{"as_of":"2026-08-07T15:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:50b28c6dfd75b1431092cdb297c7248c4dadf1eab76ca17caa4e04d0f2e42285","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:33:13.169386Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T22:25:39.474855Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":269,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:23ca499e75b7cc06ad91be4f7e5f1177f491a880572cb7e77d1b9d88675b9cf0","observation_id":"81251f2c-dffb-488b-8f22-598a5490d6d0","resolution":{"observed_at":"2026-05-12T08:40:41.589761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-07T14:33:13.169386Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18458","last_updated":"2025-06-01T16:00:34Z","snapshot_observed_at":"2026-08-07T14:28:50.871667Z","submitted_at":"2025-05-24T01:57:12Z","title":"A Survey of LLM $\\times$ DATA","version":3},"reference_index":173,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:13.169386Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2505.18458"},"observation_digest":"sha256:9a4cdb66dd201962a48fd15c244af538aebb38907e0b752c934aebb85dc2ef55","observation_id":"a300edda-669d-4cb1-8b55-df261ab2b868","resolution":{"observed_at":"2026-08-07T14:33:13.169386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-07T14:19:02.805674Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19406","last_updated":"2025-05-26T01:42:38Z","snapshot_observed_at":"2026-08-07T14:12:34.636062Z","submitted_at":"2025-05-26T01:42:38Z","title":"Unveiling the Compositional Ability Gap in Vision-Language Reasoning Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:19:02.805674Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2505.19406"},"observation_digest":"sha256:f2e10a469a64280074d1d9b8d20e6ac302f13343bf0795b23bd3edd2345baa58","observation_id":"4e063a37-5cf6-4970-b35f-34de18d07322","resolution":{"observed_at":"2026-08-07T14:19:02.805674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-07T13:02:42.962354Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22960","last_updated":"2025-06-20T03:07:38Z","snapshot_observed_at":"2026-08-07T12:54:12.759971Z","submitted_at":"2025-05-29T01:02:55Z","title":"Revisiting Multi-Agent Debate as Test-Time Scaling: A Systematic Study of Conditional Effectiveness","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:42.962354Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2505.22960"},"observation_digest":"sha256:e5778b2349c57f004404fb39e999949f9aeb7a9143d7f1a0ebcb17b17915f062","observation_id":"91b8e223-e1c5-4e6c-bfcf-6fe735e1549b","resolution":{"observed_at":"2026-08-07T13:02:42.962354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-07T12:45:30.579622Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint CoRR, abs/2501.11651, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-07T12:38:52.756749Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.579622Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:15da26f97b8c28ec992dca989fc56cb0c33c8018b72df437229902b53961188e","observation_id":"40c01fbe-6c3c-4c25-b7f8-ab428a258bfc","resolution":{"observed_at":"2026-08-07T12:45:30.579622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-07T01:08:21.609464Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11902","last_updated":"2025-06-13T15:52:37Z","snapshot_observed_at":"2026-08-07T00:58:51.821987Z","submitted_at":"2025-06-13T15:52:37Z","title":"TreeRL: LLM Reinforcement Learning with On-Policy Tree Search","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T01:08:21.609464Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2506.11902"},"observation_digest":"sha256:0abcff25b04b3beed4384c632bf856e26930393990527af28656626456f42930","observation_id":"3abbd6aa-3f04-4587-8587-14516d4153ce","resolution":{"observed_at":"2026-08-07T01:08:21.609464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-07T00:32:36.538291Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13666","last_updated":"2025-06-16T16:24:31Z","snapshot_observed_at":"2026-08-07T00:25:36.770856Z","submitted_at":"2025-06-16T16:24:31Z","title":"We Should Identify and Mitigate Third-Party Safety Risks in MCP-Powered Agent Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:32:36.538291Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2506.13666"},"observation_digest":"sha256:af1139efc0fac6913d566f151b8a37b89945120fd4724c7ba5aaceb66cdea267","observation_id":"ecd65069-43f6-4e93-b30d-fac8feff78d3","resolution":{"observed_at":"2026-08-07T00:32:36.538291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-06T21:13:12.864750Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00711","last_updated":"2025-07-01T12:14:22Z","snapshot_observed_at":"2026-08-07T07:21:03.621965Z","submitted_at":"2025-07-01T12:14:22Z","title":"Large Reasoning Models are not thinking straight: on the unreliability of thinking trajectories","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T21:13:12.864750Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2507.00711"},"observation_digest":"sha256:244d25a84183ee7984a79b5ae887495169cbe8720d7e7277b09b63119cbd3e5f","observation_id":"c480f1c5-9c68-4f25-9b8e-77c4d3e525d8","resolution":{"observed_at":"2026-08-06T21:13:12.864750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-05T20:21:06.806080Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.CoRR, abs/2501.11651, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10751","last_updated":"2025-08-14T15:34:47Z","snapshot_observed_at":"2026-08-07T12:11:52.874985Z","submitted_at":"2025-08-14T15:34:47Z","title":"Pass@k Training for Adaptively Balancing Exploration and Exploitation of Large Reasoning Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T20:21:06.806080Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2508.10751"},"observation_digest":"sha256:2c1c2f6a7c9306274ba78311f438e72c7d9d8f2cfea2411fb8aee3b1a1358a86","observation_id":"ac01cefd-0396-434f-892a-51412916c5c1","resolution":{"observed_at":"2026-08-05T20:21:06.806080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-05T20:20:54.083020Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10839","last_updated":"2025-08-14T17:05:44Z","snapshot_observed_at":"2026-08-07T07:02:18.670963Z","submitted_at":"2025-08-14T17:05:44Z","title":"Reinforced Language Models for Sequential Decision Making","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T20:20:54.083020Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2508.10839"},"observation_digest":"sha256:960dd7f36f51fd06c43e27333d17351d50f2b78426b93e89394c0d08eacc31be","observation_id":"c16c6a00-d1fe-4f2f-a93f-369528e211ca","resolution":{"observed_at":"2026-08-05T20:20:54.083020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-04T18:50:10.489926Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09629","last_updated":"2025-09-11T17:15:45Z","snapshot_observed_at":"2026-08-07T09:48:52.473972Z","submitted_at":"2025-09-11T17:15:45Z","title":"Bridging the Capability Gap: Joint Alignment Tuning for Harmonizing LLM-based Multi-Agent Systems","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T18:50:10.489926Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2509.09629"},"observation_digest":"sha256:8a7a224a4863fbf05261b49d694ceddf437b7b09d75846b4d82953f7450c0f64","observation_id":"a32a9fd8-f044-4e31-8089-d72f7c94858b","resolution":{"observed_at":"2026-08-04T18:50:10.489926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2510.02283","last_updated":"2025-10-02T17:55:42Z","snapshot_observed_at":"2026-08-02T07:40:05.046770Z","submitted_at":"2025-10-02T17:55:42Z","title":"Self-Forcing++: Towards Minute-Scale High-Quality Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T22:39:53.995700Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2510.02283"},"observation_digest":"sha256:ea8cb175c67c8213069ff77873fd5d8292c4829e1117c218758e9d8fa1691f5e","observation_id":"a12d51e4-c978-4d5f-8b2b-c7e22818bcdb","resolution":{"observed_at":"2026-05-15T22:39:54.390558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2510.05837","last_updated":"2026-04-13T12:17:34Z","snapshot_observed_at":"2026-07-06T22:31:53.944103Z","submitted_at":"2025-10-07T12:02:03Z","title":"EEPO: Exploration-Enhanced Policy Optimization via Sample-Then-Forget","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T08:53:31.803096Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2510.05837"},"observation_digest":"sha256:1348562753ee0c3b429b76ffcb693b8e9a68655fc77bc5d5cceac45ee12d5205","observation_id":"d89408a0-8077-47b2-95f1-fd431cf9722b","resolution":{"observed_at":"2026-05-18T08:56:08.697739Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2510.08141","last_updated":"2026-05-18T14:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-09T12:24:08Z","title":"SCOPE-RL: Stable and Quantitative Control of Policy Entropy in RL Post-Training","version":7},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T20:30:17.581842Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2510.08141"},"observation_digest":"sha256:75c95bf68d90333504d620153e26d06fe71e576e71b3d84230ebe969398c5e22","observation_id":"824f44cf-2477-4107-bf83-d736628ddf0d","resolution":{"observed_at":"2026-05-21T20:30:35.407585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-04T09:34:07.194227Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14807","last_updated":"2026-06-16T08:24:10Z","snapshot_observed_at":"2026-08-06T05:26:40.214370Z","submitted_at":"2025-10-16T15:40:49Z","title":"Beyond the Sampled Token: Preserving Candidate Support in RLVR","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T09:34:07.194227Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2510.14807"},"observation_digest":"sha256:c9510e88d621aaacefb68f1bfd71d4434321b067aea129289625927a9484049d","observation_id":"fbac5259-3219-4704-9dae-3d7634003ab4","resolution":{"observed_at":"2026-08-04T09:34:07.194227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-04T08:11:51.451496Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.22228","last_updated":"2026-07-20T17:30:01Z","snapshot_observed_at":"2026-08-04T08:11:48.838546Z","submitted_at":"2025-10-25T09:22:22Z","title":"When Fewer Layers Break More Chains: Layer Pruning Harms Test-Time Scaling in LLMs","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T08:11:51.451496Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2510.22228"},"observation_digest":"sha256:b6bf24a544663ce94446ab524c9e3b70853b12dbc79eaadff0a6715448a08e0a","observation_id":"caaa32b5-751e-44d1-b34d-a7d5220f2f0f","resolution":{"observed_at":"2026-08-04T08:11:51.451496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2604.14646","last_updated":"2026-04-17T11:31:53Z","snapshot_observed_at":"2026-08-02T15:11:58.102043Z","submitted_at":"2026-04-16T05:52:18Z","title":"Targeted Exploration via Unified Entropy Control for Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T10:48:27.733823Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2604.14646"},"observation_digest":"sha256:f2bf9899983bd0dbd3ac1c39f29b51cda112191b6bdaf252d840fd33dedfe9e2","observation_id":"68f8d439-e2b5-45f7-a112-384252096432","resolution":{"observed_at":"2026-05-10T10:49:56.071198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2604.17433","last_updated":"2026-06-04T22:58:20Z","snapshot_observed_at":"2026-08-02T14:45:34.175111Z","submitted_at":"2026-04-19T13:26:04Z","title":"Self-Consistency from Only Two Samples: CoT-PoT Ensembling for Efficient LLM Reasoning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-10T05:40:25.414166Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2604.17433"},"observation_digest":"sha256:833cd26d8c09159322ce3af449e6828e13ae97856d06cc4ceeacf32668ede1f9","observation_id":"f39bcd0d-440c-402f-a67a-3420cc2047bf","resolution":{"observed_at":"2026-05-10T05:41:01.943069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2605.11461","last_updated":"2026-05-18T07:36:31Z","snapshot_observed_at":"2026-07-06T23:23:16.461539Z","submitted_at":"2026-05-12T03:20:24Z","title":"Breaking $\\textit{Winner-Takes-All}$: Cooperative Policy Optimization Improves Diverse LLM Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T01:57:30.877915Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2605.11461"},"observation_digest":"sha256:7ee219286668e9bae9833016c43e3d90c92e89b6af45297532964c0daa8de9b3","observation_id":"92b1c155-540f-4788-9ef3-23d07d1f64ca","resolution":{"observed_at":"2026-05-13T02:07:09.106701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2605.11461","last_updated":"2026-05-18T07:36:31Z","snapshot_observed_at":"2026-07-06T23:23:16.461539Z","submitted_at":"2026-05-12T03:20:24Z","title":"Breaking $\\textit{Winner-Takes-All}$: Cooperative Policy Optimization Improves Diverse LLM Reasoning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T22:45:56.857810Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2605.11461"},"observation_digest":"sha256:3b51c8546fd2c789385b738a475088d892274343b099c0ac6d1283bfe6ae48db","observation_id":"b0e72bd3-cb95-465d-8f94-3ec23d0f8b01","resolution":{"observed_at":"2026-05-20T22:49:10.497847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2605.18864","last_updated":"2026-05-15T07:42:21Z","snapshot_observed_at":"2026-07-06T23:29:42.583875Z","submitted_at":"2026-05-15T07:42:21Z","title":"SAGE: Shaping Anchors for Guided Exploration in RLVR of LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-20T20:09:42.841695Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2605.18864"},"observation_digest":"sha256:4a0f29743a24c0e1d7aa9b3e3ec539b18d462d2838e805856eac59889bde5e33","observation_id":"2d79e701-e8c6-4cc7-ba42-410b598735f4","resolution":{"observed_at":"2026-05-20T20:13:44.141720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:4dd2e3cdb85b5d307b690d2be7490cf1f8efa5d9ddafc99f9b894ba06b069059","observation_id":"212e8307-e81a-479c-a1aa-106cd0950245","resolution":{"observed_at":"2026-07-08T22:25:39.476832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.11651/citation-record","integrity":"/paper/2501.11651/integrity","json":"/paper/2501.11651/citation-record.json","paper":"/paper/2501.11651"},"outbound":[],"paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T09:44:45.484509Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2501.11651."}