{"as_of":"2026-08-12T09:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:857ec6b16f297a0bcddbe6f07e8965df12d81dc39746120a69bd75e5b9cfa8b6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":78,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:02:27.628345Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":116,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-10T12:54:44.636760Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2201.11903"},"observation_digest":"sha256:73d0d78ffb948d3701650453ad1ee522155d572aea58bd6b7328dc8edaca5033","observation_id":"27972a50-4972-4b14-b15f-c54e19d62b87","resolution":{"observed_at":"2026-05-10T12:54:44.812334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-07T04:02:08.445660Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T19:04:13.778347Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2205.11916"},"observation_digest":"sha256:baa3ec4ea19f2d34d86543978f7370228785c5b56ff336fc01eb85b0b4c7b9a4","observation_id":"1cfd1bb4-fdac-4d39-abc6-ec634eb05b76","resolution":{"observed_at":"2026-05-12T19:04:13.828509Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T10:39:16.997741Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2210.03493"},"observation_digest":"sha256:4ce37a631bae838a96a3a1838eed4aeb605de2858cc51161cb264c75b0f3e847","observation_id":"a34c375e-2e54-4c94-b28c-dcb42d934fe0","resolution":{"observed_at":"2026-05-16T10:39:17.064171Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2210.11610","last_updated":"2022-10-25T17:45:17Z","snapshot_observed_at":"2026-08-09T02:27:34.152063Z","submitted_at":"2022-10-20T21:53:54Z","title":"Large Language Models Can Self-Improve","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T17:00:48.167441Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2210.11610"},"observation_digest":"sha256:864c3839264225216d867047b1fd23925ec73c1e0ef1862f7ce588a2ba1c0b6c","observation_id":"372c619b-5a54-483c-8575-3bf52d8e508d","resolution":{"observed_at":"2026-05-18T17:00:48.288535Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2211.01910","last_updated":"2023-03-10T17:20:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-03T15:43:03Z","title":"Large Language Models Are Human-Level Prompt Engineers","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-24T09:43:26.288866Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2211.01910"},"observation_digest":"sha256:121b39e3943f06f542b52e4cfbb9b1feba725898e07473e59d28fc99a2be706b","observation_id":"158d9e49-2aee-4efa-9279-0249c450767a","resolution":{"observed_at":"2026-05-24T09:43:26.366972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-24T11:10:40.864420Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2211.14275"},"observation_digest":"sha256:6c19abd36338e48f743cdcefe5a34e9234ad8bafa70856254be24db657b97d0b","observation_id":"d4598555-4857-4ccf-b926-e5aff78ea628","resolution":{"observed_at":"2026-05-24T11:14:23.222412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2305.02301","last_updated":"2023-07-05T16:59:31Z","snapshot_observed_at":"2026-07-06T15:22:55.122322Z","submitted_at":"2023-05-03T17:50:56Z","title":"Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes","version":2},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-21T20:50:09.265838Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2305.02301"},"observation_digest":"sha256:6e593508bf5ea0a3d0b96798229fb90eceea593e9750494f080ba5149b16a9b2","observation_id":"5f090305-dd52-403d-a056-a953a7a43eae","resolution":{"observed_at":"2026-05-21T20:50:09.507437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2310.03714","last_updated":"2023-10-05T17:37:25Z","snapshot_observed_at":"2026-08-04T05:21:05.846165Z","submitted_at":"2023-10-05T17:37:25Z","title":"DSPy: Compiling Declarative Language Model Calls into Self-Improving Pipelines","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-11T18:57:46.756656Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2310.03714"},"observation_digest":"sha256:5c3c29fe0e10fa241ed1fd8f8a61a846e64801e86b818da16f3b33bdec8cfb80","observation_id":"35c5dde4-5f0f-456d-ac0f-8921202c0298","resolution":{"observed_at":"2026-05-11T18:57:47.237327Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"reference_index":211,"source":"pdf_text","source_observed_at":"2026-05-17T22:58:16.523267Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2406.11794"},"observation_digest":"sha256:7f2226ca81a45cfc21fa0a51d9b4288bae9233ff3943d3638d32df9691a8f1d6","observation_id":"9f2698e6-b64f-4462-9ca1-ff2b22724cf9","resolution":{"observed_at":"2026-05-17T22:58:17.355012Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-11T20:02:27.628345Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.06176","last_updated":"2024-12-09T03:22:35Z","snapshot_observed_at":"2026-08-11T19:53:39.268432Z","submitted_at":"2024-12-09T03:22:35Z","title":"AlphaVerus: Bootstrapping Formally Verified Code Generation through Self-Improving Translation and Treefinement","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T20:02:27.628345Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2412.06176"},"observation_digest":"sha256:4f34057a8458010349b9ffa8ee2b2a39d89e8951e55b75851c5dcabd28a161cb","observation_id":"c70093c8-1a23-49cf-95bf-4e9bc9be8f71","resolution":{"observed_at":"2026-08-11T20:02:27.628345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-11T17:57:44.377903Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08347","last_updated":"2024-12-11T12:41:36Z","snapshot_observed_at":"2026-08-11T17:51:53.595686Z","submitted_at":"2024-12-11T12:41:36Z","title":"SmolTulu: Higher Learning Rate to Batch Size Ratios Can Lead to Better Reasoning in SLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T17:57:44.377903Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2412.08347"},"observation_digest":"sha256:0d49bf7a84783ef1075e9fc011251aef88febf37ec08d8579cfb61ae9eb504a9","observation_id":"c0b8700c-5a31-4222-a3ff-9c5034dab00d","resolution":{"observed_at":"2026-08-11T17:57:44.377903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-11T17:34:19.635312Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08819","last_updated":"2024-12-11T23:31:06Z","snapshot_observed_at":"2026-08-11T21:32:41.724258Z","submitted_at":"2024-12-11T23:31:06Z","title":"HARP: A challenging human-annotated math reasoning benchmark","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T17:34:19.635312Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2412.08819"},"observation_digest":"sha256:34a37b7045d53ff7d8cd4ac824217c10ce17badb2e2092c01f0f97160a6fc700","observation_id":"83c817e7-3ec0-462f-89e1-80d6044ca40f","resolution":{"observed_at":"2026-08-11T17:34:19.635312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-11T13:20:59.598559Z","title":"Zelikman, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13292","last_updated":"2025-04-10T02:11:49Z","snapshot_observed_at":"2026-08-11T18:37:57.262020Z","submitted_at":"2024-12-17T19:45:53Z","title":"Refining Answer Distributions for Improved Large Language Model Reasoning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T13:20:59.598559Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2412.13292"},"observation_digest":"sha256:899e7fa2879a5d75ca29e98a941cb43a863c22309b3a5ef81c478e305835fb96","observation_id":"a5e19c7b-f84e-4546-b05f-ac73e8b3a0b5","resolution":{"observed_at":"2026-08-11T13:20:59.598559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-10T23:21:34.728757Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.21037","last_updated":"2025-04-10T05:01:32Z","snapshot_observed_at":"2026-08-10T23:01:20.648881Z","submitted_at":"2024-12-30T16:02:44Z","title":"TangoFlux: Super Fast and Faithful Text to Audio Generation with Flow Matching and Clap-Ranked Preference Optimization","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:34.728757Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2412.21037"},"observation_digest":"sha256:b7612cf5a3e090c2ea7a7fb00cbc0a763255e153a17420a316dd635278854705","observation_id":"098672e5-dc02-45e7-be75-259d3cc2dafa","resolution":{"observed_at":"2026-08-10T23:21:34.728757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-10T22:19:55.705836Z","title":"STaR: Bootstrapping reasoning with reasoning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.02156","last_updated":"2025-01-08T14:26:51Z","snapshot_observed_at":"2026-08-10T22:12:03.285904Z","submitted_at":"2025-01-04T01:45:32Z","title":"The Race to Efficiency: A New Perspective on AI Scaling Laws","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:55.705836Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2501.02156"},"observation_digest":"sha256:63828d02c3218fc54d1ba39a588b96b1485d80f667622e81845dc72ab9743239","observation_id":"107765b1-5a2d-4ce9-a7db-3360ddbb2ce1","resolution":{"observed_at":"2026-08-10T22:19:55.705836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-10T22:17:22.508227Z","title":"& Goodman, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.02393","last_updated":"2025-03-05T13:19:16Z","snapshot_observed_at":"2026-08-12T01:16:28.083266Z","submitted_at":"2025-01-04T22:30:21Z","title":"Graph-Aware Isomorphic Attention for Adaptive Dynamics in Transformers","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T22:17:22.508227Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2501.02393"},"observation_digest":"sha256:046d30877b407b599f5fa2ca9b91004b377b90ea4f3f608b2577ebd7cb608a80","observation_id":"f87b22f3-26b0-45f2-967e-84107cd1b22e","resolution":{"observed_at":"2026-08-10T22:17:22.508227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-10T20:34:08.811472Z","title":"& Goodman, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08120","last_updated":"2025-01-14T13:52:41Z","snapshot_observed_at":"2026-08-12T07:45:14.919926Z","submitted_at":"2025-01-14T13:52:41Z","title":"In-situ graph reasoning and knowledge expansion using Graph-PReFLexOR","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T20:34:08.811472Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2501.08120"},"observation_digest":"sha256:1feab77546194b65ec88ed2cbce207c71210885eed6e478d9d4f59dd5ad9750b","observation_id":"615a11fa-8d68-476b-9486-0e5832351751","resolution":{"observed_at":"2026-08-10T20:34:08.811472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-10T19:42:22.834603Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09804","last_updated":"2025-01-16T19:23:11Z","snapshot_observed_at":"2026-08-10T20:21:04.164761Z","submitted_at":"2025-01-16T19:23:11Z","title":"Enhancing Generalization in Chain of Thought Reasoning for Smaller Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T19:42:22.834603Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2501.09804"},"observation_digest":"sha256:695d40b254e3a1e0ac8386bc764cda5e18c34c0f1b0ec01fd2941171ab1f6763","observation_id":"2e878eb3-7507-4a76-bb34-33a80df0b2c1","resolution":{"observed_at":"2026-08-10T19:42:22.834603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-10T18:05:43.201396Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-10T17:58:02.856512Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T18:05:43.201396Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2501.11651"},"observation_digest":"sha256:c6173e820daa03ee01a193412390af5a41a90eb4cf2c609486dc5b665381e060","observation_id":"95bdd860-8339-487c-9e23-35356cc67856","resolution":{"observed_at":"2026-08-10T18:05:43.201396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-09T20:47:53.657069Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.19278","last_updated":"2025-01-31T16:42:31Z","snapshot_observed_at":"2026-08-09T20:40:17.563626Z","submitted_at":"2025-01-31T16:42:31Z","title":"Pheromone-based Learning of Optimal Reasoning Paths","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T20:47:53.657069Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2501.19278"},"observation_digest":"sha256:7749b53096ef751d931009e018fc837f74892a847cd09cd11f1d326fbbe6c4b5","observation_id":"85fdba8a-1974-4145-8b1a-fe3bd2773aba","resolution":{"observed_at":"2026-08-09T20:47:53.657069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-09T17:09:15.435280Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-10T10:07:25.758530Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.435280Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:aa825fc8fc33c0a65b710e52fb7b7ca0c3011362eaf4e27391a78605e321696a","observation_id":"0e410b0d-eb4e-495a-828c-567b648cb6d6","resolution":{"observed_at":"2026-08-09T17:09:15.435280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2504.01990","last_updated":"2025-08-02T12:44:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-31T18:00:29Z","title":"Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-22T21:39:49.832151Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2504.01990"},"observation_digest":"sha256:a490f115205f1c88d3b4f57544f94659b2c7180535e08b4e8c9e1275cec3260f","observation_id":"ddf7e4dc-309e-4ffb-95fb-87970ca7f8f9","resolution":{"observed_at":"2026-05-22T21:42:10.525531Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-07T14:28:22.144115Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18933","last_updated":"2025-05-25T01:57:06Z","snapshot_observed_at":"2026-08-08T18:50:17.944017Z","submitted_at":"2025-05-25T01:57:06Z","title":"REACT: Representation Extraction And Controllable Tuning to Overcome Overfitting in LLM Knowledge Editing","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:28:22.144115Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2505.18933"},"observation_digest":"sha256:2684d98c429c5c24b800a8451f58f157df784a2246befb35f703d0fd1f4c0bf1","observation_id":"f5a69afc-cbb8-4a09-b48c-60781bb9f9d4","resolution":{"observed_at":"2026-08-07T14:28:22.144115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-07T13:05:26.000236Z","title":"STaR: Bootstrapping reasoning with reasoning.arXiv [cs.LG], 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22756","last_updated":"2025-05-28T18:18:49Z","snapshot_observed_at":"2026-08-11T16:38:12.898922Z","submitted_at":"2025-05-28T18:18:49Z","title":"Decomposing Elements of Problem Solving: What \"Math\" Does RL Teach?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:26.000236Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2505.22756"},"observation_digest":"sha256:56f89438f5c65d516bc65b627a46c7c52a777a716eec69743d7871909c686296","observation_id":"1f525c57-5dd2-417b-ad07-854da3f25b12","resolution":{"observed_at":"2026-08-07T13:05:26.000236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2505.23678","last_updated":"2026-05-15T17:27:46Z","snapshot_observed_at":"2026-08-02T04:30:21.704758Z","submitted_at":"2025-05-29T17:20:26Z","title":"Grounded Reinforcement Learning for Visual Reasoning","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-22T01:05:18.801388Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2505.23678"},"observation_digest":"sha256:5e00b6d901d862a4faa4563d10a006e9f42b014f75e5b1b4475f0aad3e23f793","observation_id":"892369a6-b9db-4d93-9e31-b98db6ec58e3","resolution":{"observed_at":"2026-05-22T01:05:51.975095Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-07T12:32:24.359399Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24273","last_updated":"2026-08-09T16:14:48Z","snapshot_observed_at":"2026-08-12T09:16:15.760517Z","submitted_at":"2025-05-30T06:49:00Z","title":"How Much Backtracking is Enough? Exploring the Interplay of SFT and RL in Enhancing LLM Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:24.359399Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2505.24273"},"observation_digest":"sha256:ff19f8ef85cf2e6be87df4f018c7668104c02127f599f50c28a68053a48e449b","observation_id":"065ddffa-ba89-4cf2-acc9-631c345c4d9f","resolution":{"observed_at":"2026-08-07T12:32:24.359399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-07T04:47:42.415670Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09659","last_updated":"2025-06-11T12:26:45Z","snapshot_observed_at":"2026-08-11T00:50:34.571807Z","submitted_at":"2025-06-11T12:26:45Z","title":"Intent Factored Generation: Unleashing the Diversity in Your Language Model","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:42.415670Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2506.09659"},"observation_digest":"sha256:2809a15d55887dd962888e5b2d89533934fb103e67ed538105d9a0bcbb16a107","observation_id":"01f99c58-477e-430c-9f17-9c7f33c41790","resolution":{"observed_at":"2026-08-07T04:47:42.415670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-06T22:01:32.043196Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22865","last_updated":"2025-06-28T12:22:55Z","snapshot_observed_at":"2026-08-07T22:26:15.164180Z","submitted_at":"2025-06-28T12:22:55Z","title":"ReasonBridge: Efficient Reasoning Transfer from Closed to Open-Source Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T22:01:32.043196Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2506.22865"},"observation_digest":"sha256:a1dbad38f5dcdc37fe75a5dc6f12fc5140301d3c1686d2a0286c10c8e829acc7","observation_id":"b1b4d621-0bde-440c-91fc-a77119a339dd","resolution":{"observed_at":"2026-08-06T22:01:32.043196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-06T21:31:50.533455Z","title":"Star: Self-taught reasoner","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23926","last_updated":"2025-06-30T14:54:52Z","snapshot_observed_at":"2026-08-08T16:04:50.807756Z","submitted_at":"2025-06-30T14:54:52Z","title":"Industrial brain: a human-like autonomous neuro-symbolic cognitive decision-making system","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:31:50.533455Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2506.23926"},"observation_digest":"sha256:9e4fc9e08fc778f987fa117110169f1e6922cbf8979b5a4cce5c3bd58af82cd5","observation_id":"76c6fe23-82fe-4fff-ba66-83610b7a47d3","resolution":{"observed_at":"2026-08-06T21:31:50.533455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-06T15:52:20.453572Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15889","last_updated":"2025-07-20T02:10:46Z","snapshot_observed_at":"2026-08-10T05:42:08.311078Z","submitted_at":"2025-07-20T02:10:46Z","title":"Dr. Boot: Bootstrapping Program Synthesis Language Models to Perform Repairing","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T15:52:20.453572Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2507.15889"},"observation_digest":"sha256:9ebfcf42188c9231b848f6f7519cf217ed8a2b5da80283184d8d5d3286110b49","observation_id":"b968a3c6-2c11-4170-a7fa-977673a0b7ca","resolution":{"observed_at":"2026-08-06T15:52:20.453572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T21:01:24.813718Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09586","last_updated":"2025-08-20T07:50:49Z","snapshot_observed_at":"2026-08-07T12:33:53.736485Z","submitted_at":"2025-08-13T07:59:29Z","title":"EvoCurr: Self-evolving Curriculum with Behavior Code Generation for Complex Decision-making","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:24.813718Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2508.09586"},"observation_digest":"sha256:e08e6ff640cec06ea1e5d2db90234dbf311590e9eb22b98a2da57a2325a95c6c","observation_id":"4708af9c-c2ad-4e8e-9407-de016763c60a","resolution":{"observed_at":"2026-08-05T21:01:24.813718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T16:32:54.654828Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.18255","last_updated":"2025-09-02T17:12:12Z","snapshot_observed_at":"2026-08-08T07:21:34.906013Z","submitted_at":"2025-08-25T17:45:06Z","title":"Hermes 4 Technical Report","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T16:32:54.654828Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2508.18255"},"observation_digest":"sha256:57826dc9e700a7a3fb8e609c508253366265c03ea96a86a72a2ca5cd75b337be","observation_id":"95d7fda6-35d8-4310-8b8d-64ed23b3fcc5","resolution":{"observed_at":"2026-08-05T16:32:54.654828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T12:41:12.241511Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01363","last_updated":"2025-09-01T11:04:51Z","snapshot_observed_at":"2026-08-11T10:08:49.277554Z","submitted_at":"2025-09-01T11:04:51Z","title":"Reasoning Vectors: Transferring Chain-of-Thought Capabilities via Task Arithmetic","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T12:41:12.241511Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2509.01363"},"observation_digest":"sha256:c57d31c3428d7942489b4aea030a266eb315ffad358d19ccef04dd7d5cce5917","observation_id":"3d30df80-2647-40c6-a5d0-46f29dbe3c45","resolution":{"observed_at":"2026-08-05T12:41:12.241511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-04T19:34:27.222058Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09193","last_updated":"2025-09-11T07:09:30Z","snapshot_observed_at":"2026-08-07T07:37:18.552922Z","submitted_at":"2025-09-11T07:09:30Z","title":"AI Reasoning for Wireless Communications and Networking: A Survey and Perspectives","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T19:34:27.222058Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2509.09193"},"observation_digest":"sha256:7593242384e3124f9f228389ed634c8cda35a01cce7d2d5a90ed97a1093a9021","observation_id":"daa89b09-542d-4f4f-889a-d96fec1ffbfa","resolution":{"observed_at":"2026-08-04T19:34:27.222058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2509.10026","last_updated":"2026-04-14T03:34:18Z","snapshot_observed_at":"2026-08-10T23:31:25.488694Z","submitted_at":"2025-09-12T07:45:44Z","title":"LaV-CoT: Language-Aware Visual CoT with Multi-Aspect Reward Optimization for Real-World Multilingual VQA","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-18T17:53:08.136677Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2509.10026"},"observation_digest":"sha256:025a0212fd4b32a6db8c2b86b6d834badad99bf6ed40d45c91398c91af0f7578","observation_id":"728028ec-8ede-4f97-8798-83dffd908a50","resolution":{"observed_at":"2026-05-18T17:56:42.196973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2509.22739","last_updated":"2026-05-15T15:16:23Z","snapshot_observed_at":"2026-07-06T22:30:55.313733Z","submitted_at":"2025-09-25T23:25:47Z","title":"Painless Activation Steering: An Automated, Lightweight Approach for Post-Training Large Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T21:44:36.351517Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2509.22739"},"observation_digest":"sha256:db927a95c2e6ce2233edf317410fcdf257ab65194b680ff1d163e7bcd313f63e","observation_id":"9e7ed1a1-ebad-46db-b704-620a64301188","resolution":{"observed_at":"2026-05-21T21:45:40.585862Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2510.16416","last_updated":"2026-05-17T05:54:56Z","snapshot_observed_at":"2026-08-02T06:39:30.995519Z","submitted_at":"2025-10-18T09:22:40Z","title":"SSL4RL: Revisiting Self-supervised Learning as Intrinsic Reward for Visual-Language Reasoning","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-21T20:24:02.748854Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2510.16416"},"observation_digest":"sha256:1675b1dab30a7162c75775b1d03c55a3f0e67821e13bfa5fe56b9db75d4074a1","observation_id":"8a6eb81b-8be2-41ec-b027-5b8c37c3bd92","resolution":{"observed_at":"2026-05-21T20:24:21.270342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-04T08:49:34.805639Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.18874","last_updated":"2026-06-26T02:22:44Z","snapshot_observed_at":"2026-08-09T10:21:52.218853Z","submitted_at":"2025-10-21T17:59:41Z","title":"Retaining by Doing: The Role of On-Policy Data in Mitigating Forgetting","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T08:49:34.805639Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2510.18874"},"observation_digest":"sha256:d99980ca7ee7e275afb087d5d019ca5cc3572cc26d55d52e53f2dcc6d08f5372","observation_id":"d8ea49d0-e1a8-43a7-ab66-18735a9bbec3","resolution":{"observed_at":"2026-08-04T08:49:34.805639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-03T22:48:12.820859Z","title":"Eric Zelikman, Yuhuai Wu, Noah D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.10687","last_updated":"2026-07-01T23:47:17Z","snapshot_observed_at":"2026-08-09T05:26:26.206076Z","submitted_at":"2025-11-11T22:21:08Z","title":"Who Gets the Reward & Who Gets the Blame? Evaluation-Aligned Training Signals for Multi-LLM Agents","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T22:48:12.820859Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2511.10687"},"observation_digest":"sha256:e7c807029af45c6039658c8929e0c0893c5e55da5008dbabca58540847dc8a09","observation_id":"fbdf2d18-0fcd-47dd-a69d-c5e64652322b","resolution":{"observed_at":"2026-08-03T22:48:12.820859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-03T13:19:47.796914Z","title":"11 Denny Zhou, Nathanael Sch ¨arli, Le Hou, Jason Wei, Nathan Scales, Xuezhi Wang, Dale Schuur- mans, Claire Cui, Olivier Bousquet, Quoc Le, and Ed Chi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.24776","last_updated":"2025-12-31T10:51:32Z","snapshot_observed_at":"2026-08-10T18:05:33.600735Z","submitted_at":"2025-12-31T10:51:32Z","title":"Compute-Accuracy Pareto Frontiers for Open-Source Reasoning Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T13:19:47.796914Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2512.24776"},"observation_digest":"sha256:6bed0723f7342077fa51bc2c49f1641164fc7f0e0a73f0d527a899320fc5864a","observation_id":"ae3794c0-49f1-492c-b743-39e80f1f4ad3","resolution":{"observed_at":"2026-08-03T13:19:47.796914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-03T08:15:36.827296Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.17717","last_updated":"2026-06-09T20:25:14Z","snapshot_observed_at":"2026-08-08T23:34:38.789355Z","submitted_at":"2026-01-25T06:40:25Z","title":"A Survey on Evaluating Quality and Trustworthiness in LLM-Generated Data","version":3},"reference_index":261,"source":"arxiv_source","source_observed_at":"2026-08-03T08:15:36.827296Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2601.17717"},"observation_digest":"sha256:8b4bb84972cb8eba33185d81c42e12f201e1a404d04823e29036fefc6800da8d","observation_id":"cfdcf71d-070c-40df-baa3-9a142d9a57a7","resolution":{"observed_at":"2026-08-03T08:15:36.827296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2604.06385","last_updated":"2026-04-07T19:16:50Z","snapshot_observed_at":"2026-08-11T12:45:01.155986Z","submitted_at":"2026-04-07T19:16:50Z","title":"Application-Driven Pedagogical Knowledge Optimization of Open-Source LLMs via Reinforcement Learning and Supervised Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T19:55:17.077281Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2604.06385"},"observation_digest":"sha256:3ea2c63f3ad1ad448807b823f8f71777827c24a70633ad6c74bc980a82402598","observation_id":"a97831fb-6223-4e7c-9989-022308f0174b","resolution":{"observed_at":"2026-05-10T22:20:49.382767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2604.21027","last_updated":"2026-08-02T16:15:42Z","snapshot_observed_at":"2026-08-10T23:41:30.183421Z","submitted_at":"2026-04-22T19:18:36Z","title":"HypEHR: Hyperbolic Modeling of Electronic Health Records for Efficient Question Answering","version":1},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-05-09T23:51:47.724033Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2604.21027"},"observation_digest":"sha256:ec0b8b9939df983732621621908bffebe6a8ee96bcf8f270e626ade4c88a3b4b","observation_id":"2b071913-6bc2-43b0-bd6a-9e5c34a95649","resolution":{"observed_at":"2026-05-09T23:54:45.375182Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2605.09315","last_updated":"2026-05-10T04:20:24Z","snapshot_observed_at":"2026-07-06T23:21:26.017420Z","submitted_at":"2026-05-10T04:20:24Z","title":"Do Self-Evolving Agents Forget? Capability Degradation and Preservation in Lifelong LLM Agent Adaptation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T04:10:31.784413Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2605.09315"},"observation_digest":"sha256:4c56efd3925d6fa117bc0a44d276d19d523eb9d379d32c4daab2afba8bdd3915","observation_id":"f005a9d1-5511-43ad-8ab9-f825bfc16b38","resolution":{"observed_at":"2026-05-12T06:31:29.362777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2605.17187","last_updated":"2026-05-16T22:52:11Z","snapshot_observed_at":"2026-07-06T23:28:12.114488Z","submitted_at":"2026-05-16T22:52:11Z","title":"PluRule: A Benchmark for Moderating Pluralistic Communities on Social Media","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-20T14:05:14.737146Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2605.17187"},"observation_digest":"sha256:b08635c2989fb848807fc52d82e70f704f4507bd5c75575b52b120ff7950fd7f","observation_id":"e701b0d5-e014-4fdd-a0bf-32bf6fbd8243","resolution":{"observed_at":"2026-05-20T14:08:20.524505Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2605.28070","last_updated":"2026-05-27T07:28:25Z","snapshot_observed_at":"2026-08-03T11:47:22.689668Z","submitted_at":"2026-05-27T07:28:25Z","title":"Bridging the Detection-to-Abstention Gap in Reasoning Models under Insufficient Information","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-29T12:37:16.138816Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2605.28070"},"observation_digest":"sha256:3fb8c9f30ececb5d6afa887ad94ebc194e79fa9f4a7d00de9dff5ae305f15c9e","observation_id":"7abf555e-b729-4a8c-9e09-2778d07ce7cc","resolution":{"observed_at":"2026-06-29T12:43:25.877063Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2605.30914","last_updated":"2026-05-29T06:59:28Z","snapshot_observed_at":"2026-08-04T08:48:12.582835Z","submitted_at":"2026-05-29T06:59:28Z","title":"Automating Formal Verification with Reinforcement Learning and Recursive Inference","version":1},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-06-28T23:52:36.891080Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2605.30914"},"observation_digest":"sha256:c6771c81a8a3fd44c02b97512d706051d5e1007fdcb9c6f5f1e50fbec81e31bd","observation_id":"cae30c5f-55bd-4e65-9809-77016b0fa686","resolution":{"observed_at":"2026-06-28T23:52:49.257858Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.00172","last_updated":"2026-05-29T13:21:30Z","snapshot_observed_at":"2026-08-12T08:51:49.914934Z","submitted_at":"2026-05-29T13:21:30Z","title":"CAST: Non-Privileged Clipped Asymmetric Self-Teaching with Advantage Flipping for GRPO","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T22:25:04.067339Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.00172"},"observation_digest":"sha256:4c44d82efbff9814b3ef87df3248cdbfd389066efeef57078296befb4f6be82c","observation_id":"58d429ef-7582-48da-95e4-9c40e303713d","resolution":{"observed_at":"2026-07-01T19:26:01.033064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.00726","last_updated":"2026-07-10T01:15:34Z","snapshot_observed_at":"2026-08-02T05:37:27.284595Z","submitted_at":"2026-05-30T13:38:06Z","title":"Latent Reward Steering: An Adaptive Inference-Time Framework that Implicitly Promotes Cognitive Behaviors in Reasoning LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-28T18:49:56.917505Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.00726"},"observation_digest":"sha256:9b6dcaf0fcfeeb2cad47f6bee4c140cb47ee24c3e6fe5a289939dfa69761b903","observation_id":"893c8d82-ed23-45eb-9537-763f5a13047b","resolution":{"observed_at":"2026-06-28T19:52:35.527408Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.02812","last_updated":"2026-06-01T19:30:07Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:30:07Z","title":"Traj-Evolve: A Self-Evolving Multi-Agent System for Patient Trajectory Modeling in Lung Cancer Early Detection","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-06-28T14:20:06.381334Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.02812"},"observation_digest":"sha256:e62f6f444c4e469d78ff335f52bf62a3291596ff60de200a9507b77e14c82de8","observation_id":"059f74fa-929e-4c01-9e0f-26a42ca34c2c","resolution":{"observed_at":"2026-06-28T14:22:17.966583Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.03503","last_updated":"2026-06-02T11:21:27Z","snapshot_observed_at":"2026-08-09T19:58:40.083423Z","submitted_at":"2026-06-02T11:21:27Z","title":"ThoughtFold: Folding Reasoning Chains via Introspective Preference Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T10:07:16.700499Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.03503"},"observation_digest":"sha256:9673b13645bf779a1ae539449a1fb979bf1372e4c2620017b741ba38b8dde3d3","observation_id":"62a23dee-e4dd-4c7c-8039-48fe40462f59","resolution":{"observed_at":"2026-07-02T03:26:28.783144Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.03938","last_updated":"2026-06-03T02:07:12Z","snapshot_observed_at":"2026-08-03T04:36:58.198458Z","submitted_at":"2026-06-02T17:27:48Z","title":"q0: Primitives for Hyper-Epoch Pretraining","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T11:07:20.239027Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.03938"},"observation_digest":"sha256:dbea11f1b8e4f1e4a0379c68ff0e534c370eedb8c08e9a583317f3a2350b9124","observation_id":"3c8277d7-240f-44e6-aeee-bbf5e83bd5b7","resolution":{"observed_at":"2026-07-02T02:16:26.600644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.05253","last_updated":"2026-06-03T14:51:33Z","snapshot_observed_at":"2026-08-01T00:36:11.076649Z","submitted_at":"2026-06-03T14:51:33Z","title":"Alpha-RTL: Test-Time Training for RTL Hardware Optimization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-28T07:11:52.187869Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.05253"},"observation_digest":"sha256:4efd18e199070ee5192bb7a16a929ac5fe18e421a9685ae6c0abcd463976107b","observation_id":"cc27747f-64d0-45c7-a4ba-e5645e9a1539","resolution":{"observed_at":"2026-07-02T07:06:44.163854Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.07006","last_updated":"2026-06-05T07:52:40Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T07:52:40Z","title":"RASFT: Rollout-Adaptive Supervised Fine-Tuning for Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T22:25:52.959859Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.07006"},"observation_digest":"sha256:0327143d72f1004e231ec43c3ec66303cfc39f24662fd041419d6fe8c4dbb23a","observation_id":"fc864530-c808-4d59-a8e7-364ccea3522d","resolution":{"observed_at":"2026-06-27T22:31:21.095267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.07856","last_updated":"2026-06-05T21:37:49Z","snapshot_observed_at":"2026-07-06T23:47:24.424525Z","submitted_at":"2026-06-05T21:37:49Z","title":"Teacher-Free Self-Training Amplifies but Does Not Compound: A Pass@$K$ Crossover on a Free-Verifier Domain","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T22:26:50.223393Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.07856"},"observation_digest":"sha256:a329a69ec5306c4d00acc002827be1f6ba62e89222f6d6ee87ea4c7b6398a3ae","observation_id":"ce642541-dcf8-427c-a219-0b6f70f1ff46","resolution":{"observed_at":"2026-07-02T16:47:09.133387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.18216","last_updated":"2026-06-16T17:46:02Z","snapshot_observed_at":"2026-08-10T09:12:54.601851Z","submitted_at":"2026-06-16T17:46:02Z","title":"Zone of Proximal Policy Optimization: Teacher in Prompts, Not Gradients","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T01:08:52.981296Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.18216"},"observation_digest":"sha256:cd442d8b6f4c2d1c324589ad6a8c9a3b93bcb1bf55fed90d0305e47dbb7c9265","observation_id":"ba262c07-4746-42d3-9b1f-53ea440e5244","resolution":{"observed_at":"2026-07-03T20:48:56.145642Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.20295","last_updated":"2026-07-24T07:54:17Z","snapshot_observed_at":"2026-08-02T10:48:55.986116Z","submitted_at":"2026-06-18T14:33:09Z","title":"Token-Operations-Oriented Inference Optimization Techniques for Large Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-26T16:15:22.543601Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.20295"},"observation_digest":"sha256:fbbb60a45afdbc553fe729fc9a313356e402af7db265e2775739098ddd46e47f","observation_id":"bf8db513-ea18-4d05-ab22-778d6c31c2ff","resolution":{"observed_at":"2026-07-04T05:09:36.765677Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-02T10:49:06.089278Z","title":"STaR: Bootstrapping Reasoning With Reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.20295","last_updated":"2026-07-24T07:54:17Z","snapshot_observed_at":"2026-08-02T10:48:55.986116Z","submitted_at":"2026-06-18T14:33:09Z","title":"Token-Operations-Oriented Inference Optimization Techniques for Large Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T10:49:06.089278Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.20295"},"observation_digest":"sha256:f18c7774d479608cd259fe83c11f2e5b8731b8a80c42a08e4367f2ec4cafadb3","observation_id":"e64d0a0e-2dac-4d20-a294-4c6db1de7d35","resolution":{"observed_at":"2026-08-02T10:49:06.089278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.21121","last_updated":"2026-06-19T05:47:44Z","snapshot_observed_at":"2026-08-04T13:33:33.678027Z","submitted_at":"2026-06-19T05:47:44Z","title":"Answer Engineering: Local Trajectory Editing for Protocol-Constrained Decision Making in Large Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-06-26T14:13:13.678245Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.21121"},"observation_digest":"sha256:4c4fad50845f5019368b0942cc330623b6ddb4c2140f167f7dfcc01a8db9819e","observation_id":"eeb465d2-f5b9-4c93-aa65-cdb29be7fb9c","resolution":{"observed_at":"2026-07-04T06:49:37.526833Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.21884","last_updated":"2026-06-20T04:52:14Z","snapshot_observed_at":"2026-08-03T01:34:19.883808Z","submitted_at":"2026-06-20T04:52:14Z","title":"A Verifiable Search Is Not a Learnable Chain-of-Thought","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T12:35:20.698118Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.21884"},"observation_digest":"sha256:a899e9e7b437c0376c6797908f993dac3f060f383b7161e352cc41c12734c9e6","observation_id":"aedefa56-fbe0-4a64-8029-8ba19e3e09db","resolution":{"observed_at":"2026-07-04T07:49:39.738079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.22992","last_updated":"2026-06-22T08:11:35Z","snapshot_observed_at":"2026-08-01T03:40:02.577381Z","submitted_at":"2026-06-22T08:11:35Z","title":"Predicate Importance Estimation and Decoupled Rationale-Score Distillation for Entity Alignment","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-26T08:20:40.103291Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.22992"},"observation_digest":"sha256:fe0e8b18940b09ded375f1d31f36370558087b5e30632c8071141b2e8ac336cd","observation_id":"aca80cec-9e8e-4879-8047-9f3d68e290b2","resolution":{"observed_at":"2026-07-04T10:59:45.786178Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":1},"reference_index":237,"source":"pdf_text","source_observed_at":"2026-06-26T08:09:57.542558Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:d85ef8adaffcd136ec08401a03c0e7e627ce21b13172bd577c7a1e93dd231d0f","observation_id":"3e46aecf-0cf8-4d71-b63f-f1c35633e556","resolution":{"observed_at":"2026-07-04T11:09:46.297246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-02T10:27:18.541929Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":2},"reference_index":223,"source":"pdf_text","source_observed_at":"2026-08-02T10:27:18.541929Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:816212b73a4cdb4d58059d5ff6f9213eba9e498be9427dbc82643fd315e18f97","observation_id":"4e597057-e393-4389-8958-e42466445bd6","resolution":{"observed_at":"2026-08-02T10:27:18.541929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.30775","last_updated":"2026-06-29T18:06:43Z","snapshot_observed_at":"2026-07-07T00:04:34.491408Z","submitted_at":"2026-06-29T18:06:43Z","title":"A Single Rewrite Suffices: Empirical Lessons from Production Skill Description Optimization","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-07-01T02:32:19.425550Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.30775"},"observation_digest":"sha256:1f5c539b9b145be14279590335d4c65499a4d208db16f32bd67f739bdbc38107","observation_id":"67354744-947c-4b16-8c84-534c775db013","resolution":{"observed_at":"2026-07-01T12:05:43.632415Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2606.32017","last_updated":"2026-07-17T21:52:23Z","snapshot_observed_at":"2026-08-03T01:04:24.359983Z","submitted_at":"2026-06-30T17:48:07Z","title":"TRIAGE: Role-Typed Credit Assignment for Agentic Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-01T06:07:43.151474Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.32017"},"observation_digest":"sha256:fdb4fd57653411a84b944af0f6adf884405796b13399e4965acf5389993d10ee","observation_id":"0b57a894-9ec3-44c0-97d6-833917e6e1ef","resolution":{"observed_at":"2026-07-01T09:55:40.404010Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-07-12T10:00:13.340163Z","title":"Griffiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.32017","last_updated":"2026-07-17T21:52:23Z","snapshot_observed_at":"2026-08-03T01:04:24.359983Z","submitted_at":"2026-06-30T17:48:07Z","title":"TRIAGE: Role-Typed Credit Assignment for Agentic Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T10:00:13.340163Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.32017"},"observation_digest":"sha256:33ee5eba760a7bbe73449e9431b029e659e79e7dd93a7f836ebbbf727ea6e053","observation_id":"96acdead-44b0-49de-b2b1-4c220803133d","resolution":{"observed_at":"2026-07-12T10:00:13.340163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-02T09:22:58.367083Z","title":"Griffiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.32017","last_updated":"2026-07-17T21:52:23Z","snapshot_observed_at":"2026-08-03T01:04:24.359983Z","submitted_at":"2026-06-30T17:48:07Z","title":"TRIAGE: Role-Typed Credit Assignment for Agentic Reinforcement Learning","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T09:22:58.367083Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2606.32017"},"observation_digest":"sha256:01c3a305d33ff7f4b963e134788a521dd222d9dc1c1a221d0b5bd49eb050ca32","observation_id":"a56046dc-e476-42d3-8e4c-51db1b262b62","resolution":{"observed_at":"2026-08-02T09:22:58.367083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2607.02460","last_updated":"2026-07-02T17:27:24Z","snapshot_observed_at":"2026-08-04T03:32:05.841423Z","submitted_at":"2026-07-02T17:27:24Z","title":"Neuron-Aware Data Selection for Annotation-Free LLM Self-Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-03T16:26:21.011177Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.02460"},"observation_digest":"sha256:346514515753cd8d24547586df4df3f93f7554ff3165dfb7245b820bea1d2e8e","observation_id":"80caf142-b748-4707-b813-e00671bcdb7b","resolution":{"observed_at":"2026-07-03T16:28:38.310374Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2607.07646","last_updated":"2026-07-08T17:04:42Z","snapshot_observed_at":"2026-08-08T04:35:50.018550Z","submitted_at":"2026-07-08T17:04:42Z","title":"RL Post-Training Builds Compositional Reasoning Strategies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-09T04:04:13.942267Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.07646"},"observation_digest":"sha256:49143966edbad80fcae09072c30daf49a57b70012badf5f9e4071e65f6cdbdc7","observation_id":"94236739-64e4-4465-84ec-8c5cb5f8ea07","resolution":{"observed_at":"2026-07-09T04:05:55.483803Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":"2203.14465","doi":"10.48550/arxiv.2203.14465","metadata_source":"pith","pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wu, andN.D.Goodman","venue":"cs.LG","work_id":"3339dfe0-b229-41ec-a6e0-8f601080eb97","year":2022},"citing_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-08-11T21:54:55.410559Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-09T03:36:57.168246Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.07663"},"observation_digest":"sha256:f194c676e41803b0da3974f1039a702d086b5a83bf984fff4edc321d02c5bf59","observation_id":"a9c5853f-9068-42f0-8b00-fb7ae44110c8","resolution":{"observed_at":"2026-07-09T03:45:55.603171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:15.019726+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-07-14T17:25:37.713857Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09709","last_updated":"2026-06-23T13:47:41Z","snapshot_observed_at":"2026-08-04T12:23:53.502733Z","submitted_at":"2026-06-23T13:47:41Z","title":"The Verifier is the Curriculum: Execution-Gated Self-Distillation for Cross-Family Game Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T17:25:37.713857Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.09709"},"observation_digest":"sha256:cb3b6b9a369e27990a6a33894f684cb3fca881ad89dbab98413b7c3889adc813","observation_id":"3bcbd7c6-b923-48f4-bb29-5bad160f98c5","resolution":{"observed_at":"2026-07-14T17:25:37.713857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-02T02:16:39.943018Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15314","last_updated":"2026-08-04T04:26:54Z","snapshot_observed_at":"2026-08-08T15:06:49.295115Z","submitted_at":"2026-07-15T22:05:23Z","title":"Cura 1T: Specialized Model for Agentic Healthcare","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T02:16:39.943018Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.15314"},"observation_digest":"sha256:42e5be2a35103b052325e84c246832d67abd8bed84ac7131bd23fe3d895dcd5d","observation_id":"3d707d09-6d39-4dc0-8f9f-d8ecbb16ff40","resolution":{"observed_at":"2026-08-02T02:16:39.943018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-01T11:35:16.183416Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19845","last_updated":"2026-07-22T07:30:39Z","snapshot_observed_at":"2026-08-10T20:41:10.900892Z","submitted_at":"2026-07-22T07:30:39Z","title":"Sentence Splitter: Uncovering Latent Factual Structure for Self-Supervised Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T11:35:16.183416Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.19845"},"observation_digest":"sha256:ae70592dfe3d8a6c02efedc20bf2182be73e5ddb51997f7cd436e9eaa99363a2","observation_id":"6a99286f-2c1f-4f36-bed8-ea932ceb693b","resolution":{"observed_at":"2026-08-01T11:35:16.183416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-01T08:09:46.708320Z","title":", year = 2022, month = may, number =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21220","last_updated":"2026-07-23T11:37:49Z","snapshot_observed_at":"2026-08-05T03:50:14.721040Z","submitted_at":"2026-07-23T11:37:49Z","title":"Search Hardness-Aware LLM-Based Problem Formulation for Expensive Simulation-Driven Design","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T08:09:46.708320Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.21220"},"observation_digest":"sha256:7b6a11ab8b3f9672c21bca9b97fdcef2a0225f5ea7e3f2cf7dd62b9c4c32f440","observation_id":"04005985-c066-4551-bb82-cd9ead0da713","resolution":{"observed_at":"2026-08-01T08:09:46.708320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-01T10:23:23.080738Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-11T02:19:29.595764Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:23.080738Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:b4c64579385f592589aa01a0a11668e9d594056875fb5d809db580608fb56fec","observation_id":"d8115288-2739-4d6f-823e-a760abed4ec1","resolution":{"observed_at":"2026-08-01T10:23:23.080738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-07-31T06:41:19.974754Z","title":", year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28460","last_updated":"2026-07-30T16:22:13Z","snapshot_observed_at":"2026-08-08T15:54:46.171579Z","submitted_at":"2026-07-30T16:22:13Z","title":"Cybersecurity Detection Classification with Reasoning-enabled Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-31T06:41:19.974754Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.28460"},"observation_digest":"sha256:f5cc3156b46d4613bb673111f496c018a21c252409df972b090b3c16e0f8ccec","observation_id":"033b29ac-0c7c-4b17-a759-82c8c0d9b50b","resolution":{"observed_at":"2026-07-31T06:41:19.974754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-08T19:13:05.247668Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04355","last_updated":"2026-08-05T01:55:33Z","snapshot_observed_at":"2026-08-11T17:43:03.713926Z","submitted_at":"2026-08-05T01:55:33Z","title":"The Calibration Floor: Format Repair Can Masquerade as Self-Correction at Small-to-Mid Scale","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T19:13:05.247668Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2608.04355"},"observation_digest":"sha256:03e84db4d3eedf31b402a9775b1b4ec5d5e3e7efc61091865f29f4dd93446818","observation_id":"5c4ea6e0-ba34-4337-88a8-ad951046ea03","resolution":{"observed_at":"2026-08-08T19:13:05.247668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-07T10:19:43.516621Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06296","last_updated":"2026-08-09T12:07:45Z","snapshot_observed_at":"2026-08-12T09:15:01.000689Z","submitted_at":"2026-08-06T17:18:23Z","title":"On-Policy Self-Distillation without Any Supervision","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:43.516621Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2608.06296"},"observation_digest":"sha256:0cd1067ef4955378cbee12ccb1fec3053c01b002f86d877857c63a1ec82a1dca","observation_id":"e37b18b6-0199-485d-863f-ee6df588524a","resolution":{"observed_at":"2026-08-07T10:19:43.516621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2203.14465/citation-record","integrity":"/paper/2203.14465/integrity","json":"/paper/2203.14465/citation-record.json","paper":"/paper/2203.14465"},"outbound":[],"paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T03:08:42.211484Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 78 inbound Pith citation observations for arXiv:2203.14465."}