{"as_of":"2026-08-07T09:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c57abe7357d4dd7f26a6a2c970a70331982a4d5470a111423efdc634400a3a79","coverage":[{"denominator":265,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T21:20:07.238992Z","state":"measured"},{"denominator":103,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":103,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T08:35:09.009897Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T08:35:33.342217Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2504.02181","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.02181","snapshot_observed_at":"2026-07-01T08:35:33.342217Z","title":"A Survey of Scaling in Large Language Model Reasoning","venue":"cs.AI","work_id":"4257f345-a552-494e-95c1-50d14c42b438","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2504.02181","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:1bdb41346c2957249a664f14a7d8b084e401eb22912c36fd682e87c0f743846b","observation_id":"c1176bd8-16cb-4712-9bbd-06447b91b84e","resolution":{"observed_at":"2026-05-12T08:40:41.940442Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2504.02181","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.02181","snapshot_observed_at":"2026-07-01T08:35:33.342217Z","title":"A Survey of Scaling in Large Language Model Reasoning","venue":"cs.AI","work_id":"4257f345-a552-494e-95c1-50d14c42b438","year":2025},"citing_paper":{"arxiv_id":"2507.13334","last_updated":"2025-07-21T17:48:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-17T17:50:36Z","title":"A Survey of Context Engineering for Large Language Models","version":2},"reference_index":167,"source":"pdf_text","source_observed_at":"2026-05-13T20:58:45.060041Z"},"links":{"cited_paper":"/paper/2504.02181","citing_paper":"/paper/2507.13334"},"observation_digest":"sha256:9e1c52f31e0e29d00a0b763db6ea0a29e56715a7384963db50b13bdc68af39b2","observation_id":"c9e92fa3-d902-4cbd-b88f-4bca7635fb6b","resolution":{"observed_at":"2026-05-13T20:58:45.466222Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2504.02181","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.02181","snapshot_observed_at":"2026-07-01T08:35:33.342217Z","title":"A Survey of Scaling in Large Language Model Reasoning","venue":"cs.AI","work_id":"4257f345-a552-494e-95c1-50d14c42b438","year":2025},"citing_paper":{"arxiv_id":"2606.23695","last_updated":"2026-04-29T15:38:24Z","snapshot_observed_at":"2026-07-29T15:44:55.641561Z","submitted_at":"2026-04-29T15:38:24Z","title":"Quantifying Prior Dominance in RAG Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-01T08:35:09.009897Z"},"links":{"cited_paper":"/paper/2504.02181","citing_paper":"/paper/2606.23695"},"observation_digest":"sha256:321823f9c0ed9f650552218736f1684981ab9156ced87bb3ce3871ef257e8dbc","observation_id":"6b762dfc-c7d8-4da3-9a5d-b5464226ed6e","resolution":{"observed_at":"2026-07-01T08:35:33.343635Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.02181/citation-record","integrity":"/paper/2504.02181/integrity","json":"/paper/2504.02181/citation-record.json","paper":"/paper/2504.02181"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b573c86d-2561-4d4f-a55c-d2d2e2f5e0a4","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:a2dff318de545fc0d5d64e135c21b5234ab6a25f46425e430cfb6326b94953de","observation_id":"3d1ecf94-a01e-4e52-80e4-1e436ff10bf3","resolution":{"observed_at":"2026-05-22T21:22:10.314456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b4d9c98f-ce50-48fe-8bbe-b0e8a3c30eaa","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:33c2aee9fd5bbecb2e6ea3a7319a2be50ea261240f8c8fc361d50fccbfa12347","observation_id":"21ff7433-45e3-458f-92f5-5240f640411a","resolution":{"observed_at":"2026-05-22T21:22:10.302305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14740","last_updated":"2024-02-26T18:26:25Z","snapshot_observed_at":"2026-07-06T17:34:07.737296Z","submitted_at":"2024-02-22T17:52:34Z","title":"Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs","version":2},"cited_work":{"arxiv_id":"2402.14740","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.14740","snapshot_observed_at":"2026-07-09T08:56:06.435604Z","title":"Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs","venue":"cs.LG","work_id":"7bb8f9ec-1241-4472-a4fa-c636c6d79892","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2402.14740","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:179d3cb5fc08975cb53303282ed9c39bc6d65f0c0b2006b91c246c4471f8e4d0","observation_id":"c64f43c6-e0f2-4c65-b1c5-268342ce4e4e","resolution":{"observed_at":"2026-05-22T21:22:09.509264Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09798","last_updated":"2024-03-14T18:36:04Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:36:04Z","title":"Comparing Rationality Between Large Language Models and Humans: Insights and Open Questions","version":1},"cited_work":{"arxiv_id":"2403.09798","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09798","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"08e7d428-ed68-4113-8729-92d6aa66208a","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2403.09798","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:538604bd606049783c4e802bf89ce87f69d71797573e30fa9209402955da1bfc","observation_id":"8d6dba17-85ae-4b32-920e-7d112aa8bfc7","resolution":{"observed_at":"2026-05-22T21:22:09.129785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":"1606.06565","doi":"10.48550/arxiv.1606.06565","metadata_source":"pith","pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Concrete Problems in AI Safety","venue":"cs.AI","work_id":"c8d14fbe-6eab-464a-95b3-778aabd82fa3","year":2016},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:7db9101fcae948d1d3236290c1d990bbbcaecd5291e23b1ef701267a26bd64f7","observation_id":"70eebbb4-6f26-418e-b8ed-a7d5af244f48","resolution":{"observed_at":"2026-05-22T21:22:09.470182Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-13T23:49:52.215761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T23:49:52.215761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16926","last_updated":"2025-05-28T07:02:54Z","snapshot_observed_at":"2026-07-06T20:11:42.361400Z","submitted_at":"2024-12-22T08:55:19Z","title":"Revisiting In-Context Learning with Long Context Language Models","version":3},"cited_work":{"arxiv_id":"2412.16926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.16926","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7ee2432b-5d6c-4258-9948-77808e6f35af","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2412.16926","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:2d40b6b6ad6f31bfa2a1d810394bfa04a54d8fb61c19bd74444aac36aaf6db73","observation_id":"ee2e7284-731f-4b64-88f5-d71ee45b270c","resolution":{"observed_at":"2026-05-22T21:22:08.847660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f30ed216-72e6-46b3-bf76-7a8b6444d384","year":2015},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:50bf52d6ebf4251779fc003e00d3f7e7dce275ad5dc3553d303406cfa2b33f77","observation_id":"461b9cde-ab26-4bed-b39e-08c8f5bf26e6","resolution":{"observed_at":"2026-05-22T21:22:10.252006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00200","last_updated":"2025-03-03T19:53:28Z","snapshot_observed_at":"2026-08-04T16:59:22.807968Z","submitted_at":"2024-04-30T21:06:52Z","title":"In-Context Learning with Long-Context Models: An In-Depth Exploration","version":2},"cited_work":{"arxiv_id":"2405.00200","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00200","snapshot_observed_at":"2026-07-03T09:17:48.381748Z","title":"Gormley, and Graham Neubig","venue":null,"work_id":"16af75a7-d946-4ab5-a85c-1a423767113b","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2405.00200","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:cd396443dbe62d076694f1da4d96edd8095704ac18b300ec0c1096be66586066","observation_id":"5275f3a5-7e67-4f71-a5c5-1327ad322fb0","resolution":{"observed_at":"2026-05-22T21:22:09.498310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8f351d5b-cad6-4555-b540-279e84a05dba","year":2022},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:0985c7b2fe46965bb315457a180c37a73a080bab94b13e13a54372439c0e1d0c","observation_id":"ea69f26d-fba4-4e46-8669-07b0b146d682","resolution":{"observed_at":"2026-05-22T21:22:10.244634Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"100ca77b-a564-47f7-8c6c-3ecafe5374db","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:bcc9c3011d5f0600234bb71daa6bba5743b5ff22f0e8dbe459c55a1a2190d700","observation_id":"fb7899a0-4996-4c8c-bffd-3113b5eb1a17","resolution":{"observed_at":"2026-05-22T21:22:10.241285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:27c4304f709dcf4a7844f48acb5862ca946740dce22ea6ae1b77d9cc154d39b2","observation_id":"8806c47c-1293-408d-aeb7-56ed79f389bf","resolution":{"observed_at":"2026-05-22T21:22:09.405178Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"951cb6e2-2d17-4acd-b617-d2a64f7dbd72","year":2020},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:4a1c29f39f234b72111bb542ebfca967692888d1aae24b8831fb2f27d58e8d84","observation_id":"c74935bf-61d3-4014-9a6b-8026f032c74b","resolution":{"observed_at":"2026-05-22T21:22:10.230613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02690","last_updated":"2023-07-05T23:26:01Z","snapshot_observed_at":"2026-07-06T15:50:49.116859Z","submitted_at":"2023-07-05T23:26:01Z","title":"Scaling In-Context Demonstrations with Structured Attention","version":1},"cited_work":{"arxiv_id":"2307.02690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02690","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6ba88b6f-e129-4041-a976-898facd2bf1d","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2307.02690","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:103cdefb431e65d796ab06abf1a8d4b050e94cff4db33e4e43743c6372e8d27e","observation_id":"c0e29111-f78a-43c6-bd13-7b3da753a302","resolution":{"observed_at":"2026-05-22T21:22:09.166055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17126","last_updated":"2024-03-11T01:15:09Z","snapshot_observed_at":"2026-08-05T01:49:57.023215Z","submitted_at":"2023-05-26T17:50:11Z","title":"Large Language Models as Tool Makers","version":2},"cited_work":{"arxiv_id":"2305.17126","doi":"10.48550/arxiv.2305.17126","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models as tool makers","venue":"arXiv (Cornell University)","work_id":"1447b78e-0a79-4af6-8cd4-93220e680d2b","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2305.17126","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:b391e7b42369fbcc14520a6ef785f82777bbe112f6953d902a803349ad1d4ab0","observation_id":"090dc59d-8ec3-45a8-bfa8-d9f641d6097a","resolution":{"observed_at":"2026-05-22T21:22:08.776396Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9ef12e7b-cb8e-48bf-921f-1aa63a36a56a","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:2229d21990aef4b27bc6f11ea20ee2cf19833382edf039ba060b004052d09814","observation_id":"bb326f58-45ad-4dcf-950d-ec355d3ec111","resolution":{"observed_at":"2026-05-22T21:22:10.202504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00051","last_updated":"2017-04-28T03:53:14Z","snapshot_observed_at":"2026-07-06T05:36:07.769337Z","submitted_at":"2017-03-31T20:39:10Z","title":"Reading Wikipedia to Answer Open-Domain Questions","version":2},"cited_work":{"arxiv_id":"1704.00051","doi":null,"metadata_source":"pith","pith_arxiv_id":"1704.00051","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reading Wikipedia to Answer Open-Domain Questions","venue":"cs.CL","work_id":"7c368acd-6e32-499b-8b06-12678d71945c","year":2017},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/1704.00051","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:44e3a77b80868973163a7225d9d46b73648a309d06f3c78a564946cc8ef3d643","observation_id":"675e1d1d-ac39-4bfc-80ff-a3863c0a37f4","resolution":{"observed_at":"2026-05-22T21:22:09.106608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":"2412.18925","doi":"10.48550/arxiv.2412.18925","metadata_source":"pith","pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","venue":"cs.CL","work_id":"56766c95-7f7b-4db7-8563-f6df210ecdd1","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:6322898be5793c0bfd2f22edb65f8187ea225647478f897136cb72f14f65bf15","observation_id":"0163a8d1-76d5-4036-812b-affbe3fdd77e","resolution":{"observed_at":"2026-05-22T21:22:08.741033Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01600","last_updated":"2025-03-08T05:23:57Z","snapshot_observed_at":"2026-07-06T20:30:26.881629Z","submitted_at":"2025-02-03T18:35:42Z","title":"Reinforcement Learning for Long-Horizon Interactive LLM Agents","version":3},"cited_work":{"arxiv_id":"2502.01600","doi":"10.48550/arxiv.2502.01600","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01600","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reinforcement learning for long-horizon interactive llm agents","venue":"ArXiv.org","work_id":"7e929792-6a2a-42ff-a1db-763f890d8b4e","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2502.01600","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:d30ce0e258e4a8a874ebfc2bbe5efc3264b05059722f2dfa466a1217ecd1bec1","observation_id":"e4bb1187-2562-46e3-9dc3-335f6fe88efa","resolution":{"observed_at":"2026-05-22T21:22:09.374887Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"67ad7d0d-f249-4441-a673-dd1232cffbbd","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:d492d8f1f2062997e24e3c46816cf22f9ba2b8039663d2c726f8824fc93439f5","observation_id":"1339b975-6add-41a7-a0f5-5e03e1ac59c8","resolution":{"observed_at":"2026-05-22T21:22:10.180280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:4ae33bfa97c6d64776e8107994958ac5dceda1fdf471537077974d2e891881d7","observation_id":"7395c582-b1bb-42db-8ccb-348b67f51284","resolution":{"observed_at":"2026-05-22T21:22:09.395451Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13614","last_updated":"2023-05-23T02:25:01Z","snapshot_observed_at":"2026-07-06T15:31:05.250637Z","submitted_at":"2023-05-23T02:25:01Z","title":"LLM-empowered Chatbots for Psychiatrist and Patient Simulation: Application and Evaluation","version":1},"cited_work":{"arxiv_id":"2305.13614","doi":"10.48550/arxiv.2305.13614","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13614","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zhu, Kunyao Lan, Zhiling Zhang, and Lyuchun Cui","venue":"arXiv (Cornell University)","work_id":"06fcc97f-6bc6-4d66-9f0c-f34b3f399199","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2305.13614","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:43e6bb1bd4fc975377a83e866215fb10121910c7b36a17cc2fdb56c2bb91068d","observation_id":"bf62d06d-dc3d-44d2-90e3-1695ebee2ee2","resolution":{"observed_at":"2026-05-22T21:22:09.246635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":"2412.21187","doi":"10.48550/arxiv.2412.21187","metadata_source":"pith","pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","venue":"cs.CL","work_id":"d79f8b7d-560d-4fbd-bd70-4d084f6d9ad6","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:383d0e378602231bee9ff912d4399297bf9cff05a1741681b126fc20fd2c6a88","observation_id":"b520749e-ca3f-4cc1-b3c4-9a1c407015fe","resolution":{"observed_at":"2026-05-22T21:22:09.006698Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13842","last_updated":"2025-02-23T04:31:53Z","snapshot_observed_at":"2026-07-06T20:39:15.111209Z","submitted_at":"2025-02-19T16:02:23Z","title":"Inner Thinking Transformer: Leveraging Dynamic Depth Scaling to Foster Adaptive Internal Thinking","version":2},"cited_work":{"arxiv_id":"2502.13842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.13842","snapshot_observed_at":"2026-07-03T00:17:29.491839Z","title":"Inner thinking transformer: Leveraging dynamic depth scaling to foster adaptive internal thinking","venue":null,"work_id":"78225604-9e4a-4234-bc26-eb72213c1199","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2502.13842","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:b8fb4fa4418120aab3fb12d5678f77c21b06b290b752ff327cc7efee1531ba34","observation_id":"48fefaeb-12ac-4066-8bc2-c68ae83f8a61","resolution":{"observed_at":"2026-05-22T21:22:09.171274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00273","last_updated":"2023-11-01T03:49:52Z","snapshot_observed_at":"2026-07-06T16:41:31.021679Z","submitted_at":"2023-11-01T03:49:52Z","title":"SoulChat: Improving LLMs' Empathy, Listening, and Comfort Abilities through Fine-tuning with Multi-turn Empathy Conversations","version":1},"cited_work":{"arxiv_id":"2311.00273","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00273","snapshot_observed_at":"2026-07-03T23:09:01.532048Z","title":"Soulchat: Im- proving llms’ empathy, listening, and comfort abilities through fine-tuning with multi-turn empathy conversa- tions.ArXiv, abs/2311.00273","venue":null,"work_id":"4bb17088-c0c6-4974-ac27-f34e154a0aed","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2311.00273","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:c23fa12e0c38ad4a04207f3900cfc8c3a649188fd9dcfd5a14e5311e2fc894a7","observation_id":"d7a738cf-6525-4186-b1e9-d70d979fe702","resolution":{"observed_at":"2026-05-22T21:22:09.224878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16079","last_updated":"2023-11-27T18:49:43Z","snapshot_observed_at":"2026-07-06T16:53:18.275859Z","submitted_at":"2023-11-27T18:49:43Z","title":"MEDITRON-70B: Scaling Medical Pretraining for Large Language Models","version":1},"cited_work":{"arxiv_id":"2311.16079","doi":"10.48550/arxiv.2311.16079","metadata_source":"pith","pith_arxiv_id":"2311.16079","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MEDITRON-70B: Scaling Medical Pretraining for Large Language Models","venue":"cs.CL","work_id":"37ffc476-9077-4c41-90a1-c647f41682d7","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2311.16079","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:73f3293ad58a1c11cc4c2bc589e1104e4283816ebd22dd778a69ba6e7c1b079f","observation_id":"76118bf6-9682-47c1-8501-8142d7d4721f","resolution":{"observed_at":"2026-05-22T21:22:08.711160Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d2fa7d1d-04ad-478f-a641-f4366ae457b1","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:38ef0133e816a09f796b974093500c18f9fce86c650cd3de25cc9113b037bdc3","observation_id":"ceedceba-423e-480c-8ff8-2cade7c70811","resolution":{"observed_at":"2026-05-22T21:22:10.131111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cf4626a2-26da-4402-8da6-08246c25c6cb","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:bb0427a75239235759b988164b01c6bbc94001187e1e405d5ad6205fece9e07c","observation_id":"d75a4784-6da8-46b7-bbfc-4744f1b49112","resolution":{"observed_at":"2026-05-22T21:22:10.188437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13401","last_updated":"2024-07-07T05:03:53Z","snapshot_observed_at":"2026-07-06T18:17:46.369537Z","submitted_at":"2024-05-22T07:21:32Z","title":"TrojanRAG: Retrieval-Augmented Generation Can Be Backdoor Driver in Large Language Models","version":4},"cited_work":{"arxiv_id":"2405.13401","doi":"10.48550/arxiv.2405.13401","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.13401","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trojanrag: Retrieval-augmented genera- tion can be backdoor driver in large language mod- els","venue":"arXiv (Cornell University)","work_id":"5befd644-96f9-4d91-a699-11fc8e99930c","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2405.13401","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:3ccc50dbfd3721b5adcb317632777db1a7f6fe5fe16898115a2e3c272bd62f39","observation_id":"a1f203df-f4ad-43ae-9ad1-8c54591dac1f","resolution":{"observed_at":"2026-05-22T21:22:08.830637Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04381","last_updated":"2025-06-06T10:43:14Z","snapshot_observed_at":"2026-07-06T20:47:51.382034Z","submitted_at":"2025-03-06T12:33:20Z","title":"TRACT: Regression-Aware Fine-tuning Meets Chain-of-Thought Reasoning for LLM-as-a-Judge","version":2},"cited_work":{"arxiv_id":"2503.04381","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.04381","snapshot_observed_at":"2026-07-02T22:17:26.263855Z","title":null,"venue":null,"work_id":"83e5e8ca-2805-4865-81f0-89d9046d3c95","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2503.04381","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:ea0d0f4ff48dbbfe3b5547f190e2aa9df0648e911826e07e9eeec82642d10cad","observation_id":"79087c8e-b017-49e2-a76d-a51d583a5245","resolution":{"observed_at":"2026-05-22T21:22:09.241208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"cited_work":{"arxiv_id":"2501.17161","doi":"10.48550/arxiv.2501.17161","metadata_source":"pith","pith_arxiv_id":"2501.17161","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","venue":"cs.AI","work_id":"258dd934-025c-47f5-b4f6-5a0c1c338cc6","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2501.17161","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:adca92f361656776cd7cd230b22ca2febcdee1e72330b8d99f9e5961645cb037","observation_id":"bbb48d40-aff3-44f4-8519-63e9d4d362f8","resolution":{"observed_at":"2026-05-22T21:22:08.728695Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:42.961784+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:42.961784+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6cd3c97c-3f44-4f19-a8b9-e4e29d6bdbc9","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:5d3316a113c39522fe3a20ca3b9820533e6adf1035419b18b2c7b3b2bd15463d","observation_id":"74c993f4-a3e0-4595-9116-4dfb3794c4ea","resolution":{"observed_at":"2026-05-22T21:22:10.113211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Journal of Machine Learning Research 25, 70 (2024), 1–53","venue":null,"work_id":"1faf90c7-800c-4084-a540-e00c42b0cf99","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:1fd9005f76ebab6ff460a374115ae1a0601b120f0905d159567f2011de6f4d5c","observation_id":"41311be0-6faf-4d54-ac97-f62f77419bec","resolution":{"observed_at":"2026-05-22T21:22:10.109088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"efc64150-c62a-4c78-a3a0-acd4b876c74d","year":2020},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:79830d992b5a9ea01239f3f62cf93da2a0ffecedcb72e4f72b73b63dc1d982ec","observation_id":"9aa075b6-5358-4ce3-9a1e-5beadc8adf7b","resolution":{"observed_at":"2026-05-22T21:22:10.177191Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01460","last_updated":"2023-11-02T17:59:49Z","snapshot_observed_at":"2026-08-05T13:45:13.159592Z","submitted_at":"2023-11-02T17:59:49Z","title":"Implicit Chain of Thought Reasoning via Knowledge Distillation","version":1},"cited_work":{"arxiv_id":"2311.01460","doi":"10.48550/arxiv.2311.01460","metadata_source":"pith","pith_arxiv_id":"2311.01460","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2311.01460 , year=","venue":"cs.CL","work_id":"9fdf9899-15b3-4c02-93fb-f7bb42f8f2d6","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2311.01460","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:d44fd946bfacddce8f0b46605d6f8288ad2adcd42bdf2a49d79407b4f46e39a5","observation_id":"7690a114-1d12-4590-a5bf-c6b6c503f257","resolution":{"observed_at":"2026-05-22T21:22:08.770536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"68c47c3c-efc6-41ad-a3fa-c4b41017924b","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:d1f03be05be1ce7405f9d699ad29373cc545376249c21e972aa9d9a9f7130e7a","observation_id":"5e8b1d34-d0ff-465d-923f-86503f312d25","resolution":{"observed_at":"2026-05-22T21:22:10.080614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"79bfd9d5-0a0a-45e6-9d38-d32562ee1ace","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:1aaad589cd285387e5bdb6a2401ea37c0a9793c2a4e2be37387456a10460c6f4","observation_id":"1b41703e-1996-4582-91c1-8b60f6f7471a","resolution":{"observed_at":"2026-05-22T21:22:10.137968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.10978","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:03.434165Z","title":"Agentic llm framework for adaptive decision discourse","venue":null,"work_id":"5d7f78d2-c8a6-40fa-8ed8-ac3d8d899878","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:6289c4384ee845ca9b681611531f252255019bfaa47b11202b2b2af3ede999bc","observation_id":"fe06efe5-d144-4c7f-8fa5-bffec20c7ff5","resolution":{"observed_at":"2026-05-22T21:22:09.161187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"468fb0cb-dee9-408f-8c0f-9979d81729eb","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:997ad0f71b91b42ef8e68e32e7049418c293bd45d513abf16a9e5b329c4aeecd","observation_id":"9de56b95-e3d4-4a7f-bbcb-9d0e65a20b28","resolution":{"observed_at":"2026-05-22T21:22:10.067599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9b291863-c084-4085-afe5-99ce8b966568","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:4ef2c57d1ae383114cca55b028b48f07c4cc297d3ae5f3aea88c3cd830cdc759","observation_id":"ce044c07-2bca-49c0-a9c5-b1e24cbea18c","resolution":{"observed_at":"2026-05-22T21:22:10.064266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6989d69b-676b-432b-ab2b-e41de99b172e","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:3fb695a0e8dabc848d524db22710d1e83b6187c459c4ad151777530e025e1dad","observation_id":"e15697cd-58a5-42d5-a51f-3098fe031b3d","resolution":{"observed_at":"2026-05-22T21:22:10.077332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"26df094f-0969-4501-8977-b3b482165143","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:091e77a00cfc7a5845d306ed94f365b316e72f9c1632c21508c55dcad128031f","observation_id":"f4d1c5dc-a926-467d-a049-f96cd9737e36","resolution":{"observed_at":"2026-05-22T21:22:10.040194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09742","last_updated":"2024-06-28T03:11:48Z","snapshot_observed_at":"2026-08-06T16:34:49.000585Z","submitted_at":"2024-02-15T06:46:48Z","title":"AI Hospital: Benchmarking Large Language Models in a Multi-agent Medical Interaction Simulator","version":4},"cited_work":{"arxiv_id":"2402.09742","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.09742","snapshot_observed_at":"2026-07-01T09:55:40.453086Z","title":"Ai hospital: Benchmarking large language models in a multi-agent medical interaction simulator","venue":null,"work_id":"90338bcb-def1-4eba-94a0-4a69b13fd05c","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2402.09742","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:0446f2d5aa4b1881399ee8144770d4b2cad6f2a1df1fae44c25bfddc121a1e06","observation_id":"89d6027a-0986-455c-9000-fd762434b75c","resolution":{"observed_at":"2026-05-22T21:22:09.176472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01135","last_updated":"2024-02-02T04:20:13Z","snapshot_observed_at":"2026-07-06T17:24:08.607859Z","submitted_at":"2024-02-02T04:20:13Z","title":"A Multi-Agent Conversational Recommender System","version":1},"cited_work":{"arxiv_id":"2402.01135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.01135","snapshot_observed_at":"2026-07-04T12:09:48.846846Z","title":"A Multi-Agent Conversational Recommender System.arXiv preprint arXiv:2402.01135, 2024","venue":null,"work_id":"5282a4f5-438a-4599-9b03-52042801cc6a","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2402.01135","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:402de4e26d67f60efc1d4bb7a84602d636b3a517c5c11644b018f35341e3d077","observation_id":"0061fd63-7717-43b9-b1c3-ffaebff3e5ba","resolution":{"observed_at":"2026-05-22T21:22:09.192454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07961","last_updated":"2023-05-16T21:21:46Z","snapshot_observed_at":"2026-07-06T15:26:50.277211Z","submitted_at":"2023-05-13T16:40:07Z","title":"Leveraging Large Language Models in Conversational Recommender Systems","version":2},"cited_work":{"arxiv_id":"2305.07961","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.07961","snapshot_observed_at":"2026-07-03T14:58:32.769100Z","title":"Leveraging large language models in conversational recommender systems","venue":null,"work_id":"a7190e5e-4fe7-4837-be84-703253a65d5d","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2305.07961","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:7edf4a58dc261fb80908f5276c9b6c1ca707ca869058e16a8fc65e0b66cb9b35","observation_id":"d88f8c49-840f-4f07-81ae-4c0ec4f92594","resolution":{"observed_at":"2026-05-22T21:22:09.083891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18845","last_updated":"2025-06-04T08:36:19Z","snapshot_observed_at":"2026-07-06T20:42:51.341508Z","submitted_at":"2025-02-26T05:31:44Z","title":"Sliding Window Attention Training for Efficient Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.18845","doi":"10.48550/arxiv.2502.18845","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.18845","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sliding window attention training for efficient large language models","venue":"ArXiv.org","work_id":"bfaf1468-70be-4e01-9473-42ce5e715f51","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2502.18845","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:c79a5cf98151bfba5a168dd27c9b8aedbbcf909c3a331c9ed20426194be18bf3","observation_id":"fa2d1f11-e831-4cc3-8e84-d63eab42fe7e","resolution":{"observed_at":"2026-05-22T21:22:08.801191Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00353","last_updated":"2025-03-01T05:05:24Z","snapshot_observed_at":"2026-08-04T21:48:26.348803Z","submitted_at":"2025-03-01T05:05:24Z","title":"U-NIAH: Unified RAG and LLM Evaluation for Long Context Needle-In-A-Haystack","version":1},"cited_work":{"arxiv_id":"2503.00353","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00353","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e0c69f2a-664f-40db-9948-f9dca19ba1b4","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2503.00353","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:363c869794d54d56408900783109dddacfba082623ef30f8390df1dc818dfcee","observation_id":"e3ec0b30-336d-4794-9424-41fd728a6e8c","resolution":{"observed_at":"2026-05-22T21:22:08.853374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"793b90ba-ef71-4e99-bf6c-68f92f364a1c","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:0fd12907d22af70f3921e738d7698a9dc31f39ac8371d374b9ae123cbd79e7b0","observation_id":"08049154-e517-4423-b60e-3a4235a971de","resolution":{"observed_at":"2026-05-22T21:22:10.457228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7ac5ebf1-1d60-4cb7-ab95-b4d0e72ec41c","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:09d9bb56c5348d1ac559c1b3f2f36b64bf2811c5eb56e2dad0d745b27ccdf30b","observation_id":"bd15afa7-4e77-4fed-aec1-d9aee7874e70","resolution":{"observed_at":"2026-05-22T21:22:10.450036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"cited_work":{"arxiv_id":"2502.05171","doi":"10.1016/0041-5553(81)90075-6","metadata_source":"pith","pith_arxiv_id":"2502.05171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","venue":"cs.LG","work_id":"1ee7474f-a930-486e-897c-207b8755f2c9","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2502.05171","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:d56f831964b785ed79c0119e24c90001eaf8518c506de1724a68f438547de7cf","observation_id":"65aa1c9b-04b2-4a42-8d03-26db744c506a","resolution":{"observed_at":"2026-05-22T21:22:08.835995Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1b7b148e-aa87-4269-9f68-27b718ffd335","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:356421871d7e50723ba5f5e7b1091b27144d76eb25a293c4f6d96f06f093a1dd","observation_id":"a19c3976-6e74-4402-aa44-4b6ff959c04b","resolution":{"observed_at":"2026-05-22T21:22:10.437058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11738","last_updated":"2024-02-21T12:59:21Z","snapshot_observed_at":"2026-07-31T18:12:14.483728Z","submitted_at":"2023-05-19T15:19:44Z","title":"CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing","version":4},"cited_work":{"arxiv_id":"2305.11738","doi":"10.48550/arxiv.2305.11738","metadata_source":"pith","pith_arxiv_id":"2305.11738","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing","venue":"cs.CL","work_id":"dcdfa0ce-7ed4-4614-acd9-8bdbf491fc26","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2305.11738","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:55870dff47c67f392ed9fa183f0d1c1ceaf8ed0d112ea3b60d2f1bda0e63b438","observation_id":"46d45b8a-78c4-40d1-bb43-cf67e5770f93","resolution":{"observed_at":"2026-05-22T21:22:08.818983Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:37.02582+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:37.02582+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:1cfdcbe836d8fbd2e0da575c6f2e13c1741851eeba22399335a8552df5418262","observation_id":"bd97f8b2-89f7-4e8c-93fe-d37092050f0b","resolution":{"observed_at":"2026-05-22T21:22:09.055779Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01680","last_updated":"2024-04-19T01:15:16Z","snapshot_observed_at":"2026-08-06T19:10:15.466826Z","submitted_at":"2024-01-21T23:36:14Z","title":"Large Language Model based Multi-Agents: A Survey of Progress and Challenges","version":2},"cited_work":{"arxiv_id":"2402.01680","doi":"10.48550/arxiv.2402.01680","metadata_source":"pith","pith_arxiv_id":"2402.01680","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Model based Multi-Agents: A Survey of Progress and Challenges","venue":"cs.CL","work_id":"fb905249-ea5f-4765-80f0-2428ea66f15f","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2402.01680","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:2190c922e3db2514920e1dc236ccce80e3bd7485168f47aeee2a55c5b59eb84c","observation_id":"f916478f-19a4-4258-8c19-62a0fb7117dc","resolution":{"observed_at":"2026-05-22T21:22:09.328967Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T17:15:09.749304Z","title":null,"venue":null,"work_id":"b8a1b071-436f-45f3-9314-08d5cadbf4a0","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:4b8f2089723e947c83545804b20341243aead6128f3f54c096a6797ebb92fe04","observation_id":"f5755f86-2d3b-47e0-be50-f450c6b2a3ae","resolution":{"observed_at":"2026-05-22T21:22:10.417158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In International confer- ence on machine learning","venue":null,"work_id":"933a0629-e7f7-4bc8-8295-f2ec495dd19b","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:6b1b0bf82fb9ead1b21b04ab2554478a72b5dce3d037c86ba387d347b3497bb7","observation_id":"16237b5e-0a18-4d72-8942-aa327d699252","resolution":{"observed_at":"2026-05-22T21:22:10.413400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":"2412.06769","doi":"10.48550/arxiv.2412.06769","metadata_source":"pith","pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","venue":"cs.CL","work_id":"3ddd0fd2-c176-408f-9b58-0666c2707f2d","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:7dd85146f41e37c0646c0e2e549766b32e07bda2a4692d7884e8f3e47b0b9416","observation_id":"ea15f9b6-59c1-4188-918b-536c27a73f19","resolution":{"observed_at":"2026-05-22T21:22:09.344442Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:44.826594+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:44.826594+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06713","last_updated":"2022-12-13T16:31:21Z","snapshot_observed_at":"2026-07-06T14:30:08.686540Z","submitted_at":"2022-12-13T16:31:21Z","title":"Structured Prompting: Scaling In-Context Learning to 1,000 Examples","version":1},"cited_work":{"arxiv_id":"2212.06713","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.06713","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structured prompting: Scaling in-context learning to 1,000 examples","venue":null,"work_id":"70cea7cc-d17c-44be-b84b-ab7043209445","year":2022},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2212.06713","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:bd3a405d307d8d3c2582a0c7d982938f7d653e4172e65f67102704ebd0661b40","observation_id":"28ce86d2-f281-4e86-88fb-8132e564bfc9","resolution":{"observed_at":"2026-05-22T21:22:08.947253Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fa7bc1d0-676d-4024-86ea-51e8ece16184","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:b1ff8949e399291799cfc4105dd5eea5d6126740b60f2ead498daa6745b2db47","observation_id":"b3d13ba6-fec2-4c4b-99e7-deb0ab509a2a","resolution":{"observed_at":"2026-05-22T21:22:10.402498Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10071","last_updated":"2023-06-13T10:55:29Z","snapshot_observed_at":"2026-07-06T14:32:48.360720Z","submitted_at":"2022-12-20T08:24:45Z","title":"Large Language Models Are Reasoning Teachers","version":2},"cited_work":{"arxiv_id":"2212.10071","doi":"10.48550/arxiv.2212.10071","metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10071","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Models Are Reasoning Teachers.arXiv preprint arXiv:2212.10071 2022","venue":"arXiv (Cornell University)","work_id":"7fbbb4f1-7e3e-40ed-bcca-8ba6d789b36b","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2212.10071","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:66839789e588e165d6643ccf3ea6bfe6689900dca73ac10d57bdd2518aa9b803","observation_id":"fd3f89ec-db34-4c16-8850-d4c00b0748e8","resolution":{"observed_at":"2026-05-22T21:22:09.360185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-07-06T16:01:07.532053Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":"2308.00352","doi":"10.48550/arxiv.2308.00352","metadata_source":"pith","pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","venue":"cs.AI","work_id":"891b9780-a800-4e3c-bba0-53597ab8dc98","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:5a6d3754023d8fd1282d48306433b66ef992eb95f10728051a1fa5d26f35e352","observation_id":"4cfaec74-32f0-4ff0-bc5c-47d1880cfa36","resolution":{"observed_at":"2026-05-22T21:22:08.952449Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06000","last_updated":"2024-12-08T17:19:48Z","snapshot_observed_at":"2026-07-06T20:03:29.510169Z","submitted_at":"2024-12-08T17:19:48Z","title":"Does RLHF Scale? Exploring the Impacts From Data, Model, and Method","version":1},"cited_work":{"arxiv_id":"2412.06000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.06000","snapshot_observed_at":"2026-07-02T11:46:56.157502Z","title":"Does RLHF Scale? Exploring the Impacts From Data, Model, and Method","venue":null,"work_id":"c991f832-ce59-4145-9b34-7410189776a0","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2412.06000","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:c416167a8bcb355f45617ee49ff8f883f1a32570a979c94acca1fc77dadd0c5f","observation_id":"5edfe7af-59b4-4fac-a5d5-af2457690eb9","resolution":{"observed_at":"2026-05-22T21:22:09.100904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-02T05:27:47.490711Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":"2501.03262","doi":"10.48550/arxiv.2501.03262","metadata_source":"pith","pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","venue":"cs.CL","work_id":"557f9e99-cb00-4dd2-92fd-67ddcddbb35d","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:689bff28405e2dc1cb91df456d7996050880ef3b0615a37bfa2e618b91c315f7","observation_id":"fc1017a8-151f-4dd1-91a1-23308a8b958e","resolution":{"observed_at":"2026-05-22T21:22:09.380118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:52:56.973979+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:52:56.973979+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06458","last_updated":"2025-01-11T07:10:23Z","snapshot_observed_at":"2026-08-07T08:07:31.851127Z","submitted_at":"2025-01-11T07:10:23Z","title":"O1 Replication Journey -- Part 3: Inference-time Scaling for Medical Reasoning","version":1},"cited_work":{"arxiv_id":"2501.06458","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.06458","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 Replication Journey–Part 3: Inference-time Scaling for Medical Reasoning","venue":null,"work_id":"e8aa099f-f23f-4fcd-a16c-03c513476897","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2501.06458","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:ddc55951146f06bf45847df8742dad820db597cd198cd25d921513c08aa9aa17","observation_id":"27cae4e0-e004-4edc-807b-eac5f8acefa3","resolution":{"observed_at":"2026-05-22T21:22:09.454226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ec5e4712-345d-41e1-9448-c8aa9fcc76fb","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:0580a1813930f4468ee454c9519beaeceacea5680fba9e19ce0726db2f10e39f","observation_id":"a454aa83-2ff1-4918-8983-0d51f55992c7","resolution":{"observed_at":"2026-05-22T21:22:10.388961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:9badd210854a4f33354651e9bb4fe862336dd3c866f0fdaa3025dd37a2811efc","observation_id":"6a066174-9168-4cb0-b197-bdb1bb7b3283","resolution":{"observed_at":"2026-05-22T21:22:08.995753Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0e340100-1418-4011-b4aa-50a02ecb7dff","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:d6e591b2ae407ac0af3be3e1cf36e851ee832d2b4d6bbf3ecf80b5a428982e04","observation_id":"dcd0d35e-1e49-49ea-bc0a-c5f8d1ed843f","resolution":{"observed_at":"2026-05-22T21:22:10.382092Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14110","last_updated":"2025-08-08T11:56:30Z","snapshot_observed_at":"2026-08-02T10:24:11.927887Z","submitted_at":"2024-11-21T13:18:03Z","title":"Feedback-Guided Extraction of Knowledge Base from Retrieval-Augmented LLM Applications","version":2},"cited_work":{"arxiv_id":"2411.14110","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.14110","snapshot_observed_at":"2026-07-04T14:09:53.298273Z","title":"arXiv preprint arXiv:2411.14110 , year=","venue":null,"work_id":"876fc002-910d-43c1-ad7f-a363165d2d9d","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2411.14110","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:85d4f693cbbf83f2a15d0336d5f24d2bb032cd1d2c326b707b2f7ac66840dd44","observation_id":"ba73458c-46e0-449c-a172-0012277e0c68","resolution":{"observed_at":"2026-05-22T21:22:09.400785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12025","last_updated":"2025-02-17T16:57:56Z","snapshot_observed_at":"2026-08-03T19:45:16.676191Z","submitted_at":"2025-02-17T16:57:56Z","title":"SafeChain: Safety of Language Models with Long Chain-of-Thought Reasoning Capabilities","version":1},"cited_work":{"arxiv_id":"2502.12025","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.12025","snapshot_observed_at":"2026-07-01T08:55:35.552681Z","title":"Safechain: Safety of language models with long chain-of-thought reasoning capabilities","venue":null,"work_id":"99fb5b54-7b9b-4c81-8804-f8f01386b344","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2502.12025","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:e3c126dd8169f5a7bb48182fd14fa294947753c267bd2ac2dcddb661d8c6c700","observation_id":"e9b87ba3-cb91-401b-ae3e-c91b1dfe7eb9","resolution":{"observed_at":"2026-05-22T21:22:08.979508Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-07-29T20:40:25.374189Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":"2406.00515","doi":"10.48550/arxiv.2406.00515","metadata_source":"pith","pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on Large Language Models for Code Generation","venue":"cs.CL","work_id":"7d829146-3160-44c7-9ce4-4201ed9b654c","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:57834b39d6ad0890b1390b68578cb97a4a90cf162d6349101216f19150e84f6a","observation_id":"296f6d6b-2ffd-4b5a-9495-e1a3c5c74be0","resolution":{"observed_at":"2026-05-22T21:22:09.230153Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T06:49:11.204487+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T06:49:11.204487+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15319","last_updated":"2024-09-01T17:21:18Z","snapshot_observed_at":"2026-08-06T21:07:15.533962Z","submitted_at":"2024-06-21T17:23:21Z","title":"LongRAG: Enhancing Retrieval-Augmented Generation with Long-context LLMs","version":3},"cited_work":{"arxiv_id":"2406.15319","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15319","snapshot_observed_at":"2026-07-03T14:38:28.944024Z","title":"Longrag: Enhancing retrieval-augmented generation with long-context llms","venue":null,"work_id":"d03e79d3-0f0e-4e3b-9a34-5ca75c82b80a","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2406.15319","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:a676da99fe63c6b840e7a991b6ebd55dd02d9328b741d8b3cbdd9787a3b98b47","observation_id":"35ea2063-c611-40ee-8950-db416cbf987a","resolution":{"observed_at":"2026-05-22T21:22:09.207818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"51709fa4-4923-46ba-9f05-75917ceb4d7f","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:ee01aa40ff8deb9d3338d6ca3c84cbc24740f1d28d4dc769fdf823a33eaf982e","observation_id":"bdce46fe-c04c-4e6a-a53f-d14043478091","resolution":{"observed_at":"2026-05-22T21:22:10.359529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a9e119f1-3507-4001-985e-2ecc76fcc310","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:a2d267f18d398dcd4b42671ed277dc0099787c6d157182cc2658a5899d925cae","observation_id":"8deac156-da47-45e0-b479-b6ede4ff291f","resolution":{"observed_at":"2026-05-22T21:22:10.353449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:df983a711cf7aafeb79aab44c451dadd9e7e4585011256ab6518f573ee2e2542","observation_id":"3d01b7e6-ea9d-4d9c-9583-79610d868e0d","resolution":{"observed_at":"2026-05-22T21:22:09.259984Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa813a57-13d9-4da9-bc8d-c0a7aa6bb3ce","year":2020},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:76d03a41369b2748f6839d6acc64e3d25d11c8b2ab50844528e4a3c8a08ef55f","observation_id":"17b8b28a-5cad-4495-a643-0e9c7287528b","resolution":{"observed_at":"2026-05-22T21:22:10.347352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04622","last_updated":"2024-07-12T16:38:12Z","snapshot_observed_at":"2026-08-02T16:31:30.812187Z","submitted_at":"2024-07-05T16:29:15Z","title":"On scalable oversight with weak LLMs judging strong LLMs","version":2},"cited_work":{"arxiv_id":"2407.04622","doi":"10.48550/arxiv.2407.04622","metadata_source":"pith","pith_arxiv_id":"2407.04622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Siegel, János Kramár, Jonah Brown-Cohen, Samuel Albanie, Jannis Bulian, Rishabh Agarwal, David Lindner, Yunhao Tang, Noah D","venue":"cs.LG","work_id":"a04390e1-d3d7-43e4-87d0-2c6b25780063","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2407.04622","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:5f95dbfe341d371c0361f16a8025403f4813775c74e0c3ec868271ffe154bf51","observation_id":"fe47977d-0797-4bdf-9880-d6f2f97de9b2","resolution":{"observed_at":"2026-05-22T21:22:09.323611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"82eb652f-2529-4e10-ad1a-7b0836ad6987","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:bb1e4982939d01c9fccc38e299749f25a986dd64e34a2c076ab53cf382b41a11","observation_id":"670fcdd4-f431-4864-ade9-70c64403338d","resolution":{"observed_at":"2026-05-22T21:22:10.341055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"16730698-8ae6-4f3b-8b9f-b491aacf2501","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:931404b69e1a5aa29abd9507ad75275dc197bfa9f012d361db0847fc75176d7b","observation_id":"1c9ff720-38ab-4e9e-ab89-d674d412b1de","resolution":{"observed_at":"2026-05-22T21:22:10.220107Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"50fd2053-b98f-466e-9851-57a07267de35","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:feb9123891b0422b78b7c63a187466070e996ddc4efe963522d730519bc4cad9","observation_id":"e5c18a69-201e-4ce7-9004-323ddbd78f97","resolution":{"observed_at":"2026-05-22T21:22:10.333182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03796","last_updated":"2025-03-07T08:06:15Z","snapshot_observed_at":"2026-07-06T20:47:23.647914Z","submitted_at":"2025-03-05T14:33:18Z","title":"Human Implicit Preference-Based Policy Fine-tuning for Multi-Agent Reinforcement Learning in USV Swarm","version":2},"cited_work":{"arxiv_id":"2503.03796","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.03796","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"750e1f81-e384-4276-91d8-7dfbafd99392","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2503.03796","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:1eb216bc02ce7defc405d52b4b186f8f44666988fdd3a44dd029e78284fe1659","observation_id":"6e38f73c-36e8-4f19-a155-76af83f1f4b4","resolution":{"observed_at":"2026-05-22T21:22:09.218918Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.08082","last_updated":"2022-06-16T10:52:13Z","snapshot_observed_at":"2026-07-06T13:21:31.756267Z","submitted_at":"2022-06-16T10:52:13Z","title":"Self-Generated In-Context Learning: Leveraging Auto-regressive Language Models as a Demonstration Generator","version":1},"cited_work":{"arxiv_id":"2206.08082","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.08082","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-generated in-context learning: Leveraging auto-regressive language models as a demonstration generator","venue":null,"work_id":"a15ea148-39d7-469c-abb8-48eacb725f29","year":2022},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2206.08082","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:5c960c70878d1630e1a689a2a9fa1045de748b788be4d803f08402ad9db41d94","observation_id":"47943f11-022f-4da2-a191-9f1339aadd19","resolution":{"observed_at":"2026-05-22T21:22:08.925526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"97ba6b2b-b323-41ee-8187-2489e6bbcd74","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:01c6bc5b33d5187132f782ba056082029f087847d3a9880b0ea6f4f59eb3390a","observation_id":"39bc49d5-f654-46b3-bbde-1128ca0e7343","resolution":{"observed_at":"2026-05-22T21:22:10.318348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems 37 (2024), 79410–79452","venue":null,"work_id":"ef145493-d665-4ef4-bc44-0ca0efef9634","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:2a1bba57c1fffe6cb1e51ab4e24c73fb77a9d1d297f3b818f77c78582bda563f","observation_id":"4697bfd0-429c-469f-b23f-1594e78fb83a","resolution":{"observed_at":"2026-05-22T21:22:10.310480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"05ecae2d-76b2-497f-a497-f529c1bf507a","year":2022},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:98474212747aa8879f17e4f70fd9fc2c44123914f2a1975770310bba7a3b01eb","observation_id":"6b425419-ad0a-48d8-9215-f5047af6627b","resolution":{"observed_at":"2026-05-22T21:22:10.306331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06625","last_updated":"2024-02-09T18:57:08Z","snapshot_observed_at":"2026-07-06T17:28:06.332906Z","submitted_at":"2024-02-09T18:57:08Z","title":"Understanding the Effects of Iterative Prompting on Truthfulness","version":1},"cited_work":{"arxiv_id":"2402.06625","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06625","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Understanding the effects of iterative prompting on truthfulness","venue":null,"work_id":"bc22033d-6bad-49b8-8204-3629c36ab9f9","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2402.06625","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:393d2ca0932180f526cf888d9fe5d5093dfdacd7e625e14699d55c8ac347bc94","observation_id":"4defa957-ee38-4bf7-88bf-7fe8e9ab6fce","resolution":{"observed_at":"2026-05-22T21:22:08.887136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.02542","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T19:58:53.649523Z","title":"Overthink: Slowdown attacks on reasoning llms","venue":null,"work_id":"66563fc1-564b-48e3-994f-4a091f2885c6","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:07d5e05ce6cfe5dd42aedf3afb408efbcb235ad0a1a628ebaf51e12247e2106e","observation_id":"47fe58b2-2d95-4b29-9aee-57fbd154bb4e","resolution":{"observed_at":"2026-05-22T21:22:09.140630Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21321","last_updated":"2025-03-24T09:34:38Z","snapshot_observed_at":"2026-07-06T20:44:35.837721Z","submitted_at":"2025-02-28T18:59:54Z","title":"LLM Post-Training: A Deep Dive into Reasoning Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.21321","doi":"10.48550/arxiv.2502.21321","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.21321","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"ArXiv.org","work_id":"4c10bffb-560d-4de2-9f8e-b3290faa7d18","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2502.21321","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:a429ebf9e695283e3b46d6d66d645c99403491b14cff66554026ff94e9ab3fc2","observation_id":"84a65939-9faa-4e51-b4b4-2bae29577fd1","resolution":{"observed_at":"2026-05-22T21:22:09.504234Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12893","last_updated":"2025-02-27T01:32:58Z","snapshot_observed_at":"2026-08-05T21:26:59.220214Z","submitted_at":"2025-02-18T14:29:12Z","title":"H-CoT: Hijacking the Chain-of-Thought Safety Reasoning Mechanism to Jailbreak Large Reasoning Models, Including OpenAI o1/o3, DeepSeek-R1, and Gemini 2.0 Flash Thinking","version":2},"cited_work":{"arxiv_id":"2502.12893","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.12893","snapshot_observed_at":"2026-07-04T03:59:33.729006Z","title":"H-cot: Hijacking the chain-of-thought safety reasoning mechanism to jailbreak large reasoning models, including openai o1/o3, deepseek-r1, and gemini 2.0 flash thinking","venue":null,"work_id":"f81fb5a7-37c8-4bd2-9d6d-f1ba88504d78","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2502.12893","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:08670425c59f392095fd0f50d370a0ba62c8317ce733ac20e38fc35042b48a1f","observation_id":"73469dd1-e9df-4b99-84b8-a45efbbf4850","resolution":{"observed_at":"2026-05-22T21:22:09.135337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15073","last_updated":"2026-05-26T11:54:36Z","snapshot_observed_at":"2026-07-06T18:49:38.316515Z","submitted_at":"2024-07-21T06:21:47Z","title":"Multi-Agent Causal Discovery Using Large Language Models","version":4},"cited_work":{"arxiv_id":"2407.15073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15073","snapshot_observed_at":"2026-06-29T17:33:45.259899Z","title":"Multi-agent causal discovery using large language models","venue":"cs.AI","work_id":"b1c140a8-5e7a-42b0-9ded-079b8de0842d","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2407.15073","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:7379f6c9ba7c2e5676f976f50cd869ad2ad1379720318cf1e7fe3e56b405da89","observation_id":"93d8fe24-4734-45ac-95c3-ef3c3b90dc81","resolution":{"observed_at":"2026-05-27T02:05:00.588917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10684","last_updated":"2024-12-14T05:06:43Z","snapshot_observed_at":"2026-07-06T20:06:57.159160Z","submitted_at":"2024-12-14T05:06:43Z","title":"Inference Scaling for Bridging Retrieval and Augmented Generation","version":1},"cited_work":{"arxiv_id":"2412.10684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.10684","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"72124a05-27ed-4ebf-b5a6-ab4abda2ccfe","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2412.10684","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:272a62b2d378563584df6f5b099960c076d3f83eaeec85b102073d7113a2cc6d","observation_id":"a9c2f343-49d7-47b4-903c-5875d588a237","resolution":{"observed_at":"2026-05-22T21:22:09.312768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"879dc561-632e-41a7-b80b-1f7b1035c9fe","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:6b2c63cef607cf4a957e5b136c8fb82ad7a1ff7d26cf43fb9bb67533e1b8c805","observation_id":"cf5c1308-0075-4412-b1f4-7cc62ff40bef","resolution":{"observed_at":"2026-05-22T21:22:10.273686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06932","last_updated":"2025-08-22T21:40:07Z","snapshot_observed_at":"2026-08-01T19:30:09.814788Z","submitted_at":"2025-01-12T21:00:50Z","title":"Harnessing Large Language Models for Disaster Management: A Survey","version":2},"cited_work":{"arxiv_id":"2501.06932","doi":"10.48550/arxiv.2501.06932","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.06932","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2501.06932 (2025)","venue":"arXiv (Cornell University)","work_id":"70dbbb53-2894-4d55-bb5b-e0b09a51f4c6","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2501.06932","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:a65db5063772dbeea359104f709081fcc6f325b79800a9f9804510df5b157d4f","observation_id":"0f164dff-0bad-439c-9255-aa3e1a446d28","resolution":{"observed_at":"2026-05-22T21:22:08.764590Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"80ae7627-7e1e-4294-813f-256f65a6b4fe","year":2020},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:e7317b68b3b2b35d96dd56db11ce84c673cbe45a1863844ddb76e6c057b033a5","observation_id":"08c425f3-eb8f-43ae-8f35-43089d417208","resolution":{"observed_at":"2026-05-22T21:22:10.262870Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.16594","doi":"10.48550/arxiv.2411.16594","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From generation to judg- ment: Opportunities and challenges of llm-as-a-judge","venue":"arXiv (Cornell University)","work_id":"6654304a-22e0-4b16-93cf-36e7fc38ae5a","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:98b8b2f554cdc76caf48551a1802329fbc60105bff89fb4e475408e9616e0988","observation_id":"656fe646-9998-44a9-afbe-34bad594332e","resolution":{"observed_at":"2026-05-22T21:22:08.788678Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:26.997979+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:26.997979+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"37a47658-5ac7-4c15-beaf-d74227e15019","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:051637f2ee9c6ed3ae10eea64620c433a68a7360318e4150e0e6e9dabe76549c","observation_id":"fb7d6aac-fb2f-49b4-9359-6623d2a82992","resolution":{"observed_at":"2026-05-22T21:22:10.248267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18174","last_updated":"2024-12-24T05:22:33Z","snapshot_observed_at":"2026-07-06T20:12:35.886724Z","submitted_at":"2024-12-24T05:22:33Z","title":"INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent","version":1},"cited_work":{"arxiv_id":"2412.18174","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18174","snapshot_observed_at":"2026-07-04T20:40:08.185850Z","title":"Investor- bench: A benchmark for financial decision-making tasks with llm-based agent","venue":null,"work_id":"c00980ce-0d3c-482b-918f-adc4a33a253e","year":2025},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2412.18174","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:9b2ecdc221012185c82f5a2731a2643876a726ee42cfa32615645cc2736aa25d","observation_id":"d4442445-3340-4eb0-b89c-21c0f3028ba4","resolution":{"observed_at":"2026-05-22T21:22:08.963610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10998","last_updated":"2023-05-24T09:35:39Z","snapshot_observed_at":"2026-08-03T20:47:10.812215Z","submitted_at":"2023-05-18T14:20:32Z","title":"The Web Can Be Your Oyster for Improving Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.10998","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.10998","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems 33 (2020), 9459–9474","venue":null,"work_id":"035d6a9b-7d65-4da8-88ad-d4cbd666e5f1","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2305.10998","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:ca8f6a3cc5352ce83222c8e1868fa10c1ae8cc3348cf4879ba196fc15493b5ba","observation_id":"5e8a3a82-cc13-4dd8-b2d9-82c906fa1ca2","resolution":{"observed_at":"2026-05-22T21:22:09.186902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04931","last_updated":"2023-02-09T20:53:12Z","snapshot_observed_at":"2026-07-06T14:50:14.766783Z","submitted_at":"2023-02-09T20:53:12Z","title":"In-Context Learning with Many Demonstration Examples","version":1},"cited_work":{"arxiv_id":"2302.04931","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.04931","snapshot_observed_at":"2026-07-03T09:17:48.381940Z","title":"arXiv preprint arXiv:2302.04931 , year=","venue":null,"work_id":"6a83bddf-add2-4c02-a01c-0c0a17c1091f","year":2023},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2302.04931","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:4c590b2ac4cd0c4d4a15e4686c6baa391166359795b181735d6671d827ee12f2","observation_id":"2123d773-c803-4469-8979-8c304932ed28","resolution":{"observed_at":"2026-05-22T21:22:09.443530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00570","last_updated":"2025-05-05T09:49:56Z","snapshot_observed_at":"2026-07-06T17:53:35.219482Z","submitted_at":"2024-03-31T05:56:15Z","title":"ParaICL: Towards Parallel In-Context Learning","version":2},"cited_work":{"arxiv_id":"2404.00570","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.00570","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a9b55cd4-67a2-4bbb-af22-2caf2aaea56f","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2404.00570","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:e16c822551d0478fe341b6c391ce78c1ca75a91f3338728a6e2f5c3e9b0233ec","observation_id":"7bae226b-3fda-4278-babc-79873e33b3ca","resolution":{"observed_at":"2026-05-22T21:22:09.438889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10319","last_updated":"2025-03-11T14:02:04Z","snapshot_observed_at":"2026-08-06T07:50:40.568356Z","submitted_at":"2024-12-13T17:59:52Z","title":"SCBench: A KV Cache-Centric Analysis of Long-Context Methods","version":2},"cited_work":{"arxiv_id":"2412.10319","doi":"10.48550/arxiv.2412.10319","metadata_source":"pith","pith_arxiv_id":"2412.10319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"H.; Li, D.; Gao, J.; Yang, Y.; and Qiu, L","venue":"cs.CL","work_id":"846c0629-2f5a-462b-a768-28cf4efbb4ee","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2412.10319","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:84282b35aaf14379b806faf6b7bd4d31ba70c9b7f7d27a71c9ebfe1fdac2776f","observation_id":"59b9fc34-209f-4705-a7f5-c96c010a895c","resolution":{"observed_at":"2026-05-22T21:22:09.420903Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"91f928c9-4359-4147-9226-6b68ee25a7c0","year":null},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:8704db4280969ab7f43133e6a5cb628e6e2758269139df3a7b2740d88fb9e198","observation_id":"55806ae6-d51e-4433-9b1e-e7677b8cde95","resolution":{"observed_at":"2026-05-22T21:22:10.238273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":36,"verified_exact":57,"verified_fuzzy":4},"total_outbound_references":265},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 265 outbound references and 3 inbound Pith citation observations for arXiv:2504.02181."}