{"as_of":"2026-08-11T13:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4cd4ad36d0b225fec82de14d16c5b91b185c433229cdfb5265094f895d579f90","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T01:16:51.288077Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19075/citation-record","integrity":"/paper/2505.19075/integrity","json":"/paper/2505.19075/citation-record.json","paper":"/paper/2505.19075"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://open-thoughts.ai","venue":null,"work_id":"26566da8-da59-4308-bb08-837a89c858fc","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:55b152ea77df6b979bccc848069defccdc0ef33dbb58628e87994b1697b23d78","observation_id":"7915efde-4014-49f2-9561-76044141a237","resolution":{"observed_at":"2026-05-22T01:20:53.059308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A distributional view on multi-objective policy optimization","venue":null,"work_id":"f2c27723-2bd7-4a50-b331-80db7d363056","year":2020},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:2ffd6a68bf475b462ae2cecbb1e6197950e11b11b6fed9b4eb0ba78869b9b32b","observation_id":"2f6d41ee-b12f-4e8d-ac27-7c9ac5e7e1ed","resolution":{"observed_at":"2026-05-22T01:20:53.056170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.04463","doi":"10.48550/arxiv.2502.04463","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training language models to reason efficiently","venue":"ArXiv.org","work_id":"ddc0d049-f0ca-4946-aa25-6843f6072e08","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:6e10d31691e3ef7717423921f29492c6c8f2234c132fe4b2cd02b59f94cc5816","observation_id":"71ad09b3-2af8-4443-b8aa-0fb255219a3c","resolution":{"observed_at":"2026-05-22T01:20:52.113085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:f117c6371f905d82042ae788a55f2a22c822dbbb5f003b0b8e78d401587404ac","observation_id":"7b682a7a-fdfe-477a-be31-469344dce1f5","resolution":{"observed_at":"2026-05-22T01:20:52.203476Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bespoke-stratos: The unreasonable effectiveness of reasoning distillation","venue":null,"work_id":"d45e6afb-6ce5-489c-9b74-bb508729dede","year":null},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:e76b75435ae5cfa6d1b28a2ddc784642f7d8d7e3861e84a54ca0ea1abe2b0548","observation_id":"47b5cb35-68e6-4067-98ac-baa9999a75aa","resolution":{"observed_at":"2026-05-22T01:20:53.082399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Overview of the iwslt 2017 evaluation campaign","venue":null,"work_id":"4bfb7cb3-f466-4847-900f-b6f5747a4b31","year":2017},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:4fa9643cfa800776527c8e889194e74cbb87132d10b4bf7c5d7ef8268dab2114","observation_id":"a6aaa778-a682-4be5-a3ec-56cec7314d6c","resolution":{"observed_at":"2026-05-22T01:20:53.052749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:93bcda734e28cdc0500fe421cf6202dd3a6f52f2fe0890e97b4bb6f696442e04","observation_id":"c4cef4f9-3fb2-4505-a16f-8cb7e023fb7e","resolution":{"observed_at":"2026-05-22T01:20:52.198563Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T11:03:40.152421Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":"e88f7222-3e8e-41a6-b3e3-36964716b0bb","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:5af2c14308961fa4ff56164dbb76f820e7cffafb0f2821d7d36ba0bf68478a99","observation_id":"aad8307f-e2ab-41f3-9028-b9f607f87145","resolution":{"observed_at":"2026-05-22T01:20:53.126831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14479","last_updated":"2024-03-06T09:36:54Z","snapshot_observed_at":"2026-07-31T02:15:29.021222Z","submitted_at":"2023-11-24T13:41:12Z","title":"Controlled Text Generation via Language Model Arithmetic","version":2},"cited_work":{"arxiv_id":"2311.14479","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.14479","snapshot_observed_at":"2026-07-03T11:08:03.461390Z","title":"Controlled text generation via language model arithmetic","venue":null,"work_id":"cd438079-6c6a-4d08-a2ed-45478dc07445","year":2023},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2311.14479","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:1d24c919eb899720f08c1090e7f2d1388ef9fa2b1ef76fa33b40b8887e31ff76","observation_id":"872b89c1-d2e2-4f20-b0b6-7124c13dd8c9","resolution":{"observed_at":"2026-05-22T01:20:52.182731Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03568","last_updated":"2024-01-25T21:20:27Z","snapshot_observed_at":"2026-07-30T06:39:40.880794Z","submitted_at":"2024-01-07T19:11:18Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","version":2},"cited_work":{"arxiv_id":"2401.03568","doi":"10.48550/arxiv.2401.03568","metadata_source":"pith","pith_arxiv_id":"2401.03568","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","venue":"cs.AI","work_id":"7469e3ce-613c-4298-9d5f-ab2526320c8a","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2401.03568","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:4bf57e4dbd17e1ce92ab17301664e4a3943b5a2de1775f484beebed1289ba845","observation_id":"3837ff0d-b0b5-45f2-91e7-47ed2836b30a","resolution":{"observed_at":"2026-05-22T01:20:52.101452Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10160","last_updated":"2025-04-14T12:14:18Z","snapshot_observed_at":"2026-08-10T10:51:01.289012Z","submitted_at":"2025-04-14T12:14:18Z","title":"MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.10160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10160","snapshot_observed_at":"2026-07-02T02:56:29.964672Z","title":"Mt-r1-zero: Advancing llm-based machine translation via r1-zero-like reinforcement learning","venue":null,"work_id":"4b95aad2-bf05-4e49-8d1f-c2ee2a5a71f6","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2504.10160","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:c8cb3435297e27f6420f8a4753fb6307209bbdf6cb0dc61c05e44c7c07a7f92b","observation_id":"a11ac186-d2f9-44e8-a5ee-99cf35f7bd09","resolution":{"observed_at":"2026-05-22T01:20:52.107060Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T21:30:09.680521Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":"52561758-0cb3-4ae1-8db4-d20a08e886a1","year":2023},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:518fbba761d07e1897a5b9021ae595151a67da71c686a69053943a0f8a7c6c6f","observation_id":"9f5ebffa-9cee-4643-8d8b-ef82f2eb9ba6","resolution":{"observed_at":"2026-05-22T01:20:53.049385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:613b2146faa1181f1782f590d346b0a1cc35995c9510364a1dc89cdf9f27df67","observation_id":"056ea82c-06dc-487e-a52d-4e3767f22c0f","resolution":{"observed_at":"2026-05-22T01:20:52.079264Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"xcomet: Transparent machine translation evaluation through fine-grained error detection","venue":null,"work_id":"090afa3d-2fda-4b84-bd23-cfd8ca6b7ff7","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:8bf083c431e4c5470bfe6e6abf335d1fd3560f60e95f5c5cd6330b9abd94c18f","observation_id":"72068d0f-88ac-409c-be81-58046c28229c","resolution":{"observed_at":"2026-05-22T01:20:53.123230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with deep energy-based policies","venue":null,"work_id":"02164ad0-2d6b-4c5d-bd83-587e866d4261","year":2017},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:62f87f5ee12de110e200f9c04802330b2c9fe1792e7fbdd68f66ee6e66691a2a","observation_id":"1f00b3c2-cd6d-4976-8a55-85cc0fde0f2b","resolution":{"observed_at":"2026-05-22T01:20:53.119671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06639","last_updated":"2024-05-10T17:59:04Z","snapshot_observed_at":"2026-07-06T18:12:43.301678Z","submitted_at":"2024-05-10T17:59:04Z","title":"Value Augmented Sampling for Language Model Alignment and Personalization","version":1},"cited_work":{"arxiv_id":"2405.06639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.06639","snapshot_observed_at":"2026-07-03T21:18:58.014691Z","title":"Value augmented sampling for language model alignment and personalization","venue":null,"work_id":"2b50b7cf-032c-4539-a9c6-10944bcf2027","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2405.06639","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:d2c704769af792fb22cb218e0ebc3ee98fbeaf25ed506c5140375afedf8eb6a0","observation_id":"28d7c55c-27d9-4503-ad9d-13a8f3f271d3","resolution":{"observed_at":"2026-05-22T01:20:52.085102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":"2402.14008","doi":"10.48550/arxiv.2402.14008","metadata_source":"pith","pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","venue":"cs.CL","work_id":"19abed3b-0ff6-409b-aded-a50205319aa3","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:17e8e4ab81e1d4a597084aba9c0c8732c06484e712479b39e9a6f1bd20140685","observation_id":"aecab8b7-1f59-4848-b429-40e0533658f6","resolution":{"observed_at":"2026-05-22T01:20:52.193412Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"9847f7f8-dbb6-4b5f-b700-d880fdd3dfa5","year":2022},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:58e384334cdc0b5c8f798901e83326a83171f1fe327361f118c497a617683f8a","observation_id":"8a64ad45-09d0-477c-b8a3-cdc2851330af","resolution":{"observed_at":"2026-05-22T01:20:53.116330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open-reasoner-zero: An open source approach to scaling up reinforcement learning on the base model","venue":null,"work_id":"77351198-422e-4ee7-a9e5-639a549cad59","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:0be1ba691435971b73348adc5fb9e487acf4e968fa87e7bd5ddb4c484a223150","observation_id":"86da1fd4-3498-45fa-9415-d6c3aa076176","resolution":{"observed_at":"2026-05-22T01:20:53.112995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solving quantitative reasoning problems with language models","venue":null,"work_id":"3040a19b-01b2-4214-b823-b815354086d1","year":2022},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:2794252073e1591ff9a34512266b30e97d14f48653d6b3ba566c69f8965410b8","observation_id":"fdde4249-e2f8-4bf6-9e55-d2f4e23670b3","resolution":{"observed_at":"2026-05-22T01:20:53.109398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07124","last_updated":"2023-10-09T03:34:01Z","snapshot_observed_at":"2026-07-06T16:18:06.415304Z","submitted_at":"2023-09-13T17:59:09Z","title":"RAIN: Your Language Models Can Align Themselves without Finetuning","version":2},"cited_work":{"arxiv_id":"2309.07124","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.07124","snapshot_observed_at":"2026-07-03T04:27:37.151450Z","title":"Rain: Your language models can align themselves without finetuning","venue":null,"work_id":"bf51f407-2426-4136-9e1b-7a596b6b9f2e","year":2023},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2309.07124","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:6a070096fe0c5b22ff3acfdea01183edd65a846a516cb6830f345a518ef7c9a4","observation_id":"8220def0-689a-42ca-a85c-828cfd0329b4","resolution":{"observed_at":"2026-05-22T01:20:52.188334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T16:32:39.114869Z","title":"Let’s verify step by step","venue":null,"work_id":"7c9f7d5c-e081-4728-8d71-07bae6642366","year":2023},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:b9a905e1ecff07c61889a40ab587314d9a5f7eea358d688e5c49c64083103ae6","observation_id":"6ffd0ca5-2957-4209-ab91-054b8e481c64","resolution":{"observed_at":"2026-05-22T01:20:53.105883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Making ppo even better: Value-guided monte-carlo tree search decoding","venue":null,"work_id":"42deb700-27fe-46bb-89c9-a5664c3e4d44","year":2023},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:75ec55d61da2ef817c413dc26d4fae0f390c188a502026510c5dc022b0a54688","observation_id":"0645521b-7d67-4b62-a131-be0b61326922","resolution":{"observed_at":"2026-05-22T01:20:53.102722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":"2503.20783","doi":"10.48550/arxiv.2503.20783","metadata_source":"pith","pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","venue":"cs.LG","work_id":"ec354f3b-9484-4a0c-94c8-92d4d0260835","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:3a2b2014b3831dfdab0cda085ca6c490fbb2df34a42cdde092c9c6c137ca24bd","observation_id":"ce7c1b11-dec3-4674-9a12-f52092031b24","resolution":{"observed_at":"2026-05-22T01:20:52.176802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04165","last_updated":"2021-07-20T23:22:27Z","snapshot_observed_at":"2026-08-06T13:29:31.050456Z","submitted_at":"2021-05-10T07:46:55Z","title":"Inter-GPS: Interpretable Geometry Problem Solving with Formal Language and Symbolic Reasoning","version":3},"cited_work":{"arxiv_id":"2105.04165","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.04165","snapshot_observed_at":"2026-07-03T19:28:52.843212Z","title":"Inter-gps: Interpretable geometry problem solving with formal language and symbolic reasoning","venue":null,"work_id":"99d7e9ec-ee77-4407-bbba-e0794ed1a869","year":2021},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2105.04165","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:58af03f5ecee29b0544c670f40b2c0415700bef42318b1ecdb7b6cdcae0dcdc8","observation_id":"2aad626e-20b7-46ea-a334-ef43ac666b0c","resolution":{"observed_at":"2026-05-22T01:20:52.171935Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17022","last_updated":"2024-06-03T20:50:26Z","snapshot_observed_at":"2026-08-09T12:39:32.277152Z","submitted_at":"2023-10-25T22:00:05Z","title":"Controlled Decoding from Language Models","version":3},"cited_work":{"arxiv_id":"2310.17022","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.17022","snapshot_observed_at":"2026-07-03T21:18:57.960126Z","title":"Controlled decoding from language models","venue":null,"work_id":"cf3345d9-e026-4cda-a14a-5fd0bb08bbcf","year":2023},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2310.17022","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:8b4f38ec80cda314b019b50b0917fca5dbefe4c1ebdf654757c6eef880e7123e","observation_id":"f976f99d-ee17-42b6-bdd3-06c5bc560059","resolution":{"observed_at":"2026-05-22T01:20:52.166735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"s1: Simple test-time scaling","venue":null,"work_id":"7bd37f69-c662-41fb-8922-fb8b6c4f5e19","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:e2038492ab3f06a5150463dd9e6915bc069b9814da8d9ee4ceb43cb721e75386","observation_id":"383dbb4b-e39d-4bde-99cb-c9145cedabdd","resolution":{"observed_at":"2026-05-22T01:20:53.099580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to reason with llms","venue":null,"work_id":"178a0e2a-1261-4953-9582-f13a17a6344b","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:a80dd22d7bfadc22295143c76a84f3d227295a5528daa8b92da1e072b5e45829","observation_id":"8d8d4176-d223-404f-a5c6-e5207e1d0711","resolution":{"observed_at":"2026-05-22T01:20:53.096141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03860","last_updated":"2025-02-06T08:19:59Z","snapshot_observed_at":"2026-08-11T05:57:10.684371Z","submitted_at":"2025-02-06T08:19:59Z","title":"BOLT: Bootstrap Long Chain-of-Thought in Language Models without Distillation","version":1},"cited_work":{"arxiv_id":"2502.03860","doi":"10.48550/arxiv.2502.03860","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bolt: Bootstrap long chain-of-thought in language models without distillation","venue":"ArXiv.org","work_id":"f047822c-1d82-480f-adf0-9cc875bced37","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2502.03860","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:051f613cf47cc4c3eda4613ec7b9e18c14124099a91a88ec3ae5f07583f74460","observation_id":"7a2ccf24-1ca3-47b3-868e-26c56f619e68","resolution":{"observed_at":"2026-05-22T01:20:52.209043Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"61d34a5f-3525-4046-b217-7110c889eb7a","year":2002},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:c5af9ef92444cfaab68cb661fabb07feb4ccc604dccbcd554132409fdbc86d55","observation_id":"2c63b656-1f92-4a2e-8eee-6d9ebc65ac1d","resolution":{"observed_at":"2026-05-22T01:20:53.093173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"6f5b41a9-e179-48c7-9cb5-b8c7521ac0a0","year":2023},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:4746a270f00e5f0d75519a9f727af1a6a0a2b3d9af55f30299da595d8f2c0974","observation_id":"65cfd4e5-9954-4cff-9412-6697d76c7c98","resolution":{"observed_at":"2026-05-22T01:20:53.089363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06243","last_updated":"2022-09-13T18:05:12Z","snapshot_observed_at":"2026-08-05T03:06:38.187055Z","submitted_at":"2022-09-13T18:05:12Z","title":"CometKiwi: IST-Unbabel 2022 Submission for the Quality Estimation Shared Task","version":1},"cited_work":{"arxiv_id":"2209.06243","doi":"10.48550/arxiv.2209.06243","metadata_source":"arxiv_reference","pith_arxiv_id":"2209.06243","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cometkiwi: Ist-unbabel 2022 submission for the quality estimation shared task","venue":"arXiv (Cornell University)","work_id":"6048b08c-03a7-40f4-adf2-4f9ad9ca2792","year":2022},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2209.06243","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:c1e2f01a8b8f9476831fb648d8c624f18acaa7548acad90af59dde6b42f0f5e3","observation_id":"222f1f60-7fab-46a8-bc84-085e4f79878c","resolution":{"observed_at":"2026-05-22T01:20:52.161220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:27:26.595786+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:27:26.595786+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:2fb2ba8fbf3f6dad9170fd4dad6d4871c5601c8bb5a00444c17aec6e985b1631","observation_id":"ec53a422-5e92-4b71-8b4b-c2660be71598","resolution":{"observed_at":"2026-05-22T01:20:52.090514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:e53003b1c7d28fef1e22beb69fa93891037f8d42b3de5b836612871a5643bf50","observation_id":"3fbcfc41-5b47-4203-ab4c-c532860b1a4a","resolution":{"observed_at":"2026-05-22T01:20:52.096042Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are multilingual chain-of-thought reasoners","venue":null,"work_id":"8c5361e1-3341-40e6-8ec4-039c7dbcb9bc","year":2022},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:d824e5b85543f01f01f1d3e2749cfc0d0a5ec14e7cde29369b2e8e10d4df0f2d","observation_id":"76f6d3ad-11b5-4b7a-8d9b-8852031dfa8c","resolution":{"observed_at":"2026-05-22T01:20:53.086110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11871","last_updated":"2023-05-01T04:42:27Z","snapshot_observed_at":"2026-08-04T02:07:56.186059Z","submitted_at":"2022-06-05T18:38:42Z","title":"Offline RL for Natural Language Generation with Implicit Language Q Learning","version":2},"cited_work":{"arxiv_id":"2206.11871","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.11871","snapshot_observed_at":"2026-07-04T07:59:40.700056Z","title":"Offline rl for natural language generation with implicit language q learning","venue":null,"work_id":"999f22b2-7bc1-427a-b291-d00e4ef116f6","year":2022},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2206.11871","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:08303de2306c1b9e77d843efc196ad1400c30caab6caf0bd2a41c3b8031e1cef","observation_id":"85e3a1ec-6c4e-408e-ad20-e2303f14f675","resolution":{"observed_at":"2026-05-22T01:20:52.155945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-11T01:31:26.242281Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":"2501.12599","doi":"10.48550/arxiv.2501.12599","metadata_source":"pith","pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","venue":"cs.AI","work_id":"bff96ab1-bd6a-4585-be23-74fdb51969c7","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:925f731fd17cbc5ecc288a75c0e878ff859680146163b647520016b155361a26","observation_id":"a9dca9a3-4128-4376-acc7-12a18e9f0db2","resolution":{"observed_at":"2026-05-22T01:20:52.144708Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:38.585868+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:38.585868+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09685","last_updated":"2025-01-20T22:00:26Z","snapshot_observed_at":"2026-08-10T19:43:20.086799Z","submitted_at":"2025-01-16T17:37:35Z","title":"Inference-Time Alignment in Diffusion Models with Reward-Guided Generation: Tutorial and Review","version":2},"cited_work":{"arxiv_id":"2501.09685","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09685","snapshot_observed_at":"2026-07-05T17:51:14.850174Z","title":"arXiv preprint arXiv:2501.09685 , year=","venue":"cs.AI","work_id":"07ffebde-5fc1-4135-b68e-df8c1c798f0c","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2501.09685","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:84cb220a6cdfa5066bff5e5ceeab427a384be79bb557258e92ea908b17dc433b","observation_id":"35c3cccf-e86d-4078-bcba-aa6592f5efe7","resolution":{"observed_at":"2026-05-22T01:20:52.134739Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.595164Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"a3ac3b4d-8c58-4772-ad55-18e8fb162bd1","year":2022},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:a8d8d20818808dfe519247358e7f6c12ef8217f8651afe2052b93b6b0f38ec66","observation_id":"04056c00-3775-4bae-8598-f20d88600f84","resolution":{"observed_at":"2026-05-22T01:20:53.079265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08193","last_updated":"2025-07-15T00:32:25Z","snapshot_observed_at":"2026-07-06T19:31:23.072307Z","submitted_at":"2024-10-10T17:58:24Z","title":"GenARM: Reward Guided Generation with Autoregressive Reward Model for Test-time Alignment","version":5},"cited_work":{"arxiv_id":"2410.08193","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.08193","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Genarm: Reward guided generation with autoregressive reward model for test-time alignment","venue":null,"work_id":"a0f8ee46-64ef-4bfe-b68c-01c772c8ae24","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2410.08193","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:3eb4e9967114e8397cd1761fd58a3a0a53468b4318c5d83f0393e37e9f370625","observation_id":"513ae582-aa7c-4aba-a346-c1826eabce63","resolution":{"observed_at":"2026-05-22T01:20:52.150446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:6749cee0750513103c3cacc65194a11664f2c3e966ed9952f4ff75ecd87b5f3c","observation_id":"f55dfc8e-a788-4e6a-a5da-968495c6c492","resolution":{"observed_at":"2026-05-22T01:20:52.139872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":"2409.12122","doi":"10.18653/v1/2025.emnlp-main.712","metadata_source":"pith","pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","venue":"cs.CL","work_id":"a097c5d4-6d32-46ee-9826-57d532bbfc9c","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:f3d68662ee27b7194551c2da6b6778bbd9be95fde7fde589cecf7add1acfcb45","observation_id":"a9e5fb04-bd7b-46f4-a12c-9921810d1942","resolution":{"observed_at":"2026-05-22T01:20:52.129283Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preference-grounded token-level guidance for language model fine-tuning","venue":null,"work_id":"ce9bdd98-afde-4cf6-878a-e733f2622fbd","year":2023},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:31264c06d2ec19dda0310ddaf0acc5c6bbe66c5e9423edc5ab61c84974983973","observation_id":"7e816517-ff3e-4e87-8683-8cda32623abd","resolution":{"observed_at":"2026-05-22T01:20:53.074920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Limo: Less is more for reasoning","venue":null,"work_id":"d35c1e53-2d81-40e1-87dd-daa982bbecae","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:6cda16d829c05836fdd7f919c462793e1fa7fd912d6f4dcce85c08531c354318","observation_id":"e627d3e4-b2a9-4f21-93e2-0d3947444551","resolution":{"observed_at":"2026-05-22T01:20:53.070822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:1c680b60febaa0a363ef2477d4b5d922db54072e200faffadd5ae027d4cc844c","observation_id":"69316f9c-050b-4ccf-8937-93ae51d826a2","resolution":{"observed_at":"2026-05-22T01:20:52.124513Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03303","last_updated":"2026-05-09T05:30:15Z","snapshot_observed_at":"2026-08-08T14:14:26.000056Z","submitted_at":"2023-08-07T05:12:27Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","version":3},"cited_work":{"arxiv_id":"2308.03303","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.03303","snapshot_observed_at":"2026-07-04T19:10:05.832087Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","venue":"cs.CL","work_id":"caf23d24-5176-4330-bd2a-6cf699d152cd","year":2023},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"cited_paper":"/paper/2308.03303","citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:06596685bf42bfcfc0f1c9e4ef2cbc330bfa67363e1d8dbfa3cc56a5420e7e86","observation_id":"d78bc88d-8e1a-4fcd-a8da-02a88cfa8749","resolution":{"observed_at":"2026-05-22T01:20:52.118075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? In European Conference on Computer Vision, pages 169–186","venue":null,"work_id":"cbd1428f-a820-49da-85a4-f5d6e4969d00","year":2024},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:b88f0b35f5e8346ac39526c9dae4479baae264c40ba279f2242631d83b2e9fef","observation_id":"74b1e685-a579-48e0-99de-47063553b50f","resolution":{"observed_at":"2026-05-22T01:20:53.067029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What about","venue":null,"work_id":"7c1f28d9-4a69-4f48-b26b-a01a5fd0182a","year":2008},"citing_paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T01:16:51.288077Z"},"links":{"citing_paper":"/paper/2505.19075"},"observation_digest":"sha256:7b752e7f0f839b12e4bcb90892e68616ac795ddf76f32a0b46f842df938ac6c2","observation_id":"13641742-2f5d-4b0b-956c-2327087be5bf","resolution":{"observed_at":"2026-05-22T01:20:53.063230Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19075","last_updated":"2026-05-20T08:13:51Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-30T16:12:36.732031Z","submitted_at":"2025-05-25T10:19:10Z","title":"Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":24,"verified_fuzzy":22},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2505.19075."}