{"as_of":"2026-08-08T08:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e4616de53ef33b7d1c43829aa4be3cc37bd48f5c205919cea3195b04d91eb04","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:13:55.402176Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T05:23:08.478393Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T09:23:37.521970Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"cited_work":{"arxiv_id":"2506.03295","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03295","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.03295 , year=","venue":null,"work_id":"ef232cf2-24ac-43d3-bb51-3aa8fdf7d067","year":null},"citing_paper":{"arxiv_id":"2604.17928","last_updated":"2026-04-20T08:09:01Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T08:09:01Z","title":"HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-10T05:23:08.478393Z"},"links":{"cited_paper":"/paper/2506.03295","citing_paper":"/paper/2604.17928"},"observation_digest":"sha256:71ee0d29b2fa9ed2f41229e11f24db7ef346205d5ee408f6ec2ec942e89e875b","observation_id":"444f8f0e-d11a-4ce5-a8bc-e6279d55bb8a","resolution":{"observed_at":"2026-05-10T09:23:37.523565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03295/citation-record","integrity":"/paper/2506.03295/integrity","json":"/paper/2506.03295/citation-record.json","paper":"/paper/2506.03295"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:52.240891Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:52.240891Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:d15aa2bedfc28ceabf50e2ec3963f974faba37f1c340398c334112a688fb96bd","observation_id":"f61a3d36-b194-4a19-80e4-5fe8042ad77e","resolution":{"observed_at":"2026-08-07T11:13:52.240891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:52.323699Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:52.323699Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:16a4b69a31f545216b36168c4e6afd4956daef3a77b03ad5b7fb5f6559f3b849","observation_id":"3bddc807-a88e-4a84-8e28-f448c411a530","resolution":{"observed_at":"2026-08-07T11:13:52.323699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21318","last_updated":"2025-04-30T05:05:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-30T05:05:09Z","title":"Phi-4-reasoning Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21318","snapshot_observed_at":"2026-08-07T11:13:52.400441Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:52.400441Z"},"links":{"cited_paper":"/paper/2504.21318","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:a38a4773fefa1eb13e351b07b3b8828cd1359572fe03b21ade9b74dd940eb85a","observation_id":"032176ae-7252-468b-9ff9-fb94657eb39b","resolution":{"observed_at":"2026-08-07T11:13:52.400441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:13:52.506651Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:52.506651Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:c73e01594acc284ff7580349ecd4807998a3a9d89f45015fbce4a5466ea50637","observation_id":"64dc34c3-5951-4705-aec2-9f1d5c9b3859","resolution":{"observed_at":"2026-08-07T11:13:52.506651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:56.712580Z","title":null,"venue":null,"work_id":"a13ffb70-5145-4efe-b0ab-0ad5e2246623","year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:52.589772Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:f70c9758bf1a5acf75ab827c8f84576193f200521ab66a960a0db021854285d0","observation_id":"0ceb413f-2a7b-4c3b-b255-b662ea55ec38","resolution":{"observed_at":"2026-08-07T11:13:56.812661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:52.676931Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:52.676931Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:8705947992b1d4e42f781757852579871d92000f83a391e9cd647013dd3010cd","observation_id":"f5a9ef3e-62e5-40ab-b996-0d4c84c0436d","resolution":{"observed_at":"2026-08-07T11:13:52.676931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14739","last_updated":"2025-03-28T15:21:44Z","snapshot_observed_at":"2026-07-29T21:41:16.650188Z","submitted_at":"2025-02-20T17:05:58Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14739","snapshot_observed_at":"2026-08-07T11:13:52.791271Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:52.791271Z"},"links":{"cited_paper":"/paper/2502.14739","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:ec8ec4869e07bda9a46fd16491e00b07b20d03e0b76eafc1bdb6250177c8e481","observation_id":"e8d4d64b-3532-482b-a0a8-9cd360d41574","resolution":{"observed_at":"2026-08-07T11:13:52.791271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:56.539340Z","title":null,"venue":null,"work_id":"02d2ad1f-9660-4cec-b805-f7472754c482","year":2024},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:52.878596Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:8dd437116b1476ea7c5e3d9a059d9d4860e26baf15921a613337422d32abd6ea","observation_id":"2c3c6318-4650-477a-826d-0a6ef184648c","resolution":{"observed_at":"2026-08-07T11:13:56.607935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T11:13:52.980675Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:52.980675Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:1571d26d68c9568c7109e57499b99da988a410c4fb25f3b48c5a47a3d39f49bd","observation_id":"ad00419f-80f7-4192-9c27-d8b928d75df3","resolution":{"observed_at":"2026-08-07T11:13:52.980675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:53.074826Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.074826Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:acba5366b02343ceb5b270e5a9491d36b88bf6f440b69f9f8fda2a4384abd9b3","observation_id":"e35f8357-73d7-4ba2-a547-0b006bb08109","resolution":{"observed_at":"2026-08-07T11:13:53.074826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T11:13:53.146158Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.146158Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:a0a1a8a9af7f648f75b50885b22d2543ef4b9d3207bc096d02b0e8c61ecfd2e1","observation_id":"f36f3d9b-9820-40ef-b053-f8c2ce170c51","resolution":{"observed_at":"2026-08-07T11:13:53.146158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:53.242475Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.242475Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:f5ef26d06b3144f29836021d13320fd3c4dbd098f9d9de133c9a70853027d522","observation_id":"1b47a0b5-9e12-4b7c-92b3-386e12b15de2","resolution":{"observed_at":"2026-08-07T11:13:53.242475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05826","last_updated":"2021-09-22T08:03:34Z","snapshot_observed_at":"2026-07-06T09:27:40.943546Z","submitted_at":"2020-06-10T13:26:31Z","title":"Transient Non-Stationarity and Generalisation in Deep Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05826","snapshot_observed_at":"2026-08-07T11:13:53.326869Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.326869Z"},"links":{"cited_paper":"/paper/2006.05826","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:e4709f5f944ede0de62f68c3c0cec95aa1405a52e346dac5fd0f0e0d75bf9c79","observation_id":"ef3b0a0a-d011-4cc8-8d46-32c24501447a","resolution":{"observed_at":"2026-08-07T11:13:53.326869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T11:13:53.423566Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.423566Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:bf452013a6f9d4281bc6eb8a68726465c1c06d15a70d7abecee375b17bb773a1","observation_id":"95815a1c-d9b2-4c25-ac55-c5ec47921bb3","resolution":{"observed_at":"2026-08-07T11:13:53.423566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-07T11:13:53.511955Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.511955Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:cadfee7ead55e31c4f7aaab62a719bdfde44a90d9e0a1e111e9495ea7ded2422","observation_id":"dab77a8c-5779-48ce-9821-740a9524f26c","resolution":{"observed_at":"2026-08-07T11:13:53.511955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:53.610370Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.610370Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:59d9355accc3a1ef06f5fecec9a2153ba505bda58c7391824f4a06731ee38862","observation_id":"18c74c37-490f-495c-8640-0c7dd3b64025","resolution":{"observed_at":"2026-08-07T11:13:53.610370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15084","last_updated":"2025-01-17T07:12:55Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:29:44Z","title":"AceMath: Advancing Frontier Math Reasoning with Post-Training and Reward Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15084","snapshot_observed_at":"2026-08-07T11:13:53.714891Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.714891Z"},"links":{"cited_paper":"/paper/2412.15084","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:2eb88a9e24a098e999b58eb82ff58158dd4bcb92f5e710392e1eb902c0e5ff87","observation_id":"0be86bb8-dca2-4b9f-9e6b-4ee186768982","resolution":{"observed_at":"2026-08-07T11:13:53.714891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14652","snapshot_observed_at":"2026-08-07T11:13:53.817051Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.817051Z"},"links":{"cited_paper":"/paper/2505.14652","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:eed812fffcbb7545c8cf4c80579fa1d248d7cfacd1f00358a6f44d16f4cf8df7","observation_id":"c458e86f-bf83-4911-8d45-be01a33a7d17","resolution":{"observed_at":"2026-08-07T11:13:53.817051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T11:13:53.902869Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.902869Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:0c5175cc44b35a4d28e5ab70388968afc022d43b4c2b7a703877da4ac5724f72","observation_id":"a8850b35-548f-4380-a5f3-600086c3753c","resolution":{"observed_at":"2026-08-07T11:13:53.902869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:56.375635Z","title":null,"venue":null,"work_id":"68e70299-2196-43a7-802a-ac78cd0dae1f","year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.034196Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:b1299b5934646f15701a22e05c0474a048cec6ccc6cd1635f21ea7d4b2b01f11","observation_id":"a2e15b19-515e-4dd6-ad16-7b64c773c0b9","resolution":{"observed_at":"2026-08-07T11:13:56.439106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:56.228896Z","title":null,"venue":null,"work_id":"1e190c47-a9ec-4c95-abd5-6b48f413a10f","year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.134662Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:21243748da5ca60e1832bfe2c0246f0806abb57db8a38b3d2502fde0b7a224f3","observation_id":"be07fda1-f257-458c-b527-5313acd2bbc2","resolution":{"observed_at":"2026-08-07T11:13:56.315205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:54.250085Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.250085Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:7b9a00907bb15112849d117756dd70f03c2b47a4dc1fb36872b72344a5098cfc","observation_id":"fe1384b7-7f29-4423-85e6-839528e25287","resolution":{"observed_at":"2026-08-07T11:13:54.250085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:55.976366Z","title":null,"venue":null,"work_id":"673038cd-13f1-454b-b2b9-e902c95a13dc","year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.352917Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:265160546cc1ffeae2066cb6ea2e1118b88b741316212c46e9766f7c713b0437","observation_id":"8cb61302-0316-49ef-8f2a-b4ef49a9bdfe","resolution":{"observed_at":"2026-08-07T11:13:56.076603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T11:13:54.466759Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.466759Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:3e23a5c352e856bcd99465e5748dab3e3402ca048b2df6fa16889473ae811046","observation_id":"5ff1a335-898a-4926-b228-1eeacf38255a","resolution":{"observed_at":"2026-08-07T11:13:54.466759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:54.545213Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.545213Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:c6e669c60b5178b241e365dc2ba16c5ee312b923e2dd02352f77fec39bb95f9f","observation_id":"7d2fe63a-e74e-4ea6-b315-b09ac42ba3c4","resolution":{"observed_at":"2026-08-07T11:13:54.545213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20571","snapshot_observed_at":"2026-08-07T11:13:54.643303Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.643303Z"},"links":{"cited_paper":"/paper/2504.20571","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:5bbd3be7dd097d7cacde63d0a27f6c986146eb9aef3163821f010b472dd76063","observation_id":"bb53f15c-9bda-41fe-b338-77fba178d538","resolution":{"observed_at":"2026-08-07T11:13:54.643303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:54.739185Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.739185Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:45f6b26992c01ccb7c938d7c94096d9be3f9ea3b31ce919cf661c1c1fa602abb","observation_id":"c47b0fc3-0508-435c-aa00-a904a00345d2","resolution":{"observed_at":"2026-08-07T11:13:54.739185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17703","last_updated":"2025-03-29T15:21:55Z","snapshot_observed_at":"2026-08-06T17:25:43.987350Z","submitted_at":"2025-01-29T15:20:30Z","title":"Critique Fine-Tuning: Learning to Critique is More Effective than Learning to Imitate","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17703","snapshot_observed_at":"2026-08-07T11:13:54.819029Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.819029Z"},"links":{"cited_paper":"/paper/2501.17703","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:6a6f0397d48661f945dedd27e0e6f871005d327667ffbdfffd301a22dbf320e3","observation_id":"3a427ab1-20d6-42e5-875b-457b07433dc2","resolution":{"observed_at":"2026-08-07T11:13:54.819029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07608","last_updated":"2025-06-05T11:49:09Z","snapshot_observed_at":"2026-08-07T15:47:50.795694Z","submitted_at":"2025-05-12T14:30:11Z","title":"MiMo: Unlocking the Reasoning Potential of Language Model -- From Pretraining to Posttraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07608","snapshot_observed_at":"2026-08-07T11:13:54.909053Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:54.909053Z"},"links":{"cited_paper":"/paper/2505.07608","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:54b7eabb7bbe8fa209cf7a183179cfcbf3561a97bbdd34cd29e1a561c56bce63","observation_id":"8b679c15-fa0b-45ea-9eb4-314ab6cb5bf7","resolution":{"observed_at":"2026-08-07T11:13:54.909053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T11:13:55.027673Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:55.027673Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:6957d98d8d63f10227612286a7b547122400127f7985744beafc09413a49b162","observation_id":"72345245-f1cc-42a6-84b1-174caee69774","resolution":{"observed_at":"2026-08-07T11:13:55.027673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T11:13:55.110716Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:55.110716Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:2d6d38f5f0e299f1302feaff4014b8e0c8ae31ea5716ee81d52ecfcee1da7981","observation_id":"0a341be0-3ea0-4c17-9ce4-a97b22bc3daa","resolution":{"observed_at":"2026-08-07T11:13:55.110716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-07T11:13:55.202416Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:55.202416Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:fc0adf09625d16534869f17a42fe30b3d4e5172cd84ff7a365b6debc1b25f644","observation_id":"7a5f9fc7-85ed-475f-8b00-cb6c7d8884c3","resolution":{"observed_at":"2026-08-07T11:13:55.202416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:13:55.797724Z","title":null,"venue":null,"work_id":"2555567a-cf8b-4ab9-86b5-be491bad90b3","year":2024},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:55.271965Z"},"links":{"citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:7dcfcaebd89a4ea7b5332a84a0ef5ba1992ed8af718fc590f2b8fad3dbbb6222","observation_id":"bfc1964e-dd6b-4193-892f-3d6fbb2eff31","resolution":{"observed_at":"2026-08-07T11:13:55.861725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-07T11:13:55.402176Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:55.402176Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:bdaf1e7d3b7abdbf3140891ab1c5782e1aa0416815317e74ebab671fb8aed036","observation_id":"475ea730-30f7-4685-a1f9-f66e4a87bee5","resolution":{"observed_at":"2026-08-07T11:13:55.402176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2506.03295."}