{"as_of":"2026-08-07T22:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4588acc55696c13713e4c9d7f244185ba00925727ea9b2816d627d298ea8e871","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:07:02.121912Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06009/citation-record","integrity":"/paper/2506.06009/integrity","json":"/paper/2506.06009/citation-record.json","paper":"/paper/2506.06009"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:01.972708Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:01.972708Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:b2fd2adcde9d90feac34bae89cfa2ca0c1e28b04c604e4b2e88260ce147c9a63","observation_id":"246ca00c-68a2-4c84-bd15-805de75a1b75","resolution":{"observed_at":"2026-08-07T06:07:01.972708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:01.976315Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:01.976315Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:6d4154ebb5cb6e27feaeb57ffdb9dcba128a4e2a103c1ca36e2bf11931358fc3","observation_id":"939f3c85-c716-43fe-821c-736597ed7817","resolution":{"observed_at":"2026-08-07T06:07:01.976315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:01.979925Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:01.979925Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:6ded455fabbcd9a05c63c13156f2cf6ac0fd7eaff94282979233a95b817c9547","observation_id":"6a23e769-4d86-4c64-9a8e-9603b5d2a836","resolution":{"observed_at":"2026-08-07T06:07:01.979925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11791","last_updated":"2024-08-21T17:24:15Z","snapshot_observed_at":"2026-07-06T19:04:09.389583Z","submitted_at":"2024-08-21T17:24:15Z","title":"Critique-out-Loud Reward Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11791","snapshot_observed_at":"2026-08-07T06:07:01.983009Z","title":"Chang, and Prithviraj Ammanabrolu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:01.983009Z"},"links":{"cited_paper":"/paper/2408.11791","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:de4f06004957ad3e42286afde13caef5a921b147760258aac768db0542ae550a","observation_id":"47b801cc-3afb-4edc-95fa-edd60c593ab1","resolution":{"observed_at":"2026-08-07T06:07:01.983009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.548836Z","title":null,"venue":null,"work_id":"fed0bac9-0804-4824-8da3-e188da532bf9","year":2013},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:01.986290Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:c973bb83e5bd1fff31248191d259a3bc66d56dad800e06d2b23ee9aa09f6fb0b","observation_id":"c55dfe77-2b6c-49ab-b566-62fab778e8b4","resolution":{"observed_at":"2026-08-07T06:07:02.551702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-07T06:07:01.989412Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:01.989412Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:d8d038b3bd9f5a57da865010192b778732a7feb6366af84ac73fa9814b55b0ce","observation_id":"6c04a003-9f19-46bf-b99d-54b7299b459f","resolution":{"observed_at":"2026-08-07T06:07:01.989412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01377","last_updated":"2024-07-16T03:24:39Z","snapshot_observed_at":"2026-08-02T07:46:40.319683Z","submitted_at":"2023-10-02T17:40:01Z","title":"UltraFeedback: Boosting Language Models with Scaled AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01377","snapshot_observed_at":"2026-08-07T06:07:01.992586Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:01.992586Z"},"links":{"cited_paper":"/paper/2310.01377","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:6539df375b416e9578fcd411354ce107dd9f40a550483296808331dc94fbc7eb","observation_id":"6839484a-01ee-4961-8192-6cd9c52c977e","resolution":{"observed_at":"2026-08-07T06:07:01.992586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-07T06:07:01.995800Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:01.995800Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:7528f32f4a75e70a9e42737bd73e11bacaf0c5739c08c6a70a5c1a4cd6fa9b12","observation_id":"7813797b-1ee3-4912-9539-35b925349318","resolution":{"observed_at":"2026-08-07T06:07:01.995800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.539559Z","title":null,"venue":null,"work_id":"8c609661-119b-4e2d-a1ab-2571a2c3329c","year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:01.999001Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:f5fcfa9dd1c390f2c6b341ef775b3ab18e8e2b1b92bdcbac7c7c8f4dce2f2e7a","observation_id":"380dbae0-c436-4b05-80cd-67d470103764","resolution":{"observed_at":"2026-08-07T06:07:02.542765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-07T06:07:02.002272Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.002272Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:609850e23c329f235bcdd49db0b0088931dce380446d51c60f8f0b0465aa9af6","observation_id":"70eb2ecf-2649-4acf-a152-1efe251e6f61","resolution":{"observed_at":"2026-08-07T06:07:02.002272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T06:07:02.005898Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.005898Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:b01df24fdca840049241e5e0d5484d18f8f6618018fb6355e0318082b8e069ff","observation_id":"ffc07461-ffdc-44a3-8845-da654ca7584f","resolution":{"observed_at":"2026-08-07T06:07:02.005898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.530492Z","title":null,"venue":null,"work_id":"8aa94a7a-1bc1-45ad-b213-1bacddf94287","year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.009364Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:c2a4a094b30562518e901e73053287e35677abc0e76318a12a50e9bdcd03eae9","observation_id":"1deacb34-0eb5-4a6d-8403-2b305905c92a","resolution":{"observed_at":"2026-08-07T06:07:02.533322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04298","last_updated":"2024-09-06T01:14:26Z","snapshot_observed_at":"2026-08-06T01:39:33.613496Z","submitted_at":"2024-04-04T20:27:37Z","title":"SELF-[IN]CORRECT: LLMs Struggle with Discriminating Self-Generated Responses","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04298","snapshot_observed_at":"2026-08-07T06:07:02.012071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.012071Z"},"links":{"cited_paper":"/paper/2404.04298","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:88030485576beb028488d7775ea01d62c106b53a4c203380c32a4dc04059038c","observation_id":"99d2a96c-a0a0-4b41-b672-bf9620c8ca44","resolution":{"observed_at":"2026-08-07T06:07:02.012071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.015165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.015165Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:681ab87989110cb9e06e38ccc9eacf4765d9197889d4f4cf9e18773dafd04cb7","observation_id":"6509816e-6a6d-47dd-a93c-8d7edb8b66f2","resolution":{"observed_at":"2026-08-07T06:07:02.015165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.515029Z","title":null,"venue":null,"work_id":"667c0516-ccca-4a80-8a25-e4a2be5a00ee","year":2023},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.018445Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:ceee8bd7ce2295cd6a00d0d81f8ae02ddcc1c70ef2639bbfdc8edb409161bdbb","observation_id":"204fcbc4-8020-47c9-b96e-6a8676ecf97c","resolution":{"observed_at":"2026-08-07T06:07:02.517796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12917","snapshot_observed_at":"2026-08-07T06:07:02.021435Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.021435Z"},"links":{"cited_paper":"/paper/2409.12917","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:8dfb1de7a562c0f2d5b2afdd1d19db57fcfaf6fb04f840a1cbd1979f4f04d48e","observation_id":"705a9ac5-f8aa-43a1-acfa-18a3e9b4fbe4","resolution":{"observed_at":"2026-08-07T06:07:02.021435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-02T11:33:41.297984Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-07T06:07:02.024636Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.024636Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:a1e5d69a88c9868e2df6f838737a49f941181cdaf6b13f45c78700d9b8dd6b8a","observation_id":"a7932206-d0a4-4c75-bb3e-9b990646251b","resolution":{"observed_at":"2026-08-07T06:07:02.024636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.027559Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.027559Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:68f8be09c1f59b62c207c9b4738ff7065d727ded6f2ff024d5406e8a116c183a","observation_id":"9d099228-8a1c-4a64-9c96-40bce31657d7","resolution":{"observed_at":"2026-08-07T06:07:02.027559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12163","last_updated":"2024-05-20T16:47:22Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T16:47:22Z","title":"Fennec: Fine-grained Language Model Evaluation and Correction Extended through Branching and Bridging","version":1},"cited_work":{"arxiv_id":"2405.12163","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12163","snapshot_observed_at":"2026-08-07T06:07:02.323155Z","title":"Fennec: Fine-grained Language Model Evaluation and Correction Extended through Branching and Bridging","venue":"cs.CL","work_id":"ed610644-d01b-4e70-8b6d-c29a03a4a5f7","year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.030197Z"},"links":{"cited_paper":"/paper/2405.12163","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:7dd09180ff9dace685fe449651f363daeffdeb45b3a084467afd9e33dad123b5","observation_id":"9ff1999d-45be-4193-9751-ae2c244ffcd8","resolution":{"observed_at":"2026-08-07T06:07:02.326602Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-07T06:07:02.033102Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.033102Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:485f3b1d3d34b0abae58e649c130bcafa059cd01600d8e51adf61d64fd6f8daf","observation_id":"e9d85ba7-afeb-4fd9-a028-9647961ba4e8","resolution":{"observed_at":"2026-08-07T06:07:02.033102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-07T05:53:12.643515Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18451","snapshot_observed_at":"2026-08-07T06:07:02.036124Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.036124Z"},"links":{"cited_paper":"/paper/2410.18451","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:6cf2578a60c64f1463a0eaad83554b15c62f3e906f9f9f0c04b0f701ce420747","observation_id":"71669695-99c8-4e6d-8853-be1d52f87454","resolution":{"observed_at":"2026-08-07T06:07:02.036124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.039027Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.039027Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:a6f7ecb773a699d92cf8aa1d896258b693e56ae04eff1313c11aeb64bff3e555","observation_id":"d449e7df-6801-4529-a0c1-68995e4c7361","resolution":{"observed_at":"2026-08-07T06:07:02.039027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09413","last_updated":"2024-12-22T10:44:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-12T16:20:36Z","title":"Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09413","snapshot_observed_at":"2026-08-07T06:07:02.041738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.041738Z"},"links":{"cited_paper":"/paper/2412.09413","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:19ab2ad123f47d26de2707d850fcba64709633d75ca2c1c2e03c5c7b343775bb","observation_id":"cda1544f-8451-41de-9077-a474bf655e98","resolution":{"observed_at":"2026-08-07T06:07:02.041738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T06:07:02.044561Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.044561Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:cd943178e38f76c60271e06f5b8bbb208c07f89bec4452aa9a6bab77279fb8c8","observation_id":"48c893e3-c9f5-446b-931b-6ef14232d5c1","resolution":{"observed_at":"2026-08-07T06:07:02.044561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.494208Z","title":null,"venue":null,"work_id":"d6f7fc82-652b-48dc-a5c3-64949e4e67ec","year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.047780Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:d1330939bdb3f31d519a18b0027504a3c61370c57ec6da953ded91b3cd679eb4","observation_id":"dd036561-2dc0-4c25-ae10-2a2b251de0ae","resolution":{"observed_at":"2026-08-07T06:07:02.497164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19159","last_updated":"2024-09-09T04:39:31Z","snapshot_observed_at":"2026-08-04T02:06:41.618052Z","submitted_at":"2024-03-28T06:03:47Z","title":"Disentangling Length from Quality in Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19159","snapshot_observed_at":"2026-08-07T06:07:02.051648Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.051648Z"},"links":{"cited_paper":"/paper/2403.19159","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:1b469241b814007f7274b3358ff6b06dfdd04b77955cb5b4a23343594f579753","observation_id":"7faebdb5-bce8-4568-9819-96e8c32d9373","resolution":{"observed_at":"2026-08-07T06:07:02.051648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-07-06T19:39:15.025945Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T06:07:02.055033Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.055033Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:f436332a51a3a7e9b06d9aa2eefc9d5a607c6d5de41e29c92b11e978a05dbb67","observation_id":"2d7ca1f7-6c45-49c7-8011-f26477e5e3b3","resolution":{"observed_at":"2026-08-07T06:07:02.055033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18219","last_updated":"2024-07-26T17:50:27Z","snapshot_observed_at":"2026-08-07T12:10:53.303603Z","submitted_at":"2024-07-25T17:35:59Z","title":"Recursive Introspection: Teaching Language Model Agents How to Self-Improve","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18219","snapshot_observed_at":"2026-08-07T06:07:02.058112Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.058112Z"},"links":{"cited_paper":"/paper/2407.18219","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:1de2677ea0c3084813f992670b9c342f5515a860d4fa751a46e451dd1d3a3844","observation_id":"240fdee3-e6fb-4e72-ab6c-d236343dbeff","resolution":{"observed_at":"2026-08-07T06:07:02.058112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.484777Z","title":null,"venue":null,"work_id":"94143787-50de-448c-ab20-c9969e0ce0d3","year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.061385Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:3204cf875d0e06a2a0712ff3bfc4e6f90c64102b1bc3c5f80730a6af9833fd6e","observation_id":"a0289a2f-f48d-4367-9d62-3fb1d7e8a19a","resolution":{"observed_at":"2026-08-07T06:07:02.488026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.064199Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.064199Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:1b3013bffb6ed9dcbe641d40b2a4dd38fa73d7ddbb27015ab9e961944fc1bf0b","observation_id":"e3c7f2da-8a66-47c0-b9b9-cb3b863d71f2","resolution":{"observed_at":"2026-08-07T06:07:02.064199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.066957Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.066957Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:e547fd279e4e4b8a00c3a837c892934e0c8ff3b72b339451da31fc3ee0baa640","observation_id":"8d62d28c-59f8-4d8d-a541-ff514de9200d","resolution":{"observed_at":"2026-08-07T06:07:02.066957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.069605Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.069605Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:11ee5b29393d6641c22da700c3ca443dfd722ee751892d180b09f5d4a8678e8c","observation_id":"0f14bae8-f08e-4f62-ba2d-9cb358d8eb81","resolution":{"observed_at":"2026-08-07T06:07:02.069605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.072269Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.072269Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:4e14bfe418a8bae1e7ec9f74b5d291f239a7b2c9b71a115d78ff412611e1d03b","observation_id":"429d58db-9a7f-433a-92e6-8cd9a2964ec3","resolution":{"observed_at":"2026-08-07T06:07:02.072269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.450877Z","title":null,"venue":null,"work_id":"619c1ff6-ee59-4c53-88e8-5034bbba88dc","year":1979},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.075154Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:8481f1ab2123674d4b17e9607bfc9aa2cd612e5a090e710a90d01f017bd5544d","observation_id":"b414345b-aa49-4c5e-a267-65b1183c2d77","resolution":{"observed_at":"2026-08-07T06:07:02.453762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T06:07:02.078218Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.078218Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:fc44556f6157bec68ff6a03d807407e36326e7c0601537071f31921ed16a60ff","observation_id":"7ca97041-5f81-428c-8287-3dc77c8239d5","resolution":{"observed_at":"2026-08-07T06:07:02.078218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.441833Z","title":null,"venue":null,"work_id":"98e36126-5bc2-4bdc-b7ff-3ee6fda9476b","year":1971},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.081251Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:ed89bad87d613b603f370685c74004244b568dc6289d00470237bec94afdf4bc","observation_id":"3a8cd4f1-5e19-4997-bd32-5b4e9ae2bd3e","resolution":{"observed_at":"2026-08-07T06:07:02.444742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T06:07:02.084050Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.084050Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:abf4f0002f9fb44cf6482a4a0971de4e3c99d7ce0bfdcb7bbb304717a3feda7a","observation_id":"ecba1e32-ca90-4164-998b-5c71dbe261b2","resolution":{"observed_at":"2026-08-07T06:07:02.084050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.432631Z","title":null,"venue":null,"work_id":"0eedef3c-ade8-46bd-9b4c-4fb33b2757c0","year":1988},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.087091Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:3b24b1ab105d78b708d334a2175a78550eac319cfd9d7bba854210fa11059d57","observation_id":"5e4046cb-f43d-485f-a977-3299fb9f0052","resolution":{"observed_at":"2026-08-07T06:07:02.435618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T06:07:02.089755Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.089755Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:bffccaa964421e91558643bd2699c173a8ff08d1eb5e92eeffa7eac2510f7c7d","observation_id":"e5792110-ad88-4671-964a-a5b8859a5d18","resolution":{"observed_at":"2026-08-07T06:07:02.089755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.092644Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.092644Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:738162a7feff6374974378ae420ac6f2ccac4bc411db1ec8c0b9ceeff0847ce6","observation_id":"bfb59995-fcf9-4ed4-a7c5-2584175072a5","resolution":{"observed_at":"2026-08-07T06:07:02.092644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17498","last_updated":"2025-08-24T16:41:54Z","snapshot_observed_at":"2026-07-06T20:12:04.557004Z","submitted_at":"2024-12-23T11:55:33Z","title":"DRT: Deep Reasoning Translation via Long Chain-of-Thought","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17498","snapshot_observed_at":"2026-08-07T06:07:02.095155Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.095155Z"},"links":{"cited_paper":"/paper/2412.17498","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:40049f2e4442a316bd8b30979d7d3a4108ca6aa1a62e57563d4dcbab5849f216","observation_id":"617291b0-867b-4816-97f9-e09c6666a867","resolution":{"observed_at":"2026-08-07T06:07:02.095155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.098175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.098175Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:9ea2f26f66c9a67d3622bedf2a8fd9e8983edcaa89466effbe60d0c236184c31","observation_id":"491b5ac9-a129-4783-ba7c-6607f705e9b3","resolution":{"observed_at":"2026-08-07T06:07:02.098175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05087","last_updated":"2024-05-24T06:37:31Z","snapshot_observed_at":"2026-08-07T12:09:31.277517Z","submitted_at":"2023-06-08T10:41:56Z","title":"PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05087","snapshot_observed_at":"2026-08-07T06:07:02.101272Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.101272Z"},"links":{"cited_paper":"/paper/2306.05087","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:6712e8bbeabb0178a815ac6df27598474ab704ba16617126d640c449849b19c6","observation_id":"95bf17a7-838b-45b7-9e5f-4411dfae52a6","resolution":{"observed_at":"2026-08-07T06:07:02.101272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-07-06T20:28:33.378335Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-07T06:07:02.104060Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.104060Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:482753863ec1fe7b81670c75962c65ad89c8f3076bee44619bff1171386bde4d","observation_id":"76841248-9d69-4b5e-b366-47d44e28e2b8","resolution":{"observed_at":"2026-08-07T06:07:02.104060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:07:02.107069Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.107069Z"},"links":{"citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:eae4c19431480ca26e430e4b1a3d6b4eddd28065f018d896dd3971c911e96503","observation_id":"861754ea-92b0-4b77-ab47-7d256420d134","resolution":{"observed_at":"2026-08-07T06:07:02.107069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-07T06:07:02.109745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.109745Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:874a4c1361918e6af8e4db474adb5ff990af3224174cb2250ffc9f7228f84573","observation_id":"922c3bed-baff-4497-b9b8-297001d79be1","resolution":{"observed_at":"2026-08-07T06:07:02.109745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-07T08:02:34.857823Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-07T06:07:02.112916Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.112916Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:e881bdd8ed9aa212e9f51bb8cca19fa9b8722da0d9a134688cf7bf38dd2ff871","observation_id":"25ec39e4-7325-4bf2-93cd-bd83a1ca71c3","resolution":{"observed_at":"2026-08-07T06:07:02.112916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14959","last_updated":"2025-07-15T07:07:14Z","snapshot_observed_at":"2026-07-06T20:10:15.143454Z","submitted_at":"2024-12-19T15:39:31Z","title":"Understanding the Dark Side of LLMs' Intrinsic Self-Correction","version":2},"cited_work":{"arxiv_id":"2412.14959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14959","snapshot_observed_at":"2026-08-07T06:07:02.170366Z","title":"Understanding the Dark Side of LLMs' Intrinsic Self-Correction","venue":"cs.CL","work_id":"1023339a-7f68-4367-b0ad-ccdf61e0fb38","year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.115821Z"},"links":{"cited_paper":"/paper/2412.14959","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:58f004267d17fcd1a06b7c118d82081b204704522572b78254a8e3e38ed1715a","observation_id":"33364e88-0301-43cb-82b7-a273cb02dc70","resolution":{"observed_at":"2026-08-07T06:07:02.175915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00154","last_updated":"2024-12-10T04:39:25Z","snapshot_observed_at":"2026-08-05T17:55:01.214018Z","submitted_at":"2024-11-29T07:19:56Z","title":"o1-Coder: an o1 Replication for Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00154","snapshot_observed_at":"2026-08-07T06:07:02.118750Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.118750Z"},"links":{"cited_paper":"/paper/2412.00154","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:b4425eb5cfc03f05fdd6894569f3ede84e32b97ca2fa1710a499f35a98d649f1","observation_id":"19cb7ee1-9951-4eca-8ed0-a9302ad030b9","resolution":{"observed_at":"2026-08-07T06:07:02.118750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14405","last_updated":"2024-11-25T17:57:55Z","snapshot_observed_at":"2026-07-06T19:53:56.407834Z","submitted_at":"2024-11-21T18:37:33Z","title":"Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14405","snapshot_observed_at":"2026-08-07T06:07:02.121912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.121912Z"},"links":{"cited_paper":"/paper/2411.14405","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:72830e7e961c0b5f88926f6565dbaac482255031235ec7c1382a0ff031e1cbb9","observation_id":"b1d0106d-abe3-4a86-b6f0-07b718b24a5d","resolution":{"observed_at":"2026-08-07T06:07:02.121912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T12:09:47.632552Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2506.06009."}