{"as_of":"2026-08-22T01:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a88458564bad8741995347292fae117c96a950a8f21ca44132c45b79e44fe089","coverage":[{"denominator":112,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:59:11.621135Z","state":"measured"},{"denominator":104,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":104,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:43:44.229927Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T18:16:17.926450Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"cited_work":{"arxiv_id":"2411.08147","doi":"10.48550/arxiv.2411.08147","metadata_source":"pith","pith_arxiv_id":"2411.08147","snapshot_observed_at":"2026-08-10T18:16:17.926450Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","venue":"cs.CL","work_id":"68659f34-a431-4d0f-a747-7c62287406ba","year":2024},"citing_paper":{"arxiv_id":"2501.13042","last_updated":"2025-02-25T16:41:36Z","snapshot_observed_at":"2026-08-17T23:05:30.623754Z","submitted_at":"2025-01-22T17:44:01Z","title":"Does Table Source Matter? Benchmarking and Improving Multimodal Scientific Table Understanding and Reasoning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T16:34:40.543242Z"},"links":{"cited_paper":"/paper/2411.08147","citing_paper":"/paper/2501.13042"},"observation_digest":"sha256:fc2594b346b43ec45ae56313f0b69649c82f2e06d4ef32a0218736e77650efaa","observation_id":"b4ee988a-3f88-438a-885e-7930504f9ce1","resolution":{"observed_at":"2026-08-10T16:34:40.617192Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08147","snapshot_observed_at":"2026-08-16T04:43:44.229927Z","title":"Large language models can self-improve in long-context reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00551","last_updated":"2025-05-15T14:16:03Z","snapshot_observed_at":"2026-08-17T18:29:23.516617Z","submitted_at":"2025-05-01T14:28:35Z","title":"100 Days After DeepSeek-R1: A Survey on Replication Studies and More Directions for Reasoning Language Models","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-16T04:43:44.229927Z"},"links":{"cited_paper":"/paper/2411.08147","citing_paper":"/paper/2505.00551"},"observation_digest":"sha256:96cdecd93e1a7ea3bd5f0952586a16306aec0cc1b340c4c22bce18d449c486e2","observation_id":"14a587b3-fe87-4db8-9ebb-748a1039dd17","resolution":{"observed_at":"2026-08-16T04:43:44.229927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08147","snapshot_observed_at":"2026-08-15T21:23:46.376793Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10063","last_updated":"2025-05-15T08:05:12Z","snapshot_observed_at":"2026-08-19T02:21:41.161285Z","submitted_at":"2025-05-15T08:05:12Z","title":"CAFE: Retrieval Head-based Coarse-to-Fine Information Seeking to Enhance Multi-Document QA Capability","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T21:23:46.376793Z"},"links":{"cited_paper":"/paper/2411.08147","citing_paper":"/paper/2505.10063"},"observation_digest":"sha256:1438bcb221067df3112fa3c1ed2efbcf5fa931ccd80cad95ba8125dbe83602b4","observation_id":"27c72fba-56b9-40bb-9cb5-9c63d6cf06fd","resolution":{"observed_at":"2026-08-15T21:23:46.376793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08147","snapshot_observed_at":"2026-07-14T10:51:16.019022Z","title":"arXiv preprint arXiv:2411.08147 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10557","last_updated":"2026-07-12T04:13:27Z","snapshot_observed_at":"2026-08-20T06:50:44.998850Z","submitted_at":"2026-07-12T04:13:27Z","title":"UNIBROWSE: A Data-to-Agent Framework for Multimodal BrowseComp","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-14T10:51:16.019022Z"},"links":{"cited_paper":"/paper/2411.08147","citing_paper":"/paper/2607.10557"},"observation_digest":"sha256:865ee24fbd67f176423fae581706e9e48f347a109561ec4c450f85699a910e29","observation_id":"1725a611-9fe4-4818-aec8-d5fc573dd06a","resolution":{"observed_at":"2026-07-14T10:51:16.019022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.08147/citation-record","integrity":"/paper/2411.08147/integrity","json":"/paper/2411.08147/citation-record.json","paper":"/paper/2411.08147"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T21:59:11.306537Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.306537Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:d0cd6691c72c9691774ab1c83a0ed1808ae21534affdeaef10ffe03f4086b8ef","observation_id":"8a918d31-e3fc-4ea4-93b3-159d55fde0e2","resolution":{"observed_at":"2026-08-12T21:59:11.306537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.311066Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.311066Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:d48d4b2db6a57f56b1562b641b550f5f27d65690e4c13fcd1fc1bbbba390096b","observation_id":"3dabd5db-0c68-4d89-b0ce-a90f2a924cb7","resolution":{"observed_at":"2026-08-12T21:59:11.311066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.314878Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.314878Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:e5ebf01e0672b03ef52f297a5d93cbadecff0af10e5d22834d5c9b79903f5fef","observation_id":"509026b9-55e0-4fbc-a7a6-dd7391a07281","resolution":{"observed_at":"2026-08-12T21:59:11.314878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18745","last_updated":"2024-10-24T13:51:50Z","snapshot_observed_at":"2026-08-16T13:06:16.669745Z","submitted_at":"2024-10-24T13:51:50Z","title":"Why Does the Effective Context Length of LLMs Fall Short?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18745","snapshot_observed_at":"2026-08-12T21:59:11.318494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.318494Z"},"links":{"cited_paper":"/paper/2410.18745","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:58e05eaf6077b32d609eef770409ef7f7eabd0a913c0a29bba8238d9ea35907d","observation_id":"e88427c0-687d-4f77-b162-da7af3e8fca8","resolution":{"observed_at":"2026-08-12T21:59:11.318494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16811","last_updated":"2024-04-26T11:15:21Z","snapshot_observed_at":"2026-08-21T16:19:00.812974Z","submitted_at":"2024-04-25T17:55:14Z","title":"Make Your LLM Fully Utilize the Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16811","snapshot_observed_at":"2026-08-12T21:59:11.322583Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.322583Z"},"links":{"cited_paper":"/paper/2404.16811","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:21d55856b9c69258f22328a2c9a532a6f0b1cbf322a7e8484f3db778567e062b","observation_id":"2e99b3c0-4e25-4e48-804d-41a66801d0a2","resolution":{"observed_at":"2026-08-12T21:59:11.322583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.326458Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.326458Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:c1538a757fc2f364a2f54a6d4fcc20720f14e8bbeceaba9a7d313bee97fc3b05","observation_id":"392585d0-a57b-4dce-af7f-0a2ec01a3c8b","resolution":{"observed_at":"2026-08-12T21:59:11.326458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.330307Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.330307Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:3c5428a7f312a4cb578ed0f9de03a3e4c98952a83f233dda5e9411368e593086","observation_id":"354655eb-68fe-4eed-b326-cd72f108b74f","resolution":{"observed_at":"2026-08-12T21:59:11.330307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.18058","last_updated":"2024-01-31T18:29:39Z","snapshot_observed_at":"2026-08-16T14:22:46.159588Z","submitted_at":"2024-01-31T18:29:39Z","title":"LongAlign: A Recipe for Long Context Alignment of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.18058","snapshot_observed_at":"2026-08-12T21:59:11.333514Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.333514Z"},"links":{"cited_paper":"/paper/2401.18058","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:fe508be9671eb0dd8b3e96c710f70ee98973659bbf1339fb4c11d418f0ac3e1d","observation_id":"7d990902-ad1d-454f-bba7-970403b1daaa","resolution":{"observed_at":"2026-08-12T21:59:11.333514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-12T21:59:11.337185Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.337185Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:05e7d2598ac88410fe354d3057a7887aaafb088e2d3c0d81489c0528e231a9bc","observation_id":"ef285698-d967-47a1-968f-11681ce2145c","resolution":{"observed_at":"2026-08-12T21:59:11.337185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.340595Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.340595Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:959d7409cede975ee6fac814540908a9ce81c2199331fa762b6eba6c4a74bb0d","observation_id":"37a5a221-87c8-41d5-87ac-b8c68c9f7bf9","resolution":{"observed_at":"2026-08-12T21:59:11.340595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.343731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.343731Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:5619f7beeeb122761d0e3971e9b084ce8c7a802bdf66c39625c42bc7e847d0de","observation_id":"ff9ab0f2-33a6-4696-829d-b45653353371","resolution":{"observed_at":"2026-08-12T21:59:11.343731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.346733Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.346733Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:c20ee034f457e2d094f1c30f89440426675d80de1c0ff88d256467e2d2404e20","observation_id":"9561d0c8-6a24-42f9-8dde-222482d790bf","resolution":{"observed_at":"2026-08-12T21:59:11.346733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.349631Z","title":"Bickel and K.A","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.349631Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:217e508bafa71418d07dd5b28161240f04d86bebc78a2b9e1888fab77ca680dd","observation_id":"739b5958-0b73-4fcb-a02a-b9dec1801d39","resolution":{"observed_at":"2026-08-12T21:59:11.349631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-18T22:17:47.865607Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-12T21:59:11.352448Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.352448Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:956dac3b553120205832f73019fba3d10949a744defb80c4034675110dcd5a57","observation_id":"6ee08289-7d7c-4705-bc8b-60d9657628e9","resolution":{"observed_at":"2026-08-12T21:59:11.352448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15595","last_updated":"2023-06-28T04:26:05Z","snapshot_observed_at":"2026-08-16T11:24:28.964729Z","submitted_at":"2023-06-27T16:26:26Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15595","snapshot_observed_at":"2026-08-12T21:59:11.355767Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.355767Z"},"links":{"cited_paper":"/paper/2306.15595","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:526bf040cd6e80d178ed2c5f470e9a00102624e7e528c07237bcd7c42049b39e","observation_id":"7e925acf-8f64-4f92-8f8b-6df75b5f8399","resolution":{"observed_at":"2026-08-12T21:59:11.355767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.359164Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.359164Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:4ab2f623f2283807ca54fb6c3204a01a6ede91ee8cf60e1eab1ce47616b1aef2","observation_id":"abf60e79-3821-40a9-a09c-04386207b308","resolution":{"observed_at":"2026-08-12T21:59:11.359164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.362368Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.362368Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:7a6ecfffa035f4ff87b25440b78560ace935f973f0d9497820200708f6393248","observation_id":"a4c9daad-e1b8-46be-bb93-4559074dfb04","resolution":{"observed_at":"2026-08-12T21:59:11.362368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01893","last_updated":"2025-05-19T16:32:11Z","snapshot_observed_at":"2026-08-16T13:21:46.202122Z","submitted_at":"2024-09-03T13:30:00Z","title":"What are the Essential Factors in Crafting Effective Long Context Multi-Hop Instruction Datasets? Insights and Best Practices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01893","snapshot_observed_at":"2026-08-12T21:59:11.365346Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.365346Z"},"links":{"cited_paper":"/paper/2409.01893","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:9a22b7948d3cc9cdd56f57d0ceec6d55fcbf7825d7ee839e10f5c03ea1c3af25","observation_id":"e3f0d919-6313-43fe-a42c-985bdb14ffbe","resolution":{"observed_at":"2026-08-12T21:59:11.365346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-12T21:59:11.368436Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.368436Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:b96c85f3de5b88f06843221bd50db5dfc9b15f5ad3fd2feba419aeb6a4294935","observation_id":"c0f5226c-65a3-43d5-ac16-74175ea3ad2b","resolution":{"observed_at":"2026-08-12T21:59:11.368436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-12T21:59:11.371647Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.371647Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:cce0f3b6ffeeeb982d574bb2dcf9af861d5c083aabbe665d7035a9a5cab3be04","observation_id":"cb5bf869-a2fb-4b9e-ac8f-3e77d9e3fcba","resolution":{"observed_at":"2026-08-12T21:59:11.371647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01377","last_updated":"2024-07-16T03:24:39Z","snapshot_observed_at":"2026-08-14T00:28:11.851309Z","submitted_at":"2023-10-02T17:40:01Z","title":"UltraFeedback: Boosting Language Models with Scaled AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01377","snapshot_observed_at":"2026-08-12T21:59:11.374842Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.374842Z"},"links":{"cited_paper":"/paper/2310.01377","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:0833fc3c504d26d6464256bf199dcb3a41d2c3f96ef1a13e45ca382e39cdddb4","observation_id":"b19e1b83-3fc0-4dab-bc38-926d3911d61c","resolution":{"observed_at":"2026-08-12T21:59:11.374842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.377998Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.377998Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:a5eeb18c6f509a66a4f79742acaedf194e0bd68c5d7427b60899150656f62038","observation_id":"5172e102-cacd-49f1-a271-3b1711b65aab","resolution":{"observed_at":"2026-08-12T21:59:11.377998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.381347Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.381347Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:4c906bdf335c79d807e31f08b4fb454d5a2def328ef3a6c06f66f540f162162d","observation_id":"3bd30292-d155-457a-829f-10bf187509e1","resolution":{"observed_at":"2026-08-12T21:59:11.381347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02486","last_updated":"2023-07-19T12:25:35Z","snapshot_observed_at":"2026-08-16T15:18:27.962961Z","submitted_at":"2023-07-05T17:59:38Z","title":"LongNet: Scaling Transformers to 1,000,000,000 Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02486","snapshot_observed_at":"2026-08-12T21:59:11.384267Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.384267Z"},"links":{"cited_paper":"/paper/2307.02486","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:b78faf66a146627c608857977aa4c010439c3b94f15896c6527dfaf2eb9e4088","observation_id":"e1d38f53-668b-45bd-986e-c9910b2847a6","resolution":{"observed_at":"2026-08-12T21:59:11.384267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.387537Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.387537Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:d9f921a8d0ae7cc845f3a7c93facc36d1a3cd28af67ea9d39cb4e5718610a98d","observation_id":"6f31a60e-d1f3-4289-83f0-7e4877a4b4ff","resolution":{"observed_at":"2026-08-12T21:59:11.387537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T21:59:11.390488Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.390488Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:dfd686d0d5eb3ad8139a58bb42c9b14dc64134a047826fb3b1eafb03e2849a76","observation_id":"82d94504-c315-494a-a177-3a331dcb2e14","resolution":{"observed_at":"2026-08-12T21:59:11.390488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.393791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.393791Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:88dcc48e7a6542f9e811e16ef72eb2a42c014a7bc9163234dace0c8473054d22","observation_id":"2f3bc8b2-97fd-4d87-a5ab-3f458e140287","resolution":{"observed_at":"2026-08-12T21:59:11.393791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.396861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.396861Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:4a7c6e1906f06b5739013fa16b6b901a477ae5988671dd8d367e43d4fcab7fc2","observation_id":"bb6a64d0-6233-4a37-9cab-f0f1ba3243d1","resolution":{"observed_at":"2026-08-12T21:59:11.396861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10171","last_updated":"2024-02-15T18:19:16Z","snapshot_observed_at":"2026-08-21T17:34:39.398716Z","submitted_at":"2024-02-15T18:19:16Z","title":"Data Engineering for Scaling Language Models to 128K Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10171","snapshot_observed_at":"2026-08-12T21:59:11.399879Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.399879Z"},"links":{"cited_paper":"/paper/2402.10171","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:cae7bc5d82774aaf526f037f27327d50e96b80c470d59196249879cd7de88c11","observation_id":"5283bd0b-4f60-478a-b28c-5fc97fc64b0a","resolution":{"observed_at":"2026-08-12T21:59:11.399879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07459","last_updated":"2023-02-18T21:30:27Z","snapshot_observed_at":"2026-08-16T15:55:15.315299Z","submitted_at":"2023-02-15T04:25:40Z","title":"The Capacity for Moral Self-Correction in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07459","snapshot_observed_at":"2026-08-12T21:59:11.403148Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.403148Z"},"links":{"cited_paper":"/paper/2302.07459","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:4baaadd50883ca4331bca411bf6e91440d32eed3a59e7f2364581b0b6deefa44","observation_id":"6dedd3d2-c6c3-436a-84b4-af3b8e919535","resolution":{"observed_at":"2026-08-12T21:59:11.403148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.406956Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.406956Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:3700987247ecffb28a3a24bed5640e9326d9ba07a768d1d1f3cdd89045d9e7a7","observation_id":"e4aa1090-0d5e-4a7e-9055-d0b56a25d104","resolution":{"observed_at":"2026-08-12T21:59:11.406956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-12T21:59:11.409930Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.409930Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:f1a853446faa179ff2d69dfd3c85688201beadd20bc3bf771baceedd79b55d26","observation_id":"d36d4899-7809-4eb9-96de-33aa57067f44","resolution":{"observed_at":"2026-08-12T21:59:11.409930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.413071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.413071Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:bf6e787dae8b885f4ebf2ba10dc65f8cfda13361e09f687350872abac0c1b9b5","observation_id":"7f06b897-ccd0-49d1-8925-f798f58d15c4","resolution":{"observed_at":"2026-08-12T21:59:11.413071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08998","last_updated":"2023-08-21T10:23:42Z","snapshot_observed_at":"2026-08-13T14:38:32.919809Z","submitted_at":"2023-08-17T14:12:48Z","title":"Reinforced Self-Training (ReST) for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08998","snapshot_observed_at":"2026-08-12T21:59:11.415869Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.415869Z"},"links":{"cited_paper":"/paper/2308.08998","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:1f7baeb3982e3e6a784378d5e95549ac1bc8cdc4f15149e06c6cd4f0299a655b","observation_id":"cbe9ffd4-fc00-4b25-a7f0-dd4a1fff88b4","resolution":{"observed_at":"2026-08-12T21:59:11.415869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.418981Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.418981Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:db00fdf77de8b1db3c0b57cdc049647adaf647ed1e21dfea2183a00b763f21db","observation_id":"1762ad22-dc37-428a-ae9f-d433fcae8340","resolution":{"observed_at":"2026-08-12T21:59:11.418981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.421706Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.421706Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:8dfc64becfdc9931c1ed92c5ccd2da8afbf5c14f4619d10d4cad5fea8a6cf46e","observation_id":"8e6aa272-51e4-4a3e-bcc2-f6ad74fac1f2","resolution":{"observed_at":"2026-08-12T21:59:11.421706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07691","last_updated":"2024-03-14T07:47:08Z","snapshot_observed_at":"2026-08-16T14:56:35.674907Z","submitted_at":"2024-03-12T14:34:08Z","title":"ORPO: Monolithic Preference Optimization without Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07691","snapshot_observed_at":"2026-08-12T21:59:11.424607Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.424607Z"},"links":{"cited_paper":"/paper/2403.07691","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:e2ed02726db19925f5063092ee0645e7340ee2d6eb18800f37c9ada762ddb753","observation_id":"a247b1b7-f16e-4b2a-8edb-674c8601e163","resolution":{"observed_at":"2026-08-12T21:59:11.424607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.427457Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.427457Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:489d8401f37d82b7b8ee5685dc61193f855a46865d5ac142497d1dbc3a3b188a","observation_id":"a6d6cbf8-1023-4901-8447-69da31179a18","resolution":{"observed_at":"2026-08-12T21:59:11.427457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-18T14:33:16.365411Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-12T21:59:11.430548Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.430548Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:0203a7c8a73e7f07f0c7332df1551de3380ac219f876054b908b945d79313923","observation_id":"e2a5de38-6888-493c-a419-5fcd61ecccc4","resolution":{"observed_at":"2026-08-12T21:59:11.430548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.433714Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.433714Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:d9b444dbb0eb6921c0c40942f15b62cdfb52381f4cfb7ea5dc269759a92298d9","observation_id":"f9624050-6c9d-4344-8497-db53506adce2","resolution":{"observed_at":"2026-08-12T21:59:11.433714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.436778Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.436778Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:8d9c35bf4dbacbf57483bfe094ef70bfa3d2e05e1e8b3aed08ea512f65217917","observation_id":"6e4d9a5f-68c4-4308-a50d-c58376af60d8","resolution":{"observed_at":"2026-08-12T21:59:11.436778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-12T21:59:11.439591Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.439591Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:0e105e1491d7397c672596485aa14e722f038f06e147d4152793fc8ea0df1023","observation_id":"8ec6703e-cebf-470d-8c86-fded145b4a81","resolution":{"observed_at":"2026-08-12T21:59:11.439591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10702","last_updated":"2023-11-20T02:01:33Z","snapshot_observed_at":"2026-08-18T15:11:49.913463Z","submitted_at":"2023-11-17T18:45:45Z","title":"Camels in a Changing Climate: Enhancing LM Adaptation with Tulu 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10702","snapshot_observed_at":"2026-08-12T21:59:11.442695Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.442695Z"},"links":{"cited_paper":"/paper/2311.10702","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:f151ba2c44fe442f518c86dd7c47429ed9a9798615650c6942d3207837edf638","observation_id":"d1e7c5d9-ad45-4730-bc51-95efb318188d","resolution":{"observed_at":"2026-08-12T21:59:11.442695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-20T06:29:44.483696Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14509","snapshot_observed_at":"2026-08-12T21:59:11.445695Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.445695Z"},"links":{"cited_paper":"/paper/2309.14509","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:4494c1e6e5d40758587891a6d37f78f7bcc8b289375ff7b4aa6f8d20d3316bdd","observation_id":"d9273d0f-97c5-4a90-8012-f42e1105f403","resolution":{"observed_at":"2026-08-12T21:59:11.445695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04298","last_updated":"2024-09-06T01:14:26Z","snapshot_observed_at":"2026-08-17T22:52:54.773071Z","submitted_at":"2024-04-04T20:27:37Z","title":"SELF-[IN]CORRECT: LLMs Struggle with Discriminating Self-Generated Responses","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04298","snapshot_observed_at":"2026-08-12T21:59:11.449089Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.449089Z"},"links":{"cited_paper":"/paper/2404.04298","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:45f9595ff4577517747b767abe0038e2137f705da3fcf55b97a2ad2487a17efb","observation_id":"61a0b5a9-cc02-46c6-8735-7f2cf0f1ad99","resolution":{"observed_at":"2026-08-12T21:59:11.449089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.452296Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.452296Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:b9174bd7c7899ccedf7a08de05ccdfa1f2ae2a00bf7c80820e2a9d78ee71afc1","observation_id":"9681af41-2f08-4e33-9465-f9cdd956a3ad","resolution":{"observed_at":"2026-08-12T21:59:11.452296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.455500Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.455500Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:a889a3691fad45d5c3caa21e97cfc83fbfb2e77b044d81bf9e5f1dc1fbba5bdc","observation_id":"6e422970-bc84-4f76-b750-a0a64c7b1626","resolution":{"observed_at":"2026-08-12T21:59:11.455500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.458498Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.458498Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:b0eddd49e8867d19f26ecfd53ef2ebd80cc881e18d56349c52d15305330bc2a3","observation_id":"f7e91e14-a153-4ca6-ae4d-0258bd882691","resolution":{"observed_at":"2026-08-12T21:59:11.458498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16264","last_updated":"2024-10-22T15:09:58Z","snapshot_observed_at":"2026-08-16T13:40:19.287703Z","submitted_at":"2024-06-24T02:03:57Z","title":"One Thousand and One Pairs: A \"novel\" challenge for long-context language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16264","snapshot_observed_at":"2026-08-12T21:59:11.461492Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.461492Z"},"links":{"cited_paper":"/paper/2406.16264","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:29dfd7c6f6470fbce187d145970949737cb70fa4bc419c0dcdf62532b9825743","observation_id":"e1156245-d11f-4974-8b38-d32615c8ab4c","resolution":{"observed_at":"2026-08-12T21:59:11.461492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.464840Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.464840Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:70da9f6e4c644bae44805681f68cc5c314c8fd2e525522d0a6c3f3e4826a2e08","observation_id":"dee2e371-e6d9-44ea-b8c6-79b428defc9d","resolution":{"observed_at":"2026-08-12T21:59:11.464840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.468356Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.468356Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:2bac86c36043ff81451e3b28d05d8bd36b31d570a72a0c1a569b51a04b634b29","observation_id":"974ba318-2539-4414-b5e1-112525dfc358","resolution":{"observed_at":"2026-08-12T21:59:11.468356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15287","last_updated":"2024-10-20T04:57:45Z","snapshot_observed_at":"2026-08-17T23:56:00.082609Z","submitted_at":"2024-10-20T04:57:45Z","title":"Training Language Models to Critique With Multi-agent Feedback","version":1},"cited_work":{"arxiv_id":"2410.15287","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15287","snapshot_observed_at":"2026-08-12T21:59:12.001360Z","title":"Training Language Models to Critique With Multi-agent Feedback","venue":"cs.CL","work_id":"47e337de-4655-4686-80e2-0bd52801157a","year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.471411Z"},"links":{"cited_paper":"/paper/2410.15287","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:46cc767105ae9cf61d5d40ee4bdfc2ad402140577434bbcae488d3147ce2236b","observation_id":"80d4dc1a-5b77-48b6-aaac-edb217397620","resolution":{"observed_at":"2026-08-12T21:59:12.006873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13764","last_updated":"2024-10-20T05:32:25Z","snapshot_observed_at":"2026-08-18T06:12:16.094787Z","submitted_at":"2024-02-21T12:38:59Z","title":"CriticEval: Evaluating Large Language Model as Critic","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13764","snapshot_observed_at":"2026-08-12T21:59:11.474773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.474773Z"},"links":{"cited_paper":"/paper/2402.13764","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:4587678bb5dae3a000daaa18da1f69fb0999c8083f9f98e0045cf9a8a1ef00cc","observation_id":"3d6373db-0923-4f5f-9efe-8e4f21f093b4","resolution":{"observed_at":"2026-08-12T21:59:11.474773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.478016Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.478016Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:14834019479ae8b0b0b20f58349c4b797a444da77a6c0668acf8c224f7bee58f","observation_id":"4b3ca501-514d-45b2-83b9-9f6d138490f3","resolution":{"observed_at":"2026-08-12T21:59:11.478016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03227","last_updated":"2024-10-04T08:29:12Z","snapshot_observed_at":"2026-08-16T13:12:40.647371Z","submitted_at":"2024-10-04T08:29:12Z","title":"ALR$^2$: A Retrieve-then-Reason Framework for Long-context Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03227","snapshot_observed_at":"2026-08-12T21:59:11.481767Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.481767Z"},"links":{"cited_paper":"/paper/2410.03227","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:d7c303fac5d863cbb6c33eefac0b3f8e5d7231599dc9d3b63f91f20619d6b9a4","observation_id":"7a299b91-40f2-4427-8bc4-791eb3b56e0f","resolution":{"observed_at":"2026-08-12T21:59:11.481767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.485205Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.485205Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:a6d9559529112e518dfb87d764637de696386cfbbba73dccd6f059ef9e8a3b3f","observation_id":"c0cf0d74-be64-45e6-8750-e41c703122c1","resolution":{"observed_at":"2026-08-12T21:59:11.485205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.488339Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.488339Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:77c241f3d7d34c955cacb8cddb525124d93baf4110a018a1a71d55caf62c88cd","observation_id":"6523ec48-8509-49ad-9b5a-729520146a8e","resolution":{"observed_at":"2026-08-12T21:59:11.488339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19887","last_updated":"2024-07-03T14:30:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T23:55:06Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19887","snapshot_observed_at":"2026-08-12T21:59:11.491299Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.491299Z"},"links":{"cited_paper":"/paper/2403.19887","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:1fb814c16544b383d518fae1cabde3c6f8104b4639284b3dca389da106373645","observation_id":"419a9974-5a29-4d11-9bb9-7c1c9b52e551","resolution":{"observed_at":"2026-08-12T21:59:11.491299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.494523Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.494523Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:fef0e8094553f50b4088caa71c2d19f2ceb7ba510b354dc07c268628998fff96","observation_id":"c9bac916-d2b2-4e8a-b2e6-7e0ae6134fe3","resolution":{"observed_at":"2026-08-12T21:59:11.494523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.497467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.497467Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:4c69531c91813cf1dd9a0e61c1155bbc4a84dde5e9f2145e7a9ded5510563589","observation_id":"9c5982ca-cfa1-44a6-a9bc-4b0342e10c9a","resolution":{"observed_at":"2026-08-12T21:59:11.497467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.500312Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.500312Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:7a98383998576091af5737fd95da7adb8f65ef99771b3aaed7d095a78e51b9f7","observation_id":"55bd8efa-d946-469d-b6eb-e6601d1c8245","resolution":{"observed_at":"2026-08-12T21:59:11.500312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-12T21:59:11.503157Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.503157Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:16ecadbb0a69380bc18b8edfb06297b27dac0447c8d6c61a45cd20a34709917f","observation_id":"f50ed608-6eb8-44e8-ac3a-1a6efb078d9f","resolution":{"observed_at":"2026-08-12T21:59:11.503157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-08-20T13:31:05.293801Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-12T21:59:11.506456Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.506456Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:e5a9b5360ea6986cdbd64fc9a46cd0b0e498ff1f30204e517c27cbd8453ba82c","observation_id":"23363eee-02df-4ebb-b7e9-31e27ad75bbb","resolution":{"observed_at":"2026-08-12T21:59:11.506456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.509653Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.509653Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:4b5d8b7643a7f5fe4fde140a5473b0e17b0612b1b49572a7e0d4645593bfdf99","observation_id":"fd1b14dc-e64d-4505-ae7b-375c3626dd73","resolution":{"observed_at":"2026-08-12T21:59:11.509653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.512655Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.512655Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:aed25a3a241b0c214f5ced51a25a441e2d57db747f26022d5c070d29ba41d8af","observation_id":"39ce6e49-77ea-4eb8-b2a0-70f42683350f","resolution":{"observed_at":"2026-08-12T21:59:11.512655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.515509Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.515509Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:048f059186c044ac8e253f0dbc2c703c9e78358d9408fc122ad3de92923ccd6e","observation_id":"2032335d-8d27-4947-9dad-9c74f00b81c1","resolution":{"observed_at":"2026-08-12T21:59:11.515509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.561746Z","title":null,"venue":null,"work_id":"adc1ee0a-a57e-4a3f-b8cf-2fb046e06f92","year":2022},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.518421Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:9355bf60d96b66074f80653f7207ce1e7111de95e54f79526940339f5a2c7424","observation_id":"18c794d3-e2b7-46e9-ae57-43d3f4987e06","resolution":{"observed_at":"2026-08-12T21:59:12.564988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.521265Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.521265Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:dc86c779a89ec81879750366e711af5c133382f648e40fdf84ff02b3ffe69553","observation_id":"4860d0f3-6582-4e0c-ba29-b429538df09a","resolution":{"observed_at":"2026-08-12T21:59:11.521265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.545124Z","title":null,"venue":null,"work_id":"229e3801-ba44-4ae2-9ee7-cbd67622d7b4","year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.524202Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:51ccdb987af5b53df42bffa8f3acfccfa1275df332ffe93593b2badb4e032214","observation_id":"7a31241d-3999-4b3d-b11a-c5b999828ab7","resolution":{"observed_at":"2026-08-12T21:59:12.548112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.535123Z","title":null,"venue":null,"work_id":"7c858e94-6bc1-422d-93bf-99a7d4482bb7","year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.527124Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:c7cbfb05341bb6ca7fda91c2967f5b0959b7966f3ccbcebb0e8b4a147417023d","observation_id":"c155a58d-f7ab-4080-a6b3-6b509dc9c0e9","resolution":{"observed_at":"2026-08-12T21:59:12.538319Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.525435Z","title":null,"venue":null,"work_id":"34822414-48e7-415a-bd43-674174c18275","year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.530354Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:1ae60ce1545edb008d8b4b7ebfe4849d795e370df8a71587db0d3b5261a26cd1","observation_id":"7349d838-9ab5-4026-8f64-8924a1a2a455","resolution":{"observed_at":"2026-08-12T21:59:12.528543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04109","last_updated":"2025-07-06T18:16:47Z","snapshot_observed_at":"2026-08-20T11:06:22.056035Z","submitted_at":"2024-11-06T18:36:22Z","title":"Self-Consistency Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04109","snapshot_observed_at":"2026-08-12T21:59:11.533287Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.533287Z"},"links":{"cited_paper":"/paper/2411.04109","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:fd283ef29fc2e490d860b1169c8269beab1e5d3c5e74ca439f84e9ff20f87bd6","observation_id":"a4cb839f-9b51-4a5b-b4e7-7eda387fc184","resolution":{"observed_at":"2026-08-12T21:59:11.533287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.536801Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.536801Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:20cfea6d71b086ff4e7de10c2b6f17260415ea7010329fab9882b67cb828e59f","observation_id":"37a00a3a-e394-442b-99fe-8d510734ead7","resolution":{"observed_at":"2026-08-12T21:59:11.536801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.539758Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.539758Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:b4f8ef939911260d45334bb527a76cedb546eea76e9623032f6cf71577a668ce","observation_id":"de6760af-633a-4963-bc01-bb9d72098497","resolution":{"observed_at":"2026-08-12T21:59:11.539758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.542752Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.542752Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:05588c62d31afe4da110598d04885e76dab970f72a56cb7867b698d36d0744f7","observation_id":"dfb24677-d9b0-4b09-ab2d-5f53213dec6f","resolution":{"observed_at":"2026-08-12T21:59:11.542752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10173","last_updated":"2024-09-19T11:21:24Z","snapshot_observed_at":"2026-08-21T22:05:38.517825Z","submitted_at":"2024-09-16T11:10:29Z","title":"jina-embeddings-v3: Multilingual Embeddings With Task LoRA","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10173","snapshot_observed_at":"2026-08-12T21:59:11.545616Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.545616Z"},"links":{"cited_paper":"/paper/2409.10173","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:6c20b9d7ac86985f6d77b5d50fd538c88702d08fff799496336b8b314a670fd5","observation_id":"f3d1d7b9-e80b-4e5b-8aec-746b9671f09d","resolution":{"observed_at":"2026-08-12T21:59:11.545616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05254","last_updated":"2024-05-09T14:12:45Z","snapshot_observed_at":"2026-08-20T14:01:44.201219Z","submitted_at":"2024-05-08T17:57:39Z","title":"You Only Cache Once: Decoder-Decoder Architectures for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05254","snapshot_observed_at":"2026-08-12T21:59:11.548817Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.548817Z"},"links":{"cited_paper":"/paper/2405.05254","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:72980618519d27b71f407bead8ce12503785355d8696290fe98caa6186af76a3","observation_id":"03d9c865-d3ed-4065-b639-a14223410df7","resolution":{"observed_at":"2026-08-12T21:59:11.548817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.552150Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.552150Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:978a0cff4f97a7f579652d6da40aa03f73d035ecab232468d2ae26669759ce2b","observation_id":"bfe10510-beba-4749-9495-cdcf59f3ea56","resolution":{"observed_at":"2026-08-12T21:59:11.552150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.490141Z","title":null,"venue":null,"work_id":"2dd59fb6-3558-42cb-adc4-e982731acc72","year":2008},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.555573Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:ba853e9fc38279c79b6d02791e63491d0fd7ca0036462a059e607f1a3128b94c","observation_id":"8695dbf8-44fe-4b26-9dbd-d773b3462f48","resolution":{"observed_at":"2026-08-12T21:59:12.493056Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12640","last_updated":"2024-09-20T00:47:33Z","snapshot_observed_at":"2026-08-18T15:47:09.128856Z","submitted_at":"2024-09-19T10:38:01Z","title":"Michelangelo: Long Context Evaluations Beyond Haystacks via Latent Structure Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12640","snapshot_observed_at":"2026-08-12T21:59:11.558906Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.558906Z"},"links":{"cited_paper":"/paper/2409.12640","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:8571e62facee41e7a010e55f4d3b1686d227cf2a3052da3b0774d9c71533292b","observation_id":"134e0421-c1f6-4e5e-ba9a-305ad9b52663","resolution":{"observed_at":"2026-08-12T21:59:11.558906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10456","last_updated":"2024-07-15T06:11:18Z","snapshot_observed_at":"2026-08-17T05:28:01.121237Z","submitted_at":"2024-07-15T06:11:18Z","title":"Don't Throw Away Data: Better Sequence Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10456","snapshot_observed_at":"2026-08-12T21:59:11.562032Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.562032Z"},"links":{"cited_paper":"/paper/2407.10456","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:473bb757090078ff6b90783a7c82a30fdd28824fe56602be21da446782217a70","observation_id":"64c024f7-d61d-4c4c-8722-3fa84c0defe3","resolution":{"observed_at":"2026-08-12T21:59:11.562032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.565165Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.565165Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:a3d296fa2d86c41e9cbcd9e2af6c7543479f7246a1aadd41aba6db9633d3032d","observation_id":"dc8741a5-ada9-4872-bbdc-76dbf92c8c9d","resolution":{"observed_at":"2026-08-12T21:59:11.565165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17419","last_updated":"2024-10-03T06:03:14Z","snapshot_observed_at":"2026-08-21T16:30:38.934831Z","submitted_at":"2024-06-25T09:42:56Z","title":"Leave No Document Behind: Benchmarking Long-Context LLMs with Extended Multi-Doc QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17419","snapshot_observed_at":"2026-08-12T21:59:11.568384Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.568384Z"},"links":{"cited_paper":"/paper/2406.17419","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:3d85e984da8cd4140ff5b3242b7fccb4c26bcd65ada6d2f369a0febd949c7e01","observation_id":"de30b7c5-5679-486c-a051-ddd988b49aac","resolution":{"observed_at":"2026-08-12T21:59:11.568384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.473170Z","title":null,"venue":null,"work_id":"603a4c7d-b2eb-454b-8d89-5197917741b1","year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.572681Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:a55c3a02a9446f328f8677349552c8b3fa764c0f2bdac90e9362428d1fcae36d","observation_id":"99c7ef06-162a-4d9a-b0d1-46cea58f70bd","resolution":{"observed_at":"2026-08-12T21:59:12.476279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.463363Z","title":null,"venue":null,"work_id":"f286ee25-40c5-4b89-b7ef-72c5e9de5921","year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.575884Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:23c9d156aea6d49768b167ad08bdd98b6393a429a2b9d956f26b727f7ed34238","observation_id":"753c194b-dda0-4d9b-91d0-754ca68d1748","resolution":{"observed_at":"2026-08-12T21:59:12.466599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.578863Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.578863Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:b1d0bd346d7f604809a0593227cc75bc3e81b85a5a023e7ceebf1c27fff51c9d","observation_id":"3a4fa418-b8e5-415b-b1e6-4b23aa46a164","resolution":{"observed_at":"2026-08-12T21:59:11.578863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.581857Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.581857Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:09e8cb35ef16e90338c5c6a5607c94c3e90460cf857920bc50a6456bb388213d","observation_id":"22abef6c-9cfc-44f0-b731-2d1cc6444caa","resolution":{"observed_at":"2026-08-12T21:59:11.581857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02902","last_updated":"2025-02-25T19:43:29Z","snapshot_observed_at":"2026-08-20T02:29:28.287065Z","submitted_at":"2024-10-03T18:48:38Z","title":"Better Instruction-Following Through Minimum Bayes Risk","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02902","snapshot_observed_at":"2026-08-12T21:59:11.584965Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.584965Z"},"links":{"cited_paper":"/paper/2410.02902","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:44c268f2bdd133679d86e2794afe9de3098094ad83df74f603adf071408e4839","observation_id":"551fa1df-4c13-47e4-9416-7b02612eb989","resolution":{"observed_at":"2026-08-12T21:59:11.584965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.588160Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.588160Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:67d59edd5018a52989f689342ecda0652cf36c94ae10a352967cd894960005e3","observation_id":"3019c49e-9785-4b8d-9c26-14670eca582c","resolution":{"observed_at":"2026-08-12T21:59:11.588160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.590962Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.590962Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:fbb317a7946cf71e47807c71c267adde6c06888ae1dec52bda57e5b241a802e0","observation_id":"05541181-61bf-495c-838c-87fe1e1a4d1b","resolution":{"observed_at":"2026-08-12T21:59:11.590962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.427525Z","title":null,"venue":null,"work_id":"8a9866f4-a259-45ae-986d-18d4c1ed1786","year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.593746Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:a3b3c71e8abbe50902d7ae46e4dff3de44443c5591b07aabc82673114a03b139","observation_id":"044160ba-4ce3-40b1-827c-ce5b0a79c113","resolution":{"observed_at":"2026-08-12T21:59:12.430587Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-12T21:59:11.596551Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.596551Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:5870cb90298acc5b204de0df4e3ab802e2b17a648e72aee50338166430ebfb79","observation_id":"89cb1edf-e351-4791-b2b6-19e5ed6efd87","resolution":{"observed_at":"2026-08-12T21:59:11.596551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.417258Z","title":null,"venue":null,"work_id":"326dd2ac-a89a-4406-a6eb-2553156e0140","year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.599542Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:5e8d32c0795f692b3b09cd7f54b7e4ab375cb60ed933a587ce6cc9aa6d30a2e4","observation_id":"dfc4cb05-ce2c-40c7-86a4-e125bbc03f1b","resolution":{"observed_at":"2026-08-12T21:59:12.420929Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.602396Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.602396Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:86a0e3549f8e5ca73be292198270d324634ddc33a103e69f13839a73d186bf6c","observation_id":"c691c278-1685-4eeb-944b-0d6daf410905","resolution":{"observed_at":"2026-08-12T21:59:11.602396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05258","last_updated":"2025-04-07T12:04:28Z","snapshot_observed_at":"2026-08-20T08:43:39.407075Z","submitted_at":"2024-10-07T17:57:38Z","title":"Differential Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05258","snapshot_observed_at":"2026-08-12T21:59:11.605565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.605565Z"},"links":{"cited_paper":"/paper/2410.05258","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:fde2cd4ad39606d1fa0fd45519592da76406d5c067a44cbf8e927a1c97145be5","observation_id":"9d542e08-3b47-4884-bfbc-f8c883a8cbe7","resolution":{"observed_at":"2026-08-12T21:59:11.605565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16617","last_updated":"2024-06-11T18:54:13Z","snapshot_observed_at":"2026-08-16T14:15:17.943932Z","submitted_at":"2024-02-26T14:47:35Z","title":"Long-Context Language Modeling with Parallel Context Encoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16617","snapshot_observed_at":"2026-08-12T21:59:11.608721Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.608721Z"},"links":{"cited_paper":"/paper/2402.16617","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:9861256a29de50dc41c0428303bd5d56f1eaf05df0efa64c7de7dbfd33d55d74","observation_id":"dddbd108-437b-4dcf-b9d2-f8b4ed5c62e5","resolution":{"observed_at":"2026-08-12T21:59:11.608721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02694","last_updated":"2025-03-06T18:41:54Z","snapshot_observed_at":"2026-08-19T20:54:59.800056Z","submitted_at":"2024-10-03T17:20:11Z","title":"HELMET: How to Evaluate Long-Context Language Models Effectively and Thoroughly","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02694","snapshot_observed_at":"2026-08-12T21:59:11.611829Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.611829Z"},"links":{"cited_paper":"/paper/2410.02694","citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:16d4c787d7fa010960b76ca7167b5baab394ebd70e881145ca74790a0c892083","observation_id":"06ea400d-30db-4d2d-8789-57870e1c5112","resolution":{"observed_at":"2026-08-12T21:59:11.611829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.615042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.615042Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:6923ea8f3a71fc5848d808dda98796660a375e2000a36f3b4d817fb47ded7c1c","observation_id":"4c2dc3f5-e634-48a4-af55-843f3f5ea1fa","resolution":{"observed_at":"2026-08-12T21:59:11.615042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:12.393386Z","title":null,"venue":null,"work_id":"610f9d10-08de-4dbb-9d90-8bbb4767ea2b","year":2022},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.618143Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:5437449964fe58cd40bda51244dfdfea35ad697da901ca9addd186b51851a75b","observation_id":"105b7cf0-29dd-43b9-b7be-8532f1d9909c","resolution":{"observed_at":"2026-08-12T21:59:12.396679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:59:11.621135Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-12T21:59:11.621135Z"},"links":{"citing_paper":"/paper/2411.08147"},"observation_digest":"sha256:8d3961fc49022de478e9de2fbe9ddf5235b8eb52169c6c39bd622009ba878807","observation_id":"9b78972c-dfa9-4f06-8527-be2c5c428ded","resolution":{"observed_at":"2026-08-12T21:59:11.621135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.08147","last_updated":"2024-11-12T19:53:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-21T03:44:33.483122Z","submitted_at":"2024-11-12T19:53:00Z","title":"Large Language Models Can Self-Improve in Long-context Reasoning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":112},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 100 of 112 outbound references and 4 inbound Pith citation observations for arXiv:2411.08147."}