{"as_of":"2026-08-11T17:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ea6c174e382d7712a591c3b8d3a032d6e69b27277eea445e7d018531160d6af","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T08:31:04.774135Z","state":"measured"},{"denominator":85,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":85,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":70,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:58:03.007138Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":15,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-10T09:20:57.804343Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T03:55:20.355345Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2404.06654"},"observation_digest":"sha256:d4c7d8c02c9dc5bed8835c3f057e5b160fe7122bb1a225ad22944db9f274e1c7","observation_id":"96f97e74-23c5-4e4f-82f7-7a225283de2a","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T09:58:29.057357Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2406.02069"},"observation_digest":"sha256:5c34ac6fa1fae3e67f4a59e3619865633db3a6ad613bdd1b1608ddd7c13c90e0","observation_id":"12ac178d-1ee8-49ab-847e-d5558564a844","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T07:08:35.946669Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2406.16852"},"observation_digest":"sha256:1194e4e56f18bb550f887e363fb0de28d58cc1f1a0e7dbc74d93b5495199db43","observation_id":"4b2960b7-7bc7-4481-9f00-ce19b2ce278e","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-11T16:58:03.007138Z","title":"Longrope: Extending llm context window beyond 2 million tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09616","last_updated":"2024-12-13T04:58:33Z","snapshot_observed_at":"2026-08-11T16:49:47.892018Z","submitted_at":"2024-12-12T18:59:46Z","title":"V2PE: Improving Multimodal Long-Context Capability of Vision-Language Models with Variable Visual Position Encoding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T16:58:03.007138Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2412.09616"},"observation_digest":"sha256:31fdf655908e2f27ef6e50594ee61ab4c8ae3a07c0ac790bef1fb2380892069b","observation_id":"94596343-81bd-4481-9179-d2d9ba0084c3","resolution":{"observed_at":"2026-08-11T16:58:03.007138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-10T22:50:28.589583Z","title":"Longrope: Extending llm context window beyond 2 million tokens, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00692","last_updated":"2025-01-01T01:10:59Z","snapshot_observed_at":"2026-08-11T14:36:39.612089Z","submitted_at":"2025-01-01T01:10:59Z","title":"Adjoint sharding for very long context training of state space models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:50:28.589583Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2501.00692"},"observation_digest":"sha256:6273ead86a414245597a94462ccc6a4c3ed39ffa33a7164c2826a86ea59e88a2","observation_id":"4277793a-c7d5-4b8b-a87b-e385df3b5f10","resolution":{"observed_at":"2026-08-10T22:50:28.589583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-10T21:01:58.762144Z","title":"Longrope: Extending llm context window beyond 2 million tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.06625","last_updated":"2025-01-11T19:21:53Z","snapshot_observed_at":"2026-08-11T10:37:59.289654Z","submitted_at":"2025-01-11T19:21:53Z","title":"Guided Code Generation with LLMs: A Multi-Agent Framework for Complex Code Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:01:58.762144Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2501.06625"},"observation_digest":"sha256:a41ae124747541de3d534648527d0c34b063eeed5efa45f8983201abd16507f0","observation_id":"88bb9ee1-9aee-41de-ab67-74940e9e54b5","resolution":{"observed_at":"2026-08-10T21:01:58.762144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-10T20:14:58.710382Z","title":"Longrope: Extending llm context window beyond 2 million tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09223","last_updated":"2025-06-15T13:24:11Z","snapshot_observed_at":"2026-08-10T20:07:27.554415Z","submitted_at":"2025-01-16T01:03:56Z","title":"Foundations of Large Language Models","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T20:14:58.710382Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2501.09223"},"observation_digest":"sha256:80c19f5e77266a0ea389b363ae5d0b25dfbb8e556128f163b1b98fc72268a821","observation_id":"2301d6e3-b5a1-4d97-9d7d-c74b63e1e25b","resolution":{"observed_at":"2026-08-10T20:14:58.710382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-10T20:26:11.022416Z","title":"Longrope: Extending llm context window beyond 2 million tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09767","last_updated":"2025-01-15T05:17:12Z","snapshot_observed_at":"2026-08-11T16:31:10.641403Z","submitted_at":"2025-01-15T05:17:12Z","title":"LeMo: Enabling LEss Token Involvement for MOre Context Fine-tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:11.022416Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2501.09767"},"observation_digest":"sha256:ab178e0543c026880c08337bab9c79806bde061ddc3bb5a355470acb932f70c6","observation_id":"ce8ee582-57fc-4566-832b-9bcb6c3a72cc","resolution":{"observed_at":"2026-08-10T20:26:11.022416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-10T14:10:40.288991Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15599","last_updated":"2025-01-26T16:53:27Z","snapshot_observed_at":"2026-08-11T10:23:46.912154Z","submitted_at":"2025-01-26T16:53:27Z","title":"Evaluating an LLM-Powered Chatbot for Cognitive Restructuring: Insights from Mental Health Professionals","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:10:40.288991Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2501.15599"},"observation_digest":"sha256:c53d455adc728d81aa8c896d09c10609333118f3579493f4b3405e1f166b66fd","observation_id":"b62248e3-8918-4ed2-af08-ad04260ac2ad","resolution":{"observed_at":"2026-08-10T14:10:40.288991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-09T23:58:36.365228Z","title":"Longrope: Extending llm context window beyond 2 million tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18320","last_updated":"2025-01-30T13:00:15Z","snapshot_observed_at":"2026-08-10T17:58:19.250871Z","submitted_at":"2025-01-30T13:00:15Z","title":"Leveraging LLM Agents for Automated Optimization Modeling for SASP Problems: A Graph-RAG based Approach","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T23:58:36.365228Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2501.18320"},"observation_digest":"sha256:a08ad7db8acd663910a5f377ae6e701699fa3a2a1c5a5edf8da9ced3d4b8b390","observation_id":"8a14f75f-2c09-4184-b115-b1adab37991e","resolution":{"observed_at":"2026-08-09T23:58:36.365228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-09T13:50:48.828392Z","title":"Longrope: Extending llm context window beyond 2 million tokens, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02004","last_updated":"2025-02-04T04:44:53Z","snapshot_observed_at":"2026-08-11T14:36:50.050210Z","submitted_at":"2025-02-04T04:44:53Z","title":"Wavelet-based Positional Representation for Long Context","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T13:50:48.828392Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2502.02004"},"observation_digest":"sha256:5283f4e184eda6052c6a0dc0b0c35f315c929a493d0bc3bb73faabe045d2b68c","observation_id":"f965e58c-aa89-4fd5-90cb-eebda038d2dc","resolution":{"observed_at":"2026-08-09T13:50:48.828392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-09T11:38:33.558604Z","title":"L., Zhang, C., Xu, Y., Shang, N., Xu, J., Yang, F., and Yang, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02659","last_updated":"2025-05-30T05:42:35Z","snapshot_observed_at":"2026-08-10T12:24:49.783843Z","submitted_at":"2025-02-04T19:01:24Z","title":"A Training-Free Length Extrapolation Approach for LLMs: Greedy Attention Logit Interpolation (GALI)","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T11:38:33.558604Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2502.02659"},"observation_digest":"sha256:1650fae31c3b9828dd387cda84d3bbcfe1c96e2c67698c49af3ff71c1f37804d","observation_id":"46a24f67-2d9a-4ac0-93e6-2facd21d9016","resolution":{"observed_at":"2026-08-09T11:38:33.558604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-08T20:06:35.102689Z","title":"L., Zhang, C., Xu, Y ., Shang, N., Xu, J., Yang, F., and Yang, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05173","last_updated":"2025-05-30T03:54:16Z","snapshot_observed_at":"2026-08-09T16:45:21.957564Z","submitted_at":"2025-02-07T18:56:04Z","title":"VideoRoPE: What Makes for Good Video Rotary Position Embedding?","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T20:06:35.102689Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2502.05173"},"observation_digest":"sha256:53a603c2a7b0b10f7b2fc8cc7c3742ea799111a982685a6da81b75630e28ade8","observation_id":"bcb314c8-8f4f-48c6-94cf-730a25f6fc0d","resolution":{"observed_at":"2026-08-08T20:06:35.102689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-08T17:26:43.402898Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06898","last_updated":"2025-02-09T14:51:15Z","snapshot_observed_at":"2026-08-09T09:06:17.244447Z","submitted_at":"2025-02-09T14:51:15Z","title":"Large Language Models for In-File Vulnerability Localization Can Be \"Lost in the End\"","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:26:43.402898Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2502.06898"},"observation_digest":"sha256:b463edbdc2eca3eb07c87ee2d81c2db7d5194f1489e7b51eb08f77902d634a37","observation_id":"cc4dc858-576e-4fcc-aeb9-1fbf5d7a334b","resolution":{"observed_at":"2026-08-08T17:26:43.402898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2502.14541","last_updated":"2026-04-30T11:23:52Z","snapshot_observed_at":"2026-07-30T05:01:07.387637Z","submitted_at":"2025-02-20T13:20:19Z","title":"LLM-based User Profile Management for Recommender System","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-23T02:45:16.107117Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2502.14541"},"observation_digest":"sha256:549949fbc6d2051891b53c2a046108e8d0d5761bd914320d896858490d6b45c3","observation_id":"da0cda29-2028-4741-989a-c0694914d186","resolution":{"observed_at":"2026-05-23T02:45:19.288815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T12:45:47.270376Z","title":"Longrope: Extending llm context window beyond 2 million tokens.arXiv preprint arXiv:2402.13753, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00069","last_updated":"2025-05-29T16:09:32Z","snapshot_observed_at":"2026-08-10T04:49:11.189189Z","submitted_at":"2025-05-29T16:09:32Z","title":"Evaluating the Sensitivity of LLMs to Prior Context","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:47.270376Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.00069"},"observation_digest":"sha256:c9eb76454d2227043845ed59515dcde493c38243ac6dcfe14ed79ed27ff80ec5","observation_id":"8994043a-2d19-443d-abe3-210b486c51ce","resolution":{"observed_at":"2026-08-07T12:45:47.270376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T15:31:42.756912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02000","last_updated":"2025-06-23T01:41:05Z","snapshot_observed_at":"2026-08-07T15:25:33.498661Z","submitted_at":"2025-05-20T20:54:37Z","title":"NovelHopQA: Diagnosing Multi-Hop Reasoning Failures in Long Narrative Contexts","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:31:42.756912Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.02000"},"observation_digest":"sha256:4bf1125eea96a11f10446a14e85fa128d7082ed18b5ad0aaa07a8cfb6c5ce255","observation_id":"071381ea-b736-4724-b2e0-c4d4e06a518d","resolution":{"observed_at":"2026-08-07T15:31:42.756912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T11:15:23.081198Z","title":"Longrope: Extending llm context window beyond 2 million tokens.arXiv preprint arXiv:2402.13753, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03131","last_updated":"2025-06-03T17:57:33Z","snapshot_observed_at":"2026-08-10T16:29:24.659168Z","submitted_at":"2025-06-03T17:57:33Z","title":"Native-Resolution Image Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:15:23.081198Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.03131"},"observation_digest":"sha256:e0226fc35a8c117d3ebe2a8d20c140a2156ea012191a3db8dd97da44cb5944e2","observation_id":"7f65b2fc-1edc-4fbf-a366-a0a6211fc287","resolution":{"observed_at":"2026-08-07T11:15:23.081198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T10:35:18.731567Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04983","last_updated":"2025-06-05T12:54:56Z","snapshot_observed_at":"2026-08-08T09:50:26.694274Z","submitted_at":"2025-06-05T12:54:56Z","title":"TextVidBench: A Benchmark for Long Video Scene Text Understanding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:35:18.731567Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.04983"},"observation_digest":"sha256:e9950b2b7b3893d933cf1e44eb22d286eef14dd4aa88ebe21131f943ba63c0ab","observation_id":"8323916c-5354-4581-80d9-9d0e94cfa7c0","resolution":{"observed_at":"2026-08-07T10:35:18.731567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T05:31:19.832284Z","title":"Longrope: Extending LLM context window beyond 2 million tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-09T02:25:55.181285Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.832284Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:a82c69e8dd8b44ef2ba5b7da0cd63d0b90801eb190ba2dff4da7b1defe91653d","observation_id":"4023f1a7-3a0a-43a9-adc1-72371e797054","resolution":{"observed_at":"2026-08-07T05:31:19.832284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T05:31:19.897369Z","title":"Abhimanyu Dubey, Abhinav Jauhri, Abhinav Pandey, Abhishek Kadian, Ahmad Al-Dahle, Aiesha Letman, Akhil Mathur, Alan Schelten, Amy Yang, Angela Fan, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-09T02:25:55.181285Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:19.897369Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:98a64d75cc98ab02f0fde36d0dc70ced940081422d336a545854b824d2703bb0","observation_id":"af373711-54ae-471f-8020-88eb87640fd6","resolution":{"observed_at":"2026-08-07T05:31:19.897369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T04:59:21.226822Z","title":"Zhang, Chengruidong Zhang, Yuanyuan Xu, Ning Shang, Jiahang Xu, Fan Yang, and Mao Yang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09251","last_updated":"2025-08-04T16:57:32Z","snapshot_observed_at":"2026-08-10T08:26:32.587684Z","submitted_at":"2025-06-10T21:22:51Z","title":"Extrapolation by Association: Length Generalization Transfer in Transformers","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:21.226822Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.09251"},"observation_digest":"sha256:38019c74525ac17f61b890cb59e636675f1b21cfd429b7fdd437eb47899cab1a","observation_id":"9e830576-616b-49fb-9094-4eeb6c2afa7f","resolution":{"observed_at":"2026-08-07T04:59:21.226822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-07T04:10:45.692174Z","title":"arXiv preprint arXiv:2402.13753 (2024) Lag-Relative Sparse Attention In Long Context Training 11","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11498","last_updated":"2025-06-13T06:49:53Z","snapshot_observed_at":"2026-08-10T13:22:21.396028Z","submitted_at":"2025-06-13T06:49:53Z","title":"Lag-Relative Sparse Attention In Long Context Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:45.692174Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.11498"},"observation_digest":"sha256:ca2c7157c9bd0cedc1ce9b8706f38a5c57bb2b7c2a279b269443dba4bec5040e","observation_id":"a11b3d47-cc92-4d8e-833a-c9f2cb615b2c","resolution":{"observed_at":"2026-08-07T04:10:45.692174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2506.17310","last_updated":"2026-04-10T08:34:15Z","snapshot_observed_at":"2026-07-06T21:45:25.136396Z","submitted_at":"2025-06-18T09:17:06Z","title":"PaceLLM: Brain-Inspired Large Language Models for Long-Context Understanding","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T09:33:56.616828Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.17310"},"observation_digest":"sha256:3a560146c9f7d95a6701cf86f4db3fb685a0cb88ebb1016ca46b8a6213ae7a0f","observation_id":"e293b53f-7b1d-4a82-b0d5-ef24503beabb","resolution":{"observed_at":"2026-05-19T09:37:14.236648Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-06T23:40:57.268890Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21607","last_updated":"2025-06-20T11:58:00Z","snapshot_observed_at":"2026-08-11T14:36:26.656206Z","submitted_at":"2025-06-20T11:58:00Z","title":"CORE-KG: An LLM-Driven Knowledge Graph Construction Framework for Human Smuggling Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:40:57.268890Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.21607"},"observation_digest":"sha256:39b80a10f79854d37a55c564f24c8aec9e904a76aa57b9afb7944431fb3e95a5","observation_id":"2c88effe-345f-4765-9d08-500d1d6b744e","resolution":{"observed_at":"2026-08-06T23:40:57.268890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-06T18:22:15.929655Z","title":"Longrope: Extending llm context window beyond 2 million tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08584","last_updated":"2025-07-11T13:29:32Z","snapshot_observed_at":"2026-08-09T20:09:07.075208Z","submitted_at":"2025-07-11T13:29:32Z","title":"To Trade or Not to Trade: An Agentic Approach to Estimating Market Risk Improves Trading Decisions","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:22:15.929655Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2507.08584"},"observation_digest":"sha256:a8df75ad60c0d76741cc8f3b20c85ebae82b54e1bba9af4ae4725c9a1ff2d998","observation_id":"7368503d-ea04-4fbf-925a-8d2ee18f3f69","resolution":{"observed_at":"2026-08-06T18:22:15.929655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-06T15:20:38.582379Z","title":"Longrope: Extending llm context window beyond 2 million tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-10T19:16:45.408211Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.582379Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:54584b74104a26daeb4673220f9a33a40e0be44c8c25dd4f6e912bd8ba59535c","observation_id":"93e6196b-4e58-4f7d-9496-740392bcb826","resolution":{"observed_at":"2026-08-06T15:20:38.582379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T21:47:54.391198Z","title":"Longrope: Extending llm context window beyond 2 million tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07966","last_updated":"2025-08-11T13:26:48Z","snapshot_observed_at":"2026-08-10T08:31:43.576342Z","submitted_at":"2025-08-11T13:26:48Z","title":"Exploring the Challenges and Opportunities of AI-assisted Codebase Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T21:47:54.391198Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2508.07966"},"observation_digest":"sha256:1b602e17759f3008504b1c53f81ee68486bfba1c8acfd765cf980458a4bed6dc","observation_id":"43087eec-6503-44ba-b7e9-ad3fcc9108da","resolution":{"observed_at":"2026-08-05T21:47:54.391198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2509.11206","last_updated":"2026-04-20T05:43:30Z","snapshot_observed_at":"2026-08-07T05:35:56.514953Z","submitted_at":"2025-09-14T10:24:13Z","title":"Evalet: Evaluating Large Language Models through Functional Fragmentation","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T16:57:25.259866Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2509.11206"},"observation_digest":"sha256:a6debaac3389076679b9f908782798407e5544e9e1d2312e87b45a256ee42d71","observation_id":"9359bcbd-e928-4697-8fbb-04160300c563","resolution":{"observed_at":"2026-05-18T17:01:40.021643Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2509.12635","last_updated":"2026-05-10T22:28:15Z","snapshot_observed_at":"2026-08-03T03:02:00.357806Z","submitted_at":"2025-09-16T03:53:32Z","title":"Positional Encoding via Token-Aware Phase Attention","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T16:19:48.318702Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2509.12635"},"observation_digest":"sha256:079cc3bcb1c023260b73a6f930924e580557af02d66ce33aea9e19528659da9f","observation_id":"27629305-74b4-408d-aa09-c6d94fca1995","resolution":{"observed_at":"2026-05-18T16:21:36.703339Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2510.09608","last_updated":"2025-10-10T17:59:58Z","snapshot_observed_at":"2026-08-08T02:53:06.532732Z","submitted_at":"2025-10-10T17:59:58Z","title":"StreamingVLM: Real-Time Understanding for Infinite Video Streams","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T11:51:33.345812Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2510.09608"},"observation_digest":"sha256:a96508d9c791c1ede6310d060473b6af6364329b94bab18a7edb58428530876c","observation_id":"ec4ccb94-4b46-4d34-8f81-38c5822cab32","resolution":{"observed_at":"2026-05-17T11:51:33.395994Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-03T20:30:27.187880Z","title":"Longrope: Extending llm context window beyond 2 million tokens.arXiv preprint arXiv:2402.13753, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19778","last_updated":"2026-06-30T01:28:09Z","snapshot_observed_at":"2026-08-07T03:18:48.553937Z","submitted_at":"2025-11-24T23:10:15Z","title":"Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T20:30:27.187880Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2511.19778"},"observation_digest":"sha256:d69c0e6cfb7a98534325dd6046f5de85ee2757c2e3066c114213dbcee02a0249","observation_id":"0a79e3c5-740c-42e9-a757-22671dbc3bd5","resolution":{"observed_at":"2026-08-03T20:30:27.187880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2511.22599","last_updated":"2026-04-08T14:04:20Z","snapshot_observed_at":"2026-08-03T23:42:45.825181Z","submitted_at":"2025-11-27T16:27:35Z","title":"DisCEdge: Distributed Context Management for Large Language Models at the Edge","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T04:17:31.955480Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2511.22599"},"observation_digest":"sha256:d213be08e3e89d071f879002319bdaab242993251b7b2e6dcef0c731cc1461b1","observation_id":"e083a9d4-a6ad-4fd7-86a6-817dfbd43224","resolution":{"observed_at":"2026-05-17T04:19:00.435409Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2604.03263","last_updated":"2026-03-12T21:21:51Z","snapshot_observed_at":"2026-08-07T08:04:07.875512Z","submitted_at":"2026-03-12T21:21:51Z","title":"LPC-SM: Local Predictive Coding and Sparse Memory for Long-Context Language Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T11:22:08.937342Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2604.03263"},"observation_digest":"sha256:f80ce3f55c6393560662bf33aff44ba8e679778bb6b4799349ad470503d93686","observation_id":"1a243fed-4d0b-4327-bc46-6033b6639632","resolution":{"observed_at":"2026-05-15T11:25:30.983156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2604.07766","last_updated":"2026-04-09T03:41:33Z","snapshot_observed_at":"2026-08-11T16:33:53.338558Z","submitted_at":"2026-04-09T03:41:33Z","title":"Sensitivity-Positional Co-Localization in GQA Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:15:58.196935Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2604.07766"},"observation_digest":"sha256:97eb8eada2fd33c99e4cdf058af3b48a344e24711cdfa1e4ff053b62e6c196f3","observation_id":"201a5d52-f223-43e0-a061-32bc393e1080","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2604.08932","last_updated":"2026-04-10T04:00:49Z","snapshot_observed_at":"2026-07-06T22:57:55.179136Z","submitted_at":"2026-04-10T04:00:49Z","title":"From Indiscriminate to Targeted: Efficient RTL Verification via Functionally Key Signal-Driven LLM Assertion Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T17:26:47.139265Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2604.08932"},"observation_digest":"sha256:285dc3a95ab4cff781eec0ebf753db0b5ac6f0ddbb31bacde53dba739123d6d0","observation_id":"04f67770-d072-4b44-96b8-48ab9d94f2ba","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2604.11435","last_updated":"2026-04-13T13:19:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T13:19:56Z","title":"Think Before you Write: QA-Guided Reasoning for Character Descriptions in Books","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:05:17.570163Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2604.11435"},"observation_digest":"sha256:eddf5f88a3edc82518334e44bb3752b793ca5b04b219b178ed2e95f40bc1809a","observation_id":"2efe2635-9a9b-485c-9178-bd6e3d047b18","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-07-12T21:59:12.263579Z","title":"Yiran Ding, Li Lyna Zhang, Chengruidong Zhang, Yuanyuan Xu, Ning Shang, Jiahang Xu, Fan Yang, and Mao Yang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.11436","last_updated":"2026-06-22T17:35:24Z","snapshot_observed_at":"2026-08-02T00:33:34.891083Z","submitted_at":"2026-04-13T13:20:09Z","title":"Fourier-based potential theory without an explicit Green's function","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T21:59:12.263579Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2604.11436"},"observation_digest":"sha256:439480190e12221f1502473b477fb05be83fceb591993bb1a7477218a4603993","observation_id":"bea102a5-0cee-4008-a593-669352b6cf0e","resolution":{"observed_at":"2026-07-12T21:59:12.263579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2604.16883","last_updated":"2026-04-18T07:23:22Z","snapshot_observed_at":"2026-08-11T13:01:49.230368Z","submitted_at":"2026-04-18T07:23:22Z","title":"SinkRouter: Sink-Aware Routing for Efficient Long-Context Decoding in Large Language and Multimodal Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T07:56:05.583390Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2604.16883"},"observation_digest":"sha256:5b319675a2f591ea5669fd191e52bae9e32f91d96187d1774de0103fd9824c82","observation_id":"e47ad284-9e2d-43b0-b264-1a9f4cbd938b","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2604.18603","last_updated":"2026-04-09T19:32:11Z","snapshot_observed_at":"2026-08-11T12:41:21.337306Z","submitted_at":"2026-04-09T19:32:11Z","title":"Dual Triangle Attention: Effective Bidirectional Attention Without Positional Embeddings","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T16:50:43.716813Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2604.18603"},"observation_digest":"sha256:40d4f5f3d087a655b75833f145eb7e60002516db61286169df6932a84664b5dd","observation_id":"d1ed560f-842d-4d9d-9b6a-0f706f802bde","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2604.24162","last_updated":"2026-04-27T08:18:30Z","snapshot_observed_at":"2026-08-11T05:40:25.501792Z","submitted_at":"2026-04-27T08:18:30Z","title":"Defusing the Trigger: Plug-and-Play Defense for Backdoored LLMs via Tail-Risk Intrinsic Geometric Smoothing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T03:09:43.879809Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2604.24162"},"observation_digest":"sha256:39a0a8ae636598adc515a7f8e47910024622cca103a85e1c77868a72b6862ff2","observation_id":"0ccb4841-042e-41f8-889a-6ab320c6ae9b","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.00968","last_updated":"2026-05-01T15:51:10Z","snapshot_observed_at":"2026-07-06T23:14:15.780028Z","submitted_at":"2026-05-01T15:51:10Z","title":"Adaptive 3D-RoPE: Physics-Aligned Rotary Positional Encoding for Wireless Foundation Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-09T18:48:03.437788Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.00968"},"observation_digest":"sha256:3acf74b1e8e4fe9fa880d4b8085f0b8a9f5751d7a26ffcb0ff62080bdaf07f01","observation_id":"c466575c-0d37-435a-880b-d393de217c27","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.04217","last_updated":"2026-05-21T13:27:26Z","snapshot_observed_at":"2026-08-07T11:03:27.831093Z","submitted_at":"2026-05-05T18:59:31Z","title":"Jordan-RoPE: Non-Semisimple Relative Positional Encoding via Complex Jordan Blocks","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-22T10:38:40.497451Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.04217"},"observation_digest":"sha256:c30307b874f15f69d0063812451531cdb70db3bdee2093eeee3b206c724fe471","observation_id":"fef32ab0-4ea5-4243-ab63-29af4c63feb9","resolution":{"observed_at":"2026-05-22T10:41:25.295901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.06850","last_updated":"2026-05-07T18:51:57Z","snapshot_observed_at":"2026-07-06T23:19:15.382283Z","submitted_at":"2026-05-07T18:51:57Z","title":"How to Compress KV Cache in RL Post-Training? Shadow Mask Distillation for Memory-Efficient Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T01:25:30.458137Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.06850"},"observation_digest":"sha256:221c5b8d431aefb0670d64d5ebb565dabcbcc5b0b68e4f99aa167e631522eda4","observation_id":"afb24e69-d5f2-4175-aebd-72cc87174713","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.07731","last_updated":"2026-05-20T09:02:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-08T13:36:24Z","title":"Benchmarking EngGPT2-16B-A3B against Comparable Italian and International Open-source LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T03:40:04.692279Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.07731"},"observation_digest":"sha256:f305ef039dab239f8d35a1a8f22617916ba6cd4a290a8caa9e3473fade05b92a","observation_id":"6f025346-4c91-4c90-9022-c2e3edfb5bec","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.07731","last_updated":"2026-05-20T09:02:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-08T13:36:24Z","title":"Benchmarking EngGPT2-16B-A3B against Comparable Italian and International Open-source LLMs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T08:14:55.858466Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.07731"},"observation_digest":"sha256:7cc93b4f5d34e8f63777c5115cc215940ba2d4b348cb065379d6df05dd1d86f3","observation_id":"ca940442-cbc2-4637-8a05-2f4766916197","resolution":{"observed_at":"2026-05-21T08:19:52.961254Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.09304","last_updated":"2026-05-10T04:02:10Z","snapshot_observed_at":"2026-08-11T15:58:13.494968Z","submitted_at":"2026-05-10T04:02:10Z","title":"Generating Complex Code Analyzers from Natural Language Questions","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T05:02:19.519786Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.09304"},"observation_digest":"sha256:8a25b7cc5625be9ac9bd60c8a7d362b8d6756a19c881afe0d75e63af062c2cc9","observation_id":"d99a9aa1-eed3-42ac-a575-5d226419c3dd","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.09932","last_updated":"2026-05-11T03:30:35Z","snapshot_observed_at":"2026-08-10T21:57:22.560923Z","submitted_at":"2026-05-11T03:30:35Z","title":"FocuSFT: Bilevel Optimization for Dilution-Aware Long-Context Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T04:35:48.572353Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.09932"},"observation_digest":"sha256:c585fdc171a6c6176107d0e5cb64b1933a8489f43e7bcee21b9460a6f0a566ac","observation_id":"14b4a965-4ec7-4671-a5fe-962c38ba66b0","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.10268","last_updated":"2026-05-11T09:30:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T09:30:59Z","title":"MemReread: Enhancing Agentic Long-Context Reasoning via Memory-Guided Rereading","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T05:22:43.330891Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.10268"},"observation_digest":"sha256:ef43abbbe7f6c2d574ee5d64cedc8e5d21ffa102e8b8bbed67f8502df46eab25","observation_id":"4bc7a11b-9b1e-4534-bb21-f507bfae6844","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.10414","last_updated":"2026-05-11T11:52:06Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T11:52:06Z","title":"Remember to Forget: Gated Adaptive Positional Encoding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T04:44:31.449357Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.10414"},"observation_digest":"sha256:8a1f23f7975496ecd408b98e7a45bdb7ea2e29d44047da668b28c2c88512ce80","observation_id":"dfee035c-0d3f-40d8-86cb-3dfc8d8c1c47","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.10544","last_updated":"2026-05-11T13:23:21Z","snapshot_observed_at":"2026-08-11T10:54:12.115733Z","submitted_at":"2026-05-11T13:23:21Z","title":"Where Does Long-Context Supervision Actually Go? Effective-Context Exposure Balancing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:45.320454Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.10544"},"observation_digest":"sha256:4502cad99efb0a09fd6243c04fb19593c7b6a6e2d27bc3cd24c87906f550a6ff","observation_id":"31770531-63f9-4f48-9113-8054c2bd19fd","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.13831","last_updated":"2026-05-13T17:52:53Z","snapshot_observed_at":"2026-08-06T00:20:13.394323Z","submitted_at":"2026-05-13T17:52:53Z","title":"Training Long-Context Vision-Language Models Effectively with Generalization Beyond 128K Context","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-14T19:16:07.851098Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.13831"},"observation_digest":"sha256:22a69c2ae5635dfb187cd6e7cbc9a722460a9189eee466f2d9964dbaa4ae473b","observation_id":"bdd65c67-20ce-4d3c-841b-6b2220b1be49","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.14589","last_updated":"2026-06-02T09:12:16Z","snapshot_observed_at":"2026-07-06T23:25:58.895612Z","submitted_at":"2026-05-14T09:00:03Z","title":"EndPrompt: Efficient Long-Context Extension via Terminal Anchoring","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T01:32:32.967922Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.14589"},"observation_digest":"sha256:fa9dd22ab9efaa403063586e3473191c30e89bc51caac0c853e100ae85c96139","observation_id":"1b6b6739-be80-44d4-ba7f-c2149619f3fa","resolution":{"observed_at":"2026-05-15T08:31:04.851790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.14589","last_updated":"2026-06-02T09:12:16Z","snapshot_observed_at":"2026-07-06T23:25:58.895612Z","submitted_at":"2026-05-14T09:00:03Z","title":"EndPrompt: Efficient Long-Context Extension via Terminal Anchoring","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T21:13:23.148984Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.14589"},"observation_digest":"sha256:0c08b22c16bb80ce7282f64275a29f6b937195e9857065275c4d9b2c534a1fd4","observation_id":"e7270d42-313c-4b88-b298-53384fdee730","resolution":{"observed_at":"2026-06-30T21:15:04.004808Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.14906","last_updated":"2026-05-14T14:41:17Z","snapshot_observed_at":"2026-08-02T09:41:14.453439Z","submitted_at":"2026-05-14T14:41:17Z","title":"MemLens: Benchmarking Multimodal Long-Term Memory in Large Vision-Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-30T21:00:25.664841Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.14906"},"observation_digest":"sha256:e54453863990d54130e7112237519ac23ffeb6aa17560acca9b2a659bd7a569b","observation_id":"c18f81a1-cecd-499f-b694-56aeb23949e8","resolution":{"observed_at":"2026-06-30T21:05:04.220053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2605.22668","last_updated":"2026-05-21T16:09:01Z","snapshot_observed_at":"2026-08-08T06:27:13.102957Z","submitted_at":"2026-05-21T16:09:01Z","title":"SEGA: Spectral-Energy Guided Attention for Resolution Extrapolation in Diffusion Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T06:10:14.080177Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2605.22668"},"observation_digest":"sha256:31ff9c40c56a5ccd8c4e5a37e1cbf7cd02dcf35cbd118781e8c2d99560b856ac","observation_id":"47cb71c2-07f1-48ec-9aae-cee8d99d4b07","resolution":{"observed_at":"2026-05-22T06:11:09.094936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2606.06906","last_updated":"2026-06-05T04:49:37Z","snapshot_observed_at":"2026-08-02T10:42:01.638389Z","submitted_at":"2026-06-05T04:49:37Z","title":"EASE-TTT: Evidence-Aligned Selective Test-Time Training for Long-Context Question Answering","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-27T22:05:00.537690Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2606.06906"},"observation_digest":"sha256:c477669251b8b2969bcf2e8629c9eaa509f3a29605db15adf91b4ad999434f2f","observation_id":"80c4d127-f9a0-44cb-8a6e-e7058c4fedad","resolution":{"observed_at":"2026-07-02T17:17:15.120266Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2606.08382","last_updated":"2026-06-07T00:24:02Z","snapshot_observed_at":"2026-08-01T14:25:51.066603Z","submitted_at":"2026-06-07T00:24:02Z","title":"STAR-KV: Low-Rank KV Cache Compression via Soft Thresholding for Adaptive Rank Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T18:34:20.645677Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2606.08382"},"observation_digest":"sha256:20c5c845f74d5be445be9313c8b9b50fcdb3a6f97a5a0055d311e44205f9cbc6","observation_id":"13d6f12a-10cb-47b0-b1f4-fd35dcb9b9d4","resolution":{"observed_at":"2026-07-02T22:57:26.291671Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2606.11275","last_updated":"2026-07-18T15:27:47Z","snapshot_observed_at":"2026-08-07T09:37:04.875624Z","submitted_at":"2026-06-09T09:56:50Z","title":"RoVE: Rotary Value Embeddings Attention for Relative Position-dependent Value Pathways","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T13:50:51.534798Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2606.11275"},"observation_digest":"sha256:74bbce2718555cb06c036145202febf58706939848425bf826f6c0ab52eef23f","observation_id":"633a6ff1-e8a6-400d-bf12-3b9d986c6a0d","resolution":{"observed_at":"2026-07-03T04:37:36.432638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-02T11:55:28.934166Z","title":"Longrope: Extending llm context window beyond 2 million tokens.arXiv preprint arXiv:2402.13753,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.11275","last_updated":"2026-07-18T15:27:47Z","snapshot_observed_at":"2026-08-07T09:37:04.875624Z","submitted_at":"2026-06-09T09:56:50Z","title":"RoVE: Rotary Value Embeddings Attention for Relative Position-dependent Value Pathways","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T11:55:28.934166Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2606.11275"},"observation_digest":"sha256:2fcb7ecd497caaad98d3f5b2f977e57e237528f3b0ddd686b5f16e0d7ee2326b","observation_id":"6bebcc6d-8819-4585-bc45-2e16d489e3f1","resolution":{"observed_at":"2026-08-02T11:55:28.934166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2606.20474","last_updated":"2026-06-19T08:02:54Z","snapshot_observed_at":"2026-08-07T06:14:47.064796Z","submitted_at":"2026-06-18T16:54:07Z","title":"UltraQuant: 4-bit KV Caching for Context-Heavy Agents","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-26T17:49:02.835708Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2606.20474"},"observation_digest":"sha256:0ecb55cb19df38aa40397ddfa13557cb5b0aa15e309625d33da4d997fd3ca9e9","observation_id":"2877006a-a558-4319-8ed8-db725b51a951","resolution":{"observed_at":"2026-07-04T03:39:30.380854Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2606.27705","last_updated":"2026-06-26T04:07:41Z","snapshot_observed_at":"2026-08-09T18:28:04.718985Z","submitted_at":"2026-06-26T04:07:41Z","title":"Mitigating Position Bias in Transformers via Layer-Specific Positional Embedding Scaling","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-29T04:59:00.304723Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2606.27705"},"observation_digest":"sha256:8a35270bef0d2813ba8eb68bf9e52c8d45a6b310a9a41c50249d2472070c38fc","observation_id":"f8259254-c854-4cfe-979f-d62074546751","resolution":{"observed_at":"2026-06-29T19:03:51.900064Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2607.02073","last_updated":"2026-07-02T12:11:49Z","snapshot_observed_at":"2026-08-01T01:57:32.190005Z","submitted_at":"2026-07-02T12:11:49Z","title":"Evidence-State Rewards for Long-Context Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-03T13:25:14.844589Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2607.02073"},"observation_digest":"sha256:df72243fb59f08309ad815f160548b77068b000963f2d42d55e8896764d623b5","observation_id":"4fc3a1ab-5cce-4fee-9088-a4651ef456e9","resolution":{"observed_at":"2026-07-03T13:28:18.212938Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-07-12T09:50:23.266920Z","title":"L., Zhang, C., Xu, Y., Shang, N., Xu, J., Y ang, F., and Y ang, M.Longrope: Extending llm context window beyond 2 million tokens.arXiv preprint arXiv:2402.13753(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02574","last_updated":"2026-06-30T16:12:40Z","snapshot_observed_at":"2026-07-12T09:50:22.497230Z","submitted_at":"2026-06-30T16:12:40Z","title":"From Tensor Buffer to Distributed Memory Hierarchy: A Survey of KV Cache Management for LLM Serving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T09:50:23.266920Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2607.02574"},"observation_digest":"sha256:bb612c0a3516e89dfb8976afc2e218532f868c7e844b565c3b4a19226393e8c2","observation_id":"9dbe4e20-5419-482e-b6d4-3fe02b480b56","resolution":{"observed_at":"2026-07-12T09:50:23.266920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":"2402.13753","doi":"10.48550/arxiv.2402.13753","metadata_source":"pith","pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","venue":"cs.CL","work_id":"41fabff1-11da-43da-8efd-2eb55186b9f2","year":2024},"citing_paper":{"arxiv_id":"2607.07740","last_updated":"2026-07-10T03:53:58Z","snapshot_observed_at":"2026-08-10T20:14:17.398534Z","submitted_at":"2026-07-08T06:23:42Z","title":"Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-10T19:59:46.713277Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2607.07740"},"observation_digest":"sha256:58a78f8c35a1903ff3532b65ad6a04e7b13b5ac12826b9b94545c9e63f14dd5f","observation_id":"b88217bd-29b0-428b-aff0-94d622c1b006","resolution":{"observed_at":"2026-07-10T20:07:33.538796Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-07-13T06:47:09.927626Z","title":"LongRoPE: Extending LLM context window beyond 2 million tokens.arXiv preprint arXiv:2402.13753, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.07740","last_updated":"2026-07-10T03:53:58Z","snapshot_observed_at":"2026-08-10T20:14:17.398534Z","submitted_at":"2026-07-08T06:23:42Z","title":"Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T06:47:09.927626Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2607.07740"},"observation_digest":"sha256:1346afb17eeb02fc0a20e61b21bf4c2352f80d4174421f1d25cac6cf5b4b079c","observation_id":"eed1d05d-0765-4004-a051-bc31678e0242","resolution":{"observed_at":"2026-07-13T06:47:09.927626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-01T17:16:36.476354Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17715","last_updated":"2026-07-20T09:09:23Z","snapshot_observed_at":"2026-08-06T08:28:52.422763Z","submitted_at":"2026-07-20T09:09:23Z","title":"C$^2$KV: Compressed and Composable KV Cache Reuse for Efficient LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T17:16:36.476354Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2607.17715"},"observation_digest":"sha256:dc6950e885d1e2aba2a2d45097700d5251a24516be882e7c23a27e2e86549452","observation_id":"a0f4ebd0-cef5-4014-b335-65fff106c74d","resolution":{"observed_at":"2026-08-01T17:16:36.476354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-01T07:12:17.640379Z","title":"arXiv preprint arXiv:2402.13753 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21550","last_updated":"2026-07-23T17:35:20Z","snapshot_observed_at":"2026-08-08T08:48:36.880078Z","submitted_at":"2026-07-23T17:35:20Z","title":"X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment","version":1},"reference_index":129,"source":"arxiv_source","source_observed_at":"2026-08-01T07:12:17.640379Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2607.21550"},"observation_digest":"sha256:6202ae5af90959e111f8cbf3ff040147f8765bb5b1072ac20ede36a5ec6ccef8","observation_id":"23007cd5-6ea8-4ab6-a3b9-0c7b7852fe8e","resolution":{"observed_at":"2026-08-01T07:12:17.640379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-07-31T23:07:18.010236Z","title":"Longrope: Extending llm context window beyond 2 million tokens.arXiv preprint arXiv:2402.13753,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27919","last_updated":"2026-07-30T09:30:03Z","snapshot_observed_at":"2026-08-10T13:09:06.351869Z","submitted_at":"2026-07-30T09:30:03Z","title":"Memory Decoder at Scale: A Pretrained, Parametric Long-Term Memory","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-07-31T23:07:18.010236Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2607.27919"},"observation_digest":"sha256:88ca919e7c6b6ff68735defce09178bb6d4b1eb718254d41fb27e9db344ef52e","observation_id":"0825969d-43f8-4d20-bd03-8d857dd9c58e","resolution":{"observed_at":"2026-07-31T23:07:18.010236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-10T04:41:11.195627Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07440","last_updated":"2026-08-07T17:23:53Z","snapshot_observed_at":"2026-08-11T16:12:09.174090Z","submitted_at":"2026-08-07T17:23:53Z","title":"Blast Radius","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T04:41:11.195627Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2608.07440"},"observation_digest":"sha256:9c752e00ce0ddbe1eee0cf21a0d0a9b8087b61cf7695a3e3ba1fa24e2de0470e","observation_id":"2d0611cf-ce1a-4d42-a27f-43549cb3fbbc","resolution":{"observed_at":"2026-08-10T04:41:11.195627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.13753/citation-record","integrity":"/paper/2402.13753/integrity","json":"/paper/2402.13753/citation-record.json","paper":"/paper/2402.13753"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.15595","last_updated":"2023-06-28T04:26:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-27T16:26:26Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","version":2},"cited_work":{"arxiv_id":"2306.15595","doi":"10.48550/arxiv.2306.15595","metadata_source":"pith","pith_arxiv_id":"2306.15595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","venue":"cs.CL","work_id":"c8b6df85-e7da-4bd8-90a4-d309cc2a0f60","year":2023},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2306.15595","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:2626d07dd382a68ea48a2fdf9a76105318755544f618572378a3d35df3f994d0","observation_id":"6b7e1a3f-cc23-495b-8a29-dab9ce3bcea4","resolution":{"observed_at":"2026-05-15T08:31:04.788204Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:38:12.283235+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:38:12.283235+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":"2101.00027","doi":"10.1117/1.jmi.10.6.061104","metadata_source":"pith","pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","venue":"cs.CL","work_id":"9b10667a-da61-4358-aceb-10578234d45d","year":2020},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:1e5763e3848cd6b98ace8d8fd4c79a5d885255809bf48d172f40ce282fc525b3","observation_id":"f820f3e9-88f8-4472-a21e-59a993bfd146","resolution":{"observed_at":"2026-05-15T08:31:04.793059Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Single path one-shot neural architecture search with uniform sampling","venue":null,"work_id":"ff23255d-764c-4c95-b81c-58af1380a665","year":2020},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:e96dd7f0713a1d01b51bead4761eabfd2c65602c608ae700dc8f26102e571a24","observation_id":"604720e8-fadf-4126-bce5-78962513c10f","resolution":{"observed_at":"2026-05-15T08:31:04.848176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-10T13:57:06.597469Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:b79a9ec5859fc4e01d62945f23eaa52cd80028b6a2d02c088dd19bfe58f8a6f2","observation_id":"8dd6b942-80ed-443e-b64e-68591d84b91f","resolution":{"observed_at":"2026-05-15T08:31:04.808774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:b191cb7c6a7791b05bee73fa617478efc8b136604c7f102f6c64a700a9d5ae6f","observation_id":"d2ef9f08-4e08-4d03-a30a-6ee90eec9f7b","resolution":{"observed_at":"2026-05-15T08:31:04.813090Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":"2109.07958","doi":"10.48550/arxiv.2109.07958","metadata_source":"pith","pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","venue":"cs.CL","work_id":"22e3b047-a6e8-4c4c-b62e-173b545a1a45","year":2021},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:0da33ca39159088fe7735653b319387b24a9dd058d7404607347c6d48cd3fb73","observation_id":"6e27a196-9acd-4f98-85ae-9a2f122c9900","resolution":{"observed_at":"2026-05-15T08:31:04.817976Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-07T00:09:06.068721+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T00:09:06.068721+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08984","last_updated":"2023-01-21T17:47:55Z","snapshot_observed_at":"2026-08-11T12:43:09.740262Z","submitted_at":"2023-01-21T17:47:55Z","title":"SuperScaler: Supporting Flexible DNN Parallelization via a Unified Abstraction","version":1},"cited_work":{"arxiv_id":"2301.08984","doi":"10.48550/arxiv.2301.08984","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.08984","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023-01-21","venue":"ArXiv.org","work_id":"c2f97180-e64c-4d44-809c-e473cd606e17","year":2023},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2301.08984","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:cbd2416bed46fdbdc745dd638c7afa59d1be6ef607993a75cba04c309c1ea1d2","observation_id":"e2e63c95-1c82-4779-97bd-8be9ec4c2c64","resolution":{"observed_at":"2026-05-15T08:31:04.822575Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05209","last_updated":"2024-03-13T08:14:47Z","snapshot_observed_at":"2026-08-03T21:56:31.751173Z","submitted_at":"2023-10-08T15:50:36Z","title":"Scaling Laws of RoPE-based Extrapolation","version":2},"cited_work":{"arxiv_id":"2310.05209","doi":"10.48550/arxiv.2310.05209","metadata_source":"pith","pith_arxiv_id":"2310.05209","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.05209 , year=","venue":"cs.CL","work_id":"dbd2741d-fa31-4d89-a786-232ddc030072","year":2023},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2310.05209","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:136f5b7c256d1e437f21935dbe64dc615829e95e9be081f0652117da93e1ffec","observation_id":"f9e495db-c92b-4a07-8588-098b67703674","resolution":{"observed_at":"2026-05-15T08:31:04.827352Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16300","last_updated":"2023-11-20T01:16:17Z","snapshot_observed_at":"2026-08-04T15:01:39.394740Z","submitted_at":"2023-05-25T17:53:42Z","title":"Landmark Attention: Random-Access Infinite Context Length for Transformers","version":2},"cited_work":{"arxiv_id":"2305.16300","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.16300","snapshot_observed_at":"2026-07-10T01:36:44.202075Z","title":"Landmark attention: Random-access infinite context length for transformers","venue":"cs.CL","work_id":"80514bca-23b2-4088-a560-960c42f74ff5","year":2023},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2305.16300","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:576827963f435049ed557d7e0ec8769eb52b29a982ac8de0c0a7590786f1777d","observation_id":"c078aada-cf39-4f4d-8826-014b670b8de4","resolution":{"observed_at":"2026-05-15T08:31:04.831285Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-01T02:15:47.181936Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"cited_work":{"arxiv_id":"2309.00071","doi":"10.48550/arxiv.2309.00071","metadata_source":"pith","pith_arxiv_id":"2309.00071","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","venue":"cs.CL","work_id":"31f454a9-7de2-4696-86f2-9bfa1410f80d","year":2023},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2309.00071","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:be8c39caa351507823f49df0634c97ba025071c50462345d357e319410e5d3af","observation_id":"573b4f94-fd52-48e9-ad55-cf4f91f11e94","resolution":{"observed_at":"2026-05-15T08:31:04.835724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05507","last_updated":"2019-11-13T14:36:01Z","snapshot_observed_at":"2026-08-10T02:15:37.272323Z","submitted_at":"2019-11-13T14:36:01Z","title":"Compressive Transformers for Long-Range Sequence Modelling","version":1},"cited_work":{"arxiv_id":"1911.05507","doi":"10.48550/arxiv.1911.05507","metadata_source":"pith","pith_arxiv_id":"1911.05507","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Compressive Transformers for Long-Range Sequence Modelling","venue":"cs.LG","work_id":"70572d78-130b-4a13-908f-0702dcf423df","year":2019},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/1911.05507","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:6f1a45d1b6d4a8f532e5333ef92b97767959af088b05d034a928bf2dd536698c","observation_id":"3a48f80c-fad7-40f5-980d-001e1e13e499","resolution":{"observed_at":"2026-05-18T10:46:17.004740Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":"2104.09864","doi":"10.48550/arxiv.2104.09864","metadata_source":"pith","pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","venue":"cs.CL","work_id":"4e5eee26-cd04-4c7a-988f-3e6d1a1f0eb9","year":2021},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:2cf8f84ac39408a068ef1c110cc3ad4801154f715eb709e530284fed29a2e32e","observation_id":"55dd6834-7696-4c5d-9c03-4b1895f3a055","resolution":{"observed_at":"2026-05-15T08:31:04.845172Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:39.263809+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:39.263809+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07174","last_updated":"2023-06-12T15:13:39Z","snapshot_observed_at":"2026-07-06T15:41:35.923624Z","submitted_at":"2023-06-12T15:13:39Z","title":"Augmenting Language Models with Long-Term Memory","version":1},"cited_work":{"arxiv_id":"2306.07174","doi":"10.48550/arxiv.2306.07174","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07174","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Augmenting language models with long-term memory","venue":"arXiv (Cornell University)","work_id":"77e43943-805c-4c7e-b857-b2d3372cffa8","year":2023},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2306.07174","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:2ebbedc194fc30dfa25d5df9ce111a28048c6a1cca0d963940cef424c6e7646c","observation_id":"fd08f067-730a-48bc-bc1a-a076d120ad16","resolution":{"observed_at":"2026-05-15T08:31:04.798383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03462","last_updated":"2024-10-11T02:18:24Z","snapshot_observed_at":"2026-08-05T14:53:23.650244Z","submitted_at":"2024-01-07T11:57:40Z","title":"Long Context Compression with Activation Beacon","version":3},"cited_work":{"arxiv_id":"2401.03462","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.03462","snapshot_observed_at":"2026-07-10T01:36:44.299242Z","title":"Soaring from 4k to 400k: Extending llm’s context with activation beacon","venue":"cs.CL","work_id":"78aba7c2-bb5d-41b3-91fb-d31607f3960a","year":2024},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2401.03462","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:101eed7ac51da8345810722bd9534604fdf95a7ba6848fbbc16fecd5ae26edd5","observation_id":"eb27fcf0-0207-4bf8-92df-d7b122e1aa0f","resolution":{"observed_at":"2026-05-15T08:31:04.803998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"As the GPU memory and computation time increase exponentially with the sequence length, it’s challenging to serve the fine-tuning and inference with context length beyond 512k","venue":null,"work_id":"33ae1ba8-b9a7-4c4d-aa7e-71374cb746a0","year":2023},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:b6d75b7675f9b97d3fced5360c6b36018e91580d19a277a84fcd06c9d730e59b","observation_id":"a22ac5c5-7007-4a0d-9ed6-9e9cae0b5f92","resolution":{"observed_at":"2026-05-15T08:31:04.850888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":0,"verified_exact":9,"verified_fuzzy":2},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 70 inbound Pith citation observations for arXiv:2402.13753."}