{"as_of":"2026-08-09T00:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2963fb23c1b78125bcae9d85def063301d3377db09fbd4fb1f667500bde4a26e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":33,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:02:23.466396Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:59:58.965650Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2306.14048","last_updated":"2023-12-18T19:10:00Z","snapshot_observed_at":"2026-08-06T19:19:02.165567Z","submitted_at":"2023-06-24T20:11:14Z","title":"H$_2$O: Heavy-Hitter Oracle for Efficient Generative Inference of Large Language Models","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-17T18:00:50.053377Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2306.14048"},"observation_digest":"sha256:4f01f662415acb332c0ebf8b1f1af87ef2a7eb99fc1d417cb0ec10744360a7f5","observation_id":"1798dffb-aa43-4817-bb5e-e033a0ad4754","resolution":{"observed_at":"2026-05-17T18:00:50.520156Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":186,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:9412de5d4c5dd2fd741bda9e70aba73a94989f25d33e6c07831f1fb95373ffe6","observation_id":"b806f92c-5f04-4724-a73c-da695ce8b1ca","resolution":{"observed_at":"2026-05-19T20:28:39.590399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-01T02:15:47.181936Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T06:46:50.042423Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2309.00071"},"observation_digest":"sha256:c7b6b709ac8df5c6ec766f03f80b7ee6105ae7ea3174a1b4b784073f23d59c44","observation_id":"c349c23a-8920-4d8b-875c-c2d03ba5312c","resolution":{"observed_at":"2026-05-12T06:46:51.081241Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T08:31:04.774135Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2402.13753"},"observation_digest":"sha256:cd5dd825e74b5fab564b351c3fb476fb3c719ac2a7357a42eacfcedcc6781dfe","observation_id":"8dd6b942-80ed-443e-b64e-68591d84b91f","resolution":{"observed_at":"2026-05-15T08:31:04.808774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T03:55:20.355345Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2404.06654"},"observation_digest":"sha256:9a689f454721a0ecee7404e187cfb5d5147c0cb797ed609ed6bec20afca4640a","observation_id":"fbe42069-2855-4559-b05c-d2537847f947","resolution":{"observed_at":"2026-05-11T03:55:20.625562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T09:58:29.057357Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2406.02069"},"observation_digest":"sha256:0747211b5e37ec6d2f3e1b43435749a2b02d6f303848cecf4bbd814ea46694de","observation_id":"7a68cb7e-960f-4615-b7d5-e3fd24d35a13","resolution":{"observed_at":"2026-05-12T09:58:29.156505Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2410.17247","last_updated":"2025-02-27T11:16:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T17:59:53Z","title":"PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T12:12:14.613620Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2410.17247"},"observation_digest":"sha256:f78e4e4d0f7ff328ded7a3bf3a93a8c12e60f4ed5e4c4a8c77f15b311a7928f4","observation_id":"c14fe22c-a852-404f-8ff5-09a618e0dd22","resolution":{"observed_at":"2026-05-15T12:12:14.781748Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-08T13:02:23.466396Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-08T12:56:03.378384Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.466396Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:8cb281659ac7271812ab67cb639b037cb9dbc6dbe410553c28015aa3a14c45aa","observation_id":"9c5bb579-0a93-4f9e-89b4-1066f8227d71","resolution":{"observed_at":"2026-08-08T13:02:23.466396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-07T23:19:37.832723Z","title":"LM - Infinite : Zero - Shot Extreme Length Generalization for Large Language Models , June 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08910","last_updated":"2025-02-13T02:52:01Z","snapshot_observed_at":"2026-08-07T23:12:54.397262Z","submitted_at":"2025-02-13T02:52:01Z","title":"InfiniteHiP: Extending Language Model Context Up to 3 Million Tokens on a Single GPU","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T23:19:37.832723Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2502.08910"},"observation_digest":"sha256:a266473ae832d4729e81e7df746b0745c34dac3a625c8eb0b5014e982344bb2c","observation_id":"42f8bdbd-f073-407f-b83e-93d7f6cc8a34","resolution":{"observed_at":"2026-08-07T23:19:37.832723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-07T15:08:00.761662Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17134","last_updated":"2025-06-03T03:04:17Z","snapshot_observed_at":"2026-08-08T16:23:18.904775Z","submitted_at":"2025-05-22T04:05:02Z","title":"LongMagpie: A Self-synthesis Method for Generating Large-scale Long-context Instructions","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T15:08:00.761662Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2505.17134"},"observation_digest":"sha256:3517e480facf6cf5d5f5ee2e284d24f1c40c0489560652b00e64c37a8dc40d67","observation_id":"6e66b81e-5b21-47ef-8472-476c2beb32cb","resolution":{"observed_at":"2026-08-07T15:08:00.761662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-07T14:52:13.219156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17296","last_updated":"2025-05-22T21:23:20Z","snapshot_observed_at":"2026-08-08T15:51:51.007510Z","submitted_at":"2025-05-22T21:23:20Z","title":"SELF: Self-Extend the Context Length With Logistic Growth Function","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:52:13.219156Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2505.17296"},"observation_digest":"sha256:e968ef807410e4e69d59a98c2ae5818a3982355fdfeb80fdb433390cd5e98def","observation_id":"a42545fb-8785-4870-809f-8e4199fea2a3","resolution":{"observed_at":"2026-08-07T14:52:13.219156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-07T13:23:12.222334Z","title":"LM -infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22107","last_updated":"2025-08-14T11:51:31Z","snapshot_observed_at":"2026-08-08T16:23:06.271281Z","submitted_at":"2025-05-28T08:34:46Z","title":"Curse of High Dimensionality Issue in Transformer for Long-context Modeling","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:23:12.222334Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2505.22107"},"observation_digest":"sha256:179fb2470f9684c7bf38859e0f3ae07e9635ea99b8952de8da3a541b0a0eb440","observation_id":"b6f39f0d-4cd4-4439-ba1b-049f3fb3b6ab","resolution":{"observed_at":"2026-08-07T13:23:12.222334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-07T12:39:03.996288Z","title":"Lm-infinite: Zero-shot extreme length generalization for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24179","last_updated":"2025-05-30T03:40:24Z","snapshot_observed_at":"2026-08-07T12:28:26.705118Z","submitted_at":"2025-05-30T03:40:24Z","title":"SALE : Low-bit Estimation for Efficient Sparse Attention in Long-context LLM Prefilling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:03.996288Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2505.24179"},"observation_digest":"sha256:46135c0b0835d87b06360704140139bfb6716d679a4e6206841528e1147fe8da","observation_id":"9c1f97f4-31be-47bf-a7e4-89aa14373d90","resolution":{"observed_at":"2026-08-07T12:39:03.996288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-07T11:15:23.945547Z","title":"Lm-infinite: Zero-shot extreme length generalization for large language models.arXiv preprint arXiv:2308.16137, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03131","last_updated":"2025-06-03T17:57:33Z","snapshot_observed_at":"2026-08-07T23:51:36.891678Z","submitted_at":"2025-06-03T17:57:33Z","title":"Native-Resolution Image Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:15:23.945547Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2506.03131"},"observation_digest":"sha256:95b07c6fb99e2f9f55160629b33050301d69f9f068b2da163f981f4070f65a89","observation_id":"59c4f0f8-6bc4-4735-a902-d56b017cf2cc","resolution":{"observed_at":"2026-08-07T11:15:23.945547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-07T10:52:06.070721Z","title":"Lm-infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04180","last_updated":"2025-06-04T17:27:42Z","snapshot_observed_at":"2026-08-08T16:23:05.849553Z","submitted_at":"2025-06-04T17:27:42Z","title":"SuperWriter: Reflection-Driven Long-Form Generation with Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:52:06.070721Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2506.04180"},"observation_digest":"sha256:ee9c5c16c9949a29d10bc6b971c434493dfb011db2f4a8177c3949806c6a5cdd","observation_id":"f05067d3-3654-4711-93d6-15f78c468956","resolution":{"observed_at":"2026-08-07T10:52:06.070721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-06T15:57:00.920875Z","title":"Lm-infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14675","last_updated":"2025-07-19T16:03:34Z","snapshot_observed_at":"2026-08-08T23:35:54.228351Z","submitted_at":"2025-07-19T16:03:34Z","title":"Docopilot: Improving Multimodal Models for Document-Level Understanding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.920875Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2507.14675"},"observation_digest":"sha256:43b9364f18fc845d4b5d11a1748b4909de9ca908f915c67c8b1f4ef1851431b6","observation_id":"31325cda-12db-4b24-85ca-015f9d77a715","resolution":{"observed_at":"2026-08-06T15:57:00.920875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-06T14:00:43.237147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20030","last_updated":"2025-07-26T18:20:25Z","snapshot_observed_at":"2026-08-06T14:00:29.609119Z","submitted_at":"2025-07-26T18:20:25Z","title":"FAEDKV: Infinite-Window Fourier Transform for Unbiased KV Cache Compression","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T14:00:43.237147Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2507.20030"},"observation_digest":"sha256:794143fc4cc2e95da7efb529283ab46515ccf4b8b46c3d68b3b77152529981d8","observation_id":"bf543205-dd9c-4967-8698-5aedea26e86b","resolution":{"observed_at":"2026-08-06T14:00:43.237147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-04T14:50:30.959453Z","title":"Lm-infinite: Zero-shot extreme length generalization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23381","last_updated":"2026-07-21T08:03:44Z","snapshot_observed_at":"2026-08-06T16:07:03.838158Z","submitted_at":"2025-09-27T16:03:44Z","title":"Guard Vector: Beyond English LLM Guardrails with Task-Vector Composition and Streaming-Aware Prefix SFT","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T14:50:30.959453Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2509.23381"},"observation_digest":"sha256:d040b74b24229f4ef04d9463a918d2c6438d16c01e33f3b662be008ec7d12247","observation_id":"aea2deaf-e721-4bce-ae6b-4597daea1ed6","resolution":{"observed_at":"2026-08-04T14:50:30.959453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-04T07:44:16.124951Z","title":"Lm- infinite: Zero-shot extreme length generalization for large language models.arXiv preprint arXiv:2308.16137,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.24606","last_updated":"2026-05-27T23:25:55Z","snapshot_observed_at":"2026-08-04T07:44:14.501838Z","submitted_at":"2025-10-28T16:34:18Z","title":"Long-Context Modeling with Dynamic Hierarchical Sparse Attention for Memory-Constrained LLM Inference","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T07:44:16.124951Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2510.24606"},"observation_digest":"sha256:b9cc63b5bd883530ae59f0b842b100999db2b67a836e8956870aedad58b0fd72","observation_id":"d1f67058-5aeb-4794-9502-cf08d945e7e4","resolution":{"observed_at":"2026-08-04T07:44:16.124951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2605.02262","last_updated":"2026-05-04T06:17:13Z","snapshot_observed_at":"2026-08-05T23:06:05.311364Z","submitted_at":"2026-05-04T06:17:13Z","title":"WindowQuant: Mixed-Precision KV Cache Quantization based on Window-Level Similarity for VLMs Inference Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-09T16:06:26.450483Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2605.02262"},"observation_digest":"sha256:7428aedc2e5f0f3cf0a92fa63e4196c56e0430994745782d9d72ce31f3757dbf","observation_id":"8d3568d7-5429-4c68-8b5c-e778931cea00","resolution":{"observed_at":"2026-05-11T16:36:08.008421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2605.06611","last_updated":"2026-05-07T17:28:55Z","snapshot_observed_at":"2026-08-03T12:02:38.374401Z","submitted_at":"2026-05-07T17:28:55Z","title":"The Structural Origin of Attention Sink: Variance Discrepancy, Super Neurons, and Dimension Disparity","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T12:11:04.146711Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2605.06611"},"observation_digest":"sha256:9a3e0b9d648c347a9fb4af6dc0ad185c250ec72ac852d217d455aac43f59f552","observation_id":"4f72b1ba-359b-4577-97f0-0f61bea1e624","resolution":{"observed_at":"2026-05-11T19:21:08.539614Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2605.08840","last_updated":"2026-05-09T09:49:32Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T09:49:32Z","title":"ReST-KV: Robust KV Cache Eviction with Layer-wise Output Reconstruction and Spatial-Temporal Smoothing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T02:52:33.076123Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2605.08840"},"observation_digest":"sha256:9ac567682ff662c78e36902e6d3a32174a0d0ba4eddf6fb7a609068027f262d1","observation_id":"e3f40dc4-dca4-4a3c-804b-4d2ec89a7aff","resolution":{"observed_at":"2026-05-12T07:26:30.166285Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2605.09649","last_updated":"2026-05-10T16:47:50Z","snapshot_observed_at":"2026-07-06T23:21:44.900680Z","submitted_at":"2026-05-10T16:47:50Z","title":"Make Each Token Count: Towards Improving Long-Context Performance with KV Cache Eviction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T05:02:25.513351Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2605.09649"},"observation_digest":"sha256:c94ec66baff17bef494001acdf56b0bec41c00dd87b957a058983c517a53f332","observation_id":"5b879935-f2aa-4a79-a91e-c62fa0d794b6","resolution":{"observed_at":"2026-05-12T05:41:26.495354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2605.24279","last_updated":"2026-05-22T23:13:21Z","snapshot_observed_at":"2026-07-31T10:30:03.841807Z","submitted_at":"2026-05-22T23:13:21Z","title":"ContextEcho: A Benchmark for Persona Drift in Long Agentic-Coding Sessions","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T15:17:37.904831Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2605.24279"},"observation_digest":"sha256:3dedcb506d11cbbc07f51779f7632c1bb6b660a69ed447479af9494368925fa9","observation_id":"095ffcf9-aa6f-4a7d-a19d-de9b8eb0a671","resolution":{"observed_at":"2026-06-30T15:34:48.471183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2606.01101","last_updated":"2026-05-31T08:43:47Z","snapshot_observed_at":"2026-08-02T03:11:04.611986Z","submitted_at":"2026-05-31T08:43:47Z","title":"Soft-NBCE: Entropy-Weighted Chunk Fusion for Long-Context","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T17:39:50.539344Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2606.01101"},"observation_digest":"sha256:0e07c1fea384ba2e7116618489f35b92b23cea941389dfb06b3f8799b2ceb0c5","observation_id":"1933acf1-a305-4328-8bcf-e64efd8845cf","resolution":{"observed_at":"2026-07-01T20:46:14.242300Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2606.07878","last_updated":"2026-06-05T22:21:23Z","snapshot_observed_at":"2026-08-07T18:41:33.416672Z","submitted_at":"2026-06-05T22:21:23Z","title":"Still: Amortized KV Cache Compaction in a Single Forward Pass","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T22:21:44.541078Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2606.07878"},"observation_digest":"sha256:05c913c9a1417bd54e29c4c6f3f7d1b888cd8ad843da97fe2318a3c731c66e72","observation_id":"e7ebb1c9-2af4-4c2c-89f8-bf4890ee9f60","resolution":{"observed_at":"2026-07-02T16:47:10.161493Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2606.24734","last_updated":"2026-06-23T15:58:46Z","snapshot_observed_at":"2026-07-06T23:59:18.313042Z","submitted_at":"2026-06-23T15:58:46Z","title":"Task Decomposition for Efficient Annotation","version":1},"reference_index":187,"source":"arxiv_source","source_observed_at":"2026-06-26T00:00:16.588823Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2606.24734"},"observation_digest":"sha256:02039badd4617d2e333df27c3aa9d7cd4171d1ab17f6d9e1d7cf9285516bb4d6","observation_id":"36f92f5c-a675-45ca-a08c-aa871ad8b4f5","resolution":{"observed_at":"2026-07-04T16:59:58.967557Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":"2308.16137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-04T16:59:58.965650Z","title":"Lm- infinite: Simple on-the-fly length generalization for large language models","venue":null,"work_id":"62f73354-8046-4134-b4e3-1bfab8df2d99","year":2023},"citing_paper":{"arxiv_id":"2606.29563","last_updated":"2026-06-28T19:04:47Z","snapshot_observed_at":"2026-08-02T13:11:07.991129Z","submitted_at":"2026-06-28T19:04:47Z","title":"Coverage-Driven KV Cache Eviction for Efficient and Improved Inference of LLM","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-30T07:19:48.530272Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2606.29563"},"observation_digest":"sha256:51e7db741a5d24b45272ae150dea3d4cb784da8ce056d9132175a15fa7557dc3","observation_id":"88fe0820-a59a-48af-a2bd-9376e47813d3","resolution":{"observed_at":"2026-06-30T07:24:21.363000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-12T09:50:23.266920Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02574","last_updated":"2026-06-30T16:12:40Z","snapshot_observed_at":"2026-07-12T09:50:22.497230Z","submitted_at":"2026-06-30T16:12:40Z","title":"From Tensor Buffer to Distributed Memory Hierarchy: A Survey of KV Cache Management for LLM Serving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-12T09:50:23.266920Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2607.02574"},"observation_digest":"sha256:b88fce41da59e4aa8f3d15480c4f4ef2d9a26a2326b52c34f6b2e8a50f9e5353","observation_id":"f51a0686-9c62-4327-92f9-b133c37e797f","resolution":{"observed_at":"2026-07-12T09:50:23.266920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-14T12:08:05.502310Z","title":"arXiv preprint arXiv:2308.16137 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10386","last_updated":"2026-07-11T16:29:51Z","snapshot_observed_at":"2026-08-03T03:24:52.663992Z","submitted_at":"2026-07-11T16:29:51Z","title":"Structured Thoughts For Improved Reasoning And Context Pruning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-14T12:08:05.502310Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2607.10386"},"observation_digest":"sha256:ab7ebbd95d0e00bfdff45d8835e325c9a0704641205d2ebcd9a1baf85bf10c7d","observation_id":"1f50a51d-e0e0-4930-81ef-6f1b90c55994","resolution":{"observed_at":"2026-07-14T12:08:05.502310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-07-31T11:50:16.936655Z","title":"Lm-infinite: Zero-shot extreme length generalization for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24554","last_updated":"2026-07-27T15:28:02Z","snapshot_observed_at":"2026-08-07T04:39:15.958635Z","submitted_at":"2026-07-27T15:28:02Z","title":"DeCoRAG: Cognitive Decoupling and Semantic-Aware Cropping for Complex Document Understanding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T11:50:16.936655Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2607.24554"},"observation_digest":"sha256:32a555aebd3c535326b92e0427e738a96870292bc21cf48cc3330d8c062efc6b","observation_id":"14e89e45-5f30-4b1a-b4a0-638c9cb50e0b","resolution":{"observed_at":"2026-07-31T11:50:16.936655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-04T13:43:51.262644Z","title":"arXiv preprint arXiv:2308.16137 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-08T23:10:44.569765Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T13:43:51.262644Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:fd03af5b012c83067bb598d8f171da7db634f252051f69d4691854f1bf66bb89","observation_id":"4fa139c7-e1fe-4b1e-991d-524c02647f5e","resolution":{"observed_at":"2026-08-04T13:43:51.262644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-07T00:11:48.558405Z","title":"arXiv preprint arXiv:2308.16137 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-08T23:10:44.569765Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T00:11:48.558405Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:56afb509a503bec8bb59d23f3953fb90993dee79a7d2fd82ec18c967540eb0ff","observation_id":"964a0bfd-f71f-4f5b-a061-e85ab2cbcdbd","resolution":{"observed_at":"2026-08-07T00:11:48.558405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2308.16137/citation-record","integrity":"/paper/2308.16137/integrity","json":"/paper/2308.16137/citation-record.json","paper":"/paper/2308.16137"},"outbound":[],"paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","latest_version":7,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 33 inbound Pith citation observations for arXiv:2308.16137."}