{"as_of":"2026-08-14T15:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c1837a566b7e9c642b8da79fec5e52c30234a579ecf6943ca9aa2a8263995a7d","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T12:56:46.806841Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28263/citation-record","integrity":"/paper/2607.28263/integrity","json":"/paper/2607.28263/citation-record.json","paper":"/paper/2607.28263"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-31T12:56:44.612278Z","title":"Geoffrey Hinton, Oriol Vinyals, and Jeff Dean","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.612278Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:eda6d85a1ec6a35089f5ce42da4d9e4de6ca4d07789997a22c321ce63a6cdd9c","observation_id":"5b257e32-d26d-40ff-9450-4edbb1cfdd63","resolution":{"observed_at":"2026-07-31T12:56:44.612278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-14T09:25:42.723726Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-07-31T12:56:44.892297Z","title":"Edward J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.892297Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:5a81a114fbad043affc40198974ece751d9e21e0341c0910f9736475dece8051","observation_id":"c72022f2-797a-4c62-8851-a4c96ce608b8","resolution":{"observed_at":"2026-07-31T12:56:44.892297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12457","last_updated":"2024-04-25T06:47:57Z","snapshot_observed_at":"2026-08-14T10:51:23.584474Z","submitted_at":"2024-04-18T18:32:30Z","title":"RAGCache: Efficient Knowledge Caching for Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12457","snapshot_observed_at":"2026-07-31T12:56:44.993564Z","title":"Yuri Kuratov et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.993564Z"},"links":{"cited_paper":"/paper/2404.12457","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:d0fcf33c7a18079f7724dcf8b7d0cbb2cadb3effbac24a4f8d994d32fe7881a1","observation_id":"14ff5225-b6c4-4a1c-948b-b7bfa0922871","resolution":{"observed_at":"2026-07-31T12:56:44.993564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19384","last_updated":"2025-06-16T10:21:00Z","snapshot_observed_at":"2026-08-14T01:45:56.211716Z","submitted_at":"2024-06-27T17:57:03Z","title":"The Remarkable Robustness of LLMs: Stages of Inference?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19384","snapshot_observed_at":"2026-07-31T12:56:45.090058Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.090058Z"},"links":{"cited_paper":"/paper/2406.19384","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:91835b96d8a4e0873d0224626932b8b99d3abf5f4944a71f87f96dff7c0eb74a","observation_id":"bf6cf282-fc70-4d4e-94e3-7cd519c5a8df","resolution":{"observed_at":"2026-07-31T12:56:45.090058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-08-14T12:21:04.886717Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-07-31T12:56:45.197106Z","title":"Xiaolin Lin, Jingcun Wang, Olga Kondrateva, Yiyu Shi, Bing Li, and Grace Li Zhang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.197106Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:0bd90c579068e8149e9a6a766b27ec3e8ec7eb06ca85aa92417184552d5cdb98","observation_id":"dd146709-5cf9-4f84-98d1-c9e0529c2a2f","resolution":{"observed_at":"2026-07-31T12:56:45.197106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.24467","last_updated":"2026-06-23T11:59:46Z","snapshot_observed_at":"2026-08-13T17:28:18.693868Z","submitted_at":"2026-06-23T11:59:46Z","title":"CompressKV: Semantic-Retrieval-Guided KV-Cache Compression for Resource-Efficient Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.24467","snapshot_observed_at":"2026-07-31T12:56:45.291959Z","title":"Akide Liu, Jing Liu, Zizheng Pan, Yefei He, Gholam- reza Haffari, and Bohan Zhuang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.291959Z"},"links":{"cited_paper":"/paper/2606.24467","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:b209f68e3257639fb31ddff5232012617ab4df283a659d8068f376188110b4d9","observation_id":"22bdc162-20b6-4d40-8af9-6cef3be9f150","resolution":{"observed_at":"2026-07-31T12:56:45.291959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17753","last_updated":"2024-02-27T18:42:31Z","snapshot_observed_at":"2026-08-13T02:36:36.245972Z","submitted_at":"2024-02-27T18:42:31Z","title":"Evaluating Very Long-Term Conversational Memory of LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17753","snapshot_observed_at":"2026-07-31T12:56:45.432364Z","title":"Amirkeivan Mohtashami and Martin Jaggi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.432364Z"},"links":{"cited_paper":"/paper/2402.17753","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:1c802a60a1fdb9c1d63de4025ef8433e2ab33b399f1a45150a24a556fb02ab7e","observation_id":"a10ddebc-b201-4562-84f4-d81c5d510e62","resolution":{"observed_at":"2026-07-31T12:56:45.432364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16300","last_updated":"2023-11-20T01:16:17Z","snapshot_observed_at":"2026-08-13T11:33:08.381732Z","submitted_at":"2023-05-25T17:53:42Z","title":"Landmark Attention: Random-Access Infinite Context Length for Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16300","snapshot_observed_at":"2026-07-31T12:56:45.516458Z","title":"Bowen Peng, Jeffrey Quesnelle, Honglu Fan, and Enrico Shippole","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.516458Z"},"links":{"cited_paper":"/paper/2305.16300","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:e2b67356e84e62c85d524ab9d3ef1c47ce00b7c0c040b9188dd787b89fdd3e1f","observation_id":"d26e740b-b28b-4095-be6d-f5b487faa1c7","resolution":{"observed_at":"2026-07-31T12:56:45.516458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-01T02:15:47.181936Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00071","snapshot_observed_at":"2026-07-31T12:56:45.589864Z","title":"Kaleem Ullah Qasim, Jiashu Zhang, Muhammad Kafeel Shaheen, Razan Alharith, and Heying Zhang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.589864Z"},"links":{"cited_paper":"/paper/2309.00071","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:d7ccd1e3cc37ae4a68c64b29552bed6a9e6718c59f4b0cba481cfb08897e149f","observation_id":"77902c20-8678-4c2e-9a89-59e4d2e6e36d","resolution":{"observed_at":"2026-07-31T12:56:45.589864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:56:45.699653Z","title":"arXiv preprint arXiv:2603.19664","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.699653Z"},"links":{"citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:6d2f6766188e7d3fa4b2e09cb06baac58d28cce9c40e526bf838de87e1c91e4e","observation_id":"2166dd7d-26f5-4ead-8f8e-6888b228ecb0","resolution":{"observed_at":"2026-07-31T12:56:45.699653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05254","last_updated":"2024-05-09T14:12:45Z","snapshot_observed_at":"2026-08-14T00:44:29.108997Z","submitted_at":"2024-05-08T17:57:39Z","title":"You Only Cache Once: Decoder-Decoder Architectures for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05254","snapshot_observed_at":"2026-07-31T12:56:45.924478Z","title":"Jiaming Tang, Yilong Zhao, Kan Zhu, Guangxuan Xiao, Baris Kasikci, and Song Han","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.924478Z"},"links":{"cited_paper":"/paper/2405.05254","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:357def1cea1b3396bc93c46a03d17e7af40b7112efe867f2e7a39ff60dfabde6","observation_id":"eb06958c-9289-4e84-b333-3ac60a66a525","resolution":{"observed_at":"2026-07-31T12:56:45.924478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03170","last_updated":"2023-11-30T17:15:34Z","snapshot_observed_at":"2026-08-13T11:00:43.925003Z","submitted_at":"2023-07-06T17:52:10Z","title":"Focused Transformer: Contrastive Training for Context Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03170","snapshot_observed_at":"2026-07-31T12:56:45.996091Z","title":"Ashish Vaswani, Noam Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.996091Z"},"links":{"cited_paper":"/paper/2307.03170","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:60e5ceba82e60ca56397ee2b3126a7edc98fe8a7616a1202f6e0e02c56ea57d1","observation_id":"d377100a-6afc-4bf7-acc6-d42127968a84","resolution":{"observed_at":"2026-07-31T12:56:45.996091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04624","last_updated":"2024-05-26T23:06:32Z","snapshot_observed_at":"2026-08-13T04:24:32.501740Z","submitted_at":"2024-02-07T07:14:11Z","title":"MEMORYLLM: Towards Self-Updatable Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04624","snapshot_observed_at":"2026-07-31T12:56:46.177620Z","title":"Haoyi Wu and Kewei Tu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.177620Z"},"links":{"cited_paper":"/paper/2402.04624","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:231e3ca26df3e96b51f9b09b5f852d2b750f46eadefee4839bbee1d9e6d30a12","observation_id":"7642a1f2-9aac-4553-8f54-cffc0e58b46e","resolution":{"observed_at":"2026-07-31T12:56:46.177620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10637","last_updated":"2024-06-04T00:08:10Z","snapshot_observed_at":"2026-08-13T00:05:16.071060Z","submitted_at":"2024-05-17T08:59:46Z","title":"Layer-Condensed KV Cache for Efficient Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10637","snapshot_observed_at":"2026-07-31T12:56:46.292098Z","title":"arXiv preprint arXiv:2405.10637","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.292098Z"},"links":{"cited_paper":"/paper/2405.10637","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:b0a2901a43dd4ab8d3ece1b02cfc2d293763e76ddfa46cab56d26aeaf0686fb4","observation_id":"dc2c4eee-5961-41b9-800a-1342369c9d8b","resolution":{"observed_at":"2026-07-31T12:56:46.292098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16444","last_updated":"2025-04-03T22:49:22Z","snapshot_observed_at":"2026-08-12T23:57:54.290846Z","submitted_at":"2024-05-26T06:00:17Z","title":"CacheBlend: Fast Large Language Model Serving for RAG with Cached Knowledge Fusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16444","snapshot_observed_at":"2026-07-31T12:56:46.484066Z","title":"Howard Yen, Tianyu Gao, and Danqi Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.484066Z"},"links":{"cited_paper":"/paper/2405.16444","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:3544d45b5863115f51a90c94e2805b451a90f8ec8984abc12c27a804ed463a32","observation_id":"246bac0e-0583-4083-ae8d-d7f5e39f296f","resolution":{"observed_at":"2026-07-31T12:56:46.484066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03462","last_updated":"2024-10-11T02:18:24Z","snapshot_observed_at":"2026-08-13T04:47:49.260668Z","submitted_at":"2024-01-07T11:57:40Z","title":"Long Context Compression with Activation Beacon","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03462","snapshot_observed_at":"2026-07-31T12:56:46.586819Z","title":"Zhenyu Zhang et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.586819Z"},"links":{"cited_paper":"/paper/2401.03462","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:1de61550c08658938456b48ab67be86ec9578be76f65b4711195ae6fab803fd5","observation_id":"56a026ec-e8b0-4b30-ada3-51ce465eab2a","resolution":{"observed_at":"2026-07-31T12:56:46.586819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:56:46.698287Z","title":"InNeurIPS","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.698287Z"},"links":{"citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:1e230d98ff6b6e6cfe4890a99a66b3cd4c9ed62deb0fb924b3b5d6cde32d68cf","observation_id":"56c6f3a7-c37f-45e0-ad71-8748f98dc2b8","resolution":{"observed_at":"2026-07-31T12:56:46.698287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:56:46.806841Z","title":"†MemoryLLM uses a different chat-tuned backbone","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.806841Z"},"links":{"citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:f15f7c6124a7f376ea9bb22af389b0f3057d938f0a3e6e7897f864a2a97d48fb","observation_id":"2053ddf8-536e-4843-82b6-62932083f24e","resolution":{"observed_at":"2026-07-31T12:56:46.806841Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-07-31T12:56:44.764763Z","title":"Cheng-Ping Hsieh et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.764763Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:abcae045cc9f82b5fb3e01259b1d8a10fa38d9aabdfeee825de834e82cafbbc2","observation_id":"ebebcc82-b04e-4bc9-b2d1-8c3f2fd00856","resolution":{"observed_at":"2026-07-31T12:56:44.764763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15022","last_updated":"2025-08-25T14:43:13Z","snapshot_observed_at":"2026-08-13T10:25:17.396322Z","submitted_at":"2023-08-29T04:59:53Z","title":"Recursively Summarizing Enables Long-Term Dialogue Memory in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15022","snapshot_observed_at":"2026-07-31T12:56:46.074813Z","title":"InAdvances in Neural Information Pro- cessing Systems, volume 30, pages 5998–6008","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.074813Z"},"links":{"cited_paper":"/paper/2308.15022","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:fa024a450ed6e890457314838caa4ba6e998c6baea6ef84f90683290a0f384d1","observation_id":"5129d7ef-986f-49e1-9161-c36d44b6fc21","resolution":{"observed_at":"2026-07-31T12:56:46.074813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05507","last_updated":"2019-11-13T14:36:01Z","snapshot_observed_at":"2026-08-10T02:15:37.272323Z","submitted_at":"2019-11-13T14:36:01Z","title":"Compressive Transformers for Long-Range Sequence Modelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.05507","snapshot_observed_at":"2026-07-31T12:56:45.774990Z","title":"Stephen Robertson and Hugo Zaragoza","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.774990Z"},"links":{"cited_paper":"/paper/1911.05507","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:57d141ce7ae5868c7b8b0f99eca373680c360950ee62def9a3a806b00a7b81d6","observation_id":"7fcdedf1-afc9-4a53-8d29-2ed1fc60cea6","resolution":{"observed_at":"2026-07-31T12:56:45.774990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-14T03:33:46.294739Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-07-31T12:56:45.848263Z","title":"arXiv preprint arXiv:2104.09864","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.848263Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:4dfff811c74d55101ae6afb4e282cb08cad53c5e5b3019dc0e1816d1821554e4","observation_id":"9b9b10e7-af59-439b-84b4-5bccc4e2235c","resolution":{"observed_at":"2026-07-31T12:56:45.848263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-07-31T12:56:44.371714Z","title":"arXiv preprint arXiv:2308.14508","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.371714Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:7b5a8f3faa565a0a5f16d0b16fa785035e3092339c27043c79dc76e44c3f509b","observation_id":"e3440b2f-b3f3-44d2-bf0a-e6d85d53dfda","resolution":{"observed_at":"2026-07-31T12:56:44.371714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-07-31T12:56:44.434623Z","title":"Shiwei Gao, Youmin Chen, and Jiwu Shu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.434623Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:f7ee039a1adccf83bb387e32a256752c93d56eb661db93591cf393a0d41f408b","observation_id":"0f018553-5d42-4941-a98d-0fec93bc3a9b","resolution":{"observed_at":"2026-07-31T12:56:44.434623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-31T12:56:46.369683Z","title":"Jiayi Yao et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.369683Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:c56c25191ff4cc21ce029c44c80e64e192832b7064d2deabe8349fd60862c4d7","observation_id":"1591ab30-e8f3-4e69-b554-2d5d89ca6e6a","resolution":{"observed_at":"2026-07-31T12:56:46.369683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05971","last_updated":"2026-05-12T06:42:09Z","snapshot_observed_at":"2026-08-12T20:56:41.268178Z","submitted_at":"2026-05-07T10:17:55Z","title":"Training Transformers for KV Cache Compressibility","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.05971","snapshot_observed_at":"2026-07-31T12:56:44.516747Z","title":"Aaron Grattafiori et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.516747Z"},"links":{"cited_paper":"/paper/2605.05971","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:d920bd1cc20b5633241d028c9c091856ad7ce5a121e93ccd63518a7208bca70b","observation_id":"910c87a8-5fa8-45c2-84b1-25cfb63079ee","resolution":{"observed_at":"2026-07-31T12:56:44.516747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T08:40:10.642095Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.28263."}