{"as_of":"2026-08-12T04:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5ca17b2e5bb9140dad99c6d67beadc0cf3c435109639838637382ccd0db800b5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:57:27.555568Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.06201","doi":"10.48550/arxiv.2310.06201","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aixin Liu, Bei Feng, Bin Wang, Bingxuan Wang, Bo Liu, Chenggang Zhao, Chengqi Dengr, Chong Ruan, Damai Dai, Daya Guo, et al","venue":"arXiv (Cornell University)","work_id":"56a7a614-da51-43ee-bf59-0a5e05d2609b","year":2023},"citing_paper":{"arxiv_id":"2409.01579","last_updated":"2026-04-26T03:57:54Z","snapshot_observed_at":"2026-08-02T14:47:38.459814Z","submitted_at":"2024-09-03T03:25:59Z","title":"AdaComp: Extractive Context Compression with Adaptive Predictor for Retrieval-Augmented Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-23T21:06:59.776841Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2409.01579"},"observation_digest":"sha256:e0ea722f1f7243f469ba62207f39d073660eb3c9d10f91584ee1b613ba67daf1","observation_id":"b9fa41b1-3d64-4ed9-a446-75585488da54","resolution":{"observed_at":"2026-05-23T21:08:26.003953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-11T14:57:27.555568Z","title":"Losparse: Structured compression of large language models based on low-rank and sparse approx- imation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-11T14:50:08.859401Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.555568Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:1a15d3fcdeb666678823363e207d4b0723d5934033c8fc0fa3eea46bc5d58d4a","observation_id":"4a3dc63c-b151-4cc7-9af2-8ce3db85edf4","resolution":{"observed_at":"2026-08-11T14:57:27.555568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-11T14:47:03.921212Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11664","last_updated":"2024-12-16T11:12:45Z","snapshot_observed_at":"2026-08-11T14:40:31.986571Z","submitted_at":"2024-12-16T11:12:45Z","title":"C3oT: Generating Shorter Chain-of-Thought without Compromising Effectiveness","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T14:47:03.921212Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2412.11664"},"observation_digest":"sha256:09e0dc81b9a47f2f9e220ce10fa74310c5374825f3afea959f180113d9166d7a","observation_id":"647d7678-7a86-402e-8186-d26d665bdc8b","resolution":{"observed_at":"2026-08-11T14:47:03.921212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-10T22:28:06.875515Z","title":"Compressing context to enhance inference efficiency of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-12T02:24:50.215653Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.875515Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:dc736f85fce13fbcf8e6887184bec49f880513ab066b38aefc75b2ad860bab76","observation_id":"6c550325-ec6b-4d9e-8c9f-57b8d7b985d2","resolution":{"observed_at":"2026-08-10T22:28:06.875515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-10T20:34:34.855472Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08262","last_updated":"2025-01-14T17:21:16Z","snapshot_observed_at":"2026-08-10T20:26:58.516585Z","submitted_at":"2025-01-14T17:21:16Z","title":"Addressing the sustainable AI trilemma: a case study on LLM agents and RAG","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T20:34:34.855472Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2501.08262"},"observation_digest":"sha256:7ce1b298c9306de866eeb81549f2cee7bc6c51b52b5dd003c44de4bfa18c5405","observation_id":"b512612a-43a3-4214-a307-fe42a9e6f753","resolution":{"observed_at":"2026-08-10T20:34:34.855472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-10T20:26:11.104966Z","title":"Compressing context to enhance inference efficiency of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09767","last_updated":"2025-01-15T05:17:12Z","snapshot_observed_at":"2026-08-11T16:31:10.641403Z","submitted_at":"2025-01-15T05:17:12Z","title":"LeMo: Enabling LEss Token Involvement for MOre Context Fine-tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:11.104966Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2501.09767"},"observation_digest":"sha256:69ad3340a5e6e92138b0c2eee057bda3dc6d58c50da1eb287e444fe204bc02e4","observation_id":"e762300c-56cb-470c-8ddd-0dfcd0074f16","resolution":{"observed_at":"2026-08-10T20:26:11.104966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-10T16:40:36.700047Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12959","last_updated":"2025-02-05T09:35:38Z","snapshot_observed_at":"2026-08-10T16:32:51.398305Z","submitted_at":"2025-01-22T15:33:17Z","title":"Efficient Prompt Compression with Evaluator Heads for Long-Context Transformer Inference","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T16:40:36.700047Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2501.12959"},"observation_digest":"sha256:c08cc805e096766e02ae3b32a10a9b64b532d58b38e33a2af1c6fecf82d33883","observation_id":"e7e8a708-eacd-4eca-ad52-556624cb6ee2","resolution":{"observed_at":"2026-08-10T16:40:36.700047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-09T11:11:17.718608Z","title":"Compressing context to enhance inference efficiency of large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02789","last_updated":"2025-05-19T18:24:50Z","snapshot_observed_at":"2026-08-10T09:14:41.151670Z","submitted_at":"2025-02-05T00:22:06Z","title":"Speculative Prefill: Turbocharging TTFT with Lightweight and Training-Free Token Importance Estimation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T11:11:17.718608Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2502.02789"},"observation_digest":"sha256:c789fd1a4a3e1ebaeecc0fce4063d877b6f5656b027753a739b66d5a7d733c32","observation_id":"c1aa0ade-cbc0-4d9f-8a4d-5969cbca6a80","resolution":{"observed_at":"2026-08-09T11:11:17.718608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.06201","doi":"10.48550/arxiv.2310.06201","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aixin Liu, Bei Feng, Bin Wang, Bingxuan Wang, Bo Liu, Chenggang Zhao, Chengqi Dengr, Chong Ruan, Damai Dai, Daya Guo, et al","venue":"arXiv (Cornell University)","work_id":"56a7a614-da51-43ee-bf59-0a5e05d2609b","year":2023},"citing_paper":{"arxiv_id":"2502.18915","last_updated":"2026-05-20T07:04:38Z","snapshot_observed_at":"2026-07-06T20:42:55.911327Z","submitted_at":"2025-02-26T08:07:17Z","title":"END: Early Noise Dropping for Efficient and Effective Context Denoising","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T02:46:33.576567Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2502.18915"},"observation_digest":"sha256:005d737cff8be345a5bff99c6ce9bc669785c15dbefc5477ed9361d05559d09e","observation_id":"a4276e16-3d46-43a7-9d5f-5370fd66cdc7","resolution":{"observed_at":"2026-05-23T02:47:26.375414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-07T14:52:13.702174Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17296","last_updated":"2025-05-22T21:23:20Z","snapshot_observed_at":"2026-08-09T05:52:01.092080Z","submitted_at":"2025-05-22T21:23:20Z","title":"SELF: Self-Extend the Context Length With Logistic Growth Function","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:52:13.702174Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2505.17296"},"observation_digest":"sha256:75ebccf51d4c0c81a8802b2ab504d2ebc905c35d3ac1c0d5d92cf40833341c7b","observation_id":"e9762229-6183-4939-84af-e95d1a7080a4","resolution":{"observed_at":"2026-08-07T14:52:13.702174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-07T14:52:57.119248Z","title":"Compressing context to enhance inference efficiency of large language models.arXiv preprint arXiv:2310.06201, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17315","last_updated":"2026-06-02T22:13:24Z","snapshot_observed_at":"2026-08-07T22:00:02.564609Z","submitted_at":"2025-05-22T22:09:47Z","title":"Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:52:57.119248Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2505.17315"},"observation_digest":"sha256:5edfa554ac98708f8247b7c6fb2fb051f0fdff758dcd91ddbedf294f14bd2c18","observation_id":"05a81d76-d8bd-4a84-9bf4-cf5846e00336","resolution":{"observed_at":"2026-08-07T14:52:57.119248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-07T14:45:13.233710Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17827","last_updated":"2025-08-02T10:54:47Z","snapshot_observed_at":"2026-08-09T04:03:13.882496Z","submitted_at":"2025-05-23T12:41:29Z","title":"Not All Tokens Are What You Need In Thinking","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:13.233710Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2505.17827"},"observation_digest":"sha256:dda68e0b643743e94dbd8fbdcf5f587aa69029babcc8c8f67fc90cfeec5fa5b4","observation_id":"f9389a32-9a8f-4394-80d8-d56596af658e","resolution":{"observed_at":"2026-08-07T14:45:13.233710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-07T14:20:25.308833Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19293","last_updated":"2026-06-02T22:08:40Z","snapshot_observed_at":"2026-08-07T14:15:05.692688Z","submitted_at":"2025-05-25T19:58:31Z","title":"100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:20:25.308833Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2505.19293"},"observation_digest":"sha256:1341d34c373f47b3f211e13608e4f29b3544321515db8065cbc0f921add7c24c","observation_id":"57c65d74-f6c6-43ae-b1db-8229c215db9e","resolution":{"observed_at":"2026-08-07T14:20:25.308833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-07T12:39:05.895555Z","title":"Compressing context to enhance inference efficiency of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24179","last_updated":"2025-05-30T03:40:24Z","snapshot_observed_at":"2026-08-09T00:29:42.217756Z","submitted_at":"2025-05-30T03:40:24Z","title":"SALE : Low-bit Estimation for Efficient Sparse Attention in Long-context LLM Prefilling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:05.895555Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2505.24179"},"observation_digest":"sha256:5be62defdceb9de4408cce0cfac08160978ec6884cbff9288614eda90c417db2","observation_id":"8677bee6-8834-4439-a1f5-446277b5db5b","resolution":{"observed_at":"2026-08-07T12:39:05.895555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-07T00:51:21.145644Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12494","last_updated":"2025-06-30T05:45:43Z","snapshot_observed_at":"2026-08-08T10:09:09.500205Z","submitted_at":"2025-06-14T13:16:31Z","title":"FlexRAG: A Flexible and Comprehensive Framework for Retrieval-Augmented Generation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T00:51:21.145644Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2506.12494"},"observation_digest":"sha256:be4169a91df8b9e2d6d2250051ed8de878980dfd2417a5aa2ce9df7da356a15b","observation_id":"72798ca7-7b83-42dd-bb49-303502252741","resolution":{"observed_at":"2026-08-07T00:51:21.145644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.06201","doi":"10.48550/arxiv.2310.06201","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aixin Liu, Bei Feng, Bin Wang, Bingxuan Wang, Bo Liu, Chenggang Zhao, Chengqi Dengr, Chong Ruan, Damai Dai, Daya Guo, et al","venue":"arXiv (Cornell University)","work_id":"56a7a614-da51-43ee-bf59-0a5e05d2609b","year":2023},"citing_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-06T20:31:23.587108Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T11:17:24.406028Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2507.02259"},"observation_digest":"sha256:263618611fcf3edcf67296b7728ab3f7b24362f62fec1f7170e8f819250b681f","observation_id":"3aaffdde-9c2a-4f8a-a59a-a68c8f461a62","resolution":{"observed_at":"2026-05-15T11:17:24.596679Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-06T20:40:10.670088Z","title":"Compressing context to enhance inference efficiency of large language models.arXiv preprint arXiv:2310.06201, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-06T20:31:23.587108Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:40:10.670088Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2507.02259"},"observation_digest":"sha256:9a6033726f32ccafaf8748f97172779c05e88e54fb31b2a2a90d6c57d909cec2","observation_id":"5cffd25f-1e54-4578-908e-73972387f4da","resolution":{"observed_at":"2026-08-06T20:40:10.670088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T04:42:13.777066Z","title":"Compressing context to enhance inference efficiency of large language models.arXiv preprint arXiv:2310.06201, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06026","last_updated":"2025-09-07T11:58:02Z","snapshot_observed_at":"2026-08-10T05:00:20.293460Z","submitted_at":"2025-09-07T11:58:02Z","title":"DCMI: A Differential Calibration Membership Inference Attack Against Retrieval-Augmented Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T04:42:13.777066Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2509.06026"},"observation_digest":"sha256:5ca3b157a84f749f20804302b482372c752604eabeca01e295733234cc56ec20","observation_id":"4b930e59-2125-465f-b794-e3aeb268838d","resolution":{"observed_at":"2026-08-05T04:42:13.777066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-04T08:06:11.497184Z","title":"Compressing context to enhance inference efficiency of large language models.arXiv preprint arXiv:2310.06201, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.22963","last_updated":"2026-06-19T20:25:06Z","snapshot_observed_at":"2026-08-04T08:06:05.944327Z","submitted_at":"2025-10-27T03:37:41Z","title":"When Compression Becomes an Attack Surface: Black-Box Attacks on Prompt-Compressed LLM Agents","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T08:06:11.497184Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2510.22963"},"observation_digest":"sha256:75981d0215e6dc0fbb6c1e1530493eebc4c1dc30a9e5053094a541aea0552311","observation_id":"217e71d3-e24b-49c5-9cdb-d4fd9cc2a58f","resolution":{"observed_at":"2026-08-04T08:06:11.497184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.06201","doi":"10.48550/arxiv.2310.06201","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aixin Liu, Bei Feng, Bin Wang, Bingxuan Wang, Bo Liu, Chenggang Zhao, Chengqi Dengr, Chong Ruan, Damai Dai, Daya Guo, et al","venue":"arXiv (Cornell University)","work_id":"56a7a614-da51-43ee-bf59-0a5e05d2609b","year":2023},"citing_paper":{"arxiv_id":"2604.12049","last_updated":"2026-04-13T20:41:36Z","snapshot_observed_at":"2026-08-03T03:51:16.996563Z","submitted_at":"2026-04-13T20:41:36Z","title":"Leveraging Weighted Syntactic and Semantic Context Assessment Summary (wSSAS) Towards Text Categorization Using LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T15:11:35.346010Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2604.12049"},"observation_digest":"sha256:34a342f08c292be8b6461c395e467bfed83f44a58900bbd7eb363f2cd44476d0","observation_id":"6296cb01-b99c-4d06-86cf-8644c465249e","resolution":{"observed_at":"2026-05-10T21:50:50.579881Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.06201","doi":"10.48550/arxiv.2310.06201","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aixin Liu, Bei Feng, Bin Wang, Bingxuan Wang, Bo Liu, Chenggang Zhao, Chengqi Dengr, Chong Ruan, Damai Dai, Daya Guo, et al","venue":"arXiv (Cornell University)","work_id":"56a7a614-da51-43ee-bf59-0a5e05d2609b","year":2023},"citing_paper":{"arxiv_id":"2604.15547","last_updated":"2026-04-16T21:52:11Z","snapshot_observed_at":"2026-08-11T03:27:16.969497Z","submitted_at":"2026-04-16T21:52:11Z","title":"Consistency Analysis of Sentiment Predictions using Syntactic & Semantic Context Assessment Summarization (SSAS)","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T10:55:20.435471Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2604.15547"},"observation_digest":"sha256:5417a76628172f8192f53c88c0627d7f140f0108695e85280bb1e968e7181a3f","observation_id":"74198f6c-c032-41b1-bf6b-4daf1fbb3c3e","resolution":{"observed_at":"2026-05-10T11:00:03.751926Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.06201","doi":"10.48550/arxiv.2310.06201","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aixin Liu, Bei Feng, Bin Wang, Bingxuan Wang, Bo Liu, Chenggang Zhao, Chengqi Dengr, Chong Ruan, Damai Dai, Daya Guo, et al","venue":"arXiv (Cornell University)","work_id":"56a7a614-da51-43ee-bf59-0a5e05d2609b","year":2023},"citing_paper":{"arxiv_id":"2605.04107","last_updated":"2026-05-04T15:35:45Z","snapshot_observed_at":"2026-08-11T06:08:27.187625Z","submitted_at":"2026-05-04T15:35:45Z","title":"TSCG: Deterministic Tool-Schema Compilation for Agentic LLM Deployments","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-08T17:42:23.586416Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2605.04107"},"observation_digest":"sha256:8df77024ecd46d617449507b03fc1e0c0eba29d9dcc59b10c004eaf65259170d","observation_id":"a4567ba7-88cf-45fe-ba8e-27422d134358","resolution":{"observed_at":"2026-05-11T17:21:07.335756Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.06201","doi":"10.48550/arxiv.2310.06201","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aixin Liu, Bei Feng, Bin Wang, Bingxuan Wang, Bo Liu, Chenggang Zhao, Chengqi Dengr, Chong Ruan, Damai Dai, Daya Guo, et al","venue":"arXiv (Cornell University)","work_id":"56a7a614-da51-43ee-bf59-0a5e05d2609b","year":2023},"citing_paper":{"arxiv_id":"2605.07307","last_updated":"2026-05-08T06:15:50Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:15:50Z","title":"Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-11T02:11:19.295354Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2605.07307"},"observation_digest":"sha256:935503e32c9c6d4a334d0d1441a3d0ab32b5f570ac4fcbf047e91cf17f15a2f8","observation_id":"a41f3010-93a6-4af1-9d0c-49d15e7f096b","resolution":{"observed_at":"2026-05-11T03:50:57.544515Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.06201","doi":"10.48550/arxiv.2310.06201","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aixin Liu, Bei Feng, Bin Wang, Bingxuan Wang, Bo Liu, Chenggang Zhao, Chengqi Dengr, Chong Ruan, Damai Dai, Daya Guo, et al","venue":"arXiv (Cornell University)","work_id":"56a7a614-da51-43ee-bf59-0a5e05d2609b","year":2023},"citing_paper":{"arxiv_id":"2606.03739","last_updated":"2026-06-02T14:55:02Z","snapshot_observed_at":"2026-08-09T21:34:41.214502Z","submitted_at":"2026-06-02T14:55:02Z","title":"Entropy Gate: Entropy Quenching for Near-Lossless Token Compression in LLM Pipelines","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:14.077931Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2606.03739"},"observation_digest":"sha256:d7ba8ab4f31c0e505f609a4e16609ac2bfee71c167adb3f54b375bcf2d2106b4","observation_id":"104866a3-739d-4f92-af58-6962970e8449","resolution":{"observed_at":"2026-07-02T02:56:28.848812Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.06201","doi":"10.48550/arxiv.2310.06201","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aixin Liu, Bei Feng, Bin Wang, Bingxuan Wang, Bo Liu, Chenggang Zhao, Chengqi Dengr, Chong Ruan, Damai Dai, Daya Guo, et al","venue":"arXiv (Cornell University)","work_id":"56a7a614-da51-43ee-bf59-0a5e05d2609b","year":2023},"citing_paper":{"arxiv_id":"2606.26875","last_updated":"2026-06-25T11:03:37Z","snapshot_observed_at":"2026-08-08T12:29:25.901976Z","submitted_at":"2026-06-25T11:03:37Z","title":"Information-Aware KV Cache Compression for Long Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T04:55:07.243644Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2606.26875"},"observation_digest":"sha256:a698a249014c97bae8d8cc67fe88627afc7e41c561d4eba858a21831055405c9","observation_id":"96d9f422-d9c8-4629-a3ae-2c082352b5eb","resolution":{"observed_at":"2026-07-04T13:49:51.571036Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-01T23:46:24.903218Z","title":"arXiv preprint arXiv:2310.06201 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15257","last_updated":"2026-07-16T17:51:23Z","snapshot_observed_at":"2026-08-08T02:15:17.714780Z","submitted_at":"2026-07-16T17:51:23Z","title":"SearchOS-V1: Towards Robust Open-Domain Information-Seeking Agent Collaboration","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-01T23:46:24.903218Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2607.15257"},"observation_digest":"sha256:360b2b7f8a31a7b0f67fb039de64fe89407ca9c05a81eec5bbfead8516512343","observation_id":"ac4861da-1648-400f-aed2-0ba235d11f16","resolution":{"observed_at":"2026-08-01T23:46:24.903218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-02T14:32:14.984908Z","title":"Compressing context to enhance inference efficiency of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16209","last_updated":"2026-05-10T13:27:01Z","snapshot_observed_at":"2026-08-06T04:38:36.769964Z","submitted_at":"2026-05-10T13:27:01Z","title":"Shapley Context Pruning: A Cooperative Game Perspective for Context Reranking and Pruning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T14:32:14.984908Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2607.16209"},"observation_digest":"sha256:567ad472532f4bdd9531a641264de88d8efa428b2651c1bca3067bf1d7c4429b","observation_id":"6ded1dd3-01ce-40b2-931a-242a03ec3377","resolution":{"observed_at":"2026-08-02T14:32:14.984908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-01T06:25:06.342561Z","title":"2023 , archivePrefix =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27523","last_updated":"2026-07-29T23:25:45Z","snapshot_observed_at":"2026-08-08T06:31:26.917124Z","submitted_at":"2026-07-29T23:25:45Z","title":"Hierarchical Reranking for Scalable Financial RAG System","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T06:25:06.342561Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2607.27523"},"observation_digest":"sha256:c6614069bb0efaf86069ba253c5d4fa91927dd5196c78fcc6c8930cbb5adef3c","observation_id":"41aa66a9-b522-465a-a7b9-aff427fb6a67","resolution":{"observed_at":"2026-08-01T06:25:06.342561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.06201/citation-record","integrity":"/paper/2310.06201/integrity","json":"/paper/2310.06201/citation-record.json","paper":"/paper/2310.06201"},"outbound":[],"paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T18:51:02.549808Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 28 inbound Pith citation observations for arXiv:2310.06201."}