{"as_of":"2026-08-05T21:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:298364779f1ce294d8f105419deaf3332f8d5538c59d01642bb13a943d3ad401","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":48,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:52:01.641529Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T01:36:44.322096Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"reference_index":144,"source":"pdf_text","source_observed_at":"2026-05-13T02:46:26.957539Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2311.05232"},"observation_digest":"sha256:532c7b444debbee87361f54f8699131123eff46b7b2f40b496c52399e9653aaa","observation_id":"f72dd5e3-3850-44c9-8af0-63c3c00b9f94","resolution":{"observed_at":"2026-05-13T02:46:27.647448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2409.01579","last_updated":"2026-04-26T03:57:54Z","snapshot_observed_at":"2026-08-02T14:47:38.459814Z","submitted_at":"2024-09-03T03:25:59Z","title":"AdaComp: Extractive Context Compression with Adaptive Predictor for Retrieval-Augmented Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-23T21:06:59.776841Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2409.01579"},"observation_digest":"sha256:6a2566fb5b4efd6c8436668f8fe3612b7ac546e8a39ad533a8b5535d43ef104a","observation_id":"bec1097a-429a-4dc0-bea3-2c1bb52f6112","resolution":{"observed_at":"2026-05-23T21:08:26.041444Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2409.06679","last_updated":"2026-04-14T06:50:10Z","snapshot_observed_at":"2026-07-06T19:13:20.458958Z","submitted_at":"2024-09-10T17:44:35Z","title":"E2LLM: Encoder Elongated Large Language Models for Long-Context Understanding and Reasoning","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-23T20:36:55.159302Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2409.06679"},"observation_digest":"sha256:091262a74a4dfabff773b0563f1e4a91e094ac5ffb11127b3fe0a76b360274ba","observation_id":"038d4429-156d-4e4e-89ce-8cdbf1905052","resolution":{"observed_at":"2026-05-23T20:38:24.967159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2412.13171","last_updated":"2024-12-17T18:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-17T18:50:33Z","title":"Compressed Chain of Thought: Efficient Reasoning Through Dense Representations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T04:47:40.335477Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2412.13171"},"observation_digest":"sha256:70a83234a2db47a7c1db4d3dce96f9e4c98b08f484957efa44ab3740616e18a1","observation_id":"6afb25e3-bfd5-40c4-a724-80806a27129d","resolution":{"observed_at":"2026-05-17T04:47:40.400393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-16T23:46:29.975858Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2502.11089"},"observation_digest":"sha256:acd9640c36a502dd04ec8ce8e5433feb96cfeb32eebd6e2200ca3569812fd0c4","observation_id":"e48c0a43-7e26-48da-9d2d-4c97cf3dd3fa","resolution":{"observed_at":"2026-05-16T23:46:30.078718Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-01T23:32:07.108143Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T11:17:24.406028Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2507.02259"},"observation_digest":"sha256:625d4d6980eaf823f66c292e25aabcb790b65a569d2f42ad48a98bc94e8abfec","observation_id":"ea12e6e0-b53f-4cc3-a8ce-11b12b42f102","resolution":{"observed_at":"2026-05-15T11:17:24.592535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-05T12:52:01.641529Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01221","last_updated":"2025-09-04T09:30:16Z","snapshot_observed_at":"2026-08-05T12:51:58.811588Z","submitted_at":"2025-09-01T08:06:49Z","title":"DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T12:52:01.641529Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2509.01221"},"observation_digest":"sha256:24cc917b518468c6625f4d170685861e40b662a8b21a6b52dcd608517cf19207","observation_id":"9c490a55-a641-41ed-979e-524003d7b96a","resolution":{"observed_at":"2026-08-05T12:52:01.641529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-04T10:36:37.392346Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.09801","last_updated":"2026-06-09T14:05:10Z","snapshot_observed_at":"2026-08-04T10:36:35.449181Z","submitted_at":"2025-10-10T19:04:28Z","title":"How can we assess human-agent interactions? Case studies in software agent design","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T10:36:37.392346Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2510.09801"},"observation_digest":"sha256:8b727eb356bb3ddeb32b90031d172a3651b847874e411f695a43bb7ae58722c3","observation_id":"cc7a1180-8b1d-4f7c-8378-d88f4f88a128","resolution":{"observed_at":"2026-08-04T10:36:37.392346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-04T08:28:49.536406Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.20535","last_updated":"2026-07-29T08:07:09Z","snapshot_observed_at":"2026-08-05T14:03:48.654042Z","submitted_at":"2025-10-23T13:20:57Z","title":"ARC-Encoder: learning compressed text representations for large language models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T08:28:49.536406Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2510.20535"},"observation_digest":"sha256:a60a1f34b7dbd9128c4e4220e63cd6b03144d560ed6704e33997d1c92fa52a57","observation_id":"9fd21ffa-571e-4863-abbb-a76960a04134","resolution":{"observed_at":"2026-08-04T08:28:49.536406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-04T08:06:11.078142Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.22963","last_updated":"2026-06-19T20:25:06Z","snapshot_observed_at":"2026-08-04T08:06:05.944327Z","submitted_at":"2025-10-27T03:37:41Z","title":"When Compression Becomes an Attack Surface: Black-Box Attacks on Prompt-Compressed LLM Agents","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T08:06:11.078142Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2510.22963"},"observation_digest":"sha256:3d1f501a5703f7d77d697dc84d7a97c28ee63e2ffda1477d025ad4df0af8d006","observation_id":"32c3b362-8b83-428a-a01d-689ab3ba003b","resolution":{"observed_at":"2026-08-04T08:06:11.078142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2602.08324","last_updated":"2026-05-25T15:41:17Z","snapshot_observed_at":"2026-08-03T03:25:21.079471Z","submitted_at":"2026-02-09T06:57:15Z","title":"Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T13:43:51.127429Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2602.08324"},"observation_digest":"sha256:b08cbe1c91ebff416c2f5ed19944d30d3893003a9db8518e84c99551f0fe43a7","observation_id":"1840f4d0-04f9-4b48-9270-0fabf218d965","resolution":{"observed_at":"2026-05-21T13:44:11.449562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-03T03:25:23.076743Z","title":"Llmlin- gua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08324","last_updated":"2026-05-25T15:41:17Z","snapshot_observed_at":"2026-08-03T03:25:21.079471Z","submitted_at":"2026-02-09T06:57:15Z","title":"Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T03:25:23.076743Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2602.08324"},"observation_digest":"sha256:32f3d43b644917471dc83e2d1ced851c9de7f13ff64069bfb472105e7f9ba113","observation_id":"33b6f1fa-13fa-4b47-9045-1a7d96d29872","resolution":{"observed_at":"2026-08-03T03:25:23.076743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2602.11574","last_updated":"2026-05-21T03:54:07Z","snapshot_observed_at":"2026-07-06T22:45:34.674215Z","submitted_at":"2026-02-12T04:45:44Z","title":"Learning to Configure Agentic AI Systems","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T13:06:56.207692Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2602.11574"},"observation_digest":"sha256:776bd6e34fd53b314b80d33de111d25f2472a1baab9b5d6a926a66d6fef7d10d","observation_id":"24041952-da97-4dc5-9b99-fdc3f1637114","resolution":{"observed_at":"2026-05-21T13:10:10.359193Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2602.11574","last_updated":"2026-05-21T03:54:07Z","snapshot_observed_at":"2026-07-06T22:45:34.674215Z","submitted_at":"2026-02-12T04:45:44Z","title":"Learning to Configure Agentic AI Systems","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T11:29:45.134060Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2602.11574"},"observation_digest":"sha256:9c149cffab96cf461289d88cce409a10fbb5be91fbba9d224439669364e6c953","observation_id":"10c5e7c7-b318-48a3-8ac3-99ae685b5df0","resolution":{"observed_at":"2026-05-22T11:31:29.533983Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.09607","last_updated":"2026-03-11T07:04:01Z","snapshot_observed_at":"2026-07-06T22:58:25.877654Z","submitted_at":"2026-03-11T07:04:01Z","title":"LLM-assisted Agentic Edge Intelligence Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T13:56:03.688192Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.09607"},"observation_digest":"sha256:91e940bb75f304ae5160ddbc67ee8ab7305597493aae0bda41e733b5c8adf7f5","observation_id":"b67fc6f0-ae67-4b8b-80ce-9d7915ae65f8","resolution":{"observed_at":"2026-05-15T14:00:03.440252Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.13725","last_updated":"2026-04-15T11:00:17Z","snapshot_observed_at":"2026-08-05T11:32:59.124748Z","submitted_at":"2026-04-15T11:00:17Z","title":"On the Effectiveness of Context Compression for Repository-Level Tasks: An Empirical Investigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T13:00:56.512868Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.13725"},"observation_digest":"sha256:bd43568967edf5d72c25beec8e160942149a407b16ce21863eae6999bd37c263","observation_id":"f698696a-d1b7-4447-b945-3c592ab986b2","resolution":{"observed_at":"2026-05-10T13:40:27.553422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.14156","last_updated":"2026-03-22T14:27:24Z","snapshot_observed_at":"2026-08-02T12:56:00.032907Z","submitted_at":"2026-03-22T14:27:24Z","title":"Compressed-Sensing-Guided, Inference-Aware Structured Reduction for Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T06:52:18.563146Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.14156"},"observation_digest":"sha256:a171006b765add9b57e1f5731a3c53b63432c22b7d491c87ae321acfbed129b9","observation_id":"3dc12810-508d-4da3-ab4e-f63eee353003","resolution":{"observed_at":"2026-05-15T06:55:10.698328Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.17512","last_updated":"2026-04-19T16:05:33Z","snapshot_observed_at":"2026-07-29T17:45:26.538909Z","submitted_at":"2026-04-19T16:05:33Z","title":"ONTO: A Token-Efficient Columnar Notation for LLM Input Optimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-10T05:21:56.826488Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.17512"},"observation_digest":"sha256:4ff5aef023421890716835085e8c4d94b2e84c1fe9d7af6241c51f8e50fadb0f","observation_id":"d77242a0-5e09-4624-adee-921596b1bbc4","resolution":{"observed_at":"2026-05-10T09:23:37.788133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.20727","last_updated":"2026-04-22T16:12:36Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T16:12:36Z","title":"Supplement Generation Training for Enhancing Agentic Task Performance","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-10T00:58:27.655909Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.20727"},"observation_digest":"sha256:7c363f1de3bcecd074266b9548ec6f5d7d74a7372c96b3cd625c4f5cde64128d","observation_id":"ff9c3f20-8131-48f6-a877-a1e59cafc4cf","resolution":{"observed_at":"2026-05-10T00:59:49.528114Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.21231","last_updated":"2026-05-04T22:59:12Z","snapshot_observed_at":"2026-07-06T23:07:51.979267Z","submitted_at":"2026-04-23T02:55:31Z","title":"SparKV: Overhead-Aware KV Cache Loading for Efficient On-Device LLM Inference","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T14:09:30.821354Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.21231"},"observation_digest":"sha256:ca4fb218dbd2c9704eb94c65929811afb3fabb7122fa63d9090ef1312b78fc84","observation_id":"075c5251-e277-4d6d-aeec-c40261aeb228","resolution":{"observed_at":"2026-05-11T18:46:07.779041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.26622","last_updated":"2026-04-29T12:49:30Z","snapshot_observed_at":"2026-07-06T23:12:15.279847Z","submitted_at":"2026-04-29T12:49:30Z","title":"OCR-Memory: Optical Context Retrieval for Long-Horizon Agent Memory","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-07T10:45:48.976501Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.26622"},"observation_digest":"sha256:6ad2f32e8d91a1108b20746ccb73a673200240ef0d6fecc753fa1bc6a3048aed","observation_id":"a234ca39-dfe8-4eb4-b367-d6070dd1cf0f","resolution":{"observed_at":"2026-05-12T09:31:25.537117Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.00336","last_updated":"2026-05-01T01:34:53Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T01:34:53Z","title":"Budget-Aware Routing for Long Clinical Text","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-09T19:59:00.888734Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.00336"},"observation_digest":"sha256:611f2c27ef2f4a94ca847dc4c2669b935acd67e911c7f2d2c78b135487d631d7","observation_id":"3726b935-c200-4b81-b842-0f3460351fb0","resolution":{"observed_at":"2026-05-11T15:26:10.192361Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.00505","last_updated":"2026-05-17T17:18:53Z","snapshot_observed_at":"2026-07-06T23:13:57.367556Z","submitted_at":"2026-05-01T08:30:52Z","title":"LLM-Oriented Information Retrieval: A Denoising-First Perspective","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-09T18:54:06.144968Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.00505"},"observation_digest":"sha256:129e1c0c40e6533bfe041dfdba81f7fcf9c50b06abdd0b00565aaaf6738fcb2a","observation_id":"adc10e6b-b90c-4c19-b7d5-189f57fa8d6b","resolution":{"observed_at":"2026-05-11T16:01:19.749858Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.00505","last_updated":"2026-05-17T17:18:53Z","snapshot_observed_at":"2026-07-06T23:13:57.367556Z","submitted_at":"2026-05-01T08:30:52Z","title":"LLM-Oriented Information Retrieval: A Denoising-First Perspective","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-21T00:18:32.423103Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.00505"},"observation_digest":"sha256:6c2133a9705caa3e8e179826be8d5d9903086340ba6251eeb0894c83f79b3627","observation_id":"c2fec4e9-8772-4d5f-9473-5a56d9782452","resolution":{"observed_at":"2026-05-21T00:19:16.570350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.09611","last_updated":"2026-05-10T15:48:38Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T15:48:38Z","title":"Byte-Exact Deduplication in Retrieval-Augmented Generation: A Three-Regime Empirical Analysis Across Public Benchmarks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T04:18:11.836537Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.09611"},"observation_digest":"sha256:531167fb052a4573a55b72d4198598a6c3d9f666e9d3add8c5cdfd97a95af5a6","observation_id":"570d6085-1061-43d9-ba01-bf90ae8330e2","resolution":{"observed_at":"2026-05-12T06:26:24.196333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.24279","last_updated":"2026-05-22T23:13:21Z","snapshot_observed_at":"2026-07-31T10:30:03.841807Z","submitted_at":"2026-05-22T23:13:21Z","title":"ContextEcho: A Benchmark for Persona Drift in Long Agentic-Coding Sessions","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T15:17:37.904831Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.24279"},"observation_digest":"sha256:5862e367833571bb1b79dd0c82f67e9c5af6bef0a1107d6b0d7d20e24ed9aa00","observation_id":"0ce26496-205a-4f76-9f79-39760693bd75","resolution":{"observed_at":"2026-06-30T15:34:48.513036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.26165","last_updated":"2026-05-24T20:52:54Z","snapshot_observed_at":"2026-08-02T00:37:55.747392Z","submitted_at":"2026-05-24T20:52:54Z","title":"Tool-Schema Compression Enables Agentic RAG Under Constrained Context Budgets","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-29T23:23:49.298204Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.26165"},"observation_digest":"sha256:70ecc01197184fb70306aae3af893ab18db4d5e6f8bab97a71aea4ac0d421b6a","observation_id":"7f1a60ae-bca1-40cc-b45f-89d97c3143b8","resolution":{"observed_at":"2026-06-29T23:24:01.270362Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.03979","last_updated":"2026-07-10T17:52:03Z","snapshot_observed_at":"2026-07-15T23:18:25.559225Z","submitted_at":"2026-06-02T17:56:55Z","title":"Language Models Need Sleep: Learning to Self-Modify and Consolidate Memories","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T10:56:13.058872Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.03979"},"observation_digest":"sha256:d39d34c11d95bcae61cd9fac805e7541a1eee8a32bef0374d5fac9eb89b8e180","observation_id":"94c48765-afd0-491c-8695-d7eb7ac9dc0e","resolution":{"observed_at":"2026-07-02T02:26:26.695917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-13T07:44:25.325808Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03979","last_updated":"2026-07-10T17:52:03Z","snapshot_observed_at":"2026-07-15T23:18:25.559225Z","submitted_at":"2026-06-02T17:56:55Z","title":"Language Models Need Sleep: Learning to Self-Modify and Consolidate Memories","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-13T07:44:25.325808Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.03979"},"observation_digest":"sha256:ac639214feb457b2e05c2f062b1b49e7f0c2f9ff900443f7a7fd1b72174f87e9","observation_id":"53d80952-6f94-4501-b0fa-8058eeabff75","resolution":{"observed_at":"2026-07-13T07:44:25.325808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.05875","last_updated":"2026-06-04T08:47:46Z","snapshot_observed_at":"2026-07-06T23:45:47.161248Z","submitted_at":"2026-06-04T08:47:46Z","title":"QCFuse: Query-Aware Cache Fusion via Compressed View for Efficient RAG Serving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T01:47:43.240850Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.05875"},"observation_digest":"sha256:4e814b9ce9bb4270b2f7453eab5808d6a6f94dfd804078ef5aa1329eb62accc0","observation_id":"ddddc700-5c17-4948-8aa4-b4d4e80ec9e8","resolution":{"observed_at":"2026-07-02T12:46:57.478212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.08151","last_updated":"2026-06-06T13:02:28Z","snapshot_observed_at":"2026-07-06T23:47:43.942733Z","submitted_at":"2026-06-06T13:02:28Z","title":"Decision-Aware Memory Cards: Counterfactual-Inspired Context Selection and Compression for Tool-Using LLM Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T19:47:08.844690Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.08151"},"observation_digest":"sha256:c8d66bb0498db939b3781960ec1dc44eb00d66e1aa02e85bfae86718d854d422","observation_id":"2736a578-a94a-418a-9eeb-13cec35d42d4","resolution":{"observed_at":"2026-07-02T21:17:25.260446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.09659","last_updated":"2026-06-08T15:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-08T15:43:16Z","title":"End-to-End Context Compression at Scale","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T16:36:54.699174Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.09659"},"observation_digest":"sha256:1e88741a9a825e613706a70e627c6d44d8269607378c83b7ffd39a6466789c7d","observation_id":"ca86e023-c913-4143-8476-247483c077a5","resolution":{"observed_at":"2026-07-03T01:17:31.616571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.10209","last_updated":"2026-06-08T22:01:28Z","snapshot_observed_at":"2026-07-06T23:49:27.565372Z","submitted_at":"2026-06-08T22:01:28Z","title":"Less Context, Better Agents: Efficient Context Engineering for Long-Horizon Tool-Using LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T16:10:25.191306Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.10209"},"observation_digest":"sha256:a52d70fd732ff45ddce010c86cfd154281be0d91027eaa076e2f39963c7412df","observation_id":"38dda257-2d76-4c89-a68f-c7290b5a80a0","resolution":{"observed_at":"2026-07-03T02:07:33.619433Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.19613","last_updated":"2026-06-17T21:36:09Z","snapshot_observed_at":"2026-07-06T23:54:51.451358Z","submitted_at":"2026-06-17T21:36:09Z","title":"StaminaBench: Stress-Testing Coding Agents over 100 Interaction Turns","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T19:47:59.090249Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.19613"},"observation_digest":"sha256:7f4b773c4dc786af943acf4ec71f207c659d8b8fab27a82bec3c2770d3b2910b","observation_id":"4555f900-c28b-4ff1-b6fd-9311a2aa28a7","resolution":{"observed_at":"2026-07-04T02:19:23.905129Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.20295","last_updated":"2026-07-24T07:54:17Z","snapshot_observed_at":"2026-08-02T10:48:55.986116Z","submitted_at":"2026-06-18T14:33:09Z","title":"Token-Operations-Oriented Inference Optimization Techniques for Large Models","version":1},"reference_index":130,"source":"pdf_text","source_observed_at":"2026-06-26T16:15:22.543601Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.20295"},"observation_digest":"sha256:f758f6dc24fbaa0f08e657758cceafcba1b5cb775b2312ae1792e71b36675226","observation_id":"e1434e72-7500-43ac-98d2-1752019b4273","resolution":{"observed_at":"2026-07-04T05:09:36.936832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-02T10:49:13.256103Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.20295","last_updated":"2026-07-24T07:54:17Z","snapshot_observed_at":"2026-08-02T10:48:55.986116Z","submitted_at":"2026-06-18T14:33:09Z","title":"Token-Operations-Oriented Inference Optimization Techniques for Large Models","version":2},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-02T10:49:13.256103Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.20295"},"observation_digest":"sha256:6d62861f5e4c48c58022881bb289ffdd1bf27509b59b1b0c146767c97bcd390e","observation_id":"a3c17276-531a-447f-b190-2fb8246f4ece","resolution":{"observed_at":"2026-08-02T10:49:13.256103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.28349","last_updated":"2026-06-03T07:15:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-03T07:15:11Z","title":"HMARS: A Hierarchical Multi-Agent Memory System for Long-Context Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-30T11:30:52.871762Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.28349"},"observation_digest":"sha256:8de2ee0171d2717c4ebf801a6e42590ba1cb60d02e30f25f0ffcf1e6cd1e28e8","observation_id":"06e93a9e-23a9-4284-a100-c4a53829084e","resolution":{"observed_at":"2026-06-30T11:34:37.884491Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2607.01241","last_updated":"2026-05-04T01:41:31Z","snapshot_observed_at":"2026-07-07T00:06:49.412663Z","submitted_at":"2026-05-04T01:41:31Z","title":"Mapping Text to Multiplex Graph: Prompt Compression as L\\'evy Walk-Guided Graph Pruning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-04T01:45:36.335508Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.01241"},"observation_digest":"sha256:fdfd09fab8ebc2fa1da54eb1cafa67b0ad124644b84c933863296189a82fbcc1","observation_id":"4404e395-a8a2-428c-8e87-7a2eed6babba","resolution":{"observed_at":"2026-07-04T01:49:21.550972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2607.01916","last_updated":"2026-07-09T01:58:28Z","snapshot_observed_at":"2026-07-12T23:17:37.670248Z","submitted_at":"2026-07-02T09:15:28Z","title":"ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-03T14:09:32.980488Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.01916"},"observation_digest":"sha256:17d3eaad6488ca771343a62e04cf2116495ad429dfef78c2bd7f54a22c28b822","observation_id":"b4d2f544-20d4-495b-ae9b-7a7cbd752945","resolution":{"observed_at":"2026-07-03T14:18:22.569952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-12T08:32:14.868469Z","title":"LLMLingua: Compressing prompts for accelerated inference of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.01916","last_updated":"2026-07-09T01:58:28Z","snapshot_observed_at":"2026-07-12T23:17:37.670248Z","submitted_at":"2026-07-02T09:15:28Z","title":"ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T08:32:14.868469Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.01916"},"observation_digest":"sha256:48b6366e241c98d231c862a8bf077dc17471c7657b6ebb7cf7c632ef131bf801","observation_id":"d4c13e6d-a18b-4ed4-bcea-7c1ee9e55a06","resolution":{"observed_at":"2026-07-12T08:32:14.868469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-12T05:14:41.315225Z","title":"In: Proceedings of 15 EMNLP (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03048","last_updated":"2026-07-03T07:37:57Z","snapshot_observed_at":"2026-08-03T07:15:27.897135Z","submitted_at":"2026-07-03T07:37:57Z","title":"Compression, structure, and executor capability: a controlled real-cost decomposition of language-model agent skill optimisation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T05:14:41.315225Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.03048"},"observation_digest":"sha256:2da6f73400652a226fb6b7228a6e1cd8d16a19a3c07c9e060b19be0d1c7912e0","observation_id":"051587d5-d924-4796-a7b1-950773355e3a","resolution":{"observed_at":"2026-07-12T05:14:41.315225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:7310634cb6aa718d338c9d31676bc0ec6984414ec68e9e8f4d0c8e0b030fd544","observation_id":"c0bd2724-36b3-4170-98b8-ba9ce4697d40","resolution":{"observed_at":"2026-07-10T01:36:44.323273Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-13T03:29:34.486347Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09375","last_updated":"2026-07-10T12:57:08Z","snapshot_observed_at":"2026-07-15T23:18:12.873790Z","submitted_at":"2026-07-10T12:57:08Z","title":"Mach-Mind-4-Flash Technical Report","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T03:29:34.486347Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.09375"},"observation_digest":"sha256:2b2211853228367fdf8110ba4430f641b4292ce6fd1585931810b3f9461a0a2a","observation_id":"410403c7-29ae-4e64-a6a4-897774022f78","resolution":{"observed_at":"2026-07-13T03:29:34.486347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-14T17:40:33.397259Z","title":"LLMLingua: Com- pressing prompts for accelerated inference of large language models.Conference on Empirical Methods in Natural Language Processing (EMNLP), 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09691","last_updated":"2026-06-19T04:22:17Z","snapshot_observed_at":"2026-08-02T08:00:32.159848Z","submitted_at":"2026-06-19T04:22:17Z","title":"What Context Does a Coding Agent Actually Need to Act?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T17:40:33.397259Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.09691"},"observation_digest":"sha256:9411ca0ba4a28399e0b1150d4aeb296327d8ca89a2d8913922217bcb9ffa5ce2","observation_id":"3a5f3d21-5cf8-4a9d-800c-d8a8c972387b","resolution":{"observed_at":"2026-07-14T17:40:33.397259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-01T23:14:54.635607Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15516","last_updated":"2026-07-17T00:03:47Z","snapshot_observed_at":"2026-08-05T09:06:36.941854Z","submitted_at":"2026-07-17T00:03:47Z","title":"Cache-Aware Prompt Compression:A Two-Tier Cost Model for LLM API Caching","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T23:14:54.635607Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.15516"},"observation_digest":"sha256:00f8ab15fa1ad1e3c63d1949f48d790157c1eabaa326b801de6d49d1fca9e0c6","observation_id":"fd748da0-4d6e-40ff-9f9d-b36300ca1cc9","resolution":{"observed_at":"2026-08-01T23:14:54.635607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-02T14:32:14.315923Z","title":"LLMLingua: Com- pressing prompts for accelerated inference of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16209","last_updated":"2026-05-10T13:27:01Z","snapshot_observed_at":"2026-08-04T15:59:45.794846Z","submitted_at":"2026-05-10T13:27:01Z","title":"Shapley Context Pruning: A Cooperative Game Perspective for Context Reranking and Pruning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T14:32:14.315923Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.16209"},"observation_digest":"sha256:cb8af6c8d60f626dea329a9a67e22b1ce3d16d196d80b964055f22ae6888c643","observation_id":"0a17e1cd-b03b-4492-a933-1c39358fb63b","resolution":{"observed_at":"2026-08-02T14:32:14.315923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-01T20:54:09.109669Z","title":"arXiv preprint arXiv:2310.05736 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16528","last_updated":"2026-07-17T22:09:01Z","snapshot_observed_at":"2026-08-02T22:17:46.769520Z","submitted_at":"2026-07-17T22:09:01Z","title":"Hierarchical Domain Generalization","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T20:54:09.109669Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.16528"},"observation_digest":"sha256:0892b7567bf0aba16390d7448480057c3575711990b5ada944b46f232cc0a58d","observation_id":"e27cbc51-3fc1-4a48-905d-fe59b0e9ded6","resolution":{"observed_at":"2026-08-01T20:54:09.109669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-02T11:37:06.990703Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19368","last_updated":"2026-06-12T01:11:17Z","snapshot_observed_at":"2026-08-02T16:44:28.630046Z","submitted_at":"2026-06-12T01:11:17Z","title":"Spectral-LSH: Sub-Quadratic Prompt Compression via Krylov-Projected Locality-Sensitive Hashing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T11:37:06.990703Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.19368"},"observation_digest":"sha256:e52780c5e44943e67f70d5a46141053daeb5f6e83d5e78773a94ec4b61ddf848","observation_id":"b0406970-d688-4c57-a030-8dbe36cf166a","resolution":{"observed_at":"2026-08-02T11:37:06.990703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.05736/citation-record","integrity":"/paper/2310.05736/integrity","json":"/paper/2310.05736/citation-record.json","paper":"/paper/2310.05736"},"outbound":[],"paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 48 inbound Pith citation observations for arXiv:2310.05736."}