{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2023:TDQ5R44R4WMYOQG2FXKP6TTSC4","short_pith_number":"pith:TDQ5R44R","schema_version":"1.0","canonical_sha256":"98e1d8f391e5998740da2dd4ff4e72170cdeb5ea75bb61dfbc301687887e6fbd","source":{"kind":"arxiv","id":"2307.06945","version":4},"attestation_state":"computed","paper":{"title":"In-context Autoencoder for Context Compression in a Large Language Model","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.AI","cs.LG"],"primary_cat":"cs.CL","authors_text":"Furu Wei, Jing Hu, Lei Wang, Si-Qing Chen, Tao Ge, Xun Wang","submitted_at":"2023-07-13T17:59:21Z","abstract_excerpt":"We propose the In-context Autoencoder (ICAE), leveraging the power of a large language model (LLM) to compress a long context into short compact memory slots that can be directly conditioned on by the LLM for various purposes. ICAE is first pretrained using both autoencoding and language modeling objectives on massive text data, enabling it to generate memory slots that accurately and comprehensively represent the original context. Then, it is fine-tuned on instruction data for producing desirable responses to various prompts. Experiments demonstrate that our lightweight ICAE, introducing abou"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2307.06945","kind":"arxiv","version":4},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CL","submitted_at":"2023-07-13T17:59:21Z","cross_cats_sorted":["cs.AI","cs.LG"],"title_canon_sha256":"65fca3f2a85e70ee020a0e7de979ff1629c131946cb258fa12884440910a5ed7","abstract_canon_sha256":"cbcf79cabbcd7e466362bad98019002755da376980b7243b85be239a88680f91"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T08:17:10.032226Z","signature_b64":"BzFdctCCW8BkGRk3jgzn9RGquP/UyBKkX7LtLVRXRvm7ZX1akDSObvu5SR6ZVcr7Yk1Bb5Rz8CuGQuODE4vBCw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"98e1d8f391e5998740da2dd4ff4e72170cdeb5ea75bb61dfbc301687887e6fbd","last_reissued_at":"2026-07-05T08:17:10.031759Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T08:17:10.031759Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"In-context Autoencoder for Context Compression in a Large Language Model","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.AI","cs.LG"],"primary_cat":"cs.CL","authors_text":"Furu Wei, Jing Hu, Lei Wang, Si-Qing Chen, Tao Ge, Xun Wang","submitted_at":"2023-07-13T17:59:21Z","abstract_excerpt":"We propose the In-context Autoencoder (ICAE), leveraging the power of a large language model (LLM) to compress a long context into short compact memory slots that can be directly conditioned on by the LLM for various purposes. ICAE is first pretrained using both autoencoding and language modeling objectives on massive text data, enabling it to generate memory slots that accurately and comprehensively represent the original context. Then, it is fine-tuned on instruction data for producing desirable responses to various prompts. Experiments demonstrate that our lightweight ICAE, introducing abou"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2307.06945","kind":"arxiv","version":4},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2307.06945/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2307.06945","created_at":"2026-07-05T08:17:10.031816+00:00"},{"alias_kind":"arxiv_version","alias_value":"2307.06945v4","created_at":"2026-07-05T08:17:10.031816+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2307.06945","created_at":"2026-07-05T08:17:10.031816+00:00"},{"alias_kind":"pith_short_12","alias_value":"TDQ5R44R4WMY","created_at":"2026-07-05T08:17:10.031816+00:00"},{"alias_kind":"pith_short_16","alias_value":"TDQ5R44R4WMYOQG2","created_at":"2026-07-05T08:17:10.031816+00:00"},{"alias_kind":"pith_short_8","alias_value":"TDQ5R44R","created_at":"2026-07-05T08:17:10.031816+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":32,"internal_anchor_count":3,"sample":[{"citing_arxiv_id":"2607.08180","citing_title":"Out of Sight: Compression-Aware Content Protection against Agentic Crawlers","ref_index":20,"is_internal_anchor":true},{"citing_arxiv_id":"2607.08399","citing_title":"Prompt Compression via Activation Aggregation","ref_index":17,"is_internal_anchor":true},{"citing_arxiv_id":"2607.08032","citing_title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","ref_index":42,"is_internal_anchor":true},{"citing_arxiv_id":"2606.24320","citing_title":"ZONOS2 Technical Report","ref_index":164,"is_internal_anchor":false},{"citing_arxiv_id":"2606.20295","citing_title":"Token-Operations-Oriented Inference Optimization Techniques for Large Models","ref_index":129,"is_internal_anchor":false},{"citing_arxiv_id":"2606.13316","citing_title":"ReSum: Synergizing LLM Reasoning and Summarization with Reinforcement Learning","ref_index":17,"is_internal_anchor":false},{"citing_arxiv_id":"2606.11853","citing_title":"Task-Aware Structured Memory for Dynamic Multi-modal In-Context Learning","ref_index":208,"is_internal_anchor":false},{"citing_arxiv_id":"2606.09659","citing_title":"End-to-End Context Compression at Scale","ref_index":27,"is_internal_anchor":false},{"citing_arxiv_id":"2606.08184","citing_title":"TextEconomizer: Enhancing Lossy Text Compression with Denoising Transformers and Entropy Coding","ref_index":21,"is_internal_anchor":false},{"citing_arxiv_id":"2606.03979","citing_title":"Language Models Need Sleep: Learning to Self-Modify and Consolidate Memories","ref_index":54,"is_internal_anchor":false},{"citing_arxiv_id":"2606.24320","citing_title":"ZONOS2 Technical Report","ref_index":164,"is_internal_anchor":false},{"citing_arxiv_id":"2605.23071","citing_title":"The Efficiency Frontier: A Unified Framework for Cost-Performance Optimization in LLM Context Management","ref_index":28,"is_internal_anchor":false},{"citing_arxiv_id":"2606.28349","citing_title":"HMARS: A Hierarchical Multi-Agent Memory System for Long-Context Reasoning","ref_index":30,"is_internal_anchor":false},{"citing_arxiv_id":"2605.26099","citing_title":"Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference","ref_index":23,"is_internal_anchor":false},{"citing_arxiv_id":"2605.26596","citing_title":"AGORA: Adapter-Grounded Observation-Action Retention for Inference-Free Prompt Compression in LLM Agents","ref_index":7,"is_internal_anchor":false},{"citing_arxiv_id":"2605.28713","citing_title":"Thinking as Compression: Your Reasoning Model is Secretly a Context Compressor","ref_index":7,"is_internal_anchor":false},{"citing_arxiv_id":"2605.23071","citing_title":"The Efficiency Frontier: A Unified Framework for Cost-Performance Optimization in LLM Context Management","ref_index":28,"is_internal_anchor":false},{"citing_arxiv_id":"2409.01579","citing_title":"AdaComp: Extractive Context Compression with Adaptive Predictor for Retrieval-Augmented Large Language Models","ref_index":6,"is_internal_anchor":false},{"citing_arxiv_id":"2409.06679","citing_title":"E2LLM: Encoder Elongated Large Language Models for Long-Context Understanding and Reasoning","ref_index":28,"is_internal_anchor":false},{"citing_arxiv_id":"2404.07143","citing_title":"Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2605.18226","citing_title":"Context Memorization for Efficient Long Context Generation","ref_index":13,"is_internal_anchor":false},{"citing_arxiv_id":"2309.10668","citing_title":"Language Modeling Is Compression","ref_index":7,"is_internal_anchor":false},{"citing_arxiv_id":"2412.13171","citing_title":"Compressed Chain of Thought: Efficient Reasoning Through Dense Representations","ref_index":5,"is_internal_anchor":false},{"citing_arxiv_id":"2602.09789","citing_title":"When Less is More: The LLM Scaling Paradox in Context Compression","ref_index":3,"is_internal_anchor":false},{"citing_arxiv_id":"2603.04759","citing_title":"Stacked from One: Multi-Scale Self-Injection for Context Window Extension","ref_index":12,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/TDQ5R44R4WMYOQG2FXKP6TTSC4","json":"https://pith.science/pith/TDQ5R44R4WMYOQG2FXKP6TTSC4.json","graph_json":"https://pith.science/api/pith-number/TDQ5R44R4WMYOQG2FXKP6TTSC4/graph.json","events_json":"https://pith.science/api/pith-number/TDQ5R44R4WMYOQG2FXKP6TTSC4/events.json","paper":"https://pith.science/paper/TDQ5R44R"},"agent_actions":{"view_html":"https://pith.science/pith/TDQ5R44R4WMYOQG2FXKP6TTSC4","download_json":"https://pith.science/pith/TDQ5R44R4WMYOQG2FXKP6TTSC4.json","view_paper":"https://pith.science/paper/TDQ5R44R","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2307.06945&json=true","fetch_graph":"https://pith.science/api/pith-number/TDQ5R44R4WMYOQG2FXKP6TTSC4/graph.json","fetch_events":"https://pith.science/api/pith-number/TDQ5R44R4WMYOQG2FXKP6TTSC4/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/TDQ5R44R4WMYOQG2FXKP6TTSC4/action/timestamp_anchor","attest_storage":"https://pith.science/pith/TDQ5R44R4WMYOQG2FXKP6TTSC4/action/storage_attestation","attest_author":"https://pith.science/pith/TDQ5R44R4WMYOQG2FXKP6TTSC4/action/author_attestation","sign_citation":"https://pith.science/pith/TDQ5R44R4WMYOQG2FXKP6TTSC4/action/citation_signature","submit_replication":"https://pith.science/pith/TDQ5R44R4WMYOQG2FXKP6TTSC4/action/replication_record"}},"created_at":"2026-07-05T08:17:10.031816+00:00","updated_at":"2026-07-05T08:17:10.031816+00:00"}