{"as_of":"2026-08-05T10:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a69fad65e743142d83526db5f0fec7be8a16c86d070ae8ae9e438f9fc279c85","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T00:54:15.090677Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T23:13:34.852488Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T09:11:27.612828Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"cited_work":{"arxiv_id":"2603.25340","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.25340","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"df7798b5-bfa6-4ee2-ade0-663b19127ca4","year":2026},"citing_paper":{"arxiv_id":"2604.20311","last_updated":"2026-04-23T11:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T08:11:06Z","title":"Seeing Further and Wider: Joint Spatio-Temporal Enlargement for Micro-Video Popularity Prediction","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-09T23:13:34.852488Z"},"links":{"cited_paper":"/paper/2603.25340","citing_paper":"/paper/2604.20311"},"observation_digest":"sha256:63b11af4bc159daf3dce981ad7b71a54320e0ee5ce03106d1d57f931f06e67e6","observation_id":"cc6ed436-3244-450a-b9f5-82d88bc2bebf","resolution":{"observed_at":"2026-05-14T01:55:25.088077Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"cited_work":{"arxiv_id":"2603.25340","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.25340","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"df7798b5-bfa6-4ee2-ade0-663b19127ca4","year":2026},"citing_paper":{"arxiv_id":"2604.25614","last_updated":"2026-04-28T13:23:29Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T13:23:29Z","title":"HotComment: A Benchmark for Evaluating Popularity of Online Comments","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-07T16:08:51.838574Z"},"links":{"cited_paper":"/paper/2603.25340","citing_paper":"/paper/2604.25614"},"observation_digest":"sha256:5b1e152fff6ce43be8e2c96ddb6ca267c7509ea0044c5317c66537daef8e86f4","observation_id":"636041bb-3b8e-475e-9f22-76b574fa0b99","resolution":{"observed_at":"2026-05-14T01:55:25.088077Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"cited_work":{"arxiv_id":"2603.25340","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.25340","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"df7798b5-bfa6-4ee2-ade0-663b19127ca4","year":2026},"citing_paper":{"arxiv_id":"2604.26252","last_updated":"2026-04-29T03:14:42Z","snapshot_observed_at":"2026-08-02T09:37:59.075117Z","submitted_at":"2026-04-29T03:14:42Z","title":"OmniTrend: Content-Context Modeling for Scalable Social Popularity Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T14:00:15.854344Z"},"links":{"cited_paper":"/paper/2603.25340","citing_paper":"/paper/2604.26252"},"observation_digest":"sha256:98702979fce99f8993fb4a14c1da77744bd8cf7cd98599a7bf320e8c35ca4df9","observation_id":"c9aa32b0-57fc-421f-bd28-5fbd3faa43d9","resolution":{"observed_at":"2026-05-14T01:55:25.088077Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"cited_work":{"arxiv_id":"2603.25340","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.25340","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"df7798b5-bfa6-4ee2-ade0-663b19127ca4","year":2026},"citing_paper":{"arxiv_id":"2604.26707","last_updated":"2026-04-29T14:15:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:15:45Z","title":"CurEvo: Curriculum-Guided Self-Evolution for Video Understanding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-07T11:52:26.828633Z"},"links":{"cited_paper":"/paper/2603.25340","citing_paper":"/paper/2604.26707"},"observation_digest":"sha256:44eb9316a9419f1695a6ed9d6f443360b852961f83969bbcde4326f8e405f578","observation_id":"4c94b710-44ba-4448-942c-8c3f104d4df8","resolution":{"observed_at":"2026-05-14T01:55:25.088077Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.25340/citation-record","integrity":"/paper/2603.25340/integrity","json":"/paper/2603.25340/citation-record.json","paper":"/paper/2603.25340"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Peters, and Arman Cohan","venue":null,"work_id":"477d1550-5247-4659-85a2-1cc846c63115","year":2020},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:fbc708e9b3041dab5f1e3f5376e923882cc15674431828e2b2ca3a697c447080","observation_id":"c58c298d-0eeb-4f9e-aee3-0770823cf5aa","resolution":{"observed_at":"2026-05-15T10:40:28.767006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Token merging: Your vit but faster","venue":null,"work_id":"790954c9-35d8-4397-92ae-24d94c563cc4","year":2023},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:5962f81c620ff4ec757375ab333bf2ff03954120ee3c4e1af7bb5b096c4b5a35","observation_id":"519cbe9a-a0c6-4363-b0e4-f8bb775896cc","resolution":{"observed_at":"2026-05-15T10:40:28.814584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hudson, Ehsan Adeli, et al","venue":null,"work_id":"10e2738f-b505-4455-824c-58c06c17d125","year":2022},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:2fff2e961c3edf4e0b2e66cde2ccd03f38a1fcf6ffedcc23edd3d45c647908ec","observation_id":"bfa214ae-2d9b-4cea-a46f-0dbcc9fe8574","resolution":{"observed_at":"2026-05-15T10:40:28.771607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"817f656c-a9d7-4ab2-a333-8160212f136f","year":2020},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:b087bc4bb7a6b5cfc9df2244f0a08dab369e48810bb8d0dacec26e5ff3b49c09","observation_id":"16419067-246a-456a-a20a-bdd122a7e869","resolution":{"observed_at":"2026-05-15T10:40:28.822922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adapting language models to compress con- texts","venue":null,"work_id":"b022c61c-4cd4-40d2-b589-dbb244102410","year":2023},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:db27c2d505c2e8d1ac3fbd2f06b77c4fbba4b685f424d54fee2596e3a3ea98b5","observation_id":"935e5fc8-06f5-4ab2-9c74-4bb6f67cad9e","resolution":{"observed_at":"2026-05-15T10:40:28.779467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generating long sequences with sparse transformers","venue":null,"work_id":"4b266c85-d11a-434e-850b-aee13ee1012f","year":2019},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:c95600538d4d127c10c17f132ad89fa61dd74461ed1033d3426ecafb8f5f3dde","observation_id":"11a7ec4a-81f9-4f05-992d-ee4d78548830","resolution":{"observed_at":"2026-05-15T10:40:28.799282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5ad20211-7f7c-44c8-9c6a-048535df8126","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:1328065c4f056039370e1a279b07d183a131716209ee2d4d3bfa4517165a5a0b","observation_id":"8c89e5b0-8fbc-46ae-8b29-fd52afc4bfff","resolution":{"observed_at":"2026-05-15T10:40:28.806783Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smith, and Matt Gardner","venue":null,"work_id":"a7907dfa-66db-40d1-9c64-5bb5e0a19f04","year":2021},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:d9f2144a512e120bc9c913ca8ffe364c85e0cc29de21678157505facd9e03daa","observation_id":"7693bf6f-9a95-4761-aa7b-07cca46c774a","resolution":{"observed_at":"2026-05-15T10:40:28.826250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language mod- eling is compression","venue":null,"work_id":"81f2f823-b664-4534-a501-1d22c0677618","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:2589fd5141833c37f414332d37fc774aab391a66fcef3e4498ff0066060659c2","observation_id":"26d1968f-c0ee-46c2-ba5a-1fc6f942f781","resolution":{"observed_at":"2026-05-15T10:40:28.785443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maskllm: Learnable semi-structured sparsity for large language models","venue":null,"work_id":"2ef63655-9f02-4770-a196-cb3044dc7903","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:b7667dba5bb0aae78bd42a94cbff20dc4987fa1438308bf50bb700e68908bdef","observation_id":"b61960ad-c0b2-4d39-a545-e88b7ad51e2b","resolution":{"observed_at":"2026-05-15T10:40:28.795823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Switch transformers: Scaling to trillion parameter models with sim- ple and efficient sparsity","venue":null,"work_id":"bb9c91bf-dea2-4c51-b372-f98c7ce7e117","year":2022},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:46d7a93b4bd817af60e240be7681c5ad2e7652713a524bf3cbc3e539fcbf6ac7","observation_id":"38228a98-ceff-4e67-9efa-f4aebb8eea75","resolution":{"observed_at":"2026-05-15T10:40:28.746918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In-context autoencoder for context compression in a large language model","venue":null,"work_id":"12dca8b1-c3d4-47d2-9f55-b5dc34f2692c","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:26123ba70e961afa6ab29dbed999cfad8cc742cdbe166f70bf617f680e6e6c3a","observation_id":"08998853-b437-42b4-8521-b241202ea5f1","resolution":{"observed_at":"2026-05-15T10:40:28.841141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen- Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"6ba2b406-3607-4767-91c6-5899706fdd92","year":2021},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:d450b3776683f67d635fe1af90f150bcd12ee8ba491b11420e09780c68bf69ea","observation_id":"226cf730-57f5-4134-8cbd-db12b9b027c1","resolution":{"observed_at":"2026-05-15T10:40:28.776432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Longllmlingua: Accelerating and enhancing llms in long context scenarios via prompt compression","venue":null,"work_id":"6d2cf46d-7db0-4c5d-a680-47c219ee4e88","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:8ac7062e8cb0a196cac888d8b780bf33c4e1294fa636072c76d9a1b4a6786d06","observation_id":"86009044-f55c-40c9-8e82-706c6f04eb49","resolution":{"observed_at":"2026-05-15T10:40:28.764325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Discrete latent variable representations for low- resource text classification","venue":null,"work_id":"ad666ff9-dfc8-46bd-a52e-9ffc033d43ac","year":2020},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:40759d9fddf86475cfd73302eb4eb0e44582504eeea29c2381aa290b4a9aa25c","observation_id":"6dfeb115-ca7e-4c18-a51e-190811cc8607","resolution":{"observed_at":"2026-05-15T10:40:28.760990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learned token pruning for transformers","venue":null,"work_id":"f4847258-e40c-41af-b7b2-e0b55f39cf12","year":2022},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:16e87b8d7f05327737526a1f57a681763c5b9af87ee271b477bffb685b145c5e","observation_id":"c84b6f5d-3c90-4284-b5a3-80e1957ae727","resolution":{"observed_at":"2026-05-15T10:40:28.788569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Re- former: The efficient transformer","venue":null,"work_id":"7095406f-6983-43ed-a4bd-ed119b137f9e","year":2020},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:556a454be6efa068e067f80ead32fbb0c0f90016f187c26e6c25905c560c7143","observation_id":"1c74c70c-b548-4fb9-8c07-66a8156b0dd4","resolution":{"observed_at":"2026-05-15T10:40:28.774002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The narrativeqa reading comprehension chal- lenge","venue":null,"work_id":"8907e16f-a23b-489d-8883-257fb07e2fb5","year":2017},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:5e92503cfab8178e0c533bd8b8e50b1a13d307c13caa8b1f3afe2ea903454917","observation_id":"7c3b7b7d-8822-467c-bdfb-15f61b1b0175","resolution":{"observed_at":"2026-05-15T10:40:28.844366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compact: Common-token optimized model pruning across channels and tokens","venue":null,"work_id":"9cd4ed3d-ca90-4e65-b9be-318ac11b8b77","year":2025},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:dac2ae1ece2fd9251d439fb96114408c33bee6945d54035fea72bb52ef89c3f6","observation_id":"3344a454-02a5-4efd-a7d6-01f5d8d427de","resolution":{"observed_at":"2026-05-15T10:40:28.757519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compressing context to enhance inference efficiency of large language models","venue":null,"work_id":"0572d55d-9606-4a5d-9bce-b974019c514c","year":2023},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:f9994f26d3e5176e9829cf911dce37738a6381389ad0d0880db856df219d514f","observation_id":"2f03c1b8-13ca-4a30-889f-522f041ab7d0","resolution":{"observed_at":"2026-05-15T10:40:28.847589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"500xcompressor: Generalized prompt compression for large language models","venue":null,"work_id":"7d4c7ee6-4da8-4c22-b627-d47d4ca48769","year":null},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:59033771456f19c34840a746982b2de8fcdf800b0e77c600ca08bc7e2f8837d2","observation_id":"a31d3c4f-fef6-4272-a325-1187ae0eabdd","resolution":{"observed_at":"2026-05-15T10:40:28.753990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liu, SouYoung Jin, Cheng-I Jeff Lai, Andrew Rouditchenko, Aude Oliva, and James Glass","venue":null,"work_id":"cc720fdc-75e0-41d9-8e2d-c8db13af54a0","year":2021},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:5ccc579574f02049ca93f7b07166902c79aa0968957b96eeabccd1e688dcd779","observation_id":"f820403c-5482-4aae-b61b-42dfaafd60e6","resolution":{"observed_at":"2026-05-15T10:40:28.782340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Discrete semantic tokeniza- tion for deep ctr prediction","venue":null,"work_id":"f10c5a05-5d59-45b6-8d6c-fe71cc2b69d6","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:9c44b5d5d95023c23f3122f03f58870915901896169430c22bf98db3126b51ee","observation_id":"2f44c6cd-7f68-4859-909b-7ae7ee292f1d","resolution":{"observed_at":"2026-05-15T10:40:28.830447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Catanet: Effi- cient content-aware token aggregation for lightweight image super-resolution","venue":null,"work_id":"18af8518-9107-40a9-877d-e58781139471","year":2025},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:e3b7e39216311b09939432fe6359d5b8ca08fa718f6f1c8c62cb1356a3f86ed7","observation_id":"24bea3ad-d48d-4e35-b038-2527c1cd998e","resolution":{"observed_at":"2026-05-15T10:40:28.837985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swin trans- former: Hierarchical vision transformer using shifted win- dows","venue":null,"work_id":"32aba246-b31f-4f71-8350-86475b479c44","year":2021},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:22d427a8d2963ba1cd5854cfdae2e79fc57217705235bb22fc1031b36a5f8ef2","observation_id":"857cd4d4-15dd-4e20-bfd5-fad1179aad70","resolution":{"observed_at":"2026-05-15T10:40:28.819474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to compress prompts with gist tokens","venue":null,"work_id":"219ee4d3-2fde-4dc0-a998-d969b7073146","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:ca54d63c6b6ea03fcc362598ac6c0e3a0111137bdc87e0a6a375eb9f03482f35","observation_id":"d7938063-0fb3-4fe7-a0a0-30b97b28dfd8","resolution":{"observed_at":"2026-05-15T10:40:28.803151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bow- man","venue":null,"work_id":"4bb00f77-c314-49c3-b5c5-47654c1553ab","year":2022},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:7837929b4281989b8547b6ee32e17b0ae98766299436c9625421052e47b29150","observation_id":"c0281aa2-77f9-45b6-a5fd-00c8ca33c74d","resolution":{"observed_at":"2026-05-15T10:40:28.769479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rae, Anna Potapenko, Siddhant M","venue":null,"work_id":"75214237-baaa-48d3-8ab0-2a78c97f9c4d","year":2019},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:b46a9bf46086eaefa9f1ae7f49cb4dd4c0e2db8f13cd675f83e10c9c9bb7dd58","observation_id":"99ad9ce2-5d77-497e-8f12-cf133db38c31","resolution":{"observed_at":"2026-05-15T10:40:28.810397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamicvit: Efficient vision transformers with dynamic token sparsification","venue":null,"work_id":"2965c7e2-b300-40a9-9182-5ce468ba39aa","year":2021},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:097d83af399556e259c3ff291289b16a7ec34fd48badb79d1918dbd689232319","observation_id":"8f36dc6a-5f4c-44ff-a2b3-aebaea2c88b7","resolution":{"observed_at":"2026-05-15T10:40:28.750544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient content-based sparse attention with rout- ing transformers","venue":null,"work_id":"6bf61e2c-939e-40c2-b645-ada1c6409428","year":2020},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:14a26dfbd590339fbe6d500d7aba5eb2f62e42ea4e518acb9dc4e4a95c9d14cf","observation_id":"32d630d5-fc80-489c-bab9-533055f005ce","resolution":{"observed_at":"2026-05-15T10:40:28.851412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning by distilling context","venue":null,"work_id":"dc96e4a7-b784-4092-8a65-83fce2df9722","year":2022},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:a96b66fd6cc0f6559f5ec80303fbbf48f72f39039dbe41cf10b6adf6afc2f42e","observation_id":"3f94b8d6-81a4-428d-92ca-ba091945ae0f","resolution":{"observed_at":"2026-05-15T10:40:28.834140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hier- archical context merging: Better long context understanding for pre-trained llms","venue":null,"work_id":"893e87ce-dfd8-47fd-8bcb-ee0de7939b10","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:dbc1aab9f24c09363e735b974e43ed6ec4ab80b37e37d23fd8f2c0fd0102aa19","observation_id":"b22510ec-6159-428b-aa47-318ab45ea70a","resolution":{"observed_at":"2026-05-15T10:40:28.792326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gonzalez, and Raluca Ada Popa","venue":null,"work_id":"e725e2e4-bcbb-4923-aa1c-a33c68897bab","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:b9409b61acdac4b599f131c98ded734ea2bc764bc262622420ed39111d7b8ac8","observation_id":"7548f112-d143-43fd-b73c-d61a6980fd0b","resolution":{"observed_at":"2026-05-15T10:40:28.854118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llama: Open and efficient foundation lan- guage models","venue":null,"work_id":"8aa26801-8ad5-4ad1-8fde-16351393195c","year":2023},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:b6626643d66b95a9db1844536df9a9e75820d9b2db72b8ae7efe00197db92762","observation_id":"0c140e6a-5125-4c05-aa89-a91cbdffba0f","resolution":{"observed_at":"2026-05-15T10:40:28.879119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T16:41:19.124504Z","title":"Neural discrete representation learning","venue":null,"work_id":"ed7372a6-9716-49ae-a27f-edc5710701dd","year":null},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:2da22b29751f1e5b6518eb8be6263061eb49a36bdc0904bcc5aac56b5c542eba","observation_id":"bc9a7307-37f2-4517-bdba-884b8336f47f","resolution":{"observed_at":"2026-05-15T10:40:28.875994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:55:41.074585Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"998f14c0-aaee-406f-a34d-981bdd7d7114","year":2023},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:a1087ec9e8f54e1d15c05c50c2d6d750a2d43bcb2fa131450e46c67f13a742da","observation_id":"5cbde0cd-7437-4af6-806d-c2e15e4d7abd","resolution":{"observed_at":"2026-05-15T10:40:28.882447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chi, Tat- sunori Hashimoto, Oriol Vinyals, Percy Liang, Jeff Dean, and William Fedus","venue":null,"work_id":"308b51bb-fc51-43c9-b5ed-7dab98f99896","year":2022},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:a29e679ff723ab71f607200ccdfd2ac5d55dd694f36ae8b49d2e29635c36df3e","observation_id":"40df7bcc-323d-4cea-978a-300de954dff3","resolution":{"observed_at":"2026-05-15T10:40:28.885296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen3 technical report","venue":null,"work_id":"2ff3d5c8-2b63-408e-8d6d-bc822f3701b7","year":2025},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:f60ad9c4870e157a6f15045db9175bdd4a6a956eed3d2ef155f49144a49107ac","observation_id":"c85b24ee-72f3-4f2c-b142-cdccf57a859d","resolution":{"observed_at":"2026-05-15T10:40:28.887994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"S 2ft: Efficient, scalable and generalizable llm fine- tuning by structured sparsity","venue":null,"work_id":"ed7fc874-0245-4052-b8e9-8ac6b74df2f7","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:d029b2239b1455e4f32aab61ecf69ad921108ecf6482ce2de5b801a25ba784bd","observation_id":"5698ada9-5f25-4f55-8051-36dcfca55b2d","resolution":{"observed_at":"2026-05-15T10:40:28.890560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cohen, Ruslan Salakhutdinov, and Christo- pher D","venue":null,"work_id":"1958e964-8449-4c61-be06-a32686adb447","year":2018},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:fa6fe24d47e17433d8f6b3f69df34c6b7bf790cd0204778ed032aac04bb0e9b7","observation_id":"f07a06cd-6365-4234-b916-998c167ac5f1","resolution":{"observed_at":"2026-05-15T10:40:28.893329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d8e445e6-43ef-4865-b1cc-69d77576b69a","year":2025},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:54d0fee0467f83c5271fa71ae07c42ab0e13476f25264ef6c1d0652b2fca22a3","observation_id":"3d37dab4-be0b-4612-b8e6-62eb17e65926","resolution":{"observed_at":"2026-05-15T10:40:28.895893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Big bird: Transformers for longer sequences","venue":null,"work_id":"5e9515e8-6145-4120-bd26-4fb6447c7425","year":2021},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:88ed5a7230f7da42e2f582bd970249f7ab33333729b84a3d3d67dffbe65ae9e9","observation_id":"adb4e4f1-63e4-4695-bf20-627d1d86c2e3","resolution":{"observed_at":"2026-05-15T10:40:28.872263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Long context compression with acti- vation beacon","venue":null,"work_id":"f568835e-92bb-4f6d-8df1-ce21f16aa211","year":2024},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:500589bf8ac0ebd6131d85dc69ff225ddf846ece1bbb6ffaf2be000071fd6c14","observation_id":"dc492d62-9750-4100-b64a-a6b6b2787c21","resolution":{"observed_at":"2026-05-15T10:40:28.869118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Un- supervised discrete sentence representation learning for in- terpretable neural dialog generation","venue":null,"work_id":"d5b3e556-c58a-4361-a47c-afce2a69d5a6","year":2018},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:a7eb8e46642a9d57b49ce5f7f062526437f86b1c465b881677c67e029ff0cfdd","observation_id":"46a9e74f-30e5-4bf4-9b98-b44770a2a6f9","resolution":{"observed_at":"2026-05-15T10:40:28.862924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aim: Adaptive inference of multi-modal llms via token merging and pruning","venue":null,"work_id":"ce2e10df-a279-460b-a499-045ef8d211ba","year":2025},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:6cd4363d1dd40ebdaeb389d55c7ac6bd810384216d221bf28361c42cd991ede7","observation_id":"c9f71f41-4829-4085-a7b4-0b65b930124b","resolution":{"observed_at":"2026-05-15T10:40:28.866261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Discrete autoencoders for sequence models","venue":null,"work_id":"045614dd-0ff8-4c2e-9e0c-5a82a156f8f2","year":2018},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:c59422851e88d1fa33ea08539ce2b1d7143448005a9a24d3284ff7dc4d1669f0","observation_id":"9696ea97-7aad-462d-bd28-c7cd7a6c33c1","resolution":{"observed_at":"2026-05-15T10:40:28.859490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast de- coding in sequence models using discrete latent variables","venue":null,"work_id":"b02954c5-f7ee-4784-997c-eb3ec3d0c39f","year":null},"citing_paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T00:54:15.090677Z"},"links":{"citing_paper":"/paper/2603.25340"},"observation_digest":"sha256:c111999baa960b88ee1aa049dd82d3a286116bee1bdbeaabd2ef24045af13c2d","observation_id":"afb56f1a-fbcb-4366-896a-2b63a5e25fc6","resolution":{"observed_at":"2026-05-15T10:40:28.856908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.25340","last_updated":"2026-05-13T05:15:01Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T03:33:22.037851Z","submitted_at":"2026-03-26T11:30:44Z","title":"Large Language Model as Token Compressor and Decompressor"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":44},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 4 inbound Pith citation observations for arXiv:2603.25340."}