{"as_of":"2026-08-10T18:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1e0a61bb7f0e53e9aa2940d7c725e447048b5cbaa87865aa8b42f66da3a67f2","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T23:23:39.127173Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01665/citation-record","integrity":"/paper/2608.01665/integrity","json":"/paper/2608.01665/citation-record.json","paper":"/paper/2608.01665"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.04804","last_updated":"2026-05-13T17:11:48Z","snapshot_observed_at":"2026-08-09T15:22:21.165722Z","submitted_at":"2026-02-04T17:51:05Z","title":"OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.04804","snapshot_observed_at":"2026-08-04T23:23:37.653849Z","title":"OmniSIFT: Modality-asymmetric token compression for efficient omni-modal large language models.arXiv preprint arXiv:2602.04804,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:37.653849Z"},"links":{"cited_paper":"/paper/2602.04804","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:7e7bdbfd984243ea2cfdde3a9a5c8869ec5100d471dfa316135a09be96472e1d","observation_id":"e203ff2e-1c58-439c-963c-e9ac11644da1","resolution":{"observed_at":"2026-08-04T23:23:37.653849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.15655","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:23:39.671703Z","title":"Event-vstream: Event-driven real-time understanding for long video streams.arXiv preprint arXiv:2601.15655,","venue":null,"work_id":"20c87f1f-a682-4fa7-8d3b-1e06f8b2dbaf","year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:37.981144Z"},"links":{"citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:dea8d37b3b982f69652f606ac77836f0efb297d598f3c6d0d427af7b782b2c6e","observation_id":"9e43021e-4266-44ad-bea5-45c26c6af657","resolution":{"observed_at":"2026-08-04T23:23:39.745127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04326","last_updated":"2026-03-01T04:35:41Z","snapshot_observed_at":"2026-07-06T20:32:23.502480Z","submitted_at":"2025-02-06T18:59:40Z","title":"WorldSense: Evaluating Real-world Omnimodal Understanding for Multimodal LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04326","snapshot_observed_at":"2026-08-04T23:23:38.038522Z","title":"Xiaohu Huang, Hao Zhou, and Kai Han","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.038522Z"},"links":{"cited_paper":"/paper/2502.04326","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:f1f4fe9f8a749575a73b6dc6e3c631c6a05ac3648783a9d97e06bd658170b71c","observation_id":"26f457be-4fb0-49da-8fbd-246fdfcb5cf0","resolution":{"observed_at":"2026-08-04T23:23:38.038522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:23:38.125893Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.125893Z"},"links":{"citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:76f90cb4d7e992c754451c67622c6d7f6cd803b354d55a76a960f9d09737ea8f","observation_id":"cdcf84f7-48a5-4552-91d9-c05821392a35","resolution":{"observed_at":"2026-08-04T23:23:38.125893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:23:38.234159Z","title":"URLhttps://arxiv.org/abs/2503.04130","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.234159Z"},"links":{"citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:03dd74a7acf5099a498e76d2fd15b1440231f1dddd56971225022e537a7761c4","observation_id":"b2e15ce5-88e3-4563-810a-8867e8fe4c14","resolution":{"observed_at":"2026-08-04T23:23:38.234159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:23:38.297534Z","title":"2601.13143","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.297534Z"},"links":{"citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:e6715abcc4f8c7808a1686373a53b2f303a4a90d0c57020839a8fc7a0b5062ca","observation_id":"27e54a3e-1f0d-40a1-bc3e-f1a0a6cf8394","resolution":{"observed_at":"2026-08-04T23:23:38.297534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.15685","last_updated":"2026-07-08T06:29:12Z","snapshot_observed_at":"2026-07-14T21:16:45.898566Z","submitted_at":"2026-03-15T15:22:06Z","title":"DASH: Dynamic Audio-Driven Semantic Chunking for Efficient Omnimodal Token Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.15685","snapshot_observed_at":"2026-08-04T23:23:38.428177Z","title":"URL https://arxiv.org/abs/2603.15685","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.428177Z"},"links":{"cited_paper":"/paper/2603.15685","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:9fce3e4696d2aa96b0d9069f915965a2dfe8fb381e58ace70e0422e1985f9539","observation_id":"995e80ce-76f8-42a4-83b1-e293a54cfab9","resolution":{"observed_at":"2026-08-04T23:23:38.428177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:23:38.494676Z","title":"Kele Shao, Keda Tao, Can Qin, Haoxuan You, Yang Sui, and Huan Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.494676Z"},"links":{"citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:969881029d1e4651b898aa39bc91183b48bd86c32eebbc5e00a18160d91b4e7c","observation_id":"fc042c54-46ec-4b4f-97a2-ad3f36087706","resolution":{"observed_at":"2026-08-04T23:23:38.494676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:23:38.577322Z","title":"Huyu Wu, Meng Tang, Xinhan Zheng, and Haiyun Jiang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.577322Z"},"links":{"citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:adb1f47e6c50a83f44cc1e2cf9a43f0ebd3f30c894179d1a5ab50f457345b66b","observation_id":"d1bde1cf-a489-465a-a9cd-f7dfb3337742","resolution":{"observed_at":"2026-08-04T23:23:38.577322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10552","last_updated":"2025-08-14T11:44:52Z","snapshot_observed_at":"2026-08-09T07:24:43.212927Z","submitted_at":"2025-08-14T11:44:52Z","title":"When Language Overrules: Revealing Text Dominance in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10552","snapshot_observed_at":"2026-08-04T23:23:38.657616Z","title":"Long Xing, Qidong Huang, Xiaoyi Dong, Jiajie Lu, Pan Zhang, Yuhang Zang, Yuhang Cao, Conghui He, Jiaqi Wang, Feng Wu, and Dahua Lin","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.657616Z"},"links":{"cited_paper":"/paper/2508.10552","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:594e54263d89204a00049c89ad4ab8739cdd09dfd3943991144d3b2157d2b3f9","observation_id":"1292bf7c-cbee-4843-8715-43181321eafc","resolution":{"observed_at":"2026-08-04T23:23:38.657616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17247","last_updated":"2025-02-27T11:16:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T17:59:53Z","title":"PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17247","snapshot_observed_at":"2026-08-04T23:23:38.724029Z","title":"Jin Xu, Zhifang Guo, Jinzheng He, Hangrui Hu, Ting He, Shuai Bai, Keqin Chen, Jialin Wang, Yang Fan, Kai Dang, Bin Zhang, Xiong Wang, Yunfei Chu, and Junyang Lin","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.724029Z"},"links":{"cited_paper":"/paper/2410.17247","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:893c5471e9aacd6cd847b0636d65311e9df4c2c5ce5305bcea99d218c69aac2d","observation_id":"309f69c9-7ce8-47e5-ade7-a89946606132","resolution":{"observed_at":"2026-08-04T23:23:38.724029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-06T08:46:20.194739Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-08-04T23:23:38.847802Z","title":"URL https://arxiv.org/abs/2503.20215","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.847802Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:0e5f6bbc61c5160920f47bb881bdab9f3a1af83b044bf94194185699bca91b87","observation_id":"c42d391e-0024-4f16-b4d2-b10cbc4723e4","resolution":{"observed_at":"2026-08-04T23:23:38.847802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12772","last_updated":"2025-05-05T04:48:45Z","snapshot_observed_at":"2026-07-06T18:47:56.109836Z","submitted_at":"2024-07-17T17:51:53Z","title":"LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12772","snapshot_observed_at":"2026-08-04T23:23:38.908542Z","title":"Qizhe Zhang, Aosong Cheng, Ming Lu, Renrui Zhang, Zhiyong Zhuo, Jiajun Cao, Shaobo Guo, Qi She, and Shanghang Zhang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:38.908542Z"},"links":{"cited_paper":"/paper/2407.12772","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:700859416ffeb18476b869c5547387533b5d13b3b1e417af42640a5e8eca5228","observation_id":"6b8813a0-05ca-4779-8278-e01d2d41057c","resolution":{"observed_at":"2026-08-04T23:23:38.908542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18657","last_updated":"2025-05-24T11:49:31Z","snapshot_observed_at":"2026-08-07T17:10:13.501355Z","submitted_at":"2025-05-24T11:49:31Z","title":"MLLMs are Deeply Affected by Modality Bias","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18657","snapshot_observed_at":"2026-08-04T23:23:39.041606Z","title":"Ziwei Zhou, Rui Wang, Zuxuan Wu, and Yu-Gang Jiang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:39.041606Z"},"links":{"cited_paper":"/paper/2505.18657","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:1ea516c71deaa45b5c5d5e998f59c0d650eea59d3644200016e8f1b00f8fc69d","observation_id":"2428e129-1e3e-41a7-a55b-7e035829ebef","resolution":{"observed_at":"2026-08-04T23:23:39.041606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0044.5074","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:23:39.353257Z","title":"The ratio∆ v/∆a measures whether video or audio readout is more sensitive to probe-layer choice","venue":null,"work_id":"a7311134-4b53-46da-bb41-9b1014220d0c","year":2064},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:39.127173Z"},"links":{"citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:b191b1843a8759ca78308355b1f48867dce6149f5d37cfc86af698a85bfc2fbc","observation_id":"e3706b11-782e-4d0f-bb5b-e200c1b17737","resolution":{"observed_at":"2026-08-04T23:23:39.429064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:23:39.895028Z","title":"Liang Chen, Haozhe Zhao, Tianyu Liu, Shuai Bai, Junyang Lin, Chang Zhou, and Baobao Chang","venue":null,"work_id":"a9fe0448-e658-4dcc-90cc-b65bccf31464","year":2024},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:37.440797Z"},"links":{"citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:e6d8f2dc02552d941c954daf394b5e40cfe8ecafb130fea744eba15dedc639bc","observation_id":"a575452c-6a33-43de-86b2-59c5805eb4d1","resolution":{"observed_at":"2026-08-04T23:23:39.988358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-04T23:23:37.539387Z","title":"URL https://doi.org/10.1007/978-3-031-73004-7_2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:37.539387Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:b7ecc359207a5f785152784c27ffe494429e43bd860a2c2127cb922d302f823a","observation_id":"d5893ffd-1c19-4210-a32d-a87daa2f0fba","resolution":{"observed_at":"2026-08-04T23:23:37.539387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20939","last_updated":"2025-07-28T15:52:36Z","snapshot_observed_at":"2026-08-10T06:10:12.904760Z","submitted_at":"2025-07-28T15:52:36Z","title":"ARC-Hunyuan-Video-7B: Structured Video Comprehension of Real-World Shorts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20939","snapshot_observed_at":"2026-08-04T23:23:37.839045Z","title":"Yuying Ge, Yixiao Ge, Chen Li, Teng Wang, Junfu Pu, Yizhuo Li, Lu Qiu, Jin Ma, Lisheng Duan, Xinyu Zuo, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:37.839045Z"},"links":{"cited_paper":"/paper/2507.20939","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:630de57d412ae9cb97fada8de3c90de8fa4fc433e094b9d86531a5c3b6e1aae2","observation_id":"70c59f4e-51a2-44fa-bca1-f081081e2100","resolution":{"observed_at":"2026-08-04T23:23:37.839045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.04804","last_updated":"2026-05-13T17:11:48Z","snapshot_observed_at":"2026-08-09T15:22:21.165722Z","submitted_at":"2026-02-04T17:51:05Z","title":"OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.04804","snapshot_observed_at":"2026-08-04T23:23:37.735203Z","title":"URL https://arxiv.org/abs/2602.04804","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:37.735203Z"},"links":{"cited_paper":"/paper/2602.04804","citing_paper":"/paper/2608.01665"},"observation_digest":"sha256:40188a1ddc8a14107cd841b944d24fd7670e4998a89746740fffdd1a236de4c3","observation_id":"4b77c009-9588-4157-823d-53606e59ef2f","resolution":{"observed_at":"2026-08-04T23:23:37.735203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01665","last_updated":"2026-08-03T03:56:33Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T21:05:15.058403Z","submitted_at":"2026-08-03T03:56:33Z","title":"Allocation Before Ranking: Decoupled Token Compression for OmniLLMs"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2608.01665."}