{"as_of":"2026-08-06T03:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:705796aa3b960d7b2102eba8b4d9a49d3031509b8164cfca43ac851b625940ea","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T05:20:30.823304Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.23717/citation-record","integrity":"/paper/2604.23717/integrity","json":"/paper/2604.23717/citation-record.json","paper":"/paper/2604.23717"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":"2503.01743","doi":"10.18653/v1/2023.wmt-1.23","metadata_source":"pith","pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","venue":"cs.CL","work_id":"83956045-536a-41ff-af02-b80e2a614eab","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:4a62a3ea88178e3034b31901ab6aa3611ab8c1be0c7b3daa22e1bb82288825d3","observation_id":"e9899b37-44e8-40af-bc00-b577a5b281de","resolution":{"observed_at":"2026-05-11T22:22:28.302846Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.20973","doi":"10.48550/arxiv.2511.20973","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards audio token compression in large audio language models","venue":"ArXiv.org","work_id":"41b97985-618b-4192-8d41-3d9849f7512e","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:d86ac8e960ba289ab09d74c52c6e71bfd0e5b164770ba115f1ed81c0987273ce","observation_id":"40b8f34b-e6e2-4bc5-8920-3e93ce848b28","resolution":{"observed_at":"2026-05-11T21:31:14.401725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.01552","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T03:39:29.537898Z","title":"Variation-aware vision token dropping for faster large vision-language models","venue":null,"work_id":"75a96e9d-a46e-49e2-aec8-ccde8fd280a7","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:3dba1e824939a56ce80675f0951f9965102125482225cb08f31a39e69b5e5ff3","observation_id":"e7da7269-9919-49d9-b7b2-3dfc5f8da75e","resolution":{"observed_at":"2026-05-11T21:31:14.378072Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:13:58.895009Z","title":"An image is worth 1/2 tokens after layer 2: Plug-and-play inference acceleration for large vision-language models","venue":null,"work_id":"cff41906-a618-4bf0-929e-0d9e32c02c32","year":2024},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:5d9fe5a7b9460dd96eef82ac41a61347cb849d7b06018825c13cc93c0ae783da","observation_id":"bffe711f-3c2e-4c92-8dfd-f944ff110020","resolution":{"observed_at":"2026-05-26T19:57:56.584029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Voxdialogue: Can spoken dialogue systems un- derstand information beyond words? InThe Thirteenth International Conference on Learn- ing Representations","venue":null,"work_id":"461ff6a2-b5f8-4043-b67d-72a8e9e92975","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:9bf25e69510895e997266c0dd391666bad763ba6634302de5f1f5665bd9ced27","observation_id":"a4295657-bb6c-4941-aba1-af5d483ec599","resolution":{"observed_at":"2026-05-26T19:57:56.580751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recent advances in speech language models: A survey","venue":null,"work_id":"2aa6fe5d-a035-4247-8f32-9b524a541100","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:6fbe669b0dc0718674bab9acd7be2b2eaf4e4db49a3208820cd25718a77fa975","observation_id":"c8d85341-555c-4be0-953b-0748dc9289fc","resolution":{"observed_at":"2026-05-26T19:57:56.561749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.04804","last_updated":"2026-05-13T17:11:48Z","snapshot_observed_at":"2026-07-30T23:51:10.917702Z","submitted_at":"2026-02-04T17:51:05Z","title":"OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2602.04804","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.04804","snapshot_observed_at":"2026-07-04T16:49:57.262617Z","title":"OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models","venue":"cs.CL","work_id":"1224850f-993a-4c50-9816-1d9aa50d76bf","year":2026},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2602.04804","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:2b00050e0a0372e6dce76b7d251146b5e0a5f4eada75a36546a8c59c0bf65c2f","observation_id":"898ff85c-2a31-40b3-87bd-2926c7790446","resolution":{"observed_at":"2026-05-14T02:56:19.131480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03983","last_updated":"2025-03-06T00:10:26Z","snapshot_observed_at":"2026-08-05T12:03:49.450949Z","submitted_at":"2025-03-06T00:10:26Z","title":"Audio Flamingo 2: An Audio-Language Model with Long-Audio Understanding and Expert Reasoning Abilities","version":1},"cited_work":{"arxiv_id":"2503.03983","doi":"10.48550/arxiv.2503.03983","metadata_source":"pith","pith_arxiv_id":"2503.03983","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Audio flamingo 2: An audio- language model with long-audio understanding and expert rea- soning abilities","venue":"cs.SD","work_id":"c3d168cb-8267-475f-bc18-b33bba54b60d","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2503.03983","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:13c231ecbfc1a60b0a8c2e215129d343723ea22d68df4536176037fdc3799431","observation_id":"bf4b9018-0016-4edd-9b2e-362ec6250864","resolution":{"observed_at":"2026-05-11T21:31:14.370153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08128","last_updated":"2025-07-28T22:53:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-10T19:40:21Z","title":"Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models","version":2},"cited_work":{"arxiv_id":"2507.08128","doi":"10.48550/arxiv.2507.08128","metadata_source":"pith","pith_arxiv_id":"2507.08128","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models","venue":"cs.SD","work_id":"67c2892d-8e27-4da1-8198-71c48e673e96","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2507.08128","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:d199e142761e5971b4da69c669c30f7c4dcb13e02680767e8e4b50eca3c6403f","observation_id":"7e9353d4-a18d-4699-8b73-dc728fa74740","resolution":{"observed_at":"2026-05-15T03:42:46.422993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Filter, correlate, compress: Training-free token reduc- tion for mllm acceleration","venue":null,"work_id":"4dba99ca-b013-4677-8fb4-a518bc0e9264","year":2026},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:9788551c543a6f7b41f066e4b1799e8ad692703e92c8c300dd3c2be5cb5171a2","observation_id":"1bdcfb75-9d0e-476a-a9a3-133515f91b67","resolution":{"observed_at":"2026-05-26T19:57:56.546365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07293","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:53:55.839119Z","title":"Audiomarathon: A comprehensive benchmark for long-context audio understanding and efficiency in audio llms","venue":null,"work_id":"09d1fac2-ebc7-4758-8efd-e47325ca4f45","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:e28ea501fc272890726fbb20f72b21a3c09ff11520f6f0d402bf10324e8a25ad","observation_id":"870262c2-a8e2-4446-bb81-0c36ca06ccc8","resolution":{"observed_at":"2026-05-11T21:31:14.497205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13992","last_updated":"2025-08-19T16:33:49Z","snapshot_observed_at":"2026-08-05T18:48:28.371759Z","submitted_at":"2025-08-19T16:33:49Z","title":"MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General Intelligence","version":1},"cited_work":{"arxiv_id":"2508.13992","doi":"10.48550/arxiv.2508.13992","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.13992","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Mmau-pro: A challenging and comprehensive benchmark for holistic evaluation of audio general intelligence","venue":null,"work_id":"34fbbc93-cd79-4b11-a99d-32d597b71a37","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2508.13992","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:deeb40ae8746f4c41e4727cf4f788991331dfbdcd41c6e55a305d977c530d98a","observation_id":"a6acffad-05ba-4093-9044-286feb5b7a2b","resolution":{"observed_at":"2026-05-11T21:31:14.474889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.27650","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V-cast: Video curvature- aware spatio-temporal pruning for efficient video large language models","venue":null,"work_id":"0dd7c286-40c6-442f-8a10-67c931b1f7e9","year":2026},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:5e18a988875faa6530ae95e6c2882743c9f963840ac5e4b2f69dffa8d4796a68","observation_id":"f1e50845-3222-4a47-8073-11ba80d34beb","resolution":{"observed_at":"2026-05-11T21:31:14.657167Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T09:17:49.037658Z","title":"Mixing importance with diversity: Joint optimization for kv cache compression in large vision-language models","venue":null,"work_id":"8adf6298-3fce-4c48-93ad-ac629841176a","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:4a051bdae0b5f8eb2598561e937460df9bab5e09446d1a8dd4fc12043275e366","observation_id":"3ed66fc0-294a-4000-92d7-9c28a980e6fb","resolution":{"observed_at":"2026-05-11T21:31:14.513215Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video compression commander: Plug-and-play inference acceleration for video large language models","venue":null,"work_id":"aa3c3814-4826-4db3-a9f6-75d98fc17b32","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:f9bbfa3f8675926f3a93c903a593d37bccdf505e955a5e91107fede5790f727d","observation_id":"d1b026d1-b1ba-4b27-8ef1-ec175ea69ae7","resolution":{"observed_at":"2026-05-26T19:57:56.543532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19147","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shifting AI efficiency from model-centric to data-centric compression","venue":null,"work_id":"8b2f6389-ce47-4621-a1aa-124c67694da9","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:ebd19a3353568e38e9592d261c9ffb4fd83c050c616531d72d3445b2da578361","observation_id":"724a5910-bc5a-4ec1-af1e-9354d78a695a","resolution":{"observed_at":"2026-05-11T21:31:14.445030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Global compression commander: Plug-and-play infer- ence acceleration for high-resolution large vision- language models","venue":null,"work_id":"8715ab3f-cdff-4368-a116-1116fad95659","year":2026},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:87a6e228325c164cac4cba50507281fc0f7c2e065c6bc06fa7a859e4712f4ad9","observation_id":"9a3c33ad-a0d5-4bb6-8cb6-bac34ef25363","resolution":{"observed_at":"2026-05-26T19:57:56.540450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Librispeech: an asr corpus based on public domain audio books","venue":null,"work_id":"f597a2a0-f186-4058-b75e-8d08b9fd00d1","year":2015},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:c68291d5e569d94070de9c9baad258836f679d08f08797fd7e9b194eacf80b7f","observation_id":"4abbffd3-3d25-46c2-915b-804f12f3f2cf","resolution":{"observed_at":"2026-05-26T19:57:56.565167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robust speech recognition via large- scale weak supervision","venue":null,"work_id":"5ff9b64c-8712-4c4f-8fdf-2f6575969f74","year":2023},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:6e57fea241e434c3a308a9a2c07f16f126024f337de8ddd8a6210ed6cd59b686","observation_id":"93ba1f1d-8a84-43b4-a904-e48ecd18bedf","resolution":{"observed_at":"2026-05-26T19:57:56.568263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sound event detec- tion in synthetic domestic environments","venue":null,"work_id":"05192637-5737-4098-ab17-4cc67f76c311","year":2020},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:0d94bb2106661603564d9cbb98706d47be2db18df43594447c25e337a4c86d33","observation_id":"196c0e02-1f11-4ace-bc2f-a081d44e7b7f","resolution":{"observed_at":"2026-05-26T19:57:56.571169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-02T21:51:36.809095Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.13289","doi":"10.1016/j.ajhg.2009.06.010","metadata_source":"pith","pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","venue":"cs.SD","work_id":"b06d6def-ea7a-4cbd-8bb3-73f6a81db238","year":2023},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:761df35a554301779771770f91703983b520a991ad604428505f0d484bcee3d6","observation_id":"9ac3f73f-d49c-48d9-9ee1-8ec2c911da9f","resolution":{"observed_at":"2026-05-18T02:29:46.683133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04779","last_updated":"2026-03-16T09:24:19Z","snapshot_observed_at":"2026-08-02T22:58:18.776196Z","submitted_at":"2025-06-05T09:09:36Z","title":"MMSU: A Massive Multi-task Spoken Language Understanding and Reasoning Benchmark","version":3},"cited_work":{"arxiv_id":"2506.04779","doi":"10.48550/arxiv.2506.04779","metadata_source":"pith","pith_arxiv_id":"2506.04779","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MMSU: A Massive Multi-task Spoken Language Understanding and Reasoning Benchmark","venue":"cs.CL","work_id":"1a24d3b1-2d00-407c-90f0-b0aeec13bfe6","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2506.04779","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:45cadb1ee3517292897d083f0e68ba1b4cf8277d5a27d42fada6074f3d2c050b","observation_id":"6490c2f1-061b-4704-8000-a1ef2e463553","resolution":{"observed_at":"2026-05-17T17:21:50.902611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:22:14.816429+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:22:14.816429+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.00891","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T03:19:29.889686Z","title":"Accelerating streaming video large language models via hierarchical token compression","venue":null,"work_id":"a3ecdf36-13d0-4963-b6db-299a71d77fde","year":2026},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:7b6656dbb9b01a48e9a6032ff14438f58f8780c9fbed3bce84435b16acd481c6","observation_id":"d4cc5161-b3a8-481d-a543-b82fb78afeba","resolution":{"observed_at":"2026-05-11T21:31:14.616290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06694","last_updated":"2026-04-08T05:20:39Z","snapshot_observed_at":"2026-07-06T22:55:06.424752Z","submitted_at":"2026-04-08T05:20:39Z","title":"AudioKV: KV Cache Eviction in Efficient Large Audio Language Models","version":1},"cited_work":{"arxiv_id":"2604.06694","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.06694","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AudioKV: KV Cache Eviction in Efficient Large Audio Language Models","venue":"cs.SD","work_id":"bd7b600f-6c47-4135-8b5e-9abc717adcd2","year":2026},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2604.06694","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:c01c841a8146f6a2dc92a0b27a3451320e66ef857a8a4b5d7b91eec7adcbd0bd","observation_id":"aa111c45-fffc-4065-9216-d52c541ee86d","resolution":{"observed_at":"2026-05-11T21:31:14.567879Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b82bf056-73d1-4da7-b04a-006eb3156adf","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:d99e390f86f654ac881883aedf9c666adf9fb6bb567344bd52b220e4b9eda8f9","observation_id":"2e4ba5d4-df3d-4e55-bf62-beaf4520ba1e","resolution":{"observed_at":"2026-05-26T19:57:56.574187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"files/1228896","doi":"10.18653/v1/2025.emnlp-main","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Stolfo, A., Balachandran, V ., Yousefi, S., Horvitz, E., and Nushi, B","venue":null,"work_id":"e8f5282f-30a2-4e6a-96fd-5aa884a0e8a0","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:f224fb472a1b43feaf272103a0af55751480478668c1213b139579e9230a803b","observation_id":"87e75540-5bb3-45b4-8336-5a01d0f862ca","resolution":{"observed_at":"2026-05-08T23:54:25.288601Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T08:50:07.505227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T08:50:07.505227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"emnlp-main.505/","venue":null,"work_id":"c4d63920-8e90-4a8f-b78f-e2b95fd0137c","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:43777de24d60b1f0cd51bfac1d5fdabcb227f3bde87d85388c40cde2667820de","observation_id":"da6e42db-0295-4223-988a-5f90513ce6f6","resolution":{"observed_at":"2026-05-26T19:57:56.555479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":"2309.17453","doi":"10.48550/arxiv.2309.17453","metadata_source":"pith","pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Streaming Language Models with Attention Sinks","venue":"cs.CL","work_id":"a8d25452-c237-48c9-88a4-682717c3979a","year":2023},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:8ede527f58d86345a1a7b3d30ba7aa7d4264d71511ec35d3021937294bce9224","observation_id":"2f88fd74-413b-4689-8ad8-4320184c52af","resolution":{"observed_at":"2026-05-11T21:31:14.455362Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-03T04:23:51.274879Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2503.20215","doi":"10.48550/arxiv.2503.20215","metadata_source":"pith","pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Omni Technical Report","venue":"cs.CL","work_id":"438f105c-fa9b-44aa-ad52-43acb8045cda","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:a30271cde1c8e6300d21026a5275debe7101ceabc994a60123fadf486ab6c47e","observation_id":"d73c1422-ffbb-4461-b29d-c7bb9b415b41","resolution":{"observed_at":"2026-05-11T21:31:14.582887Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:18:44.887499+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:18:44.887499+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8bfef644-0170-4573-866a-58f4d6b94a78","year":null},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:b1af50532c2f17ae66e239a42fb8b8094ee3b79ffd053e4a4db83844f18123de","observation_id":"6f2d9c7d-3566-48b9-a27e-059812bf89cd","resolution":{"observed_at":"2026-05-26T19:57:56.549274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2509.17765","doi":"10.48550/arxiv.2509.17765","metadata_source":"pith","pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-Omni Technical Report","venue":"cs.CL","work_id":"ae43e594-8bab-4471-b6af-92a300f6a048","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:a06be304ae3c4bf5f9dc3c98146ef5c01e2f2063cc64ec9b2f04c32b922b016c","observation_id":"c366e5e3-4d9e-4f67-b605-74aa33839a66","resolution":{"observed_at":"2026-05-11T21:31:14.628554Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sakura: On the multi-hop rea- soning of large audio-language models based on speech and audio information","venue":null,"work_id":"9279878f-e08f-4f52-875e-3c32dd1cbdd8","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:76ef323b6c778416a03044a6f3f3418260e8681c047084876417f0b289cfa185","observation_id":"f7619b2c-54b2-4cff-9a80-91ea556c21eb","resolution":{"observed_at":"2026-05-26T19:57:56.552201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visionzip: Longer is better but not nec- essary in vision language models","venue":null,"work_id":"b5da9c0a-2269-43fb-af97-a8cd63add2e8","year":2025},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:9394674ecaafacf3bad30dff80800f17ba7a56b2deecb43894ec065baf49e8a2","observation_id":"bfb51d97-cd5c-4b7d-9233-2c771ac3d228","resolution":{"observed_at":"2026-05-26T19:57:56.558681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speechgpt: Empowering large language models 12 with intrinsic cross-modal conversational abili- ties","venue":null,"work_id":"c67ed600-cd81-4d23-940d-5faca205480e","year":2023},"citing_paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T05:20:30.823304Z"},"links":{"citing_paper":"/paper/2604.23717"},"observation_digest":"sha256:ed9f1724bd5ac7098a523d164377c3c40ec2bd1e828192ffe27e386adea46194","observation_id":"0f42a7df-0ab8-44c7-b7e7-0de8d6793826","resolution":{"observed_at":"2026-05-26T19:57:56.577294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.23717","last_updated":"2026-04-26T14:00:31Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-02T21:00:22.453264Z","submitted_at":"2026-04-26T14:00:31Z","title":"HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":19,"verified_fuzzy":13},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2604.23717."}