{"as_of":"2026-08-07T22:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a5060da046ae478aeaf760fc6d92bcd0804df81002d86a99308421619b34a80","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:05:56.484408Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00969/citation-record","integrity":"/paper/2509.00969/integrity","json":"/paper/2509.00969/citation-record.json","paper":"/paper/2509.00969"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:53.235597Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.235597Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:282523a17d0d6dd5fdefa7f2db5fbc93d9fa7e071b309ffd00bde47a1c03017c","observation_id":"3eba0d5a-0297-42dc-9608-6a95e01a9741","resolution":{"observed_at":"2026-08-05T13:05:53.235597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:53.365017Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.365017Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:c13dd3fe006e015983bf51b1e05d848d6df55b0721990c59060adf76c0a5f097","observation_id":"06e8b971-70d6-417f-953e-29cb46383135","resolution":{"observed_at":"2026-08-05T13:05:53.365017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:57.085457Z","title":null,"venue":null,"work_id":"ed7500c3-2c9d-4de6-b374-0d416861e43a","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.473748Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:9802cffe73796efb2779da3e65086535cf9d9938c3277eca81280fcaf069a51e","observation_id":"a50d49d8-e4fe-40df-bf1e-f6367e27301e","resolution":{"observed_at":"2026-08-05T13:05:57.088261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:57.075178Z","title":null,"venue":null,"work_id":"cd509250-46b6-4ebb-a976-c124342a6d72","year":2021},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.550665Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:6b7c3becfa4d6b8f2ed7a7fccafff8262bc8e8b2ededd679add78bcdfd4b1f1b","observation_id":"80a89611-51ad-47ea-9a7e-4ffd757fcfc2","resolution":{"observed_at":"2026-08-05T13:05:57.078212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-07-06T14:06:56.291161Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09461","snapshot_observed_at":"2026-08-05T13:05:53.616303Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.616303Z"},"links":{"cited_paper":"/paper/2210.09461","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:fbe6f533b67087b6fcc969593370136f4f7f8f18aab66321af73acde0bb44607","observation_id":"d3f6908b-f5cb-43a8-8a83-2b6c0c3769e9","resolution":{"observed_at":"2026-08-05T13:05:53.616303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:57.064047Z","title":null,"venue":null,"work_id":"0d387e6c-b502-4983-8957-16fc21084200","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.681026Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:cbaf56ce2a189a75652e00b5706ae907f3ba9f030f2325aa0cd0b92574922f59","observation_id":"61ce91eb-1861-41e1-b0f3-e174b6415dc3","resolution":{"observed_at":"2026-08-05T13:05:57.067311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:57.052996Z","title":null,"venue":null,"work_id":"b2763b1a-964e-4144-bd95-a2f9ed45aae2","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.746451Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:f070bc180170a93b0aa8473caf0367d1dc5e26f0f6f3e80623594dc737e5c7b4","observation_id":"8eacebfc-68c3-470b-a361-d7ff1f73cdb3","resolution":{"observed_at":"2026-08-05T13:05:57.055994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-06T12:38:03.720232Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-05T13:05:53.794576Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.794576Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:22fbbdef1748ae2397c97f9c20b43c8d0ab51de4570131ec3c46ae2fb53f7145","observation_id":"bbd2c311-4312-47b8-b990-4fb9747f14fc","resolution":{"observed_at":"2026-08-05T13:05:53.794576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:57.041576Z","title":null,"venue":null,"work_id":"d38ef96b-1e01-490d-9182-524c1d1629d8","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.832400Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:c54e28e40cd88ba5dd29f6a5f82876cef8d034b09ac6dfc462feec13db254ba6","observation_id":"334e107d-3199-48d8-93e2-df47d2985064","resolution":{"observed_at":"2026-08-05T13:05:57.044854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:57.031368Z","title":null,"venue":null,"work_id":"cf2fc119-99c5-473b-831b-1a1dbda9ec5b","year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.876365Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:ff61025e79aba23e506f4282d11585f64061cc66e53bd4d602d9ec5551b99e00","observation_id":"c36bc76c-9875-4ff9-b6c0-69c82a7293ba","resolution":{"observed_at":"2026-08-05T13:05:57.034658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:57.021692Z","title":null,"venue":null,"work_id":"7f6a1203-1c16-43c3-9978-665781dbf67c","year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.931576Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:394da878e65fc2ed792c726847bcf037ae0207735697f4b9948d75365dd11bb4","observation_id":"aca1768d-d489-4e0c-bd38-add5b271fc87","resolution":{"observed_at":"2026-08-05T13:05:57.024753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-05T13:05:53.979850Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:53.979850Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:2208ba0a82c3e92ec415feb1e6f3935f055ca03aa9b7607e427ae3af4731da9d","observation_id":"c21867b7-2676-48dd-9917-21e5fb1f3d22","resolution":{"observed_at":"2026-08-05T13:05:53.979850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03766","last_updated":"2024-02-06T07:16:36Z","snapshot_observed_at":"2026-07-06T17:26:02.434883Z","submitted_at":"2024-02-06T07:16:36Z","title":"MobileVLM V2: Faster and Stronger Baseline for Vision Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03766","snapshot_observed_at":"2026-08-05T13:05:54.046573Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.046573Z"},"links":{"cited_paper":"/paper/2402.03766","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:cdf47b2f53c0c4bb516d9366763119d2a930407b12d4cdafc2ab4aada96ef9b9","observation_id":"52e0de29-c462-44ec-9e5c-e515c51147a4","resolution":{"observed_at":"2026-08-05T13:05:54.046573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-05T13:05:54.085259Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.085259Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:58f4b5a5f35075e22590989218dea226b4334ed747ca6e80162b5e848ad063c8","observation_id":"e3056099-9f02-4247-a432-4af80e8acff8","resolution":{"observed_at":"2026-08-05T13:05:54.085259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:54.126692Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.126692Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:bbee16ff6bcd8264688629cf63a7671409dae5d8421d24726677766d3af232d2","observation_id":"30ff767b-59c4-4bf1-8691-dba56165d421","resolution":{"observed_at":"2026-08-05T13:05:54.126692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.996743Z","title":"something something","venue":null,"work_id":"4ae1c6eb-39d2-41c8-b61c-2815328cf755","year":2017},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.163677Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:80f8d895d1fdba81449436f00e17c5ab624805056436d3371e690d4f5f79080e","observation_id":"7963f233-83ad-4476-8f33-3e858db0c826","resolution":{"observed_at":"2026-08-05T13:05:57.006612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.985548Z","title":null,"venue":null,"work_id":"7045a75c-ec85-4b94-8752-f5b2d846921f","year":2019},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.175024Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:aad20a3f8f9067798da2e3c2b0d8be8b440f00c0d603816a80026297dcb63e9b","observation_id":"656a4fd0-605b-4fe3-aaed-9e6b92553960","resolution":{"observed_at":"2026-08-05T13:05:56.988491Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.974179Z","title":null,"venue":null,"work_id":"7f947c31-ed08-4fb2-8ce1-b818571fdae8","year":2019},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.213261Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:a3355af5f711280a3969312ab18a828b6ef01550044c4538069f4699405da1e3","observation_id":"c8369171-f4de-4de8-a44b-0619cc4f5a02","resolution":{"observed_at":"2026-08-05T13:05:56.977478Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.962439Z","title":null,"venue":null,"work_id":"f0f3b2e4-194a-4fe9-ad1f-7774d199eb6b","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.230744Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:f57c4064b2f4a027bcceb95d1ede752518eeb0c68f7756144df360875b567446","observation_id":"e3cae302-8947-4497-bd34-7b0087cb4523","resolution":{"observed_at":"2026-08-05T13:05:56.965785Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-07-06T05:43:22.028213Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-05T13:05:54.267164Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.267164Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:aafef7830c322310e0a162d72ffb158bbf5e26b856217aab5fb6ac9d5c10c753","observation_id":"df9c99fa-17c8-4d90-a87f-994d1b2549ce","resolution":{"observed_at":"2026-08-05T13:05:54.267164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.952072Z","title":null,"venue":null,"work_id":"3650c759-e9b5-4809-8994-d98cb01df589","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.304338Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:1b6c2214f3896063a618eab2836f6c9b60d8c8ac4c0f16e797af2dcb184d00f8","observation_id":"b2ac6a30-6a71-46a5-8d33-61a69186265d","resolution":{"observed_at":"2026-08-05T13:05:56.955306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.941982Z","title":null,"venue":null,"work_id":"c5478238-05e0-43fc-877a-75e01d58b9ad","year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.345335Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:5034eae4f1077147ea122195e962a6e12652f2cbd55ab115733f5f7cee87f55b","observation_id":"45f76a06-6955-4e83-986f-d7d40c10be68","resolution":{"observed_at":"2026-08-05T13:05:56.944892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-05T13:05:54.367396Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.367396Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:c6d2d1645188d03724d26bfa21d11c09521f9ad00692cd92c20156f63353927e","observation_id":"53f00fa1-41cb-4adf-bc27-2b7712cca3ae","resolution":{"observed_at":"2026-08-05T13:05:54.367396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:54.407668Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.407668Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:47376a71916415a29f86ce3c61d815ec478ff99997aaad4e019139740e366c1f","observation_id":"c53423cd-a64f-4ffb-8d3c-16d32a626f8e","resolution":{"observed_at":"2026-08-05T13:05:54.407668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02392","last_updated":"2024-08-28T08:49:57Z","snapshot_observed_at":"2026-07-06T18:40:22.951929Z","submitted_at":"2024-07-02T16:10:55Z","title":"TokenPacker: Efficient Visual Projector for Multimodal LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02392","snapshot_observed_at":"2026-08-05T13:05:54.422800Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.422800Z"},"links":{"cited_paper":"/paper/2407.02392","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:29177fa094cfe02e0d65bf035c89dd5d7c51ed9c8b4f996fbcef609d4929efbe","observation_id":"4b131883-97a4-4f14-97af-e2abeb8c3d79","resolution":{"observed_at":"2026-08-05T13:05:54.422800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08478","last_updated":"2024-06-18T11:47:26Z","snapshot_observed_at":"2026-07-06T18:29:49.284504Z","submitted_at":"2024-06-12T17:59:07Z","title":"What If We Recaption Billions of Web Images with LLaMA-3?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08478","snapshot_observed_at":"2026-08-05T13:05:54.478225Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.478225Z"},"links":{"cited_paper":"/paper/2406.08478","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:792fe745c7476be2887e2624bb7060179add186cf3bb20f6aa7e037a95770815","observation_id":"6c41d5a6-4e76-40c6-adc6-d2060604eea6","resolution":{"observed_at":"2026-08-05T13:05:54.478225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.925025Z","title":null,"venue":null,"work_id":"6df7e5bd-81b5-4836-898e-48597fab3eb3","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.537883Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:5b9d1532032004560ec3ff879bb7530b598ab3da16e73f0beffa9f25d49d1bf0","observation_id":"d189ee06-e847-43e5-bc8f-a8d55761c9b0","resolution":{"observed_at":"2026-08-05T13:05:56.928365Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:54.626918Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.626918Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:0c4e507e3e90fc1e4d5f8bab19c28556d6c34e8a093314ae82b9b77d4fce392f","observation_id":"908088f7-fd8d-4088-8056-6a83a82e5dd7","resolution":{"observed_at":"2026-08-05T13:05:54.626918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.914926Z","title":null,"venue":null,"work_id":"1a616b02-a84a-499d-8160-7482dc47ca2a","year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.731172Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:4da24273c08b8f045d2bf0810be1cb411f3e06cc97ba4dcb825257153ed7a5a8","observation_id":"56b263f3-4ca1-4088-8d93-cb68876d970e","resolution":{"observed_at":"2026-08-05T13:05:56.918008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.905728Z","title":null,"venue":null,"work_id":"c0f4f17d-5435-4eeb-8cfc-f124b08c7cb4","year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.782248Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:cc6e2679a182536a21e843c34149b7a582a0a176f1af3c57e6d6868c8b921fc3","observation_id":"b001d0d2-5c6e-4698-a81e-97dcb9b60390","resolution":{"observed_at":"2026-08-05T13:05:56.908659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:54.790967Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.790967Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:3b82e394dc59346163e99f194163aebed8f2e655cc9c8de37f591a76f4e476dc","observation_id":"4ad8e511-e310-4792-95d6-3f350695e653","resolution":{"observed_at":"2026-08-05T13:05:54.790967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.889378Z","title":null,"venue":null,"work_id":"458bfcee-e40d-41db-a536-a0bfbdcf5235","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.797709Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:3339e794e6b45d40ee8783f6dbc9b10eb34d8424abe3fffce5d9f22be4c826d1","observation_id":"53c833c4-00fe-4e23-bec0-cadc49a3b59c","resolution":{"observed_at":"2026-08-05T13:05:56.892820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-72998-0_1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.528141Z","title":null,"venue":null,"work_id":"2280b27f-ace2-4e33-b582-bbc41480235b","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.817737Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:5790517c5595a167de64d159275fd837338ac26c656eb8d32d7407871c35f044","observation_id":"6c48193c-9fa1-45ec-9f52-1f2faa13b998","resolution":{"observed_at":"2026-08-05T13:05:56.531169Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07207","last_updated":"2025-03-17T13:51:51Z","snapshot_observed_at":"2026-07-06T15:41:39.660811Z","submitted_at":"2023-06-12T16:11:10Z","title":"Valley: Video Assistant with Large Language model Enhanced abilitY","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07207","snapshot_observed_at":"2026-08-05T13:05:54.875262Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.875262Z"},"links":{"cited_paper":"/paper/2306.07207","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:c903749ee5d7ab68f144d77707c0da4b3d6febdcfe2d9769c4dd36cad4ccf0a2","observation_id":"a6630497-dc85-42bc-83c5-efaa1c28942c","resolution":{"observed_at":"2026-08-05T13:05:54.875262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.880045Z","title":null,"venue":null,"work_id":"6fc3b487-c718-4e26-be52-bcbdfb10dc70","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:54.971859Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:6d440cad6bac7af44c793fcd6ea48a522b0cf065c5cbbdfe24b39d20809c90f5","observation_id":"d2ced70f-f85b-4c34-bdf5-e2df936bef70","resolution":{"observed_at":"2026-08-05T13:05:56.882918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09418","last_updated":"2024-06-13T17:59:59Z","snapshot_observed_at":"2026-07-06T18:30:32.982860Z","submitted_at":"2024-06-13T17:59:59Z","title":"VideoGPT+: Integrating Image and Video Encoders for Enhanced Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09418","snapshot_observed_at":"2026-08-05T13:05:55.083406Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.083406Z"},"links":{"cited_paper":"/paper/2406.09418","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:27c3c34803fa109bd00ced8798759fd2665137d06275fae6e43d9b2d10daa644","observation_id":"12300213-6095-433b-8b26-6bece59e0d14","resolution":{"observed_at":"2026-08-05T13:05:55.083406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.869584Z","title":null,"venue":null,"work_id":"1b8f6c0b-685b-44a1-88bd-408e1c479b3c","year":2022},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.168318Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:7b77e76cd4c57c13ea761cbee067eb9e6302b58f7a028838671b9f6635ecb664","observation_id":"32a734d8-0c95-4c5d-aacb-cb97f6a28e5f","resolution":{"observed_at":"2026-08-05T13:05:56.873199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13786","last_updated":"2023-10-30T18:35:48Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T07:54:37Z","title":"Perception Test: A Diagnostic Benchmark for Multimodal Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13786","snapshot_observed_at":"2026-08-05T13:05:55.211311Z","title":"Koster, Junlin Zhang, Stephanie Winkler, and 5 others","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.211311Z"},"links":{"cited_paper":"/paper/2305.13786","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:9128fab4a3ab040ced24e7cc65eadf3092f5415b5defcd6c20decddc1dc60195","observation_id":"7f192378-6656-46d9-82d4-cce3ea3690ab","resolution":{"observed_at":"2026-08-05T13:05:55.211311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:55.293574Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.293574Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:e17e1ed07290215bc0ba70b5051f77963f456ebb45886c726bb5ef83564f4c7d","observation_id":"5efc6ad7-758e-4d84-ab19-fe4b4297cca6","resolution":{"observed_at":"2026-08-05T13:05:55.293574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.853343Z","title":null,"venue":null,"work_id":"c7a29474-822f-4030-98f0-93cfb419b07d","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.363817Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:277ae59791c3daed80704dba880f1a9dc468564f03f7a33e0dc6f1bdcb6db87b","observation_id":"b509660e-f94a-44f4-8710-8c1f3035b75e","resolution":{"observed_at":"2026-08-05T13:05:56.856410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.843466Z","title":null,"venue":null,"work_id":"a65372cd-415b-4ca0-82b1-0c8cadb2f0e0","year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.406091Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:d0fcbfb8f9a4e47435fa5d07d35ea83b94ef4ebc8eda135a9d35f201b14ffe03","observation_id":"1fb4b155-49b7-4811-84df-94f42a5ad213","resolution":{"observed_at":"2026-08-05T13:05:56.846261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.832627Z","title":null,"venue":null,"work_id":"66c73b7a-af60-4e9d-9367-45b2ed717838","year":2025},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.466123Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:70940a7fb0ca509b3fdf332154be3dfbccf6bfa642a510ad8290d4fa9c6623ae","observation_id":"24428157-7a14-4ced-8cbe-2c3db02157c5","resolution":{"observed_at":"2026-08-05T13:05:56.836332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.822047Z","title":null,"venue":null,"work_id":"f735397a-dc61-4d17-ad3a-6fc1a8c16643","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.512481Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:047552fb4f0a20004d9cfeb8ee31a3bbb67ec987196bd3e89a205965cb8bf992","observation_id":"9ddb16e0-3e75-4641-8258-fb9e5640614c","resolution":{"observed_at":"2026-08-05T13:05:56.825240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:55.584430Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.584430Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:45760975c0b4eed44a4ff7aedfa016740a647ad37b98edb63cbc255a716563a9","observation_id":"d5344a12-99f3-424b-b19e-99df6a1295f8","resolution":{"observed_at":"2026-08-05T13:05:55.584430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.804977Z","title":null,"venue":null,"work_id":"d28ec1a6-73e1-4d87-b320-320f22c73a73","year":2019},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.654485Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:7619a4efb6216260a75daf8dda2fec7ebc0795c6d1c365945d1c7353451b5bae","observation_id":"35343478-ec9f-496f-b0dd-78614b9c746a","resolution":{"observed_at":"2026-08-05T13:05:56.808257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T13:05:55.724253Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.724253Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:5553ce41a9af8d343eaa30366a5396ac2d6de6b13343580f97d59a78b06683f2","observation_id":"66c95aa7-e169-42e3-8816-cfcd532bcb56","resolution":{"observed_at":"2026-08-05T13:05:55.724253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T13:05:55.794328Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.794328Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:9d39fa7fcabab5a6037aa1c5c2b18bd56eadd238557bb749557a6f2b2abe7406","observation_id":"9c72c10a-aa91-4c35-b588-6183f952f355","resolution":{"observed_at":"2026-08-05T13:05:55.794328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.794113Z","title":null,"venue":null,"work_id":"ee2e42b1-5207-4567-af88-b1671f172caa","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.839359Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:0fc95b01bd440553299d5e429bff2bf40b05020c3ee3ef8cf8681b2735d9f7a4","observation_id":"d0ee8bd6-f100-4136-8876-c03688e45bc4","resolution":{"observed_at":"2026-08-05T13:05:56.797175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-73414-4_26","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.515673Z","title":null,"venue":null,"work_id":"a20ac83e-d628-4a78-b0e6-e96ec62fc684","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.894783Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:b496c326c58097052f32231bb325a026f9e3b1ddac3ba00b5fbaf24c14778c53","observation_id":"a35eae8e-1978-43cc-b43f-da23d8134e7e","resolution":{"observed_at":"2026-08-05T13:05:56.520197Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:55.937129Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.937129Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:7f7a2740a711964214900c09be30c32da6038f60e01afba2062d90e9dd5c7d7e","observation_id":"e3736764-6d94-4e73-8a19-b65e5879f412","resolution":{"observed_at":"2026-08-05T13:05:55.937129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:55.979545Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:55.979545Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:1401f74d929c5969fff213ab16109c570ed4d4104386af7ad0643de26bd280e4","observation_id":"f0343381-ce90-4446-a91b-08601cc6c9e3","resolution":{"observed_at":"2026-08-05T13:05:55.979545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.770011Z","title":null,"venue":null,"work_id":"c1cb7a29-20bb-47c5-8963-304e05ccca6d","year":2017},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.002741Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:2175adf71d411541413b923038fbd4c9d0068a08fcad642b3dbdc7b38b7ad3f5","observation_id":"10f2929c-0710-4e3d-b7f2-c63bd70b44e9","resolution":{"observed_at":"2026-08-05T13:05:56.773627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.758320Z","title":"Gupta, Rilyn Han, Li Fei-Fei, and Saining Xie","venue":null,"work_id":"e4d55b26-6901-418f-aa48-36b49e5d9cd4","year":2025},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.058383Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:28bc0e5117d7341891d8804aeecef2bfa72bfdde897ce7fca74e0c5cdfdd176d","observation_id":"e6da866d-f3be-4087-b9b3-4587f6eb0075","resolution":{"observed_at":"2026-08-05T13:05:56.761756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.748263Z","title":null,"venue":null,"work_id":"7bc7a3c5-eade-4198-8768-d12818144d1c","year":2025},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.102237Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:7978d460811f64d4d0b19991a993bc8e48bc2b522dd4fbf5814c59f41566e004","observation_id":"c78a3461-6b53-4510-b9aa-1b2910607279","resolution":{"observed_at":"2026-08-05T13:05:56.751423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01442","last_updated":"2020-03-08T00:09:07Z","snapshot_observed_at":"2026-07-06T08:26:38.349660Z","submitted_at":"2019-10-03T13:16:36Z","title":"CLEVRER: CoLlision Events for Video REpresentation and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01442","snapshot_observed_at":"2026-08-05T13:05:56.164738Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.164738Z"},"links":{"cited_paper":"/paper/1910.01442","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:9ae19c066eba93c507fecbd88fc03c998c6a692c50f6c5d61e70fcc9f4832b25","observation_id":"c60e3fa1-6315-425e-b4e2-141155b5ec52","resolution":{"observed_at":"2026-08-05T13:05:56.164738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.737462Z","title":null,"venue":null,"work_id":"de0ee869-32d1-4302-b421-6b016bd079b1","year":2019},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.215245Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:8aa72151207393dec8b0ee801949018c283e82b10fe420f6bf38d27ff237d4e0","observation_id":"44f6258d-6830-47b4-9121-e95269b6d565","resolution":{"observed_at":"2026-08-05T13:05:56.740895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.273972Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.273972Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:1abb6e8d3175ecd96caa66385716f734a1825941ef53b858f32b007d6a39c00a","observation_id":"cf62ef30-a320-401e-baba-17efa35e793c","resolution":{"observed_at":"2026-08-05T13:05:56.273972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.727669Z","title":null,"venue":null,"work_id":"d7ce82f9-a130-467f-9da9-db9cdab7dc29","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.324177Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:a370c969d7a4c7b987d2e4adbfbd823a53ff10f68e7ab206f36c51ae37f0987d","observation_id":"434e5fa5-6559-4f83-930a-34765c97f39a","resolution":{"observed_at":"2026-08-05T13:05:56.730852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:05:56.717531Z","title":null,"venue":null,"work_id":"27a20d05-2929-48d6-b43a-b18ea46ad3ba","year":2024},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.337483Z"},"links":{"citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:622b38ff054ebccfa6f6202e68332ef81804ea9d71070d554c7a735d396ba88b","observation_id":"451a5ec0-1aea-40c2-be0e-11e1cd09b5f8","resolution":{"observed_at":"2026-08-05T13:05:56.720709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03895","last_updated":"2025-03-02T15:55:07Z","snapshot_observed_at":"2026-07-06T20:17:43.203959Z","submitted_at":"2025-01-07T16:03:14Z","title":"LLaVA-Mini: Efficient Image and Video Large Multimodal Models with One Vision Token","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03895","snapshot_observed_at":"2026-08-05T13:05:56.397948Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.397948Z"},"links":{"cited_paper":"/paper/2501.03895","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:7459471c7b6b3151327c1dfe3a45c4d3f5ecd51ad73d704211b550b939d26d4e","observation_id":"be70dd87-0aee-4f07-a90a-33ab85d0a529","resolution":{"observed_at":"2026-08-05T13:05:56.397948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-05T13:05:56.484408Z","title":"P Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T13:05:56.484408Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2509.00969"},"observation_digest":"sha256:065280d77747d97d8c331ea794b6ffedf9000d36d95108387ead0773e1612961","observation_id":"469b897c-590b-4a9d-a34a-adaacffc4b8d","resolution":{"observed_at":"2026-08-05T13:05:56.484408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.00969","last_updated":"2025-09-09T03:59:05Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:22:31.806249Z","submitted_at":"2025-08-31T19:27:29Z","title":"Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":57,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2509.00969."}