{"as_of":"2026-08-19T08:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab30c922a69df59178831c5e2709b77155a5bd9186f31a38a5b89581e9a5dcbf","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:35:16.391111Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08630/citation-record","integrity":"/paper/2608.08630/integrity","json":"/paper/2608.08630/citation-record.json","paper":"/paper/2608.08630"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:19.374792Z","title":"Zhang et al","venue":null,"work_id":"fbe8dc5c-bd97-4ef0-91dd-c6992deed7cc","year":2022},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.334751Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:02d9094f335935f15f86edfb47832075a37c03d5b004f6dfec5ec06354bc46cc","observation_id":"2ff526b5-0224-4298-8178-d657da7cf84d","resolution":{"observed_at":"2026-08-14T04:35:19.392851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-14T04:35:15.384752Z","title":"arXiv preprint arXiv:2502.13923 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.384752Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:950da8e06d90ab27db69aa972cc606e1570c245631c60ef7c93b00f843c85095","observation_id":"b1c07b5b-a398-4d88-8d16-e5f93ef93d75","resolution":{"observed_at":"2026-08-14T04:35:15.384752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:19.294437Z","title":null,"venue":null,"work_id":"90ab8d68-b8d4-4c1e-87e2-6f2ae2ade43b","year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.423283Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:4d5feda897a909a89ac7c4cd90ddf1602f42a38e1eb5abd2354f34782cd46cf2","observation_id":"108c75e5-66e2-4745-a2ca-d9a476677ecc","resolution":{"observed_at":"2026-08-14T04:35:19.334749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-14T04:35:15.449448Z","title":"CoRR abs/2412.05271(2024).https://doi.org/10.48550/ARXIV.2412.05271","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.449448Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:b11478db1e439fc1efea775c509ad215facd599e0514df2df9274050e322462c","observation_id":"ad117176-c504-45b8-8bf2-33b60291a912","resolution":{"observed_at":"2026-08-14T04:35:15.449448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:19.204834Z","title":"Advances in Neural Information Processing Systems37, 109487–109516 (2024)","venue":null,"work_id":"99e90b58-22f2-41a5-9f89-9f3dc7614ae8","year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.484833Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:7462846c6a46ee1ea0697a80b3ac9e3394cb66e817866fcb2b78e2f556c8fc2d","observation_id":"7073e692-45a2-4b27-b39d-02c93a2274aa","resolution":{"observed_at":"2026-08-14T04:35:19.234751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:19.154726Z","title":null,"venue":null,"work_id":"31577c79-1e05-4638-84b7-0ca34093270e","year":2023},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.504402Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:856e2689443f6b51fbf986a3dbbb329182faaf7c595fd0810f1f97569fc579de","observation_id":"2338f191-2c78-4c50-b020-3b279850c2de","resolution":{"observed_at":"2026-08-14T04:35:19.167823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:19.081054Z","title":"In: The Twelfth International Conference on Learning Represen- tations, ICLR 2024, Vienna, Austria, May 7-11, 2024","venue":null,"work_id":"41ad52fb-b1d2-40b2-964f-b5a2f1e63fe5","year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.554751Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:cacddee829ce0bb4baa51f7bd239e73f5d570514b27afeca985d2cd1002a91f5","observation_id":"e23d082b-e111-4a27-afb9-14919ee6c879","resolution":{"observed_at":"2026-08-14T04:35:19.095449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:19.014225Z","title":"In: The Twelfth International Conference on Learning Representations (2024)","venue":null,"work_id":"c03b2a81-9465-4058-886d-8d9d1581c02f","year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.601217Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:6aa67c3d8f3066e12fa2eb4c717c5bb78ded7dcd33f51f05414e91cd64bf32ff","observation_id":"95782734-eff8-43f5-9a37-e257d609f709","resolution":{"observed_at":"2026-08-14T04:35:19.021338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:15.624749Z","title":"In: Proceedings of the IEEE/CVF confer- ence on computer vision and pattern recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.624749Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:d7dbac50a33b6dd86a4bf2df7213239b1b7056a7d77cc2768ee152128a5b04cd","observation_id":"cba2200e-2e17-4f8a-a55b-362b30c94e6d","resolution":{"observed_at":"2026-08-14T04:35:15.624749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:18.744755Z","title":null,"venue":null,"work_id":"36ef68ef-1bca-4b97-ace6-d81245c3eb69","year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.645687Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:9b45f091663565cd45a9955f23bf3d987ea2a12be0c4235345c3f0e94456e977","observation_id":"aaf5acc4-6cc1-41c8-94f7-47da376e912f","resolution":{"observed_at":"2026-08-14T04:35:18.794749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:15.651846Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.651846Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:aa1b63003c0f82b962e9172eeb9631ac795dd20eccf9efdd77181bb972f87e71","observation_id":"dbce9b57-50f6-47e0-885a-d44a1f204fb9","resolution":{"observed_at":"2026-08-14T04:35:15.651846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:18.504751Z","title":null,"venue":null,"work_id":"eeb4831f-c5e5-409c-a25c-05d2d4ba345c","year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.660093Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:61e7f42f314e4658026b134c39a7ec451fd5ecd0484395642c66c43672bc015d","observation_id":"7cac4926-e3e6-4428-914d-b3f8593be74f","resolution":{"observed_at":"2026-08-14T04:35:18.523717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:18.374830Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"00461e2e-b4c8-4290-b102-8152f44871a5","year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.694746Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:6da56036ae863bd9f9fd5ae91859426854c14110e7f8f8019054fb24bdbf34bb","observation_id":"d5957217-97c1-4ae2-b5df-078f16a5dda3","resolution":{"observed_at":"2026-08-14T04:35:18.414744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:18.280653Z","title":"In: International Conference on Machine Learning, ICML 2023, 23-29 July 2023, Honolulu, Hawaii, USA.ProceedingsofMachineLearningResearch,vol.202,pp.19730–19742.PMLR (2023)","venue":null,"work_id":"efeb1854-a663-42b0-86c7-fb3c18012acb","year":2023},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.709555Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:b36353e13e487e600f54d00c458eb8e0c387324c1ab419885730339c32e30f92","observation_id":"058134ea-d3e7-46e4-bd65-560407685752","resolution":{"observed_at":"2026-08-14T04:35:18.304148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:15.735524Z","title":"In: Bouamor, H., Pino, J., Bali, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.735524Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:28e468f90f0a550a5ec3340ea1d1641b57e6ec38288ddcc6a41eebf0b6125a6b","observation_id":"cccb54ec-ca80-44fd-8fc3-5ac53319cbbd","resolution":{"observed_at":"2026-08-14T04:35:15.735524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:18.204916Z","title":null,"venue":null,"work_id":"05c11c01-3528-4936-81a5-9ec4f17548fb","year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.760755Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:d84342e7bafdc50d8de10e0ce81b4593b64e78388feea48caa0d5a6a0e0484d9","observation_id":"3559dda8-48df-4dfe-80b6-4493ae5e8782","resolution":{"observed_at":"2026-08-14T04:35:18.225417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:18.131583Z","title":"In: Proceed- ings of the 2025 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"6f35c31b-5ae7-4bda-9168-d207f01174d5","year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.785758Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:98ca742a45b476206a4e2b45a5b219e38d93a074a59525652a51d4a99a029259","observation_id":"f4de36a2-c469-4a08-acd9-1db5f1dad8f7","resolution":{"observed_at":"2026-08-14T04:35:18.156551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:18.054822Z","title":"In: IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2024, Seattle, WA, USA, June 16-22, 2024","venue":null,"work_id":"357269d1-644e-4a35-9542-b01e72033365","year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.816410Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:3e7abf4fe62e5c3059b6630ddf42eac5269d315aa39beacab7dac800f1d55c8a","observation_id":"e684fabd-5f7a-4e36-aceb-fd442bce113d","resolution":{"observed_at":"2026-08-14T04:35:18.074749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.999043Z","title":null,"venue":null,"work_id":"4a22feb2-69f5-4163-af93-da92e82023c8","year":2023},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.844751Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:076d51b87f529bdf9f22ffb20094bb386dd622dbb83ccadc00ff9ed2e5b9f744","observation_id":"d57884e4-b88c-44fb-af9e-63a36dd5942d","resolution":{"observed_at":"2026-08-14T04:35:18.010291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:15.866323Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.866323Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:03178740900f686f85579cd3019ddb7fd26c5fb04d76628e870de794e865076a","observation_id":"bd2f1e6f-8e4e-4c0d-b432-26a5aa275d7f","resolution":{"observed_at":"2026-08-14T04:35:15.866323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:15.886038Z","title":"In: The 36th Conference on Neural Information Processing Systems (NeurIPS) (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.886038Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:e3c3d9cac1bfd34a58db7de844daa50d04526409d32c5c667a51d43f35d34f09","observation_id":"fe73d3ad-4ecb-4006-bc2f-852852f0f243","resolution":{"observed_at":"2026-08-14T04:35:15.886038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20797","last_updated":"2024-06-17T17:51:50Z","snapshot_observed_at":"2026-08-16T13:47:26.506119Z","submitted_at":"2024-05-31T13:59:18Z","title":"Ovis: Structural Embedding Alignment for Multimodal Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20797","snapshot_observed_at":"2026-08-14T04:35:15.914749Z","title":"arXiv:2405.20797 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.914749Z"},"links":{"cited_paper":"/paper/2405.20797","citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:0054016b9408bf4f6e195f9215a3c078b2618f045b9663606f9804a79198dcfa","observation_id":"1836c33e-29ea-4d80-8e5c-30e8cb31dd43","resolution":{"observed_at":"2026-08-14T04:35:15.914749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:15.958770Z","title":"In: Proceedings of the IEEE/cvf conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.958770Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:349425200fbfe377822fbea1ebd2bd276ad92a05720ca804351b70bb6f4b0a98","observation_id":"8fe1d68d-42f9-4d30-a89a-d2ba0e5f70a9","resolution":{"observed_at":"2026-08-14T04:35:15.958770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.930267Z","title":"Ad- vances in Neural Information Processing Systems37, 23464–23487 (2024)","venue":null,"work_id":"4a9c1467-3453-4167-ba5f-8d5473e84463","year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.981951Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:68f178e38fe838dffe66ee799be018237d845052af7bce37d4ed2cd018e34f65","observation_id":"9da1edd0-9993-44ba-9d64-9fce080af682","resolution":{"observed_at":"2026-08-14T04:35:17.945853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.890047Z","title":"Advances in Neural Information Processing Systems36, 19327–19352 (2023)","venue":null,"work_id":"d493f8be-2cac-4a12-b0eb-ca65e92635d9","year":2023},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:15.988857Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:1899d9fb400d395f34a4b6c280af3f65bbeb99ac86629bf3565610e5a50c196b","observation_id":"d9a5c425-d43d-4b40-a662-9c97b7f22393","resolution":{"observed_at":"2026-08-14T04:35:17.897656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.867383Z","title":"In: Proceedings of the 38th In- ternational Conference on Machine Learning, ICML 2021, 18-24 July 2021, Virtual Event","venue":null,"work_id":"e4ccae23-09e4-44ad-993b-d198098ecda9","year":2021},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.001548Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:9aabb5d7b3193647bd311653e7ae5a4e3b32893410dd732511b7cdd27732bec1","observation_id":"7708feb5-12ae-4093-a468-77571bdacf3d","resolution":{"observed_at":"2026-08-14T04:35:17.874078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:16.044369Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.044369Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:cf8cf7edd6734340cb2ac9c07d9286dd2279efcd74efb91fc2cad474bd705d5a","observation_id":"5bbadd6d-dd88-4e12-8551-5a5c8d48cf4b","resolution":{"observed_at":"2026-08-14T04:35:16.044369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18532","last_updated":"2024-05-15T05:43:30Z","snapshot_observed_at":"2026-08-16T13:57:03.069039Z","submitted_at":"2024-04-29T09:19:05Z","title":"MileBench: Benchmarking MLLMs in Long Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18532","snapshot_observed_at":"2026-08-14T04:35:16.084829Z","title":"CoRRabs/2404.18532(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.084829Z"},"links":{"cited_paper":"/paper/2404.18532","citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:9bd3d1260e7498d9bd3a91cc7d1871fc6d7506247cf560bdbc37eb9d09a4cdc2","observation_id":"fd899c07-f931-4156-99e6-0be3770c81d0","resolution":{"observed_at":"2026-08-14T04:35:16.084829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.846251Z","title":"In: Advances in Neural Information Processing Systems 30: Annual Conference on Neural Information Processing Sys- tems 2017, December 4-9, 2017, Long Beach, CA, USA","venue":null,"work_id":"ac240b92-a3ba-4697-b3df-eecdb0e031ac","year":2017},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.110955Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:0db3601dc96cdcb64b7e8c33bdcdfc533e6a5a943c35f4915b0ecca64b36857d","observation_id":"121c3dc9-43dd-4310-8dee-105047108592","resolution":{"observed_at":"2026-08-14T04:35:17.851079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.807995Z","title":null,"venue":null,"work_id":"0e79c012-fd19-43b9-ae09-87c624016069","year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.133619Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:15e24d50c81fc8ba8159a9c9aaeedf1749ed7ff08a9fa2ef6bfad3f159630f19","observation_id":"819774fa-1a55-4461-a189-63ec4f6a0ede","resolution":{"observed_at":"2026-08-14T04:35:17.816481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:16.155057Z","title":"CoRRabs/2409.02889 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.155057Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:f3990c491d093e9005cfa7f063b4aae781904046e8a8b223bcc0135b35985e58","observation_id":"b76fe6c6-3d31-4f40-9d17-b97dc9f006f0","resolution":{"observed_at":"2026-08-14T04:35:16.155057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:16.184694Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.184694Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:37394b0cfbed0b1edfb72e1576b52cd1d05e4559be430887f6181986cfe9edb4","observation_id":"aba2ce28-2469-408a-a4a9-8677af6a749a","resolution":{"observed_at":"2026-08-14T04:35:16.184694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.788879Z","title":"In: The Thirteenth International Conference on Learning Representations, ICLR 2025, Singapore, April 24-28, 2025","venue":null,"work_id":"384c4900-e121-4416-a249-59b6c668180f","year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.208606Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:acf25fa73794f65294eaf563df0289317431097d461e5cbd073415eb8d1aedc5","observation_id":"3f4abad7-d502-49f8-900a-8bd607fbaf82","resolution":{"observed_at":"2026-08-14T04:35:17.793380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.764752Z","title":"In: IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2025, Nashville, TN, USA, June 11-15, 2025","venue":null,"work_id":"13c15f30-2406-405b-9fe1-9b0c10df57af","year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.225223Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:4e188e061075902ca4def7a182b9d33ccddfc6b5bb04284d354c596aca21b570","observation_id":"804dfcdb-dd59-4a18-bf1e-dee5c3c431c8","resolution":{"observed_at":"2026-08-14T04:35:17.777913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.731777Z","title":"In: The Thirteenth International Conference on Learning Representations, ICLR 2025, Singapore, April 24-28, 2025","venue":null,"work_id":"cbff25fc-5409-429f-a6a6-0dda954662c3","year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.256406Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:6f944401ba2b525d5f479259b396e5e7ba069e3411328f2af871542cfefc3b39","observation_id":"bc628f83-b4f6-4589-9df7-94dd67a4b2b2","resolution":{"observed_at":"2026-08-14T04:35:17.741675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:16.305034Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.305034Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:86b13c8920093312edf70fd5027e8a8125f8bc74904f9d9349ea31480ee7d8a4","observation_id":"4856ed6c-cdc1-435d-8bc5-c19f1a8babe0","resolution":{"observed_at":"2026-08-14T04:35:16.305034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.01548","last_updated":"2025-08-03T02:15:43Z","snapshot_observed_at":"2026-08-08T11:58:42.307183Z","submitted_at":"2025-08-03T02:15:43Z","title":"A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.01548","snapshot_observed_at":"2026-08-14T04:35:16.326920Z","title":"CoRR abs/2508.01548(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.326920Z"},"links":{"cited_paper":"/paper/2508.01548","citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:d0b8cce1c4afc78c83c17b0c884ff18a6f272f81f0c3212f605ff8c42ea2c19c","observation_id":"44b6d593-8a6b-4df9-b18c-86ef48646009","resolution":{"observed_at":"2026-08-14T04:35:16.326920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:16.332341Z","title":"In: Findings of the Association for Computational Linguis- tics: NAACL 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.332341Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:94838bc535e8bb3b8610ef43e7e8b79d2e8eea7ad562057abcc7947e21cfd053","observation_id":"b4ee590a-6bb5-4c9b-8ebc-a9d9b5fc6695","resolution":{"observed_at":"2026-08-14T04:35:16.332341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.679288Z","title":"In: The Thirteenth International Conference on Learning Representations, ICLR 2025, Singapore, April 24-28, 2025","venue":null,"work_id":"4fae590e-e94b-4b04-b16e-e15c5724d883","year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.337191Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:648f77b9ab9f5d9160f292d5f061a8d9b5cb2fb3086e2877795ea95c5e2fb8fe","observation_id":"2f5d6e27-df25-423f-a10a-2199d08edd4d","resolution":{"observed_at":"2026-08-14T04:35:17.694734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.13276","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:16.704751Z","title":"prune-and-forget","venue":null,"work_id":"b3f328da-084d-4b94-992b-a9fb878a5613","year":2025},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.347757Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:da47e5c6b18c471759976dd787d03856ac318196a432f0e3f9542756f10f7e81","observation_id":"93688644-706c-49bb-b358-d10b8a5b0af4","resolution":{"observed_at":"2026-08-14T04:35:16.784763Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.659371Z","title":null,"venue":null,"work_id":"d4adb311-d0f9-461e-81f3-688f2b319e15","year":null},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.357985Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:641368914eb1e02c1478840c638337dff92e7b73c04a533865eed135d3b9ff31","observation_id":"275525de-2c19-4f03-8a4f-4a03960c3ada","resolution":{"observed_at":"2026-08-14T04:35:17.664170Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.582204Z","title":null,"venue":null,"work_id":"b741cbea-b738-45f0-8e87-0cafbbf9ee0f","year":null},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.362662Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:05c8d4fc641d2e8170f459b98f20cb5d9b9572ce73b39ee55d25f65c71c9f7d1","observation_id":"da3ec1a0-ee96-47a1-a4a3-961f7523aa9b","resolution":{"observed_at":"2026-08-14T04:35:17.604564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.526800Z","title":null,"venue":null,"work_id":"cbfe464f-aff1-48a8-893a-48252aa0c8ad","year":null},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.367307Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:10007eb3c655db185bc1f34c653feb3207a62973329331c8b55745ee0f207b25","observation_id":"78d5c5c6-b06b-445b-97b0-1822e4618a00","resolution":{"observed_at":"2026-08-14T04:35:17.547276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.461684Z","title":"half right","venue":null,"work_id":"3bfd44ed-f407-403e-8f3d-2211c0ef31f5","year":null},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.371643Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:a6e1937a0aea93c71e936ca81a5ee9d54b8048c0d970b8d48db15e5a7825f2e7","observation_id":"245005b5-6307-4177-887c-b6c2ae79e46a","resolution":{"observed_at":"2026-08-14T04:35:17.476037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:17.336138Z","title":"score\" (an integer from 0 to 10) and “justification","venue":null,"work_id":"efe0376e-412f-46d8-a27d-2aa9b1fc8368","year":null},"citing_paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:16.391111Z"},"links":{"citing_paper":"/paper/2608.08630"},"observation_digest":"sha256:3745e60e44abeebf97d15ae80887061ee195c853ba6f9737c2fc6ce16ddaf5d1","observation_id":"99fdd81a-3e1e-48cc-ab05-7f3aac2ed0d4","resolution":{"observed_at":"2026-08-14T04:35:17.374752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08630","last_updated":"2026-08-09T10:31:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T00:02:01.135216Z","submitted_at":"2026-08-09T10:31:03Z","title":"VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":25,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2608.08630."}