{"as_of":"2026-08-08T02:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5ec10135dfc07d5220b1796a4c8c3ba3eaeb4a49cf1ea3f82bce1f2e89bd0cd1","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:16:20.927090Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T06:03:03.062322Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T07:58:07.594523Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"cited_work":{"arxiv_id":"2505.19602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19602","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memory-efficient visual au- toregressive modeling with scale-aware kv cache compression","venue":null,"work_id":"749ed683-89fb-49a6-b565-8f46daab3fe4","year":2025},"citing_paper":{"arxiv_id":"2605.01220","last_updated":"2026-07-06T12:26:12Z","snapshot_observed_at":"2026-07-12T17:51:44.757848Z","submitted_at":"2026-05-02T03:23:17Z","title":"Visual Implicit Autoregressive Modeling","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-09T15:20:03.981830Z"},"links":{"cited_paper":"/paper/2505.19602","citing_paper":"/paper/2605.01220"},"observation_digest":"sha256:0194b1bce5a93ffa690bca09927756a92655eb49f505c80c38b2f27aa4f9f780","observation_id":"1a3ca253-3931-42c1-bdfb-79ffa010f511","resolution":{"observed_at":"2026-05-11T16:41:18.325747Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"cited_work":{"arxiv_id":"2505.19602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19602","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memory-efficient visual au- toregressive modeling with scale-aware kv cache compression","venue":null,"work_id":"749ed683-89fb-49a6-b565-8f46daab3fe4","year":2025},"citing_paper":{"arxiv_id":"2605.19660","last_updated":"2026-05-19T10:53:03Z","snapshot_observed_at":"2026-08-02T21:06:34.067413Z","submitted_at":"2026-05-19T10:53:03Z","title":"OScaR: The Occam's Razor for Extreme KV Cache Quantization in LLMs and Beyond","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T07:57:51.032025Z"},"links":{"cited_paper":"/paper/2505.19602","citing_paper":"/paper/2605.19660"},"observation_digest":"sha256:576ad4dc7193f4b4c90eb632e01fa187fbeed08f80b8169e58871080d677ed8f","observation_id":"348b6ba1-7a44-4b8c-91ef-076c5be59bb4","resolution":{"observed_at":"2026-05-20T07:58:07.596260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19602","snapshot_observed_at":"2026-08-04T06:03:03.062322Z","title":"arXiv preprint arXiv:2505.19602 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02504","last_updated":"2026-08-03T17:05:15Z","snapshot_observed_at":"2026-08-06T23:38:50.825846Z","submitted_at":"2026-08-03T17:05:15Z","title":"Token Radius Attention for Efficient Video Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T06:03:03.062322Z"},"links":{"cited_paper":"/paper/2505.19602","citing_paper":"/paper/2608.02504"},"observation_digest":"sha256:1b63b49d103e8bdb1065f3e75c5b1656cd71c150feb72dcb5dc88190b9c43761","observation_id":"14f8186d-8235-4945-ba0f-c792e5ebda9f","resolution":{"observed_at":"2026-08-04T06:03:03.062322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19602/citation-record","integrity":"/paper/2505.19602/integrity","json":"/paper/2505.19602/citation-record.json","paper":"/paper/2505.19602"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T14:16:12.031316Z","title":"Longformer: The long-document transformer.arXiv preprint arXiv:2004.05150, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.031316Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:21fa01a490def0b67fc7a9d92f2af67c48da282be8643eb06f8d4f5bb02c2478","observation_id":"293a0609-f139-43f6-8037-2b43a274623d","resolution":{"observed_at":"2026-08-07T14:16:12.031316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.089620Z","title":"Improving image generation with better captions.Computer Science","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.089620Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:ae3843c5e2d3cdad09d033bbdc22edb49e9702ba5eab2e4f8f2c62386767bb48","observation_id":"a6f5049a-cb1c-4012-92fc-54079f5ef1b7","resolution":{"observed_at":"2026-08-07T14:16:12.089620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-07T14:16:12.217814Z","title":"Pyramidkv: Dynamic kv cache compression based on pyramidal information funneling.arXiv preprint arXiv:2406.02069, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.217814Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:a8cb58349689a5dfbfbbab73c3596e780f777f05096ad02de55dd902105e82b2","observation_id":"dffea209-3858-47ca-a9a0-3affff8ba103","resolution":{"observed_at":"2026-08-07T14:16:12.217814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.340496Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.340496Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:622c2feb063b8689d1a4ef7a459214d6a59ed2ed71ae91ea0d73070f329a3d4e","observation_id":"e9ea3931-fa9a-4d77-8236-6c48319287f0","resolution":{"observed_at":"2026-08-07T14:16:12.340496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:24.018135Z","title":"PixArt-Sigma: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":"20219db7-c97f-4534-a900-b07e642c859b","year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.414680Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:40154148adbf6655966d3018d96358b7a573dbafd6ef3b0084b4d1e186d8952f","observation_id":"646555be-1f9c-4df6-9c80-d2e0bfdc8a28","resolution":{"observed_at":"2026-08-07T14:16:24.117531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.543575Z","title":"Generative pretraining from pixels","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.543575Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:83adc5a4e3905b6c1625f0cad1e6dc24daf5c8546ccb7638e4ffcfef53bda037","observation_id":"a14d7039-3002-422e-b24d-f6c3e6c903e8","resolution":{"observed_at":"2026-08-07T14:16:12.543575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17787","last_updated":"2024-11-26T15:13:15Z","snapshot_observed_at":"2026-07-06T19:57:33.013839Z","submitted_at":"2024-11-26T15:13:15Z","title":"Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17787","snapshot_observed_at":"2026-08-07T14:16:12.670870Z","title":"Collaborative decoding makes visual auto-regressive modeling efficient.arXiv preprint arXiv:2411.17787, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.670870Z"},"links":{"cited_paper":"/paper/2411.17787","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:184f94e257f16cd02ffb0b99714fc2bfb8afbdcbc0eca127e4cfd632c4306e91","observation_id":"aa1f79b0-8e6d-406e-8dfa-1e8a18d509a4","resolution":{"observed_at":"2026-08-07T14:16:12.670870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.835884Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.835884Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:5bba788de4e176286d3d694622dbaf77966bbf904ab7fb0142e76857f68439ae","observation_id":"0fad3e3f-9146-4a5f-beae-d73abe0a52dc","resolution":{"observed_at":"2026-08-07T14:16:12.835884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01199","last_updated":"2024-12-02T07:05:39Z","snapshot_observed_at":"2026-08-07T17:07:55.964734Z","submitted_at":"2024-12-02T07:05:39Z","title":"TinyFusion: Diffusion Transformers Learned Shallow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01199","snapshot_observed_at":"2026-08-07T14:16:13.014126Z","title":"Tinyfusion: Diffusion transformers learned shallow.arXiv preprint arXiv:2412.01199, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.014126Z"},"links":{"cited_paper":"/paper/2412.01199","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:a8b0a8870a49b09fbf7e258f5188ca3a94ed931b03837fd7ede4fe6b163e82a1","observation_id":"0a678a28-5f88-44c4-8487-7a8823fc6d0f","resolution":{"observed_at":"2026-08-07T14:16:13.014126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11550","last_updated":"2025-10-16T13:25:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-16T09:53:32Z","title":"Ada-KV: Optimizing KV Cache Eviction by Adaptive Budget Allocation for Efficient LLM Inference","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11550","snapshot_observed_at":"2026-08-07T14:16:13.138387Z","title":"Ada-kv: Optimizing kv cache eviction by adaptive budget allocation for efficient llm inference.arXiv preprint arXiv:2407.11550, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.138387Z"},"links":{"cited_paper":"/paper/2407.11550","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:309f5697d81d8e91bd8a19026f79e83239bf71bf1d5d5cc9a1bfdae249643424","observation_id":"2e6847e7-cbbb-4746-be02-7c97c4414363","resolution":{"observed_at":"2026-08-07T14:16:13.138387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:13.258212Z","title":"Not all heads matter: A head-level kv cache compression method with integrated retrieval and reasoning.arXiv preprint arXiv:2410.19258, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.258212Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:b81971309a26a9aa13f8e5e3252ef676fa2bde78433b66f785164a00d3df2f64","observation_id":"8fd9a677-964d-498e-8609-a9f486163db0","resolution":{"observed_at":"2026-08-07T14:16:13.258212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01801","last_updated":"2024-10-29T18:26:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T05:17:08Z","title":"Model Tells You What to Discard: Adaptive KV Cache Compression for LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01801","snapshot_observed_at":"2026-08-07T14:16:13.413395Z","title":"Model tells you what to discard: Adaptive kv cache compression for llms.arXiv preprint arXiv:2310.01801, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.413395Z"},"links":{"cited_paper":"/paper/2310.01801","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:2707e8e3ef7ddd5c2fa61022aeda65b1629d24ce61e5bea8db8e28dc05a1b117","observation_id":"814de7f5-fdf4-4a33-9933-76925e214302","resolution":{"observed_at":"2026-08-07T14:16:13.413395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.779438Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment","venue":null,"work_id":"2420255c-e93d-4cb9-848b-19ac06ef9c56","year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.530092Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:0940b305340aa60c0a219d0f35315be4883f09753e9aa5fa13dd59aa829dc6af","observation_id":"dc481280-ccd0-491c-af0e-50b4974a2be8","resolution":{"observed_at":"2026-08-07T14:16:23.862112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08159","last_updated":"2025-01-23T17:08:57Z","snapshot_observed_at":"2026-08-01T22:13:52.809109Z","submitted_at":"2024-10-10T17:41:54Z","title":"DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08159","snapshot_observed_at":"2026-08-07T14:16:13.622854Z","title":"Dart: Denoising autoregressive transformer for scalable text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.622854Z"},"links":{"cited_paper":"/paper/2410.08159","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:172a9bd765e12373281d4f7358264a5af5faf1abc36382f72255d4f346a013a0","observation_id":"22f15021-513d-40bb-a2ad-7b7af0fd1226","resolution":{"observed_at":"2026-08-07T14:16:13.622854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23367","last_updated":"2025-07-08T12:34:10Z","snapshot_observed_at":"2026-08-07T16:27:43.588160Z","submitted_at":"2025-03-30T08:51:19Z","title":"FastVAR: Linear Visual Autoregressive Modeling via Cached Token Pruning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23367","snapshot_observed_at":"2026-08-07T14:16:13.693484Z","title":"Fastvar: Linear visual autoregressive modeling via cached token pruning.arXiv preprint arXiv:2503.23367, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.693484Z"},"links":{"cited_paper":"/paper/2503.23367","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:819fd18a685df845c6873a4a43d38492096a0f56c2738b626c1bfcc0c61365e3","observation_id":"0d51690e-64bf-4e93-9317-19ab2db69ce6","resolution":{"observed_at":"2026-08-07T14:16:13.693484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:13.770499Z","title":"Infinity: Scaling bitwise autoregressive modeling for high-resolution image synthesis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.770499Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:6f10162e83c1c2c7a935de806bea315b9c006a645de03313b6f709ea0cc176ac","observation_id":"c8144f2e-57d3-4053-bc65-a0aff67de974","resolution":{"observed_at":"2026-08-07T14:16:13.770499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14256","last_updated":"2024-05-23T07:37:16Z","snapshot_observed_at":"2026-07-06T18:18:21.334080Z","submitted_at":"2024-05-23T07:37:16Z","title":"ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14256","snapshot_observed_at":"2026-08-07T14:16:13.857590Z","title":"Zipcache: Accurate and efficient kv cache quantization with salient token identification.arXiv preprint arXiv:2405.14256, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.857590Z"},"links":{"cited_paper":"/paper/2405.14256","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:679cdc0c7154262af059a1d1f4dcff8ce43fb05a46fd0e27c3ad0cae2f32acf4","observation_id":"e9cccbfa-a369-4d8f-bf85-2dddd7291d5f","resolution":{"observed_at":"2026-08-07T14:16:13.857590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:13.948063Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.948063Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:cc47f8eb4e5764f5e0f579011a89a8c6893a7b559b61175590e033871bddca5d","observation_id":"90c1a4be-0e2a-4a36-8855-c9899a98340c","resolution":{"observed_at":"2026-08-07T14:16:13.948063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T14:16:14.033748Z","title":"Distilling the knowledge in a neural network.arXiv preprint arXiv:1503.02531, 2(7), 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.033748Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:dff3f4b301c981735913d876a98615be7ffd32d026dbc58c91ccd4f14cc00764","observation_id":"b128b49e-cda3-4642-9df2-5a338a5297d4","resolution":{"observed_at":"2026-08-07T14:16:14.033748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-04T23:51:18.339338Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-07T14:16:14.124213Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment.arXiv preprint arXiv:2403.05135, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.124213Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:0d40bbedb0b948e0598d2d2a0679de0e621df1f8ce9dc94843cc07856579f454","observation_id":"a26ea0ad-6364-4f16-92b9-5d354a338c16","resolution":{"observed_at":"2026-08-07T14:16:14.124213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:16:14.194123Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.194123Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:3321a8191896f2b2fbf56ceeef676e425911944bd43c643dba88fdd1bb960d78","observation_id":"e4045744-1d75-4e87-b00d-b7d213d10524","resolution":{"observed_at":"2026-08-07T14:16:14.194123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05527","last_updated":"2024-09-30T22:44:58Z","snapshot_observed_at":"2026-08-07T12:20:18.370756Z","submitted_at":"2024-03-08T18:48:30Z","title":"GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05527","snapshot_observed_at":"2026-08-07T14:16:14.282281Z","title":"Gear: An efficient kv cache compression recipefor near-lossless generative inference of llm.arXiv preprint arXiv:2403.05527, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.282281Z"},"links":{"cited_paper":"/paper/2403.05527","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:0b5fc3b9da8cacaf76111ee3e60a73697cfec37488c6f925085f97b76970ae0d","observation_id":"38eff18d-581c-469e-8f75-d9b88ac6bfaf","resolution":{"observed_at":"2026-08-07T14:16:14.282281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:14.444559Z","title":"Scalable autoregressive image generation with mamba.arXiv preprint arXiv:2408.12245, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.444559Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:de5893a6c998c711b33eca503e6c7f1f8fab226a852740cccb41550688b91925","observation_id":"c1402ed7-f490-4546-badd-4fd7f608e0b5","resolution":{"observed_at":"2026-08-07T14:16:14.444559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:14.611793Z","title":"Svdquant: Absorbing outliers by low-rank components for 4-bit diffusion models.arXiv preprint arXiv:2411.05007, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.611793Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:169883a0dff73d8251cb371368b6cbde9864819618ed4fd87ca5a9b06bb22802","observation_id":"2b8bf013-ee0a-40cf-bd57-999abc287a7f","resolution":{"observed_at":"2026-08-07T14:16:14.611793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09608","last_updated":"2024-10-15T07:11:11Z","snapshot_observed_at":"2026-08-03T01:47:19.174467Z","submitted_at":"2023-12-15T08:46:43Z","title":"Faster Diffusion: Rethinking the Role of the Encoder for Diffusion Model Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09608","snapshot_observed_at":"2026-08-07T14:16:14.731278Z","title":"Faster diffusion: Rethinking the role of unet encoder in diffusion models.arXiv preprint arXiv:2312.09608, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.731278Z"},"links":{"cited_paper":"/paper/2312.09608","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:f5c08d36bf0e1ded57d1ca494a3a179971fd1620a624709b41fbd5521ca93099","observation_id":"06423f51-cfd0-4ae9-88ef-0b4c16487a02","resolution":{"observed_at":"2026-08-07T14:16:14.731278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-07T14:16:14.884901Z","title":"Autoregressive image generation without vector quantization.arXiv preprint arXiv:2406.11838, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.884901Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:8de34aaf1857539f9e361fefcb7151ecf50cbed575f93616036a6444716b3d66","observation_id":"cb8defb5-873d-46e9-9eb1-3f9540d81714","resolution":{"observed_at":"2026-08-07T14:16:14.884901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09750","last_updated":"2024-10-02T02:10:26Z","snapshot_observed_at":"2026-07-06T18:30:46.405694Z","submitted_at":"2024-06-14T06:35:33Z","title":"ControlVAR: Exploring Controllable Visual Autoregressive Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09750","snapshot_observed_at":"2026-08-07T14:16:15.022702Z","title":"Controlvar: Exploring controllable visual autoregressive modeling.arXiv preprint arXiv:2406.09750, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.022702Z"},"links":{"cited_paper":"/paper/2406.09750","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:d0362a61b48de9a284f77a591c759c942fabe0f7da265cc648f5a65fcdd5e209","observation_id":"62903964-d2cc-40eb-8e34-f2ca28e166b2","resolution":{"observed_at":"2026-08-07T14:16:15.022702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:15.125418Z","title":"Q-diffusion: Quantizing diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.125418Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:b1eb66f4726242b614a77fb3528aabbbd7cdf2208ab8fd0c428025e521e0d8b5","observation_id":"4026be12-2d5f-44b1-a227-95b768acf7cd","resolution":{"observed_at":"2026-08-07T14:16:15.125418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.449716Z","title":"Snapfusion: Text-to-image diffusion model on mobile devices within two seconds.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"9a6b9984-52f8-4218-bd68-664cc0ec5587","year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.281994Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:75a8dc9c5e1e3d700b45afd559a5fed9e69d140035dd92b1ce399a93d033cd14","observation_id":"29d6db59-5830-46f1-a198-ef87d091c6e3","resolution":{"observed_at":"2026-08-07T14:16:23.563170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-08-07T22:57:56.263839Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-08-07T14:16:15.378042Z","title":"Snapkv: Llm knows what you are looking for before generation.arXiv preprint arXiv:2404.14469, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.378042Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:e91b472b4bc6df86910738914e7d6eb3d8cb0925c54ae6ae1bd3b412c1187bbd","observation_id":"8e0543e4-440f-4b44-b65f-4a42fa18ac23","resolution":{"observed_at":"2026-08-07T14:16:15.378042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02705","last_updated":"2025-03-10T06:33:37Z","snapshot_observed_at":"2026-07-06T19:27:11.995338Z","submitted_at":"2024-10-03T17:28:07Z","title":"ControlAR: Controllable Image Generation with Autoregressive Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02705","snapshot_observed_at":"2026-08-07T14:16:15.523883Z","title":"Controlar: Controllable image generation with autoregressive models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.523883Z"},"links":{"cited_paper":"/paper/2410.02705","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:98a32495105d2924f36353745c7fac871e02f1bbf7c572dcab7fa6fb3abdba4c","observation_id":"6fd371e8-a244-47b5-b834-3ef570d38900","resolution":{"observed_at":"2026-08-07T14:16:15.523883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:15.657471Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.657471Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:4302c334f668d0b1525dc0ba6551ef768c347cc5de42df0f3ae7a8118c0e7413","observation_id":"a495cb52-b5cc-4ba3-9c05-bbf931b8765b","resolution":{"observed_at":"2026-08-07T14:16:15.657471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14366","last_updated":"2024-09-07T02:52:29Z","snapshot_observed_at":"2026-08-04T12:08:53.387357Z","submitted_at":"2024-05-23T09:43:52Z","title":"MiniCache: KV Cache Compression in Depth Dimension for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14366","snapshot_observed_at":"2026-08-07T14:16:15.805734Z","title":"Minicache: Kv cache compression in depth dimension for large language models.arXiv preprint arXiv:2405.14366, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.805734Z"},"links":{"cited_paper":"/paper/2405.14366","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:4d01ff11499cdd0f490b9b70203ad07f8db365d3cf42e55f0e6cd9ac9618fdf2","observation_id":"46aec037-8f7c-40db-bf10-3ec3a2194891","resolution":{"observed_at":"2026-08-07T14:16:15.805734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02657","last_updated":"2025-04-24T16:16:27Z","snapshot_observed_at":"2026-08-05T15:40:56.937227Z","submitted_at":"2024-08-05T17:46:53Z","title":"Lumina-mGPT: Illuminate Flexible Photorealistic Text-to-Image Generation with Multimodal Generative Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02657","snapshot_observed_at":"2026-08-07T14:16:15.891755Z","title":"Lumina-mgpt: Illuminate flexible photorealistic text-to-image generation with multimodal generative pretraining.arXiv preprint arXiv:2408.02657, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.891755Z"},"links":{"cited_paper":"/paper/2408.02657","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:ca55fccdc279bf2cbe4374a3c03aa0ad5a162252d074209a0aeaafed4cd4d39d","observation_id":"1adb9af2-121c-41eb-81d2-c622f8fed257","resolution":{"observed_at":"2026-08-07T14:16:15.891755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:16.016184Z","title":"Scissorhands: Exploiting the persistence of importance hypothesis for llm kv cache compression at test time.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.016184Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:0ad6d563a36b771e9f9bd27d05e047421820c62f7ed10a6a5308eeca000875a5","observation_id":"bebf9bab-5a0c-4ab4-b687-370c985bcc0a","resolution":{"observed_at":"2026-08-07T14:16:16.016184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02750","last_updated":"2024-07-25T09:16:05Z","snapshot_observed_at":"2026-07-06T17:25:18.238343Z","submitted_at":"2024-02-05T06:06:47Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02750","snapshot_observed_at":"2026-08-07T14:16:16.195264Z","title":"Kivi: A tuning-free asymmetric 2bit quantization for kv cache.arXiv preprint arXiv:2402.02750, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.195264Z"},"links":{"cited_paper":"/paper/2402.02750","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:90e01763471b4c62d45ea1c2c443460ed189a0a5eff90c8ca3b718edc6c208ac","observation_id":"6c237317-f6f2-4a3b-8185-92f5aef59083","resolution":{"observed_at":"2026-08-07T14:16:16.195264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-07T14:16:16.358206Z","title":"Latent consistency models: Synthesizing high-resolution images with few-step inference.arXiv preprint arXiv:2310.04378, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.358206Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:d2a82c016c26a466aa2b9bc33b385e8fbffd7a66a21a39d1ceb258938f16d770","observation_id":"f0675899-2855-42d8-8823-4a6794e46234","resolution":{"observed_at":"2026-08-07T14:16:16.358206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04410","last_updated":"2025-02-09T08:59:19Z","snapshot_observed_at":"2026-08-06T03:43:29.067278Z","submitted_at":"2024-09-06T17:14:53Z","title":"Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04410","snapshot_observed_at":"2026-08-07T14:16:16.536400Z","title":"Open-magvit2: An open- source project toward democratizing auto-regressive visual generation.arXiv preprint arXiv:2409.04410, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.536400Z"},"links":{"cited_paper":"/paper/2409.04410","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:b10ac39831953d5d5f5b0c8709d1e47220197fec4ac5d91c3b2a8f726cbafa05","observation_id":"d5edde25-459b-4fdb-8432-9e94b657d3a9","resolution":{"observed_at":"2026-08-07T14:16:16.536400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12524","last_updated":"2022-05-30T03:13:08Z","snapshot_observed_at":"2026-07-06T13:13:40.650733Z","submitted_at":"2022-05-25T06:40:09Z","title":"Accelerating Diffusion Models via Early Stop of the Diffusion Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12524","snapshot_observed_at":"2026-08-07T14:16:16.665647Z","title":"Accelerating diffusion models via early stop of the diffusion process.arXiv preprint arXiv:2205.12524, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.665647Z"},"links":{"cited_paper":"/paper/2205.12524","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:1c76dd37e636f3865832879110e66971efad2855df479a78606bfbdae1b43f38","observation_id":"6133ddb2-fc52-429d-8bbf-4dcf6ebadf01","resolution":{"observed_at":"2026-08-07T14:16:16.665647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10797","last_updated":"2025-02-19T06:00:55Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T03:45:45Z","title":"STAR: Scale-wise Text-conditioned AutoRegressive image generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10797","snapshot_observed_at":"2026-08-07T14:16:16.780411Z","title":"Star: Scale-wise text-to-image generation via auto-regressive representations.arXiv preprint arXiv:2406.10797, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.780411Z"},"links":{"cited_paper":"/paper/2406.10797","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:c4d57fe0dfe4ca169043f3b9b911047bd040ee6a834af742308df1094474dca6","observation_id":"4eb1f813-b788-4468-b191-0668b04482d3","resolution":{"observed_at":"2026-08-07T14:16:16.780411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00858","last_updated":"2023-12-07T17:24:18Z","snapshot_observed_at":"2026-07-06T16:55:49.813116Z","submitted_at":"2023-12-01T17:01:06Z","title":"DeepCache: Accelerating Diffusion Models for Free","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00858","snapshot_observed_at":"2026-08-07T14:16:16.890592Z","title":"Deepcache: Accelerating diffusion models for free.arXiv preprint arXiv:2312.00858, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.890592Z"},"links":{"cited_paper":"/paper/2312.00858","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:bcaee91b8ccd19cca949bec805e7d0405b28220a225eaf0f9cf9ffdca182b3b3","observation_id":"2eec77e1-4b91-470e-85ac-3b668055466b","resolution":{"observed_at":"2026-08-07T14:16:16.890592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06104","last_updated":"2024-06-18T09:16:14Z","snapshot_observed_at":"2026-08-07T11:50:21.011836Z","submitted_at":"2024-01-11T18:35:26Z","title":"Transformers are Multi-State RNNs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06104","snapshot_observed_at":"2026-08-07T14:16:17.009571Z","title":"Transformers are multi-state rnns.arXiv preprint arXiv:2401.06104, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.009571Z"},"links":{"cited_paper":"/paper/2401.06104","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:976a460a9505a63d42aa2528e8ec6101e0f112c84f8cb321f13816d7fbac0f36","observation_id":"c33b358f-77c5-4223-bb69-6eaff1831127","resolution":{"observed_at":"2026-08-07T14:16:17.009571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T14:16:17.118171Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.118171Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:ac51afe2efd964fa69eb865190f66ca67a3bfb2b41d7cbdaa9f0e3fbfb1b55f9","observation_id":"3c17afa5-d337-45c2-9e6c-6c4729a30143","resolution":{"observed_at":"2026-08-07T14:16:17.118171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.201417Z","title":"Head-aware kv cache compression for efficient visual autoregressive modeling.arXiv preprint arXiv:2504.09261, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.201417Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:aeaf9e6ab6ab7d6faf0b4230369f71921d96510a79794a13ec972abd1f3841cf","observation_id":"ba685361-ef66-4fa7-89e4-8b276a81e4f1","resolution":{"observed_at":"2026-08-07T14:16:17.201417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09027","last_updated":"2024-12-16T21:50:56Z","snapshot_observed_at":"2026-07-06T19:01:45.542387Z","submitted_at":"2024-08-16T21:48:53Z","title":"Efficient Autoregressive Audio Modeling via Next-Scale Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09027","snapshot_observed_at":"2026-08-07T14:16:17.266768Z","title":"Efficient autoregressive audio modeling via next-scale prediction.arXiv preprint arXiv:2408.09027, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.266768Z"},"links":{"cited_paper":"/paper/2408.09027","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:a324b329144d176cda8be89938182dc8c036af25dd21fb220a333c1847a4c447","observation_id":"e9c6dae5-05e4-4040-a6e6-e81f9537114c","resolution":{"observed_at":"2026-08-07T14:16:17.266768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06262","last_updated":"2024-02-17T10:08:14Z","snapshot_observed_at":"2026-08-03T16:19:48.429086Z","submitted_at":"2024-02-09T09:20:59Z","title":"On the Efficacy of Eviction Policy for Key-Value Constrained Generative Language Model Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06262","snapshot_observed_at":"2026-08-07T14:16:17.384573Z","title":"On the efficacy of eviction policy for key-value constrained generative language model inference.arXiv preprint arXiv:2402.06262, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.384573Z"},"links":{"cited_paper":"/paper/2402.06262","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:8001b77cf2dca004726d5deec92cefda0abfb411517a60239119890b02ba3558","observation_id":"c21181a6-5cea-470f-a97a-05134b04e7ca","resolution":{"observed_at":"2026-08-07T14:16:17.384573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00512","last_updated":"2022-06-07T09:17:35Z","snapshot_observed_at":"2026-07-06T12:33:23.843893Z","submitted_at":"2022-02-01T16:07:25Z","title":"Progressive Distillation for Fast Sampling of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00512","snapshot_observed_at":"2026-08-07T14:16:17.490839Z","title":"Progressive distillation for fast sampling of diffusion models.arXiv preprint arXiv:2202.00512, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.490839Z"},"links":{"cited_paper":"/paper/2202.00512","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:8e8711b96f1aa92d59c36d65ffac3e49ceca982bbed35b4d7444df2f4ec08ef3","observation_id":"4a14f778-46c6-4d1f-a4ec-dcbf3ab8e720","resolution":{"observed_at":"2026-08-07T14:16:17.490839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17042","last_updated":"2023-11-28T18:53:24Z","snapshot_observed_at":"2026-07-06T16:53:58.875152Z","submitted_at":"2023-11-28T18:53:24Z","title":"Adversarial Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17042","snapshot_observed_at":"2026-08-07T14:16:17.578156Z","title":"Adversarial diffusion distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.578156Z"},"links":{"cited_paper":"/paper/2311.17042","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:55fd5643e3ad2938945d8bff66d55ac08b8ec8e2228fed76c7158c229e101e56","observation_id":"aa9df552-5935-49c0-8aa1-7d1032654f6d","resolution":{"observed_at":"2026-08-07T14:16:17.578156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.679607Z","title":"Post-training quantization on diffusion models","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.679607Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:2ce98edc671a60000835d4745d9b81c5281d029fd6245fafa7473906832d27e7","observation_id":"3d0a08cb-ef61-469a-b213-c19bf6a9ab4c","resolution":{"observed_at":"2026-08-07T14:16:17.679607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03517","last_updated":"2024-09-02T08:30:37Z","snapshot_observed_at":"2026-07-06T16:57:46.724781Z","submitted_at":"2023-12-06T14:24:26Z","title":"FRDiff : Feature Reuse for Universal Training-free Acceleration of Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03517","snapshot_observed_at":"2026-08-07T14:16:17.772212Z","title":"Frdiff: Feature reuse for exquisite zero-shot acceleration of diffusion models.arXiv preprint arXiv:2312.03517, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.772212Z"},"links":{"cited_paper":"/paper/2312.03517","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:45aa722324c0fc9ca6696ada07be266875ca9ebe9088542d9f8d08e607a0cc6b","observation_id":"a8693224-84aa-45a6-b7c3-dfc107049171","resolution":{"observed_at":"2026-08-07T14:16:17.772212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T14:16:18.009369Z","title":"Autore- gressive model beats diffusion: Llama for scalable image generation.arXiv preprint arXiv:2406.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.009369Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:5e758a91f4eacb0a323ffdc8591dec5d16bd96bc46a0e2ea8a5bedbb83ee0d6c","observation_id":"353a2226-eed9-4e36-903e-a49527443e35","resolution":{"observed_at":"2026-08-07T14:16:18.009369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10812","last_updated":"2024-10-14T17:59:42Z","snapshot_observed_at":"2026-08-07T19:45:45.522836Z","submitted_at":"2024-10-14T17:59:42Z","title":"HART: Efficient Visual Generation with Hybrid Autoregressive Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10812","snapshot_observed_at":"2026-08-07T14:16:18.127539Z","title":"HART: Efficient visual generation with hybrid autoregressive transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.127539Z"},"links":{"cited_paper":"/paper/2410.10812","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:caf13fd85ca682794463865fab33b4184c54c743869dc99d4c4bc0e9c81f7918","observation_id":"a8d75859-c32a-486a-af2c-e1c44e89e10f","resolution":{"observed_at":"2026-08-07T14:16:18.127539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.201368Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction.Advances in neural information processing systems, 37:84839–84865, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.201368Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:6e115d9535daaba0800be92ee43a12f3066c9366c1ecf4f5bf6d601f06a3546a","observation_id":"4080b004-8286-4e92-9045-62ccd4f9bc2c","resolution":{"observed_at":"2026-08-07T14:16:18.201368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.298675Z","title":"Conditional image generation with pixelcnn decoders.Advances in neural information processing systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.298675Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:8e14b8ddcbe30476f7e75969ccb65a471b7f4a2cb71fd0d78584da6b18558bab","observation_id":"456bd8c8-8727-471a-935e-d761f58b42f2","resolution":{"observed_at":"2026-08-07T14:16:18.298675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.412301Z","title":"Neural discrete representation learning.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.412301Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:2c7569fdc953e5cfeb77ae6dcfce1a33b7839c73ea59f2072cd275d5993efa86","observation_id":"1cb61cd6-bea0-49cc-9630-78d1767074d0","resolution":{"observed_at":"2026-08-07T14:16:18.412301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13035","last_updated":"2025-03-13T03:16:43Z","snapshot_observed_at":"2026-08-05T10:25:57.608223Z","submitted_at":"2024-06-18T20:01:51Z","title":"D2O: Dynamic Discriminative Operations for Efficient Long-Context Inference of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13035","snapshot_observed_at":"2026-08-07T14:16:18.517957Z","title":"D2o: Dynamic discriminative operations for efficient generative inference of large language models.arXiv preprint arXiv:2406.13035, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.517957Z"},"links":{"cited_paper":"/paper/2406.13035","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:3da7bf2c4faa9e47814882600486e13d3df1c034d17cac8dbe305eb00cdb5836","observation_id":"735fab92-1f44-4700-825d-a90d83fc65a6","resolution":{"observed_at":"2026-08-07T14:16:18.517957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-07T14:16:18.606283Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference.arXiv preprint arXiv:2406.18139, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.606283Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:2a43241de6e75a21f625bb96f60414ae7ecf3170ae04bbd90c2afbce2ebb4d81","observation_id":"1cabc8b2-404d-4115-8940-3fe58a98ed21","resolution":{"observed_at":"2026-08-07T14:16:18.606283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-07T14:16:18.699512Z","title":"Emu3: Next-token prediction is all you need.arXiv preprint arXiv:2409.18869, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.699512Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:e6a348ef6fba5068e8e8b2ed3bb82f173750362cce6675186e57e1ab301fd4d3","observation_id":"aa87dea9-225f-47b8-8879-38d93ae314cb","resolution":{"observed_at":"2026-08-07T14:16:18.699512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03209","last_updated":"2024-01-12T09:26:45Z","snapshot_observed_at":"2026-07-06T16:57:30.263879Z","submitted_at":"2023-12-06T00:51:38Z","title":"Cache Me if You Can: Accelerating Diffusion Models through Block Caching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03209","snapshot_observed_at":"2026-08-07T14:16:18.760250Z","title":"Cache me if you can: Accelerating diffusion models through block caching.arXiv preprint arXiv:2312.03209, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.760250Z"},"links":{"cited_paper":"/paper/2312.03209","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:6785ef8a30c28c30067f01ef6a12807b96e1d407518e501373413de8270cf821","observation_id":"975c5e03-be46-46c4-8191-fea0a7ff031d","resolution":{"observed_at":"2026-08-07T14:16:18.760250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-07T14:16:18.842698Z","title":"Janus: Decoupling visual encoding for unified multimodal understanding and generation.arXiv preprint arXiv:2410.13848, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.842698Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:5c0927bc0d25a7ba7b44be596e77259b2d15e74bde2dc0c2f7de80dad0f3ca93","observation_id":"e9eb3f00-e6d4-4429-849e-e68f1db1311f","resolution":{"observed_at":"2026-08-07T14:16:18.842698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-07T14:16:18.961783Z","title":"VILA-U: A unified foundation model integrating visual understanding and generation.arXiv preprint arXiv:2409.04429, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.961783Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:cc8bfeee5778aa177547aa68f26ddfb458ac29909ef8faa58a2fab80534c55b5","observation_id":"545bebb5-615d-4ecf-b2f1-754fcf5878c5","resolution":{"observed_at":"2026-08-07T14:16:18.961783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.047855Z","title":"Efficient streaming language models with attention sinks.arXiv, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.047855Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:821ea624668609554739173fd95f2d3b82b39d04fff556a32309683b1017fbc1","observation_id":"bacfe7e9-9139-4137-abab-317b6f2257e6","resolution":{"observed_at":"2026-08-07T14:16:19.047855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-07T14:16:19.134844Z","title":"Show-o: One single transformer to unify multimodal understanding and generation.arXiv preprint arXiv:2408.12528, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.134844Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:5c0e9f3d3b291c7a5ef4afd4f675bd82f2e01e42e18faf34997a374750f447a0","observation_id":"8655804e-2349-42e9-9902-0e4d05f68341","resolution":{"observed_at":"2026-08-07T14:16:19.134844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17178","last_updated":"2024-11-26T07:32:36Z","snapshot_observed_at":"2026-08-06T06:46:13.877506Z","submitted_at":"2024-11-26T07:32:36Z","title":"LiteVAR: Compressing Visual Autoregressive Modelling with Efficient Attention and Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17178","snapshot_observed_at":"2026-08-07T14:16:19.250138Z","title":"Litevar: Compressing visual autoregressive modelling with efficient attention and quantization.arXiv preprint arXiv:2411.17178, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.250138Z"},"links":{"cited_paper":"/paper/2411.17178","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:d760e1c72e8e3c0104b2a1344b5e7ed860d601ea09e6fc55b9931396c213323a","observation_id":"f56e95aa-f6be-4e5f-994b-a7f82c45c05c","resolution":{"observed_at":"2026-08-07T14:16:19.250138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12532","last_updated":"2024-06-05T09:01:24Z","snapshot_observed_at":"2026-07-06T18:17:08.160308Z","submitted_at":"2024-05-21T06:46:37Z","title":"PyramidInfer: Pyramid KV Cache Compression for High-throughput LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12532","snapshot_observed_at":"2026-08-07T14:16:19.360068Z","title":"Pyramidinfer: Pyramid kv cache compression for high-throughput llm inference.arXiv preprint arXiv:2405.12532, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.360068Z"},"links":{"cited_paper":"/paper/2405.12532","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:5e8740bc632ca5151e9ee57aa89c0becce4f48945954532148e146471c0d33c5","observation_id":"827a1ae8-2935-4ac9-96d7-895870c2b1be","resolution":{"observed_at":"2026-08-07T14:16:19.360068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06091","last_updated":"2024-04-09T07:49:30Z","snapshot_observed_at":"2026-07-06T17:57:35.831578Z","submitted_at":"2024-04-09T07:49:30Z","title":"Hash3D: Training-free Acceleration for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06091","snapshot_observed_at":"2026-08-07T14:16:19.475008Z","title":"Hash3d: Training-free acceleration for 3d generation.arXiv preprint arXiv:2404.06091, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.475008Z"},"links":{"cited_paper":"/paper/2404.06091","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:9099d85914f34a57643da247b18340bdd521ba5b4ce381148b1f751190d613e6","observation_id":"8d6893d3-7a1a-463f-9bef-f80db39d814d","resolution":{"observed_at":"2026-08-07T14:16:19.475008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.046060Z","title":"Diffusion probabilistic model made slim","venue":null,"work_id":"165df68b-b5f2-4cdd-b68f-d3cf6b3a641d","year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.548827Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:5d0417160f400cd212cfdbb2f37ea24be5b2438160544e7a6efd745ef049118e","observation_id":"b7a8c97c-e8de-47ce-bb5a-d8e082b59bd0","resolution":{"observed_at":"2026-08-07T14:16:23.209684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04671","last_updated":"2024-10-07T00:55:42Z","snapshot_observed_at":"2026-07-06T19:28:43.743447Z","submitted_at":"2024-10-07T00:55:42Z","title":"CAR: Controllable Autoregressive Modeling for Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04671","snapshot_observed_at":"2026-08-07T14:16:19.608040Z","title":"Car: Controllable autoregressive modeling for visual generation.arXiv preprint arXiv:2410.04671, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.608040Z"},"links":{"cited_paper":"/paper/2410.04671","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:b0a9a267abcb43b46e09896ae405091995841a3b951ba76d8cc4598c195896f8","observation_id":"f523d14b-49a3-43af-9877-e8c9330bc139","resolution":{"observed_at":"2026-08-07T14:16:19.608040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18828","last_updated":"2024-10-04T04:41:06Z","snapshot_observed_at":"2026-08-05T06:14:40.189444Z","submitted_at":"2023-11-30T18:59:20Z","title":"One-step Diffusion with Distribution Matching Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18828","snapshot_observed_at":"2026-08-07T14:16:19.701607Z","title":"One-step diffusion with distribution matching distillation.arXiv preprint arXiv:2311.18828, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.701607Z"},"links":{"cited_paper":"/paper/2311.18828","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:2ab19115448a754e9b09d556e7f58de18abc7a0d125126fbc93054c74d84f105","observation_id":"0f4c3011-d88a-411d-8bb5-7ed536fb36b2","resolution":{"observed_at":"2026-08-07T14:16:19.701607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-07-06T17:32:10.828230Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-07T14:16:19.784103Z","title":"Wkvquant: Quan- tizing weight and key/value cache for large language models gains more.arXiv preprint arXiv:2402.12065, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.784103Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:a2c9f1d1d55f974e63fd564d928bc9254c4d9bb326480a66bee24741e4c44622","observation_id":"0e775c07-916f-4896-ae0c-6090247f3f33","resolution":{"observed_at":"2026-08-07T14:16:19.784103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.767767Z","title":"Resshift: Efficient diffusion model for image super-resolution by residual shifting.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"7816471f-58c0-4296-8d68-35c8941846fd","year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.898686Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:15105a5cdbd673c5feea6d2df496a5ec277e9fbcc6ce74f9f71d80a556d05acf","observation_id":"3557f87b-5aab-4826-a750-14232c37e679","resolution":{"observed_at":"2026-08-07T14:16:22.897167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11098","last_updated":"2025-03-05T13:28:29Z","snapshot_observed_at":"2026-07-06T18:01:23.297512Z","submitted_at":"2024-04-17T06:32:42Z","title":"LAPTOP-Diff: Layer Pruning and Normalized Distillation for Compressing Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11098","snapshot_observed_at":"2026-08-07T14:16:20.004397Z","title":"Laptop-diff: Layer pruning and normalized distillation for compressing diffusion models.arXiv preprint arXiv:2404.11098, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.004397Z"},"links":{"cited_paper":"/paper/2404.11098","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:8c86c854259a35ca107b9448f85b15a9798572b8c36eb44cea70a2ff2b9429a6","observation_id":"affe042c-ddf2-4a81-9f3d-0a82e5985e68","resolution":{"observed_at":"2026-08-07T14:16:20.004397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06322","last_updated":"2024-09-10T08:27:19Z","snapshot_observed_at":"2026-08-03T19:24:23.594815Z","submitted_at":"2024-09-10T08:27:19Z","title":"G3PT: Unleash the power of Autoregressive Modeling in 3D Generation via Cross-scale Querying Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06322","snapshot_observed_at":"2026-08-07T14:16:20.116154Z","title":"G3pt: Unleash the power of autoregressive modeling in 3d generation via cross-scale querying transformer.arXiv preprint arXiv:2409.06322, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.116154Z"},"links":{"cited_paper":"/paper/2409.06322","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:3523612156ec2de862d409592b5af74160c344e2cbc3df8fe05d2db4336dca1a","observation_id":"aaa1b858-7fb0-4d7a-8413-b7a35de4a838","resolution":{"observed_at":"2026-08-07T14:16:20.116154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-06T13:04:34.380567Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-07T14:16:20.208413Z","title":"Var-clip: Text-to- image generator with visual auto-regressive modeling.arXiv preprint arXiv:2408.01181, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.208413Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:4b5d8927e82d3ef2ce2d9bf66572e1841fa91d982e047715b99a84d156eaef4b","observation_id":"91b9fa70-7ee9-4c17-b71a-2ec91cd63095","resolution":{"observed_at":"2026-08-07T14:16:20.208413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.320593Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.320593Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:e2c283e6a79795fddaaafea4e83247fd2963721fe6036d16d78ebf3715fec80a","observation_id":"9e2adf34-da4a-445f-a409-4db203c50c08","resolution":{"observed_at":"2026-08-07T14:16:20.320593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02747","last_updated":"2025-02-26T10:49:33Z","snapshot_observed_at":"2026-08-06T20:59:17.219335Z","submitted_at":"2024-04-03T13:44:41Z","title":"Faster Diffusion via Temporal Attention Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02747","snapshot_observed_at":"2026-08-07T14:16:20.398774Z","title":"Cross-attention makes inference cumbersome in text-to-image diffusion models.arXiv preprint arXiv:2404.02747, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.398774Z"},"links":{"cited_paper":"/paper/2404.02747","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:2c686d87a2ac5ec90fa37bcaa8d12b36148cee5bd0791bf46d81b9c65cd12fe3","observation_id":"b14eb1c8-94d5-4847-9600-356c9fdc9949","resolution":{"observed_at":"2026-08-07T14:16:20.398774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.497806Z","title":"Cam: Cache merging for memory-efficient llms inference","venue":null,"work_id":"feb07f03-6d45-4d52-ad68-4cc6cd968dd6","year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.509944Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:94db6befaaa4871d48b0a6a08f3799f321e14414477f024f97a686e026d039d1","observation_id":"55a8508a-c4ac-4be5-804e-d2fb45026751","resolution":{"observed_at":"2026-08-07T14:16:22.625939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.627739Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models.Advances in Neural Information Processing Systems, 36:34661–34710, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.627739Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:2278bea4eb9218525de14f75635e64d41c3caa6ef42b29f3d1ac08a34ad9adb9","observation_id":"c37d9c57-6909-4482-b493-26005cd2d039","resolution":{"observed_at":"2026-08-07T14:16:20.627739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-07T14:16:20.706471Z","title":"Real-time video generation with pyramid attention broadcast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.706471Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:aa25baf97807bb78afe47e6dd52c5001668826d042346d287fca1417d25840cd","observation_id":"30e5a746-e8e1-4266-af0e-8df43ff5936d","resolution":{"observed_at":"2026-08-07T14:16:20.706471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16567","last_updated":"2024-06-12T07:16:21Z","snapshot_observed_at":"2026-07-06T16:53:39.713988Z","submitted_at":"2023-11-28T07:14:41Z","title":"MobileDiffusion: Instant Text-to-Image Generation on Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16567","snapshot_observed_at":"2026-08-07T14:16:20.821528Z","title":"Mobilediffusion: Subsecond text-to-image generation on mobile devices.arXiv preprint arXiv:2311.16567, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.821528Z"},"links":{"cited_paper":"/paper/2311.16567","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:7a01c9c2ab9d3c39b970ffd5838ed6ee9684938ec72b7d68dfa5d78f33d196f8","observation_id":"76094485-c0db-45ea-b5ce-5a4b36647ba1","resolution":{"observed_at":"2026-08-07T14:16:20.821528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-07T14:16:20.927090Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model.arXiv preprint arXiv:2408.11039, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.927090Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:e2a1b610d555a4aa785464ab8847cb863d00c58d2b8227a163043ccabea98e7f","observation_id":"f972b876-9b38-4a37-98c5-2063619a429b","resolution":{"observed_at":"2026-08-07T14:16:20.927090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":75,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 3 inbound Pith citation observations for arXiv:2505.19602."}