{"as_of":"2026-08-16T04:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b16c5726b4caa0944b0917fd7c58c8614bbf8a24361d5ff6f45c2b124e3104bc","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:49:43.764805Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20454/citation-record","integrity":"/paper/2507.20454/integrity","json":"/paper/2507.20454/citation-record.json","paper":"/paper/2507.20454"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.10945","last_updated":"2024-12-25T01:27:01Z","snapshot_observed_at":"2026-08-14T23:00:20.153734Z","submitted_at":"2024-08-20T15:34:27Z","title":"HiRED: Attention-Guided Token Dropping for Efficient Inference of High-Resolution Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10945","snapshot_observed_at":"2026-08-15T17:49:43.567557Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.567557Z"},"links":{"cited_paper":"/paper/2408.10945","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:6cc35fdac88893c2db1e2ddea26e6bf41a08230805b4b1133a1e948b9fd8b38f","observation_id":"2673a3a8-503a-4558-a7d8-6d51e7f17b77","resolution":{"observed_at":"2026-08-15T17:49:43.567557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.614874Z","title":"Improving image generation with better captions","venue":null,"work_id":"5b11906d-9c58-40f7-b98e-0e58c746bfab","year":2023},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.573722Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:c9f0f22a6aa3241c843ddb438111b7fde4ddf86af1fef750a502e3d8839127bc","observation_id":"19813d58-be82-4795-bfbd-c2a369eb603d","resolution":{"observed_at":"2026-08-15T17:49:44.619893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.599354Z","title":"Token merging: Your vit but faster","venue":null,"work_id":"a8b0a896-4a37-4d8b-8f07-21e7b8cf2e6c","year":2023},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.579009Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:6bae4da351d8fa462aa1cdf0960d85444e2bb09400e101b312caba2a94197956","observation_id":"0a533aa9-4233-4f3d-b910-ae671e816faa","resolution":{"observed_at":"2026-08-15T17:49:44.604465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.583863Z","title":"T., Luo, P., Lu, H., and Li, Z","venue":null,"work_id":"b2433155-a2b8-491b-a714-9fac602c8913","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.584456Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:141914cede372bfbcf59606faa54b6515f27c909c2feb24e1793c0fd72b20fca","observation_id":"89bc5f6a-de99-40e9-ba42-d58725db678e","resolution":{"observed_at":"2026-08-15T17:49:44.588983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.567819Z","title":"An image is worth 1/2 tokens after layer 2: Plug-and-play inference acceleration for large vision-language models","venue":null,"work_id":"ad02fa14-40f4-47ef-a2e3-1de551503fdb","year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.590436Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:7d94e89b50fbf56fea906cfb52c9d38f5a9990717d4b7e834853c0fa5c34d7e6","observation_id":"8c1b5a97-4442-4f85-91bc-63c843152e49","resolution":{"observed_at":"2026-08-15T17:49:44.573182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.552295Z","title":"Optical flow distillation: Towards efficient and stable video style transfer","venue":null,"work_id":"520c9ff2-1c04-482e-8b3a-c17fe74e4b8d","year":2020},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.596343Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:68d87359a2cce1baf0b490185bd95e5f2be223ccb2453db4ef2562a72d473fde","observation_id":"873b5584-1493-43b0-bf7c-265f7e756d8a","resolution":{"observed_at":"2026-08-15T17:49:44.557325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.535579Z","title":"Cogview: Mastering text-to-image generation via trans- formers","venue":null,"work_id":"651f0b9d-0cf1-45ee-963d-a8d9e8ffb325","year":2021},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.601647Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:739c834fccc8fa94968232036dce89243c24c40503cf4ba720d190013d637987","observation_id":"bdf189ac-d1c7-4a95-b060-5fb0c009c972","resolution":{"observed_at":"2026-08-15T17:49:44.540530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.520442Z","title":"Taming trans- formers for high-resolution image synthesis","venue":null,"work_id":"07828971-1a40-4f01-a14c-b7ea122c7336","year":2021},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.607495Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:cd49743b75ce4556fe7eb37a1c4810592cfdf299d09e0de9ebd4f89fcb476642","observation_id":"1959baa0-3a5b-4553-a27e-800627fc6ad8","resolution":{"observed_at":"2026-08-15T17:49:44.525314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.505323Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment","venue":null,"work_id":"84f5ead4-5479-42d3-9170-bc06d55d59e0","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.612577Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:cec47991bce0cffb69821365c8184d83acd9b0590db0a3c606ef991d15a34663","observation_id":"a1fa6cfb-3c7b-4913-9ede-c6504ff96a88","resolution":{"observed_at":"2026-08-15T17:49:44.510385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-15T00:31:45.808844Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-15T17:49:43.617614Z","title":"Infinity: Scaling bitwise autore- gressive modeling for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.617614Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:d1ccf5b9512b0ac88c1a82e970e3a999bcd1235f38c943b7c3e37220c8f9ef08","observation_id":"75e6fdd2-f518-4e99-a147-92d905e4ee43","resolution":{"observed_at":"2026-08-15T17:49:43.617614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04062","last_updated":"2025-06-29T07:13:36Z","snapshot_observed_at":"2026-08-14T01:36:02.031381Z","submitted_at":"2024-12-05T10:57:08Z","title":"ZipAR: Parallel Auto-regressive Image Generation through Spatial Locality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04062","snapshot_observed_at":"2026-08-15T17:49:43.623259Z","title":"Zipar: Accelerating autoregressive im- age generation through spatial locality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.623259Z"},"links":{"cited_paper":"/paper/2412.04062","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:be4a7019c0dbd14ceda44ee75331915978171aab59d8a253691e7cd1013f3a88","observation_id":"6a5a3f70-b144-4e6f-99c3-241ef755b679","resolution":{"observed_at":"2026-08-15T17:49:43.623259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08584","last_updated":"2024-12-18T07:45:11Z","snapshot_observed_at":"2026-08-14T18:06:06.359792Z","submitted_at":"2024-10-11T07:24:21Z","title":"ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08584","snapshot_observed_at":"2026-08-15T17:49:43.628605Z","title":"Zipvl: Efficient large vision-language models with dynamic token sparsification and kv cache compression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.628605Z"},"links":{"cited_paper":"/paper/2410.08584","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:26ce682ac37626ad53673ee8769d60697ea98fa7036e2cf346e1b91bc4563614","observation_id":"658dd267-ee19-4576-932e-8682694f9af2","resolution":{"observed_at":"2026-08-15T17:49:43.628605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-12T17:58:56.652054Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-15T17:49:43.633946Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.633946Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:96b4a2c07e328d63bc938721bf73f7dc958d96f52ca255e56cbc36f6271cc3a1","observation_id":"7569a03a-2990-4226-a87a-9ea4afc6cb64","resolution":{"observed_at":"2026-08-15T17:49:43.633946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.487910Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":"1d6cea0c-23bf-46e7-9cc8-884575483808","year":2022},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.639096Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:70a3b64f2171eadb74e556beb13f75d70f495459d81be54436354c65d89ac3c4","observation_id":"8af07939-e1d3-4e06-b0f0-8f25311ad09d","resolution":{"observed_at":"2026-08-15T17:49:44.492751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.472286Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":"fd33a556-9b03-42fd-a46a-dec9dbf25bc4","year":2022},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.643797Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:4e59d6e9076062f438656763c886e0057899a20b83864ed2744ae70ccecc36e0","observation_id":"843afbb6-346e-4d6a-8ba0-9b7033520c51","resolution":{"observed_at":"2026-08-15T17:49:44.477290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23782","last_updated":"2024-10-31T09:55:32Z","snapshot_observed_at":"2026-08-15T03:08:13.251279Z","submitted_at":"2024-10-31T09:55:32Z","title":"Video Token Merging for Long-form Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23782","snapshot_observed_at":"2026-08-15T17:49:43.649427Z","title":"Video token merging for long-form video understand- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.649427Z"},"links":{"cited_paper":"/paper/2410.23782","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:20d484ff6f6067c30825d49dad15fc123282b94784394425c666714c217f631a","observation_id":"50a05d97-ecda-4775-aa76-eda03233ec33","resolution":{"observed_at":"2026-08-15T17:49:43.649427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.456743Z","title":"Control- lable text-to-image generation","venue":null,"work_id":"131ada25-ca5c-4228-9883-e8c7ce488bfa","year":2019},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.654523Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:8162c08b4be3df7c76b247d2374fde14951620221b8915372c6cf04156bbc51d","observation_id":"9de9e9de-fa8d-4156-bfa7-cb7d3791f8db","resolution":{"observed_at":"2026-08-15T17:49:44.461713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01756","last_updated":"2024-12-03T20:32:52Z","snapshot_observed_at":"2026-08-15T09:01:39.909890Z","submitted_at":"2024-10-02T17:06:39Z","title":"ImageFolder: Autoregressive Image Generation with Folded Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01756","snapshot_observed_at":"2026-08-15T17:49:43.659509Z","title":"Imagefolder: Autoregressive image generation with folded tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.659509Z"},"links":{"cited_paper":"/paper/2410.01756","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:f47998b5c689faa5cb23e5c1fd445e9424bd42ffba72d50a757f24130166d01c","observation_id":"9a15ce32-99b5-49ca-8d2d-4d3790e7d293","resolution":{"observed_at":"2026-08-15T17:49:43.659509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09750","last_updated":"2024-10-02T02:10:26Z","snapshot_observed_at":"2026-08-14T21:49:09.774607Z","submitted_at":"2024-06-14T06:35:33Z","title":"ControlVAR: Exploring Controllable Visual Autoregressive Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09750","snapshot_observed_at":"2026-08-15T17:49:43.665348Z","title":"Controlvar: Exploring control- lable visual autoregressive modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.665348Z"},"links":{"cited_paper":"/paper/2406.09750","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:bf69315ce7489ba1497375922448a81727192112d96fde9119dcf3fce55291d2","observation_id":"0d8ce180-5a53-410c-b5ad-4ba1056be509","resolution":{"observed_at":"2026-08-15T17:49:43.665348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.441628Z","title":"Finite scalar quantization: Vq-vae made simple","venue":null,"work_id":"73d039bb-9065-4216-a0dd-ecef37a6882a","year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.670253Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:244d3dd7880ba8f412cc86d6e8ff374ba7f0a8d8d1e48d05a73179f09cf53888","observation_id":"46de1876-4c62-45c2-9e0c-e3f7aaa106b7","resolution":{"observed_at":"2026-08-15T17:49:44.446559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.426391Z","title":"SDXL: improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"b29616c1-0436-448c-91f3-0d2b1bb77b3c","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.675150Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:fbf3daa33478d3465a0176f42128fcbadf962b3aaf9a0cb858ced8e3fb63dadf","observation_id":"3b004722-083b-4f3e-bac6-58c4d0aacc0f","resolution":{"observed_at":"2026-08-15T17:49:44.431592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.409495Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"e92be7b2-481e-4b62-8f59-1735bd23c183","year":2021},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.680696Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:725f90a0b79c1965e98b1d61f0fa20143349cf23f67cbbeff69006b659fc4184","observation_id":"c07c7db6-21c2-4b2f-b66e-937e70adc882","resolution":{"observed_at":"2026-08-15T17:49:44.414650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.393976Z","title":"Gen- erating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":"8e71ff2e-1950-4891-b908-860e78eb8981","year":2019},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.685562Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:ffa8cc85cee2259a61a1285858e688491f9f4decacb77b84e30d8cd775ba86ef","observation_id":"8c9a1963-ba82-447d-8ec7-e1e3687d8490","resolution":{"observed_at":"2026-08-15T17:49:44.398969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.378441Z","title":"Generative adversarial text to image synthesis","venue":null,"work_id":"e2106f31-9cbb-497e-8955-943697ef1d18","year":2016},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.690441Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:a9361c2ca36767637f1e91e579e415793bb45ceb223aa62063f5f45476f923f3","observation_id":"0a542497-8a0b-454e-9509-090612fc2155","resolution":{"observed_at":"2026-08-15T17:49:44.383454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.362306Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"e3d0a813-7f93-4bd8-a11f-6637e18836ae","year":2022},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.695983Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:6113e464b96b94bc872779f03e53514b5583c6cc992b21835a486c6877292d64","observation_id":"e51d9640-cf19-401d-ad68-c504403289e4","resolution":{"observed_at":"2026-08-15T17:49:44.367449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:43.700781Z","title":"J., and Yan, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.700781Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:c334bed47a37182f3d7834738bbb2cc849132dfb4cdfca27c446a71c8e9bac98","observation_id":"67ab8691-930f-4d70-908c-725a5ef630e9","resolution":{"observed_at":"2026-08-15T17:49:43.700781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-15T17:49:43.706738Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.706738Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:4b4ef2919b9d97adb5e5baa8023899078edd78d736d990d9041fc216e9144bf3","observation_id":"bf81c526-0afb-438f-8ef3-56c05e271e80","resolution":{"observed_at":"2026-08-15T17:49:43.706738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10812","last_updated":"2024-10-14T17:59:42Z","snapshot_observed_at":"2026-08-12T22:23:26.382002Z","submitted_at":"2024-10-14T17:59:42Z","title":"HART: Efficient Visual Generation with Hybrid Autoregressive Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10812","snapshot_observed_at":"2026-08-15T17:49:43.711960Z","title":"Hart: Ef- ficient visual generation with hybrid autoregressive transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.711960Z"},"links":{"cited_paper":"/paper/2410.10812","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:bd0d31ec25c54f2168d57f0e6712caf644e9161820ba23e4d6044027fa454562","observation_id":"e5ed191a-5c52-4ac6-8140-3cdc4794067e","resolution":{"observed_at":"2026-08-15T17:49:43.711960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.344543Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":"fdd25a23-a3fc-4229-9fde-29901df1534c","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.717358Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:c3657bd835d3794923168396b0a0de3f34b25fc0be4c703c8fa6bf0a791babe3","observation_id":"77f02810-04e8-47dd-b53f-ac68ff7cb72d","resolution":{"observed_at":"2026-08-15T17:49:44.350215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.327374Z","title":"Neural discrete representation learning","venue":null,"work_id":"01703202-674d-463b-9317-a339aa34a840","year":2017},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.721899Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:ec745274b23c024967016fbf5ae28e811bc6a4a8ca084ce3c81a1b6c9a2cd266","observation_id":"502b412c-c872-4aa7-9263-08700e9519ff","resolution":{"observed_at":"2026-08-15T17:49:44.333379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.309890Z","title":"Tag dis- entangled generative adversarial networks for object image re-rendering","venue":null,"work_id":"ecfe6b5e-d077-491e-aceb-c348b651b1c6","year":2017},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.726461Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:a4c4b0b51f77ffd8a0c1441434eb5a67a3e59eb15e4d2b4d6192600bbe195b75","observation_id":"70900018-08b8-4252-b0c3-2aff8dc20083","resolution":{"observed_at":"2026-08-15T17:49:44.314959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-15T17:49:43.732191Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.732191Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:eed79757d2417da81e9bca789bf77a8a9f4c86aaf041c3f2876d55b7a167b7c1","observation_id":"561d413c-edf3-4347-8c39-8b820f23954b","resolution":{"observed_at":"2026-08-15T17:49:43.732191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-14T02:46:25.655503Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-15T17:49:43.737120Z","title":"Human preference score v2: A solid benchmark for evaluating human preferences of text- to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.737120Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:74b87d0caf9ada32493e4c5524f243c7112122273e758cd815c71715aeea8b29","observation_id":"e0542dc5-7ffc-4a7c-847c-b17d3d6956ba","resolution":{"observed_at":"2026-08-15T17:49:43.737120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.294748Z","title":"Imagereward: Learning and evalu- ating human preferences for text-to-image generation","venue":null,"work_id":"0234fd7a-54be-4429-8d85-3ce1bdbf62f3","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.742650Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:e43714800a9ec3c02447d7a25389fef0f3db68b5f5cfce418c4898ac6879702b","observation_id":"9ec1fa05-9e90-49f2-b053-f031e013e85a","resolution":{"observed_at":"2026-08-15T17:49:44.299516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.278423Z","title":"Attngan: Fine-grained text to image generation with attentional generative adversar- ial networks","venue":null,"work_id":"c4f46962-a5a9-483e-894b-b26bb2c6f45f","year":2018},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.749094Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:8d944b8754a323d387eca94b7a52cf5554b5bd13e39f9cee692a65164bae7575","observation_id":"3e6893ed-108a-48de-8e52-3e8fd8a1b00b","resolution":{"observed_at":"2026-08-15T17:49:44.284008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04627","last_updated":"2022-06-05T01:57:58Z","snapshot_observed_at":"2026-08-13T12:11:58.325060Z","submitted_at":"2021-10-09T18:36:00Z","title":"Vector-quantized Image Modeling with Improved VQGAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04627","snapshot_observed_at":"2026-08-15T17:49:43.753809Z","title":"Y ., Zhang, H., Pang, R., Qin, J., Ku, A., Xu, Y ., Baldridge, J., and Wu, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.753809Z"},"links":{"cited_paper":"/paper/2110.04627","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:508658a2370fb6dd95b4c439b01f15ddcb40a88825310f8d82341e54d4e51486","observation_id":"d34253de-c952-43f1-816a-b8e69778b900","resolution":{"observed_at":"2026-08-15T17:49:43.753809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.261521Z","title":"B., Versari, L., Sohn, K., Minnen, D., Cheng, Y ., Gupta, A., Gu, X., Hauptmann, A","venue":null,"work_id":"f00590c0-62ff-4d51-9ecb-4152a956d46a","year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.759129Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:ce7d6220fa0e8088b124b173f6c27b8473034c7259088ce124ed5fd21b65afee","observation_id":"d991820e-6168-441d-a48d-82337ef23314","resolution":{"observed_at":"2026-08-15T17:49:44.266556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.242442Z","title":"B., Versari, L., Sohn, K., Minnen, D., Cheng, Y ., Gupta, A., Gu, X., Hauptmann, A","venue":null,"work_id":"f0b9e4aa-474b-4aae-a0c2-7758cfca9b02","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.764805Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:6b1dc35f685a78d9afb7ea42854e6a2f164f40b6cb19c3e304e7b3d946b5d36d","observation_id":"4b4950a1-23f5-40ed-9467-3a88d532bd65","resolution":{"observed_at":"2026-08-15T17:49:44.250140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2507.20454."}