{"as_of":"2026-08-07T12:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1cd1dbba6f05e2b09f9d36ae83a94198e3ba45fcaedf18232d3aed7a23f90b14","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:41:23.831463Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:23:08.137866Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T04:23:09.921374Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"cited_work":{"arxiv_id":"2507.04947","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.04947","snapshot_observed_at":"2026-08-06T04:23:09.921374Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","venue":"cs.CV","work_id":"80001308-6a23-4e21-bfd6-10e5f49608fa","year":2025},"citing_paper":{"arxiv_id":"2508.03789","last_updated":"2025-08-22T08:53:37Z","snapshot_observed_at":"2026-08-06T04:22:44.373906Z","submitted_at":"2025-08-05T17:17:13Z","title":"HPSv3: Towards Wide-Spectrum Human Preference Score","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T04:23:08.137866Z"},"links":{"cited_paper":"/paper/2507.04947","citing_paper":"/paper/2508.03789"},"observation_digest":"sha256:3bbb5ae76ac7c17c1e8f10cef4c26deb5ea9a1ef5ca69ea60de4e157d34c02fe","observation_id":"70406000-a5b0-4912-b562-5cf97973bb31","resolution":{"observed_at":"2026-08-06T04:23:09.993343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04947/citation-record","integrity":"/paper/2507.04947/integrity","json":"/paper/2507.04947/citation-record.json","paper":"/paper/2507.04947"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13967","last_updated":"2025-06-04T12:56:23Z","snapshot_observed_at":"2026-08-06T14:17:35.390332Z","submitted_at":"2025-02-19T18:59:44Z","title":"FlexTok: Resampling Images into 1D Token Sequences of Flexible Length","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13967","snapshot_observed_at":"2026-08-06T19:41:23.597184Z","title":"Flextok: Re- sampling images into 1d token sequences of flexible length","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.597184Z"},"links":{"cited_paper":"/paper/2502.13967","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:2b080d08709527a1f3f363f385233adba1cd9c8f74d26d7fbfe3fa0ec2815162","observation_id":"34dd3310-39fe-4f53-a573-f35974eb1cd1","resolution":{"observed_at":"2026-08-06T19:41:23.597184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08261","last_updated":"2025-03-13T15:09:10Z","snapshot_observed_at":"2026-07-06T19:31:23.072307Z","submitted_at":"2024-10-10T17:59:17Z","title":"Meissonic: Revitalizing Masked Generative Transformers for Efficient High-Resolution Text-to-Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08261","snapshot_observed_at":"2026-08-06T19:41:23.601433Z","title":"Meissonic: Revitalizing masked generative trans- formers for efficient high-resolution text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.601433Z"},"links":{"cited_paper":"/paper/2410.08261","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:6ecbcb5fae3abdc3fc9672e801a8245087eb3e469b0de1d595cc0d26ee223b19","observation_id":"12388c83-15cb-42a7-aad7-f388b1f89336","resolution":{"observed_at":"2026-08-06T19:41:23.601433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.599233Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":"a169459a-12a0-4b73-8873-9c06cff97f5f","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.605018Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:af3cc9710c8d65f405c42028641a9736c73eca2cb81af51d707eb8c937f54a34","observation_id":"b34dd59c-ddf7-498e-8ecd-29082de15795","resolution":{"observed_at":"2026-08-06T19:41:24.602385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.590219Z","title":"Flux, 2024","venue":null,"work_id":"67cf8832-0d1c-4e46-9603-7311208e6c90","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.608086Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:fe5d52330448f02ed5dde85c9dfbd083cbb0ccdb52fa650a668482e42051fb04","observation_id":"1b725b72-339a-46c0-8f26-3a378878204c","resolution":{"observed_at":"2026-08-06T19:41:24.593338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.580098Z","title":"Efficientvit: Lightweight multi-scale attention for high- resolution dense prediction","venue":null,"work_id":"2134c057-b32d-456e-812e-693c255ba1ec","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.611773Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:385857c37b1e428bc18fdebecb6cb068a262e84b581a29a80f0a12d2dafbeae4","observation_id":"4cec7b2a-686c-4369-a2fd-a9e758073b30","resolution":{"observed_at":"2026-08-06T19:41:24.583437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.568660Z","title":"Condition-aware neural network for controlled image generation","venue":null,"work_id":"d83c26dd-a3e5-4eac-9e02-ee5eb8e74363","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.614980Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:603a00cc5d3ebf027ca0f1a99c3668b7ce15a4de30be0a01061cffbdeac1e8fa","observation_id":"745ad257-39eb-4eba-aade-9af00a02f3e0","resolution":{"observed_at":"2026-08-06T19:41:24.572142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.557367Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":"c37e0d24-a64c-46a9-a89d-b12c3f31181d","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.617922Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:85878ae0e9c0e8296a781a9080c960cb0065fb2e06a0aab27cc97ab2cfaf6e95","observation_id":"047dad19-1554-4487-9528-3b8954e7e9d6","resolution":{"observed_at":"2026-08-06T19:41:24.560754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00704","last_updated":"2023-01-02T14:43:38Z","snapshot_observed_at":"2026-08-03T00:33:47.397969Z","submitted_at":"2023-01-02T14:43:38Z","title":"Muse: Text-To-Image Generation via Masked Generative Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00704","snapshot_observed_at":"2026-08-06T19:41:23.621281Z","title":"Muse: Text-to-image generation via masked generative transform- ers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.621281Z"},"links":{"cited_paper":"/paper/2301.00704","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:3d56d45f052dce898eb38d0fec3ad3f89998927c709a944440eb7a42b118fc66","observation_id":"0757d32b-5882-4aac-a7ab-e83195aef7f6","resolution":{"observed_at":"2026-08-06T19:41:23.621281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10958","last_updated":"2025-03-14T22:22:40Z","snapshot_observed_at":"2026-07-06T20:07:10.352535Z","submitted_at":"2024-12-14T20:29:29Z","title":"SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10958","snapshot_observed_at":"2026-08-06T19:41:23.624757Z","title":"Softvq-vae: Efficient 1-dimensional con- tinuous tokenizer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.624757Z"},"links":{"cited_paper":"/paper/2412.10958","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:288ad331987fee75a06b207f8964bcb6f1d12df47b5fa327cec8e204044e3521","observation_id":"62f40565-28e3-4d95-bbfe-fa5f79d53533","resolution":{"observed_at":"2026-08-06T19:41:23.624757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03444","last_updated":"2025-05-30T05:49:31Z","snapshot_observed_at":"2026-07-06T20:31:46.181066Z","submitted_at":"2025-02-05T18:42:04Z","title":"Masked Autoencoders Are Effective Tokenizers for Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03444","snapshot_observed_at":"2026-08-06T19:41:23.628002Z","title":"Masked autoencoders are effective tokenizers for diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.628002Z"},"links":{"cited_paper":"/paper/2502.03444","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:adb64024f4629aa190eed888a9b5ca49c033f08623245c16a2d9a3462f53b9ea","observation_id":"137e2f05-51d3-4712-84a0-7b96c1511d17","resolution":{"observed_at":"2026-08-06T19:41:23.628002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10733","last_updated":"2025-05-18T21:17:22Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:15:07Z","title":"Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10733","snapshot_observed_at":"2026-08-06T19:41:23.631407Z","title":"Deep compression autoencoder for efficient high-resolution diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.631407Z"},"links":{"cited_paper":"/paper/2410.10733","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:3f4139a5a1ede9433c277e3b6d307d136a9db17db6e4d949c987719d66ca2eb9","observation_id":"a32b09d4-4e31-4bb0-b5a3-beb141350c54","resolution":{"observed_at":"2026-08-06T19:41:23.631407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.546101Z","title":"Pixart- σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":"1bca83d0-345d-4cb9-9893-c67105b29168","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.634884Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:3187a595aaa14b2fd096b4ad71a69eb1bd82e1e554a36fe2ac77e6fb7f415f50","observation_id":"4ba7edef-3ab1-4b73-a8ab-98746842fe2c","resolution":{"observed_at":"2026-08-06T19:41:24.550348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05252","last_updated":"2024-01-10T16:27:38Z","snapshot_observed_at":"2026-08-07T04:04:46.527670Z","submitted_at":"2024-01-10T16:27:38Z","title":"PIXART-{\\delta}: Fast and Controllable Image Generation with Latent Consistency Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05252","snapshot_observed_at":"2026-08-06T19:41:23.637843Z","title":"Pixart- {\\delta}: Fast and controllable image generation with latent consis- tency models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.637843Z"},"links":{"cited_paper":"/paper/2401.05252","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:f35dc736dca5e8d2d184c18ce3c50dc4e863a69c5d1045a9155c863c6ab20df3","observation_id":"1ccf0a15-739d-47c5-9915-32ae42beb7c9","resolution":{"observed_at":"2026-08-06T19:41:23.637843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.535529Z","title":"Pixart- α: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":"f2029f22-fb6c-4ab4-a58f-57fa39706389","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.641117Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:244679fffb9f5d7c0167adc24ace9c479ce78dcbb1310c3a9a78e2fb734b1fd3","observation_id":"7f6b40b9-ce03-41c3-9da7-c0df6c9da372","resolution":{"observed_at":"2026-08-06T19:41:24.539299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19937","last_updated":"2024-09-30T04:28:55Z","snapshot_observed_at":"2026-07-06T19:24:17.628876Z","submitted_at":"2024-09-30T04:28:55Z","title":"MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19937","snapshot_observed_at":"2026-08-06T19:41:23.643833Z","title":"Maskmamba: A hybrid mamba-transformer model for masked image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.643833Z"},"links":{"cited_paper":"/paper/2409.19937","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:8c5ea362aa7b5c235a07fb513a940826d3b8b9e45e9a0bb0462f20c21e9f0444","observation_id":"e8a436c8-2254-4d9e-92f2-2f1249cd3316","resolution":{"observed_at":"2026-08-06T19:41:23.643833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-06T19:41:23.646952Z","title":"Janus- pro: Unified multimodal understanding and generation with data and model scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.646952Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:0765e9540a2e9379473e1afa76876bb6c681532c24e1d4a62d08d36cbeec74ef","observation_id":"db8be56c-dd30-42d4-8ed1-30208cf160cb","resolution":{"observed_at":"2026-08-06T19:41:23.646952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17787","last_updated":"2024-11-26T15:13:15Z","snapshot_observed_at":"2026-07-06T19:57:33.013839Z","submitted_at":"2024-11-26T15:13:15Z","title":"Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17787","snapshot_observed_at":"2026-08-06T19:41:23.650563Z","title":"Collaborative decoding makes visual auto-regressive modeling efficient","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.650563Z"},"links":{"cited_paper":"/paper/2411.17787","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:d78231dc6c7716f680761579f8214617934ffa57a998737c244fc7b1d8dca9d8","observation_id":"f3f8b3ac-f320-46cd-8758-8e241995f1bb","resolution":{"observed_at":"2026-08-06T19:41:23.650563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.524247Z","title":"Vqgan-clip: Open domain image generation and editing with natural language guidance","venue":null,"work_id":"4a32be0a-d409-4c3f-9cff-c469f52638ec","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.653858Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:b123c3ef6163a4fa26a3fc3d7df5d4be0e1d09b5bb0d851b09920693dcc0249f","observation_id":"1905c30c-1215-4bfb-b4ec-04f85879daa4","resolution":{"observed_at":"2026-08-06T19:41:24.528012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.513507Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"840ab2da-0e89-47ba-8f4e-3cb44e992736","year":2009},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.656533Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:b6b0fd320ab1eb36be862b81574cb1960cca088f91c5137d502d9a10568d61d4","observation_id":"2e503436-5d51-4628-b25e-9fff171b8223","resolution":{"observed_at":"2026-08-06T19:41:24.517000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.659371Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.659371Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:287157a6fd430f48d8819957501dff12fc490d326b8c3554e3c79c5ba18e56dc","observation_id":"3dc5b9e6-e0b5-4149-b72d-e91cbb5a07dd","resolution":{"observed_at":"2026-08-06T19:41:23.659371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.495818Z","title":"Cogview: Mastering text-to-image generation via transformers","venue":null,"work_id":"c8492f28-a9a1-49b6-8225-61664befc13e","year":2021},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.662520Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:eee814f19b817fda43030b5d1df0fc0f0bbfc8da5141d4c586bfc67e03a23762","observation_id":"b26dfbd7-02f7-408d-a6c8-daa19cfa3668","resolution":{"observed_at":"2026-08-06T19:41:24.499523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.484033Z","title":"Cogview2: Faster and better text-to-image generation via hierarchical transformers","venue":null,"work_id":"177f8a1b-e202-443f-af0a-0a54131a1708","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.665292Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:02833592b6d6149bf560bcb90c0d1a90792443b9193b95c2aba70897d747cf61","observation_id":"ed0c676b-6098-46ad-aa37-1aa6ec6573e9","resolution":{"observed_at":"2026-08-06T19:41:24.487740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.668024Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.668024Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:164c9fbcc342ea0487144e466400eae1cd67ca67a5d027dd1534048f7e8a3ccd","observation_id":"bf37ec64-e006-42f6-a2c2-d3cb9b640474","resolution":{"observed_at":"2026-08-06T19:41:23.668024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.670970Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.670970Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:ec752ead6aab08080fd7649591f2d2801e072386731c45cc078e0332f98711d3","observation_id":"bd3707a4-1393-4e79-a4a8-870fe9598436","resolution":{"observed_at":"2026-08-06T19:41:23.670970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-03T02:37:38.651864Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-06T19:41:23.673806Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.673806Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:5730f08011545be835e5e7c081f0a4223f76ffff7fe40f39ab19bcb90645ecc9","observation_id":"ff003569-80a0-4a66-a324-9c1a05f1c1a9","resolution":{"observed_at":"2026-08-06T19:41:23.673806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.449483Z","title":"Make-a-scene: Scene- based text-to-image generation with human priors","venue":null,"work_id":"be516d64-195b-4cce-b1c4-d9955b83f8df","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.677307Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1b58ac84942429405ac40a8306fd6e2fedbcdf41255187fdca65017ef7d145fb","observation_id":"5cbe8f3e-1ded-4354-af83-b2672b2a4d1d","resolution":{"observed_at":"2026-08-06T19:41:24.453151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.439056Z","title":"Geneval: An object-focused framework for evaluating text- to-image alignment","venue":null,"work_id":"0583afaf-d9fc-429c-bd41-4adee3f54a04","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.680293Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:9e4372a1c2396abe51c319a5e8dcf3ec7a63021de164b252eacaf1eff879ebbf","observation_id":"02221b71-5d38-4501-90ea-30a1900a85e3","resolution":{"observed_at":"2026-08-06T19:41:24.442337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-06T22:01:43.705500Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-06T19:41:23.683029Z","title":"Infinity: Scaling bit- wise autoregressive modeling for high-resolution image syn- thesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.683029Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:f524bafca9d46dbb00c8426aa9a9bba917b2835928f58fc708e3af7165fef729","observation_id":"4ad5d9f1-7fac-4d07-8739-4632c1a45992","resolution":{"observed_at":"2026-08-06T19:41:23.683029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.685861Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.685861Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:b2e582f28502b87bb061a9397bdcf9a2d1da280c86d49aefdc9248363fc50549","observation_id":"188553c7-4b49-4eb3-a5f5-8047a6497060","resolution":{"observed_at":"2026-08-06T19:41:23.685861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03355","last_updated":"2025-03-02T07:45:09Z","snapshot_observed_at":"2026-07-06T19:27:37.936219Z","submitted_at":"2024-10-04T12:21:03Z","title":"LANTERN: Accelerating Visual Autoregressive Models with Relaxed Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03355","snapshot_observed_at":"2026-08-06T19:41:23.688829Z","title":"Lantern: Accelerating visual autoregressive mod- els with relaxed speculative decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.688829Z"},"links":{"cited_paper":"/paper/2410.03355","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:998ed784bd0e9b396f443a39c17d50859a5f81afeb383c9b603236b414c68044","observation_id":"7737570e-471b-4ad9-8965-39b0e94ec915","resolution":{"observed_at":"2026-08-06T19:41:23.688829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07730","last_updated":"2025-08-02T07:11:16Z","snapshot_observed_at":"2026-07-06T20:20:37.632750Z","submitted_at":"2025-01-13T22:37:17Z","title":"Democratizing Text-to-Image Masked Generative Models with Compact Text-Aware One-Dimensional Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07730","snapshot_observed_at":"2026-08-06T19:41:23.691857Z","title":"Democra- tizing text-to-image masked generative models with com- pact text-aware one-dimensional tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.691857Z"},"links":{"cited_paper":"/paper/2501.07730","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:3f4d852159a805893605fac193dd62f94f0cbbd7ddb0668c134940f5d32ef929","observation_id":"60d468d8-6607-4641-8640-b7445fdc2ca0","resolution":{"observed_at":"2026-08-06T19:41:23.691857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.421517Z","title":"Videopoet: A large language model for zero-shot video gen- eration","venue":null,"work_id":"52fd5291-d84d-4c05-a1e7-1b984a798eff","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.694896Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:99eb4006b52208afb40e2e1a59e1aad2e8c52bfe4b988d46c8f0bb310966aa72","observation_id":"14c41753-a012-4487-a846-551f7d8cc919","resolution":{"observed_at":"2026-08-06T19:41:24.425715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17245","last_updated":"2024-02-27T06:31:52Z","snapshot_observed_at":"2026-07-06T17:36:01.939242Z","submitted_at":"2024-02-27T06:31:52Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17245","snapshot_observed_at":"2026-08-06T19:41:23.697555Z","title":"Playground v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.697555Z"},"links":{"cited_paper":"/paper/2402.17245","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:8f43bac0e6b3da4c7c04a42ad7eeba4a936e42ce05d1986bd9dfd0ae5fe7ca90","observation_id":"ad64d74f-3a96-4457-af1b-4ad3542c923a","resolution":{"observed_at":"2026-08-06T19:41:23.697555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.700734Z","title":"Mage: Masked generative encoder to unify representation learning and image synthe- sis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.700734Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:b5af61a361474f5e078275d11461319a906745d8054a79fa96b77d9f0c893301","observation_id":"d018cac0-b23c-4277-9dc4-1541957b1376","resolution":{"observed_at":"2026-08-06T19:41:23.700734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.403175Z","title":"Autoregressive image generation without vec- tor quantization","venue":null,"work_id":"ea5ce072-4308-4bc3-b516-750b502be73c","year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.704341Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:a2af072449d25d55b5217e21239f8073aefcae31b264d2cddef6c56552c12096","observation_id":"6b558d4a-4b2c-4a46-acf1-1aa8dd686bf9","resolution":{"observed_at":"2026-08-06T19:41:24.406704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09750","last_updated":"2024-10-02T02:10:26Z","snapshot_observed_at":"2026-07-06T18:30:46.405694Z","submitted_at":"2024-06-14T06:35:33Z","title":"ControlVAR: Exploring Controllable Visual Autoregressive Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09750","snapshot_observed_at":"2026-08-06T19:41:23.707412Z","title":"Controlvar: Exploring con- trollable visual autoregressive modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.707412Z"},"links":{"cited_paper":"/paper/2406.09750","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1ead4c698679c9dde12406127bb034434833d38a391128c3fb78b386ed283c5a","observation_id":"da46fd01-6f63-4522-9731-2f592007beca","resolution":{"observed_at":"2026-08-06T19:41:23.707412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.392159Z","title":"Vila: On pre-training for vi- sual language models","venue":null,"work_id":"1c67d9f3-0dcc-4d1c-a67d-ac2f3467f547","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.710603Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:e76faad3c477e7270cb1db0da7c0e71ffef19c373e06ee575794531f425eb73e","observation_id":"61176306-b6d5-4f11-adea-42bbed8557de","resolution":{"observed_at":"2026-08-06T19:41:24.395848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10695","last_updated":"2024-10-21T20:01:13Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T19:52:24Z","title":"Playground v3: Improving Text-to-Image Alignment with Deep-Fusion Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10695","snapshot_observed_at":"2026-08-06T19:41:23.713635Z","title":"Playground v3: Im- proving text-to-image alignment with deep-fusion large lan- guage models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.713635Z"},"links":{"cited_paper":"/paper/2409.10695","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1f294230e21775b09896457140e7c7444e3c38c1b7c052bb4653a55860c1a42b","observation_id":"7a3d0dcb-6129-494c-8159-78cd2e95eefa","resolution":{"observed_at":"2026-08-06T19:41:23.713635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02657","last_updated":"2025-04-24T16:16:27Z","snapshot_observed_at":"2026-08-05T15:40:56.937227Z","submitted_at":"2024-08-05T17:46:53Z","title":"Lumina-mGPT: Illuminate Flexible Photorealistic Text-to-Image Generation with Multimodal Generative Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02657","snapshot_observed_at":"2026-08-06T19:41:23.716761Z","title":"Lumina-mgpt: Illuminate flexible photorealistic text-to-image generation with multimodal generative pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.716761Z"},"links":{"cited_paper":"/paper/2408.02657","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:aeb850fb03bb17534a1df0ca3bb1d4582ae53e19b031fd1d99a137073fce74aa","observation_id":"d2bd89df-c72d-4e5d-8a5c-2f7b2e9f196a","resolution":{"observed_at":"2026-08-06T19:41:23.716761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08268","last_updated":"2025-02-03T21:47:31Z","snapshot_observed_at":"2026-08-05T16:01:06.026395Z","submitted_at":"2024-02-13T07:47:36Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08268","snapshot_observed_at":"2026-08-06T19:41:23.720034Z","title":"World model on million-length video and language with blockwise ringattention","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.720034Z"},"links":{"cited_paper":"/paper/2402.08268","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:fdfc37e6555912aec4a6818c18ca7014ded9247d9331617d7e251584dd467c21","observation_id":"10e17c38-ac4e-4510-a198-8794726844f2","resolution":{"observed_at":"2026-08-06T19:41:23.720034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.381502Z","title":"Exploring the role of large language models in prompt encoding for diffusion models","venue":null,"work_id":"810354fa-45e9-41b0-9ed2-9c2d27d582a9","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.723272Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1d8e6b714042158801849ebef0d172401dbd7f9d0415d098a501db78e3124066","observation_id":"05608fb7-ecfb-41a0-b473-66459712bb50","resolution":{"observed_at":"2026-08-06T19:41:24.385166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10797","last_updated":"2025-02-19T06:00:55Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T03:45:45Z","title":"STAR: Scale-wise Text-conditioned AutoRegressive image generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10797","snapshot_observed_at":"2026-08-06T19:41:23.726623Z","title":"Star: Scale-wise text-to- image generation via auto-regressive representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.726623Z"},"links":{"cited_paper":"/paper/2406.10797","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:a1aca5d46b9a300ae595c92923355e2e738e15f0f374e2ad5fb3d125be0bd463","observation_id":"217bf85a-1191-4a80-8f3b-3e43d2497ea0","resolution":{"observed_at":"2026-08-06T19:41:23.726623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.369139Z","title":"Hello gpt-4o, 2024","venue":null,"work_id":"10c3c0d3-05af-4571-990e-c5c8116451ed","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.729953Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:601caa159330bf11575ea117cffca64c2f6a36dbfc731f68371786e47bbd81ae","observation_id":"3a459c38-41de-4b25-bb4f-1463c15ff854","resolution":{"observed_at":"2026-08-06T19:41:24.373082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.732818Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.732818Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:5441321f7d13f87c07788fb2137c4e8d5c849e92b1bb61ca15e54783c91cbcd0","observation_id":"e70fe837-c7d5-4f4b-b432-cad4b1270b93","resolution":{"observed_at":"2026-08-06T19:41:23.732818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.352206Z","title":"W ¨urstchen: An ef- ficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":"0f209184-105f-4f6a-90f0-7de23e8c3205","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.736414Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:ea3d9760a4db0e6b96395807438d20bce695c6cbb92e549877cafe0bb36d16ac","observation_id":"d32be879-4738-4d53-8d2a-1f2e9962b981","resolution":{"observed_at":"2026-08-06T19:41:24.356049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.341745Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"3f5b3515-1c7b-4e41-aa66-5d6310e8836d","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.740004Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:dc03d8d6e7f434ccb6f0006a8ba228ae679b4f15571b726f2c53c54047261c1c","observation_id":"387bf42c-f125-42aa-942a-126750c839f8","resolution":{"observed_at":"2026-08-06T19:41:24.345544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03069","last_updated":"2025-08-07T09:08:33Z","snapshot_observed_at":"2026-07-06T20:01:23.373458Z","submitted_at":"2024-12-04T06:46:55Z","title":"TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03069","snapshot_observed_at":"2026-08-06T19:41:23.743296Z","title":"Tokenflow: Unified image tokenizer for multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.743296Z"},"links":{"cited_paper":"/paper/2412.03069","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1ef0f5d57c7d2496ba0e22f234fb9234ed98399ea24ff97a977a7608ffb5aed0","observation_id":"e77a85cc-3c45-4774-b6cd-e6648a3feeb8","resolution":{"observed_at":"2026-08-06T19:41:23.743296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.331391Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":"3c8fe0ec-b3dd-4ee9-816a-b44db2a464dc","year":2020},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.746402Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:dcc612326e4bfd0e2440788d33e835e5ca39cee3c6aef46e1af2d377660b412d","observation_id":"96036b35-5845-4c61-89e6-8ba9814ae24e","resolution":{"observed_at":"2026-08-06T19:41:24.334820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.749368Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.749368Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:0670e9910919a198e87c67109df237e4cfdaad0e23beec0613a748281aa48223","observation_id":"514fabfe-dc50-4fb9-8220-db01381d887b","resolution":{"observed_at":"2026-08-06T19:41:23.749368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.752473Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.752473Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:070c52e36c283480c9eff620d455407543f789e941eae9af1dc02b565ffed9b0","observation_id":"b59c94d5-6f14-4b37-a016-3c49affc816d","resolution":{"observed_at":"2026-08-06T19:41:23.752473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.307000Z","title":"Journeydb: A benchmark for generative im- age understanding","venue":null,"work_id":"9014983b-3ea8-4cb6-88b1-ee00c72ae467","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.755319Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:4ba5274412baaad176ca8a5d8c56a79e413275971c4301f3901aa21417501388","observation_id":"98a0a5e4-7bc7-4417-86af-e1c317274499","resolution":{"observed_at":"2026-08-06T19:41:24.310911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-06T19:41:23.758914Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.758914Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:8d9bf5a06454fb06f9541a6424f3361399791d8412da37dae67ef0a2d1e91d5f","observation_id":"b3db0879-fb1b-466e-8256-142c6ec613f1","resolution":{"observed_at":"2026-08-06T19:41:23.758914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10812","last_updated":"2024-10-14T17:59:42Z","snapshot_observed_at":"2026-08-07T01:29:22.842436Z","submitted_at":"2024-10-14T17:59:42Z","title":"HART: Efficient Visual Generation with Hybrid Autoregressive Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10812","snapshot_observed_at":"2026-08-06T19:41:23.762860Z","title":"Hart: Efficient visual generation with hybrid au- toregressive transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.762860Z"},"links":{"cited_paper":"/paper/2410.10812","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:968498b1fe033917f6cee63a42b2cc2e103a8f3beaee097f3578007add387229","observation_id":"32ffb138-09c0-44ba-ae2e-ee0063776e3d","resolution":{"observed_at":"2026-08-06T19:41:23.762860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.296588Z","title":"Introducing auraflow v0","venue":null,"work_id":"0c953d0e-3147-403f-9304-fae90e8bde9d","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.766316Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:494809343010202fa6582ed6245ac3764abcacba5c694a1a43227e1ce9ffdcec","observation_id":"ef40a9a9-7bfc-4dea-91d1-b34525e77634","resolution":{"observed_at":"2026-08-06T19:41:24.299918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T19:41:23.769261Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.769261Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:cf9ba0916c7f44da5b6f38bc2a9af100d398d372d9ad434d10a4080a58628e71","observation_id":"ea4877f2-701f-4f21-a926-cce601e32e35","resolution":{"observed_at":"2026-08-06T19:41:23.769261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.285824Z","title":"Kolors: Effective training of diffusion model for photorealistic text-to-image synthesis","venue":null,"work_id":"5d822cb9-3067-4df3-a25a-68e496406f15","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.772210Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:74519691d2c1b86a5c22736b6e2bffc6bc29ed6e59ab482e91b07358fc032937","observation_id":"05c6b64d-7efb-40a4-b309-aa4736357ae1","resolution":{"observed_at":"2026-08-06T19:41:24.289469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.273323Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":"3d7aa734-5d7d-466b-963c-685818e61bad","year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.775229Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:7a74df72362759817eeda971dea79ed4cdf756f7045f732f963f4590151557ab","observation_id":"47186ff9-ba17-4818-a852-85093f69afeb","resolution":{"observed_at":"2026-08-06T19:41:24.277788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.778537Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.778537Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:578276bc898c0c7ae2f581f58eb5c052ab374499aa02c0697978677a9639e5c3","observation_id":"24ca1245-6f49-4bc6-8998-30b18845bdf7","resolution":{"observed_at":"2026-08-06T19:41:23.778537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02399","last_updated":"2022-10-05T17:18:28Z","snapshot_observed_at":"2026-08-04T09:09:48.463217Z","submitted_at":"2022-10-05T17:18:28Z","title":"Phenaki: Variable Length Video Generation From Open Domain Textual Description","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02399","snapshot_observed_at":"2026-08-06T19:41:23.781644Z","title":"Phenaki: Variable length video generation from open domain textual description","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.781644Z"},"links":{"cited_paper":"/paper/2210.02399","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:cfbd366aee9a07f61fc9d9f22d9883037587f45880dac06d98b6d7e4aee2c759","observation_id":"e18e3c3e-01c1-45dd-a062-775cf528945c","resolution":{"observed_at":"2026-08-06T19:41:23.781644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-06T19:41:23.784989Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.784989Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:e0c8b5d8eac894f9b0263effded5d9a08c72fa75cc8b68e7c791a2a6a1403b09","observation_id":"9b48ac4f-56d7-4001-9c42-9910aba55a29","resolution":{"observed_at":"2026-08-06T19:41:23.784989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15119","last_updated":"2025-04-03T02:34:24Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:59:54Z","title":"Parallelized Autoregressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15119","snapshot_observed_at":"2026-08-06T19:41:23.788082Z","title":"Parallelized autoregressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.788082Z"},"links":{"cited_paper":"/paper/2412.15119","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:66ac984f1c012b29192036e8c6941bcede5f98e47914aa9fa326a176bf8cde12","observation_id":"aeb2ad6d-4043-4c25-9816-35067e89fed0","resolution":{"observed_at":"2026-08-06T19:41:23.788082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.255365Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":"8a153977-a129-4bef-be36-8bb85d3e7c6a","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.791122Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:3ba61a549bc7c8b707db862a4b947d8b7d759f81a688c84cc7cc788af34c1af7","observation_id":"10e389e7-0f61-43f6-b4b9-303926d15be5","resolution":{"observed_at":"2026-08-06T19:41:24.258779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-06T19:41:23.793876Z","title":"Janus: Decoupling visual encoding for unified multimodal understanding and generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.793876Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:cb55c3727e114008a705c8b139585d3bfac7699fb76a5464a4e2efaf650d8a29","observation_id":"b6830a1d-9454-4d9e-9dc4-fdfa04d5e7f3","resolution":{"observed_at":"2026-08-06T19:41:23.793876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-06T19:41:23.796917Z","title":"Vila-u: a unified foundation model inte- grating visual understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.796917Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:cf6af3eeebc546008d930e71604e1a5309b272575a96f6add8562f87613e9d38","observation_id":"6d49930b-816d-492d-a59a-bb82a5337018","resolution":{"observed_at":"2026-08-06T19:41:23.796917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-06T19:41:23.799913Z","title":"Sana: Efficient high-resolution image syn- thesis with linear diffusion transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.799913Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:6a16fac155e5dbd2a9afb639daf0f882ff362f125987bd683c840b9717d8eac5","observation_id":"3a94fa02-2984-48fc-8485-0a6fe88377f3","resolution":{"observed_at":"2026-08-06T19:41:23.799913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18427","last_updated":"2025-05-17T13:26:31Z","snapshot_observed_at":"2026-08-06T13:34:35.279373Z","submitted_at":"2025-01-30T15:31:48Z","title":"SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18427","snapshot_observed_at":"2026-08-06T19:41:23.803601Z","title":"Sana 1.5: Efficient scaling of training-time and inference-time compute in linear diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.803601Z"},"links":{"cited_paper":"/paper/2501.18427","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:03c4b0bc5d980930dd349cdc7654a99d7ad1e67828736feff6a000482cbe4528","observation_id":"17170477-082e-4982-9a7a-c920950cf2bd","resolution":{"observed_at":"2026-08-06T19:41:23.803601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-06T19:41:23.806841Z","title":"Show-o: One single transformer to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.806841Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:2a33bf5c08c8478dc9c2c185bda6e7e94634a6b48acded722544efd593808eec","observation_id":"7d9a9c8d-afb2-4b25-9f0c-0017bc5bd809","resolution":{"observed_at":"2026-08-06T19:41:23.806841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04671","last_updated":"2024-10-07T00:55:42Z","snapshot_observed_at":"2026-07-06T19:28:43.743447Z","submitted_at":"2024-10-07T00:55:42Z","title":"CAR: Controllable Autoregressive Modeling for Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04671","snapshot_observed_at":"2026-08-06T19:41:23.810106Z","title":"Car: Controllable autoregressive modeling for visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.810106Z"},"links":{"cited_paper":"/paper/2410.04671","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:62a07b366bdc2c70d8cfc406de8e2e33d79d15204d89bf28b30845d6fcdbbb4e","observation_id":"7220a54c-9e3d-467b-bfcd-98c904db1064","resolution":{"observed_at":"2026-08-06T19:41:23.810106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.244126Z","title":"Scaling autoregres- sive models for content-rich text-to-image generation.Trans","venue":null,"work_id":"e0af3a5f-75a6-42de-985d-0d316b8a7b0e","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.813094Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:7db93065ba03a5eab97b9465ad47ed4d76444beee5bbdfacae8a5bcc9bfd83a4","observation_id":"9d469825-40e3-496d-81ae-64fe1f51a583","resolution":{"observed_at":"2026-08-06T19:41:24.247703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.233654Z","title":"Magvit: Masked generative video transformer","venue":null,"work_id":"0e4af14a-4662-487a-97f0-5057f367c8ab","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.816090Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:929d6fcafa5fbb6fe1d9f965ac92101c31228f5cef3e7b14be2e2f43975384c3","observation_id":"a4399186-bebf-4829-8b73-eacedc0fa28e","resolution":{"observed_at":"2026-08-06T19:41:24.237240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.222823Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":"c9cf48cd-987e-4635-ab4e-9dc74138fbbb","year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.818931Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:74d264b543d602a878c031667e6018921f9f9c752d276af42df741e7f0791c71","observation_id":"852f6685-331f-4262-8912-dd1508fe325f","resolution":{"observed_at":"2026-08-06T19:41:24.226993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21772","snapshot_observed_at":"2026-08-06T19:41:23.821729Z","title":"Shield- gemma: Generative ai content moderation based on gemma","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.821729Z"},"links":{"cited_paper":"/paper/2407.21772","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:135bd06aa12e508b8b36ddb32b2e253032f7aaf0a4c90e013e38341d89a4212a","observation_id":"0cbbcf26-880c-45f5-b390-3b08383a86aa","resolution":{"observed_at":"2026-08-06T19:41:23.821729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05796","last_updated":"2025-04-05T18:15:41Z","snapshot_observed_at":"2026-07-06T20:03:20.752332Z","submitted_at":"2024-12-08T03:18:17Z","title":"Language-Guided Image Tokenization for Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05796","snapshot_observed_at":"2026-08-06T19:41:23.825012Z","title":"Language- guided image tokenization for generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.825012Z"},"links":{"cited_paper":"/paper/2412.05796","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:57056c671b20786a161c58a5683eb0f4900ef1aefdb61365463d820c3f13d184","observation_id":"04a282f2-e224-4651-b17e-bd2a670c7af5","resolution":{"observed_at":"2026-08-06T19:41:23.825012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-06T13:04:34.380567Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-06T19:41:23.828655Z","title":"Var-clip: Text-to-image gen- erator with visual auto-regressive modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.828655Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:af870fb1eb050ed1aef8706f16dcd03f77a1bed95c53d174ed3d62bae221e566","observation_id":"43ad1ff8-72f0-4a82-99e6-2f3e1f952c7e","resolution":{"observed_at":"2026-08-06T19:41:23.828655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.210632Z","title":"A red heart","venue":null,"work_id":"6cf43064-c5c6-49b7-8cf7-0ff2e015fdcf","year":2018},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.831463Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:a193c22c1ec4d21c11269015c747c306b043a85d6386ee8b7ee832eb740acf5a","observation_id":"6b79ced7-fa55-4df9-a90c-e187a0b47102","resolution":{"observed_at":"2026-08-06T19:41:24.215300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:33:15.001245Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":30},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 1 inbound Pith citation observation for arXiv:2507.04947."}