{"as_of":"2026-08-09T07:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b6a3d87e354717490bf032613b20c0f3db1f4d5a6ca8ca80b174a4c81ea888c","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:51:39.674630Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12035/citation-record","integrity":"/paper/2506.12035/integrity","json":"/paper/2506.12035/citation-record.json","paper":"/paper/2506.12035"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:34.522136Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:34.522136Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:a8b7c6f3fd50e24b4d944bd07836449c9807cfa727edc35ed1161413e9f7970c","observation_id":"0855b291-cb86-48f8-9c29-b71ffc09993d","resolution":{"observed_at":"2026-08-07T14:51:34.522136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:34.599885Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:34.599885Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:38238c0fd06ea4a40ff5822fe6304a247941d8fa7ff518c18828c34eecaf57fb","observation_id":"71ad7472-ddfb-41d8-a021-6347bebc5f87","resolution":{"observed_at":"2026-08-07T14:51:34.599885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:34.739954Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:34.739954Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:2be7134b22674408a60bfc5e6430cf46ca8deb566e53a9e1836ee547f1037e40","observation_id":"bb8c33c4-17cd-4225-9d38-ba9f8a6ea557","resolution":{"observed_at":"2026-08-07T14:51:34.739954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:51:34.918931Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:34.918931Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:cd0232cde6028ca22d2d5b80f9bef1f6d157c30157061974bc6cc338afa2d63e","observation_id":"43ff26fe-c2b7-4df8-9318-35a391f46122","resolution":{"observed_at":"2026-08-07T14:51:34.918931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.060491Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.060491Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:b7e1f8a3ca944906b55ccc83438783683c1a9ba6bf83ce2f0d44ebf296046408","observation_id":"9362b41c-ba1e-414c-a0bf-59b72d46d594","resolution":{"observed_at":"2026-08-07T14:51:35.060491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.109638Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.109638Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:66777c36bf9f4b134fca7c010feabff0cbd570d19bda4591639302e15734415b","observation_id":"79d57e66-4b1b-4793-95ca-1465951410ec","resolution":{"observed_at":"2026-08-07T14:51:35.109638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.151996Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.151996Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:5d07c513e953407df0b904b06aa9d389146f7f0eb2cf9caf41a0064a41242e0b","observation_id":"09b31c6d-fbfb-40af-9baa-10fbb3e2e76c","resolution":{"observed_at":"2026-08-07T14:51:35.151996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.221860Z","title":"Generative pretraining from pixels","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.221860Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:9de5ba10b3d60846156227281f705dc7db85b7dbe2ec1b297ce85e4af1ce650f","observation_id":"0408b77d-ce05-4bf7-a8a1-4264f0a03455","resolution":{"observed_at":"2026-08-07T14:51:35.221860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.324924Z","title":"Con- ditional image generation with pixelcnn decoders","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.324924Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:7c4011086c767059e0a2d4b81e20a7f1dcd294b6fcf983b155bb941465865d7e","observation_id":"550e00fe-7789-4d2d-b03b-d7803153e762","resolution":{"observed_at":"2026-08-07T14:51:35.324924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:42.819254Z","title":"Parallel multiscale autoregressive density estimation","venue":null,"work_id":"d710e558-ac6c-4234-b080-c5a20c49f27b","year":2017},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.404187Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:b4cddaf1f46dc5497f6b1cb832577d03af7a2aa243930c6a423a0713d83eea5e","observation_id":"dbea20ad-b1de-4434-945c-06d2cad83140","resolution":{"observed_at":"2026-08-07T14:51:42.898404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.487117Z","title":"Image transformer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.487117Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:dcd80130a7e7c975ed92e456087ce07b16ec3c81129e88a6bd5d98df6d3cb067","observation_id":"facbe27e-024e-4770-a509-d4f1d93fed9c","resolution":{"observed_at":"2026-08-07T14:51:35.487117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.606850Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.606850Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:49ae483e99f394197db9c23d95252cf06eb8b077fd9991ef10d680b1cfebb162","observation_id":"97b20b8d-b383-4f70-85a9-301f44095392","resolution":{"observed_at":"2026-08-07T14:51:35.606850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T14:51:35.679726Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.679726Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:ad851039705dcae5158c2ed74bf849be5c266c6688bac10b0732f7172e231ebe","observation_id":"0d9faa52-18ba-456a-845d-ed4246ea6c70","resolution":{"observed_at":"2026-08-07T14:51:35.679726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.743187Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.743187Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:0a8984c2b0efcfea15d8629db2c69d4e1ae0761147a3e5633071f3e0bca56ae4","observation_id":"f617ee0c-8aa9-4f26-9bbd-47849bdc9c2b","resolution":{"observed_at":"2026-08-07T14:51:35.743187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-07T14:51:35.831619Z","title":"Scaling autoregressive models for content-rich text-to-image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.831619Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:73b1fc8e282abd9a959315bed80a4bb192ed9e13a311994b1601e5c727507113","observation_id":"da2819f2-d93e-4d5c-be32-2e15503fb3be","resolution":{"observed_at":"2026-08-07T14:51:35.831619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.946175Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.946175Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:812a66cbef48f7afc0368f8e068904c019ec46591667e8d63ba6cfa7a265691a","observation_id":"44de99e3-b8f4-47b1-80e0-1dfd2dd35e50","resolution":{"observed_at":"2026-08-07T14:51:35.946175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:42.563372Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"b15b99c7-9e9a-4d4f-9ef4-22d458796b27","year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.019159Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:bdb3207b930f61d3688fe7240d6a78a70600f3ff588deecd71253e44502ad7e0","observation_id":"67d90918-9981-4272-917a-35d7cd87f5d9","resolution":{"observed_at":"2026-08-07T14:51:42.674671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:42.339951Z","title":"Cogview: Mastering text-to-image generation via transformers","venue":null,"work_id":"02ed578f-13bd-4af5-98bb-78bfd910a07f","year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.106126Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:ad9db27745f9710de07cd0035cb05abe93abfd294aee495c9e99df869662ac96","observation_id":"0a942605-7717-4ca5-97ea-d740ed3accc4","resolution":{"observed_at":"2026-08-07T14:51:42.448903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.203044Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.203044Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:416a75478ad97fd9d2089da68966eebd303bdac57183068bedd695c14ef2f2e6","observation_id":"0c6278ae-2827-48e3-abbf-c41acfa2dce1","resolution":{"observed_at":"2026-08-07T14:51:36.203044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00704","last_updated":"2023-01-02T14:43:38Z","snapshot_observed_at":"2026-08-03T00:33:47.397969Z","submitted_at":"2023-01-02T14:43:38Z","title":"Muse: Text-To-Image Generation via Masked Generative Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00704","snapshot_observed_at":"2026-08-07T14:51:36.281876Z","title":"Muse: Text-to-image generation via masked generative transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.281876Z"},"links":{"cited_paper":"/paper/2301.00704","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:4144009a243e6ca31066d8c36a8d1c0006005740909cf3a8880f2e7d8758007b","observation_id":"93898f86-93a1-4007-bbe9-fd4ddcd0c70e","resolution":{"observed_at":"2026-08-07T14:51:36.281876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:42.138762Z","title":"Mage: Masked generative encoder to unify representation learning and image synthesis","venue":null,"work_id":"0e908d68-24ed-4d31-bae4-7e7570b6a433","year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.348766Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:113c793db7030b2a8f6227a728ecf8ad688244b990414325e1436f8957fae41e","observation_id":"015dee4b-739b-4098-a76c-8689b2828a3a","resolution":{"observed_at":"2026-08-07T14:51:42.216217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.470938Z","title":"Autoregressive image generation without vector quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.470938Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:dfb96e077b80d7e8fa3a7b944bafccf38ec6cca0328ca36cddf0fd969b37b210","observation_id":"6b8602d1-b76f-41e9-ba6b-cdfa0b55c1de","resolution":{"observed_at":"2026-08-07T14:51:36.470938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.555721Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.555721Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:60144de5e95a8678e2383c99d995d0a6aac72547e20a46819255d835fb0ad497","observation_id":"ace0fd0d-9ea8-49ea-b89c-5d8550a3225a","resolution":{"observed_at":"2026-08-07T14:51:36.555721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.625243Z","title":"Generating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.625243Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:8af508500dcdbfddb68e7e1011f172574d0bbba8aded89e61720cde8f2866c55","observation_id":"887af349-8cf6-46bb-abf9-dd8d21f3ccff","resolution":{"observed_at":"2026-08-07T14:51:36.625243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.707317Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.707317Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:e319b679ceb0525702d9b19f68b536b2f984a2ea919f0fb624ce3ff04ff9a4d7","observation_id":"13bdb4ab-2099-4c46-b335-46770ba5ffd2","resolution":{"observed_at":"2026-08-07T14:51:36.707317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-07T14:51:36.819702Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.819702Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:16b227f815ca690c9cafcc860cab19f057409d3788e3d4843f36dbdce15641cc","observation_id":"97a60daa-89ff-42b7-95d6-cc77432e1e3e","resolution":{"observed_at":"2026-08-07T14:51:36.819702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.918375Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.918375Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:70dc8b48bdb8a0726b7aa83424d12f257eb46ee05fce9ef8a56a1c34132fb2cf","observation_id":"47b04ec4-31d8-40b4-8531-0e61630506bc","resolution":{"observed_at":"2026-08-07T14:51:36.918375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01801","last_updated":"2024-10-29T18:26:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T05:17:08Z","title":"Model Tells You What to Discard: Adaptive KV Cache Compression for LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01801","snapshot_observed_at":"2026-08-07T14:51:36.998467Z","title":"Model tells you what to discard: Adaptive kv cache compression for llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.998467Z"},"links":{"cited_paper":"/paper/2310.01801","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:a06aa2b7497ad314e540733b57d6a7ba17209996952daf2f4458439c7d616bca","observation_id":"43f963b5-6dfe-4b4f-9014-e939bbd9bbcb","resolution":{"observed_at":"2026-08-07T14:51:36.998467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:41.861771Z","title":"Keyformer: Kv cache reduction through key tokens selection for efficient generative inference","venue":null,"work_id":"a8daea6b-9183-4fbb-aabe-3b1b7a6f5a05","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.082269Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:c8e93b727f74263e2572dcd6c5aa05d4233de54eef82612efaf910e6ca42581b","observation_id":"c7b3339b-aa57-4708-80e2-d93519b5d011","resolution":{"observed_at":"2026-08-07T14:51:41.992619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:41.692172Z","title":"Arkvale: Efficient generative llm inference with recallable key-value eviction","venue":null,"work_id":"ffd14363-f5cb-4a93-8b8b-01d658f46b8c","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.199442Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:f8fcd17fce2bf6b4c98326a412312371982322ad658d60a7ece76e5882054ae3","observation_id":"0bcdc309-b746-4e0d-8edc-f25d29288da5","resolution":{"observed_at":"2026-08-07T14:51:41.797671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10774","last_updated":"2024-08-26T21:01:02Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T01:33:02Z","title":"Quest: Query-Aware Sparsity for Efficient Long-Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10774","snapshot_observed_at":"2026-08-07T14:51:37.284507Z","title":"Quest: Query-aware sparsity for efficient long-context llm inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.284507Z"},"links":{"cited_paper":"/paper/2406.10774","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:c3d29b4b4068e4b3749d67fd7e133c18370224e1f29af1e3f96138fe3b0547c3","observation_id":"3329ceac-9a9b-4278-b3a4-40badbf4fc78","resolution":{"observed_at":"2026-08-07T14:51:37.284507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16211","last_updated":"2024-12-08T19:55:36Z","snapshot_observed_at":"2026-08-04T16:36:02.143481Z","submitted_at":"2024-09-24T16:12:12Z","title":"MaskBit: Embedding-free Image Generation via Bit Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16211","snapshot_observed_at":"2026-08-07T14:51:37.368918Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.368918Z"},"links":{"cited_paper":"/paper/2409.16211","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:87f495aed6ab7789c874982201c49bf2b8af9aa76467ab3d2c397a07c83cef17","observation_id":"51afbdb6-c529-42c8-bc39-60d2fd5d1e14","resolution":{"observed_at":"2026-08-07T14:51:37.368918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:41.441695Z","title":"Improved masked image generation with token-critic","venue":null,"work_id":"682bc3ef-ffc3-4371-a322-88cdec1f96c9","year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.436193Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:5dafcf059cd45c6b092678f33c11c39a64fe3d5f51835f8e8a7415f0c9197faa","observation_id":"1e63f68a-2ffd-4d4b-af1c-8accd9f5c043","resolution":{"observed_at":"2026-08-07T14:51:41.572898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:37.543931Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.543931Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:8243df4b377798e19df9a51d0487ca3cc11a5a25e34a374b366bd1fe7ca0050e","observation_id":"c8fd2eb0-fa39-40c1-9839-eaf5a1b638db","resolution":{"observed_at":"2026-08-07T14:51:37.543931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-07-29T20:17:21.488997Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-07T14:51:37.635963Z","title":"Dpm- solver++: Fast solver for guided sampling of diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.635963Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:cc2b07958a84947fcb44c8ff9c525f8d9c7936792a17c5d6dea5e9b8b92abcd5","observation_id":"490547de-cf89-4b24-9cbd-fdb9d30dda34","resolution":{"observed_at":"2026-08-07T14:51:37.635963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:37.695253Z","title":"Oms-dpm: Optimizing the model schedule for diffusion probabilistic models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.695253Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:b45ec6ff5d79f901132e60a954d19f38f0245d32ad38f7acbab5c85d82e7cc67","observation_id":"f779dddb-3e16-4ed4-888c-94759087a487","resolution":{"observed_at":"2026-08-07T14:51:37.695253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:37.784997Z","title":"Mixdq: Memory-efficient few-step text-to-image diffusion models with metric-decoupled mixed precision quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.784997Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:b543c3a9d4157fabd6e8dfe311a6b0047749c1a5e5d9bfe8e175db0dbac799db","observation_id":"85762a26-6964-4ea9-9e1c-65a5107c739b","resolution":{"observed_at":"2026-08-07T14:51:37.784997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02540","last_updated":"2025-02-22T16:29:03Z","snapshot_observed_at":"2026-08-09T01:39:40.569339Z","submitted_at":"2024-06-04T17:57:10Z","title":"ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02540","snapshot_observed_at":"2026-08-07T14:51:37.905137Z","title":"Vidit-q: Efficient and accu- rate quantization of diffusion transformers for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.905137Z"},"links":{"cited_paper":"/paper/2406.02540","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:0a827f49503580231e8330731b9f0f88341821e3150e9b0acfa4e5674ab68922","observation_id":"dd2ab87b-5330-4308-abda-84b02de2c8f3","resolution":{"observed_at":"2026-08-07T14:51:37.905137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:41.198878Z","title":"Ditfastattn: Attention compression for diffusion transformer models","venue":null,"work_id":"c347a059-7dbe-4886-aeed-98cbbf24426e","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.990389Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:340edf90b26f800c9bd19bef3f6f03147af04169439c2688de7c350adb370c9c","observation_id":"756c4c89-9f8e-465d-bbc7-b776da15de36","resolution":{"observed_at":"2026-08-07T14:51:41.291719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:38.106131Z","title":"Deepcache: Accelerating diffusion models for free","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.106131Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:be26a220f48d4778e088a301e92aa1a3dc9e881f66c2f6c0d8d3a555228adf2c","observation_id":"65a89333-3f65-4512-9cb5-47eb406ba394","resolution":{"observed_at":"2026-08-07T14:51:38.106131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:38.221896Z","title":"Cache me if you can: Accelerating diffusion models through block caching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.221896Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:611c885ac19746b2de82bf3ca3d0cec92a1d165c43ab7a99a1c52a8a3f939398","observation_id":"515494ef-31a9-420c-bb8d-3fe28a85a446","resolution":{"observed_at":"2026-08-07T14:51:38.221896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:38.305668Z","title":"Approximate caching for efficiently serving {Text-to-Image} diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.305668Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:a5394582f9751c96a36058206fe7ae4f81c186c4e681a2f747abb4799c9f94f4","observation_id":"d7336f79-12f7-4f44-aaa5-347bed5eecce","resolution":{"observed_at":"2026-08-07T14:51:38.305668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03355","last_updated":"2025-03-02T07:45:09Z","snapshot_observed_at":"2026-07-06T19:27:37.936219Z","submitted_at":"2024-10-04T12:21:03Z","title":"LANTERN: Accelerating Visual Autoregressive Models with Relaxed Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03355","snapshot_observed_at":"2026-08-07T14:51:38.393125Z","title":"Lantern: Accelerating visual autoregressive models with relaxed speculative decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.393125Z"},"links":{"cited_paper":"/paper/2410.03355","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:b79387a764a52ef13197d330adeca7600cc2ec0555c5dfa32cc0f03b3b7e0dcc","observation_id":"45cf22a6-689c-474d-a52a-82c9b1c7b3f9","resolution":{"observed_at":"2026-08-07T14:51:38.393125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01699","last_updated":"2025-03-04T04:33:27Z","snapshot_observed_at":"2026-08-06T12:47:52.616897Z","submitted_at":"2024-10-02T16:05:27Z","title":"Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01699","snapshot_observed_at":"2026-08-07T14:51:38.475432Z","title":"Accelerating auto-regressive text-to-image generation with training-free speculative jacobi decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.475432Z"},"links":{"cited_paper":"/paper/2410.01699","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:9fb92945601a545792728314c07dcca3f45163096c21f58919769536e38bc680","observation_id":"4a6c1563-eda2-495a-8e40-d4a20d9a33c8","resolution":{"observed_at":"2026-08-07T14:51:38.475432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:40.920054Z","title":"Enat: Rethinking spatial-temporal interactions in token-based image synthesis","venue":null,"work_id":"972dfe25-22cb-46bc-8893-00885f098226","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.600348Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:8587d111b92b61dc8630724c293439fb76bc872f95d020eed57825b744208391","observation_id":"2a326e07-2f4f-4ad0-88f9-bd1fbc76fd85","resolution":{"observed_at":"2026-08-07T14:51:41.044269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12450","last_updated":"2025-03-16T10:54:59Z","snapshot_observed_at":"2026-08-07T17:00:46.891028Z","submitted_at":"2025-03-16T10:54:59Z","title":"LazyMAR: Accelerating Masked Autoregressive Models via Feature Caching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12450","snapshot_observed_at":"2026-08-07T14:51:38.761307Z","title":"Lazymar: Accelerating masked autoregressive models via feature caching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.761307Z"},"links":{"cited_paper":"/paper/2503.12450","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:bfae6d508d7b2d88fb90dba0becf5dc6f7b48c0d95300fb3cda555a06571dbcd","observation_id":"dcc9f420-d816-4a04-9646-0e35d4fab642","resolution":{"observed_at":"2026-08-07T14:51:38.761307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00382","last_updated":"2025-02-01T09:41:01Z","snapshot_observed_at":"2026-08-05T03:53:54.199942Z","submitted_at":"2025-02-01T09:41:01Z","title":"Masked Generative Nested Transformers with Decode Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00382","snapshot_observed_at":"2026-08-07T14:51:38.875000Z","title":"Masked generative nested transformers with decode time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.875000Z"},"links":{"cited_paper":"/paper/2502.00382","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:49b6a6e68bd5f834c37ff45f9855bd6f034d116e84bf164d3796fbff6d39decd","observation_id":"3061cc74-1719-4ceb-9d97-6717f4f92a8a","resolution":{"observed_at":"2026-08-07T14:51:38.875000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:40.629614Z","title":"Efficient attention: Attention with linear complexities","venue":null,"work_id":"e31212df-4c28-48a0-905e-0a2e6b2c1502","year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.026651Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:4a0bc92673d3b1fc5b752283fe68c5c9f429c650384e33330cfef584438b3182","observation_id":"f330e986-a343-4de0-9d9f-8c6ae8c5029e","resolution":{"observed_at":"2026-08-07T14:51:40.789777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:39.140239Z","title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.140239Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:cb2bd9a7396456b55edad917f496d02be4cc3150a5ca3aa5c35c9f7ca93c972d","observation_id":"2cf67de3-23ae-4f53-b387-378b4ccab314","resolution":{"observed_at":"2026-08-07T14:51:39.140239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-07T14:51:39.254887Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.254887Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:9249cd5f82672c857cc4aba9d1f572af573a7efc090b0ed48cb3794c41a5be7d","observation_id":"bf542ecc-b918-4352-98c5-5b023fd7ce06","resolution":{"observed_at":"2026-08-07T14:51:39.254887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:40.429662Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision","venue":null,"work_id":"170e8fd4-fdb2-4c53-a315-4f959be1dc07","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.367546Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:c2014744764bd874c769e8c939bb133c1ad7935bc192bae6fc7c4c69ea043ade","observation_id":"c6cf25e8-9611-42a6-9ec6-5d564c585d18","resolution":{"observed_at":"2026-08-07T14:51:40.532249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:40.170004Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"18a6f15d-0fbe-4ac8-b433-9ff42c234f22","year":2017},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.443033Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:41ee88b2dc1bc6813b54c8c5e3fd134bbe91563144424f562585eb70f409ae26","observation_id":"efafe7c4-52bf-4e40-8d87-a92f2602e5b1","resolution":{"observed_at":"2026-08-07T14:51:40.270692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:39.555453Z","title":"Improved techniques for training gans","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.555453Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:552e108e97705b5af051f6eb3f5c447824534b97666644b339841c67a95c35d6","observation_id":"0bff735c-a713-4f48-a045-ce9662e3d156","resolution":{"observed_at":"2026-08-07T14:51:39.555453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:39.955429Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"674cc116-3d23-4489-aab1-84f85b4682b8","year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.674630Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:0d84f7acabc576a4f337595d37dc48bbe5a872c613dc5a441f1e1d4e2e88dae7","observation_id":"2c401573-b2a1-4ffc-a390-69b76c7df4a8","resolution":{"observed_at":"2026-08-07T14:51:40.037165Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T01:40:05.216347Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2506.12035."}