{"as_of":"2026-08-08T08:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2f24275ee4e33663825a0c2d458074fa742726164529382a156bc1587d163ba","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:22:23.749597Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19089/citation-record","integrity":"/paper/2505.19089/integrity","json":"/paper/2505.19089/citation-record.json","paper":"/paper/2505.19089"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:30.322222Z","title":"Structured denoising diffusion models in discrete state-spaces","venue":null,"work_id":"929b1813-000d-45aa-89d0-e740ce59d04f","year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:19.702342Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:625b526ed1926a6b6484472d5954b72beef01ebc6dd8e1dac37dff7aeb728688","observation_id":"d2b6a849-60a0-4afb-b9ca-0f7df212d632","resolution":{"observed_at":"2026-08-07T14:22:30.356164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:30.152031Z","title":"All are worth words: a vit backbone for score-based diffusion models","venue":null,"work_id":"f3fed24a-dddc-4b3f-8155-eb37b8bf3ca1","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:19.783708Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:8779e4b60bb5a913945f32c693cba005f9b55d19478ebe89c1725c0cdd6ef9a0","observation_id":"c8422181-518a-4c94-8933-a6528b173ac8","resolution":{"observed_at":"2026-08-07T14:22:30.225543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:30.052910Z","title":"Beit: Bert pre-training of image transformers","venue":null,"work_id":"573b0773-b90f-4aaf-8dd1-8d60ea11afb9","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:19.894865Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:1f26d7665684b87a59aa543db92d9f96601adbf4ae50383ee9746168de0de03d","observation_id":"db864d19-a145-4a53-a48b-364b021c169f","resolution":{"observed_at":"2026-08-07T14:22:30.092278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:29.896073Z","title":"Freeman, Michael Rubinstein, Yuanzhen Li, and Dilip Krishnan","venue":null,"work_id":"8187df60-6e34-43cf-9637-57d2ca619231","year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.057049Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b0eba83f671c0f5cfcc3ce275caeb062ccd52ff653892f42812da3b3279309db","observation_id":"29ecc8be-668b-4141-aacc-df82402ad5ad","resolution":{"observed_at":"2026-08-07T14:22:29.945378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:29.745458Z","title":null,"venue":null,"work_id":"c50f16e5-6980-4504-a3ea-5808a5445664","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.094167Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:50667f62cf3c2394409705c1d325457e15f229070a7c6cc0791bbb27cb1ec640","observation_id":"9c142a2c-0f5c-463f-a2a1-0a450ea1482e","resolution":{"observed_at":"2026-08-07T14:22:29.806377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12095","last_updated":"2024-12-17T18:45:55Z","snapshot_observed_at":"2026-07-06T20:07:58.873037Z","submitted_at":"2024-12-16T18:59:29Z","title":"Causal Diffusion Transformers for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12095","snapshot_observed_at":"2026-08-07T14:22:20.175049Z","title":"Causal diffusion transformers for generative modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.175049Z"},"links":{"cited_paper":"/paper/2412.12095","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:2157fe0c6ef7ac3b9a9d4cc6362d3b7461f3f9744c1f25a818f1105747e04841","observation_id":"207544d0-fa63-42af-8ba3-7adbd0774495","resolution":{"observed_at":"2026-08-07T14:22:20.175049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.258861Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.258861Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:fc58dab42bc8f50c3fea3ccd909480fe19c99a7ccb6d10c4af9f5a1310f6ca1c","observation_id":"48c074fd-7cda-4857-a63b-fd1d368489ce","resolution":{"observed_at":"2026-08-07T14:22:20.258861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.394852Z","title":"Bert: Pre-training of deep bidi- rectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.394852Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:9171454aba2f30d996bff49a9ca0b834145467a1650f1e6db8e63d50437f432d","observation_id":"e28a6360-7857-4299-b76b-3fca6162c69e","resolution":{"observed_at":"2026-08-07T14:22:20.394852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:29.533152Z","title":"Diffusion models beat GANs on image synthesis","venue":null,"work_id":"279c1d52-f83f-48ef-be68-6916892e9a7d","year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.455774Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b25eb9dc201c96b8c80ef402c160cbccdadfa344fedeff0a1efc44f8a779c726","observation_id":"32c914a6-4410-439a-a1f4-208194db83a4","resolution":{"observed_at":"2026-08-07T14:22:29.620944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:29.376515Z","title":"Imagebart: Bidirectional context with multinomial diffusion for autoregressive image synthesis","venue":null,"work_id":"6ec10e17-16f6-451c-8356-9f1e1999c2b4","year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.509207Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:70b2cc8bb242defd4784ef4640e0e183fbc4bd53d4b297b3f380abee2186b44c","observation_id":"c5d6181c-560b-47bb-ab72-0bddcc2b0870","resolution":{"observed_at":"2026-08-07T14:22:29.444541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:28.945632Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"60f53d43-97ab-42f0-9e5c-2e027851fada","year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.562051Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b9240d8c6ec91844a4b595403faeb4230af4609208cd715e585842f9e8f6f537","observation_id":"43f9f8bc-184f-4c2c-b7bd-516e714fb2e8","resolution":{"observed_at":"2026-08-07T14:22:29.209123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-07T22:15:46.490983Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-07T14:22:20.617028Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.617028Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:414e1ca5871ebdac25158b64dc036d52929be05ca01fb32ac5547c20d3a180ff","observation_id":"ff9a1bf0-9ae0-41b2-bb10-e2ba1b3f28b3","resolution":{"observed_at":"2026-08-07T14:22:20.617028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-07T14:22:20.756291Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.756291Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:114da80460cb3aef34387cf9f3f0e9ea72452d95ca86124274481b7197754f8a","observation_id":"8c35af6d-d189-4965-aad3-4868b574bc21","resolution":{"observed_at":"2026-08-07T14:22:20.756291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15833","last_updated":"2020-12-31T18:52:59Z","snapshot_observed_at":"2026-08-06T08:31:42.642575Z","submitted_at":"2020-12-31T18:52:59Z","title":"Fully Non-autoregressive Neural Machine Translation: Tricks of the Trade","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15833","snapshot_observed_at":"2026-08-07T14:22:20.810497Z","title":"Fully non-autoregressive neural machine translation: Tricks of the trade","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.810497Z"},"links":{"cited_paper":"/paper/2012.15833","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:0616d952b5f9482abb873ea0af2578d78689f2029d35269111c804890c7bbbfd","observation_id":"d5fdfa04-02ea-4bfa-9e37-b2f8d092c6e7","resolution":{"observed_at":"2026-08-07T14:22:20.810497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:28.622453Z","title":"Vector quantized diffusion model for text-to-image synthesis","venue":null,"work_id":"86aadd7c-b088-4ca1-80ef-066967d85193","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.870748Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:30ca5dc32e85f8518acb7ca4f243b5235428a0026ac47b0fd8190cc67fe506a5","observation_id":"970f4271-30f9-402d-a7bc-768b5ffa2a9d","resolution":{"observed_at":"2026-08-07T14:22:28.745354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.922968Z","title":"Diffit: Diffusion vision transformers for image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.922968Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:c6cad0a5905b1dc268bfc145dd77d4a7edad5e2ff16d0bb2dbb746cb57e0be23","observation_id":"dd81193a-d53f-4bc1-aebe-6776476addf6","resolution":{"observed_at":"2026-08-07T14:22:20.922968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.020154Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.020154Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:5e48582a2eaa64c8cd1f0be3a3e20001dea3f0bbc0e55347cdadd7fa29bfb906","observation_id":"75ac87fc-86a8-4134-b102-e97c73a02b5d","resolution":{"observed_at":"2026-08-07T14:22:21.020154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:28.252847Z","title":"GANs trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"dd5d42f0-610e-4a43-9546-c7f337287cb7","year":2017},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.098532Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:4a615cf0bdc57b40a18a424061349e97029b7ca2ca2523ec7b45406c61dbd695","observation_id":"d7132c5e-5369-4d0e-a71e-927939234de6","resolution":{"observed_at":"2026-08-07T14:22:28.386531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T14:22:21.160809Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.160809Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:31daaee4d69dff3a40380e19d9a7a7b2a7281d554eaaa52b52d20991ef10b82a","observation_id":"df36ca3e-ca12-466b-a998-44f23e86eb80","resolution":{"observed_at":"2026-08-07T14:22:21.160809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:27.989031Z","title":"Understanding diffusion objectives as the elbo with simple data augmentation","venue":null,"work_id":"8446696b-e71c-4ec1-913f-ef6e26041c53","year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.240183Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:a5b89e658a2c46e0d14e5171eb9eabec3be6afb93d25449164852b06ba47fe50","observation_id":"24ccbca6-32bc-4891-a6ae-95261f4593a9","resolution":{"observed_at":"2026-08-07T14:22:28.061163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07724","last_updated":"2024-11-06T14:29:36Z","snapshot_observed_at":"2026-07-06T17:58:47.786948Z","submitted_at":"2024-04-11T13:16:47Z","title":"Applying Guidance in a Limited Interval Improves Sample and Distribution Quality in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07724","snapshot_observed_at":"2026-08-07T14:22:21.350491Z","title":"Applying guidance in a limited interval improves sample and distribution quality in diffusion models.arXiv preprint arXiv:2404.07724, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.350491Z"},"links":{"cited_paper":"/paper/2404.07724","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:1776f0e6a20abf46779b2897833f4d9d95ab4ffd18dcb6049f00147ed6d2e9d3","observation_id":"7b10031d-dc6c-4bad-aeac-c3f5444fed2e","resolution":{"observed_at":"2026-08-07T14:22:21.350491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.420593Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.420593Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:daa96af38d753f995becefc2691cc5df5e176b4e819fcaf9e566900de49c1d7d","observation_id":"bb6559a1-261d-4d0d-9d0c-90f549c4ea2b","resolution":{"observed_at":"2026-08-07T14:22:21.420593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:27.876134Z","title":"Draft-and-revise: Effective image generation with contextual rq-transformer","venue":null,"work_id":"e8276173-a56f-4428-98cd-3253c23b9834","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.454887Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:d597ada7c25492cd0c19c7d9860b2dd38454dc6beaa976558bdc828dd7732267","observation_id":"e9dabb62-c939-4e62-91ce-5790ad3eeb49","resolution":{"observed_at":"2026-08-07T14:22:27.917270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.484277Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.484277Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b8d0f902df0ea796e62cc3a247beaf2b983ab5afc8da64aee8cdb78bc03ca18f","observation_id":"3b0d97da-c2bc-4702-9c52-0f6d70eb038f","resolution":{"observed_at":"2026-08-07T14:22:21.484277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:27.553002Z","title":"Improved masked image generation with token- critic","venue":null,"work_id":"08775922-ee5c-4af6-8903-2d0227488e7e","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.533354Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:0063190719e357d2f5a8835cd94de7f3d2c7531c2c344c2ad34df1edc55071a9","observation_id":"34083a7a-8d7e-4cfc-8730-4ad1f4e16114","resolution":{"observed_at":"2026-08-07T14:22:27.763904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:27.012991Z","title":"Discrete predictor- corrector diffusion models for image synthesis","venue":null,"work_id":"169d265f-9130-495f-95f6-8b40a863108b","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.629552Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:bf804a01fb47afb16cd07210209714c2b59188135395f4d427772330efeecdac","observation_id":"6cc8e6df-2358-40dc-a244-5753c776b877","resolution":{"observed_at":"2026-08-07T14:22:27.321907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:26.602350Z","title":"Mage: Masked generative encoder to unify representation learning and image synthesis","venue":null,"work_id":"bac8302c-11f2-482f-b736-4573e126e491","year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.712465Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:2a0bd205f61f94c843b8ff9af0e3637c3ec452d4d4bfc30565df128b1e1adcf2","observation_id":"8a2ee06b-b9ef-4550-90b2-aac8dc92d642","resolution":{"observed_at":"2026-08-07T14:22:26.722456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:26.494297Z","title":"Return of unconditional generation: A self-supervised representation generation method","venue":null,"work_id":"1fec1835-f7c8-40a4-bfd3-ed6b5376ffc0","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.779255Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:69f934f13209ec075e2110c90aeafbf8676c74683f6c6b1b631327c8fdb2defa","observation_id":"92b546f6-50d1-415d-b2e0-ac66d25494ae","resolution":{"observed_at":"2026-08-07T14:22:26.560726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:26.285521Z","title":"Autoregressive image generation without vector quantization","venue":null,"work_id":"03658155-0e80-4283-b0a7-e5e57c02e7ba","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.818234Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:28f21563b1011f8259256deaf5bd4e8e44f85753e61a5e0e4853824e318f33ff","observation_id":"f2a1fb4d-da3b-47b0-8443-ff369f92c998","resolution":{"observed_at":"2026-08-07T14:22:26.352817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01949","last_updated":"2025-03-19T08:34:29Z","snapshot_observed_at":"2026-07-06T19:26:33.330434Z","submitted_at":"2024-10-02T18:51:38Z","title":"Discrete Copula Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01949","snapshot_observed_at":"2026-08-07T14:22:21.919608Z","title":"Discrete copula diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.919608Z"},"links":{"cited_paper":"/paper/2410.01949","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:54444306421339d4d5f9df870d39d9a36304720645627a3fafe6ed7a00c843a5","observation_id":"ebd10694-5bfd-499c-918e-2d38c0357b32","resolution":{"observed_at":"2026-08-07T14:22:21.919608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:26.057715Z","title":"Maskpredict: Parallel decoding of conditional masked language models","venue":null,"work_id":"9ec68c2b-9759-4c1b-9adc-8aa267e1a2b8","year":2019},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.991731Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:0e9f8b4fd2020f2942eed643523842af33b35fd2c2d0043c8d9f8d28ede74c3b","observation_id":"3a237b6b-c544-4d09-8e05-6ea1a2d72846","resolution":{"observed_at":"2026-08-07T14:22:26.164916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16834","last_updated":"2024-06-06T21:06:44Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:59:12Z","title":"Discrete Diffusion Modeling by Estimating the Ratios of the Data Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16834","snapshot_observed_at":"2026-08-07T14:22:22.063083Z","title":"Discrete diffusion modeling by estimating the ratios of the data distribution","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.063083Z"},"links":{"cited_paper":"/paper/2310.16834","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:4dd0b52952fa5958adc941e39b64b9994a652d6406f3b393e1cc319d29b2a205","observation_id":"cc0772e2-6f9f-4390-8632-65add6188ad3","resolution":{"observed_at":"2026-08-07T14:22:22.063083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:22.114264Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.114264Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:908880eb45ce7ec9d66eb45bb1e7a6ef67157b89dbdc67c72f60d3048ee4c6cb","observation_id":"b58e2f5d-f0de-4233-b716-39ac9528ac19","resolution":{"observed_at":"2026-08-07T14:22:22.114264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-07-29T20:17:21.488997Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-07T14:22:22.151155Z","title":"Dpm-solver++: Fast solver for guided sampling of diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.151155Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:6c31d17ed7517684fccc459d1d168435e7fbd6652a9d5f18162da53cc45db4a6","observation_id":"c85141af-6a79-4d40-9dfe-c2161220d8f0","resolution":{"observed_at":"2026-08-07T14:22:22.151155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:22.234181Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.234181Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:fe8a1b07235878d3e534d16352b97659a3c1a6c3cb05c80e44f8fe6e09ad80ff","observation_id":"cdc90829-40d4-453a-a339-359e2c279ae3","resolution":{"observed_at":"2026-08-07T14:22:22.234181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.879858Z","title":"Revisiting non-autoregressive transformers for efficient image synthesis","venue":null,"work_id":"9911af98-972f-4d6f-8959-2d19d5269a41","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.324049Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b17cbc32ca4918215c8b386aedcacaa112ee743057ff25ee8fb8cde23f633a30","observation_id":"d5997584-6c3a-4ad6-b15b-aa7c0dad9e7c","resolution":{"observed_at":"2026-08-07T14:22:25.965306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.651927Z","title":"Adanat: Exploring adaptive policy for token-based image generation","venue":null,"work_id":"66779b91-e25d-4450-bec3-9d31a963434b","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.383273Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:ec24167d09a4bedafe886c92bf6a464409fff3a8a199f29f545b0391d1b1b83f","observation_id":"18ba5bd5-400c-42e1-8c42-085ec0cb9a16","resolution":{"observed_at":"2026-08-07T14:22:25.689532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T14:22:22.430503Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.430503Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:be3d5d3e54d45886ee32d1d401104025a7bca26ff1240d1eb2967115cd1ff80c","observation_id":"af23bd07-ea75-4608-88ce-497f048feff0","resolution":{"observed_at":"2026-08-07T14:22:22.430503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.411564Z","title":"Scalable diffusion models with Transformers","venue":null,"work_id":"c4120e09-e09a-4041-9f99-03663c8adb59","year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.470385Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:d1ac58fd3377b1efcf9e1ac7804bd948719e3fc59b3b6a68f4fde0ba5c0a9c19","observation_id":"aae13b34-2ac2-43fd-90d1-e85c481b3d68","resolution":{"observed_at":"2026-08-07T14:22:25.532550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00750","last_updated":"2023-03-01T18:59:33Z","snapshot_observed_at":"2026-07-06T14:57:32.192330Z","submitted_at":"2023-03-01T18:59:33Z","title":"StraIT: Non-autoregressive Generation with Stratified Image Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00750","snapshot_observed_at":"2026-08-07T14:22:22.534676Z","title":"Strait: Non- autoregressive generation with stratified image transformer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.534676Z"},"links":{"cited_paper":"/paper/2303.00750","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:fa96cd35625793fdae143677f220c90c964d51bb5bf37348a4bd733d1ec6f599","observation_id":"c9722e61-a3da-40da-9e99-d39e12255091","resolution":{"observed_at":"2026-08-07T14:22:22.534676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:22.657186Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.657186Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:d36b6b08e26ddadae1af6571a925643c788ab22003ad6c30ecfc4a84b45c3872","observation_id":"27658364-cb1a-427b-bf80-5e35d4a62afe","resolution":{"observed_at":"2026-08-07T14:22:22.657186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.265697Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"86c40edd-9bcd-4a28-ba5d-8e869005f851","year":2019},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.715131Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:f68821ee60aa42fcd776c148c77e297c54565ed6ec2b0697106492cdd4050b90","observation_id":"5f7014a3-cbe8-430f-885c-6c34077dd2c1","resolution":{"observed_at":"2026-08-07T14:22:25.333231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.129776Z","title":"Generating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":"82118bfa-cc30-4e8b-9c2a-aa9b03f64cfc","year":2019},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.764804Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:570d73e441681082d4b146d42e7d4806c537bd8e22083fdd488c75f8916781a4","observation_id":"7558d3a6-743a-4d33-ad2d-197da628844d","resolution":{"observed_at":"2026-08-07T14:22:25.204504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-07T17:41:55.935183Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-07T14:22:22.867030Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.867030Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:7c385884b30b977acbc0fa9cad8c349ee768f67a6bc701fa5bf7973c22f14f65","observation_id":"3463cecd-eb04-4987-aadd-86d1f4c40274","resolution":{"observed_at":"2026-08-07T14:22:22.867030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:22.931168Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.931168Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:434e1bac7cbd02fa88d2853f5b5844ed7608fe0cab11d30ddd2ea02169fcd805","observation_id":"02f3d19d-c1ca-42fc-964e-b1b753b85e46","resolution":{"observed_at":"2026-08-07T14:22:22.931168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:24.932234Z","title":"Improved techniques for training GANs","venue":null,"work_id":"5bef9421-18f3-453e-a745-7825babf754e","year":2016},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.007958Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:57f1c956be0f86aa73ffb309b142db1e9e1fb0db92bc7e27444576d3aca96ced","observation_id":"a9051ae3-b2db-41f7-ad90-c955fa145ddf","resolution":{"observed_at":"2026-08-07T14:22:24.998850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-07T14:22:23.051577Z","title":"Fast transformer decoding: One write-head is all you need","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.051577Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:60fd40c81cefd8a72b8f5a9619839cf923113ab5af682cbd3d7a0d20b06aed6a","observation_id":"03c1a018-a45f-4f29-8af6-8755344f9ff5","resolution":{"observed_at":"2026-08-07T14:22:23.051577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:23.082603Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.082603Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:92f0b1de738cca8e1b59f7a18bef4cf59743f6dcbb37789fdb0aa7c309abf627","observation_id":"698a3f35-5924-48c1-a782-8c588e91b87e","resolution":{"observed_at":"2026-08-07T14:22:23.082603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:24.750325Z","title":"Givt: Generative infinite-vocabulary transformers","venue":null,"work_id":"7623d939-4884-44e8-83ac-684aeec8b7ee","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.160882Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:6471d8208ff887353d9ab48dcff33c9b7b124d40e889fd46faf5c3da8cb42bd2","observation_id":"e840a4cd-7e3d-455d-b7b8-573526dff548","resolution":{"observed_at":"2026-08-07T14:22:24.859172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:24.542710Z","title":"Neural discrete representation learning","venue":null,"work_id":"1eb6edaf-8db9-4c1d-a0f5-c4e940e92ad6","year":2017},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.249222Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:7f5b83ed828477e90ededbdf6b8d85b8f87839b6c42be72cafbaaf09f6658d2b","observation_id":"62195bd5-1c0c-460c-94d5-f7326aaa731c","resolution":{"observed_at":"2026-08-07T14:22:24.617975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:24.358969Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"d0476eab-1bf8-4e01-bd56-c90f14f7bd4f","year":2017},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.317491Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:0789a2917c1671f7642ca1d69c55c4e3291087d9a9b9e0808f0a733842ebf77f","observation_id":"b5e74a37-3d84-48da-b7ff-a9a134493487","resolution":{"observed_at":"2026-08-07T14:22:24.478080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16211","last_updated":"2024-12-08T19:55:36Z","snapshot_observed_at":"2026-08-04T16:36:02.143481Z","submitted_at":"2024-09-24T16:12:12Z","title":"MaskBit: Embedding-free Image Generation via Bit Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16211","snapshot_observed_at":"2026-08-07T14:22:23.365662Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.365662Z"},"links":{"cited_paper":"/paper/2409.16211","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:ef38d47bfccc8d3243db0c4c1ac43f53ab0ee7001e32b1697203865a8a4f9cd0","observation_id":"d2c80551-cc65-4d47-b8cf-b1d82d3fa46f","resolution":{"observed_at":"2026-08-07T14:22:23.365662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:23.463621Z","title":"Effective and efficient masked image generation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.463621Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:d78b5d9cd7e0c276ef544c48881991a432086f83c6eed1684029633d59c71b14","observation_id":"7c03548f-896e-4036-b03b-92b5b55f7f20","resolution":{"observed_at":"2026-08-07T14:22:23.463621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04627","last_updated":"2022-06-05T01:57:58Z","snapshot_observed_at":"2026-07-06T11:56:10.689708Z","submitted_at":"2021-10-09T18:36:00Z","title":"Vector-quantized Image Modeling with Improved VQGAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04627","snapshot_observed_at":"2026-08-07T14:22:23.537186Z","title":"Vector-quantized image modeling with improved vqgan.arXiv preprint arXiv:2110.04627, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.537186Z"},"links":{"cited_paper":"/paper/2110.04627","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:9768417f5f45eafa7b7eecff48625a546b5d6f4eddc36a969fab984a06057170","observation_id":"472a515d-fb67-4fbe-9c5c-52b01cce65a3","resolution":{"observed_at":"2026-08-07T14:22:23.537186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05737","snapshot_observed_at":"2026-08-07T14:22:23.633465Z","title":"Language model beats diffusion–tokenizer is key to visual generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.633465Z"},"links":{"cited_paper":"/paper/2310.05737","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:6e711ef94eb06f7e533d1f9a01870516c300ac1dee9c8e2288d5d4d81af42652","observation_id":"4f2298aa-a27f-4eff-9ec6-d3a744e13c67","resolution":{"observed_at":"2026-08-07T14:22:23.633465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-07T14:22:23.680186Z","title":"Representation alignment for generation: Training diffusion transformers is easier than you think","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.680186Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:2cce4334a4bd770314aa7fafa25749ec425a86486ed3ad6255a88ac454785010","observation_id":"8913b2b9-d47a-4016-92d9-9d6db51230d8","resolution":{"observed_at":"2026-08-07T14:22:23.680186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:23.749597Z","title":"sweet spot","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.749597Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b6500c8aea42bc71a32ad490f5dffd07e9515410252aced7519e0fc9021cc9a2","observation_id":"b308e1ef-e744-42eb-ab55-e00eb0348691","resolution":{"observed_at":"2026-08-07T14:22:23.749597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2505.19089."}