{"as_of":"2026-08-08T22:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:67c7ccb72fe82f83728a91e4ec90485599862209deb4a1c6dd82ff0c40385a7b","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:33:12.833852Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:40:16.892454Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T13:45:46.109771Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2603.06351","last_updated":"2026-05-07T16:40:07Z","snapshot_observed_at":"2026-07-06T22:48:08.821342Z","submitted_at":"2026-03-06T14:59:11Z","title":"DC-DiT: Adaptive Compute and Elastic Inference for Visual Generation via Dynamic Chunking","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T15:10:00.146694Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2603.06351"},"observation_digest":"sha256:312382f61df8d3b02d9b460e8348ccb51aea267f4e92733309a3379ccc50ac13","observation_id":"e35993a9-d991-427b-84a6-22aa4778c62d","resolution":{"observed_at":"2026-05-15T15:10:05.851830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2604.04913","last_updated":"2026-04-06T17:55:05Z","snapshot_observed_at":"2026-08-02T23:05:22.273323Z","submitted_at":"2026-04-06T17:55:05Z","title":"A Frame is Worth One Token: Efficient Generative World Modeling with Delta Tokens","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T19:19:17.796377Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2604.04913"},"observation_digest":"sha256:f347f70027d4e1f9a9be84d98da9dc3a8c5568a0e1e9eec4c882b1f89f96bdd5","observation_id":"43ca65b5-c884-476c-89eb-9a67ba031992","resolution":{"observed_at":"2026-05-10T23:10:50.174151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2604.15521","last_updated":"2026-04-16T21:00:41Z","snapshot_observed_at":"2026-07-06T23:03:02.938732Z","submitted_at":"2026-04-16T21:00:41Z","title":"Frequency-Aware Flow Matching for High-Quality Image Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T10:58:05.541289Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2604.15521"},"observation_digest":"sha256:ccd09b799f035f38217ca67e839614a8f8625f1477c3cdf288d1233d5d48a25e","observation_id":"b86c1ea3-1ce8-4a08-a0f2-0ad7cacd5cdf","resolution":{"observed_at":"2026-05-10T11:00:04.105673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-07-06T23:03:21.422544Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:1db7968e5dcd6717103c2e83a3be791008038ba0261374d9fa7df42112f52b31","observation_id":"a1252ef0-c61f-4411-b75a-250093626758","resolution":{"observed_at":"2026-05-10T09:03:25.769904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2605.09313","last_updated":"2026-06-16T05:24:37Z","snapshot_observed_at":"2026-08-05T22:00:25.912572Z","submitted_at":"2026-05-10T04:14:07Z","title":"Attention Sinks in Diffusion Transformers: A Causal Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T04:18:26.883899Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2605.09313"},"observation_digest":"sha256:eeb89d5cf45cd4259d2f9c77ab448dc624a0c0282959d7ef6f4a57d48c37fd2a","observation_id":"46388b3a-5e1a-407a-8fa7-2421d098f3b5","resolution":{"observed_at":"2026-05-12T06:26:24.044397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2605.09313","last_updated":"2026-06-16T05:24:37Z","snapshot_observed_at":"2026-08-05T22:00:25.912572Z","submitted_at":"2026-05-10T04:14:07Z","title":"Attention Sinks in Diffusion Transformers: A Causal Analysis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T05:59:16.233848Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2605.09313"},"observation_digest":"sha256:4c5c54c82b1241dbb3447e53a2bcb5fdf5846c0a1ea14d88859bcadc75e328ec","observation_id":"a5fff18d-56e4-433c-a0a9-601a2ebc0192","resolution":{"observed_at":"2026-05-13T06:02:23.283147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2605.09313","last_updated":"2026-06-16T05:24:37Z","snapshot_observed_at":"2026-08-05T22:00:25.912572Z","submitted_at":"2026-05-10T04:14:07Z","title":"Attention Sinks in Diffusion Transformers: A Causal Analysis","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T22:47:11.360530Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2605.09313"},"observation_digest":"sha256:575506e482ecf6919d693e019499d3fbc44319788392ca7816a4fccc1202a3cd","observation_id":"5a6911fb-01fb-4563-a1ba-bcbc644f8972","resolution":{"observed_at":"2026-07-01T13:45:46.111412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-08-02T06:40:16.892454Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers.arXiv preprint arXiv:2505.14687, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12358","last_updated":"2026-07-16T04:34:12Z","snapshot_observed_at":"2026-08-07T15:23:16.030924Z","submitted_at":"2026-07-14T05:17:24Z","title":"ACID: Adaptive Caching for vIDeo generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T06:40:16.892454Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2607.12358"},"observation_digest":"sha256:77977b46e13f34e7485ccad4e2e1cadaff896a0324b8b3369c0243d78194f07e","observation_id":"03ed245a-a299-4c3a-9bee-234a7289ec20","resolution":{"observed_at":"2026-08-02T06:40:16.892454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14687/citation-record","integrity":"/paper/2505.14687/integrity","json":"/paper/2505.14687/citation-record.json","paper":"/paper/2505.14687"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:08.008274Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.008274Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:3725a07661556f1fe3e7f32abae30699b09ebd431273d462893dd3a2804459e0","observation_id":"1aee1501-f069-4741-a986-6b2df5d8ef2a","resolution":{"observed_at":"2026-08-07T15:33:08.008274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T15:33:08.118350Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.118350Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:30121e74c8f932e2dc684b65e89cd3cee1c5fe9e7b2f4e54443687eb1c55878a","observation_id":"79c19ce1-eb41-4073-bc28-c88e517ff778","resolution":{"observed_at":"2026-08-07T15:33:08.118350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:18.201330Z","title":"Pixart- σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":"2a095ea5-998e-418e-b85e-8dd4b126ab7e","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.197422Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:d2a0e72e5dd73d91578e0ee3a3ae0d54b75c49d86b8f419cad2fa7c4c184b1f9","observation_id":"570f195f-2620-41dc-914c-3d3c2f7f226a","resolution":{"observed_at":"2026-08-07T15:33:18.248784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-07T15:33:08.290073Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.290073Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:2b482d5ca38abb248f51e5d813a40f97aa2f89733d06d53cac361420ab1549df","observation_id":"8e1e9712-4957-4e21-bf0d-88a4e3ac9617","resolution":{"observed_at":"2026-08-07T15:33:08.290073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02589","last_updated":"2025-02-04T18:59:46Z","snapshot_observed_at":"2026-07-06T20:31:08.252721Z","submitted_at":"2025-02-04T18:59:46Z","title":"COCONut-PanCap: Joint Panoptic Segmentation and Grounded Captions for Fine-Grained Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02589","snapshot_observed_at":"2026-08-07T15:33:08.388520Z","title":"Coconut-pancap: Joint panoptic segmentation and grounded captions for fine-grained understanding and generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.388520Z"},"links":{"cited_paper":"/paper/2502.02589","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:76842f6707512e90f1022675818fb05b8308e82dbc40c15144b3d708df5e71fd","observation_id":"f3978d47-c442-4331-bc50-de86e6ed8d5d","resolution":{"observed_at":"2026-08-07T15:33:08.388520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05496","last_updated":"2024-12-07T01:46:38Z","snapshot_observed_at":"2026-08-07T15:28:16.662668Z","submitted_at":"2024-12-07T01:46:38Z","title":"Flex Attention: A Programming Model for Generating Optimized Attention Kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05496","snapshot_observed_at":"2026-08-07T15:33:08.466620Z","title":"Flex attention: A programming model for generating optimized attention kernels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.466620Z"},"links":{"cited_paper":"/paper/2412.05496","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:7dee8e7a97d8a71624e4954bb48974056146cc0e92ad0ca675221789be16dd37","observation_id":"b65944f0-5ef0-4d1f-90ca-b981e5a77b81","resolution":{"observed_at":"2026-08-07T15:33:08.466620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:08.532943Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.532943Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:4b0630e29c4715f99f8ffefdfeac1ce472658ed67116a7c15166eab73bc5d92f","observation_id":"55148d36-2d75-4aad-8792-03b2310999da","resolution":{"observed_at":"2026-08-07T15:33:08.532943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:08.640437Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.640437Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:a29f483421f3fd284b21614c85f5bb4b10c631866bda56c7a6fbc5bd5a528712","observation_id":"4ed792c8-8bfc-49e3-a976-f12d51407e7b","resolution":{"observed_at":"2026-08-07T15:33:08.640437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:18.067120Z","title":"Structural pruning for diffusion models","venue":null,"work_id":"8183df60-3f86-4474-8473-d716230cf7a9","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.725477Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:7071e974f75c8588943a2a4f0050cd764101582197d537b8176d0ff57818325f","observation_id":"c084b80d-dd89-4d79-a5c9-8a0a46f8ebde","resolution":{"observed_at":"2026-08-07T15:33:18.103909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:17.919567Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment","venue":null,"work_id":"0fef2555-05aa-49e2-a864-a46829d63f92","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.815181Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:7f40d545e3f0b371f67ddce49e0d48844c6ad21a8d22fbe2c8e02c7a24ecc23b","observation_id":"aa39bbf9-2236-4de0-b5dd-b96f1eddd47d","resolution":{"observed_at":"2026-08-07T15:33:17.981770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:17.690575Z","title":"Neighborhood attention transformer","venue":null,"work_id":"e4cf165d-d7dd-48ab-b3fb-30bc9cacd7db","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.892465Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:a10d3aad5af3ecbd5981442b523e99d68b1a91c8e17de34be343bd45350953ba","observation_id":"4b10cff7-cce4-4bf4-a41e-21bfe2969bf6","resolution":{"observed_at":"2026-08-07T15:33:17.816114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18537","last_updated":"2024-06-12T08:20:59Z","snapshot_observed_at":"2026-07-06T16:55:01.268118Z","submitted_at":"2023-11-30T13:20:09Z","title":"A Simple Video Segmenter by Tracking Objects Along Axial Trajectories","version":2},"cited_work":{"arxiv_id":"2311.18537","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.18537","snapshot_observed_at":"2026-08-07T15:33:13.502180Z","title":"A Simple Video Segmenter by Tracking Objects Along Axial Trajectories","venue":"cs.CV","work_id":"809b4222-632f-4321-a502-ca36cb5bc239","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.965378Z"},"links":{"cited_paper":"/paper/2311.18537","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:08637d675d59eb4232edbd29fa17d3556c5332c20db6830f98f0193610f94e41","observation_id":"0eea724e-96ed-45c3-81e6-87c7c20ea960","resolution":{"observed_at":"2026-08-07T15:33:13.584587Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.065536Z","title":"Flowtok: Flowing seamlessly across text and image tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.065536Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:03ad07644e51e57cc1b87cce602266971db24f87d25d82d03a788f1dbcadd4f9","observation_id":"03515be4-1de5-4509-b57b-0eb2ae6b54e8","resolution":{"observed_at":"2026-08-07T15:33:09.065536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.139544Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.139544Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:4adc9db62b63c8201e75c6e6b6ee62a156da81d25f76c18a7c1afcd94c3d0a4f","observation_id":"03e5c20f-ce90-4244-ba60-26c8237e3e2f","resolution":{"observed_at":"2026-08-07T15:33:09.139544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.231873Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.231873Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:3ba27a59d480a78268b94c9c54d25ea878c2b6ea7c480ae8c6c52ff51b8d40c3","observation_id":"788e1d04-561d-4298-ba60-ebb3ee82799e","resolution":{"observed_at":"2026-08-07T15:33:09.231873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.321274Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.321274Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:9cadb4e6a84bad48e05881162326bf13a5c98a3dfa921eb95fded0bc05ced920","observation_id":"37d84659-5348-4166-a3cf-c3936698a787","resolution":{"observed_at":"2026-08-07T15:33:09.321274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.415489Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.415489Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:ccf1134bab8e717882df491e4925f9330e1421834c2734164511d8779a4a1e21","observation_id":"1f4363f6-381f-42b0-a7ea-d36456e50415","resolution":{"observed_at":"2026-08-07T15:33:09.415489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15798","last_updated":"2024-12-02T12:58:23Z","snapshot_observed_at":"2026-07-06T15:33:06.904026Z","submitted_at":"2023-05-25T07:28:28Z","title":"BK-SDM: A Lightweight, Fast, and Cheap Version of Stable Diffusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15798","snapshot_observed_at":"2026-08-07T15:33:09.528176Z","title":"On architectural compression of text-to-image diffusion models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.528176Z"},"links":{"cited_paper":"/paper/2305.15798","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:940f6160fab0b11eb6938dfef2f4648ef68ae3f7fd17a8de6b6e0c066a24d097","observation_id":"d74470f6-32c6-427b-9b13-b484f376cc39","resolution":{"observed_at":"2026-08-07T15:33:09.528176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07730","last_updated":"2025-08-02T07:11:16Z","snapshot_observed_at":"2026-07-06T20:20:37.632750Z","submitted_at":"2025-01-13T22:37:17Z","title":"Democratizing Text-to-Image Masked Generative Models with Compact Text-Aware One-Dimensional Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07730","snapshot_observed_at":"2026-08-07T15:33:09.611097Z","title":"Democratizing text-to-image masked generative models with compact text-aware one-dimensional tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.611097Z"},"links":{"cited_paper":"/paper/2501.07730","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:b21b489984c3426303de6081e1b5da510dd6241c11d0df70d0827993f5bca4af","observation_id":"2a26b896-c5e6-445e-8391-19d4a2ddce8e","resolution":{"observed_at":"2026-08-07T15:33:09.611097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:17.325141Z","title":"Auto-encoding variational bayes","venue":null,"work_id":"642429a0-7b3b-4060-9bf1-b6eb65c297ab","year":2014},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.705790Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:946945d265cda4c1ba7545ed0e2645879cf2989c16f0fb5155d13d8b0c188dea","observation_id":"1787af12-90c5-4b72-9f49-63638d80ea82","resolution":{"observed_at":"2026-08-07T15:33:17.450202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T15:33:09.802048Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.802048Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:a720af40c365def8f19724f3e1d348b5fedca414203312e91d95bd79dfac1d97","observation_id":"d75af1e5-a66f-4b6b-97b7-02db52c580e4","resolution":{"observed_at":"2026-08-07T15:33:09.802048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:17.154358Z","title":"Flux: Official inference repository for flux.1 models, 2024","venue":null,"work_id":"d7dbf3c6-b4df-4538-9983-c47f7d044ffc","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.890736Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:dab517956a6bf1326becef3168ebd4fba284a29d1574ff834419d8566cdb0079","observation_id":"b2bb5ecf-4d31-43cb-8817-516329cc1819","resolution":{"observed_at":"2026-08-07T15:33:17.223842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.923915Z","title":"Set transformer: A framework for attention-based permutation-invariant neural networks","venue":null,"work_id":"8ea693d6-0b41-4c41-9ac3-5c87b07316e5","year":2019},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.990647Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:85d91e7d239ebe0f2c82b984d75efbfa3310132ec64aed5f40f981fd0a483592","observation_id":"9cc94751-2b32-4437-b9e8-535fa9d70074","resolution":{"observed_at":"2026-08-07T15:33:17.040318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.730126Z","title":"Koala: Empirical lessons toward memory-efficient and fast diffusion models for text-to-image synthesis","venue":null,"work_id":"aa92ee9a-5892-48bb-ad5e-a51bcc7edcab","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.054589Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:a18cf890a595e94417b28fc0af20a215237ce900841405854f6c6f4730cf5314","observation_id":"f2caf802-0014-48e2-b3de-918c4742d692","resolution":{"observed_at":"2026-08-07T15:33:16.801008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17245","last_updated":"2024-02-27T06:31:52Z","snapshot_observed_at":"2026-07-06T17:36:01.939242Z","submitted_at":"2024-02-27T06:31:52Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17245","snapshot_observed_at":"2026-08-07T15:33:10.117315Z","title":"Playground v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.117315Z"},"links":{"cited_paper":"/paper/2402.17245","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:2f32d5a4c3ef93b4d7be1d7be2ea40f250b23e22366b7217bd76d03d58475054","observation_id":"d5ca0487-ccd4-49f5-ae78-14d7505d2ada","resolution":{"observed_at":"2026-08-07T15:33:10.117315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.555615Z","title":"Q-diffusion: Quantizing diffusion models","venue":null,"work_id":"f200ffe2-45fb-4add-9826-b6c9eb17be59","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.175585Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:7df3dfabd1c0b9d54075e097f9645580f767e6590904e2f51502f4bab9d1017f","observation_id":"2a90d978-d06c-48d5-b03f-3b411c00ea1b","resolution":{"observed_at":"2026-08-07T15:33:16.609258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.217019Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.217019Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:db05b2c3a5b8a8cafb19fa47a9fa7a897a4679fd89d598cf689b9afcb326d02d","observation_id":"b92128ce-cfe6-4f37-9d28-195864e60914","resolution":{"observed_at":"2026-08-07T15:33:10.217019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.358578Z","title":"Flow matching for generative modeling","venue":null,"work_id":"3d8c294f-0054-4e7f-9003-88a4453d2526","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.273734Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:475e38e4db228b47c5b6037df1b649a92817d5dc703d089b2a038de6c526a4aa","observation_id":"972035e3-7f4a-4f27-92ca-ed1145ceb719","resolution":{"observed_at":"2026-08-07T15:33:16.438238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.188213Z","title":"Pseudo numerical methods for diffusion models on manifolds","venue":null,"work_id":"8c48f63a-e1a1-432d-97ff-cfc6f4e04275","year":2022},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.339537Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:a71e30c19473d2fcaf7bf77b076afbbef6a0ccedc6ec6108e96a33d671df1c0c","observation_id":"0f3c9bf9-39e8-4cd3-8cf7-717e30be88b4","resolution":{"observed_at":"2026-08-07T15:33:16.268542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.025673Z","title":"Alleviating distortion in image generation via multi-resolution diffusion models and time-dependent layer normalization.NeurIPS, 2024","venue":null,"work_id":"d9a0db77-5c2e-4365-a422-6c436fa16a3b","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.406077Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:af958a1e3b9a9b7e152365ea7417d9436c07f90d25218124640ee70f340ce546","observation_id":"0cd2cb5c-2199-4a34-a237-179c20409316","resolution":{"observed_at":"2026-08-07T15:33:16.093310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.485556Z","title":"Revision: High-quality, low-cost video generation with explicit 3d physics modeling for complex motion and interaction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.485556Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:036d1180439ae0f2571f3f53e84164ab17696cd686a5a386905cf1351656721f","observation_id":"19652a10-b693-4a25-877e-120a4bd9af9c","resolution":{"observed_at":"2026-08-07T15:33:10.485556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16112","last_updated":"2024-12-20T17:57:09Z","snapshot_observed_at":"2026-07-06T20:11:06.248415Z","submitted_at":"2024-12-20T17:57:09Z","title":"CLEAR: Conv-Like Linearization Revs Pre-Trained Diffusion Transformers Up","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16112","snapshot_observed_at":"2026-08-07T15:33:10.540296Z","title":"Clear: Conv-like linearization revs pre-trained diffusion transformers up","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.540296Z"},"links":{"cited_paper":"/paper/2412.16112","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:a274088f5343c1d06882164a26abb304aa17486f27415e1921f0cdbab8a15b5e","observation_id":"35b85fd9-8839-4faa-a332-90f6e4ea280d","resolution":{"observed_at":"2026-08-07T15:33:10.540296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.610639Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.610639Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:431707ab7ae661bdcd1d6ec23f2cdc1ec6b94098344250f767bce30d05c63b1c","observation_id":"f4577a30-29a3-43a2-9d6c-eab7419c672d","resolution":{"observed_at":"2026-08-07T15:33:10.610639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.696982Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.696982Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:8e8e1768f436af14bcd721676dd5d6a3f586bb142ef20181e94010543b013d9b","observation_id":"4d94bc75-79ca-4c30-a430-b229abadc9d4","resolution":{"observed_at":"2026-08-07T15:33:10.696982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:15.815953Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":"92c6bfaa-2ba7-46ec-ab98-4134c787ceca","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.753989Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:396cf330b40e8a25310824861aee64008c4d1f27df89170aae4533f415bfec6b","observation_id":"1dbe9e44-1332-4068-bf74-324f3776c0db","resolution":{"observed_at":"2026-08-07T15:33:15.882654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.831193Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.831193Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:3d5bba8164c3fd62411a0d9dbc8ea41c7afe7e76d30063d529995f2d416a6f9e","observation_id":"f3338114-3ca9-4c04-8fe0-8ad611cde28c","resolution":{"observed_at":"2026-08-07T15:33:10.831193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.906479Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.906479Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:16ba5cb0dc77c33f49e9cfd697c087680740b2dfb0e11d10c28d18ebd912f942","observation_id":"86184171-4eff-455c-bce7-036aa8a98720","resolution":{"observed_at":"2026-08-07T15:33:10.906479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.970631Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.970631Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:706b2725fa9956be45f21d2db090a33cf650732848e0de615abc7aa046860ff2","observation_id":"043dafce-3774-4c63-ac1a-3847466d5983","resolution":{"observed_at":"2026-08-07T15:33:10.970631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:15.608207Z","title":"Stand-alone self-attention in vision models","venue":null,"work_id":"fb8918cc-c976-408f-9619-abe8b4cbb9f2","year":2019},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.011275Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:5cffb29de3d49197d108d993e3f22c171141023b27a0c29118e666721bf5830c","observation_id":"a275f21e-61a1-43de-8f5a-b6f5a8de9e99","resolution":{"observed_at":"2026-08-07T15:33:15.688154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-07T17:41:55.935183Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-07T15:33:11.114818Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.114818Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:38003fa952d4f1dbd56e7e78c6d3adeee6351b84988461c82b08bd65f14618bc","observation_id":"2bbd127e-dbbb-433b-813f-e49370cc231c","resolution":{"observed_at":"2026-08-07T15:33:11.114818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:15.405040Z","title":"Flowar: Scale-wise autoregressive image generation meets flow matching","venue":null,"work_id":"6066ee21-eb3b-40b7-97bb-aea4a5a41436","year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.195760Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:77d6e34af358bd55bac0a9ce64f5ac3d5adad5caa6fc95adafed2815ab50b446","observation_id":"9f72c516-3ad7-4c04-8ece-4ef59bbc362f","resolution":{"observed_at":"2026-08-07T15:33:15.477595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:11.277092Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.277092Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:824b08fdcec3d820bcf72581f2d866342822d6d201e9ed917405ae1c67e58b5e","observation_id":"94c821a4-de10-4790-81ad-2d7123d4bd17","resolution":{"observed_at":"2026-08-07T15:33:11.277092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:15.197900Z","title":"Progressive distillation for fast sampling of diffusion models","venue":null,"work_id":"d594c0e5-6917-48b7-a67f-1a879f7a107f","year":2022},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.359332Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:cd5a3fda7ff4b50d43f4fce6b345beb4127e92b524d65a493942eb4966fe64be","observation_id":"6398b433-bfa5-4f43-8e83-f8eeeefeec59","resolution":{"observed_at":"2026-08-07T15:33:15.272853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.972526Z","title":"Post-training quantization on diffusion models","venue":null,"work_id":"494c7796-d367-4043-a52d-02c3432768f8","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.455816Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:88616f17a39f5a414a6809030f6721522a747285c8eb90146e1de71d07a53393","observation_id":"321737fb-993e-48a6-a12b-32fbfd077602","resolution":{"observed_at":"2026-08-07T15:33:15.032194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14494","last_updated":"2025-09-02T18:15:39Z","snapshot_observed_at":"2026-08-07T16:54:10.051699Z","submitted_at":"2025-03-18T17:58:08Z","title":"Deeply Supervised Flow-Based Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14494","snapshot_observed_at":"2026-08-07T15:33:11.513331Z","title":"Deeply supervised flow-based generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.513331Z"},"links":{"cited_paper":"/paper/2503.14494","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:82f12e7c56ec1cc3a1cf860a34568a74050a8f403810bb81b18135d6b35a8405","observation_id":"c24fecb9-67b7-4ab2-a03d-d5e391791211","resolution":{"observed_at":"2026-08-07T15:33:11.513331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-07T15:33:11.607502Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.607502Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:859409d03fc8fac4fafb86540595abf95ebd800aa01f45d6287b028b3bc57a2f","observation_id":"19ff55c3-075f-45ca-bbf3-7053f4ce474c","resolution":{"observed_at":"2026-08-07T15:33:11.607502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:11.705712Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.705712Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:690d0f24178f9079a66ec3d55f6f8c7d3a4ca6800b3062a3ed41db776287e949","observation_id":"5ab29220-e2f7-49e4-a5c8-71683cfec651","resolution":{"observed_at":"2026-08-07T15:33:11.705712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T15:33:11.772789Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.772789Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:870b27a9e674c0baa4db8b2994829d876edc478afe993fee4091f3759a3e24ab","observation_id":"0a5d231c-f14c-4c32-ad4f-523e11f1d95d","resolution":{"observed_at":"2026-08-07T15:33:11.772789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.761783Z","title":"Axial- deeplab: Stand-alone axial-attention for panoptic segmentation","venue":null,"work_id":"0e11b184-eeb5-4bb5-a8ad-73f588219056","year":2020},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.883552Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:788a085e145c28d3b4445b1921a9726fd9c3ef334ade1c9ba7959db58807ea90","observation_id":"335f927a-0a5c-4a67-a57f-1cefeef14486","resolution":{"observed_at":"2026-08-07T15:33:14.822785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-07T15:33:11.991320Z","title":"Linformer: Self-attention with linear complexity, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.991320Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:9ad290633c2bd2f8c7efa47f49b06d5f7aa277f892844aa1b44b54a69e236c86","observation_id":"38e89115-e881-4974-8c2e-638c6bcb5b66","resolution":{"observed_at":"2026-08-07T15:33:11.991320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01812","last_updated":"2024-02-05T09:21:28Z","snapshot_observed_at":"2026-07-06T16:26:58.234941Z","submitted_at":"2023-10-03T05:55:11Z","title":"PPT: Token Pruning and Pooling for Efficient Vision Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01812","snapshot_observed_at":"2026-08-07T15:33:12.123223Z","title":"Ppt: Token pruning and pooling for efficient vision transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.123223Z"},"links":{"cited_paper":"/paper/2310.01812","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:461068cad4b77b91187efa4deddb4f749b52640444897a4433febbe163dc5d07","observation_id":"26888ff7-48f0-4f2b-a890-68aa6548ffe5","resolution":{"observed_at":"2026-08-07T15:33:12.123223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.557249Z","title":"Revealing the dark secrets of masked image modeling","venue":null,"work_id":"c4488e20-5a24-46ac-8518-a4561e949263","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.199902Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:cf043fde9f55d93788e407c05847588386ae5ffe81e4f623906e85d46998d6cf","observation_id":"7d171f7b-9679-4dd8-98b7-0f4657292cc7","resolution":{"observed_at":"2026-08-07T15:33:14.625332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.350817Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"bf6f05f9-f229-4e61-9dfb-6adcb92f32c0","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.267943Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:490e033b941e851fd08a54c74571fc672e02383729b9f67b2694c8056a314ec7","observation_id":"21e1b526-6c24-4eb8-9732-6fa63313b9fa","resolution":{"observed_at":"2026-08-07T15:33:14.439072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-08T00:07:17.895883Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-08-07T15:33:12.353042Z","title":"1.58-bit flux","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.353042Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:6a4a283a39ad61c94b0abdcef44625b3648cf36834b76d8fe7ccb7e02d43ea92","observation_id":"20031a9d-1774-46c2-9f24-63e9b5f8b4bd","resolution":{"observed_at":"2026-08-07T15:33:12.353042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00776","last_updated":"2024-11-01T17:59:58Z","snapshot_observed_at":"2026-07-06T19:43:42.287026Z","submitted_at":"2024-11-01T17:59:58Z","title":"Randomized Autoregressive Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00776","snapshot_observed_at":"2026-08-07T15:33:12.464495Z","title":"Randomized autoregressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.464495Z"},"links":{"cited_paper":"/paper/2411.00776","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:6a2667042214e2f9e9b7c436d4ed1a21c9b50150945785794decf2a56ba7da8d","observation_id":"5ca922d8-374f-4f87-84ea-6bbce513e84b","resolution":{"observed_at":"2026-08-07T15:33:12.464495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.096085Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":"53c2ece2-c156-4a06-a04d-10a05d53290e","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.577214Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:04a397580196936d30e7526d981038075edda5e33779e3d454f39f23c2d4ef90","observation_id":"7620ea40-4ef0-47f6-b852-c29001f5d12e","resolution":{"observed_at":"2026-08-07T15:33:14.221647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:13.919699Z","title":"Ditfastattn: Attention compression for diffusion transformer models","venue":null,"work_id":"05c96af6-de87-4d3a-8201-ecc502c09eb0","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.642624Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:330865b8ef79fe97dccfb3441a61ce44b6b25f3d653f4a3e56205c07d7b3efaa","observation_id":"57186a5d-b8a1-4890-9d3e-67454e39df8b","resolution":{"observed_at":"2026-08-07T15:33:14.001466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:13.775985Z","title":"Big bird: Transformers for longer sequences","venue":null,"work_id":"80b0bc71-7703-4e76-a924-964bc0be54a9","year":2020},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.738393Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:6ac56612c313fab11897dfe99f7ce1de106e371eac5b37d6548b953492a45eb9","observation_id":"09a73369-39d8-4ca8-9def-216df835b5ed","resolution":{"observed_at":"2026-08-07T15:33:13.837906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04507","last_updated":"2025-06-04T23:21:39Z","snapshot_observed_at":"2026-08-08T22:25:30.997284Z","submitted_at":"2025-02-06T21:17:09Z","title":"Fast Video Generation with Sliding Tile Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04507","snapshot_observed_at":"2026-08-07T15:33:12.833852Z","title":"Hello GRAT","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.833852Z"},"links":{"cited_paper":"/paper/2502.04507","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:d1cb5c14e99241ca90382c041d5a2cfde5a58c2e2e06d83ee656e75087e58f6b","observation_id":"5f1ba8ba-8080-4e44-b3d1-2a3d53862c32","resolution":{"observed_at":"2026-08-07T15:33:12.833852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 8 inbound Pith citation observations for arXiv:2505.14687."}