{"as_of":"2026-08-14T21:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:547671563cac2e3221264917a2b1c6f38565cfae25b03636a4d75b9493e9d902","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":39,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:31:29.051222Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:59:57.977754Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"reference_index":241,"source":"arxiv_source","source_observed_at":"2026-05-13T20:06:44.480769Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2310.05737"},"observation_digest":"sha256:53c71bcdc88d769d219116b2bcf69e4e8995718e89ca3cb05586f50897142561","observation_id":"259772ae-d76a-4d13-8ab0-b3a869a452e7","resolution":{"observed_at":"2026-05-13T20:06:44.709299Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-12T18:31:29.051222Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11505","last_updated":"2025-03-06T07:26:35Z","snapshot_observed_at":"2026-08-14T05:47:23.540005Z","submitted_at":"2024-11-18T12:05:27Z","title":"LaVin-DiT: Large Vision Diffusion Transformer","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T18:31:29.051222Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2411.11505"},"observation_digest":"sha256:437c85ad86d5f9558b70d473b608150894c6aa84034424699d095c1c5d319a6b","observation_id":"62ff35ec-0675-42b6-b596-5828acd7c3c0","resolution":{"observed_at":"2026-08-12T18:31:29.051222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-11T22:12:27.514147Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03791","last_updated":"2025-05-29T01:03:51Z","snapshot_observed_at":"2026-08-12T16:11:49.028934Z","submitted_at":"2024-12-05T01:00:07Z","title":"INRFlow: Flow Matching for INRs in Ambient Space","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T22:12:27.514147Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2412.03791"},"observation_digest":"sha256:ab071b45137aac0aebf43006461fade8d7a63ced04ed5e4a0447858afac4da25","observation_id":"e911b030-c58c-4527-98b0-1ae3ce5ef19b","resolution":{"observed_at":"2026-08-11T22:12:27.514147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-11T20:37:01.962804Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-14T12:51:51.348513Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.962804Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:a7be58709cb6bf1221c7eeb53b016c493c5ce0e6a7099ccfe03854df09aa48aa","observation_id":"18ab7e93-b2b8-4d33-b6d6-936aa6fae1bc","resolution":{"observed_at":"2026-08-11T20:37:01.962804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-11T14:20:49.571961Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12095","last_updated":"2024-12-17T18:45:55Z","snapshot_observed_at":"2026-08-14T05:13:44.637603Z","submitted_at":"2024-12-16T18:59:29Z","title":"Causal Diffusion Transformers for Generative Modeling","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T14:20:49.571961Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2412.12095"},"observation_digest":"sha256:a26e66b0081591716c11ffe0da3fcf31956b561d3ed1db7ff6099ccfd807e262","observation_id":"3343cfab-9a23-4c18-93b7-b4968e06e0f8","resolution":{"observed_at":"2026-08-11T14:20:49.571961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-11T01:02:56.117688Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19104","last_updated":"2024-12-26T07:47:20Z","snapshot_observed_at":"2026-08-12T03:51:21.211579Z","submitted_at":"2024-12-26T07:47:20Z","title":"Improving Generative Pre-Training: An In-depth Study of Masked Image Modeling and Denoising Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T01:02:56.117688Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2412.19104"},"observation_digest":"sha256:72bb30e0628f86a2760d786b601aad482ba603cc8d573a4721ab6c454048c5f5","observation_id":"79d7d66e-c587-4e38-8cd1-03f8cdf3894c","resolution":{"observed_at":"2026-08-11T01:02:56.117688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-10T22:34:14.559949Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01423","last_updated":"2025-03-10T11:43:42Z","snapshot_observed_at":"2026-08-11T01:06:46.210110Z","submitted_at":"2025-01-02T18:59:40Z","title":"Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T22:34:14.559949Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2501.01423"},"observation_digest":"sha256:55f4e5ce00d3b21950a09004c95e780fee31a428df28d99270bfb5cb779dec3d","observation_id":"2f5d5819-a497-423e-bfa0-39fc45d5d85f","resolution":{"observed_at":"2026-08-10T22:34:14.559949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-09T19:22:41.755072Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-10T10:14:26.773878Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.755072Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:73d2c9d2a29f21035e969fc6f1f2555e41f404c8d0b7a1e2cf4f50126efe129e","observation_id":"eea0c7b9-9832-46ec-9bed-6bf4cc9eda5d","resolution":{"observed_at":"2026-08-09T19:22:41.755072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-09T19:21:56.339709Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00382","last_updated":"2025-02-01T09:41:01Z","snapshot_observed_at":"2026-08-13T10:30:36.353400Z","submitted_at":"2025-02-01T09:41:01Z","title":"Masked Generative Nested Transformers with Decode Time Scaling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T19:21:56.339709Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2502.00382"},"observation_digest":"sha256:f39cf9835d32efee4da0e722539d36e94f8ccd1a75e35c44a402e1ce1776382b","observation_id":"8ad5099c-9541-4c90-933b-d69adb866c68","resolution":{"observed_at":"2026-08-09T19:21:56.339709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-07T21:17:55.982594Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09509","last_updated":"2025-08-04T10:44:54Z","snapshot_observed_at":"2026-08-09T00:33:22.873294Z","submitted_at":"2025-02-13T17:21:51Z","title":"EQ-VAE: Equivariance Regularized Latent Space for Improved Generative Image Modeling","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T21:17:55.982594Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2502.09509"},"observation_digest":"sha256:23050351b65a8073634a93ebaf8a605f451c9bcd378def1ff2fc471a4f520c56","observation_id":"001834eb-dab0-447b-82ee-3f5c530f4a75","resolution":{"observed_at":"2026-08-07T21:17:55.982594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2506.13763","last_updated":"2026-04-16T06:16:45Z","snapshot_observed_at":"2026-07-06T21:43:03.415527Z","submitted_at":"2025-06-16T17:59:54Z","title":"Diagnosing and Improving Diffusion Models by Estimating the Optimal Loss Value","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-19T09:05:58.516845Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2506.13763"},"observation_digest":"sha256:4c4b6e37c74e3906f7701798fb6ccd844744c3186b107c23fb235017d365b66b","observation_id":"7edd54e0-07dd-485b-827b-f91ffa599e20","resolution":{"observed_at":"2026-05-19T09:07:14.037023Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-06T20:49:43.657417Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-14T20:40:32.970220Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.657417Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:767d5bb3d4c55a3f45032cdd770e9a0d219b78b1b4b27d88948d088e0ebcc343","observation_id":"13829bd9-c1ef-4d9a-b6d1-7032636d9a26","resolution":{"observed_at":"2026-08-06T20:49:43.657417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-06T16:48:34.038440Z","title":"pause tokens,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13401","last_updated":"2025-07-16T20:56:57Z","snapshot_observed_at":"2026-08-13T23:50:55.894948Z","submitted_at":"2025-07-16T20:56:57Z","title":"MADI: Masking-Augmented Diffusion with Inference-Time Scaling for Visual Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:48:34.038440Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2507.13401"},"observation_digest":"sha256:f0a7be13f20ce89e385b06f819a099729134e15ce3dc90f7014447157cab1d17","observation_id":"54f2b4ff-c8c9-4a47-9964-0a21b2e591d9","resolution":{"observed_at":"2026-08-06T16:48:34.038440Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-06T15:44:53.604445Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15216","last_updated":"2025-07-21T03:36:58Z","snapshot_observed_at":"2026-08-14T19:45:04.377115Z","submitted_at":"2025-07-21T03:36:58Z","title":"Improving Joint Embedding Predictive Architecture with Diffusion Noise","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:44:53.604445Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2507.15216"},"observation_digest":"sha256:afa522fd5bce23cf4b7fca0bd812dec1bdda6f045569574c7a5c78538f0995b5","observation_id":"1261d8e6-cabb-4627-a43f-00f83fb3e609","resolution":{"observed_at":"2026-08-06T15:44:53.604445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-05T05:27:34.379629Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05441","last_updated":"2025-09-10T22:15:25Z","snapshot_observed_at":"2026-08-06T13:34:56.299668Z","submitted_at":"2025-09-05T18:49:08Z","title":"Missing Fine Details in Images: Last Seen in High Frequencies","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-05T05:27:34.379629Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2509.05441"},"observation_digest":"sha256:2f1e44471c250a3914e51ced23896d3d6c9a148045de66ec23fcdfe215f4a9f0","observation_id":"2b6ecdaa-0d4e-48e4-93fd-4e1daec5a277","resolution":{"observed_at":"2026-08-05T05:27:34.379629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2510.18457","last_updated":"2026-04-23T08:02:03Z","snapshot_observed_at":"2026-08-14T18:01:33.728925Z","submitted_at":"2025-10-21T09:30:45Z","title":"VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T05:22:05.125849Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2510.18457"},"observation_digest":"sha256:6b1be87d8765716046dbd057cea9a9dbc31c29d763b5b5f50912fad80a5ecc7e","observation_id":"fb61079b-6df8-4dd6-83f7-232c5fb4b940","resolution":{"observed_at":"2026-05-18T05:22:23.937867Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-03T15:35:00.843984Z","title":"Fast training of diffusion models with masked transformers.arXiv preprint arXiv:2306.09305, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.16636","last_updated":"2026-07-18T11:24:13Z","snapshot_observed_at":"2026-08-07T17:53:52.987639Z","submitted_at":"2025-12-18T15:10:42Z","title":"REGLUE Your Latents with Global and Local Semantics for Entangled Diffusion","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T15:35:00.843984Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2512.16636"},"observation_digest":"sha256:44600b2a06bf9c9324668d77a6f665d432d2ccf89be2b353a2a69a93cd6f9ae0","observation_id":"7467a394-75b9-4e97-8669-c4ac14672611","resolution":{"observed_at":"2026-08-03T15:35:00.843984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-03T14:53:03.638057Z","title":"Sulphur-crested cockatoo","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.19311","last_updated":"2026-07-12T14:26:35Z","snapshot_observed_at":"2026-08-07T18:54:26.140556Z","submitted_at":"2025-12-22T12:00:12Z","title":"MixFlow Training: Alleviating Exposure Bias with Slowed Interpolation Mixture","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T14:53:03.638057Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2512.19311"},"observation_digest":"sha256:b83502fcaa8cacae83e0c7eaae2b5e63c50d22da015ebabbc95a9df4e9120523","observation_id":"f37e1941-f099-465d-af4b-0c9760651f68","resolution":{"observed_at":"2026-08-03T14:53:03.638057Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2602.06886","last_updated":"2026-07-31T08:35:56Z","snapshot_observed_at":"2026-08-05T23:10:18.924353Z","submitted_at":"2026-02-06T17:19:53Z","title":"Prompt Reinjection: Alleviating Prompt Forgetting in Multimodal Diffusion Transformers for Text-to-Image Generation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T13:00:22.875471Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2602.06886"},"observation_digest":"sha256:8cccf4132287107da699935b289564ae6a59a447d6d5e26c6373b51921165ec7","observation_id":"65a1ecf4-f5d1-44c8-8569-7c0e8ee21e22","resolution":{"observed_at":"2026-05-21T13:04:10.580837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-03T03:50:47.050868Z","title":"Zheng, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06886","last_updated":"2026-07-31T08:35:56Z","snapshot_observed_at":"2026-08-05T23:10:18.924353Z","submitted_at":"2026-02-06T17:19:53Z","title":"Prompt Reinjection: Alleviating Prompt Forgetting in Multimodal Diffusion Transformers for Text-to-Image Generation","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T03:50:47.050868Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2602.06886"},"observation_digest":"sha256:17b766662e886115660b915549ab8c604947bebc5211552bcc3b4c12d5abf637","observation_id":"44f08017-9a0e-4aa1-964f-852df110be70","resolution":{"observed_at":"2026-08-03T03:50:47.050868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-03T01:25:20.415023Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10099","last_updated":"2026-07-03T15:19:24Z","snapshot_observed_at":"2026-08-06T13:27:43.962812Z","submitted_at":"2026-02-10T18:58:04Z","title":"Learning on the Manifold: Unlocking Standard Diffusion Transformers with Representation Encoders","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T01:25:20.415023Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2602.10099"},"observation_digest":"sha256:d0ce6df6ff040188dc45579c83c199ab9eb3c4a1c75e10fd897fd72b22501aca","observation_id":"de8052a5-d3d6-4468-a7ba-8a3cf75730a6","resolution":{"observed_at":"2026-08-03T01:25:20.415023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2604.07397","last_updated":"2026-04-08T08:55:49Z","snapshot_observed_at":"2026-08-11T05:46:59.574678Z","submitted_at":"2026-04-08T08:55:49Z","title":"Data Warmup: Complexity-Aware Curricula for Efficient Diffusion Training","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T18:55:26.852585Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2604.07397"},"observation_digest":"sha256:a82077f3fd40ac14331ed726cd3b9a33cf1bd7c6b7365ef03507a7b9a7644057","observation_id":"3b2adf24-8812-4ff2-b41e-dccb7770bff9","resolution":{"observed_at":"2026-05-10T23:40:54.141984Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-10T17:19:22.543462Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:d6769aa0a2069309cfd051d6e1369d299af80f1374b7806c364f5dfa6d8542f3","observation_id":"de66bacb-14e1-44a3-93de-80c9b6cc2eef","resolution":{"observed_at":"2026-05-11T07:06:00.051356Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-02T16:35:03.444701Z","title":"Zheng, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-02T16:35:03.444701Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:17f8a388ee6fa9185a86ce28c5318a3ce0980b21ff329228d9f6652421af41b1","observation_id":"fb315d39-8a1f-4662-82e3-14adc4bb2564","resolution":{"observed_at":"2026-08-02T16:35:03.444701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2604.19141","last_updated":"2026-04-21T06:44:44Z","snapshot_observed_at":"2026-08-13T10:37:04.380295Z","submitted_at":"2026-04-21T06:44:44Z","title":"Denoising, Fast and Slow: Difficulty-Aware Adaptive Sampling for Image Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T03:06:43.992858Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2604.19141"},"observation_digest":"sha256:1f5a1a6ca50d618011257aea31b388e1e6a557541302152295ac2c01816983e6","observation_id":"c0344861-4a63-4bcb-b361-0d0ebe3e3b13","resolution":{"observed_at":"2026-05-10T03:08:59.205615Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.00503","last_updated":"2026-05-04T10:19:31Z","snapshot_observed_at":"2026-08-13T10:47:30.778928Z","submitted_at":"2026-05-01T08:25:51Z","title":"End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-09T19:41:03.302303Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.00503"},"observation_digest":"sha256:8969573236a1cea965e86713ea8d8e40b71f90d66e62b1c8f4193c70169ecca7","observation_id":"cc77dfbe-21c3-4a73-8d4c-ff633c2d4d8c","resolution":{"observed_at":"2026-05-11T15:36:05.832440Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.10790","last_updated":"2026-05-11T16:21:45Z","snapshot_observed_at":"2026-08-11T12:36:02.727982Z","submitted_at":"2026-05-11T16:21:45Z","title":"Elucidating Representation Degradation Problem in Diffusion Model Training","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-12T04:08:11.110912Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.10790"},"observation_digest":"sha256:3b5a66eb1dc954249b5daa69139946b5034a7efcd9c413ba9d47e3f53b7c4e09","observation_id":"1dcca901-4945-4546-ad7f-bc3c9574ddbb","resolution":{"observed_at":"2026-05-12T06:36:26.415612Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.16949","last_updated":"2026-05-16T12:01:04Z","snapshot_observed_at":"2026-08-12T22:15:06.703156Z","submitted_at":"2026-05-16T12:01:04Z","title":"Beyond Point-Wise Matching: Structural Representation Alignment for Accelerating Diffusion Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-19T20:49:25.902880Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.16949"},"observation_digest":"sha256:dc887e9f72180ad98d1fb0ce9222a81a8abd08881c796fd71969ba7bb99f46e2","observation_id":"170e9b77-d498-4fb1-b5fb-6f73cdd884ec","resolution":{"observed_at":"2026-05-19T20:52:46.192834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.17759","last_updated":"2026-05-18T02:25:07Z","snapshot_observed_at":"2026-08-01T22:43:12.616139Z","submitted_at":"2026-05-18T02:25:07Z","title":"FrequencyBooster: Full-Frequency Modeling for High-Fidelity Pixel Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T12:43:58.746650Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.17759"},"observation_digest":"sha256:d05f287cfa5329561fbe623729da1d51d86cbea006e4fde9ae90540c02e92b2b","observation_id":"d1b7b837-8ef6-4925-b570-055f3e15fbde","resolution":{"observed_at":"2026-05-20T12:48:17.664054Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T11:59:54.139888Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:1ac29289959bdc1653e431981c0a7770d0927df6ba2358d639b1d7667520170c","observation_id":"dd868de8-cddc-4767-8129-b14f1093c79e","resolution":{"observed_at":"2026-05-20T12:03:15.331324Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T18:39:40.667006Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:b6900a83468ab12c6085e1e7472532b089486c2cbf54f87510ea60e5d63cdfde","observation_id":"2f3ca426-072d-4c4c-a7ab-f65a2a6395bb","resolution":{"observed_at":"2026-06-30T18:45:00.712640Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-02T13:49:19.876126Z","title":"Fast training of diffusion models with masked transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T13:49:19.876126Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:31e1e6e0d7716980feeaa465b33014be87c1c1ee7d566d0ae57197083a1ec652","observation_id":"921c3a4c-0e22-469e-a5d9-275bda7cbeb5","resolution":{"observed_at":"2026-08-02T13:49:19.876126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.18390","last_updated":"2026-05-18T13:38:43Z","snapshot_observed_at":"2026-08-13T22:07:18.094754Z","submitted_at":"2026-05-18T13:38:43Z","title":"Vision Foundation Models as Generalist Tokenizers for Image Generation","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-20T11:01:24.738195Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.18390"},"observation_digest":"sha256:745f092ba7312e92151e26d680482f8ac6a2ba0e1d018c9a76dc2d257e3d4020","observation_id":"07539e4e-6a3f-4ae2-ae0c-00fbec1cf69b","resolution":{"observed_at":"2026-05-20T11:03:13.472208Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2606.08788","last_updated":"2026-06-07T19:11:22Z","snapshot_observed_at":"2026-08-14T17:02:51.118640Z","submitted_at":"2026-06-07T19:11:22Z","title":"MaskAlign: Token-Subset Representation Alignment for Efficient Diffusion Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T18:44:41.266768Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2606.08788"},"observation_digest":"sha256:28bf0df2c1d50b551a1e69ddcf249a95cabc8e36c1ecabd2088ae058ad46a7e7","observation_id":"4b08c0d9-0f40-4cfb-a1d4-0d27e8bca0dc","resolution":{"observed_at":"2026-07-02T22:37:26.196124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2606.11096","last_updated":"2026-06-09T16:53:30Z","snapshot_observed_at":"2026-08-12T15:22:32.843957Z","submitted_at":"2026-06-09T16:53:30Z","title":"IDEAL: In-DEpth ALignment Makes A Discrete Representation AutoEncoder","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T13:10:14.308216Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2606.11096"},"observation_digest":"sha256:ec59e93d034bd0a536cd8dfbd02176fa74de250de50f5004be0403844e8ae123","observation_id":"69277d24-07ac-4c3c-a60c-59bdb0c99a53","resolution":{"observed_at":"2026-07-03T05:37:40.236125Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2606.24888","last_updated":"2026-06-23T17:59:55Z","snapshot_observed_at":"2026-08-08T16:38:03.178919Z","submitted_at":"2026-06-23T17:59:55Z","title":"DiffusionBench: On Holistic Evaluation of Diffusion Transformers","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-26T00:06:11.951205Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2606.24888"},"observation_digest":"sha256:b3411550861b8ffc2cee970df9778739c97e0b1f9251dcc4c02e78c66c376ad2","observation_id":"cc6a1552-d762-46c7-b7f8-246ac4a4d2a5","resolution":{"observed_at":"2026-07-04T16:59:57.979676Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2606.27760","last_updated":"2026-06-26T06:39:06Z","snapshot_observed_at":"2026-07-31T06:11:06.764017Z","submitted_at":"2026-06-26T06:39:06Z","title":"PixelU: A U-Shaped Transformer for Efficient End-to-End Pixel Diffusion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T04:31:57.169935Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2606.27760"},"observation_digest":"sha256:6c1e12bb5162c4dda6b82e87569fd54b845e89559dcf0371444cbc77bdc49454","observation_id":"46d55d90-dee0-4983-bb48-8d8908df0fa0","resolution":{"observed_at":"2026-06-29T20:03:57.140969Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2607.02508","last_updated":"2026-07-02T17:59:25Z","snapshot_observed_at":"2026-07-07T00:07:56.573640Z","submitted_at":"2026-07-02T17:59:25Z","title":"From SRA to Self-Flow: Data Augmentation or Self-Supervision?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-03T14:36:59.833888Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2607.02508"},"observation_digest":"sha256:6e74539729074efbefe163bb95b6916d2aba1e8b2f22fd40d24b75c3dd2e319b","observation_id":"9b452c7b-b3c8-46d9-b918-b0a9efdb9971","resolution":{"observed_at":"2026-07-03T14:38:28.526783Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-08T01:07:11.974745Z","title":"Fast train- ing of diffusion models with masked transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03082","last_updated":"2026-08-04T03:51:15Z","snapshot_observed_at":"2026-08-10T23:38:17.010766Z","submitted_at":"2026-08-04T03:51:15Z","title":"DiverseDiT++: Quantifying, Analyzing, and Promoting Representation Diversity in Diffusion Transformers","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T01:07:11.974745Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2608.03082"},"observation_digest":"sha256:dea028957913f686ce38bb1e29b47bfa8a4f6b1af4a88bdf9d6c3e13faee4377","observation_id":"51831a14-7900-4cd2-95da-7d1eb6f19e1f","resolution":{"observed_at":"2026-08-08T01:07:11.974745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.09305/citation-record","integrity":"/paper/2306.09305/integrity","json":"/paper/2306.09305/citation-record.json","paper":"/paper/2306.09305"},"outbound":[],"paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 39 inbound Pith citation observations for arXiv:2306.09305."}