{"as_of":"2026-08-07T10:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ca6d0216ba606476faa5810ed3d415c54ae67839af2aa3cc7d6dca929e83ca1","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:49:43.861863Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.01756/citation-record","integrity":"/paper/2507.01756/integrity","json":"/paper/2507.01756/citation-record.json","paper":"/paper/2507.01756"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T20:49:40.410671Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.410671Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:70270aa40278dc8e2ed069891d2cfe7d42a40cccadc9c1c5385f261d74685fec","observation_id":"a309802a-78df-415a-b8d5-1b36b700a450","resolution":{"observed_at":"2026-08-06T20:49:40.410671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:45.908600Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":"904f61de-a96b-49f3-824d-0d7041075427","year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.464546Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:bb5ac1e7d48f4d69dedc6da9b05166ae25659157ec07e4631e0f820410de6ac7","observation_id":"cae5366e-7bf8-4e17-83ae-97c1d5955c93","resolution":{"observed_at":"2026-08-06T20:49:46.043806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10958","last_updated":"2025-03-14T22:22:40Z","snapshot_observed_at":"2026-07-06T20:07:10.352535Z","submitted_at":"2024-12-14T20:29:29Z","title":"SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10958","snapshot_observed_at":"2026-08-06T20:49:40.554531Z","title":"Softvq-vae: Efficient 1-dimensional con- tinuous tokenizer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.554531Z"},"links":{"cited_paper":"/paper/2412.10958","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:b4223e4acbccda14bbff08f7609ed5b1cd81cb4ee7c3c0c7010ae8b6fd66974e","observation_id":"00cb8b07-238c-497a-97e4-1ca54dcd4c11","resolution":{"observed_at":"2026-08-06T20:49:40.554531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08698","last_updated":"2023-07-17T17:57:56Z","snapshot_observed_at":"2026-08-04T12:09:15.933692Z","submitted_at":"2023-07-17T17:57:56Z","title":"Flow Matching in Latent Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08698","snapshot_observed_at":"2026-08-06T20:49:40.625491Z","title":"Flow matching in latent space","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.625491Z"},"links":{"cited_paper":"/paper/2307.08698","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:a3fadd644857c854bfb4e98d3e7e4f4f665a5f2c410d1195835c469bdd609388","observation_id":"4319f330-b1b1-4e59-82b4-f7799b5cbc7d","resolution":{"observed_at":"2026-08-06T20:49:40.625491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:40.685526Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.685526Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:b2ff5b2911d0108de8f18214dbbf9e5760aee7800d6c1efbcd75046e96d4081b","observation_id":"cd55c8ec-1eab-4532-b5ef-62cb9c5f1a27","resolution":{"observed_at":"2026-08-06T20:49:40.685526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:40.758768Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.758768Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:c86fa6cefa186145af5b3d2a30bab12c549ff88b772fe5b438c99e1c0bbb3fa8","observation_id":"6e6c8853-496e-4ccf-96fc-b243ef21d0e2","resolution":{"observed_at":"2026-08-06T20:49:40.758768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-03T02:37:38.651864Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-06T20:49:40.829577Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.829577Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:8f91a70d91332383a753afc26180717363d81b7d0f06a47a6be635bd62b16fe3","observation_id":"84ddbe34-a503-4eb4-a725-9b3fdef2f40f","resolution":{"observed_at":"2026-08-06T20:49:40.829577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-06T20:49:40.899190Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.899190Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:b7dc47ee166a340af6414b3ad09751eed33b1e5ff238d338fa5226bda04052ad","observation_id":"5989a483-4b75-4a5c-b7af-aa9ee27973ad","resolution":{"observed_at":"2026-08-06T20:49:40.899190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:40.947061Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.947061Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:4f1e52d73a46dc2d06963bd7d1374f3d01966f1faad2d09d83a1327e1f9d94fc","observation_id":"9c513895-3858-44e2-801f-35a7c3973e81","resolution":{"observed_at":"2026-08-06T20:49:40.947061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:45.653205Z","title":"Rethinking the objectives of vector- quantized tokenizers for image synthesis","venue":null,"work_id":"4e3feb71-f230-48a3-8d35-b88081084da6","year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.014819Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:2e61b6cc8cb23cfb7b5030e7950da5f3dc1feccbe93a387a1c00ccdba29cad8e","observation_id":"89685d0b-7292-4e1c-9d26-b03b9bc061de","resolution":{"observed_at":"2026-08-06T20:49:45.775186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-06T22:01:43.705500Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-06T20:49:41.040335Z","title":"Infinity: Scaling bit- wise autoregressive modeling for high-resolution image syn- thesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.040335Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:cdc97f27397a5158be18798fbbc20c98464c01b328851606ee486cc44234e2f2","observation_id":"b0ec6ca0-9a48-423d-809d-19db8a037009","resolution":{"observed_at":"2026-08-06T20:49:41.040335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.107673Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.107673Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:ecfefd8737b3f6216890cdbbc703f2ce5aacd715878e85f67e401c0777a0b892","observation_id":"9b89322d-464a-4921-91dd-8a1d9722eb0c","resolution":{"observed_at":"2026-08-06T20:49:41.107673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.159888Z","title":"Acdit: Interpolating autoregressive con- ditional modeling and diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.159888Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:8a7154ac8bafce8b2559b7e52affd7c1525e89344daef79d1e216ee8ae7f7efd","observation_id":"438627f9-f79e-4d63-9689-e9c934ca404e","resolution":{"observed_at":"2026-08-06T20:49:41.159888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.208208Z","title":"Auto-encoding vari- ational bayes, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.208208Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:f7225ceca4c86f7d1a5092247fd9f405911ef22f22ce7dd357ba53a7599c79b1","observation_id":"53ed039c-2ff2-46a5-8a2c-02524a020f09","resolution":{"observed_at":"2026-08-06T20:49:41.208208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.274498Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.274498Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:1b8f26d84d9420b8b39fe5d3152bbec0b208554673cb9c1e0deaab1989ab5b53","observation_id":"2c6b71d6-6bb7-47fe-9e94-52c6d830322a","resolution":{"observed_at":"2026-08-06T20:49:41.274498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:45.395921Z","title":"Autoregressive image generation without vec- tor quantization","venue":null,"work_id":"fe116e0d-e869-41b7-80c9-242906c6b0ff","year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.322404Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:f1d004a414ebb0b2924aa2b876046960e7a8acbacb7068fd2b164a963a6a4f18","observation_id":"211cbf41-a61c-4348-acd2-e6d994ebf7a9","resolution":{"observed_at":"2026-08-06T20:49:45.499643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-06T20:49:41.373771Z","title":"Flow matching for generative mod- eling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.373771Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:9294245c3fcb067b97e6ffa26a4ca1379d007303c7e1d535544260c7dbc1d5ec","observation_id":"6069cb31-1933-46e0-98a6-6c8b52e59d4d","resolution":{"observed_at":"2026-08-06T20:49:41.373771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T20:49:41.433253Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.433253Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:b2ecd71c56ed78b74e4dd6402f931dd50510c01aef6fdeb6fb9f94fb825029c1","observation_id":"22711448-6544-4600-b7b1-fa530e1e7e81","resolution":{"observed_at":"2026-08-06T20:49:41.433253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:45.201255Z","title":"Sit: Explor- ing flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":"a31194df-1e37-44e1-812e-0f467f615182","year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.493078Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:fe1a810c5b30b88dadaffbacbb18086321a213450055ba6ac514432f6daf4ef2","observation_id":"04eaa166-59c1-43ab-8df6-6b53e76d5a05","resolution":{"observed_at":"2026-08-06T20:49:45.275909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-07-06T20:22:04.328179Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09732","snapshot_observed_at":"2026-08-06T20:49:41.574998Z","title":"Inference-time scaling for diffu- sion models beyond scaling denoising steps","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.574998Z"},"links":{"cited_paper":"/paper/2501.09732","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:03e68d59cf905f7421dfbe647eafef928012b1a2e1a7d57ff2c36c64b1fad874","observation_id":"a68b95c8-627f-498d-bcf9-ba6bf85e8acb","resolution":{"observed_at":"2026-08-06T20:49:41.574998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:44.977855Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"f25fb205-e6bb-4370-9e14-3b088298ed78","year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.624361Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:ddc172f8f8837cabce10aff33ede81e23234c854789dd2793e9ac31bb50dadc0","observation_id":"67f2e531-6908-4911-8d1d-eda963bcb022","resolution":{"observed_at":"2026-08-06T20:49:45.076547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-04T04:01:49.750596Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-06T20:49:41.683560Z","title":"Randar: Decoder-only autoregressive visual generation in random orders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.683560Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:f5027bb4ad5945ca3790b76166375d5f0b027d51fb6961b1303fe624e13ef0c2","observation_id":"bf60b8b0-3048-4fb7-ba33-2c4190826b07","resolution":{"observed_at":"2026-08-06T20:49:41.683560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.750428Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.750428Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:0d95a9531c80b996ef25d248071968549e9c7c16930a138323c7471ff2d224a6","observation_id":"2057b161-365f-474f-a842-59ef6ac87f84","resolution":{"observed_at":"2026-08-06T20:49:41.750428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-06T20:49:41.816574Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.816574Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:720fb63d1df40a0e5e7eb11c72a821fa2b6c4c8537f2c6fb133290ba085ba422","observation_id":"21ac6c67-a52e-4256-8c6e-c813248832d0","resolution":{"observed_at":"2026-08-06T20:49:41.816574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03069","last_updated":"2025-08-07T09:08:33Z","snapshot_observed_at":"2026-07-06T20:01:23.373458Z","submitted_at":"2024-12-04T06:46:55Z","title":"TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03069","snapshot_observed_at":"2026-08-06T20:49:41.857110Z","title":"Tokenflow: Unified image tokenizer for multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.857110Z"},"links":{"cited_paper":"/paper/2412.03069","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:e3f6812b0c1e58e6c59279b2fda41ba089a637f5c564922de21c67c4d70b6b1a","observation_id":"c1aa9569-6165-4191-ae36-9f863a158d8a","resolution":{"observed_at":"2026-08-06T20:49:41.857110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15205","last_updated":"2024-12-19T18:59:31Z","snapshot_observed_at":"2026-08-05T21:19:08.972222Z","submitted_at":"2024-12-19T18:59:31Z","title":"FlowAR: Scale-wise Autoregressive Image Generation Meets Flow Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15205","snapshot_observed_at":"2026-08-06T20:49:41.897149Z","title":"Flowar: Scale-wise autoregres- sive image generation meets flow matching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.897149Z"},"links":{"cited_paper":"/paper/2412.15205","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:f5cfa787027325fb87abd46636abad434259a51bf5d17fbb744743fc73cced34","observation_id":"4f4a7ad5-af68-4dbb-bc80-118f773917b8","resolution":{"observed_at":"2026-08-06T20:49:41.897149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:44.827056Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"337fe751-a78e-4026-9fe3-cb354b49a6b1","year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.937673Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:4627e30ccccbb08a2aab4584f3f849379dbafe319f1246e2ec0a1d5da4018b6d","observation_id":"b8d68fc7-c92d-4fe1-9665-c0699c2bc5a3","resolution":{"observed_at":"2026-08-06T20:49:44.887548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-07-06T20:01:05.921085Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T20:49:41.987348Z","title":"Taming scalable visual tok- enizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.987348Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:8c08efb406abc40254ef1ffca64f520d070317425650dfd9008ac5878a29f65b","observation_id":"7d998c79-5c41-4e98-a1c7-c77f1abbcc66","resolution":{"observed_at":"2026-08-06T20:49:41.987348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15188","last_updated":"2025-02-05T02:26:38Z","snapshot_observed_at":"2026-08-02T19:18:33.010410Z","submitted_at":"2024-12-19T18:56:24Z","title":"LMFusion: Adapting Pretrained Language Models for Multimodal Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15188","snapshot_observed_at":"2026-08-06T20:49:42.028479Z","title":"Llamafu- sion: Adapting pretrained language models for multimodal generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.028479Z"},"links":{"cited_paper":"/paper/2412.15188","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:278ae81b993d96c7ad84787b6cb31ec4702ee45c94458b4586a8b7674eb99182","observation_id":"72d32ee3-09c9-486d-a573-65be95ab85cf","resolution":{"observed_at":"2026-08-06T20:49:42.028479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-06T20:49:42.079729Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.079729Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:53ab7a428b76809f60b220e34d3873fa93afbaadf07ff1af3dcd3a44ab6aeb12","observation_id":"b9a6b2cb-bbb3-4952-a9d4-990b1c8e0eb4","resolution":{"observed_at":"2026-08-06T20:49:42.079729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10812","last_updated":"2024-10-14T17:59:42Z","snapshot_observed_at":"2026-08-07T01:29:22.842436Z","submitted_at":"2024-10-14T17:59:42Z","title":"HART: Efficient Visual Generation with Hybrid Autoregressive Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10812","snapshot_observed_at":"2026-08-06T20:49:42.131239Z","title":"Hart: Efficient visual generation with hybrid au- toregressive transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.131239Z"},"links":{"cited_paper":"/paper/2410.10812","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:af65b0fc5883f33dff44846efcb64be94eb54c456dc72a2b0cc5b8021ac68440","observation_id":"e85bd7f2-1e2e-48a9-b97c-fbb89592e658","resolution":{"observed_at":"2026-08-06T20:49:42.131239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-06T20:49:42.173644Z","title":"Chameleon: Mixed-modal early-fusion foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.173644Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:2f1804e30bf5ee1942d7ebd051d4951e7f5158da4ff4cd9242bff7b74a77cf7f","observation_id":"c1306bb1-7de3-49a4-96bc-601b4b48c194","resolution":{"observed_at":"2026-08-06T20:49:42.173644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T20:49:42.212770Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.212770Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:18c11cbf14271995bd62afb3832090f1bdfad88713161922d2c90477ccd0663d","observation_id":"50dc8932-7767-492f-adae-b699fade339b","resolution":{"observed_at":"2026-08-06T20:49:42.212770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:44.655474Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":"ae3b1e0a-f0c8-4914-99a8-5121c5d6d060","year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.237158Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:7fae4b89f471ca2d779694dfbe932c57f30991cc0ab57f44d1dcf2b862ec36d1","observation_id":"7d50339c-010c-4a7f-a9d9-0fd1ef94e139","resolution":{"observed_at":"2026-08-06T20:49:44.758230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14164","last_updated":"2024-12-18T18:58:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T18:58:50Z","title":"MetaMorph: Multimodal Understanding and Generation via Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14164","snapshot_observed_at":"2026-08-06T20:49:42.284132Z","title":"Metamorph: Multimodal understanding and generation via instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.284132Z"},"links":{"cited_paper":"/paper/2412.14164","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:e4b6178dc3b945169f6aaeb6288fcfe9f43c35cebaf883837b1d906147be0ac0","observation_id":"322ac4a2-047d-4531-a1be-351033baa8fb","resolution":{"observed_at":"2026-08-06T20:49:42.284132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T20:49:42.287458Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.287458Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:9bd27693b5a4a47d4d67b12e398b54475b999dad5e838d634d8e4f3430a42ede","observation_id":"f18bf4f7-eb8f-4599-b64f-9c7078b711ba","resolution":{"observed_at":"2026-08-06T20:49:42.287458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-06T20:49:42.290451Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.290451Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:1fdcca446f6f25494354795e6230a1f9b428434b499cb301541d153598b9bd83","observation_id":"60cf142c-0d1e-4891-8013-64c9eb89867e","resolution":{"observed_at":"2026-08-06T20:49:42.290451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15119","last_updated":"2025-04-03T02:34:24Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:59:54Z","title":"Parallelized Autoregressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15119","snapshot_observed_at":"2026-08-06T20:49:42.343208Z","title":"Parallelized autoregressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.343208Z"},"links":{"cited_paper":"/paper/2412.15119","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:5b1e81c20008afdec4bdbf00bcee1336abc68ffefea78121a5855e6903718eaa","observation_id":"d1fd3900-2d4a-4d36-ae27-49912d0fd5cb","resolution":{"observed_at":"2026-08-06T20:49:42.343208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16211","last_updated":"2024-12-08T19:55:36Z","snapshot_observed_at":"2026-08-04T16:36:02.143481Z","submitted_at":"2024-09-24T16:12:12Z","title":"MaskBit: Embedding-free Image Generation via Bit Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16211","snapshot_observed_at":"2026-08-06T20:49:42.481613Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.481613Z"},"links":{"cited_paper":"/paper/2409.16211","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:454b0ba8c95083ee765fc59df8860e4f5de84b22b1d4695e9c042a6cf4b9feb7","observation_id":"85a12cc2-0cc3-45f8-9281-971b9f89b4c1","resolution":{"observed_at":"2026-08-06T20:49:42.481613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-06T20:49:42.607415Z","title":"Janus: Decoupling visual encoding for unified multimodal understanding and generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.607415Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:9f26c3999c73b727dae3b874f7fe24f1bd10d80d2e69a50cb0a9ecbcb84228ff","observation_id":"02909b14-599a-4213-8fb1-3299d79fad49","resolution":{"observed_at":"2026-08-06T20:49:42.607415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-06T20:49:42.711070Z","title":"Vila-u: a unified foundation model inte- grating visual understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.711070Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:a80eafa06ab19f89e65842e2e7d6c085ac285b9aeb4c0c33e584cddbe1141ad9","observation_id":"39649940-d2d2-4b84-a25a-18ceaa21d517","resolution":{"observed_at":"2026-08-06T20:49:42.711070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-06T20:49:42.844718Z","title":"Show-o: One single transformer to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.844718Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:5a105645b42589e2e420c2d838da6a870fc2939161d48f49735b2591ff8a5439","observation_id":"869db5e1-b857-47b5-8e0a-695c22df2881","resolution":{"observed_at":"2026-08-06T20:49:42.844718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01423","last_updated":"2025-03-10T11:43:42Z","snapshot_observed_at":"2026-08-06T01:13:01.484290Z","submitted_at":"2025-01-02T18:59:40Z","title":"Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01423","snapshot_observed_at":"2026-08-06T20:49:42.947470Z","title":"Reconstruction vs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.947470Z"},"links":{"cited_paper":"/paper/2501.01423","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:76de004f5f64d299e95aa54076b581ba1282291c0ef4ac3ab7e1be4034d05a4d","observation_id":"2f8b32c0-e3f5-4db2-8a04-60aeb491a8b6","resolution":{"observed_at":"2026-08-06T20:49:42.947470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04627","last_updated":"2022-06-05T01:57:58Z","snapshot_observed_at":"2026-07-06T11:56:10.689708Z","submitted_at":"2021-10-09T18:36:00Z","title":"Vector-quantized Image Modeling with Improved VQGAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04627","snapshot_observed_at":"2026-08-06T20:49:43.043700Z","title":"Vector-quantized image modeling with improved vqgan","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.043700Z"},"links":{"cited_paper":"/paper/2110.04627","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:3c7f265c94a1c5c08f4b17430c9c6119f87a6100fb426acad7687f9c735f7352","observation_id":"4264b34a-0145-43a7-b8a9-af568f2feeb6","resolution":{"observed_at":"2026-08-06T20:49:43.043700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05737","snapshot_observed_at":"2026-08-06T20:49:43.124751Z","title":"Language model beats diffusion–tokenizer is key to visual generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.124751Z"},"links":{"cited_paper":"/paper/2310.05737","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:7dffa45587a78b205d83c115f93beee12577493927d477ad9ea1ed0ce6787b9a","observation_id":"5243dc39-6e11-4294-8cb1-3398367a1f88","resolution":{"observed_at":"2026-08-06T20:49:43.124751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00776","last_updated":"2024-11-01T17:59:58Z","snapshot_observed_at":"2026-07-06T19:43:42.287026Z","submitted_at":"2024-11-01T17:59:58Z","title":"Randomized Autoregressive Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00776","snapshot_observed_at":"2026-08-06T20:49:43.182816Z","title":"Randomized autoregressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.182816Z"},"links":{"cited_paper":"/paper/2411.00776","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:133a6e94978dcda2b6a6977dbcd949dad99c228775a99c404253a5bcf42ea08b","observation_id":"bda0f952-1934-40e7-9ecf-3484d0b1c84e","resolution":{"observed_at":"2026-08-06T20:49:43.182816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:44.469828Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":"80b3065e-2edf-49e8-b7b9-30b3ea508638","year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.247653Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:a15cdf6cf97687f86552ab069016891924ecaa145e7b32f38de1f85f07cbe8c1","observation_id":"15c9e044-620f-4134-bb06-cb48332ec1fc","resolution":{"observed_at":"2026-08-06T20:49:44.528120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-06T20:49:43.401412Z","title":"Representation alignment for generation: Training diffu- sion transformers is easier than you think","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.401412Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:42ab95e811103837fff791442376da234dfce9ea8de8e92ff63d27e70776e800","observation_id":"671bf3f0-4caa-426b-b482-c9e8b2d400ae","resolution":{"observed_at":"2026-08-06T20:49:43.401412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14170","last_updated":"2024-12-19T02:42:46Z","snapshot_observed_at":"2026-08-04T05:10:00.882381Z","submitted_at":"2024-12-18T18:59:53Z","title":"E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling","version":2},"cited_work":{"arxiv_id":"2412.14170","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14170","snapshot_observed_at":"2026-08-06T20:49:43.986751Z","title":"E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling","venue":"cs.CV","work_id":"3b9ea66b-76b8-4780-bed9-617cdfc964ab","year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.543357Z"},"links":{"cited_paper":"/paper/2412.14170","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:1ff959326fd46d4e31ca385d1ec59aca29e6e5189ac8ef8069425a6320afd9a0","observation_id":"8b75ad89-6988-4f41-a8aa-8ed91ed62049","resolution":{"observed_at":"2026-08-06T20:49:44.067966Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-03T18:21:25.175322Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-06T20:49:43.657417Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.657417Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:070d389700e2f00a048eb5a6d1ebda4b25f885c278b93227680f69e5d8021b40","observation_id":"13829bd9-c1ef-4d9a-b6d1-7032636d9a26","resolution":{"observed_at":"2026-08-06T20:49:43.657417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-06T20:49:43.758080Z","title":"Transfusion: Pre- dict the next token and diffuse images with one multi-modal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.758080Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:301e5d90c86dd2b41ec8c5c6bed35a97669fb949938f14db834d519fa985ed83","observation_id":"ebe5efca-5ca9-4ca0-89f6-547a70e773c0","resolution":{"observed_at":"2026-08-06T20:49:43.758080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11837","last_updated":"2024-06-17T17:59:57Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:57Z","title":"Scaling the Codebook Size of VQGAN to 100,000 with a Utilization Rate of 99%","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11837","snapshot_observed_at":"2026-08-06T20:49:43.861863Z","title":"Scaling the codebook size of vqgan to 100,000 with a utilization rate of 99%","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.861863Z"},"links":{"cited_paper":"/paper/2406.11837","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:ec3e5dc1ecf57907e76951fbe092778fefac525a9f9f937cd07be04fb71363c2","observation_id":"9739bb18-d759-4093-91f0-3834a5dc1c86","resolution":{"observed_at":"2026-08-06T20:49:43.861863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:52:32.254332Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2507.01756."}