{"as_of":"2026-08-08T21:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d045d6d903beb29478b781f56a2e943c9c848e0dbf3f9c3378911e5378806774","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T11:25:36.104805Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T04:18:45.403718Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T04:20:19.343984Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"cited_work":{"arxiv_id":"2510.04961","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.04961","snapshot_observed_at":"2026-06-30T03:18:05.272041Z","title":"Vallaeys, J","venue":null,"work_id":"8f376d08-fda9-4f53-96d3-7398071c9cef","year":2025},"citing_paper":{"arxiv_id":"2605.23902","last_updated":"2026-05-22T17:59:42Z","snapshot_observed_at":"2026-08-07T05:36:53.981632Z","submitted_at":"2026-05-22T17:59:42Z","title":"PiD: Fast and High-Resolution Latent Decoding with Pixel Diffusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-25T04:18:45.403718Z"},"links":{"cited_paper":"/paper/2510.04961","citing_paper":"/paper/2605.23902"},"observation_digest":"sha256:c5e2f97197f7df90b9e6ed54b88b2be18a8d4873207a7805b9b58ee6c7c47723","observation_id":"cdd01faf-e136-481a-a2c1-0ce84f24032e","resolution":{"observed_at":"2026-06-30T03:18:05.272041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.04961/citation-record","integrity":"/paper/2510.04961/integrity","json":"/paper/2510.04961/citation-record.json","paper":"/paper/2510.04961"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-04T11:25:33.514720Z","title":"Cosmos world foundation model platform for physical AI","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:33.514720Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:c4e6f50099a374a43f0926a6d472409a8ca71ed8285d7545dbf1a9d89be7dd8a","observation_id":"afd23de3-b2cc-4395-9129-b0f4404e7310","resolution":{"observed_at":"2026-08-04T11:25:33.514720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:36.104805Z","title":"Models directly trained at128×128","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:36.104805Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:abc2f2d9768eef6a56f4b7023243584bf10d64b80544abf61980974e0db0c1e8","observation_id":"bf31865b-3481-4483-b7ff-9cedb76ac3ae","resolution":{"observed_at":"2026-08-04T11:25:36.104805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10972","last_updated":"2023-05-21T07:07:55Z","snapshot_observed_at":"2026-08-08T02:32:31.177380Z","submitted_at":"2023-01-26T07:37:22Z","title":"On the Importance of Noise Scheduling for Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10972","snapshot_observed_at":"2026-08-04T11:25:33.852695Z","title":"Masked autoencoders are effective tokenizers for diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:33.852695Z"},"links":{"cited_paper":"/paper/2301.10972","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:171b618a2613392c7d154b7abffb975ed8e5d525531cb7ec973b6a29a4ad2e7d","observation_id":"71222710-f588-4aef-a23d-073e33cec4cc","resolution":{"observed_at":"2026-08-04T11:25:33.852695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:34.320465Z","title":"Mixture-of-transformers: A sparse and scalable architecture for multi-modal foundation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.320465Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:931fed3bfa667f95d8b791a2e58e7cf91c65c5261c0f378bad35e30f72affa87","observation_id":"991313a8-36de-40d4-8e9d-caa704b7b1c5","resolution":{"observed_at":"2026-08-04T11:25:34.320465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:34.405950Z","title":"DGAE: Diffusion-guided autoencoder for efficient latent representation learning.arXiv preprint, 2506.09644,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.405950Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:42caa21a64c62ef242433eb069891cf442a35a23bfc3758152f9bb4d34250804","observation_id":"d9beb344-1cc4-48c0-81b3-3e989b95ed57","resolution":{"observed_at":"2026-08-04T11:25:34.405950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.02388","last_updated":"2021-01-07T06:12:28Z","snapshot_observed_at":"2026-07-06T10:30:38.112588Z","submitted_at":"2021-01-07T06:12:28Z","title":"Knowledge Distillation in Iterative Generative Models for Improved Sampling Speed","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.02388","snapshot_observed_at":"2026-08-04T11:25:34.483894Z","title":"Knowledge distillation in iterative generative models for improved sampling speed.arXiv preprint, 2101.02388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.483894Z"},"links":{"cited_paper":"/paper/2101.02388","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:1adf256c509d72acc952f2685fde15d0ea140c80541a5cb5825ec2332416701f","observation_id":"1a665255-829a-4519-992c-b7ddce89f401","resolution":{"observed_at":"2026-08-04T11:25:34.483894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-04T11:25:34.677649Z","title":"Sampson, Shikai Li, Simone Parmeggiani, Steve Fine, Tara Fowler, Vladan Petrovic, and Yuming Du","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.677649Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:6a2d5706142c3bf09e4953e6621e10a9e9fe472bdf291b69d4faba25eac58f67","observation_id":"6b362679-350b-45dc-a69e-b4c80fd4f4b8","resolution":{"observed_at":"2026-08-04T11:25:34.677649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.00386","last_updated":"2022-06-01T10:39:12Z","snapshot_observed_at":"2026-08-02T21:48:01.051561Z","submitted_at":"2022-06-01T10:39:12Z","title":"DiVAE: Photorealistic Images Synthesis with Denoising Diffusion Decoder","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.00386","snapshot_observed_at":"2026-08-04T11:25:34.998830Z","title":"DiVAE: Photorealistic images synthesis with denoising diffusion decoder.arXiv preprint, 2206.00386,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.998830Z"},"links":{"cited_paper":"/paper/2206.00386","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:4ef08048b3bb4b1dc44032a9a6bab2256036999498ce32e5e80351c365e1aa21","observation_id":"5d542e41-4086-4bba-b548-3d1251fc1e4a","resolution":{"observed_at":"2026-08-04T11:25:34.998830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-04T11:25:35.126850Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation.arXiv preprint, 2406.06525,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:35.126850Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:1bbc6fe3091e2a7cb55e858a02aab3de17e91f599c0d61c08fd0b389b54474f7","observation_id":"c3d31ada-40d1-498a-aa91-1451e099ad77","resolution":{"observed_at":"2026-08-04T11:25:35.126850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-07T22:11:30.869700Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-04T11:25:35.251399Z","title":"Chameleon: Mixed-modal early-fusion foundation models.arXiv preprint, 2405.09818,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:35.251399Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:1942a3181934e733d8ae1aee3a3efa84cda34ee47ee13cd1dfca3c568dabb897","observation_id":"d897b9ba-f9e8-45c0-924f-f3213b0b7702","resolution":{"observed_at":"2026-08-04T11:25:35.251399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:35.389368Z","title":"Latent denoising makes good visual tokenizers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:35.389368Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:0cb90106613f8c8006a54ac76bd6d1bb8ce3782bc708da09e3e5d286ba729d2a","observation_id":"5c813ace-5135-4c5e-9136-b92ce70c1b66","resolution":{"observed_at":"2026-08-04T11:25:35.389368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00776","last_updated":"2024-11-01T17:59:58Z","snapshot_observed_at":"2026-07-06T19:43:42.287026Z","submitted_at":"2024-11-01T17:59:58Z","title":"Randomized Autoregressive Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00776","snapshot_observed_at":"2026-08-04T11:25:35.474279Z","title":"Language model beats diffusion - tokenizer is key to visual generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:35.474279Z"},"links":{"cited_paper":"/paper/2411.00776","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:c55b2f655e49455e6ea62a0aadcd4fbd2dde55a060cf5e6a4c788606ee728fac","observation_id":"5d1ba256-33da-4e8c-80f3-800dab3f237a","resolution":{"observed_at":"2026-08-04T11:25:35.474279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:35.579729Z","title":"Z x∈E−1(z) ∆(x,ˆy) # P(D g(z) =y)dydx(2) = min ˆy","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:35.579729Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:88044c72ef1ceac2ced5800e9109be13f2f52fb9c146d68b3323de0154f8aeb6","observation_id":"c7c18563-f116-4d62-a1c5-a2eab0d2727d","resolution":{"observed_at":"2026-08-04T11:25:35.579729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:35.830861Z","title":"Impact of sampling steps on reconstruction.Quality of samples from diffusion models usually improves with a higher number of sampling steps","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:35.830861Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:254946697820f1517d987333bd78494dc70f64541285e0bfbd962a0feb97826a","observation_id":"e7ac77c7-ae75-473f-a99b-15c2c20f68a3","resolution":{"observed_at":"2026-08-04T11:25:35.830861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:35.988569Z","title":"We show in Table S3 that SSDDoutperforms the original decoders on reconstruction performance, despite being conditioned on features optimized for a different architecture","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:35.988569Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:cf270875ed0d0b5524fb2b40e23dd7645a5b937ff3dbcb3cf3e3e5bf3d259e98","observation_id":"94e3542a-068c-41ff-b080-80403a152ea8","resolution":{"observed_at":"2026-08-04T11:25:35.988569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:34.036258Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.036258Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:ef42f9d6bcd0e54eaae13596d04325207082dc1da761ad96d866f5774504ac6b","observation_id":"586244c7-883b-4b3c-843e-d4df2de85647","resolution":{"observed_at":"2026-08-04T11:25:34.036258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:35.709669Z","title":"We use the following loss coefficients: λLPIPS = 0 .5, λREPA = 0 .25, λKL = 10 −6","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:35.709669Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:7d5b75e6f02270a17298c03aeb17e9a536e9981a42c3ead96ef81907dd7aadff","observation_id":"f1afc006-9434-4351-b0d9-5f3f98801ddb","resolution":{"observed_at":"2026-08-04T11:25:35.709669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-04T11:25:34.878371Z","title":"GLU variants improve transformer.arXiv preprint, 2002.05202,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.878371Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:d8402f9426b84f85d0ec3e9d7b86c04c5837a8af812569b19cc81a7944b78618","observation_id":"55b8f0bb-8bca-4482-a8cd-ef7cee9acb91","resolution":{"observed_at":"2026-08-04T11:25:34.878371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18231","last_updated":"2024-03-07T20:28:54Z","snapshot_observed_at":"2026-08-07T18:41:59.021338Z","submitted_at":"2023-05-26T17:16:16Z","title":"High-Fidelity Image Compression with Score-based Generative Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18231","snapshot_observed_at":"2026-08-04T11:25:34.201290Z","title":"High- fidelity image compression with score-based generative models.CoRR, abs/2305.18231, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.201290Z"},"links":{"cited_paper":"/paper/2305.18231","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:b40d16ad4f63a3dc407bf673b50273cb608613f81b42108a3bcd2c08a7a1ed66","observation_id":"cd865685-340e-41a1-8847-db8730428d08","resolution":{"observed_at":"2026-08-04T11:25:34.201290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-04T11:25:34.567462Z","title":"Latent consistency models: Synthesizing high-resolution images with few-step inference.arXiv preprint, 2310.04378,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.567462Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:834ed78b87e0a74f0ed1a4ff4a75f7b8293d960e4277349096f768abbf57438a","observation_id":"f9683d53-1770-4b88-8d04-dfc80b613961","resolution":{"observed_at":"2026-08-04T11:25:34.567462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:34.811180Z","title":"Flow to the mode: Mode-seeking diffusion autoencoders for state-of-the-art image tokenization.arXiv preprint, 2503.11056,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:34.811180Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:e151ebff7461d33cf29552da3fd9a90caa32b4f5e63880e79ec4f37aedccdcf9","observation_id":"d42dc319-f30f-40b2-9cb9-684040991e75","resolution":{"observed_at":"2026-08-04T11:25:34.811180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18593","last_updated":"2025-01-30T18:59:37Z","snapshot_observed_at":"2026-07-06T20:28:33.378335Z","submitted_at":"2025-01-30T18:59:37Z","title":"Diffusion Autoencoders are Scalable Image Tokenizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18593","snapshot_observed_at":"2026-08-04T11:25:33.951411Z","title":"Diffusion autoencoders are scalable image tokenizers.arXiv preprint, 2501.18593, 2025d","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:33.951411Z"},"links":{"cited_paper":"/paper/2501.18593","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:37fb9b3bfe3ba0271d47f4af1ac1faf76a15ee8f8c1808c8fe48bf3795554355","observation_id":"918554f6-a36e-4b25-801b-a7567b8d98a5","resolution":{"observed_at":"2026-08-04T11:25:33.951411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:33.726998Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:33.726998Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:e7ff04106b0182227f3f5effc4d8cdf13b555351085c305671f667ef352cb12e","observation_id":"807130a9-b35f-43ca-885e-fa91186cda13","resolution":{"observed_at":"2026-08-04T11:25:33.726998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:25:33.604375Z","title":"Imagen 3.arXiv preprint, 2408.07009,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:33.604375Z"},"links":{"citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:f880e9ae06cb26bd22eda8e24c8740ade239e36a021df529d0e420ea4d542530","observation_id":"63759571-4e80-45c6-87d2-dd4fae17b2a6","resolution":{"observed_at":"2026-08-04T11:25:33.604375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2510.04961."}