{"as_of":"2026-08-10T18:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73ae4e4e361c2b7b7270b78a7fa1de572884fc43afbccb695a2455a3fa41f8c1","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:20:33.559040Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:44:24.318786Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"cited_work":{"arxiv_id":"2506.08257","doi":"10.48550/arxiv.2506.08257","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.08257 , year=","venue":"ArXiv.org","work_id":"df4ab88a-9953-40f1-b845-87de085a7e7e","year":2025},"citing_paper":{"arxiv_id":"2606.03578","last_updated":"2026-06-02T12:47:14Z","snapshot_observed_at":"2026-07-06T23:43:50.943530Z","submitted_at":"2026-06-02T12:47:14Z","title":"Diffusing in the Right Space: A Systematic Study of Latent Diffusability","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-06-28T10:44:24.318786Z"},"links":{"cited_paper":"/paper/2506.08257","citing_paper":"/paper/2606.03578"},"observation_digest":"sha256:d6df2be05629d5cc71b5fe7bf195b0dd897cac011c0d0ffe2bb4ac2f00dbaacb","observation_id":"47b10b4d-d5be-4f53-92fc-d1d8cd914d70","resolution":{"observed_at":"2026-07-02T02:36:27.606412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"cited_work":{"arxiv_id":"2506.08257","doi":"10.48550/arxiv.2506.08257","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.08257 , year=","venue":"ArXiv.org","work_id":"df4ab88a-9953-40f1-b845-87de085a7e7e","year":2025},"citing_paper":{"arxiv_id":"2606.05552","last_updated":"2026-06-04T01:06:52Z","snapshot_observed_at":"2026-07-06T23:45:33.157370Z","submitted_at":"2026-06-04T01:06:52Z","title":"Balancing Image Compression and Generation with Bootstrapped Tokenization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T03:07:33.054518Z"},"links":{"cited_paper":"/paper/2506.08257","citing_paper":"/paper/2606.05552"},"observation_digest":"sha256:a4908be26708189498dd133f0965f2f5b604503123f5db189fcc2d0a48908b32","observation_id":"2c151745-7ad7-4c49-998e-0b0fa5c660bc","resolution":{"observed_at":"2026-07-02T11:46:55.447804Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"cited_work":{"arxiv_id":"2506.08257","doi":"10.48550/arxiv.2506.08257","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.08257 , year=","venue":"ArXiv.org","work_id":"df4ab88a-9953-40f1-b845-87de085a7e7e","year":2025},"citing_paper":{"arxiv_id":"2606.08810","last_updated":"2026-06-15T19:27:43Z","snapshot_observed_at":"2026-08-02T08:52:28.875995Z","submitted_at":"2026-06-07T20:00:33Z","title":"Continuous Language Diffusion as a Decoder-Interface Problem","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T18:27:10.422343Z"},"links":{"cited_paper":"/paper/2506.08257","citing_paper":"/paper/2606.08810"},"observation_digest":"sha256:dd28b7e3a151a921c1082350c313597e937d207b47971d63f8fa751f8f381910","observation_id":"abe6c91c-83f8-417f-bce3-b56488f3a6d8","resolution":{"observed_at":"2026-06-27T18:31:07.705436Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"cited_work":{"arxiv_id":"2506.08257","doi":"10.48550/arxiv.2506.08257","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.08257 , year=","venue":"ArXiv.org","work_id":"df4ab88a-9953-40f1-b845-87de085a7e7e","year":2025},"citing_paper":{"arxiv_id":"2606.17590","last_updated":"2026-06-16T06:52:52Z","snapshot_observed_at":"2026-08-02T16:55:34.840902Z","submitted_at":"2026-06-16T06:52:52Z","title":"TivTok: Broadcasting Time-Invariant Tokens for Scalable Video Tokenization","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-06-27T01:20:32.508409Z"},"links":{"cited_paper":"/paper/2506.08257","citing_paper":"/paper/2606.17590"},"observation_digest":"sha256:39d7351eb1aeb59424b7ba494b9a7fe0c5828ec260ac13e2f45900fd8e52b7e1","observation_id":"df3d494b-7bc8-46ce-a6f7-bac05d6eaea1","resolution":{"observed_at":"2026-07-03T20:28:55.554344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.08257/citation-record","integrity":"/paper/2506.08257/integrity","json":"/paper/2506.08257/citation-record.json","paper":"/paper/2506.08257"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:30.399891Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.399891Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:60aa2fe8bc31021131a90a99cebc88f83d17f182d6a1535eff7aa1e704582596","observation_id":"16ef8461-5182-4194-a6da-b794a777eaa2","resolution":{"observed_at":"2026-08-07T05:20:30.399891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.346990Z","title":"Why are conditional generative models better than unconditional ones? In NeurIPS 2022 Workshop on Score-Based Methods, 2022","venue":null,"work_id":"836ee28f-6798-411f-806f-e4da43240f2d","year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.451006Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:136ec2640e0a9033a923852ee2bf54840057cf9960db2613c076106a13e4fdb1","observation_id":"a2841993-cece-482b-94bb-4dc7bb384bb6","resolution":{"observed_at":"2026-08-07T05:20:38.351781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.330336Z","title":"Retrieval-augmented diffusion models","venue":null,"work_id":"30f5316c-84c8-4951-9d54-971455919eda","year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.515158Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:324d4b5e6ef53ff0a224ee04e11a0cc91370f9db758bab42bc61278fbd91d41a","observation_id":"a944599e-2bf5-45d4-9fca-16a1c40ae1e3","resolution":{"observed_at":"2026-08-07T05:20:38.336162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.314125Z","title":"High fidelity visualization of what your self-supervised representation knows about","venue":null,"work_id":"2811a13d-2ff7-42e8-af8d-dcf0b96883dd","year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.581145Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:1d5db221410fe0cd5b06c761340b78a1cdb267989830e517707658b9cf59cdce","observation_id":"eda6c2c0-d3c4-4491-8eb5-479228ce9b1e","resolution":{"observed_at":"2026-08-07T05:20:38.318753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.298497Z","title":"Efficient-VQGAN : Towards high-resolution image generation with efficient vision transformers","venue":null,"work_id":"5651b8e1-b0bf-476e-a987-0948424a3492","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.668965Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:e1f207e169fb5c67086e567d8fc8b680ff7dbaac880968c0a6269cb8985663e5","observation_id":"27dc9c4b-6dbe-41f6-8039-cf34e9895efc","resolution":{"observed_at":"2026-08-07T05:20:38.303443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.282870Z","title":"Instance-conditioned GAN","venue":null,"work_id":"fbd920ce-604d-4074-9359-4511acaa32b6","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.734511Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:b9f949230311efd7c0e37a6d5c5e2f1f95fba0a1d543f70be33bc0a3cb23d09a","observation_id":"62e717e5-4fb7-4f19-a948-a86c5ff0814d","resolution":{"observed_at":"2026-08-07T05:20:38.287286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.268062Z","title":null,"venue":null,"work_id":"51fc87cf-cb2c-49a0-b6f0-1ab48fedf70d","year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.801178Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:bfcfebf39cd32979f16c75487b45b23335ea06f26ac72e833ac00ff216d2c466","observation_id":"7051860a-9774-4dc8-8090-5f610e8d39b1","resolution":{"observed_at":"2026-08-07T05:20:38.272768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08583","last_updated":"2022-09-04T04:57:40Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:57:29Z","title":"VQGAN-CLIP: Open Domain Image Generation and Editing with Natural Language Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08583","snapshot_observed_at":"2026-08-07T05:20:30.863466Z","title":"VQGAN-CLIP : Open domain image generation and editing with natural language guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.863466Z"},"links":{"cited_paper":"/paper/2204.08583","citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:69afa8c94cd41bfbf56026afd3d39b0142e9538bf7484f2603830a7cec4f57d4","observation_id":"b0f08a11-acee-419d-a058-bf175aa68da0","resolution":{"observed_at":"2026-08-07T05:20:30.863466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.251707Z","title":"ImageNet : A large-scale hierarchical image database","venue":null,"work_id":"a8d26e35-016e-42dc-8f61-3fcb1d521ed5","year":2009},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:30.932178Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:9e08b32b8c8872725ffddb2051cde2cb510584fe46ecdb0785164b0a8da94c27","observation_id":"53434fb0-2c25-4d62-8e0e-799327489cf5","resolution":{"observed_at":"2026-08-07T05:20:38.256220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.000262Z","title":"and Nichol, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.000262Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:15ec99e893c04129902d11ba6c0f498754c6724bba2b629425495c36495f2ef2","observation_id":"66a1f18d-4358-43a5-8f0a-c69a0815d1ab","resolution":{"observed_at":"2026-08-07T05:20:31.000262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.226093Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"66a2e869-4441-401d-a10b-07e41a60ad9f","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.053282Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:e43871541ec25bbdff56c70cd301a6692b3beaf68a11d6b9951f176880de1c4b","observation_id":"32b8c263-82ef-49e9-9559-8bca00f5122e","resolution":{"observed_at":"2026-08-07T05:20:38.230564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.210289Z","title":"H., Chechik, G., and Cohen-Or, D","venue":null,"work_id":"dfdf34a0-cf5d-4962-b080-37f5d0fa6908","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.102482Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:3d5b18201fa3ff62d3f6f8a59d2d8ccb8fd2f306be1cf8e881cb38002f5e6ecc","observation_id":"3e4b0dd7-a5c2-4cf0-803f-195574672eb4","resolution":{"observed_at":"2026-08-07T05:20:38.214950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.193895Z","title":"Generating images from caption and vice versa via CLIP -guided generative latent space search","venue":null,"work_id":"593575cd-ed74-4fd8-b247-ba71456706b1","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.194104Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:1d710b7d3f4cc232b681b31c225c07a195ee12be420dc4f638ee07b28f32ed81","observation_id":"d5a1c10b-e5cc-46f7-a869-7a357c68bb8c","resolution":{"observed_at":"2026-08-07T05:20:38.199309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.177027Z","title":"GANs trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"e6f129b7-e20b-42c3-a617-bb0863fbdfc5","year":2017},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.246934Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:3ec68301ff097be06165bdf826370906a953788ead168a9868983707dc1c2a71","observation_id":"54dc9eab-4240-4cc5-b363-a19128154dd4","resolution":{"observed_at":"2026-08-07T05:20:38.182456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.307672Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.307672Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:d09956a31027215fe7a79ea0e4bbeec4824c09607743482f7cd650251b790f19","observation_id":"580eb988-de0a-4f59-a6d3-548eab69fe4d","resolution":{"observed_at":"2026-08-07T05:20:31.307672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:38.065868Z","title":"Return of unconditional generation: A self-supervised representation generation method","venue":null,"work_id":"db557164-566f-4e7f-a1a0-02cefe5635e8","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.351182Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:7055c4dd3cdaedd76244ce6795fe578760e09a27ed5a6375671ec7b68a43535e","observation_id":"b7e625df-e501-4687-86fe-f6947afdbf39","resolution":{"observed_at":"2026-08-07T05:20:38.156129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.406422Z","title":"Autoregressive image generation without vector quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.406422Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:3d0643ec128b68b562b1a72859e362b4ae0dbe9b4ffc59e1dc5df1e6f730cf6c","observation_id":"eb8eee19-4730-45c5-8ba8-53f15d612ae1","resolution":{"observed_at":"2026-08-07T05:20:31.406422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:37.854173Z","title":"Challenging common assumptions in the unsupervised learning of disentangled representations","venue":null,"work_id":"3a120991-9613-4756-93ed-e65c069e4c9b","year":2019},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.478100Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:c413bcafe02cede605cce5006c574476a002d5e555725dacd820086844e9f420","observation_id":"ab85bd8f-845e-44ab-82e2-f586c2d4fc7c","resolution":{"observed_at":"2026-08-07T05:20:37.920846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:37.538444Z","title":"Finite scalar quantization: Vq-vae made simple","venue":null,"work_id":"762c027f-1b38-47ba-a8f2-082389915c84","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.540181Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:8ee9b48f303f78820b6e1bbe44e54b62224810939b86631b6723b77b3f88887d","observation_id":"df791c3a-65c3-4929-8040-aa235491df21","resolution":{"observed_at":"2026-08-07T05:20:37.691027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:37.277226Z","title":"Styleclip: Text-driven manipulation of stylegan imagery","venue":null,"work_id":"902224ae-393f-4d01-83ea-f92c6b61c6e4","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.611743Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:90e0c5add30eeb1d54507c3c27f9e5ab039566d1031f1351142112dc30d57bff","observation_id":"e7ec8fb5-af7f-41b4-b33b-0bb2d87eeb7f","resolution":{"observed_at":"2026-08-07T05:20:37.360258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.684542Z","title":"and Xie, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.684542Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:70f413e4b9f7e61e0f42235a52e1d8078313de6aadfee6dfddf2e0eac80407b4","observation_id":"78d31d65-f719-47e4-b946-3a852c97270b","resolution":{"observed_at":"2026-08-07T05:20:31.684542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:31.790839Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.790839Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:dc0620d5a3a14121670ef4dd175d898989069f24cca21616652bbc17ce0e6e3e","observation_id":"c2722306-e96f-4dee-89c4-1cd24b734266","resolution":{"observed_at":"2026-08-07T05:20:31.790839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.968133Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"2aaebb45-c50a-4086-9858-93ba6947ac31","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.876984Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:06d0408bb975c6315214d26d1e94248f127676169eabcd0872e272b5279ef009","observation_id":"5904539a-6718-4864-9e08-5cb53dac7fa9","resolution":{"observed_at":"2026-08-07T05:20:37.124661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.775145Z","title":"DynamicViT : Efficient vision transformers with dynamic token sparsification","venue":null,"work_id":"0bb37656-9dc5-45e2-a0a1-8920dc33e6a7","year":2021},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:31.960363Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:f4151504d4dcc4ae6400abad45a06dd1c68d97df800f9b673d68e875a7c7b257","observation_id":"0dbfa4f7-4d1f-4c4c-a045-00fe808c7fd6","resolution":{"observed_at":"2026-08-07T05:20:36.859164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.577694Z","title":"Generating diverse high-fidelity images with VQ-VAE-2","venue":null,"work_id":"ceb61d81-d40e-4914-b1d2-d0ccb0b72dcf","year":2019},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.031527Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:c03884a790643605798c45abdf6ade3af939da94dc4dab3772301e412b87f1f7","observation_id":"5960a89f-84ff-4773-860c-de27e5877901","resolution":{"observed_at":"2026-08-07T05:20:36.689899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:32.108976Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.108976Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:6468665c06a8774f7d159093ef006bceb85c15d5b26f6a7e46cb711d6aebb464","observation_id":"8fc58433-f568-4061-82a2-47025a9899e6","resolution":{"observed_at":"2026-08-07T05:20:32.108976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.349813Z","title":"Improved techniques for training GANs","venue":null,"work_id":"0aa4f562-24ed-4032-bfad-a992774f47bc","year":2016},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.174276Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:078f9a41925a47c6b73ccf81b224e7d9c089c70d1f3d36f1f567ad8120ce4993","observation_id":"91b4e0a7-42fc-4535-bb8f-14fa3690cf45","resolution":{"observed_at":"2026-08-07T05:20:36.432216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:36.105974Z","title":"Image synthesis with a single (robust) classifier","venue":null,"work_id":"55813789-87d0-49c8-9751-2cd3c234536e","year":2019},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.260104Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:bb3de48f6d1d7c31396d2b9fd7ce248185a939e50af92b694401ed2b4837ae94","observation_id":"aee17a2c-1d2e-4484-9c73-6635508ab989","resolution":{"observed_at":"2026-08-07T05:20:36.219471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:35.777292Z","title":"KNN-Diffusion : Image generation via large-scale retrieval","venue":null,"work_id":"1d89736f-a945-48e2-8444-10782c331a44","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.349316Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:ef2ff69b4732d1623eb553b31d991a8578d049dc4f6f217ff7df4c22e41be09b","observation_id":"ca19b30b-ef8c-4866-81ca-de882c9d7aec","resolution":{"observed_at":"2026-08-07T05:20:35.892169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T05:20:32.375413Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.375413Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:ea861df7362dc06022778c97684e0091c13d231152af16e9f7a722efc4f04985","observation_id":"8c9dc712-c644-4933-98de-fe40710e92a7","resolution":{"observed_at":"2026-08-07T05:20:32.375413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:35.513094Z","title":"ADDP : Learning general representations for image recognition and generation with alternating denoising diffusion process","venue":null,"work_id":"d866fe64-5041-4369-827a-3f26c661466d","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.457393Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:4faa54be72c7acdbf8f2f91881b871e8a9cec67906b162b4eab309a4576031a3","observation_id":"68aaf7aa-668e-422e-b535-5eccf2854af2","resolution":{"observed_at":"2026-08-07T05:20:35.622605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:32.607625Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.607625Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:2ef286b1ad9a8860bd14b958dba609884264258900b43398bf5c3771e7d65db4","observation_id":"4a21e32e-e6b8-459a-a42f-484b364885d9","resolution":{"observed_at":"2026-08-07T05:20:32.607625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:35.251731Z","title":"Visual lexicon: Rich image features in language space","venue":null,"work_id":"0d7f408a-232b-475d-b4bc-938e66e218b8","year":2025},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.712870Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:dd5bece834870f1d41e940032d22ea0a385fd5269f7132f0946891bb5c9558f2","observation_id":"d9743a2c-40f9-4fa4-a29b-86f0ab179a18","resolution":{"observed_at":"2026-08-07T05:20:35.373678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-07T05:20:32.840889Z","title":"J., Wang, W., Lin, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.840889Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:11df53c4a796d1e5d6c6b9966844acdc0cb6e65a2ecf3d00209c6a1f45059b46","observation_id":"976a7ef7-fa83-4657-bb4d-d884df9f23f7","resolution":{"observed_at":"2026-08-07T05:20:32.840889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:34.989293Z","title":"Y., Zhang, H., Pang, R., Qin, J., Ku, A., Xu, Y., Baldridge, J., and Wu, Y","venue":null,"work_id":"a16a8189-efbe-416b-b694-6c585fbae8a4","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.927957Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:e07940a5da67861407c750468206527e00f52285e98cb540b5570034c13583ec","observation_id":"5d49759b-8e7c-4a91-be9c-294f50428eb3","resolution":{"observed_at":"2026-08-07T05:20:35.092014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:34.724838Z","title":"B., Versari, L., Sohn, K., Minnen, D., Cheng, Y., Birodkar, V., Gupta, A., Gu, X., Hauptmann, A","venue":null,"work_id":"e8207d68-baea-4c8e-91e5-51b35ebcd509","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:32.983924Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:d5dfc646c9d6d8b0992a83dbe8682666147039cd25c57ae61264036bbb8227e0","observation_id":"093d3f2c-7256-4cac-a003-9f1b702dfc56","resolution":{"observed_at":"2026-08-07T05:20:34.857050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:34.433170Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":"e1fd527f-663e-4120-9aa0-fc9fa4901dcd","year":2024},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.089984Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:ad6e1057d4894882501a4750b2be341078f35208fddcdb01e77f723aab990b09","observation_id":"840a6b0f-6826-4586-b612-c6faef8f5df4","resolution":{"observed_at":"2026-08-07T05:20:34.587102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:34.250912Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"6c895427-631c-45d0-979c-2c096fb509e1","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.248030Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:b4975c144858b82b56b78d07a266bf02b613d6c5d2eb756c31f5ce284e330db1","observation_id":"bde1ae00-09c5-48bd-977e-419dcb7c348a","resolution":{"observed_at":"2026-08-07T05:20:34.329879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:33.361815Z","title":"A., Shechtman, E., and Wang, O","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.361815Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:f8e8fc525b1ee621e4c7bc3a12e693b9405b9f47a0065fe888cc6f5f03ff5fe6","observation_id":"2cb8bb48-33f3-42d0-87d7-1adfb5265624","resolution":{"observed_at":"2026-08-07T05:20:33.361815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:33.979742Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model","venue":null,"work_id":"d08bfffc-f772-445d-a0aa-694fc04153cb","year":2025},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.438712Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:9348cd35bcbbb469db0e6af6543a9c22ad38e475b42d9a30ebae53c263cc2029","observation_id":"dcffc91c-2b2c-4a81-bab5-eaa0bfe7855f","resolution":{"observed_at":"2026-08-07T05:20:34.079846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:33.744730Z","title":"Shifted diffusion for text-to-image generation","venue":null,"work_id":"0bd27b7d-7ac4-4983-b05a-c84a3c22f764","year":2023},"citing_paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:33.559040Z"},"links":{"citing_paper":"/paper/2506.08257"},"observation_digest":"sha256:cb5ab9edfccdf8f9e6e868a35bac572793feebbed3399ad7ff02b573a0d3301c","observation_id":"26cf7926-9be0-4252-b2a1-0c3061d7342b","resolution":{"observed_at":"2026-08-07T05:20:33.818240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.08257","last_updated":"2025-06-09T21:45:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T06:09:37.195533Z","submitted_at":"2025-06-09T21:45:03Z","title":"Highly Compressed Tokenizer Can Generate Without Training"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 4 inbound Pith citation observations for arXiv:2506.08257."}