{"as_of":"2026-08-06T11:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe01726c50792eedd3f91cfd254b26787aa47484096bd70e5cadc7de5b5bd597","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:12:48.666757Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T09:39:33.755572Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T05:27:39.704413Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"cited_work":{"arxiv_id":"2509.10140","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10140","snapshot_observed_at":"2026-07-03T05:27:39.704413Z","title":"Prafulla Dhariwal, Heewoo Jun, Christine Payne, Jong Wook Kim, Alec Radford, and Ilya Sutskever","venue":null,"work_id":"6f51a596-fbb9-4830-bb5b-5325038a428b","year":2005},"citing_paper":{"arxiv_id":"2606.11363","last_updated":"2026-06-09T18:43:29Z","snapshot_observed_at":"2026-08-06T10:47:54.873857Z","submitted_at":"2026-06-09T18:43:29Z","title":"NSVQ: Mitigating Codebook Collapse by Stabilizing Encoder Drift in Vector Quantization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T13:18:47.472178Z"},"links":{"cited_paper":"/paper/2509.10140","citing_paper":"/paper/2606.11363"},"observation_digest":"sha256:727b7aa3c8e1bf760e1f7e836033076cb3cc269b3648bec12666c7c2b3e5de33","observation_id":"fab95155-c004-4647-8004-a03e0967c8d0","resolution":{"observed_at":"2026-07-03T05:27:39.705956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"cited_work":{"arxiv_id":"2509.10140","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10140","snapshot_observed_at":"2026-07-03T05:27:39.704413Z","title":"Prafulla Dhariwal, Heewoo Jun, Christine Payne, Jong Wook Kim, Alec Radford, and Ilya Sutskever","venue":null,"work_id":"6f51a596-fbb9-4830-bb5b-5325038a428b","year":2005},"citing_paper":{"arxiv_id":"2606.29814","last_updated":"2026-07-15T22:31:14Z","snapshot_observed_at":"2026-08-02T09:39:29.759731Z","submitted_at":"2026-06-29T05:48:41Z","title":"Nemotron-Labs-Diffusion-Image: Advancing Masked Discrete Diffusion for High-Resolution Image Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T06:07:55.600338Z"},"links":{"cited_paper":"/paper/2509.10140","citing_paper":"/paper/2606.29814"},"observation_digest":"sha256:f97cdbb2140522786edef96afaf9c3a3fbd7fe26c95848a603089d81eb4a1d0f","observation_id":"7c266761-1fdc-409d-8a94-9c3906cc0e2c","resolution":{"observed_at":"2026-06-30T08:14:26.687079Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10140","snapshot_observed_at":"2026-08-02T09:39:33.755572Z","title":"Scalable training for vector-quantized networks with 100% codebook utilization.arXiv preprint arXiv:2509.10140, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29814","last_updated":"2026-07-15T22:31:14Z","snapshot_observed_at":"2026-08-02T09:39:29.759731Z","submitted_at":"2026-06-29T05:48:41Z","title":"Nemotron-Labs-Diffusion-Image: Advancing Masked Discrete Diffusion for High-Resolution Image Synthesis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:33.755572Z"},"links":{"cited_paper":"/paper/2509.10140","citing_paper":"/paper/2606.29814"},"observation_digest":"sha256:d686b983129021b21dda0ddbeeb08b23ac3b8683b6ba4367e268950d7a116a31","observation_id":"91aa0228-a3ca-4eb1-bc04-95ba5b51e8b6","resolution":{"observed_at":"2026-08-02T09:39:33.755572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.10140/citation-record","integrity":"/paper/2509.10140/integrity","json":"/paper/2509.10140/citation-record.json","paper":"/paper/2509.10140"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:44.455615Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:44.455615Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:f988e0e2970b0b31ee09a5f9fe6ddf3c68e6621c4515b617f97db036cba0806c","observation_id":"ed32ebae-949d-41b8-96de-4a4fde58e9bf","resolution":{"observed_at":"2026-08-04T18:12:44.455615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:44.549933Z","title":"Large-dit-imagenet","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:44.549933Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:e9c49d974a685979f94b65894b06e9424876850527e545ff59dfe52c32505aec","observation_id":"2f67d640-cc1d-4278-bd5d-963198d7fc23","resolution":{"observed_at":"2026-08-04T18:12:44.549933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-04T18:12:44.625003Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:44.625003Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:5144c9240b57a72cc7473ee32fd48266c805045782f4f25696df91941de95ca9","observation_id":"05bf05b2-3367-46a2-9331-c37f12e0ea8e","resolution":{"observed_at":"2026-08-04T18:12:44.625003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-04T18:12:44.717741Z","title":"Estimating or propagating gradients through stochastic neurons for conditional computation","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:44.717741Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:7dfe9a4f87c646497620c80bebcf2724d5b76cf6cd8d1dc95f347f21aa8fc21f","observation_id":"677a2059-029f-463f-a91a-efd53ef894ea","resolution":{"observed_at":"2026-08-04T18:12:44.717741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-04T18:12:44.810505Z","title":"Large scale gan training for high fidelity natural image synthesis","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:44.810505Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:c05978ac3b0386dd1cb0c8ae35faa67ec33c7e411168785325ea8d4beb62db78","observation_id":"3c0ec79f-fd75-4c61-a6e5-5c069766c453","resolution":{"observed_at":"2026-08-04T18:12:44.810505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:44.889358Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:44.889358Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:49e6392772f33f71bdc490c790aa9316999b4588bd4a2077b3579b356841c40e","observation_id":"c62f0724-8fc5-49eb-8fb4-262218c28c2f","resolution":{"observed_at":"2026-08-04T18:12:44.889358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:44.989793Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:44.989793Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:703ffde787eea2dbeaf63160cb86e0d3101139ba0d8ccf9998b757e27ec55740","observation_id":"b61311a5-53c9-46dd-a42c-f7d93de3b223","resolution":{"observed_at":"2026-08-04T18:12:44.989793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.050577Z","title":"Generative pretraining from pixels","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.050577Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:bc2a6b0ecb4b70221b97e6e86caaed2fc19ff84a78ae4ea3189b3a091fb864a4","observation_id":"5ba00256-c63d-4724-8936-6b986b4e7f54","resolution":{"observed_at":"2026-08-04T18:12:45.050577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.123223Z","title":"Image N et: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.123223Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:985ce8af57d5ad35426ac86a1ffc4b0eeebc09a7ce761f62281dd81298115619","observation_id":"2bcbc62a-7e29-48a3-aae3-3fad01fee5ca","resolution":{"observed_at":"2026-08-04T18:12:45.123223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-04T18:12:45.198607Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.198607Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:ff092ab08c004cd80f732e0a32753a0d4ce542d8c3075429bc6ed005d01e5c16","observation_id":"453fd2f5-6048-48f0-b1e3-2586b93e8411","resolution":{"observed_at":"2026-08-04T18:12:45.198607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.263732Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.263732Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:ba7ffabbd14bf9150b4f4e6faa2d25ceb6bd491b5ecbd8e2eadf444a1b90aea0","observation_id":"407e10c1-68bf-49e3-96ef-693007ceda19","resolution":{"observed_at":"2026-08-04T18:12:45.263732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.335486Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.335486Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:65247112ecc4af02dfab9c52a99c3c7aa13dbe2496157cba6a01a601c47b60a5","observation_id":"ffc0ae6b-53e7-41b9-b777-c28e31aea145","resolution":{"observed_at":"2026-08-04T18:12:45.335486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.382165Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.382165Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:f9616d5b20ea00db8b7b4de3660ac77737c328e46ec78427bc4d5992b38e064c","observation_id":"4e27dcc3-8f38-44c9-bb76-c7d668eec08c","resolution":{"observed_at":"2026-08-04T18:12:45.382165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T18:12:45.470785Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.470785Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:bd09eac30fcb57123092c58147a711b34208db2d5e49eebceb8b28be4f4df449","observation_id":"26f0ca7c-45e5-4344-8ae2-0e73958eb24a","resolution":{"observed_at":"2026-08-04T18:12:45.470785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.561435Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.561435Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:034f30c47634aad2b0c51b82474c6e90e343e94ebc285af7c516b9ee458fcb13","observation_id":"7f3a140c-dd9a-4f8f-8a2d-5a2af208e6c6","resolution":{"observed_at":"2026-08-04T18:12:45.561435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.659172Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.659172Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:e0120806dcac30002f2c7fd15cde11ac1303ab519b509f08fbceb0e0c194caa7","observation_id":"86a6802d-e4c8-4228-883f-e46364dd7da0","resolution":{"observed_at":"2026-08-04T18:12:45.659172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.751846Z","title":"Straightening out the straight-through estimator: Overcoming optimization challenges in vector quantized networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.751846Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:8b7f841ed6e5b437534c5c36564886025c430bfbb4a62e61c0380491a37688ac","observation_id":"7cfeb22c-d003-480a-b986-ebe89c637fb3","resolution":{"observed_at":"2026-08-04T18:12:45.751846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.810190Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.810190Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:eb755178a11c3838d1b361881efb7a7cd1e84747936340425b9cae33fc5ee602","observation_id":"fce15510-2ac7-4d24-84d5-83fbf74c88dd","resolution":{"observed_at":"2026-08-04T18:12:45.810190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:45.860281Z","title":"Scaling up gans for text-to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.860281Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:2946232c2201f9509d973181972da3c0b5a0d52ae7bf80bd6834484372627b07","observation_id":"8e6af703-fd1f-43a2-95e6-6fb4ff1d15f6","resolution":{"observed_at":"2026-08-04T18:12:45.860281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-04T18:12:45.923377Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.923377Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:1c17256e3ade11cbae576bb243c0766bd1dcce1f068756f63ca1139895b85115","observation_id":"89d1cdd7-5c99-490f-9a07-6938d7ccee65","resolution":{"observed_at":"2026-08-04T18:12:45.923377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-04T18:12:45.997737Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:45.997737Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:f8b0664ff6b0caf91b48c38aa205e58bb7dec3cbe678fcbf2091b61e2597c62e","observation_id":"be6717f7-c37b-4396-ad3e-ccfc206a61ec","resolution":{"observed_at":"2026-08-04T18:12:45.997737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:46.060491Z","title":"The open images dataset v4: Unified image classification, object detection, and visual relationship detection at scale","venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.060491Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:52ab5b51a117371b7302545606254b09c58e2835291cdeaa0e6d53c0b625beec","observation_id":"0682fba3-6a86-4519-87bc-e44b1bc805b6","resolution":{"observed_at":"2026-08-04T18:12:46.060491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:46.110344Z","title":"Laion-coco 600m","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.110344Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:5b222da7590bcd02c283058a55abe2803fbf46dc8662d32de2cbcd557c11f619","observation_id":"ab52ab92-ebd7-4180-8e7c-7f4fdc56879b","resolution":{"observed_at":"2026-08-04T18:12:46.110344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:46.161970Z","title":"Robust training of vector quantized bottleneck models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.161970Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:3565a2a07eda429674ce75974dc4250a4d521113050c75578e3664b1051cc395","observation_id":"7af1878d-7f8b-4266-9e2e-128f9716ea1c","resolution":{"observed_at":"2026-08-04T18:12:46.161970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:46.238435Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.238435Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:57ef06c1607ff5dea6105cd5018d3afd288d584ecd92a8d8383c8af038f8129a","observation_id":"fda13932-b51f-45b8-9c0f-b35896ab5190","resolution":{"observed_at":"2026-08-04T18:12:46.238435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:46.313796Z","title":"Return of unconditional generation: A self-supervised representation generation method","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.313796Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:b513a4b6a249908b676fb3127ab0721619e0c1708cb3baa30fccc149e3ee6b41","observation_id":"0882d2e5-5fb7-4928-8e63-a45a1d1aaa23","resolution":{"observed_at":"2026-08-04T18:12:46.313796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-04T18:12:46.413499Z","title":"Autoregressive image generation without vector quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.413499Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:db6c7c8a2798e1fddd2d479d1b5669cb76ee05cd50ae5f5a7bfc74b0aa6791f1","observation_id":"446f4224-f419-4f9c-8afb-694c7fff1172","resolution":{"observed_at":"2026-08-04T18:12:46.413499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-04T18:12:46.496749Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.496749Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:d22d37f9ff51ec11bc6a553b7ad35b67977657c8d706890d9e3c0ae77935466a","observation_id":"d5e50374-a2b9-449f-87d5-ed9edc794b65","resolution":{"observed_at":"2026-08-04T18:12:46.496749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04410","last_updated":"2025-02-09T08:59:19Z","snapshot_observed_at":"2026-08-06T03:43:29.067278Z","submitted_at":"2024-09-06T17:14:53Z","title":"Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04410","snapshot_observed_at":"2026-08-04T18:12:46.580994Z","title":"Open-magvit2: An open-source project toward democratizing auto-regressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.580994Z"},"links":{"cited_paper":"/paper/2409.04410","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:eace168b59dff729aab0d5871e87d229e99946b795a241b47d2182bcaa1ab723","observation_id":"c4f05df4-2edf-460d-a1ef-5bd97dc6147c","resolution":{"observed_at":"2026-08-04T18:12:46.580994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:46.684451Z","title":"Unitok: A unified tokenizer for visual generation and understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.684451Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:9b69c8cd4bf64d2e6e00d04fd65519af879650388914f5068dda8d61b140f981","observation_id":"6b1eb43a-6fe1-494c-bde8-b554f9d75662","resolution":{"observed_at":"2026-08-04T18:12:46.684451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15505","last_updated":"2023-10-12T07:55:05Z","snapshot_observed_at":"2026-07-06T16:24:17.829828Z","submitted_at":"2023-09-27T09:13:40Z","title":"Finite Scalar Quantization: VQ-VAE Made Simple","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15505","snapshot_observed_at":"2026-08-04T18:12:46.771609Z","title":"Finite scalar quantization: Vq-vae made simple","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.771609Z"},"links":{"cited_paper":"/paper/2309.15505","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:d0f87e41e0f87da8287ce0cebee831e2c39e36df465c7b21c588c665f9254f10","observation_id":"8528b6f5-21f6-4aa4-8087-3840642fe6f1","resolution":{"observed_at":"2026-08-04T18:12:46.771609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-04T04:01:49.750596Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-04T18:12:46.841576Z","title":"Randar: Decoder-only autoregressive visual generation in random orders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.841576Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:ff686db97ff57a8009634edfeb848a66d81bb453e951240740ddacaaf0a7e23f","observation_id":"5da56636-ee7b-4ba6-bb5d-87f26279110c","resolution":{"observed_at":"2026-08-04T18:12:46.841576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:46.922273Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.922273Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:0bdb58285bf7e4b2346231d06c0d8ecd8bad29799738dd194c13933e85fdffab","observation_id":"6ab251cf-4b09-455d-a0f6-4d5ea18bd7ac","resolution":{"observed_at":"2026-08-04T18:12:46.922273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:46.980867Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.980867Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:62e63eea36fdad88307f0832d3f4d5a3302f0ff24634f4ba66b95f2cdbf914fa","observation_id":"26e04914-b8fb-4a0f-9f15-669184b67ead","resolution":{"observed_at":"2026-08-04T18:12:46.980867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.061086Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.061086Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:4302f614fc45398630c97d232ded3fa1f20cd4b0c86f97d035580ff451c065ba","observation_id":"e160463f-953f-44da-ac50-eba76c7f0139","resolution":{"observed_at":"2026-08-04T18:12:47.061086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.141933Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.141933Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:516d7f23dcc847723cedb51baad37cca50d4a0fcfe3b693921370e669ad0a42e","observation_id":"449e2d80-d8cc-4972-ac8d-b13651eda255","resolution":{"observed_at":"2026-08-04T18:12:47.141933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.205491Z","title":"Generating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.205491Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:5439de70bfb600615792dc52824c5626756a1b15a7f7524b556f53b375be8e8d","observation_id":"0974a938-b5ef-4773-8b38-8ba879f1bd5d","resolution":{"observed_at":"2026-08-04T18:12:47.205491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.246970Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.246970Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:7af8dda21030bb0e373ba00bccd8bfcc02f6d870a961f0006c4ebe8419bc3984","observation_id":"df4d16d9-d29d-4875-b3a7-2a56a8aa15dd","resolution":{"observed_at":"2026-08-04T18:12:47.246970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.329693Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.329693Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:52e5c9cf70f30cb3aabaed1bfc0ac3a98d8073d2374d4b200bab8f64e85d9be7","observation_id":"9eb1b2cf-0d10-4a7f-b5f8-d3878639a886","resolution":{"observed_at":"2026-08-04T18:12:47.329693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.389768Z","title":"Stylegan-xl: Scaling stylegan to large diverse datasets","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.389768Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:43eb05bdc8b4ab2e5bcb3eca7f120f559fd9ce7ea5fec57d4a18b098ea209f01","observation_id":"a80b09fb-9c25-4eb7-8583-5ede8ae57cdf","resolution":{"observed_at":"2026-08-04T18:12:47.389768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-07-06T20:01:05.921085Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-04T18:12:47.447503Z","title":"Taming scalable visual tokenizer for autoregressive image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.447503Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:d28f3dcf35632087f40db88f237cad9927d3c35674e85819dfab15915743c543","observation_id":"84c704ae-008d-48e2-9e95-1752a04f3115","resolution":{"observed_at":"2026-08-04T18:12:47.447503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-04T18:12:47.506172Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.506172Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:7c604b681686d18595a40b7d00a922d5a163cf99ac1def358c28c0f8559c0d11","observation_id":"113d149d-b37f-4560-849c-6258a66f0ce6","resolution":{"observed_at":"2026-08-04T18:12:47.506172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-04T18:12:47.561520Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.561520Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:5eae6b11b0539f23650c6a4d46c92c5cbe19291972b9c59a5359a9ff87a70ec7","observation_id":"8d511910-4ad0-401d-8630-a4616be7a80e","resolution":{"observed_at":"2026-08-04T18:12:47.561520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02905","last_updated":"2024-06-10T17:59:07Z","snapshot_observed_at":"2026-07-06T17:55:16.774337Z","submitted_at":"2024-04-03T17:59:53Z","title":"Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02905","snapshot_observed_at":"2026-08-04T18:12:47.607231Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.607231Z"},"links":{"cited_paper":"/paper/2404.02905","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:f5629e9822fd9462ca2b15f08eead9841a6deb19d37221c41822103d9ea2c6c3","observation_id":"e72b48e1-f76a-42fb-86b3-dcad5db7bf7e","resolution":{"observed_at":"2026-08-04T18:12:47.607231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T18:12:47.682959Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.682959Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:875af04d1a4cdfbb5990447449ef169ff775a33b63b9540e5e7952c44eb73940","observation_id":"da219bac-86b1-44e2-935c-4ed412fce074","resolution":{"observed_at":"2026-08-04T18:12:47.682959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.737180Z","title":"Conditional image generation with pixelcnn decoders","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.737180Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:4cbfa24dd6fc57a739409af52804eb21828f84de3da44e884aab2445a74c1609","observation_id":"36edb0f2-756a-42d4-9789-a8e4a60d1746","resolution":{"observed_at":"2026-08-04T18:12:47.737180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.817518Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.817518Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:e922edce4a2d88655b8ac084b128a8790600a0a365db20ca9006852594211185","observation_id":"951b700a-5d79-4cf3-b4da-e752e5bb74a7","resolution":{"observed_at":"2026-08-04T18:12:47.817518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.874511Z","title":"Vector-quantized image modeling with improved VQGAN","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.874511Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:f00dc64ce310e11c607bf0ec79dc8bdb5e1e9916dd295f7928c954d4e1c514b0","observation_id":"a1f8e1f8-d226-4067-961c-e547f0999382","resolution":{"observed_at":"2026-08-04T18:12:47.874511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:47.928190Z","title":"Language model beats diffusion - tokenizer is key to visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.928190Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:7dc2ecc58820f156f7c3e0e13d593b731e8bcacabde3ade1f2340eb0a611e460","observation_id":"fea1c7ea-94a2-4540-8952-86e24a8280d6","resolution":{"observed_at":"2026-08-04T18:12:47.928190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07550","last_updated":"2024-06-11T17:59:56Z","snapshot_observed_at":"2026-07-06T18:29:08.586253Z","submitted_at":"2024-06-11T17:59:56Z","title":"An Image is Worth 32 Tokens for Reconstruction and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07550","snapshot_observed_at":"2026-08-04T18:12:48.006661Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.006661Z"},"links":{"cited_paper":"/paper/2406.07550","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:3132a661cfe44a652553713c0c80aeb225cc5390b511f3724ff087f46aca4dc5","observation_id":"282f7c6d-80b6-4c6c-9a70-54a0225dd3b0","resolution":{"observed_at":"2026-08-04T18:12:48.006661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:48.113131Z","title":"Regularized vector quantization for tokenized image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.113131Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:15e28036f036d5b4ad32699cb124c1bcb18caab70f0a480e8c7a4d2d8e84914f","observation_id":"ec51c12b-16d3-47ba-9873-85d1bd719e54","resolution":{"observed_at":"2026-08-04T18:12:48.113131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:48.194344Z","title":"Efros, Eli Shechtman, and Oliver Wang","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.194344Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:f9abe156078d524b93a2fad9e04fc0bbfd2e1907deeb88af5d8836a2d0568834","observation_id":"bb25314f-a770-42c3-8034-5ddc1c4dc9ca","resolution":{"observed_at":"2026-08-04T18:12:48.194344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:48.253777Z","title":"Online clustered codebook","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.253777Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:a4cfe75a5d0df51ae2ce5bc8a742d3b91dc811c0d9bd157ab22ffe56ee3c217a","observation_id":"e4e1c048-9b41-4475-8f96-32fb882334f5","resolution":{"observed_at":"2026-08-04T18:12:48.253777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:48.306046Z","title":"Movq: Modulating quantized vectors for high-fidelity image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.306046Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:afee3c429497c46480bdec9531fcbb3f8fd90ea0d035884751afbe9b7c901a73","observation_id":"7fa93c49-144d-4b09-abb0-e4ccd874215f","resolution":{"observed_at":"2026-08-04T18:12:48.306046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11837","last_updated":"2024-06-17T17:59:57Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:57Z","title":"Scaling the Codebook Size of VQGAN to 100,000 with a Utilization Rate of 99%","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11837","snapshot_observed_at":"2026-08-04T18:12:48.383882Z","title":"Scaling the codebook size of vqgan to 100,000 with a utilization rate of 99\\ arXiv preprint arXiv:2406.11837, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.383882Z"},"links":{"cited_paper":"/paper/2406.11837","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:37fdc451f4a2e1b131c0fac064e5102f56fcb6a1d16fc5b50e44fa7f41f65f28","observation_id":"8c1944f5-a9c2-48ea-8d90-fe0410a0f41e","resolution":{"observed_at":"2026-08-04T18:12:48.383882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:48.460590Z","title":"Addressing representation collapse in vector quantized models with one linear layer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.460590Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:c0d9357b1c993b5119e16d2caec952ce28bc094246b83ebddec100714d78c6c7","observation_id":"ea97fe0f-f14c-4845-ab10-4396f119cf33","resolution":{"observed_at":"2026-08-04T18:12:48.460590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:48.538179Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.538179Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:186106afb64886aa89e5b09b4afbac904fd98208438d268891b1e4c25a8d4445","observation_id":"bb459904-ffb9-4ac1-ba4e-416ae4623a31","resolution":{"observed_at":"2026-08-04T18:12:48.538179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:48.589313Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.589313Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:ad1968f790f0b0a5e46b621fb9f9573c8741ce49894cae9e55a5c45fc6f88817","observation_id":"0ddec6ed-7caa-469d-aade-769c7adea287","resolution":{"observed_at":"2026-08-04T18:12:48.589313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:12:48.666757Z","title":"Left: Performance comparison showing generation (FID) and reconstruction (rFID) quality across different methods","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:48.666757Z"},"links":{"citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:7a8f4e45ea745839fe20305b96db0e4f75cbb8aa87ffe48b1a57a53c0c2adc6f","observation_id":"5aba5afd-1bff-4c84-9716-e0cb5aa3753c","resolution":{"observed_at":"2026-08-04T18:12:48.666757Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T18:12:33.616510Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 3 inbound Pith citation observations for arXiv:2509.10140."}