{"as_of":"2026-08-12T11:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5746732b2246c2be5742bab75c12894c6f1c46fc0cda573a6240679573766df1","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:15:46.631242Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:37:42.137388Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T01:12:13.502929Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-11T11:37:42.137388Z","title":"Taming scalable visual tok- enizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15321","last_updated":"2025-03-19T06:16:54Z","snapshot_observed_at":"2026-08-11T15:20:00.371059Z","submitted_at":"2024-12-19T18:59:36Z","title":"Next Patch Prediction for Autoregressive Visual Generation","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T11:37:42.137388Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2412.15321"},"observation_digest":"sha256:480006c4088abfdf2e24a17571451ae97dc3774fc324cf77cd03d86efa13eaaf","observation_id":"e81aac83-706a-4d85-957a-9aaccec93474","resolution":{"observed_at":"2026-08-11T11:37:42.137388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-10T14:00:26.800718Z","title":"arXiv preprint arXiv:2412.02692 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15798","last_updated":"2025-01-27T05:49:06Z","snapshot_observed_at":"2026-08-11T19:06:26.778704Z","submitted_at":"2025-01-27T05:49:06Z","title":"MM-Retinal V2: Transfer an Elite Knowledge Spark into Fundus Vision-Language Pretraining","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:00:26.800718Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2501.15798"},"observation_digest":"sha256:c7c9802b162ac6e27a34cc5f0bd8394cdb5c35133f18de4181a35d2ddf59eb0f","observation_id":"b3a0c147-47a2-45ca-bd7e-dbceeb853e86","resolution":{"observed_at":"2026-08-10T14:00:26.800718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T23:01:49.760298Z","title":"Taming scalable visual tokenizer for autoregressive image generation.arXiv preprint arXiv:2412.02692, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20214","last_updated":"2025-07-08T07:46:39Z","snapshot_observed_at":"2026-08-09T16:18:48.711928Z","submitted_at":"2025-06-25T07:57:09Z","title":"UniCode$^2$: Cascaded Large-scale Codebooks for Unified Multimodal Understanding and Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:01:49.760298Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2506.20214"},"observation_digest":"sha256:9d05896d503c102296cee1a191abb8b304f808773fc00bfa68c70dc017d802cf","observation_id":"c99e1186-de25-478d-9674-808f355f0b44","resolution":{"observed_at":"2026-08-06T23:01:49.760298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T21:07:24.825964Z","title":"Taming scalable visual tok- enizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01016","last_updated":"2025-07-01T17:59:44Z","snapshot_observed_at":"2026-08-09T23:56:27.855428Z","submitted_at":"2025-07-01T17:59:44Z","title":"VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:24.825964Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2507.01016"},"observation_digest":"sha256:2f396a59af890524189b76035e5e183710c24c4ff38a994b998954fca890359f","observation_id":"3a536382-8929-4bb4-a7a0-e36e558a26ef","resolution":{"observed_at":"2026-08-06T21:07:24.825964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T20:49:41.987348Z","title":"Taming scalable visual tok- enizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.987348Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:35082b561e52c546a48d28a8cbcb205057f28c727192efa07ce9d501d72cbbbf","observation_id":"7d998c79-5c41-4e98-a1c7-c77f1abbcc66","resolution":{"observed_at":"2026-08-06T20:49:41.987348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T05:45:11.216892Z","title":"arXiv:2412.02692","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02739","last_updated":"2025-08-02T13:15:59Z","snapshot_observed_at":"2026-08-11T12:39:24.608609Z","submitted_at":"2025-08-02T13:15:59Z","title":"Kronos: A Foundation Model for the Language of Financial Markets","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T05:45:11.216892Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2508.02739"},"observation_digest":"sha256:41f7ac8aa15e938bfe6918e589ae1532690103f3055a50382f4d6aa35cefad68","observation_id":"0fc17554-4fcc-4426-a7db-ce63894ee92f","resolution":{"observed_at":"2026-08-06T05:45:11.216892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-05T20:49:51.769898Z","title":"Taming scalable visual tokenizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09858","last_updated":"2025-08-13T14:50:19Z","snapshot_observed_at":"2026-08-10T07:55:10.749018Z","submitted_at":"2025-08-13T14:50:19Z","title":"HumanGenesis: Agent-Based Geometric and Generative Modeling for Synthetic Human Dynamics","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T20:49:51.769898Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2508.09858"},"observation_digest":"sha256:ff4bdf7830c89249445255954441c00d60662f24a15cd90a0456781249d149df","observation_id":"323e0566-9621-438f-8860-1313bcde4de7","resolution":{"observed_at":"2026-08-05T20:49:51.769898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-04T18:12:47.447503Z","title":"Taming scalable visual tokenizer for autoregressive image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-10T20:39:08.643314Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.447503Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:4f87cb9292b8600e8eadb254ba4f7c35ca9b1b768e1df69b1c905aec001a5e89","observation_id":"84c704ae-008d-48e2-9e95-1752a04f3115","resolution":{"observed_at":"2026-08-04T18:12:47.447503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":"2412.02692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable image tokenization with index backpropagation quantization","venue":null,"work_id":"b3f063c5-ab7b-406a-b2cb-5c4a550bde24","year":2024},"citing_paper":{"arxiv_id":"2510.26583","last_updated":"2025-10-30T15:11:16Z","snapshot_observed_at":"2026-08-11T01:57:48.271968Z","submitted_at":"2025-10-30T15:11:16Z","title":"Emu3.5: Native Multimodal Models are World Learners","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-18T01:12:13.426640Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2510.26583"},"observation_digest":"sha256:f92e7098e968cfa9d090b152821df2a65869dce87f9ed85da8fe4ea548bfbf81","observation_id":"ae32dae3-3d6b-46d0-a3d7-3906182ad645","resolution":{"observed_at":"2026-05-18T01:12:13.504973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-01T05:45:49.675083Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization.arXiv preprint arXiv:2412.02692, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22148","last_updated":"2026-07-24T09:47:32Z","snapshot_observed_at":"2026-08-10T14:26:51.007657Z","submitted_at":"2026-07-24T09:47:32Z","title":"dRAE: Representation Autoencoder with Hyper-Spherical Codes","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T05:45:49.675083Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2607.22148"},"observation_digest":"sha256:146d11ee9504611e1da4bb7386beb5afcfb2f9d4d2ac0a65100775858b325aec","observation_id":"8acbf257-b51b-49fe-903b-fffef47608a8","resolution":{"observed_at":"2026-08-01T05:45:49.675083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.02692/citation-record","integrity":"/paper/2412.02692/integrity","json":"/paper/2412.02692/citation-record.json","paper":"/paper/2412.02692"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-11T23:15:46.081907Z","title":"Cosmos world foun- dation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.081907Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:32c630000e668d21044283dbeb4a8802560724e6783e3f3a2e2ad4bf5ce2bd4f","observation_id":"1c19259e-e996-4fd6-a9db-f334e62c254e","resolution":{"observed_at":"2026-08-11T23:15:46.081907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05453","last_updated":"2020-02-16T18:35:27Z","snapshot_observed_at":"2026-08-11T05:38:01.369830Z","submitted_at":"2019-10-12T00:55:06Z","title":"vq-wav2vec: Self-Supervised Learning of Discrete Speech Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05453","snapshot_observed_at":"2026-08-11T23:15:46.089540Z","title":"vq- wav2vec: Self-supervised learning of discrete speech repre- sentations","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.089540Z"},"links":{"cited_paper":"/paper/1910.05453","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:67f7c3ff3fd55da7f11d52d3fd5446a4cf427ac2797b59e3187e3799c3d41ca6","observation_id":"6cb689c4-cabb-413c-86e2-2fc7fd27fe21","resolution":{"observed_at":"2026-08-11T23:15:46.089540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-07-06T11:19:34.705520Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-11T23:15:46.100160Z","title":"Beit: Bert pre-training of image transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.100160Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:928a2a41865d01dd30fa391dd90ad7c3c79e22c688690bdff5acffd5da821cd9","observation_id":"2a6fa680-d9c9-4403-baec-d762a69803d4","resolution":{"observed_at":"2026-08-11T23:15:46.100160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-11T05:54:56.124984Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-11T23:15:46.108354Z","title":"10 (a) (b) (a) (b) (a) (b) Figure 9","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.108354Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:0deb457cbef75991b52eab448069a2e023c6bcedf19e73b3f9d66fe2ab3c2710","observation_id":"d56bd9a5-3f38-4d48-b70a-cfc9f4e5caf1","resolution":{"observed_at":"2026-08-11T23:15:46.108354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.743741Z","title":"Audiolm: a language modeling approach to audio genera- tion","venue":null,"work_id":"656a5b39-f8b8-4270-852c-bae26f4515f3","year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.143412Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:97c6ca7efcf6eee40fb00cab2ed123c2813d303632c1835f1ddd1322c3734de0","observation_id":"21e50a14-0504-49a6-9b98-af9eb5a1c122","resolution":{"observed_at":"2026-08-11T23:15:48.760471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.704898Z","title":"Language models are 12 few-shot learners","venue":null,"work_id":"3d968906-9472-4af1-8480-6de50cd4aafc","year":1901},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.154879Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:90486d8e23e73b3cbd709113db0ce3a531e5063b0af82b873f71f9ea420b88ee","observation_id":"7893aef8-f709-485c-bdfb-0f49996ebcbc","resolution":{"observed_at":"2026-08-11T23:15:48.720562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.668158Z","title":null,"venue":null,"work_id":"f3baa1db-6122-4fba-bfae-8493226ad087","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.162145Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:d06d59b02ffef72e2285a9e47c6ba9432c6008d6c7357c6bf2c1ddcf3c76f63b","observation_id":"f19a545e-4df8-458a-aa34-84ecc1bc1fc5","resolution":{"observed_at":"2026-08-11T23:15:48.679688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.630718Z","title":"Conceptual 12m: Pushing web-scale image-text pre- training to recognize long-tail visual concepts","venue":null,"work_id":"cf81dab9-0232-4d46-b69b-4577c55c7ecb","year":2021},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.178641Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:9ec3bc2e01d9a7782f0167d169b72bf7924942570c267cf12b8f411e4afa401c","observation_id":"eed4fa51-4f08-4b8c-a08b-8e02db6f6f63","resolution":{"observed_at":"2026-08-11T23:15:48.637141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.608470Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":"f2d38d69-6dd6-4b65-891d-ec3fa2a56e3c","year":2009},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.184202Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:cb9cefeb3e6cdf2bcda42025506a8bb987a4b181a7bc422a8f6dd99529c15a5c","observation_id":"c8dbe700-c005-4fe3-8d3b-4a4a3a10eed1","resolution":{"observed_at":"2026-08-11T23:15:48.614459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:46.188607Z","title":"Diffusion mod- els beat gans on image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.188607Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:b2ecca37851d0227aa6a3772673767e2426b38c0cbd9860c53d2aa65bb73951e","observation_id":"5aed4109-b1b2-40ed-9bc4-d7a81edcd04d","resolution":{"observed_at":"2026-08-11T23:15:46.188607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.532197Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"16cd01a4-f050-47b2-bdba-a75d44ec9080","year":2021},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.194982Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:9f3830feb276272eb469ae5544ef76c575ec1e5f5e6d6001993b1dc55bc46cef","observation_id":"cd048b85-1d90-4584-928d-cf4afe6e2bfb","resolution":{"observed_at":"2026-08-11T23:15:48.545028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-11T21:21:39.369697Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-11T23:15:46.208605Z","title":"Infinity: Scaling bit- wise autoregressive modeling for high-resolution image syn- thesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.208605Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:a65860167309226381afd5710b1f8f176bc2dbf5281dec92a8ab17b297d5fdc5","observation_id":"b5156830-aacf-4bbb-8c53-0de0c8326482","resolution":{"observed_at":"2026-08-11T23:15:46.208605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.499631Z","title":"GANs trained by a two time-scale update rule converge to a local nash equi- librium","venue":null,"work_id":"97218cd2-21e6-483a-a2cc-18c9aaa7a9f4","year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.217531Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:63428419d349bbbe489a73955fa63a90ea6ddd7389fe3b783bb1834f217e9c5c","observation_id":"4f6e10cd-fc52-4db6-acf4-b6d170c8ed06","resolution":{"observed_at":"2026-08-11T23:15:48.515936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.461943Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":"267cf91e-948e-4975-9305-5fbfb91d9024","year":null},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.222209Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:ddbe9a902736ec5f27c3a941e5b38356a827ea19c7442965e51ff18bce2f24d1","observation_id":"a664c603-a593-49cf-baba-6f60d2874b22","resolution":{"observed_at":"2026-08-11T23:15:48.476615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.399610Z","title":"Towards accurate image coding: Improved au- toregressive image generation with dynamic vector quantiza- tion","venue":null,"work_id":"47d95030-9d0b-4281-9dc7-0b28568447ab","year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.228706Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:42944c9545b28dddb10a2c71ef62f1dca8cb463d138718b0ede125740cd6502f","observation_id":"4d321c40-506b-4860-9e16-e7997574809a","resolution":{"observed_at":"2026-08-11T23:15:48.415351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.360544Z","title":null,"venue":null,"work_id":"183d4baf-acb6-4f73-8817-5def1996d0cb","year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.238731Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:ff0f950ed9df1e32b4697f1ec628304c3513f52df3c1e90e4b5a3609757af464","observation_id":"678b01ed-1d31-4952-8ab3-ab3f0e75e1d8","resolution":{"observed_at":"2026-08-11T23:15:48.375947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-11T23:15:46.247755Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.247755Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:242aa30db0ba18fe3045a65fcf8b1ebc6c2444b09301e965a7fec6a5e035d11b","observation_id":"3ccde305-39b5-4d73-896a-9803ab24c329","resolution":{"observed_at":"2026-08-11T23:15:46.247755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T23:15:46.264532Z","title":"Adam: A method for stochastic opti- mization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.264532Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:f9fea8da5030128ae3f4d47f861bf8ea33ce086eca8679c3169e73a4820293c0","observation_id":"c76f3202-3e98-4347-8d4d-8d65581f43d9","resolution":{"observed_at":"2026-08-11T23:15:46.264532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.329443Z","title":"Improved precision and recall met- ric for assessing generative models","venue":null,"work_id":"e896dc8b-0211-4850-a0f1-9c02059aa470","year":2019},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.278599Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:ab058c4dc1e717cc2f46dc558d0067703160aafbaa17c83d038e7f6d4f42a015","observation_id":"3a2a60bb-4181-4083-8e49-0211625528a2","resolution":{"observed_at":"2026-08-11T23:15:48.340988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.309037Z","title":"Laion-coco 600m","venue":null,"work_id":"4b15f5e4-33bf-49a9-907b-ec9fa7f23b2e","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.307892Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:181d3606eb88074432fa292238e8ccb35dfa57566f47c8bb9ef363a360295ee4","observation_id":"f0b627d3-87c0-456c-b8d5-04be9935adb9","resolution":{"observed_at":"2026-08-11T23:15:48.314638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.282905Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":"176a102c-4bbf-45d1-bc33-c663b168e897","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.314501Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:313cdf5ff0ea86b1616e346f62100abe546eb97dc594d6fc14a84fbaf71ac2d1","observation_id":"07467f0a-ae65-4c64-92e4-cb6137de697b","resolution":{"observed_at":"2026-08-11T23:15:48.291641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.254371Z","title":"Mage: Masked generative encoder to unify representation learning and image synthe- sis","venue":null,"work_id":"d0dd0d1c-d8b0-4676-979c-c8e8f0de424d","year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.324261Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:12814ac4641af461e7dd8ff3a7e36015028fc5aa82fb4e6b221206d272d950c1","observation_id":"c9eb4038-ed65-40d0-974f-7893f58c903b","resolution":{"observed_at":"2026-08-11T23:15:48.260348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-11T23:15:46.336301Z","title":"Autoregressive image generation without vec- tor quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.336301Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:d4ce4e2f74f4b55c13599c4a100910615aa52cdbd72ce90527203edcdd9b2501","observation_id":"b8d07e5a-a12e-4aeb-963e-069d483ce525","resolution":{"observed_at":"2026-08-11T23:15:46.336301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T23:15:46.352519Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.352519Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:5562a0f2fde9a2ec7261be954702c9766e521cddc1c78768216b26b4e946eae0","observation_id":"d25316ae-3050-489c-91e1-81c1907e1d53","resolution":{"observed_at":"2026-08-11T23:15:46.352519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04410","last_updated":"2025-02-09T08:59:19Z","snapshot_observed_at":"2026-08-06T03:43:29.067278Z","submitted_at":"2024-09-06T17:14:53Z","title":"Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04410","snapshot_observed_at":"2026-08-11T23:15:46.358367Z","title":"Open-magvit2: An open-source project toward democratizing auto-regressive visual gener- ation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.358367Z"},"links":{"cited_paper":"/paper/2409.04410","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:dcc1aeedf9f24a38e9d12a8a56f73bd3ed7e81130eff03578b6aefe406d92a45","observation_id":"c2d735d8-4fb1-4c58-bd9c-c8d5abe60ea5","resolution":{"observed_at":"2026-08-11T23:15:46.358367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T23:15:46.373663Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.373663Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:c4ff4cbd3fdcf8b32dfb3b3f41a339b47f30c26d9d772aba4d20514c5b8b90ca","observation_id":"3f051b61-9bbe-44b8-bd0d-2f2be3097991","resolution":{"observed_at":"2026-08-11T23:15:46.373663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00716","last_updated":"2023-10-28T11:46:07Z","snapshot_observed_at":"2026-08-11T09:09:26.919598Z","submitted_at":"2023-07-03T02:39:08Z","title":"JourneyDB: A Benchmark for Generative Image Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00716","snapshot_observed_at":"2026-08-11T23:15:46.385279Z","title":"Journeydb: A benchmark for generative im- age understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.385279Z"},"links":{"cited_paper":"/paper/2307.00716","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:3d8835255a13f032b3daa8f75871fb98b5f5a80e7c66b7e6c9064ef854eb876c","observation_id":"f050d890-6a36-4aab-afcc-1961181d30c7","resolution":{"observed_at":"2026-08-11T23:15:46.385279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.223526Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"5456cd37-fea7-449e-b9a7-034e5db0c39a","year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.402930Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:7a075adbdcc63feb9c6b743917148ef909a7e9504470d0d77f54caa5a5c28043","observation_id":"deef5838-042f-4b7f-a04e-6dba772fbdf3","resolution":{"observed_at":"2026-08-11T23:15:48.232003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03069","last_updated":"2025-08-07T09:08:33Z","snapshot_observed_at":"2026-08-11T22:45:59.824084Z","submitted_at":"2024-12-04T06:46:55Z","title":"TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03069","snapshot_observed_at":"2026-08-11T23:15:46.411334Z","title":"Tokenflow: Unified image tokenizer for multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.411334Z"},"links":{"cited_paper":"/paper/2412.03069","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:6f749be1b624251d7f3e2537cd735d318e466db500771167b0d62e27812c036c","observation_id":"88f6eeff-8513-4a51-849a-7144f2448515","resolution":{"observed_at":"2026-08-11T23:15:46.411334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:46.422729Z","title":"Gener- ating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.422729Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:bd447278c54b495c987eae5857da40516c4e0f162e394793f7016a8f43840c82","observation_id":"190310fb-b769-4d30-b8dc-5ac71c3ac427","resolution":{"observed_at":"2026-08-11T23:15:46.422729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.165694Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"5f67a588-de9d-4661-8eb4-1eab845e23a7","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.433441Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:38a9fa6b150d9f363609edc44504cffc773b3e22c7a3c150c385ac32447c3b92","observation_id":"78854822-a3b7-476c-a918-efcdc3977be2","resolution":{"observed_at":"2026-08-11T23:15:48.172311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.122451Z","title":"Improved techniques for training gans","venue":null,"work_id":"98d95dc3-07a4-4ea3-826e-94a1fb9497ba","year":2016},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.442194Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:cad409ff7019e990d6cb4f63f18a813906c14cd986f45c78adefe7762e87511e","observation_id":"af7a047e-dc8a-4a02-8eae-9f633e097406","resolution":{"observed_at":"2026-08-11T23:15:48.128728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.070095Z","title":"Laion- aesthetics","venue":null,"work_id":"adaf8e6e-1a05-4381-aff0-87a5e399fa87","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.449225Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:c927b046c14e323200ee37e33727a153c90e9487ef13779d29d62b1fe2552bca","observation_id":"a9c0e8c2-7bec-4ab6-9dcc-05f67116d3b8","resolution":{"observed_at":"2026-08-11T23:15:48.094988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.046718Z","title":"Conceptual captions: A cleaned, hypernymed, im- age alt-text dataset for automatic image captioning","venue":null,"work_id":"a892f28f-0a7d-4f28-abbf-9bdde95bd2c0","year":2018},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.456138Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:d049daf94d82fad71b2e97d8a266e8a2ab969b7cb91019249a19122330494416","observation_id":"2824b972-8490-4ad6-927f-e5fa739e1fde","resolution":{"observed_at":"2026-08-11T23:15:48.052735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-11T23:15:46.469089Z","title":"Glu variants improve transformer","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.469089Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:47a83557667038138dd15c40c712f3fc06ede5972082f4c825e9eb7b1e48d739","observation_id":"15775df0-948b-425a-acb0-0d89d3cfc0be","resolution":{"observed_at":"2026-08-11T23:15:46.469089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.009942Z","title":"Roformer: Enhanced transformer with rotary position embedding, 2024","venue":null,"work_id":"1333da3c-9def-4ac3-a271-aa512c94e350","year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.487259Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:fc64a212cbbee3b44b94542cabacc2fb9bfa8a80a0d4998dbaf5798371999701","observation_id":"0077a49a-cb0b-4dfc-82a0-a347db82d687","resolution":{"observed_at":"2026-08-11T23:15:48.020523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-11T23:15:46.494182Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.494182Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:7b032a36b9ae2df4b2dd204347dbe02fefefba8045e71b6949b0c2f92b29f5e3","observation_id":"ff8a588a-d5d9-4421-b2c2-d94d19edd861","resolution":{"observed_at":"2026-08-11T23:15:46.494182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-09T20:05:31.409634Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-11T23:15:46.504301Z","title":"Chameleon: Mixed-modal early-fusion foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.504301Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:bdbb43a6715ae382086c997f2eb695e3208979d0d165e4c640a799891c5b5ded","observation_id":"994cf689-b3f6-4855-b697-31a630ffee3f","resolution":{"observed_at":"2026-08-11T23:15:46.504301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02905","last_updated":"2024-06-10T17:59:07Z","snapshot_observed_at":"2026-07-06T17:55:16.774337Z","submitted_at":"2024-04-03T17:59:53Z","title":"Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02905","snapshot_observed_at":"2026-08-11T23:15:46.513031Z","title":"Visual autoregressive modeling: Scalable im- age generation via next-scale prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.513031Z"},"links":{"cited_paper":"/paper/2404.02905","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:9ec85e3b40e43d2d2e812f44e995085928741cce0452d3240aba607bd1fcd42a","observation_id":"2d5ecb2f-f1e6-43a7-8309-05dafaba5851","resolution":{"observed_at":"2026-08-11T23:15:46.513031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T23:15:46.530869Z","title":"Llama 2: Open foundation and fine- tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.530869Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:ddd8054c1e9cef2e71f67c6e097fe861b4c370c1223837c43cf23ed712886416","observation_id":"24979fbd-7709-4f97-928a-c0da2d9928f1","resolution":{"observed_at":"2026-08-11T23:15:46.530869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.976603Z","title":"Regularizing generative adversarial networks under limited data","venue":null,"work_id":"4a598c2b-6fd7-4910-8904-b708b2f8d3e6","year":2021},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.539496Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:1990c0933a56128edc9a14d69de7a06d387259d4700b16c707d46033efa37493","observation_id":"f7b0ee27-8150-4157-82d4-696e6985a341","resolution":{"observed_at":"2026-08-11T23:15:47.986132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.945572Z","title":"Neural discrete representation learning","venue":null,"work_id":"57b38e86-23fb-433d-8018-8d7e85967d07","year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.547873Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:f20df6cca175de33a05c8d7ec0be2e09ef9b5d1be0c2af6c374a68eafba658f6","observation_id":"62104cbc-e791-4722-ae01-dc0a720b95b8","resolution":{"observed_at":"2026-08-11T23:15:47.955205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:46.559335Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.559335Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:768ff8f371dc21cb9998425f0066606274aedb2755f1ef6e8cb727c8795fa4d6","observation_id":"9e78af58-c271-4b7b-a7a0-928b496f9a8d","resolution":{"observed_at":"2026-08-11T23:15:46.559335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-11T23:15:46.565959Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.565959Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:464bcc1dcd76d3d4df8fc57899ff3a6f69390098a4629792c4d77d54f532480f","observation_id":"9326b1c5-61e6-45a2-ae3f-ddf4fb9dc587","resolution":{"observed_at":"2026-08-11T23:15:46.565959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-11T23:15:46.575073Z","title":"Show-o: One single transformer to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.575073Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:0aefd086512bcd597fa0d3ea30f850d6ca8499efab3168a34adfa2f17902568f","observation_id":"b4c5e717-0984-41f9-b049-f308745b3e69","resolution":{"observed_at":"2026-08-11T23:15:46.575073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.876580Z","title":"Vector-quantized image modeling with improved VQGAN","venue":null,"work_id":"dc019f8a-e5c8-478a-8528-321ac26e160c","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.585833Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:aa004243512df23a4c72aa1d7db07ced89692fe73cd34ba90dc43874f6c7c563","observation_id":"d6411964-b629-4cac-90a4-db6bc27e6b22","resolution":{"observed_at":"2026-08-11T23:15:47.884809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.816165Z","title":"Language model beats diffusion - tokenizer is key to visual generation","venue":null,"work_id":"f7abe6fe-880f-4e85-9f93-3245b244f9d2","year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.590453Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:7980b97ecab5c5046e2680636c00d6c9cbf2d3608bb7472461bdbc972022e28d","observation_id":"fcd1baf0-fd55-484f-bcea-0bcaa4f495fd","resolution":{"observed_at":"2026-08-11T23:15:47.848386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.781474Z","title":"Capsfu- sion: Rethinking image-text data at scale","venue":null,"work_id":"361723d3-f11c-48a5-86cd-2a26f1072d2e","year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.599327Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:55ca672312137084f6a78c7393a7e2b39b62567670e63d94e4daf3897e9cd3dd","observation_id":"01e709bf-636d-40b9-beba-d67c383da024","resolution":{"observed_at":"2026-08-11T23:15:47.788311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07550","last_updated":"2024-06-11T17:59:56Z","snapshot_observed_at":"2026-07-06T18:29:08.586253Z","submitted_at":"2024-06-11T17:59:56Z","title":"An Image is Worth 32 Tokens for Reconstruction and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07550","snapshot_observed_at":"2026-08-11T23:15:46.604883Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.604883Z"},"links":{"cited_paper":"/paper/2406.07550","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:6caac882f351d313d9aa9a4fe66ce45fe76c0331030e9bd5f1dd6137532d14b5","observation_id":"1f870dfc-649d-44de-9619-d55ad2ee8873","resolution":{"observed_at":"2026-08-11T23:15:46.604883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.717174Z","title":"Efros, Eli Shecht- man, and Oliver Wang","venue":null,"work_id":"813c14ab-c742-483c-a165-7459b0da513b","year":2018},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.615387Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:68ed1b2d246439a43844257ce0ee81bb26c47e9577fe8d5a9c9c11abd0753fee","observation_id":"64675680-7cfe-4b94-b862-9aba4124e937","resolution":{"observed_at":"2026-08-11T23:15:47.725523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-11T23:15:46.620482Z","title":"Diab, Xian Li, Xi Victoria Lin, Todor Mihaylov, Myle Ott, Sam Shleifer, Kurt Shuster, Daniel Simig, Punit Singh Koura, Anjali Sridhar, Tianlu Wang, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.620482Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:10e7d16ce1e53703a2aca23658aefa4f5d8597a3e32d9466be457e66811bdb34","observation_id":"df6f8be6-e9b5-4b62-b210-883d855a4a67","resolution":{"observed_at":"2026-08-11T23:15:46.620482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11837","last_updated":"2024-06-17T17:59:57Z","snapshot_observed_at":"2026-08-12T00:38:49.395027Z","submitted_at":"2024-06-17T17:59:57Z","title":"Scaling the Codebook Size of VQGAN to 100,000 with a Utilization Rate of 99%","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11837","snapshot_observed_at":"2026-08-11T23:15:46.631242Z","title":"Scaling the codebook size of vqgan to 100,000 with a utilization rate of 99%","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.631242Z"},"links":{"cited_paper":"/paper/2406.11837","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:fed192b71871d9d9665dc97ee92d95efff94b1b9117c844bc772bbf957241712","observation_id":"ec26adc0-ca0f-4719-a6af-816c9277ff18","resolution":{"observed_at":"2026-08-11T23:15:46.631242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T01:12:16.509042Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 10 inbound Pith citation observations for arXiv:2412.02692."}