{"as_of":"2026-08-20T21:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bcea0ec5370366ec4c6ebfce90775bf3307401769f28938bc8fa4ac2bd94d8ef","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:59:25.414666Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:14:53.270468Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T18:51:16.120991Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-11T11:42:31.673489Z","title":"Freeman, and Yu-Xiong Wang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15119","last_updated":"2025-04-03T02:34:24Z","snapshot_observed_at":"2026-08-16T08:29:08.547642Z","submitted_at":"2024-12-19T17:59:54Z","title":"Parallelized Autoregressive Visual Generation","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T11:42:31.673489Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2412.15119"},"observation_digest":"sha256:c0bb27789a339593ea36fd4587196986f16f9a4fedeea4a2985a6621dbcb6014","observation_id":"8497c2e7-aec5-47d0-9107-97bf369deaa8","resolution":{"observed_at":"2026-08-11T11:42:31.673489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-11T11:37:42.079502Z","title":"Freeman, and Yu-Xiong Wang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15321","last_updated":"2025-03-19T06:16:54Z","snapshot_observed_at":"2026-08-17T04:00:01.334302Z","submitted_at":"2024-12-19T18:59:36Z","title":"Next Patch Prediction for Autoregressive Visual Generation","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T11:37:42.079502Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2412.15321"},"observation_digest":"sha256:d06c22fca8c6218d55109ca1c60c5e188bf5e4496df2fc43debb42731ea3bc3b","observation_id":"010df9a7-dbe2-4bbc-b694-a159ce69c75c","resolution":{"observed_at":"2026-08-11T11:37:42.079502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-15T21:14:53.270468Z","title":"Randar: Decoder-only autoregressive visual generation in random orders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10518","last_updated":"2025-05-15T17:25:03Z","snapshot_observed_at":"2026-08-18T18:08:44.477077Z","submitted_at":"2025-05-15T17:25:03Z","title":"Multi-Token Prediction Needs Registers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:14:53.270468Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2505.10518"},"observation_digest":"sha256:fcca7b2413d5aabb8aa51f04a5e95e240cea39cf5061954ae53580d931fdc09a","observation_id":"1669f754-baec-43be-9045-64374ce8370e","resolution":{"observed_at":"2026-08-15T21:14:53.270468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-07T12:46:45.910750Z","title":"Freeman, and Yu-Xiong Wang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23660","last_updated":"2025-05-29T17:09:25Z","snapshot_observed_at":"2026-08-12T19:13:20.732949Z","submitted_at":"2025-05-29T17:09:25Z","title":"D-AR: Diffusion via Autoregressive Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:45.910750Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2505.23660"},"observation_digest":"sha256:42cc433ba9b888011cb8c371a34ba8465b742ab728d1c9cee6e5dd23dcae81ca","observation_id":"b6155b4e-48df-4057-89c7-4ea9aa01895b","resolution":{"observed_at":"2026-08-07T12:46:45.910750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":"2412.01827","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Freeman, and Yu-Xiong Wang","venue":null,"work_id":"137e2879-e596-4a8c-b89f-4a93f2e61dd2","year":2024},"citing_paper":{"arxiv_id":"2506.15564","last_updated":"2025-09-22T01:24:29Z","snapshot_observed_at":"2026-08-20T01:41:57.728123Z","submitted_at":"2025-06-18T15:39:15Z","title":"Show-o2: Improved Native Unified Multimodal Models","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-12T18:51:15.428692Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2506.15564"},"observation_digest":"sha256:319c215086a45217afd0f316952f4b66094da83fd7766f29c6489b0f390bba83","observation_id":"0ae5fbaa-3b02-4ad4-8575-fff8645d06ac","resolution":{"observed_at":"2026-05-12T18:51:16.128174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-15T18:30:38.878855Z","title":"Randar: Decoder-only autoregressive visual generation in random orders,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19935","last_updated":"2025-06-24T18:22:25Z","snapshot_observed_at":"2026-08-18T00:29:27.604306Z","submitted_at":"2025-06-24T18:22:25Z","title":"Any-Order GPT as Masked Diffusion Model: Decoupling Formulation and Architecture","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:30:38.878855Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2506.19935"},"observation_digest":"sha256:92ce3fd127b0e81419d35dcc1e5b1c0c5fbb51f66fe2b7b77ba20a2a595a6cae","observation_id":"cca9fb82-a167-4e17-b884-3f892ef85268","resolution":{"observed_at":"2026-08-15T18:30:38.878855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-06T20:49:41.683560Z","title":"Randar: Decoder-only autoregressive visual generation in random orders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-18T01:05:39.199952Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.683560Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:625f065611960c9aa3b46d4c8a10f04dc80937675ed21c84e7546153716a4abe","observation_id":"bf60b8b0-3048-4fb7-ba33-2c4190826b07","resolution":{"observed_at":"2026-08-06T20:49:41.683560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-06T19:15:28.641209Z","title":"Freeman, and Yu-Xiong Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06137","last_updated":"2025-07-08T16:19:45Z","snapshot_observed_at":"2026-08-18T16:49:00.207762Z","submitted_at":"2025-07-08T16:19:45Z","title":"NeoBabel: A Multilingual Open Tower for Visual Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:15:28.641209Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2507.06137"},"observation_digest":"sha256:7fc22e08434af2752438106373d543fdca64dd698a49410f46e0862f2c3c9409","observation_id":"84849d24-f5bc-423b-8b0c-b90328786bee","resolution":{"observed_at":"2026-08-06T19:15:28.641209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-04T18:12:46.841576Z","title":"Randar: Decoder-only autoregressive visual generation in random orders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-18T03:39:08.163127Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:46.841576Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:6159ba90cdfed0f84c1cbcb86b729a260faa76618dbb25303a7edcea848bfdce","observation_id":"5da56636-ee7b-4ba6-bb5d-87f26279110c","resolution":{"observed_at":"2026-08-04T18:12:46.841576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-03T04:53:11.993527Z","title":"arXiv:2412.01827 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.03811","last_updated":"2026-07-31T03:14:10Z","snapshot_observed_at":"2026-08-15T08:42:42.119868Z","submitted_at":"2026-02-03T18:15:27Z","title":"Progressive Checkerboards for Autoregressive Multiscale Image Generation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T04:53:11.993527Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2602.03811"},"observation_digest":"sha256:fcda0b9fe70dfb1711f71796a7cbaece4859526fce0b3854dee847ff360bfa26","observation_id":"1b0a277a-a917-4d55-ac23-444304b2c952","resolution":{"observed_at":"2026-08-03T04:53:11.993527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-07-14T14:48:46.294893Z","title":"Randar: Decoder-only autoregressive visual generation in random orders,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09892","last_updated":"2026-07-10T18:32:27Z","snapshot_observed_at":"2026-08-15T06:32:41.930342Z","submitted_at":"2026-07-10T18:32:27Z","title":"Next-Dense-Stride Prediction for Multimodal Autoregressive Visual Modeling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T14:48:46.294893Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2607.09892"},"observation_digest":"sha256:9f64a31997b04b504d6c627a6b2779466626f6bc16d6929ba4147c3096322ee0","observation_id":"40e63fbb-a9ac-4482-96fc-fb4c1351a9b8","resolution":{"observed_at":"2026-07-14T14:48:46.294893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.01827/citation-record","integrity":"/paper/2412.01827/integrity","json":"/paper/2412.01827/citation-record.json","paper":"/paper/2412.01827"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-12T00:59:25.109699Z","title":"Large scale gan training for high fidelity natural image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.109699Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:d16c4a92cf5db103333aeb5c9384cc4a12c398611b396e08f048363fd057f083","observation_id":"3e79e4b0-ea1c-4b20-9a71-8eedda64db2d","resolution":{"observed_at":"2026-08-12T00:59:25.109699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.333151Z","title":"In- structPix2Pix: Learning to follow image editing instructions","venue":null,"work_id":"1177fae2-8924-4a2f-aadf-c80fa043c893","year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.115224Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:f1f051eaa43aebe27610071b437ab318edec51e3ee0119505b193e3cfc35678d","observation_id":"356f0a1a-1f38-429f-b8f6-38802609fc1a","resolution":{"observed_at":"2026-08-12T00:59:26.338824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T00:59:25.120361Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.120361Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:3f532dea20ed58c449480dd1a4218e58ce2553037a93162ce9ae9f17fcedf24c","observation_id":"0be9fbf8-1dec-4ef3-8593-8b6447a782b4","resolution":{"observed_at":"2026-08-12T00:59:25.120361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.317451Z","title":"Medusa: Simple llm inference acceleration framework with multiple decod- ing heads","venue":null,"work_id":"fd843053-a053-41ce-8006-784609f2b27e","year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.125825Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:b9c29f33f5c75be1516ce4dec9d5f5b58c6e97b0faae7d8de1a53472e9d79e5e","observation_id":"2cc93d9d-182f-452d-9d68-2a5f3b459d68","resolution":{"observed_at":"2026-08-12T00:59:26.322774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.300776Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":"3fb90809-ca72-4c50-8caf-20769d38fdad","year":2022},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.130058Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:b983ee940baa5f305c8c970a6f771b169788cf85fe317a2b89017c92f3cab4e1","observation_id":"d3923326-2950-4f09-8af5-a28fde4b5ed8","resolution":{"observed_at":"2026-08-12T00:59:26.305653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.284747Z","title":"Muse: Text- to-image generation via masked generative transformers","venue":null,"work_id":"eb5b32b3-66b3-43d2-be82-95e48c59470c","year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.134304Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:202156539a51f7f76a1fe14f77cd031cbad1792430aa57244bd495f4415897cd","observation_id":"c2429f4a-a68d-4769-8756-df891a0abdc9","resolution":{"observed_at":"2026-08-12T00:59:26.290732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.269983Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"3bccf51c-65a1-4df8-892e-a00359b66a5f","year":2009},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.138475Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:925779f1370d130d81a5368949610ad8153a3bb5fb5557d8ae0b26711821cd72","observation_id":"de6624c8-ae5b-4954-83bb-7668cf109aa3","resolution":{"observed_at":"2026-08-12T00:59:26.274902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.254690Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"f01a631c-895a-4be0-9e81-e28e0e6d5d07","year":2021},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.144361Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:1dcae45c3f4fbdf784ec83b4dbb13d558ba586274bfb8305b19dc9bde5eabd4a","observation_id":"19eaaf62-3368-4375-b1b0-8753b609d7db","resolution":{"observed_at":"2026-08-12T00:59:26.259380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.239287Z","title":"Patched denoising diffusion models for high-resolution im- age synthesis","venue":null,"work_id":"6c39ddbd-7fb7-44b4-9cbb-e1b364ea7d7f","year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.148762Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:8e5c50e3a2579c11f288937cff8ed45edabb670ee9422c309cb055d8f059a538","observation_id":"c4f7e062-8a0f-44a7-ab32-bebecb30b0ff","resolution":{"observed_at":"2026-08-12T00:59:26.244251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.153872Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.153872Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:4a0aaeeeaf791529c97edd70834214bfbabb7753076d7003d8805afc8f75a984","observation_id":"013a4e9b-158d-4dca-9807-cb56788f66bf","resolution":{"observed_at":"2026-08-12T00:59:25.153872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-18T20:25:20.454774Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-12T00:59:25.163566Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.163566Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:b8ddd132b474bac38a624ee67556ca02af2d2f3c65cd7631970842d28a545c68","observation_id":"014149b2-c692-4714-968b-642df00884c6","resolution":{"observed_at":"2026-08-12T00:59:25.163566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.200445Z","title":"Data engineer- ing for scaling language models to 128k context","venue":null,"work_id":"506fcfc2-76c4-4048-98be-4613a7553783","year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.168432Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:e60bf605e87baaf9ce57e71032710e101fbe6d47884bdf3ba308fbb27f8d1cdf","observation_id":"12c57df7-2a27-4047-9c7a-7b8d57197a67","resolution":{"observed_at":"2026-08-12T00:59:26.205173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.184397Z","title":"Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"69fd52a8-7d3f-4780-bedd-882864f7e6fd","year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.173122Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:259bddaf381e874fdb12fe77177b96cfecaafd8c44050794c70b9b5f4bd1d579","observation_id":"e48ee36e-315a-4b08-91e7-db16a9e129e6","resolution":{"observed_at":"2026-08-12T00:59:26.189334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-08-17T12:46:02.488423Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-12T00:59:25.178405Z","title":"Olmo: Ac- celerating the science of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.178405Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:34e35e639fad6de8235473ef2b40a3ed615d0ea58a62e35d1c7ecf53c1316510","observation_id":"779da7da-3f2f-47f0-b510-9504ed382f16","resolution":{"observed_at":"2026-08-12T00:59:25.178405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.168825Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"73867f65-6272-46a5-8653-c95ece023ebf","year":2022},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.183937Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:279e9b993f52b14818b2a531e7e418ebc4281913bc18d149a5c033aaccaa5498","observation_id":"5c61379b-cc30-4008-bcbd-05a1cfc1e634","resolution":{"observed_at":"2026-08-12T00:59:26.173581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.188481Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.188481Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:516b28965cdab2132b42a779e577d854823513cddbffc4cf3b08504d83fa968e","observation_id":"03b8a6d3-370b-4a4b-9b26-47cc5879d025","resolution":{"observed_at":"2026-08-12T00:59:25.188481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-12T00:59:25.193721Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.193721Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:d0b9eabb9989fdaca814b9c32233812505703e3142fda78f7e86c3f7dfbade15","observation_id":"41fa1a17-66fa-404f-9b41-1c943ed1bddf","resolution":{"observed_at":"2026-08-12T00:59:25.193721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.198785Z","title":"Scaling up gans for text-to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.198785Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:3f5151eb0e96a836299c4ce3e3b1cc5a7a98fe14a8d3d7341ddf241579beb322","observation_id":"90cd6b2b-3cce-45cb-89b7-db6e9d72b751","resolution":{"observed_at":"2026-08-12T00:59:25.198785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.134993Z","title":"BERT: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":"ca93c057-f8ef-4ab5-839e-f1de0b040e03","year":2019},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.202965Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:a385cc8c4a9b4f5a9a2558d5898c3a855302e9038148f4c202270707ed0037ad","observation_id":"bbc8e892-2f32-4010-bbe8-c1360f16bb3d","resolution":{"observed_at":"2026-08-12T00:59:26.139702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.119384Z","title":"SqueezeLLM: Dense-and-sparse quantization","venue":null,"work_id":"aab58ba7-c403-496e-af82-7f56ad9b2487","year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.206806Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:b8ba635864d61ddf5b59b670ecfac024d8f0308aed59b13309e847648511df41","observation_id":"5c3254b5-a5fb-4f87-8cfe-3e026d48c999","resolution":{"observed_at":"2026-08-12T00:59:26.124372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T00:59:25.211148Z","title":"Adam: A method for stochastic opti- mization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.211148Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:dcd9527c57a9343b3f5318ceda106bab45797fc5a7edccdf66591f27fb1d67b1","observation_id":"40b2d559-d1ed-4226-9963-7f07eaf616d6","resolution":{"observed_at":"2026-08-12T00:59:25.211148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.104525Z","title":"Improved precision and recall met- ric for assessing generative models","venue":null,"work_id":"02997800-14c8-4b20-85b2-fc77e0185e17","year":2019},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.216325Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:288ea46cf228e3361352336fccd9ed053c51ff6e5570728abb8a37eae12bbd45","observation_id":"98441cfc-0c71-43d8-9262-cd08bbfff0f7","resolution":{"observed_at":"2026-08-12T00:59:26.109452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.220708Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.220708Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:d42823746d2932f07bff56d6bfbc1a6646d5c3ab7fdbbf44688137ee62f54d0e","observation_id":"897a6f03-fa64-4fd4-ba63-884aa88b3fd7","resolution":{"observed_at":"2026-08-12T00:59:25.220708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.225243Z","title":"Mage: Masked generative encoder to unify representation learning and image synthe- sis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.225243Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:0200454cf0d50360118bd3446e6587c85bf5142267331606a2b85934d13df5e8","observation_id":"d55d9dbf-dc6e-41fd-899e-831fba020cbb","resolution":{"observed_at":"2026-08-12T00:59:25.225243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.070495Z","title":"Autoregressive image generation without vec- tor quantization","venue":null,"work_id":"07cf7f95-8f32-417c-b58a-b64e1c06a6cd","year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.229604Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:aeebcbf7cab01da2d91853ba4d5723d68328b0b09bab1661bca93f6da9db2b67","observation_id":"72118bd0-5bb8-4d6a-8ddb-e3f13ac9d8dc","resolution":{"observed_at":"2026-08-12T00:59:26.075135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.055380Z","title":"Solving masked jigsaw puzzles with diffusion vision transformers","venue":null,"work_id":"e5169e79-37cb-40c5-afea-416cce56e250","year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.234067Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:8402ed79a407a6b4c4abfc35ac7a1519c1d16eb622c5db24f3e5bd6766ed49ed","observation_id":"20ae4bd6-ef60-437c-a48b-dc5e2c5b267f","resolution":{"observed_at":"2026-08-12T00:59:26.060683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.039389Z","title":"Compositional visual generation with composable diffusion models","venue":null,"work_id":"a7481d39-f596-4b0c-8a88-76e67577094d","year":2022},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.239054Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:a949f760d28fe4d4571511f0394bd13636b19858ea67cc01dc6ec4d22e9f53b9","observation_id":"a1a122bf-4535-4b32-9d37-a4105e9df320","resolution":{"observed_at":"2026-08-12T00:59:26.044988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10511","last_updated":"2024-10-14T13:49:06Z","snapshot_observed_at":"2026-08-19T21:57:15.960164Z","submitted_at":"2024-10-14T13:49:06Z","title":"Customize Your Visual Autoregressive Recipe with Set Autoregressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10511","snapshot_observed_at":"2026-08-12T00:59:25.243464Z","title":"Customize your visual autoregressive recipe with set autoregressive modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.243464Z"},"links":{"cited_paper":"/paper/2410.10511","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:962749ef3824613fb0994cad63cbbf533be21558fac5c8d9b7c04effd0019020","observation_id":"f8d8081e-7d1f-45a1-afd2-82d0bc05528c","resolution":{"observed_at":"2026-08-12T00:59:25.243464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-12T00:59:25.249106Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.249106Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:c72c342901fbedd841cb48bf5fa8f25b88311b75a680d14e777db2841d01fe41","observation_id":"fcc93088-f75c-440f-bb03-8c49eeb82308","resolution":{"observed_at":"2026-08-12T00:59:25.249106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.253992Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.253992Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:25b2aae88458d68d2d5709e0da29c6b17d1d93da38358e8924f7d8c9c01b128e","observation_id":"72dac2ef-880d-43fa-b7d8-70f5c52928e4","resolution":{"observed_at":"2026-08-12T00:59:25.253992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04410","last_updated":"2025-02-09T08:59:19Z","snapshot_observed_at":"2026-08-16T13:20:41.485941Z","submitted_at":"2024-09-06T17:14:53Z","title":"Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04410","snapshot_observed_at":"2026-08-12T00:59:25.258816Z","title":"Open-magvit2: An open-source project toward democratizing auto-regressive visual gener- ation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.258816Z"},"links":{"cited_paper":"/paper/2409.04410","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:34ce257bd0957ac9040f1ef14a7d9b13ca609bfca6ad64a56dfb36c0041d31c5","observation_id":"22401958-3c6b-421f-bbb3-6eddd3820e24","resolution":{"observed_at":"2026-08-12T00:59:25.258816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08740","last_updated":"2024-09-23T15:59:41Z","snapshot_observed_at":"2026-08-18T20:56:40.841401Z","submitted_at":"2024-01-16T18:55:25Z","title":"SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08740","snapshot_observed_at":"2026-08-12T00:59:25.262939Z","title":"SIT: Explor- ing flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.262939Z"},"links":{"cited_paper":"/paper/2401.08740","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:49d4d2b600a5854f178718f1dba88a786feca430720634c7cc85d79f4a0915dd","observation_id":"4257a861-8764-4fb4-94b5-1cd7df1f4fde","resolution":{"observed_at":"2026-08-12T00:59:25.262939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10543","last_updated":"2019-08-28T04:16:52Z","snapshot_observed_at":"2026-08-18T06:10:30.441712Z","submitted_at":"2019-08-28T04:16:52Z","title":"SPair-71k: A Large-scale Benchmark for Semantic Correspondence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10543","snapshot_observed_at":"2026-08-12T00:59:25.267762Z","title":"Spair-71k: A large-scale benchmark for semantic correspon- dence","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.267762Z"},"links":{"cited_paper":"/paper/1908.10543","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:04ba5d2e114f04e403292ac2f5e1fb63ecdbdc3fca4901d924a5e474637f5d72","observation_id":"d36eb7f2-ffe0-4996-8fb6-7b2e380ed42a","resolution":{"observed_at":"2026-08-12T00:59:25.267762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.014613Z","title":"Frozen transformers in language models are effective visual encoder layers","venue":null,"work_id":"1ee474d9-0606-4ac4-9e2d-d618fc9c75bf","year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.273688Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:a6ce8b1cee21982666266a80d4345b34edd978305c1b1ca57a57feddc1eb1927","observation_id":"0ef90c10-60b8-4871-a1df-0435347ca56c","resolution":{"observed_at":"2026-08-12T00:59:26.019741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.998975Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"564f926f-cc52-48b9-869f-2320ef518c93","year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.278684Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:f4e3b66d3c2ec03c404bafcb67396f2538c22b015515ed1d69e78337269ea41f","observation_id":"97f7bf1b-d0b0-4959-8b12-67462b3240ad","resolution":{"observed_at":"2026-08-12T00:59:26.003798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.984646Z","title":"Improving language understanding with unsuper- vised learning","venue":null,"work_id":"7987ca7e-1262-4d3d-8ac9-9d0bcd64f266","year":2018},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.283934Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:1266064b065ebb9b560592258b7cea6c2cd71b9a00d4cb5f80925148752b3967","observation_id":"0c6de8c3-03be-464e-ab31-14228efbe09f","resolution":{"observed_at":"2026-08-12T00:59:25.989266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.288865Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.288865Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:18b5acb8ecf0313f47eaee9053752c2bcebe49720fcfcf09dc25b3a222c50886","observation_id":"975e1822-d382-4417-a6d4-ef4f3f8b8c90","resolution":{"observed_at":"2026-08-12T00:59:25.288865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.959539Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"99c290ce-0929-4dac-b60b-dbe9ff980da4","year":2021},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.294167Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:d1c1e2fb5cea31103c4ea838be46beb3184738da1eae94e172df37ac19aff45f","observation_id":"a6b73ee1-0e36-4d38-8341-0264418c7dc3","resolution":{"observed_at":"2026-08-12T00:59:25.964884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.942941Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"65fd6f51-cdba-4dca-9ef1-700963ebf761","year":2022},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.298682Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:595085c2a6e7c9614aeb8a00c3db5801775a21e0304a866d3b061da88c72687f","observation_id":"7f354e84-a519-494f-8dbd-dbac0962a8c3","resolution":{"observed_at":"2026-08-12T00:59:25.949564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.304395Z","title":"Improved techniques for training gans","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.304395Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:77c9b17715c965c8e86d40abc8b44a0b6556d4ec030e1f20ffc7b4076cea867f","observation_id":"747e39d5-bb48-4e56-8c27-83ea9f26517e","resolution":{"observed_at":"2026-08-12T00:59:25.304395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.308916Z","title":"Stylegan- xl: Scaling stylegan to large diverse datasets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.308916Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:b93578555c4e29c74d955062d45ab7834cdc20657b6ddd1578f2662412e9ca84","observation_id":"9142997a-d4b3-410e-a88e-9f2f454c715a","resolution":{"observed_at":"2026-08-12T00:59:25.308916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-12T00:59:25.314608Z","title":"Fast transformer decoding: One write-head is all you need","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.314608Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:44e955d9b30c783291b73f9f6ee4de31c18273e41b78790b31f0795947366e47","observation_id":"f359d05f-b1fb-498b-b1dd-5d1c5fc4e406","resolution":{"observed_at":"2026-08-12T00:59:25.314608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-12T00:59:25.319391Z","title":"Glu variants improve transformer","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.319391Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:d90a3eaa1efd9480ab8787c7887d1f03f172a7fb25125b24596ba2b5dbf89143","observation_id":"1ba2426f-0ac2-4371-a76e-dec739a824b6","resolution":{"observed_at":"2026-08-12T00:59:25.319391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.324420Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.324420Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:434d544c4e1def5b9140c829e8db7634832afa49a598e915397c9609f8a2c7ae","observation_id":"1107d39b-6d6f-42bb-a4fc-edc4f96824e6","resolution":{"observed_at":"2026-08-12T00:59:25.324420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-12T00:59:25.328556Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.328556Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:e7d554d33f194372f283c674de6510761d4c904cfe451240ca1f7fe7261745e8","observation_id":"e4db7ff1-6c91-4662-8982-00ff2c4a1be1","resolution":{"observed_at":"2026-08-12T00:59:25.328556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.899331Z","title":"Emergent correspondence from image diffusion","venue":null,"work_id":"86b0520d-98b9-48bf-b6da-9a39c9c45269","year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.333125Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:861d2be1461d4eada71fe796561e0a2cad8577a0eb3ab7de1b00c3d1d3674ab0","observation_id":"0555f671-b8a2-4636-a6dc-2fefdf01da3a","resolution":{"observed_at":"2026-08-12T00:59:25.904643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-12T11:54:14.007649Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-12T00:59:25.337732Z","title":"Chameleon: Mixed-modal early-fusion foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.337732Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:a9310e8e46c009ea15db9e8d0f9aff6fce9c71d6feb2e434cea8621378910708","observation_id":"ca131411-23f8-4074-be28-6b45309a5220","resolution":{"observed_at":"2026-08-12T00:59:25.337732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.884382Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":"cf535b77-ca79-4f8e-aabc-0bba5ef29e53","year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.342655Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:4a51cc7f68202a550ff08c05fdb1169ba32cc1b42f58a3900b02bc0752bcd8b4","observation_id":"5d7f79c3-cff1-41d1-96e2-3e9ce4cc51a1","resolution":{"observed_at":"2026-08-12T00:59:25.889731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T00:59:25.347065Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.347065Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:77f14233d53bbf13b7be1d3ab93167a7a5dc386d36512b11b976c7c62aee1ac6","observation_id":"e7320d5d-b94b-42bc-81b4-64480e2c0831","resolution":{"observed_at":"2026-08-12T00:59:25.347065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T00:59:25.352054Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.352054Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:f599dbb0f864838fc298070bf6b6e5b41645223987ee99ede53ace1d6b0a08ee","observation_id":"89cf2884-0138-4282-8e0b-56901a54fd09","resolution":{"observed_at":"2026-08-12T00:59:25.352054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.868382Z","title":"Conditional image gener- ation with pixelcnn decoders","venue":null,"work_id":"4629137c-3a63-42b5-92e4-e68eb9e91618","year":2016},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.356479Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:ed5a7271e66f98405960aa25ef7f04a09d5e1c4aec57f84ceb5ef8e20abac707","observation_id":"3c106b99-b2ea-4de3-abdb-ce7e58c1f54f","resolution":{"observed_at":"2026-08-12T00:59:25.873253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-12T00:59:25.361553Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.361553Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:c705d3f1139d0b4796aed2d876fa7850d3a102b93c7bc60939654042afad13bd","observation_id":"a67632bb-dd5f-483a-ac65-821737662168","resolution":{"observed_at":"2026-08-12T00:59:25.361553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16211","last_updated":"2024-12-08T19:55:36Z","snapshot_observed_at":"2026-08-16T13:15:48.133270Z","submitted_at":"2024-09-24T16:12:12Z","title":"MaskBit: Embedding-free Image Generation via Bit Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16211","snapshot_observed_at":"2026-08-12T00:59:25.366082Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.366082Z"},"links":{"cited_paper":"/paper/2409.16211","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:7181c17cc9626603862778b02fcbefe89b017a867b3aab6abb99bf17f96c4f1e","observation_id":"29d0aaa8-ee3c-46e0-8e1d-053cc75535aa","resolution":{"observed_at":"2026-08-12T00:59:25.366082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-08-18T17:34:44.890427Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-12T00:59:25.371206Z","title":"Show-o: One single transformer to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.371206Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:5019954760c76d9e4d402137b4a58045e395cf64a25b6fe07aa198da00ef60c4","observation_id":"de9ff407-c117-4f8c-ba51-90a07391a760","resolution":{"observed_at":"2026-08-12T00:59:25.371206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.851874Z","title":"Carbonell, Ruslan Salakhutdinov, and Quoc V","venue":null,"work_id":"3df4099e-757e-4bce-ad71-4034aa65be10","year":2019},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.375723Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:b85469abbc461dfc3f0f306e997af960a3fe93cc94c963e5ecbd002f6fc3b774","observation_id":"542cd693-08a9-4a71-96b6-5c31441cc7e5","resolution":{"observed_at":"2026-08-12T00:59:25.857237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.837410Z","title":"Hauptmann, Ming- Hsuan Yang, Yuan Hao, Irfan Essa, and Lu Jiang","venue":null,"work_id":"256a6cb8-3095-4fa7-8b56-a6a64bd2226b","year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.380582Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:1a4499ece5e5957c13184430a543bf83ff1dd1303c6b2fcb5c52bae9d5183249","observation_id":"c7eef1a9-4f9b-4d0f-abc2-de68d5db00e4","resolution":{"observed_at":"2026-08-12T00:59:25.841749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.823215Z","title":"Gundavarapu, Luca Ver- sari, Kihyuk Sohn, David Minnen, Yong Cheng, Vigh- nesh Birodkar, Agrim Gupta, Xiuye Gu, Alexander G","venue":null,"work_id":"a674585e-e5cc-4227-a9ed-0aa8d2e90a62","year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.385030Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:0ca7891fc90e64673201f6e5642c27c7569a69a9f87a35dfa14c8ce4c4506d18","observation_id":"e07626d1-3f9a-4f5a-aacb-01bbd74326b9","resolution":{"observed_at":"2026-08-12T00:59:25.827845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00776","last_updated":"2024-11-01T17:59:58Z","snapshot_observed_at":"2026-08-16T13:03:42.693512Z","submitted_at":"2024-11-01T17:59:58Z","title":"Randomized Autoregressive Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00776","snapshot_observed_at":"2026-08-12T00:59:25.390186Z","title":"Randomized autoregressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.390186Z"},"links":{"cited_paper":"/paper/2411.00776","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:1f3bf4864237244ce030eb8cd6b8eb575f60005e61de8b5f4139b9fbd5fa8bb9","observation_id":"11d35c07-54e1-4073-b671-49677b0bd2bc","resolution":{"observed_at":"2026-08-12T00:59:25.390186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07550","last_updated":"2024-06-11T17:59:56Z","snapshot_observed_at":"2026-08-16T13:44:02.831519Z","submitted_at":"2024-06-11T17:59:56Z","title":"An Image is Worth 32 Tokens for Reconstruction and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07550","snapshot_observed_at":"2026-08-12T00:59:25.395651Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.395651Z"},"links":{"cited_paper":"/paper/2406.07550","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:65a753145a74b0deced60245bc2d8cdcbed724850a79dc2771580d0098d956b1","observation_id":"12574538-3d3c-4a90-8811-9905b8c5d42d","resolution":{"observed_at":"2026-08-12T00:59:25.395651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.808036Z","title":"Root mean square layer nor- malization","venue":null,"work_id":"e21b011c-2d53-4c10-a348-85ae6683cb91","year":2019},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.400372Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:2a18b070b4a4066e5f0e69239927555a6a6dcf749a7540e969c9c2d9256ec114","observation_id":"2172bc47-7d2d-4e63-b9c5-3698a664e082","resolution":{"observed_at":"2026-08-12T00:59:25.813031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.789674Z","title":"Diffcollage: Parallel generation of large content with diffusion models","venue":null,"work_id":"d59bf35d-3005-4a6d-9837-17d9cc057d02","year":2023},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.405472Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:a3d24704c495d6edebc4c9a17bddfa79a4564c442d131974814258c1bbfcb76e","observation_id":"2ec9d9f3-8f4f-4cfa-8f7c-e165de7eceda","resolution":{"observed_at":"2026-08-12T00:59:25.796755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-08-19T12:50:53.888784Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-12T00:59:25.409969Z","title":"Transfusion: Pre- dict the next token and diffuse images with one multi-modal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.409969Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:ffff186a47d2d71f784f7c7ebece59b1d0e833458864b4218d8d722344aa35b0","observation_id":"7cb772d7-0cf5-428b-9ad4-d397889755bb","resolution":{"observed_at":"2026-08-12T00:59:25.409969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:25.414666Z","title":"Segment everything everywhere all at once","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.414666Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:271f4cae80796581b5172c37fbf421b9ada042602beb8b393c7827cdffeef414","observation_id":"ccf4e59b-30c0-4e24-b3aa-a7cec7ec1574","resolution":{"observed_at":"2026-08-12T00:59:25.414666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:59:26.215639Z","title":null,"venue":null,"work_id":"40d2ce9d-dbfe-485e-b26e-8b4b4ac87dd6","year":null},"citing_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-12T00:59:25.158582Z"},"links":{"citing_paper":"/paper/2412.01827"},"observation_digest":"sha256:a0e071537108354c31a1dd1c9f1420879b17cc9fec1d3fb66dd8553456768e26","observation_id":"fb101c33-a57e-426b-a811-8db9d33fe205","resolution":{"observed_at":"2026-08-12T00:59:26.220147Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T08:04:35.496976Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":34,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 11 inbound Pith citation observations for arXiv:2412.01827."}