{"as_of":"2026-08-23T14:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13ded15802a5636658c6e406ec0326ec4fe8a7ed362fd6029d520dccbd7ffe6a","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:28:58.261039Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:21:30.513108Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:40:01.064614Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-08-15T22:21:30.513108Z","title":"One-d-piece: Image tokenizer meets quality-controllable compression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.07538","last_updated":"2025-05-27T11:07:09Z","snapshot_observed_at":"2026-08-15T23:52:19.014030Z","submitted_at":"2025-05-12T13:19:08Z","title":"Selftok: Discrete Visual Tokens of Autoregression, by Diffusion, and for Reasoning","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T22:21:30.513108Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2505.07538"},"observation_digest":"sha256:7802d3e4ea30792ed4a1d33e969dd51200261447b6b83651b541f15ebcb02ef3","observation_id":"73b3651f-b484-44e8-95f0-3b96b46efae4","resolution":{"observed_at":"2026-08-15T22:21:30.513108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-08-06T18:35:32.299466Z","title":"One-d-piece: Image tokenizer meets quality-controllable compression, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07995","last_updated":"2025-07-10T17:59:53Z","snapshot_observed_at":"2026-08-10T08:25:29.929743Z","submitted_at":"2025-07-10T17:59:53Z","title":"Single-pass Adaptive Image Tokenization for Minimum Program Search","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:35:32.299466Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2507.07995"},"observation_digest":"sha256:3a5a23b996a37fea82d55b78423cc4f44b27c5825225b6762e196df37832967c","observation_id":"7e3e2b97-17eb-438e-b413-b45b096a0f81","resolution":{"observed_at":"2026-08-06T18:35:32.299466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-08-05T05:27:34.280620Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05441","last_updated":"2026-08-20T09:18:56Z","snapshot_observed_at":"2026-08-23T14:09:04.265801Z","submitted_at":"2025-09-05T18:49:08Z","title":"Decoupling High and Low Frequencies for Faithful Image Generation with Fine Details","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T05:27:34.280620Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2509.05441"},"observation_digest":"sha256:e1128dc88ebf86ffbbd3e46bad7ed44b4fd01d59d4f9c6ceb87503f3a3b897eb","observation_id":"9871b1da-2f25-4bbc-be23-ef4791e4e823","resolution":{"observed_at":"2026-08-05T05:27:34.280620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T17:19:22.543462Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:e4ad6e4284cd01fa92a374c93a5209898d37f947f616213fe0272b79c843eca4","observation_id":"695d0a6e-2281-4dd6-ab63-f5ba2459e7b6","resolution":{"observed_at":"2026-05-11T07:05:59.641424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-08-02T16:35:03.300652Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T16:35:03.300652Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:3679f69868d00644316eafd1194e0e978ab2e1be30658a97cf5cbfd88763c51c","observation_id":"e67e0947-c203-4a32-9aa0-da61d3c57a38","resolution":{"observed_at":"2026-08-02T16:35:03.300652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2604.24885","last_updated":"2026-04-27T18:08:05Z","snapshot_observed_at":"2026-08-11T16:54:55.131344Z","submitted_at":"2026-04-27T18:08:05Z","title":"VibeToken: Scaling 1D Image Tokenizers and Autoregressive Models for Dynamic Resolution Generations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T04:12:58.100610Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2604.24885"},"observation_digest":"sha256:de10b5e1cb0a5664432172ef603a630cda53c040a72d66a426067979d14c2376","observation_id":"09a20df6-e5ce-4cdb-9e50-3408b6da4035","resolution":{"observed_at":"2026-05-11T21:51:11.676182Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2605.06137","last_updated":"2026-05-29T13:39:42Z","snapshot_observed_at":"2026-07-06T23:18:41.400741Z","submitted_at":"2026-05-07T12:35:51Z","title":"Autoregressive Visual Generation Needs a Prologue","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T13:52:42.834440Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2605.06137"},"observation_digest":"sha256:eecbd1eaba678cf0556a2e85742957742aca92620f79388bfd541e8d07b2e02e","observation_id":"60dedc09-6cc4-4ad2-ac7a-c128482928c1","resolution":{"observed_at":"2026-05-11T18:46:10.848574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2605.06137","last_updated":"2026-05-29T13:39:42Z","snapshot_observed_at":"2026-07-06T23:18:41.400741Z","submitted_at":"2026-05-07T12:35:51Z","title":"Autoregressive Visual Generation Needs a Prologue","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T23:36:51.148162Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2605.06137"},"observation_digest":"sha256:468960f56780056cae10aa541a2aa5b8ad201e7cd76967416cbcc674d497eeb4","observation_id":"11a51bbd-a48b-4da2-8acf-8864ec206d48","resolution":{"observed_at":"2026-06-30T23:45:08.397033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2605.18390","last_updated":"2026-05-18T13:38:43Z","snapshot_observed_at":"2026-08-15T12:40:03.512398Z","submitted_at":"2026-05-18T13:38:43Z","title":"Vision Foundation Models as Generalist Tokenizers for Image Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-20T11:01:24.738195Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2605.18390"},"observation_digest":"sha256:389de5ecc3768c95abfb432873b4974effce4d4e74f24ce35b312821a4c22248","observation_id":"28ed9a64-345d-4177-b51e-004c01d54576","resolution":{"observed_at":"2026-05-20T11:03:13.539717Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2605.27696","last_updated":"2026-05-28T13:12:21Z","snapshot_observed_at":"2026-08-13T03:43:24.580636Z","submitted_at":"2026-05-26T21:16:04Z","title":"Structure over Pixels: Learning Variable-Length Visual Programs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T18:06:01.684713Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2605.27696"},"observation_digest":"sha256:ca18acb82217adbba58010d6495daf3e0565c21a6934713de7bd72f151990408","observation_id":"b20a0534-c485-43ff-a465-aafb384dbf04","resolution":{"observed_at":"2026-06-29T18:13:49.008747Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2606.03578","last_updated":"2026-06-02T12:47:14Z","snapshot_observed_at":"2026-07-06T23:43:50.943530Z","submitted_at":"2026-06-02T12:47:14Z","title":"Diffusing in the Right Space: A Systematic Study of Latent Diffusability","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-06-28T10:44:24.318786Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2606.03578"},"observation_digest":"sha256:2fbd2d2657354d6aa144b54b563ab6753af75275804e5a870674d0d7d6e0259d","observation_id":"bf62f682-71b4-4294-a7a4-0dcc68b4668b","resolution":{"observed_at":"2026-07-02T02:36:27.608527Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2606.04461","last_updated":"2026-06-03T05:10:51Z","snapshot_observed_at":"2026-08-15T16:27:36.136478Z","submitted_at":"2026-06-03T05:10:51Z","title":"ChannelTok: Efficient Flexible-Length Vision Tokenization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T07:09:25.049534Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2606.04461"},"observation_digest":"sha256:2f9cf798f104a1181ba13bda7fc997296c406bda9066b9d77a43c2e3019e48cb","observation_id":"136e92b0-881f-4a83-8992-bc90cbf09b3c","resolution":{"observed_at":"2026-07-02T07:06:44.343807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2606.05552","last_updated":"2026-06-04T01:06:52Z","snapshot_observed_at":"2026-07-06T23:45:33.157370Z","submitted_at":"2026-06-04T01:06:52Z","title":"Balancing Image Compression and Generation with Bootstrapped Tokenization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T03:07:33.054518Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2606.05552"},"observation_digest":"sha256:2c68bd387f581d25801e59765d84b775587c02f7011c3a35bfb8c57e7ad6350f","observation_id":"3ad69d85-c990-4e8f-a62e-9096c18547e1","resolution":{"observed_at":"2026-07-02T11:46:55.417548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2606.07185","last_updated":"2026-06-05T11:49:28Z","snapshot_observed_at":"2026-08-11T15:05:48.136729Z","submitted_at":"2026-06-05T11:49:28Z","title":"AdaTok: Self-Budgeting Image Tokenization with Quality-Preserving Dynamic Tokens","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T22:43:09.489524Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2606.07185"},"observation_digest":"sha256:22d18ebd07454322b73c9c687507baaf217a3abceb3c9f502c319e9057d15df1","observation_id":"c1854f04-3cf3-4ec4-bc83-31b688f58be7","resolution":{"observed_at":"2026-07-02T16:27:09.100397Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"cited_work":{"arxiv_id":"2501.10064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10064","snapshot_observed_at":"2026-07-04T17:40:01.064614Z","title":"One-d-piece: Image tokenizer meets quality- controllable compression","venue":null,"work_id":"1836059f-9b90-4a04-b98c-5a21264475bc","year":2025},"citing_paper":{"arxiv_id":"2606.25232","last_updated":"2026-06-23T23:19:12Z","snapshot_observed_at":"2026-07-06T23:59:42.289674Z","submitted_at":"2026-06-23T23:19:12Z","title":"Semantic Allocation in Ordered Bottlenecks: Predictive Residual Inference for Visual Representation Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-25T23:27:22.496307Z"},"links":{"cited_paper":"/paper/2501.10064","citing_paper":"/paper/2606.25232"},"observation_digest":"sha256:96321d213228fb6c8d5c9f0f7ada0dc444965dff087d5d0dea5c42caf66f7ffd","observation_id":"457f1a2e-ae10-4654-a91a-29724d791bd8","resolution":{"observed_at":"2026-07-04T17:40:01.066136Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.10064/citation-record","integrity":"/paper/2501.10064/integrity","json":"/paper/2501.10064/citation-record.json","paper":"/paper/2501.10064"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.944229Z","title":null,"venue":null,"work_id":"73d6f948-22c8-401b-b23a-59a1de965b1a","year":2000},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.044983Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:992a778c8b977fc8dc476ebe431c8576e9ddbcef62ddee2beeaf34515b767bd0","observation_id":"370ce760-c67d-4bf1-9f0f-34075380cee5","resolution":{"observed_at":"2026-08-10T19:28:58.948698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-10T19:28:58.050474Z","title":"Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.050474Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:9ddb2bc14c98e69d263be292249fe4071854250216b29df93b67fd3e16138613","observation_id":"e70ee6c8-6c8d-49db-aec9-8d9f1ce4cd88","resolution":{"observed_at":"2026-08-10T19:28:58.050474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.928777Z","title":"Rethinking lossy com- pression: The rate-distortion-perception tradeoff","venue":null,"work_id":"4fd04617-53b8-44dc-9050-d0518fdb8718","year":2019},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.056052Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:020063b92310c06fef8bcabced2fc44e46c4ce7bef0debc42a05b0ddea0f8e6b","observation_id":"04a7af8f-42ad-4367-8dee-68b001102a32","resolution":{"observed_at":"2026-08-10T19:28:58.933469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.914141Z","title":"Ge- nie: Generative interactive environments","venue":null,"work_id":"71a089a8-c8b3-41bb-990e-72b4348dfe55","year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.061091Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:c9a24d39e58eae6f034fd134e3599297726803292961b68f60a1d50e43823592","observation_id":"c517795c-cb6a-42db-a72b-ef1decd5f64f","resolution":{"observed_at":"2026-08-10T19:28:58.918536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.897249Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":"35352ea6-5ddb-4174-b9de-2ccb4641f808","year":2022},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.066213Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:39fcb8096e58a032be25d56267c1ad79901bc318813fa70d81adb3c5515bf3a6","observation_id":"2a26866d-053e-4fd3-aa00-cc7a7de8f328","resolution":{"observed_at":"2026-08-10T19:28:58.903137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.070858Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.070858Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:b756900c349a6974689ca6ae47e2a409022c2542379bee569f04af05c4595e01","observation_id":"7068295f-b504-4da6-8705-ba79c5bccd84","resolution":{"observed_at":"2026-08-10T19:28:58.070858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.871780Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"5dd9ebcd-c940-4901-ba59-05cc198b6c7c","year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.076102Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:525fc4681002e7d63fa03e438025f33ea118f53cbf83d6c592acac6c9cad7dc4","observation_id":"305ff2cf-ece3-4f25-972b-7b653d234393","resolution":{"observed_at":"2026-08-10T19:28:58.876898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.081179Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.081179Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:cb98bc7446b5acd1b0b5fa8a393d617075dda2bde9c01d1577800c28f99c1e88","observation_id":"1cff31be-1452-4071-a6e6-f38d6d482ef0","resolution":{"observed_at":"2026-08-10T19:28:58.081179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.845616Z","title":"Tam- ing transformers for high-resolution image synthesis","venue":null,"work_id":"7959085f-7cd6-4199-92ae-6af74a71e670","year":2021},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.086272Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:efba8734391afe1f03b7e42e4da824ba0b621e0bf1b961bdc27e8390fdd11bbc","observation_id":"42dc1459-c80d-4ff9-b7b9-1aab8c86629b","resolution":{"observed_at":"2026-08-10T19:28:58.851153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.03149","last_updated":"2022-11-03T12:31:02Z","snapshot_observed_at":"2026-08-16T18:19:19.653637Z","submitted_at":"2021-06-06T15:02:11Z","title":"Large-scale Unsupervised Semantic Segmentation","version":3},"cited_work":{"arxiv_id":"2106.03149","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.03149","snapshot_observed_at":"2026-08-10T19:28:58.427262Z","title":"Large-scale Unsupervised Semantic Segmentation","venue":"cs.CV","work_id":"949b5f2a-beb2-47c2-bde4-2ce668ef5c9a","year":2021},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.091502Z"},"links":{"cited_paper":"/paper/2106.03149","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:44b31538c2f6691d6e414feab97458883d056985bea506581ba490c3bffc5214","observation_id":"7ea9df8e-2e8e-4286-ad77-dbb42b5ae2ab","resolution":{"observed_at":"2026-08-10T19:28:58.435612Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.828836Z","title":"Making LLaMA SEE and draw with SEED tokenizer","venue":null,"work_id":"2dd02042-01cb-40d4-8b99-4e9e032c6fc8","year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.096331Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:685cdbcfdc4faea288d7981c484f7523bd2b9a9d3c24e8879b09bc9d461b7956","observation_id":"cc851ca9-5104-4526-9fd0-ea5641e7ded3","resolution":{"observed_at":"2026-08-10T19:28:58.834743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14396","last_updated":"2025-03-02T07:53:44Z","snapshot_observed_at":"2026-08-12T19:12:43.246639Z","submitted_at":"2024-04-22T17:56:09Z","title":"SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14396","snapshot_observed_at":"2026-08-10T19:28:58.100436Z","title":"Seed-x: Mul- timodal models with unified multi-granularity comprehen- sion and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.100436Z"},"links":{"cited_paper":"/paper/2404.14396","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:bf222696365a6cc01e96bb755be61dbebdede63b0ea1d864ea9c44446b275bd2","observation_id":"e207934c-b947-4cb3-bb9a-22ac198d1170","resolution":{"observed_at":"2026-08-10T19:28:58.100436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.811713Z","title":"WebP: Compression techniques, 2024","venue":null,"work_id":"5ad6098d-b089-4194-af21-6a8dfdc6bb3c","year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.105823Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:24c5b12efb5da267c7468b92d7bc46456c876597b5cda3255af22cf820bf8a3b","observation_id":"2ff9fe7f-b1b0-467c-8ca3-363e16cb127c","resolution":{"observed_at":"2026-08-10T19:28:58.817209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.110977Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.110977Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:bf7cf00540a785f8a99516b95cefcfcd8b4c908e1b28df7f323fa5a836e1e5f1","observation_id":"0b043491-087b-4e09-8619-226227bc7f6d","resolution":{"observed_at":"2026-08-10T19:28:58.110977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.115797Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.115797Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:6f7af3f3e52ef291957349ceac49a07a95e9867dffb1ec3cfab5e61cf90b05a5","observation_id":"d2e2dfcc-3df6-4fae-9100-211e496871b4","resolution":{"observed_at":"2026-08-10T19:28:58.115797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.772146Z","title":"Ultralytics YOLO11","venue":null,"work_id":"73c370ac-ecb4-404e-8092-3d53b24c9041","year":null},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.120450Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:4d24390a864f5ba924cbca29389956fcaa7b805979d7223a95e50189c751a64e","observation_id":"b3eec495-8312-4ef2-83de-e8a6358c5102","resolution":{"observed_at":"2026-08-10T19:28:58.777579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.755330Z","title":"Kingma and Max Welling","venue":null,"work_id":"e8cfc0e4-97a0-41d9-a0e5-3f14ae29eb53","year":2014},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.125450Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:2cea6f7c5960304939626f79c9b7a68defe6ea3b86ec81ff3f2eb55c68300468","observation_id":"ad1c8b9d-08f8-4bb7-9492-944b99c9ed1b","resolution":{"observed_at":"2026-08-10T19:28:58.760973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.738028Z","title":"Stochastic bottleneck: Rateless auto-encoder for flexible dimensionality reduction","venue":null,"work_id":"d091d2f9-a9fd-4da3-b270-0f0fdb2ca43b","year":2020},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.129957Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:4191eb6b265677e799ff83e425783bfda76768fb7200004d91f71f657972ebe0","observation_id":"8c86ae1f-1667-486e-abc8-411cef88c66d","resolution":{"observed_at":"2026-08-10T19:28:58.743772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.720843Z","title":"Sentencepiece: A sim- ple and language independent subword tokenizer and detok- enizer for neural text processing, 2018","venue":null,"work_id":"95109540-bb44-4e07-87e3-f440098a10d8","year":2018},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.134624Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:1cf8a5af8142a2a1b5a371ab5124a8f0f721d2c99b43a1077ae9135e79a4a9b4","observation_id":"0a068798-605f-4a82-9e4d-6e82e1e6e807","resolution":{"observed_at":"2026-08-10T19:28:58.726321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.705534Z","title":"What matters when building vision-language models? In The Thirty-eighth Annual Conference on Neural Informa- tion Processing Systems, 2024","venue":null,"work_id":"7b3fe6d0-2c9d-4ec9-9549-cffa1c79f343","year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.139082Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:066fbf00f9dd016480bac56224da68fa88187bc7cecc67444fff3e707b4b407a","observation_id":"dbb8eba7-4511-4e3a-aee3-6d539b1bae41","resolution":{"observed_at":"2026-08-10T19:28:58.710378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.143772Z","title":"Lawrence Zitnick","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.143772Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:2cbe5cf9a2cdfc80c87fccb0e045c577e6692e9e5cf9ed978770725790d11173","observation_id":"1595b933-174b-49af-b1db-4a1c0a62e02a","resolution":{"observed_at":"2026-08-10T19:28:58.143772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.152857Z","title":"Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.152857Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:9985c76e25c27b5c8e020bd76afe8d6b1781e065b76bc5bf9d787b515e93aa32","observation_id":"cdf40512-6da8-42f8-af52-f36e725b0889","resolution":{"observed_at":"2026-08-10T19:28:58.152857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.658531Z","title":"A convnet for the 2020s","venue":null,"work_id":"5e8acda5-d40a-4a31-985f-40f7c1d35485","year":2022},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.157721Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:ed045a1b66b14f208c8351bfae57374bc1b5063e7f5cd0c503b6c17761dd4f98","observation_id":"c4b34861-8984-442d-b7eb-dea966ec67de","resolution":{"observed_at":"2026-08-10T19:28:58.663220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04410","last_updated":"2025-02-09T08:59:19Z","snapshot_observed_at":"2026-08-16T13:20:41.485941Z","submitted_at":"2024-09-06T17:14:53Z","title":"Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04410","snapshot_observed_at":"2026-08-10T19:28:58.162629Z","title":"Open-magvit2: An open-source project toward democratizing auto-regressive visual gener- ation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.162629Z"},"links":{"cited_paper":"/paper/2409.04410","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:064ea165599fea50d61ad8377cfd484b088ec07762d4f078d941178eed00b06b","observation_id":"26cc9c35-b5be-4cc7-ac8b-0081a0a65547","resolution":{"observed_at":"2026-08-10T19:28:58.162629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.167827Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.167827Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:fd4b0d7a38500b5c0c0f040e54edb1c2dbd523025d75c3933df1e3f132c7915c","observation_id":"dd726dce-bc93-4793-90c0-2f19fb447b01","resolution":{"observed_at":"2026-08-10T19:28:58.167827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.633066Z","title":null,"venue":null,"work_id":"79988e94-fcdd-4fe2-bab6-a57b59f2b1d4","year":1959},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.173027Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:344f381a4a7e9cab12b2f0f170e27e1df7f1c8806bd3a96e543760e880d36301","observation_id":"dd68d007-ee1a-4996-b061-3a8193d2952d","resolution":{"observed_at":"2026-08-10T19:28:58.637938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-17T19:17:06.411141Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-10T19:28:58.177884Z","title":"Very deep convo- lutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.177884Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:cab21f72f2d3eff27fe824a8e08b7897f2308ef582a71af99cba41bee0c9c139","observation_id":"81529b30-811f-4258-a8df-26158ed83f5d","resolution":{"observed_at":"2026-08-10T19:28:58.177884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-10T19:28:58.183225Z","title":"Autoregressive model 9 beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.183225Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:68944817e58265245e498280330c530a13d9e80b6638700954d9b65a3904185e","observation_id":"165e9893-cb6b-4f87-b572-da494620aa2e","resolution":{"observed_at":"2026-08-10T19:28:58.183225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.616298Z","title":"Chameleon: Mixed-modal early-fusion foundation models, 2024","venue":null,"work_id":"3d8c3c51-cc80-47fc-a1ee-961a482a4fd6","year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.188854Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:122f9e3a9bbf6ca3ff132ab555d428618cc32b68dd495deaaa34bf7bf6584a5d","observation_id":"3ba2820a-5bd5-417c-91fe-98852ae1fcba","resolution":{"observed_at":"2026-08-10T19:28:58.621929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.599567Z","title":"Neural discrete representation learning","venue":null,"work_id":"7afae77c-4c3f-4fc7-bf75-8d9c5e940528","year":null},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.194900Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:f49e599d85f0c0209a8562fef1377ec7aca1e13fd97718116e03f5beb22e9d7f","observation_id":"844bf118-c81d-4a8f-806b-05ba42e97ec3","resolution":{"observed_at":"2026-08-10T19:28:58.604974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.200748Z","title":"Attention is all you need","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.200748Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:b99b5e57280575b40847e29d0d10f49731e32e02e85494f24d146009ae46ddcc","observation_id":"301edb6f-e257-4bce-9ed0-d682f2e57f6d","resolution":{"observed_at":"2026-08-10T19:28:58.200748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.573138Z","title":"Phenaki: Variable length video generation from open domain textual descriptions","venue":null,"work_id":"b65b90f4-cd60-4915-8b1f-594f2f87cbab","year":2022},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.206198Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:f7a082cd6add21ed05b54ee40bf7f5b4fb928b3ce952b0fa58fa256fe1fadb63","observation_id":"4cb5d973-5e54-4cfc-85cd-4550fbabaaf4","resolution":{"observed_at":"2026-08-10T19:28:58.578528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.553587Z","title":"The jpeg still picture compression stan- dard","venue":null,"work_id":"062ee744-3209-4627-82e0-d419c4f64eeb","year":1991},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.210656Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:04de5227bdfcf7bdbe68c9c097f105c13740aa4968e865d1516aa79c552a7e84","observation_id":"fb71561f-49e4-4bea-9cd8-c146cf0b45e3","resolution":{"observed_at":"2026-08-10T19:28:58.559698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09399","last_updated":"2024-06-13T17:59:26Z","snapshot_observed_at":"2026-08-21T07:33:42.271315Z","submitted_at":"2024-06-13T17:59:26Z","title":"OmniTokenizer: A Joint Image-Video Tokenizer for Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09399","snapshot_observed_at":"2026-08-10T19:28:58.215804Z","title":"Omnitokenizer: A joint image-video tokenizer for visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.215804Z"},"links":{"cited_paper":"/paper/2406.09399","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:05f08a9b9771b9aef1e1351a7540e0c0b584d7f641e3b51312404e304da3b5d9","observation_id":"0282cf07-166c-499f-8aac-f34ba020e292","resolution":{"observed_at":"2026-08-10T19:28:58.215804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-10T19:28:58.221272Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.221272Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:8cecdc4b70cbd2726c6d617cfbf6d25989a566c14b2416c16837c6458006fd84","observation_id":"867cba14-8726-4562-9a86-eba540ec0fea","resolution":{"observed_at":"2026-08-10T19:28:58.221272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16211","last_updated":"2024-12-08T19:55:36Z","snapshot_observed_at":"2026-08-16T13:15:48.133270Z","submitted_at":"2024-09-24T16:12:12Z","title":"MaskBit: Embedding-free Image Generation via Bit Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16211","snapshot_observed_at":"2026-08-10T19:28:58.227039Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.227039Z"},"links":{"cited_paper":"/paper/2409.16211","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:b1b0d6092f6fd42e0268e474e122f492dbd5e8cca6d63509fca48adf4fbf51a1","observation_id":"0beb055d-7379-4625-a31d-071d799d52ff","resolution":{"observed_at":"2026-08-10T19:28:58.227039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-10T19:28:58.233911Z","title":"Google’s neural machine translation system: Bridging the gap be- tween human and machine translation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.233911Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:e518ef6fac52d9934433fe23a844afa8c3709906e71ac187dbb683d3d3f4a31b","observation_id":"91099387-a946-459e-a3de-710aec1e6109","resolution":{"observed_at":"2026-08-10T19:28:58.233911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.535417Z","title":"Videogpt: Video generation using vq-vae and trans- formers, 2021","venue":null,"work_id":"77f642c2-0f91-45e8-9361-c40f0e998109","year":2021},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.239565Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:68e64d6a793aec9764f863630c0e130e0b1ab7dde461d17b8bfc54a5b2ef464a","observation_id":"1435f5f7-a910-4f4e-983c-1c2af931e6bc","resolution":{"observed_at":"2026-08-10T19:28:58.540912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.518594Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"de22ab2a-eeb9-4cfa-bd1e-78bde5ad2905","year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.244766Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:db4734813e65730266bf165b7f7b2179c34e34e923a9cd685a0f4daa86162ba3","observation_id":"6f5aa150-9cae-43ea-9ead-983401ffb4f4","resolution":{"observed_at":"2026-08-10T19:28:58.524210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.501660Z","title":"Language model beats diffusion - tokenizer is key to visual generation","venue":null,"work_id":"f881cf9a-9374-4c99-8a10-88f85181ba80","year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.249912Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:546c7006dbd7b8808f88970bb67030c60338f57f42ee2de9d533b47af15172c9","observation_id":"d747f6d2-b6af-4d1d-befd-a35b7174db29","resolution":{"observed_at":"2026-08-10T19:28:58.507420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.484034Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":"7423f62c-33c1-4791-94cc-af267bde48d3","year":2024},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.255582Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:9ef637b4d5208c22b592edfbe4558ac64773532d760c87cd999656c271e32e64","observation_id":"a8b56e36-2413-4ea1-b807-812ebe5ca58f","resolution":{"observed_at":"2026-08-10T19:28:58.489736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.466598Z","title":"bookshop","venue":null,"work_id":"57eba6d3-f2a5-4b64-879f-584354af1e19","year":2018},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.261039Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:b19cdf3c00bc1306f3f519deae1e8f4510c1ca3dd6dd92c82c0a062266daab9f","observation_id":"4b568948-816b-4e34-a5f9-7888ff18549d","resolution":{"observed_at":"2026-08-10T19:28:58.472199Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:28:58.148270Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:58.148270Z"},"links":{"citing_paper":"/paper/2501.10064"},"observation_digest":"sha256:a48a8a5e636c3523297fed3dd16d12817a3ad86e3c5c2b593ffde4c9c2ce9deb","observation_id":"34033e13-184e-452f-af78-2f1249fce038","resolution":{"observed_at":"2026-08-10T19:28:58.148270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.10064","last_updated":"2025-01-17T09:29:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T17:02:34.924212Z","submitted_at":"2025-01-17T09:29:33Z","title":"One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":1,"verified_fuzzy":21},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 15 inbound Pith citation observations for arXiv:2501.10064."}