{"as_of":"2026-08-07T00:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ff9eded16db4f451d3ba8d7da3e4e1a088869d77f45aa917e1d45caebaad8411","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T17:44:14.636654Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.07340/citation-record","integrity":"/paper/2604.07340/integrity","json":"/paper/2604.07340/citation-record.json","paper":"/paper/2604.07340"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1801.01973","last_updated":"2018-06-21T14:54:33Z","snapshot_observed_at":"2026-08-05T15:21:45.078868Z","submitted_at":"2018-01-06T05:44:29Z","title":"A Note on the Inception Score","version":2},"cited_work":{"arxiv_id":"1801.01973","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.01973","snapshot_observed_at":"2026-07-04T03:49:29.501368Z","title":"A Note on the Inception Score","venue":"stat.ML","work_id":"4700104e-68bd-4452-bdd6-e68281808831","year":2018},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/1801.01973","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:f3236d56a8d3a324deb639a30ac3d0eb2654a4d8a0714fdfd395844ad97f3af7","observation_id":"c11e6fc8-b615-473c-9d05-939f85690523","resolution":{"observed_at":"2026-05-11T06:15:57.120240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23736","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T11:46:55.401760Z","title":"Hieratok: Multi-scale visual tokenizer improves image reconstruction and generation.arXiv preprint arXiv:2509.23736, 2025a","venue":null,"work_id":"8eb542d5-b194-43e2-bdb7-920d7b1e576c","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:b81ce4a3905e5d152d7dc1ccf7048232d0db4b941f7f4a3ccb27e0815de4d221","observation_id":"22655daf-2916-408c-9536-4c09f39bfe88","resolution":{"observed_at":"2026-05-11T06:15:57.179300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":"2010.11929","doi":"10.1175/jcli-d-22-0357.1","metadata_source":"pith","pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","venue":"cs.CV","work_id":"e96730e3-129b-4db6-b981-15ab7932e297","year":2020},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:f6cbf77f9e2130e1cf60b9e71924548dd2f418683d39931e3179e97aff32529e","observation_id":"ae4659c6-ec83-4e1e-9602-6835a6c2a7c9","resolution":{"observed_at":"2026-05-11T06:15:57.132264Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09755","last_updated":"2025-01-16T18:59:04Z","snapshot_observed_at":"2026-07-06T20:22:09.358394Z","submitted_at":"2025-01-16T18:59:04Z","title":"Learnings from Scaling Visual Tokenizers for Reconstruction and Generation","version":1},"cited_work":{"arxiv_id":"2501.09755","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09755","snapshot_observed_at":"2026-07-07T15:43:53.781661Z","title":"Learnings from scaling visual tokenizers for reconstruction and generation","venue":"cs.CV","work_id":"b198a6f3-7796-4bb9-ab48-da1ef827995f","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/2501.09755","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:8563d1810b54bd48cf4e7e307d42f9c2390e26998492cb54369e60ae5a8789d2","observation_id":"2aa396cf-8da4-4bbc-b54a-8e497bd7139a","resolution":{"observed_at":"2026-05-11T06:15:57.138473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25180","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:13:48.377607Z","title":"Dc-gen: Post-training diffusion acceleration with deeply compressed latent space.arXiv preprint arXiv:2509.25180","venue":null,"work_id":"727ff882-c0da-48de-aeb3-0676bfd111e9","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:6e931256ae6e0dd7595bf39d929b9751cb072c03723c087b068f46eb9ecfa5cd","observation_id":"41d4bcd3-d7bc-48aa-8e5a-8dfea1887219","resolution":{"observed_at":"2026-05-11T06:15:57.170481Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.06590","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:28:32.106180Z","title":"Ming-univision: Joint image understanding and generation with a unified continuous tokenizer.arXiv preprint arXiv:2510.06590, 2025a","venue":null,"work_id":"27f83b26-431a-430b-82c3-1c56eccec44d","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:cae208555a012f37d6d991347d6d3f44b113e67bf6c1dc1e85d488c46c7ac461","observation_id":"6ce7136a-c97e-4d75-b520-6cae1b3940bc","resolution":{"observed_at":"2026-05-11T06:15:57.164310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:d3468421abf53c21793c214aab66d99a21fdb16ab7fc15c65d6758848cf940f5","observation_id":"78716e60-5ce4-4f67-8dc0-e84e6d0265aa","resolution":{"observed_at":"2026-05-11T06:15:57.143915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.15301","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.398527Z","title":"Latent diffusion model without variational autoencoder","venue":null,"work_id":"ab5fd0eb-3300-410d-a690-19e04b2a7770","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:3440f352c98440d476e1d4401f5fd3c4411de60ee1f537ad71143b94692fc035","observation_id":"3c4135f8-afe1-49e7-8d48-5bf83f7dfede","resolution":{"observed_at":"2026-05-11T06:15:57.128784Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.10794","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T16:59:58.043629Z","title":"What matters for representation alignment: Global information or spatial structure?","venue":null,"work_id":"f1f54511-fa19-44c2-9a85-6b1016b6d627","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:51b62022b268770df5517b8e2fad2543f9c1f8dc81cf1b13b0973014369d632e","observation_id":"f28efa9a-0e5e-46c3-815d-805942692de6","resolution":{"observed_at":"2026-05-11T06:15:57.193189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":"2406.06525","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-07-10T11:37:03.266757Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","venue":"cs.CV","work_id":"41efe203-9377-4c63-b1d6-e499cd6e46f6","year":2024},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:9d5e023100ba0fecabf0363c6c3531c8a4193f5b83128d1e7d833208eacd0236","observation_id":"ffd2316e-6aa9-41d5-8999-765548fa6fdf","resolution":{"observed_at":"2026-05-11T22:09:17.130563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18427","last_updated":"2025-05-17T13:26:31Z","snapshot_observed_at":"2026-08-06T13:34:35.279373Z","submitted_at":"2025-01-30T15:31:48Z","title":"SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer","version":4},"cited_work":{"arxiv_id":"2501.18427","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.18427","snapshot_observed_at":"2026-07-08T17:15:09.335782Z","title":"High- resolutionimagesynthesiswithlatentdiffusionmodels","venue":"cs.CV","work_id":"ea2bce8b-f6ab-4d7e-b28d-b16ffececa3a","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/2501.18427","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:e0f2b62dd768441261d2491895704893a22b794574166ca4d380affecde68532","observation_id":"b492d801-0693-4f2a-b9d5-519d6eedd784","resolution":{"observed_at":"2026-05-11T06:15:57.159132Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08736","last_updated":"2025-08-24T09:16:02Z","snapshot_observed_at":"2026-07-06T21:08:01.403325Z","submitted_at":"2025-04-11T17:59:58Z","title":"GigaTok: Scaling Visual Tokenizers to 3 Billion Parameters for Autoregressive Image Generation","version":2},"cited_work":{"arxiv_id":"2504.08736","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08736","snapshot_observed_at":"2026-07-02T11:46:55.480663Z","title":"Gigatok: Scaling visual tokenizers to 3 billion parameters for autoregressive image generation","venue":null,"work_id":"85e4a8fa-43a8-45c9-98c7-6d56d812a8b7","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/2504.08736","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:19738c45822cf733d2c0167c0290be72e0d036d4b3cc5ea01fcf0d4a5ed187b5","observation_id":"c0bd6338-1510-41ad-a48c-c63e857b3ca6","resolution":{"observed_at":"2026-05-11T06:15:57.185595Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.13687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.419311Z","title":"Towards scalable pre-training of visual tokenizers for generation","venue":null,"work_id":"be569ef3-3608-4632-82b4-d96a691a0f6e","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:a21ab2a089186e41b82fa12661602b3551105a34dd1c08cc2a5651ae35017f5d","observation_id":"617441f0-beb9-40a9-97b9-8c557c19722a","resolution":{"observed_at":"2026-05-11T06:15:57.200617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.11690","last_updated":"2025-10-13T17:51:39Z","snapshot_observed_at":"2026-07-06T22:32:32.632779Z","submitted_at":"2025-10-13T17:51:39Z","title":"Diffusion Transformers with Representation Autoencoders","version":1},"cited_work":{"arxiv_id":"2510.11690","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.11690","snapshot_observed_at":"2026-07-10T18:47:31.703880Z","title":"Diffusion Transformers with Representation Autoencoders","venue":"cs.CV","work_id":"c1a2d4de-4439-4005-8c56-e0124e4ed5fa","year":2025},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/2510.11690","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:2f65037d214246b1ab8b958c0ea22b91e0575631e94b53e6d95eef3d6aa5d846","observation_id":"5d2a3d8c-2b9e-455f-9d27-3916bb9367e4","resolution":{"observed_at":"2026-05-11T22:34:18.071377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:11a0d0185344c8f8422635b3babe201e027dc5bd50188ce2c5783556a354dee4","observation_id":"f13400c4-50a1-4d64-9e7a-25c1da3a35c8","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"To ensure stable joint optimization with the reconstruction objective, we reduce the learning rate","venue":null,"work_id":"852dee4c-3c9a-41da-af1f-662328d24ad6","year":2021},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:c932693573b31c5de74834374f65b7330b00e4cf3dd712e8331e26662d349041","observation_id":"e1e4c66f-a7cb-4608-b268-ae6d61f5628d","resolution":{"observed_at":"2026-05-17T09:14:22.544047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":14,"verified_fuzzy":1},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2604.07340."}