{"as_of":"2026-08-06T02:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:91a39a0b020e3a1fbe783f835fd4bfe4fe85cf673639b5241a695bcb06303bef","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T06:02:33.824296Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.22777/citation-record","integrity":"/paper/2605.22777/integrity","json":"/paper/2605.22777/citation-record.json","paper":"/paper/2605.22777"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":"60f38fe2-356d-48fe-863d-64340e3b7449","year":2022},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:7fa06c7bb9e6a373f89829c45b74348388c420fd17797a48abee9f6195677fcc","observation_id":"94745734-38a4-4a63-825a-ff93b5e4e69b","resolution":{"observed_at":"2026-05-22T06:04:40.408699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:49.784463Z","title":"Flux.https://github.com/black-forest-labs/flux","venue":null,"work_id":"ff476bd7-afa4-451d-b45d-54207aeb1545","year":2024},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:61a7cdbdbe807f5c83debda8321b91da48e179a7e8310ee1a65f83fcfe61a08e","observation_id":"a63f6bad-82cb-4c87-9ab3-a0fb8197873f","resolution":{"observed_at":"2026-05-22T06:04:40.412105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":"2410.10629","doi":"10.48550/arxiv.2410.10629","metadata_source":"pith","pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","venue":"cs.CV","work_id":"c53bf282-3c74-4c37-a7bd-6531aee212b8","year":2024},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:c6605ce893c9bb03b08c7ae8242102cb8a76444df455842b97c9a10ef96803c1","observation_id":"40fc4eb8-d0cf-4bd1-a972-d6508b89a488","resolution":{"observed_at":"2026-05-22T06:04:39.563616Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion transformers with representation autoencoders","venue":null,"work_id":"3efb784e-b9dd-4ad6-8336-d490f02409fa","year":2026},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:726c849a9d79964fe3ffbf04cc8e93ff6dfcf679c41e7a25cd5d85a9c0a6313e","observation_id":"2ccd7c9c-a131-484e-86b0-a3ee0da765c8","resolution":{"observed_at":"2026-05-22T06:04:40.398612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dinov2: Learning robust visual features without supervision.TMLR","venue":null,"work_id":"e5e9d777-ed57-4e40-9074-c290c62a7b09","year":2024},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:8f5a3df8c53a83a35aee3965f8992eabd3ec4959c4f450bd05b0303917ec224c","observation_id":"ed53b390-05f9-40b0-9a69-66580d265df9","resolution":{"observed_at":"2026-05-22T06:04:40.415524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":"2502.14786","doi":"10.48550/arxiv.2502.14786","metadata_source":"pith","pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","venue":"cs.CV","work_id":"50eec732-2d41-432f-9dcf-ac7fff235ea5","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:53934cb543e41c635247f2324b17eb54b95fc047d7c61b089f4354cdc6a6cc44","observation_id":"951384ae-d9dd-423e-b9dc-9b75ab337c33","resolution":{"observed_at":"2026-05-22T06:04:39.567961Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-10T23:49:08.777694+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T23:49:08.777694+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"12af5aeb-2914-4cbf-ac61-00b255e1d33f","year":2021},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:57b0ba76e71bf628ef3659ca968d018530efa04a2efc88038f9eaa161eacd3fb","observation_id":"50da263a-1afe-4b75-8ac6-2307a3b9dcec","resolution":{"observed_at":"2026-05-22T06:04:40.387256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sigmoid loss for lan- guage image pre-training","venue":null,"work_id":"43716a9c-d13e-4768-850a-d434f3532822","year":2023},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:1de87a65f97c37fd8b6687b3f90dbda4241472b76b9399ad147a85231952def8","observation_id":"09b03789-0aef-4cb7-b089-5fbf02a71b40","resolution":{"observed_at":"2026-05-22T06:04:40.386855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":"2508.10104","doi":"10.1055/a-2487-1252","metadata_source":"pith","pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv3","venue":"cs.CV","work_id":"c8b07deb-8fe7-4e18-9620-f3569d3529ce","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:83891ffd157c79e0842dcbdfc84c39e04c6c4c43a994301c5bc9981d76930137","observation_id":"94b869df-f63b-47f0-92f2-419bf6aae860","resolution":{"observed_at":"2026-05-22T06:04:39.519365Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Auto-encoding variational bayes","venue":null,"work_id":"2b32dc11-c616-4429-ae74-001b67b07f73","year":2014},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:6a075b3942fb0173b8d0b81c1625ad5f97423f81800daf88b63dbbc478ee9ea4","observation_id":"cb3cece6-2abe-4be4-a909-2d40b5103aec","resolution":{"observed_at":"2026-05-22T06:04:40.393886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural discrete representation learning","venue":null,"work_id":"67fd4470-3d20-4aad-8ea7-31ded9715dea","year":2017},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:a63344fe1a1289e3a1a6a7f8c8b1365e0b51e7ef56a8f4ec38db8b05a169543e","observation_id":"aff78fa8-3898-4cd1-85db-0a9cb051df40","resolution":{"observed_at":"2026-05-22T06:04:40.418984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"dbbc27c2-3f8b-46b3-81e4-6c829e3b2cd0","year":2021},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:c2dc7cd8036b60f429453c48efcf452070d39c9d8a4c142be34b149f909edbdc","observation_id":"1dde7466-a354-4260-95ca-477befc5f549","resolution":{"observed_at":"2026-05-22T06:04:40.455003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.23278","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T06:36:52.528059Z","title":"Unilip: Adapting clip for unified multimodal understanding, generation and editing","venue":null,"work_id":"a1bad6a0-54ce-45f8-8478-3169a4b3c6e8","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:8fca35b802fda49d1d7e4c17b6b0c7d24ca8a8948b126aee13430b61a95635c8","observation_id":"8e78287d-ceca-4f1c-93b7-c6f317191a4f","resolution":{"observed_at":"2026-05-22T06:04:39.553324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Latent diffusion model without variational autoencoder","venue":null,"work_id":"e9ec8fad-23d9-4d3b-89c9-9844c7429bc7","year":null},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:2a949fc04c84313eb0c017a4d0fc62b00d51ca8e1c0bacdae3fe0a528da07c8f","observation_id":"bafac140-6089-4381-8dfe-1c272d032eb5","resolution":{"observed_at":"2026-05-22T06:04:40.373234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dualtoken: Towards unifying visual understanding and generation with dual visual vocabularies","venue":null,"work_id":"d2295765-3660-497d-b77f-0b6a1a0e6edf","year":2026},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:3bd2ae83857541775a21e5319292adef32544ada87be264b662541ab90d83560","observation_id":"bb97466a-d69d-427f-bc8e-d4b53c4b6818","resolution":{"observed_at":"2026-05-22T06:04:40.427140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aligning visual foundation encoders to tokenizers for diffusion models","venue":null,"work_id":"3ebe0e7b-a061-4e08-ae16-469cde612327","year":2026},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:64347db508a7297f5bd84efc6f71e54e0b409615e98991cf2a6f91d15258fba7","observation_id":"26c464f8-a04e-4c90-96ff-1e677a906f0d","resolution":{"observed_at":"2026-05-22T06:04:40.422884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.19206","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rpiae: A representation-pivoted autoencoder enhancing both image generation and editing","venue":null,"work_id":"fa9619db-664b-4326-aa6c-2bdb1a0d069c","year":2026},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:7f4523c0bf9e1c1e4fdae0366699ebf7c83cb5a24f9a0a8098220f45ed76460e","observation_id":"bbdc2c87-82f1-43ca-8f46-69c73d3bc703","resolution":{"observed_at":"2026-05-22T06:04:39.527242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.08620","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T16:27:09.514933Z","title":"Improving reconstruction of representation autoencoder","venue":null,"work_id":"0a98c488-49b6-4f10-b39f-142fa412102e","year":2026},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:2d72cec1e795d5394435131be8ea6323c976d040852cb8796d14f25c505f062f","observation_id":"7874dfd3-74aa-46cd-9edd-04a50b60a8f9","resolution":{"observed_at":"2026-05-22T06:04:39.559337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"f2c1b260-29a5-4f0a-9548-0abb890cd8d9","year":2023},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:fdcc6741c8c00f4467f3f7e9471331aa3bb445c1c330ad936981b4a55ea1fcfd","observation_id":"4a1e1961-6385-4102-b525-c76c2da10b45","resolution":{"observed_at":"2026-05-22T06:04:40.383975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable inter- polant transformers","venue":null,"work_id":"9b8567f8-5741-452b-a857-2ed713f70cd8","year":2024},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:5c054b240ccd6b0db82151931813df0933f4332173bb328a8f90ef2983251f3b","observation_id":"5a4e9ad9-e15d-4e0a-8e10-a27a3dc87929","resolution":{"observed_at":"2026-05-22T06:04:40.458610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Representation alignment for generation: Training diffusion transformers is easier than you think","venue":null,"work_id":"cc1a81a6-2154-44eb-bbe8-4877f3f47fae","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:54ffbc9131193fc5c691a2f11c6c74fe5cccfdd24ea1c0062417128b11515a3d","observation_id":"9d54a833-db76-48a0-913e-16cc69fb436f","resolution":{"observed_at":"2026-05-22T06:04:40.448115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What matters for representation alignment: Global information or spatial struc- ture? InICLR","venue":null,"work_id":"62a11285-e1bb-48e6-98e1-9a44d2ea2ab2","year":2026},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:da35fb144c6ba117b6035882ea63e77877e0be461e410d9db0c8e8699624edcd","observation_id":"afd1df7f-b510-408e-830c-c3b2f7b533fb","resolution":{"observed_at":"2026-05-22T06:04:40.451495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Repa-e: Unlocking vae for end-to-end tuning with latent diffusion transformers","venue":null,"work_id":"0aaecb4b-3afd-484c-b665-388d5cb6323b","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:5e6792ee57c3847e282f9a5e8e93f3e4a1b639b0be60e101cc458ae3e2c9c5d0","observation_id":"b21aa6b4-c8e5-475e-991a-5bac8933f29b","resolution":{"observed_at":"2026-05-22T06:04:40.462046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Representation entanglement for generation: Training diffusion transformers is much easier than you think","venue":null,"work_id":"7636d2cb-2ff7-4f60-91c9-d249dd3548a8","year":2026},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:684524e8337a94901dd436ca6b65861fba5cadfa403c0dbc0529e39a00a25803","observation_id":"13e75e7f-55fb-4782-91ec-56a270fc48ff","resolution":{"observed_at":"2026-05-22T06:04:40.441307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Catok: Taming mean flows for one-dimensional causal image tokenization","venue":null,"work_id":"fd10c8f8-62cb-4be1-a66e-5dd5b9a81e35","year":2026},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:558bc6652720dd4a76130d41cace5b42c7e94b38db703a945dcfd531d805c183","observation_id":"fea27401-d7ac-47bb-88ea-9d7d47a00736","resolution":{"observed_at":"2026-05-22T06:04:40.437201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reconstruction vs","venue":null,"work_id":"cf1e2fef-0be4-42d1-887c-c2636fb67a21","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:3f65455b560fe1c81b60832d55583ff2613ec1c173ffe2a3bb3a6489441d61c8","observation_id":"0ab764d0-e786-428a-a8f4-f82f6bb3e5ba","resolution":{"observed_at":"2026-05-22T06:04:40.433851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07778","last_updated":"2026-06-28T16:02:21Z","snapshot_observed_at":"2026-08-04T10:23:32.451665Z","submitted_at":"2025-12-08T17:59:47Z","title":"Distribution Matching Variational AutoEncoder","version":2},"cited_work":{"arxiv_id":"2512.07778","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.07778","snapshot_observed_at":"2026-07-02T02:46:27.655163Z","title":"Distribution matching variational autoencoder","venue":"cs.CV","work_id":"32cea838-5c26-4b9c-9352-17999e9ae5a3","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"cited_paper":"/paper/2512.07778","citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:cfeeee296400a5405388625f30ae0114ee8a4b69d8dba4bbb2ea89b96f594e21","observation_id":"02680db4-7179-4db1-8f95-61aac3c282bb","resolution":{"observed_at":"2026-06-30T02:16:12.075701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.21085","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:46:27.662396Z","title":"Taming sampling perturbations with variance expansion loss for latent diffusion models","venue":null,"work_id":"867e9f31-9445-4ce0-81ab-9064b904375b","year":2026},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:b33d613324ac7939032782d8606618a35a6c1a97669e37c1814322cf2a3e0eb6","observation_id":"b2bf2b4b-fb15-4ed9-aad0-1c10a50c562d","resolution":{"observed_at":"2026-05-22T06:04:39.548368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18457","last_updated":"2026-04-23T08:02:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-21T09:30:45Z","title":"VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":"2510.18457","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.18457","snapshot_observed_at":"2026-07-07T15:43:53.837099Z","title":"VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models","venue":"cs.CV","work_id":"ac74c8b6-a91c-4489-9fcd-ccb7356f4558","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"cited_paper":"/paper/2510.18457","citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:efc45f98d7782c9a0038bc7499f39e03fe10b58e5eade45f9fca2b8c5276cc83","observation_id":"cc9b2146-145a-421b-ac90-df8897645b56","resolution":{"observed_at":"2026-05-22T06:04:39.573208Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative multimodal pretraining with discrete diffusion timestep tokens","venue":null,"work_id":"5d5b4b96-df6a-4811-bd0f-950c1ed1831b","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:e7de97a1e496b94fc3725df4aede6987d284f785a68f0631cf1fb8ea2a4b39a0","observation_id":"2782fa99-0766-4ede-82ba-4f8bddf55cf1","resolution":{"observed_at":"2026-05-22T06:04:40.405469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling rectified flow trans- formers for high-resolution image synthesis","venue":null,"work_id":"0ad3c73f-824f-4027-a44d-59e3cd54ada6","year":2024},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:995c5b9193bd5aba85c4fd143d5b063e8abbba56dd3c3161992cb0c193fecd54","observation_id":"e5d94829-5e0c-46f7-8946-26c2057f0a0d","resolution":{"observed_at":"2026-05-22T06:04:40.390592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.07829","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T15:43:53.790634Z","title":"One layer is enough: Adapting pretrained visual encoders for image generation","venue":null,"work_id":"c17af60a-6f9a-46c8-8b21-915407f8d12b","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:733a0be7cbbd03fcafc4998db515ab1b93503265d95d0a2d5769cc827a0b2ef6","observation_id":"aad30383-0db0-485d-8eaa-59e47e3355fe","resolution":{"observed_at":"2026-05-22T06:04:39.532599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efros, Eli Shechtman, and Oliver Wang","venue":null,"work_id":"295b0b48-b254-4917-b57a-598fd031fcf1","year":2018},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:f38fb6d21ea306baa046d24e3dd4e2e961ae0301beec8a3fedfbdfab75360f84","observation_id":"8ce97d08-2c2b-4812-8640-8196ef304b70","resolution":{"observed_at":"2026-05-22T06:04:40.430575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stylegan-t: Unlocking the power of gans for fast large-scale text-to-image synthesis","venue":null,"work_id":"24a6e5b3-9ab7-4765-9422-c7f85eafd907","year":2023},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:63f90b1e24395b24f580ffa9f892ef52cbee5447e2230853d50dc90bfca40dc4","observation_id":"9ae9841d-3f02-4ee1-92f7-9bb70670605e","resolution":{"observed_at":"2026-05-22T06:04:40.369966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"25a0930e-e306-4e8a-806c-c86ef6f3161a","year":null},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:7daba86b8ee2d1df83978eaa8022be91d4b62ac92f7c2273b0084295f80e766b","observation_id":"73eeb6ce-ffcd-4250-9737-bfe7a5650ec7","resolution":{"observed_at":"2026-05-22T06:04:40.368350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"94c27eda-a70d-4b92-b26c-f73e03434e4a","year":2009},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:6613c17473d3e55cf45db08b8ceaaf31ffc50397a2365b3cb7c61a60cb6c7726","observation_id":"f3411643-0c13-44f2-8939-0269d476ddfb","resolution":{"observed_at":"2026-05-22T06:04:40.364135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bovik, H.R","venue":null,"work_id":"d352003a-e71b-40bb-98ae-896f7d3400df","year":2004},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:ad4a691c27002e277cb5841f0b13e267a8d4146a2c04a15f11c5e33959467de9","observation_id":"f5e9f9bc-45e7-4ae9-8613-a51e6cdcb2b8","resolution":{"observed_at":"2026-05-22T06:04:40.352403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"6747573b-9cdd-4e08-998a-83628d0a39ba","year":null},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:aada327844be0bc20695765e432ea299e5f45c302e5beeb3a2a94bf168ee7097","observation_id":"ad6aeedd-ca43-4f22-94bc-0d0f1a0f1287","resolution":{"observed_at":"2026-05-22T06:04:40.356150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"c23e1c5c-1bf0-4630-a03d-3b8099dfe896","year":2021},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:fc3b5f6599b02bccef07708069306cee7b5cc0c8fee4088e2abb38fe8018c1d7","observation_id":"1c95f0ef-f45d-4a7e-be0e-8e5e8cdf800c","resolution":{"observed_at":"2026-05-22T06:04:40.367081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast training of diffusion models with masked transformers.TMLR","venue":null,"work_id":"17e303e0-5dcb-4c9c-aff0-b23d8279f364","year":2023},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:85d999d283a18eb0fa2edceca61543e9ad88ba957fefae0f9a3536761c409e50","observation_id":"0d48e163-9b42-4b70-a1a7-af082ee73f96","resolution":{"observed_at":"2026-05-22T06:04:40.444687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision transformers need registers","venue":null,"work_id":"bcd8056a-b09c-42c5-beef-8e7fa1d2b05e","year":2024},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:5841cd37b1d4b3a83a25378f4e6455fcb1a6bf12a9d3c2623d4e700ab6fe93d3","observation_id":"3c348dc4-2d18-4628-97bb-dc200131c1d6","resolution":{"observed_at":"2026-05-22T06:04:40.380513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Active Params","venue":null,"work_id":"649f3e4a-3089-4a06-b4e5-e58369ffe056","year":2025},"citing_paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T06:02:33.824296Z"},"links":{"citing_paper":"/paper/2605.22777"},"observation_digest":"sha256:4f10f158cdebd0f92ce8291ada94cf7f542c0e90725c25414ab3bbd772c62ef4","observation_id":"a0825f5a-32d6-425a-9fd4-7ca740552a8c","resolution":{"observed_at":"2026-05-22T06:04:40.402030Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.22777","last_updated":"2026-05-21T17:34:04Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:34:04Z","title":"DecQ: Detail-Condensing Queries for Enhanced Reconstruction and Generation in Representation Autoencoders"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":10,"verified_fuzzy":31},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2605.22777."}