{"as_of":"2026-08-18T19:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3fcf746f57d2c8c5b1ada61e7bce7831cba9629423005e2623bcfe15fefc3516","coverage":[{"denominator":104,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:39:03.631499Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T06:20:13.967906Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.19064","snapshot_observed_at":"2026-07-31T06:20:13.967906Z","title":"Mage-flow: An efficient native-resolution foundation model for image generation and editing.arXiv preprint arXiv:2607.19064, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24904","last_updated":"2026-07-27T17:59:53Z","snapshot_observed_at":"2026-08-15T01:08:05.619745Z","submitted_at":"2026-07-27T17:59:53Z","title":"Mage-VL: An Efficient Codec-Native Streaming Multimodal Foundation Model","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-07-31T06:20:13.967906Z"},"links":{"cited_paper":"/paper/2607.19064","citing_paper":"/paper/2607.24904"},"observation_digest":"sha256:5c9d6f17529be6a91e80ba449501d7894e822b4aa4de547843bd3a5d000fa768","observation_id":"93e28f7c-171f-4728-82e3-4d3ac2da353c","resolution":{"observed_at":"2026-07-31T06:20:13.967906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.19064/citation-record","integrity":"/paper/2607.19064/integrity","json":"/paper/2607.19064/citation-record.json","paper":"/paper/2607.19064"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:56.887949Z","title":"GPT-Image-1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:56.887949Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:c4d514a577dae391e3f35e446dd2b1f7c7a753a1abb01bddd0a3acc8573f4fae","observation_id":"7c858f2d-37e2-4576-815b-b8b10a7ed626","resolution":{"observed_at":"2026-08-01T13:38:56.887949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:56.924522Z","title":"Nano banana pro","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:56.924522Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:2e6829385155197b22deda9fa06980ab1fc2222534f14d49a08ba817ab1103f1","observation_id":"a03491a0-32fc-4918-a1c2-092559d0f3af","resolution":{"observed_at":"2026-08-01T13:38:56.924522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20427","last_updated":"2025-12-10T16:37:54Z","snapshot_observed_at":"2026-08-17T20:41:31.115657Z","submitted_at":"2025-09-24T17:59:04Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.20427","snapshot_observed_at":"2026-08-01T13:38:56.975385Z","title":"Seedream 4.0: Toward next-generation multimodal image generation.arXiv preprint arXiv:2509.20427, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:56.975385Z"},"links":{"cited_paper":"/paper/2509.20427","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:557ead45826ec5bf6a776b897764dc43d1916a1ed6f9bb5183f2439e34b09a2e","observation_id":"867dec0f-04de-4624-a832-1be74c18561a","resolution":{"observed_at":"2026-08-01T13:38:56.975385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-16T18:20:01.123890Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.22699","snapshot_observed_at":"2026-08-01T13:38:57.043949Z","title":"Z-Image: An efficient image generation foundation model with single-stream diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.043949Z"},"links":{"cited_paper":"/paper/2511.22699","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:4a297493920988e9988536e0fe766385f4b760eb12c80689da95f7f93fbba342","observation_id":"2addad3b-66bf-4a6d-8788-c3773a22c735","resolution":{"observed_at":"2026-08-01T13:38:57.043949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-01T13:38:57.100863Z","title":"Qwen-Image technical report.arXiv preprint arXiv:2508.02324, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.100863Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:82490d0befc34e5b51f9a6567b64bb3fc17f2225a11fd88a7b08afd527f2a8f5","observation_id":"caf5ae4d-3e9f-4c13-83b2-2f199c47bf31","resolution":{"observed_at":"2026-08-01T13:38:57.100863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:57.148852Z","title":"FLUX.2: Frontier Visual Intelligence.https://bfl.ai/blog/flux-2, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.148852Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:e9c9d99f6a2c687bbd8454a5641ab2f178637557639546fda90d0c7a1cff2f9c","observation_id":"2df78283-b3cb-422b-8a57-f5f8bade2bfe","resolution":{"observed_at":"2026-08-01T13:38:57.148852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23951","last_updated":"2026-06-26T07:53:46Z","snapshot_observed_at":"2026-08-16T05:43:37.647093Z","submitted_at":"2025-09-28T16:14:10Z","title":"HunyuanImage 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.23951","snapshot_observed_at":"2026-08-01T13:38:57.205563Z","title":"Hun- yuanImage 3.0 technical report.arXiv preprint arXiv:2509.23951, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.205563Z"},"links":{"cited_paper":"/paper/2509.23951","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:2b6095f502c5b565008e70c6e199b57013b71bc1672447e123a3bf63a784696f","observation_id":"4b0e7b2f-59c6-44a2-8965-c61c93a2fd25","resolution":{"observed_at":"2026-08-01T13:38:57.205563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:57.251416Z","title":"FireRed-Image-Edit-1.0 technical report.arXiv preprint arXiv:2602.13344, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.251416Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:4854a656d5aed763b67037f9626940cc111943059aa755811d701fd86a43fc17","observation_id":"fe95fadf-4bd7-42fc-89ec-60dd58f60cbd","resolution":{"observed_at":"2026-08-01T13:38:57.251416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12525","last_updated":"2026-04-15T01:25:27Z","snapshot_observed_at":"2026-08-07T07:03:02.391631Z","submitted_at":"2026-04-14T09:56:25Z","title":"CoD-Lite: Real-Time Diffusion-Based Generative Image Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12525","snapshot_observed_at":"2026-08-01T13:38:57.325252Z","title":"CoD-Lite: Real-time diffusion-based generative image compression.arXiv preprint arXiv:2604.12525, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.325252Z"},"links":{"cited_paper":"/paper/2604.12525","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:39feae32f7050fdd1c714923f0ae0d7c5c8b1da4006bb27fe2786f7f04b15b4c","observation_id":"201da4b4-d1c2-45ae-bfee-27fddabb5969","resolution":{"observed_at":"2026-08-01T13:38:57.325252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03131","last_updated":"2025-06-03T17:57:33Z","snapshot_observed_at":"2026-08-15T22:06:04.960455Z","submitted_at":"2025-06-03T17:57:33Z","title":"Native-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03131","snapshot_observed_at":"2026-08-01T13:38:57.401548Z","title":"Native-resolution image synthesis.arXiv preprint arXiv:2506.03131, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.401548Z"},"links":{"cited_paper":"/paper/2506.03131","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:dc07e38cdd64a55f1cf0b081fecc7dbc9f573ea1d004f02ca11970f6613ea1f5","observation_id":"de2cb3be-e99b-4213-9930-2e68296213a9","resolution":{"observed_at":"2026-08-01T13:38:57.401548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:57.454918Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.454918Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:0aa17a7cc1a3f72df5984f15c323760459596763726957beaa9b8469634af9ad","observation_id":"20d1ab30-9d3d-4609-8e09-0118cf962b08","resolution":{"observed_at":"2026-08-01T13:38:57.454918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:57.503480Z","title":"Flashattention-4: Algorithm and kernel pipelining co-design for asymmetric hardware scaling","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.503480Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:92ccb3baf9014706cb85addc536b3ed9bb4166ab767cafa059287fc85a9f12bf","observation_id":"09139313-3d93-4527-90ff-8e346da9065d","resolution":{"observed_at":"2026-08-01T13:38:57.503480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-01T13:38:57.554506Z","title":"Qwen3-VL technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.554506Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:41f529eced8ea41553614721324d0202fb87058b720a7c6ebd63ce2f2842ed88","observation_id":"844ae3fe-4852-4558-80d8-134a32fda096","resolution":{"observed_at":"2026-08-01T13:38:57.554506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-08-17T17:00:34.924478Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-01T13:38:57.629394Z","title":"DiffusionNFT: Online diffusion reinforcement with forward process.arXiv preprint arXiv:2509.16117, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.629394Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:f22cfc1fd88df69e0d10b4fee1002b9691c339f7f382b245f4a646c5e6732e2d","observation_id":"2480606f-bc55-4b33-9b7b-ecea6f2b8686","resolution":{"observed_at":"2026-08-01T13:38:57.629394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:57.679302Z","title":"Decoupled DMD: CFG augmentation as the spear, distribution matching as the shield.arXiv preprint arXiv:2511.22677, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.679302Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:0f1bd358f4fada93109e54108e939758cabcf13d042ef25dd3547de4f90c66a7","observation_id":"a7bb95ba-960a-4f80-b567-b7fd2d27a160","resolution":{"observed_at":"2026-08-01T13:38:57.679302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:57.726959Z","title":"SenseFlow: Scaling distribution matching for flow-based text-to-image distillation.arXiv preprint arXiv:2506.00523, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.726959Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:ed8c66ad974e184523e7229e9c9e10b82a8c99d72b7b8bc0e900ccb01231a9f7","observation_id":"4ad20234-223c-47f7-8ca9-149a0f2737f4","resolution":{"observed_at":"2026-08-01T13:38:57.726959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-01T13:38:57.803279Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.803279Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:2022b3d042ec6712749a79c0af62a16cd7bd41adba7d81d4ea08ff74172ddbe6","observation_id":"0e69ebc9-2c60-45c6-ba70-8a2af00871b6","resolution":{"observed_at":"2026-08-01T13:38:57.803279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-01T13:38:57.855740Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.855740Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:f3df8d3e6a5e455f4040891778ac5327656599cda5f5530139123fa041f2c4cb","observation_id":"9e06cb87-b24a-4320-8b34-35bcf6cefc1f","resolution":{"observed_at":"2026-08-01T13:38:57.855740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:57.916664Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.916664Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:8353b8c4d1b85734abcce58b9d54d1b089b9da950d4c8a0ad225605dccbaa7e9","observation_id":"c9f2b032-6057-4b7e-83de-8ba367a00a76","resolution":{"observed_at":"2026-08-01T13:38:57.916664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-08-13T01:47:21.043519Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-01T13:38:57.972786Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:57.972786Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:27498ea4f39cc2813f05a98d9ff30371c8f7e5f87474b3c35ddac546a2716da4","observation_id":"4e49f345-b2ed-4d04-9dd9-e9a07f901e9a","resolution":{"observed_at":"2026-08-01T13:38:57.972786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-08-16T01:17:28.297637Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-01T13:38:58.003534Z","title":"SANA: Efficient high-resolution image synthesis with linear diffusion transformers.arXiv preprint arXiv:2410.10629, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.003534Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:034214ffb9a1a7e9c56109c2708c63abc3d6fc549f8972747b05e33baca49991","observation_id":"cf826c32-e353-44c8-a806-33a7b733fc3e","resolution":{"observed_at":"2026-08-01T13:38:58.003534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07584","last_updated":"2025-12-08T14:26:40Z","snapshot_observed_at":"2026-08-16T15:04:17.022785Z","submitted_at":"2025-12-08T14:26:40Z","title":"LongCat-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.07584","snapshot_observed_at":"2026-08-01T13:38:58.078447Z","title":"LongCat-Image technical report.arXiv preprint arXiv:2512.07584, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.078447Z"},"links":{"cited_paper":"/paper/2512.07584","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:b8e00110fd220750883bc1eb099d264440ef933b5f9cf0c95b59912eceae206a","observation_id":"2f36cf89-305f-4a2a-8bea-5aff780c04d2","resolution":{"observed_at":"2026-08-01T13:38:58.078447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-16T16:53:14.231987Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-01T13:38:58.155927Z","title":"SDEdit: Guided image synthesis and editing with stochastic differential equations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.155927Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:b03635ec74d00232bc420a8268224356b240ccae28891ad751e989fd232ca420","observation_id":"5298febc-690e-4bf0-bb70-b7468b877dba","resolution":{"observed_at":"2026-08-01T13:38:58.155927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-08-17T00:44:11.103098Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-01T13:38:58.231018Z","title":"Prompt-to-prompt image editing with cross attention control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.231018Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:0100218880172babb476917e86b9a715f7b64daf726b8d568629352b39ba4693","observation_id":"c2dbfc13-eb9a-4914-b814-2d5c8cb04fc8","resolution":{"observed_at":"2026-08-01T13:38:58.231018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09794","last_updated":"2022-11-17T18:58:14Z","snapshot_observed_at":"2026-08-16T16:15:18.430181Z","submitted_at":"2022-11-17T18:58:14Z","title":"Null-text Inversion for Editing Real Images using Guided Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09794","snapshot_observed_at":"2026-08-01T13:38:58.309489Z","title":"Null-text inver- sion for editing real images using guided diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.309489Z"},"links":{"cited_paper":"/paper/2211.09794","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:993f354745b0ac3c0d765cb2f29c20f1b0951cc355d46864eaa74107bb64a7d7","observation_id":"8b52b593-fa08-442f-9fb4-74f891b68927","resolution":{"observed_at":"2026-08-01T13:38:58.309489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-14T19:07:37.876970Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05543","snapshot_observed_at":"2026-08-01T13:38:58.387540Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.387540Z"},"links":{"cited_paper":"/paper/2302.05543","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:f9445a2f452e648d4d2271ed75096e8534a2c384b20b33b7580eec9dc17dc251","observation_id":"f6d52b50-0b91-4bad-8c21-63dddc16fca9","resolution":{"observed_at":"2026-08-01T13:38:58.387540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-01T13:38:58.465961Z","title":"IP-Adapter: Text compatible image prompt adapter for text-to-image diffusion models.arXiv preprint arXiv:2308.06721, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.465961Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:f1117fe560316597cf75ffbc86e6d4f44c38d08f1ad1a4eccc3e38dcb5a9083b","observation_id":"eddd52a5-a990-4f9f-8fab-8d00bfc7410d","resolution":{"observed_at":"2026-08-01T13:38:58.465961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-16T16:15:18.101197Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-01T13:38:58.541944Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.541944Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:c8f5550b46eb09a20fa37fc207f1153c8252ef873cbd60dfbca23f4c3c4463b9","observation_id":"c1b52947-7354-4cd5-b1bc-5a32b213b692","resolution":{"observed_at":"2026-08-01T13:38:58.541944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10012","last_updated":"2024-05-15T18:20:28Z","snapshot_observed_at":"2026-08-17T20:01:57.006733Z","submitted_at":"2023-06-16T17:58:58Z","title":"MagicBrush: A Manually Annotated Dataset for Instruction-Guided Image Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10012","snapshot_observed_at":"2026-08-01T13:38:58.619557Z","title":"MagicBrush: A manually annotated dataset for instruction-guided image editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.619557Z"},"links":{"cited_paper":"/paper/2306.10012","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:aff8961f04b4bbe5d58f6c9e928bb48e42fe22faa79f747ad29e8277a29f757d","observation_id":"090f9787-40e8-4df9-8831-c0ee248d3ef9","resolution":{"observed_at":"2026-08-01T13:38:58.619557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15738","last_updated":"2025-03-29T04:08:47Z","snapshot_observed_at":"2026-08-12T13:55:13.088452Z","submitted_at":"2024-11-24T07:02:56Z","title":"AnyEdit: Mastering Unified High-Quality Image Editing for Any Idea","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15738","snapshot_observed_at":"2026-08-01T13:38:58.696043Z","title":"AnyEdit: Mastering unified high-quality image editing for any idea.arXiv preprint arXiv:2411.15738, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.696043Z"},"links":{"cited_paper":"/paper/2411.15738","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:3efc750dbab5a21d57854ace98aff24cba171da37009b329e73b2f686a96094e","observation_id":"3f0a1cbb-d910-4645-bf05-9289ef78d3d8","resolution":{"observed_at":"2026-08-01T13:38:58.696043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05282","last_updated":"2024-12-19T04:42:41Z","snapshot_observed_at":"2026-08-16T13:36:28.632704Z","submitted_at":"2024-07-07T06:50:22Z","title":"UltraEdit: Instruction-based Fine-Grained Image Editing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05282","snapshot_observed_at":"2026-08-01T13:38:58.775084Z","title":"UltraEdit: Instruction-based fine-grained image editing at scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.775084Z"},"links":{"cited_paper":"/paper/2407.05282","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:d6c27c1f8245e2975ab2665e1f921e449e2210e35a4b2bf7abd6f27aa80ae8a6","observation_id":"c7e83a77-e2d9-4c4a-91b6-96dd4493fe33","resolution":{"observed_at":"2026-08-01T13:38:58.775084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11340","last_updated":"2024-11-21T14:09:12Z","snapshot_observed_at":"2026-08-16T13:17:46.268142Z","submitted_at":"2024-09-17T16:42:46Z","title":"OmniGen: Unified Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11340","snapshot_observed_at":"2026-08-01T13:38:58.852140Z","title":"OmniGen: Unified image generation.arXiv preprint arXiv:2409.11340, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.852140Z"},"links":{"cited_paper":"/paper/2409.11340","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:62c473001a5320df692a632dd91ac4e492c7b3b5308661f7579fda64a344fb18","observation_id":"ffcbb146-f548-4a9d-bf67-e30f7a882312","resolution":{"observed_at":"2026-08-01T13:38:58.852140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-08-14T01:48:52.921086Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-01T13:38:58.926972Z","title":"FLUX.1 Kontext: Flow matching for in-context image generation and editing in latent space.arXiv preprint arXiv:2506.15742, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.926972Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:6700a49cbe6c06821459c3a332abaf78f6c20e455c50059b4ec2bace17aaad8b","observation_id":"36e25413-9e8c-4741-add3-0a35ae89995d","resolution":{"observed_at":"2026-08-01T13:38:58.926972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-08-15T10:26:22.896514Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-08-01T13:38:59.002094Z","title":"Step1X-Edit: A practical framework for general image editing.arXiv preprint arXiv:2504.17761, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.002094Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:36e6e5cd878ff2f14620bcf5871b7f916e9179d726fa8049495cfdbe3729cb71","observation_id":"5f401557-ecb4-4f86-b1f2-03ccb4b38f43","resolution":{"observed_at":"2026-08-01T13:38:59.002094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20690","last_updated":"2025-09-23T02:34:36Z","snapshot_observed_at":"2026-08-17T21:14:36.177695Z","submitted_at":"2025-04-29T12:14:47Z","title":"In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20690","snapshot_observed_at":"2026-08-01T13:38:59.071167Z","title":"In-context edit: Enabling instructional image editing with in-context generation in large scale diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.071167Z"},"links":{"cited_paper":"/paper/2504.20690","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:ba1d6de906acfedd0f58da5d9fcad0950b41d99ebb6f190a8e6ee2b19e48ebb9","observation_id":"1a7e7e98-7daa-4008-9502-e5cd10a8fbb4","resolution":{"observed_at":"2026-08-01T13:38:59.071167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18871","last_updated":"2026-04-21T17:32:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-23T17:38:54Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18871","snapshot_observed_at":"2026-08-01T13:38:59.153282Z","title":"OmniGen2: Towards instruction-aligned multimodal generation.arXiv preprint arXiv:2506.18871, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.153282Z"},"links":{"cited_paper":"/paper/2506.18871","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:69f2298fe3aaf6e5843a88bed30d5230668513081e75dcc8ce8ec2e9312a1b7b","observation_id":"36ead65f-0f28-4550-80eb-e950efe7ff9c","resolution":{"observed_at":"2026-08-01T13:38:59.153282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03147","last_updated":"2025-06-18T18:00:05Z","snapshot_observed_at":"2026-08-12T23:49:38.644434Z","submitted_at":"2025-06-03T17:59:33Z","title":"UniWorld-V1: High-Resolution Semantic Encoders for Unified Visual Understanding and Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03147","snapshot_observed_at":"2026-08-01T13:38:59.228524Z","title":"UniWorld-V1: High-resolution semantic encoders for unified visual understanding and generation.arXiv preprint arXiv:2506.03147, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.228524Z"},"links":{"cited_paper":"/paper/2506.03147","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:4f06980d5b138458b8367029b5e100920163399cb1134be0b1b2c6859c05020f","observation_id":"5f7cdefe-80cf-497b-a054-552bee745057","resolution":{"observed_at":"2026-08-01T13:38:59.228524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:59.302105Z","title":"DreamOmni2: Multimodal instruction-based editing and generation.arXiv preprint arXiv:2510.06679, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.302105Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:28dad24f25c4ca1544c8b9aca18bd59c14f650fd9b9ae1f05ad458d7e8a44043","observation_id":"edcccec8-7a7a-45d2-b4cb-ba914eeff2bf","resolution":{"observed_at":"2026-08-01T13:38:59.302105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:59.377034Z","title":"ChronoEdit: Towards temporal reasoning for image editing and world simulation.arXiv preprint arXiv:2510.04290, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.377034Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:e37a58651995599225d44260a5be9e04cd953f1204812d31d28622f60112f1a1","observation_id":"8b3ec910-4a54-4bee-ac4c-4d29a3980316","resolution":{"observed_at":"2026-08-01T13:38:59.377034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:38:59.536517Z","title":"Unified multimodal understanding and generation models: Advances, challenges, and opportunities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.536517Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:a7db6260fedf477706517af3c04bc900a10ec156a7c6e1e9615bd9c33d90aabe","observation_id":"c336bbc0-76c2-4e01-aa17-deb069316bb0","resolution":{"observed_at":"2026-08-01T13:38:59.536517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-08-12T12:44:22.350068Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-01T13:38:59.596720Z","title":"Janus-Pro: Unified multimodal understanding and generation with data and model scaling.arXiv preprint arXiv:2501.17811, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.596720Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:853baa5de7626d5511dbce24e1c8b20f484b0583053f07017db0b4888055f655","observation_id":"e5c40435-63c8-46d4-bbe6-4fb84ca9c26a","resolution":{"observed_at":"2026-08-01T13:38:59.596720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-08-11T01:34:46.484513Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-01T13:38:59.683081Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model.arXiv preprint arXiv:2408.11039, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.683081Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:4650b049dd4cb5de6c0b350cc70e4fa59a1208c6d4b9c73018725e5803766377","observation_id":"20f4b33d-764a-44e3-af8f-2f703e0e4874","resolution":{"observed_at":"2026-08-01T13:38:59.683081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-08-17T01:11:44.872398Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-01T13:38:59.778271Z","title":"Emerging properties in unified multimodal pretraining.arXiv preprint arXiv:2505.14683, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.778271Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:e507a6deefbc331b717444c4b64b1dab535eb42a9fd795c9347388abb07d8e5b","observation_id":"05b9b181-ce16-4210-ac53-c2ab4d676511","resolution":{"observed_at":"2026-08-01T13:38:59.778271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.26583","last_updated":"2025-10-30T15:11:16Z","snapshot_observed_at":"2026-08-11T01:57:48.271968Z","submitted_at":"2025-10-30T15:11:16Z","title":"Emu3.5: Native Multimodal Models are World Learners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.26583","snapshot_observed_at":"2026-08-01T13:38:59.844112Z","title":"Emu3.5: Native multimodal models are world learners.arXiv preprint arXiv:2510.26583, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.844112Z"},"links":{"cited_paper":"/paper/2510.26583","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:2bd489168787d213f51eef2bb20fb770c7abf7be0999fcd52baa6ffb8115086e","observation_id":"42c2eeee-3ea5-4ec5-abb1-324f0b42951a","resolution":{"observed_at":"2026-08-01T13:38:59.844112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00937","last_updated":"2018-05-30T14:58:27Z","snapshot_observed_at":"2026-08-14T20:17:29.355571Z","submitted_at":"2017-11-02T21:14:44Z","title":"Neural Discrete Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00937","snapshot_observed_at":"2026-08-01T13:38:59.903309Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:59.903309Z"},"links":{"cited_paper":"/paper/1711.00937","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:a7f0e64c2be008855ca12a01a22d548d46f4aa8848db14fd273c6ea4599560cf","observation_id":"f72ccbc2-56f5-4ffa-b4cb-6f596a0c66b4","resolution":{"observed_at":"2026-08-01T13:38:59.903309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09841","last_updated":"2021-06-23T16:07:21Z","snapshot_observed_at":"2026-08-16T18:57:41.827625Z","submitted_at":"2020-12-17T18:57:28Z","title":"Taming Transformers for High-Resolution Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09841","snapshot_observed_at":"2026-08-01T13:39:00.040780Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.040780Z"},"links":{"cited_paper":"/paper/2012.09841","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:4cb36b0ffa3677edce0ab0330d3afcc2daf085d76e9444cfadb37ee025f05b43","observation_id":"d0707cb4-3fa8-4053-8994-3dca0f5a748d","resolution":{"observed_at":"2026-08-01T13:39:00.040780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:00.130092Z","title":"PSC: Posterior sampling-based compression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.130092Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:7268b027af0dfd818f6e24f0053a45d8a6d83d07cdc05e0d84cf65c2a44df862","observation_id":"c30cf372-f403-47b9-b7c8-a8cae7761fcf","resolution":{"observed_at":"2026-08-01T13:39:00.130092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:00.218182Z","title":"Idempotence and perceptual image compression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.218182Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:58aac8158e27e6e1519a3d0efa7aebdb759072f20919d4029d4efd9421ac1ecd","observation_id":"15979df8-17ca-45f6-8cd7-ae92b0936cfc","resolution":{"observed_at":"2026-08-01T13:39:00.218182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08281","last_updated":"2025-05-13T06:51:23Z","snapshot_observed_at":"2026-08-15T21:56:33.304166Z","submitted_at":"2025-05-13T06:51:23Z","title":"Ultra Lowrate Image Compression with Semantic Residual Coding and Compression-aware Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08281","snapshot_observed_at":"2026-08-01T13:39:00.290997Z","title":"Ultra lowrate image compression with semantic residual coding and compression-aware diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.290997Z"},"links":{"cited_paper":"/paper/2505.08281","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:c64dbb2a57957897681705a9f410bcc5459f38e67b721bef34a85975df44ad92","observation_id":"2426fc3d-d7fc-4c18-87fe-937d84e01605","resolution":{"observed_at":"2026-08-01T13:39:00.290997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:00.387092Z","title":"Oscar: One-step diffusion codec across multiple bit-rates.arXiv preprint arXiv:2505.16091, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.387092Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:4646d22a267cdd6b3a6c8c715a53a3783c1a2227159dd241912d10b505d384a4","observation_id":"c4b9c307-ced5-4b5c-ba3c-36b57d53c5fe","resolution":{"observed_at":"2026-08-01T13:39:00.387092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:00.454054Z","title":"One-step diffusion- based image compression with semantic distillation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.454054Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:ea7a8511b2791c7277d35502e87fb53558a1ff6b8856a5be92aca61fc118a88b","observation_id":"c59652cb-0a85-491c-8cb7-75fb88110b5a","resolution":{"observed_at":"2026-08-01T13:39:00.454054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:00.504066Z","title":"Stablecodec: Taming one-step diffusion for extreme image compression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.504066Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:19ce921c6fbfc16dd53967225d9d493305daadc3604b57bb2f9c4c4cae5a8c4c","observation_id":"99061f9e-94ed-48a7-8e9c-e894da94eddd","resolution":{"observed_at":"2026-08-01T13:39:00.504066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12908","last_updated":"2023-11-21T15:24:05Z","snapshot_observed_at":"2026-08-17T04:35:03.542549Z","submitted_at":"2023-11-21T15:24:05Z","title":"Diffusion Model Alignment Using Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12908","snapshot_observed_at":"2026-08-01T13:39:00.559315Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.559315Z"},"links":{"cited_paper":"/paper/2311.12908","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:c42ce59c025d49dee01458fefb2ffdab95eee8469b77e178ff911bcd60aa6271","observation_id":"b9375506-9260-4b10-a3c0-531fc23b75dc","resolution":{"observed_at":"2026-08-01T13:39:00.559315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13231","last_updated":"2024-03-23T05:23:00Z","snapshot_observed_at":"2026-08-17T08:55:14.951017Z","submitted_at":"2023-11-22T08:42:46Z","title":"Using Human Feedback to Fine-tune Diffusion Models without Any Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13231","snapshot_observed_at":"2026-08-01T13:39:00.614946Z","title":"Using human feedback to fine-tune diffusion models without any reward model.arXiv preprint arXiv:2311.13231, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.614946Z"},"links":{"cited_paper":"/paper/2311.13231","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:4baa94784514be7e4a93bd2ea5aa6e9e0a7a6a6e95b2ba9fef19b8b372f2e9e2","observation_id":"62e00815-c6f2-4b3c-a13b-9a73bf269324","resolution":{"observed_at":"2026-08-01T13:39:00.614946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-01T13:39:00.643520Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.643520Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:30e668b4b608fb9295a8c0a20ac820f7c14ba8be86e26572c88cc42c102ce451","observation_id":"c0d52c28-1555-44a7-8288-fdbe87edf7df","resolution":{"observed_at":"2026-08-01T13:39:00.643520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-16T15:40:56.445501Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-01T13:39:00.645797Z","title":"ImageReward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.645797Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:3cc9bbabf85ce741df258aded54bf95be6527d55a4f1084f913176d8e82d99db","observation_id":"3fc4c5fe-f406-4084-a671-33dbcfab3280","resolution":{"observed_at":"2026-08-01T13:39:00.645797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-13T10:15:00.293616Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-08-01T13:39:00.648008Z","title":"Flow-GRPO: Training flow matching models via online rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.648008Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:20c1421c1561e3723f41c6ce51e433ca037503f0d494b60cf61150869245e496","observation_id":"d24b80c5-1f5f-4fdf-ba7d-9c3b74d4c069","resolution":{"observed_at":"2026-08-01T13:39:00.648008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-01T13:39:00.654356Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.654356Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:f6b445407d93034f25a656f52b5f0f4bdba312553e49355ff6e4fd09692862e5","observation_id":"48cfba86-f6d4-456c-8a35-f3d9ff4f1694","resolution":{"observed_at":"2026-08-01T13:39:00.654356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00512","last_updated":"2022-06-07T09:17:35Z","snapshot_observed_at":"2026-08-12T01:14:44.484432Z","submitted_at":"2022-02-01T16:07:25Z","title":"Progressive Distillation for Fast Sampling of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00512","snapshot_observed_at":"2026-08-01T13:39:00.671567Z","title":"Progressive distillation for fast sampling of diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.671567Z"},"links":{"cited_paper":"/paper/2202.00512","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:52bd7be49d28b50a3950bc0dc44d72d1137dfa74aec1c3d9c9f7756df9f0b7e5","observation_id":"d47167c3-df29-49be-972d-961edb666606","resolution":{"observed_at":"2026-08-01T13:39:00.671567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01469","last_updated":"2023-05-31T06:17:10Z","snapshot_observed_at":"2026-08-15T07:00:23.337991Z","submitted_at":"2023-03-02T18:30:16Z","title":"Consistency Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01469","snapshot_observed_at":"2026-08-01T13:39:00.690382Z","title":"Consistency models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.690382Z"},"links":{"cited_paper":"/paper/2303.01469","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:bded3191f9e59498af178865923ba577602e5598d2cc07968c5019bd4696eef2","observation_id":"0a311b42-3d05-4c4c-87a8-7738d67d31e3","resolution":{"observed_at":"2026-08-01T13:39:00.690382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-01T13:39:00.712002Z","title":"Latent consistency models: Synthesizing high-resolution images with few-step inference.arXiv preprint arXiv:2310.04378, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.712002Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:fb090f00bade16087536826e5c6730f9314f32836aebe3948303c97c00d121bd","observation_id":"cbce2025-82bf-45f5-b34d-7221b4b28df8","resolution":{"observed_at":"2026-08-01T13:39:00.712002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06380","last_updated":"2024-03-23T14:22:39Z","snapshot_observed_at":"2026-08-17T23:15:49.530355Z","submitted_at":"2023-09-12T16:42:09Z","title":"InstaFlow: One Step is Enough for High-Quality Diffusion-Based Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06380","snapshot_observed_at":"2026-08-01T13:39:00.740696Z","title":"InstaFlow: One step is enough for high-quality diffusion-based text-to-image generation.arXiv preprint arXiv:2309.06380, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.740696Z"},"links":{"cited_paper":"/paper/2309.06380","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:3ae825299708c42ef0bb34d500b03be720c792cbce59f20f163f9ce4e1fc1b1d","observation_id":"b5dee52d-cb1c-48c3-9eeb-cd4b5da2ce82","resolution":{"observed_at":"2026-08-01T13:39:00.740696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18828","last_updated":"2024-10-04T04:41:06Z","snapshot_observed_at":"2026-08-18T09:02:50.870995Z","submitted_at":"2023-11-30T18:59:20Z","title":"One-step Diffusion with Distribution Matching Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18828","snapshot_observed_at":"2026-08-01T13:39:00.769992Z","title":"Freeman, and Taesung Park","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.769992Z"},"links":{"cited_paper":"/paper/2311.18828","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:f28b3b1657c7115b729d5bee5baecd88f817aab0fa0d7c17b844a86040992ad6","observation_id":"abf273b7-fbfd-4bf3-ac8e-e1061e82f7f3","resolution":{"observed_at":"2026-08-01T13:39:00.769992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14867","last_updated":"2024-05-24T17:08:32Z","snapshot_observed_at":"2026-08-18T09:01:26.380098Z","submitted_at":"2024-05-23T17:59:49Z","title":"Improved Distribution Matching Distillation for Fast Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14867","snapshot_observed_at":"2026-08-01T13:39:00.804000Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.804000Z"},"links":{"cited_paper":"/paper/2405.14867","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:407838fe4eeac1b516fad14adc08b80ffab0033bb8e9f4325857932ea8b008e7","observation_id":"47c7b04b-57df-48ad-8848-a89fb31b278b","resolution":{"observed_at":"2026-08-01T13:39:00.804000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17042","last_updated":"2023-11-28T18:53:24Z","snapshot_observed_at":"2026-08-16T14:39:31.496511Z","submitted_at":"2023-11-28T18:53:24Z","title":"Adversarial Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17042","snapshot_observed_at":"2026-08-01T13:39:00.844047Z","title":"Adversarial diffusion distillation.arXiv preprint arXiv:2311.17042, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.844047Z"},"links":{"cited_paper":"/paper/2311.17042","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:2bf09aca772dd07d5d6e8f4853b20f5acdd13c6aef2407414b82548e444a03d9","observation_id":"0890521d-9330-4257-a37e-bb1ec2e819a7","resolution":{"observed_at":"2026-08-01T13:39:00.844047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13686","last_updated":"2024-11-04T13:24:18Z","snapshot_observed_at":"2026-08-16T13:59:07.264939Z","submitted_at":"2024-04-21T15:16:05Z","title":"Hyper-SD: Trajectory Segmented Consistency Model for Efficient Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13686","snapshot_observed_at":"2026-08-01T13:39:00.878827Z","title":"Hyper-SD: Trajectory segmented consistency model for efficient image synthesis.arXiv preprint arXiv:2404.13686, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.878827Z"},"links":{"cited_paper":"/paper/2404.13686","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:115468f4017d1fd74cb4b806ef640dc368d8cef577c1d05a97df26fe3dc2bd56","observation_id":"18df3e63-b085-49dc-b6a2-60b408d9d962","resolution":{"observed_at":"2026-08-01T13:39:00.878827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-01T13:39:00.914446Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.914446Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:e951d9b97b1a0701e395c46502faa235eff00dd4bc26e1efae54765e063fd158","observation_id":"02ca7cdd-de6f-40dd-a998-84450ccd57d4","resolution":{"observed_at":"2026-08-01T13:39:00.914446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:00.946160Z","title":"DINOv2: Learning robust visual features without supervision.Transactions on Machine Learning Research (TMLR),","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.946160Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:f4de426dd1de38bbef676050c2ca1aa8cd5bec26a38fd196b843ea7da5c2eb41","observation_id":"df63657b-cab9-42ae-95d2-83d830e131af","resolution":{"observed_at":"2026-08-01T13:39:00.946160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:00.997668Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.997668Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:19fc868cd1caed0e739e298b45a8deca113b8387a3cd0708d98ad1a1cd405b19","observation_id":"7f3b2dc1-4220-4de6-a698-f5c499de4024","resolution":{"observed_at":"2026-08-01T13:39:00.997668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.070376Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.070376Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:c19ebf3b2ecbe24a9be9aa5f892fc6aa6feb1d37773b2b296ff8ec4d8d4807f4","observation_id":"bf2a221a-815e-44b7-a3ad-31e7c4e5665f","resolution":{"observed_at":"2026-08-01T13:39:01.070376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.146797Z","title":"Dico: Revitalizing convnets for scalable and efficient diffusion modeling.Advances in neural information processing systems, 38:123582–123618, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.146797Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:72d7ae40fd9b871e49addf3ca6b11c57591eb7c3262d227a2ea22d1e65fd64fb","observation_id":"1fb8bc60-1137-493d-b132-0c4f93888226","resolution":{"observed_at":"2026-08-01T13:39:01.146797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.220849Z","title":"Deco: Frequency- decoupled pixel diffusion for end-to-end image generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.220849Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:322af9569d117a49a59e76d0cb0df64f484eff72560b980e812e5d2609d24534","observation_id":"9ba22d58-4a5d-4d10-9e1f-74e84cfa4bc2","resolution":{"observed_at":"2026-08-01T13:39:01.220849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-01T13:39:01.332817Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.332817Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:706dfa9e07f492b4b8c878f0ae9552bff79698b9cd7cef6eebc89ac312606d15","observation_id":"4e977c98-44d8-49f9-aff4-fc3a73154d75","resolution":{"observed_at":"2026-08-01T13:39:01.332817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.393850Z","title":"Cod: A diffusion foundation model for image compression","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.393850Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:6da05efa82a7907f7141be5ed00d66b7a7167df413d87a7b055b3e3580ff615c","observation_id":"b4e21bfb-8fb3-4844-8a64-d8adc314aca8","resolution":{"observed_at":"2026-08-01T13:39:01.393850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.484545Z","title":"Projected gans converge faster.Advances in Neural Information Processing Systems, 34:17480–17492, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.484545Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:401795798bea4b713304fd4aa59ad93d109542c5251086dfc858d3a02707f00e","observation_id":"16f74ce5-af68-4198-b619-0f30d58f1740","resolution":{"observed_at":"2026-08-01T13:39:01.484545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.572512Z","title":"Workshop and challenge on learned image compression(clic2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.572512Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:7a668a1ffeea20812ffc51110a8e94c11f9e0513ebe9f850eab2e98da46f18cb","observation_id":"ee880791-15fe-48bd-b680-11a752b5b8cc","resolution":{"observed_at":"2026-08-01T13:39:01.572512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.662209Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.662209Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:de5a5a53202cb92a62f6bf3f01ce9170eb06b2441ce3423f50bd3bc98cbc0f97","observation_id":"f95c4b44-3529-433a-8e9d-605289a7b612","resolution":{"observed_at":"2026-08-01T13:39:01.662209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.730192Z","title":"A self-supervised descriptor for image copy detection.Proc","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.730192Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:9e1ef7f9ee4dccd45bd9d1baf952565cf735f635d064e45c24cd8c5e2c4814a8","observation_id":"92973f4a-1131-4b7a-8110-c83a7b20ab40","resolution":{"observed_at":"2026-08-01T13:39:01.730192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.780574Z","title":"The faiss library","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.780574Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:b3cf5d89e33a54a27c2717d24071a3adfe58df835da42b6fa3bd69af8410bcb5","observation_id":"ab548f73-158c-4cd4-9e11-5790eb679201","resolution":{"observed_at":"2026-08-01T13:39:01.780574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:01.841799Z","title":"Qwen3.5: Towards native multimodal agents, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.841799Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:12d75a762b95ba90fdf1a321c6d91d3616516d3a96f0b1483dd7834486dcabd6","observation_id":"282dfb98-9c11-4967-9f5c-8fc5b304feea","resolution":{"observed_at":"2026-08-01T13:39:01.841799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21957","last_updated":"2026-04-03T06:49:11Z","snapshot_observed_at":"2026-08-13T13:13:25.351259Z","submitted_at":"2026-01-29T16:35:04Z","title":"PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21957","snapshot_observed_at":"2026-08-01T13:39:01.931696Z","title":"Paddleocr-vl-1.5: Towards a multi- task 0.9 b vlm for robust in-the-wild document parsing.arXiv preprint arXiv:2601.21957, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:01.931696Z"},"links":{"cited_paper":"/paper/2601.21957","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:a9307852cbd4df4973987f2e6a1ae60aeda9b9b3dd9ca246a4f810c70b1e2853","observation_id":"7765a8cd-f69c-4363-823e-33e14df585e8","resolution":{"observed_at":"2026-08-01T13:39:01.931696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11626","last_updated":"2026-04-14T06:06:15Z","snapshot_observed_at":"2026-08-15T01:35:03.521855Z","submitted_at":"2026-04-13T15:38:09Z","title":"RationalRewards: Reasoning Rewards Scale Visual Generation Both Training and Test Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11626","snapshot_observed_at":"2026-08-01T13:39:02.050193Z","title":"RationalRewards: Reasoning rewards scale visual generation both training and test time","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.050193Z"},"links":{"cited_paper":"/paper/2604.11626","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:ef7dd9c63b70825c1649b07233321c52895e14bbbc0b16486209ca8b9259db89","observation_id":"85f154f6-6202-42da-9ffd-d37415edcbad","resolution":{"observed_at":"2026-08-01T13:39:02.050193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:02.137873Z","title":"GenEval: An object-focused framework for evaluating text-to-image alignment.Advances in Neural Information Process- ing Systems (NeurIPS), 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.137873Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:12efe5358016d9269074f9c788e2971999791a3bfa88ad38e07c92e868250952","observation_id":"cdfa1da9-0b93-4582-98d5-414bbe3a6f68","resolution":{"observed_at":"2026-08-01T13:39:02.137873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-12T17:58:56.652054Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-01T13:39:02.199843Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment.arXiv preprint arXiv:2403.05135, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.199843Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:dfc254048d9c2f67d5a0eb49a6cf26ddb48938a52c82e47a010eb68164ec09b7","observation_id":"cb372af2-8094-4a66-9d64-ab9b0d0024e9","resolution":{"observed_at":"2026-08-01T13:39:02.199843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02161","last_updated":"2026-07-12T08:53:18Z","snapshot_observed_at":"2026-08-13T12:37:57.526772Z","submitted_at":"2025-06-02T18:44:07Z","title":"TIIF-Bench: How Does Your T2I Model Follow Your Instructions?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02161","snapshot_observed_at":"2026-08-01T13:39:02.289063Z","title":"Tiif- bench: How does your t2i model follow your instructions?arXiv preprint arXiv:2506.02161, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.289063Z"},"links":{"cited_paper":"/paper/2506.02161","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:fe2f8d4d619ffec0088a0bcafdd21c1872d56ed5b50cd5c6460bb4c26dfcd9ba","observation_id":"4feca48a-f4ad-44a7-a0c2-3b5d4199eb00","resolution":{"observed_at":"2026-08-01T13:39:02.289063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:02.359479Z","title":"Oneig-bench: Omni-dimensional nuanced evaluation for image generation.Advances in Neural Information Processing Systems, 38, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.359479Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:886d4dd5d445f9e312fbec7f17879d9a6a6182504fc4fcb462f5b07e38ae61c8","observation_id":"63e413cf-ac4b-4e54-97dc-57392f0ec55e","resolution":{"observed_at":"2026-08-01T13:39:02.359479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:02.440005Z","title":"Textcrafter: Accurately rendering multiple texts in complex visual scenes","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.440005Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:2ba60f882308513bfdd170793d916ceab7a6ee8fb87497dab0a28ca82409397b","observation_id":"bda2eae2-6e1d-40c8-9e17-cb5a4d868bca","resolution":{"observed_at":"2026-08-01T13:39:02.440005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22058","last_updated":"2025-07-29T17:59:04Z","snapshot_observed_at":"2026-08-15T19:53:33.201174Z","submitted_at":"2025-07-29T17:59:04Z","title":"X-Omni: Reinforcement Learning Makes Discrete Autoregressive Image Generative Models Great Again","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22058","snapshot_observed_at":"2026-08-01T13:39:02.492645Z","title":"X-omni: Reinforcement learning makes discrete autoregressive image generative models great again.arXiv preprint arXiv:2507.22058, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.492645Z"},"links":{"cited_paper":"/paper/2507.22058","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:91094c21a204597ab7500b83a0bc7656fb33b116ca8a61369ff5a9e9f03cc625","observation_id":"a3caf18f-d45e-4e1b-9917-598c31b18316","resolution":{"observed_at":"2026-08-01T13:39:02.492645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11346","last_updated":"2025-06-28T11:46:35Z","snapshot_observed_at":"2026-08-16T15:39:15.923412Z","submitted_at":"2025-04-15T16:19:07Z","title":"Seedream 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11346","snapshot_observed_at":"2026-08-01T13:39:02.571456Z","title":"Seedream 3.0 technical report.arXiv preprint arXiv:2504.11346, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.571456Z"},"links":{"cited_paper":"/paper/2504.11346","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:19c76e795918a85903dab3f65c06fce7a0ed93479bc638de977c5fb585797c8a","observation_id":"a071b6cb-173c-4e00-afb2-4d7d455b6ef0","resolution":{"observed_at":"2026-08-01T13:39:02.571456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:02.645140Z","title":"Kolors: Effective training of diffusion model for photorealistic text-to-image synthesis.arXiv preprint, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.645140Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:05cd1f25a29a765274a23b6314268ff10ec6fbe54087dbbe6c16667f120bc80c","observation_id":"ba699391-2add-48ee-9047-d65e73d3d5ae","resolution":{"observed_at":"2026-08-01T13:39:02.645140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-01T13:39:02.706687Z","title":"Emu3: Next-token prediction is all you need.arXiv preprint arXiv:2409.18869, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.706687Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:2fb8b383c21b12822356cf0b6cd27b8146900fd2fdc0f11b5700596c35c1c032","observation_id":"92c55759-5306-4014-adfe-f5cb6937b001","resolution":{"observed_at":"2026-08-01T13:39:02.706687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:02.789784Z","title":"Internvl-u: Democratizing unified multimodal models for understanding, reasoning, generation and editing.arXiv preprint arXiv:2603.09877, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.789784Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:32cea75d8a26e1a11e9d51cf19abbbe72057d89cb533476f1146b4e12cc9343e","observation_id":"58d5f81c-f01a-45ac-988d-52b0e61a3831","resolution":{"observed_at":"2026-08-01T13:39:02.789784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23044","last_updated":"2025-07-01T09:33:23Z","snapshot_observed_at":"2026-08-06T21:49:22.757971Z","submitted_at":"2025-06-29T00:40:17Z","title":"Ovis-U1 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23044","snapshot_observed_at":"2026-08-01T13:39:02.846343Z","title":"Ovis-u1 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.846343Z"},"links":{"cited_paper":"/paper/2506.23044","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:ea431995432a6c8dd171259270a42a9ce7f03ebf6e2fa23c2699277f3bd18fc8","observation_id":"7feddf75-2d9c-4cbd-9b90-0bcd4e1bda71","resolution":{"observed_at":"2026-08-01T13:39:02.846343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22705","last_updated":"2025-05-28T17:59:15Z","snapshot_observed_at":"2026-08-14T05:30:11.702159Z","submitted_at":"2025-05-28T17:59:15Z","title":"HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22705","snapshot_observed_at":"2026-08-01T13:39:02.912248Z","title":"Hidream-i1: A high-efficient image generative foundation model with sparse diffusion transformer.arXiv preprint arXiv:2505.22705, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:02.912248Z"},"links":{"cited_paper":"/paper/2505.22705","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:c1e675836ca25d23063539da164e4b7ee59577cd73666b5418efe073876e638b","observation_id":"59717f9d-397a-446a-a8dc-acc4ccb2d39c","resolution":{"observed_at":"2026-08-01T13:39:02.912248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:03.024435Z","title":"Flux.https://github.com/black-forest-labs/flux, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:03.024435Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:c24a8054b3ff761bdf2b72540ce11a326df945cbc3c84b94234e0c5d48d8f583","observation_id":"ff561262-9e70-49ef-becb-90f991b00039","resolution":{"observed_at":"2026-08-01T13:39:03.024435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:03.142773Z","title":"FLUX.1 Krea [dev]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:03.142773Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:a59768d80513af0acf98b6f73820116f355c90fdff428f96892db576e8dccf68","observation_id":"e04c6d32-64c6-4081-9d71-0e542dd3cc7e","resolution":{"observed_at":"2026-08-01T13:39:03.142773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.04128","last_updated":"2026-05-20T08:56:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T15:49:47Z","title":"JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.04128","snapshot_observed_at":"2026-08-01T13:39:03.262803Z","title":"Joyai-image: Awaking spatial intelligence in unified multimodal understanding and generation.arXiv preprint arXiv:2605.04128, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:03.262803Z"},"links":{"cited_paper":"/paper/2605.04128","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:2a9c8e45b2e6c8caf04154e11ad2159eba4f26d97ce27bcb736847e61c1bbaf7","observation_id":"d96657bd-7282-46d6-9cc4-98e0a09575bc","resolution":{"observed_at":"2026-08-01T13:39:03.262803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21573","last_updated":"2026-05-20T17:59:58Z","snapshot_observed_at":"2026-08-17T07:50:54.819992Z","submitted_at":"2026-05-20T17:59:58Z","title":"Lens: Rethinking Training Efficiency for Foundational Text-to-Image Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21573","snapshot_observed_at":"2026-08-01T13:39:03.440104Z","title":"Lens: Rethinking training efficiency for foundational text-to-image models.arXiv preprint arXiv:2605.21573, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:03.440104Z"},"links":{"cited_paper":"/paper/2605.21573","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:f2d2cd00c5c87449af938a774e172870eda282d2d9d933172079b9ea0b07c322","observation_id":"e9b9bfc8-ac8e-4706-ad99-30b05681b41c","resolution":{"observed_at":"2026-08-01T13:39:03.440104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15564","last_updated":"2025-09-22T01:24:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T15:39:15Z","title":"Show-o2: Improved Native Unified Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15564","snapshot_observed_at":"2026-08-01T13:39:03.551669Z","title":"Show-o2: Improved native unified multimodal models.arXiv preprint arXiv:2506.15564, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:03.551669Z"},"links":{"cited_paper":"/paper/2506.15564","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:b55b40edf21bb6fca36835523b754fc45985c3b6d1a33b6de44c9899fc91f474","observation_id":"c105e6e8-ceae-4a54-94f5-7dbf7ab7e9b3","resolution":{"observed_at":"2026-08-01T13:39:03.551669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:39:03.631499Z","title":"Improving image generation with better captions.Computer Science,https: // cdn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:03.631499Z"},"links":{"citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:4de838bd0f696a5aea7067829bc04a449689ed2d34f90aa9df065e1a818e9fca","observation_id":"f7ecdc18-6770-4109-bd69-2cd8c894a18d","resolution":{"observed_at":"2026-08-01T13:39:03.631499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":104},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 100 of 104 outbound references and 1 inbound Pith citation observation for arXiv:2607.19064."}