{"as_of":"2026-08-13T12:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:64e824d0800468fada723d7972d07fc6be485865b054c475f5e90793f36b490f","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T04:21:18.312613Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:18:10.386228Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T19:30:07.745534Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":"2605.10730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-07-04T19:30:07.745534Z","title":"Qwen-Image-2.0 Technical Report","venue":"cs.CV","work_id":"c3b82a4d-351e-4af9-b191-3c4e621c6938","year":2026},"citing_paper":{"arxiv_id":"2605.13565","last_updated":"2026-05-13T14:04:56Z","snapshot_observed_at":"2026-08-13T00:04:52.664351Z","submitted_at":"2026-05-13T14:04:56Z","title":"Qwen-Image-VAE-2.0 Technical Report","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-14T19:53:25.849049Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2605.13565"},"observation_digest":"sha256:3a5dff7cad836e9d830e4527299581566f2d8422b40c530440fae9d8192054fe","observation_id":"772cc3ed-b4ed-43bf-997c-57044ac4de7e","resolution":{"observed_at":"2026-05-14T19:57:54.127878Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":"2605.10730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-07-04T19:30:07.745534Z","title":"Qwen-Image-2.0 Technical Report","venue":"cs.CV","work_id":"c3b82a4d-351e-4af9-b191-3c4e621c6938","year":2026},"citing_paper":{"arxiv_id":"2605.28091","last_updated":"2026-06-25T07:49:03Z","snapshot_observed_at":"2026-08-12T17:51:35.366570Z","submitted_at":"2026-05-27T07:46:43Z","title":"Qwen-Image-Bench: From Generation to Creation in Text-to-Image Evaluation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T14:05:25.988619Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2605.28091"},"observation_digest":"sha256:35702eef0c9f67b7c179a1529887047955125957825c3871d3c027204a7c859f","observation_id":"4fb917a9-0e7b-4ffc-9a53-155261b4bbb2","resolution":{"observed_at":"2026-06-29T14:13:30.356502Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":"2605.10730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-07-04T19:30:07.745534Z","title":"Qwen-Image-2.0 Technical Report","venue":"cs.CV","work_id":"c3b82a4d-351e-4af9-b191-3c4e621c6938","year":2026},"citing_paper":{"arxiv_id":"2606.03746","last_updated":"2026-06-03T05:16:34Z","snapshot_observed_at":"2026-08-12T00:53:53.179304Z","submitted_at":"2026-06-02T15:00:22Z","title":"Qwen-Image-Flash: Beyond Objective Design","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T11:00:04.775189Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2606.03746"},"observation_digest":"sha256:5153db007876a85641ee2c3afe03d585557c1e1d3ed049b6295c77db308c4b8e","observation_id":"a2f85210-775a-47e7-bc78-25d0b6b2b598","resolution":{"observed_at":"2026-07-02T02:26:26.225594Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":"2605.10730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-07-04T19:30:07.745534Z","title":"Qwen-Image-2.0 Technical Report","venue":"cs.CV","work_id":"c3b82a4d-351e-4af9-b191-3c4e621c6938","year":2026},"citing_paper":{"arxiv_id":"2606.20100","last_updated":"2026-06-18T11:20:05Z","snapshot_observed_at":"2026-08-05T19:44:52.217038Z","submitted_at":"2026-06-18T11:20:05Z","title":"WeGenBench: A Multidimensional Diagnostic Benchmark towards Text-to-Image Model Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T17:54:09.656061Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2606.20100"},"observation_digest":"sha256:782a4cd3c5e3304ffd066ac22ca82b34b8ce43945d9ee1ec242b145b87bc0213","observation_id":"dcfc370e-baf7-4b8e-8d42-6df0ac59eb20","resolution":{"observed_at":"2026-07-04T03:39:29.372992Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":"2605.10730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-07-04T19:30:07.745534Z","title":"Qwen-Image-2.0 Technical Report","venue":"cs.CV","work_id":"c3b82a4d-351e-4af9-b191-3c4e621c6938","year":2026},"citing_paper":{"arxiv_id":"2606.25578","last_updated":"2026-07-19T03:51:22Z","snapshot_observed_at":"2026-08-12T21:22:30.422679Z","submitted_at":"2026-06-24T08:52:06Z","title":"H-Adapter: Pose-Robust Hairstyle Transfer via Attention-Derived, Source-Aligned Hair Masks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-25T21:15:55.027857Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2606.25578"},"observation_digest":"sha256:b968a9f14f316f903436d007e684fcbf7db902eec402505e663577946dc0346f","observation_id":"16277dd7-f87c-4341-98cc-2d38aaa408f1","resolution":{"observed_at":"2026-07-04T19:30:07.746642Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-08-02T10:17:15.385322Z","title":"arXiv preprint arXiv:2605.10730 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25578","last_updated":"2026-07-19T03:51:22Z","snapshot_observed_at":"2026-08-12T21:22:30.422679Z","submitted_at":"2026-06-24T08:52:06Z","title":"H-Adapter: Pose-Robust Hairstyle Transfer via Attention-Derived, Source-Aligned Hair Masks","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T10:17:15.385322Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2606.25578"},"observation_digest":"sha256:c93efd9fd6aac0340de73b5bce46cb82100529e79ada0e1a33e2add0fc8c6980","observation_id":"19a438f7-d0ae-43c9-9285-c523c2fa57d7","resolution":{"observed_at":"2026-08-02T10:17:15.385322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":"2605.10730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-07-04T19:30:07.745534Z","title":"Qwen-Image-2.0 Technical Report","venue":"cs.CV","work_id":"c3b82a4d-351e-4af9-b191-3c4e621c6938","year":2026},"citing_paper":{"arxiv_id":"2606.27608","last_updated":"2026-06-25T23:49:50Z","snapshot_observed_at":"2026-07-07T00:01:49.598947Z","submitted_at":"2026-06-25T23:49:50Z","title":"Qwen-Image-2.0-RL Technical Report","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T01:11:12.757656Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2606.27608"},"observation_digest":"sha256:84e266a5b30ae82a680bf3b785838b2bd516062cf2145f628d01c9f92afbdc12","observation_id":"190d5cf5-b946-4a9f-a93c-326f9300896d","resolution":{"observed_at":"2026-07-01T19:06:02.871063Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-07-14T12:48:07.464238Z","title":"Psychology","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10301","last_updated":"2026-07-11T13:10:32Z","snapshot_observed_at":"2026-08-12T18:34:34.034243Z","submitted_at":"2026-07-11T13:10:32Z","title":"ChartSync: A Benchmark for Visuo-Logical Cascading Chart Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T12:48:07.464238Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2607.10301"},"observation_digest":"sha256:e6c5172573f63979436aecedb720d20740fa3eca8ad04b1cc01f4bda722c29ef","observation_id":"30177757-e5d9-43e4-9948-56ff17f44c0e","resolution":{"observed_at":"2026-07-14T12:48:07.464238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-08-02T06:14:05.898658Z","title":"Qwen-image-2.0 technical report.arXiv preprint arXiv:2605.10730, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13125","last_updated":"2026-07-18T17:28:17Z","snapshot_observed_at":"2026-08-03T17:18:33.842709Z","submitted_at":"2026-07-14T17:52:05Z","title":"Boogu-Image-0.1: Boosting Open Agentic Multimodal Generation via Understanding under a Minimal Budget","version":2},"reference_index":143,"source":"pdf_text","source_observed_at":"2026-08-02T06:14:05.898658Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2607.13125"},"observation_digest":"sha256:fb49c50829d363ee88dbe1976afd53a192e4f4f8b97db9af45a3bf068519a3c7","observation_id":"964c8de8-64fe-4832-a435-82b6dc07a2c4","resolution":{"observed_at":"2026-08-02T06:14:05.898658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-07-31T09:23:52.417153Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24897","last_updated":"2026-07-27T16:41:36Z","snapshot_observed_at":"2026-08-03T19:46:21.991125Z","submitted_at":"2026-07-27T16:41:36Z","title":"TYPO: Instruction-Dense Visual Jailbreaks against Commercial Closed-Source Image-Generation Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-31T09:23:52.417153Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2607.24897"},"observation_digest":"sha256:97501f0692e59259c42c5e2c5555faefe406c43ecac81c7608755a05790e7992","observation_id":"e2764c7d-a22c-4174-87af-8ed6138d3c28","resolution":{"observed_at":"2026-07-31T09:23:52.417153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-08-05T04:16:44.029029Z","title":"Qwen3.5: Towards native multimodal agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00410","last_updated":"2026-08-01T03:13:35Z","snapshot_observed_at":"2026-08-11T14:47:10.169754Z","submitted_at":"2026-08-01T03:13:35Z","title":"Where did the ambiguity go? Examining how multimodal models interpret polysemous words","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T04:16:44.029029Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2608.00410"},"observation_digest":"sha256:400f62ecc9608fb7443be1fb6a9fc770f949196be77ec3f0f0b84460efa234cd","observation_id":"a5250d34-6149-4953-b815-68471ccb43eb","resolution":{"observed_at":"2026-08-05T04:16:44.029029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-08-08T00:18:10.386228Z","title":"arXiv preprint arXiv:2605.10730 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-12T22:15:41.036433Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.386228Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:581fa63fce52cf3fec90c9ca5f254d637e68e22e2e56d7d93b21d84428630d27","observation_id":"0b1cd0c2-81a5-4bd0-9a59-19ed69b2d42a","resolution":{"observed_at":"2026-08-08T00:18:10.386228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.10730/citation-record","integrity":"/paper/2605.10730/integrity","json":"/paper/2605.10730/citation-record.json","paper":"/paper/2605.10730"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:f4cc4f0427bf4b44f371057ebd1192b24f5c1a905b7d0ed07e596d890b0a5ada","observation_id":"4013da73-fd55-41ef-aed0-39d745249889","resolution":{"observed_at":"2026-05-12T04:21:21.898646Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:b5874795ba0b4ce751978ed40adac2a84c46dd2934e8246b433585dda5f1f7a9","observation_id":"444ea3c5-c4b7-4c75-be7a-054818f28354","resolution":{"observed_at":"2026-05-12T04:21:21.915860Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-13T02:23:40.621810Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":5},"cited_work":{"arxiv_id":"2511.22699","doi":"10.48550/arxiv.2511.22699","metadata_source":"pith","pith_arxiv_id":"2511.22699","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","venue":"cs.CV","work_id":"f1080a62-48e1-4255-b023-7556be57370d","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2511.22699","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:761c544f1e3bf0d66d72fa4b0c26286e568628e8842443acd26f461aabf6542c","observation_id":"abdb0e5c-0307-4df3-83f4-b1c34a40fc55","resolution":{"observed_at":"2026-05-12T04:21:21.908923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.152696+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.152696+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23951","last_updated":"2026-06-26T07:53:46Z","snapshot_observed_at":"2026-08-04T14:42:12.962842Z","submitted_at":"2025-09-28T16:14:10Z","title":"HunyuanImage 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":"2509.23951","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23951","snapshot_observed_at":"2026-07-04T16:59:57.981208Z","title":"HunyuanImage 3.0 Technical Report","venue":"cs.CV","work_id":"36511e33-8360-43dd-9407-dddf867c1d7c","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2509.23951","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:fd6ffb69089a16929ac25c8f50a492f7edca2287836109cb5aa20db581976f17","observation_id":"c7017df2-0af7-4cef-92b2-986d5e43bb91","resolution":{"observed_at":"2026-05-16T02:02:32.945705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":"3539e257-41da-42ca-83b8-3300e89aadf7","year":2024},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:fe3147d243b1912a23d316ebd8540665c51fa1f392d1b16a817fa5a485ebb4bc","observation_id":"83dec7d2-1cdf-47ff-a426-f6297571c162","resolution":{"observed_at":"2026-05-12T15:31:40.387217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2Alphabetical order","venue":null,"work_id":"b8619850-bfa7-4088-a5d8-59b81760ca79","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:81d5e35e96b6f1d8cd2b629b851d4e7c4c4eda8f0336cbf06e27b4cf93f8bb0f","observation_id":"012b56f2-40a3-43e5-a198-d37bc9ee9b5a","resolution":{"observed_at":"2026-05-12T15:31:40.390827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11346","last_updated":"2025-06-28T11:46:35Z","snapshot_observed_at":"2026-07-06T21:09:50.780345Z","submitted_at":"2025-04-15T16:19:07Z","title":"Seedream 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":"2504.11346","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11346","snapshot_observed_at":"2026-07-04T07:29:38.429370Z","title":"Seedream 3.0 Technical Report","venue":"cs.CV","work_id":"013e56d0-7f47-4d0e-bbca-e9540fc0e0cc","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2504.11346","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:868b92036d0337228717221d64c7f3b4a626a70f8e04ef01193e5bba486822da","observation_id":"514353a7-b725-4ab3-af25-0a8f88eaf529","resolution":{"observed_at":"2026-05-13T07:55:38.865721Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13447","last_updated":"2025-05-19T17:59:42Z","snapshot_observed_at":"2026-08-11T19:20:11.648968Z","submitted_at":"2025-05-19T17:59:42Z","title":"Mean Flows for One-step Generative Modeling","version":1},"cited_work":{"arxiv_id":"2505.13447","doi":"10.48550/arxiv.2505.13447","metadata_source":"pith","pith_arxiv_id":"2505.13447","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mean Flows for One-step Generative Modeling","venue":"cs.LG","work_id":"07a52ad5-0f82-4095-9a66-559b09fea1ae","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2505.13447","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:6aaef87f32c5fc3d781aed962f8afefcc5a1c8398d0299b1e22963afce0b6dcc","observation_id":"e218833d-51e1-4b79-b6c6-6a93e5522f48","resolution":{"observed_at":"2026-05-12T04:21:21.769844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07703","last_updated":"2025-03-10T17:58:33Z","snapshot_observed_at":"2026-07-06T20:50:09.622181Z","submitted_at":"2025-03-10T17:58:33Z","title":"Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model","version":1},"cited_work":{"arxiv_id":"2503.07703","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.07703","snapshot_observed_at":"2026-07-03T17:18:43.965269Z","title":"Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model","venue":"cs.CV","work_id":"e285b9d3-0bf4-4f98-ba3a-e545425ab960","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2503.07703","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:5def275455963ce7afe3722ce3a03b8328514847f2133ebb2814ff818caa4bfd","observation_id":"39cb953b-4c19-4c71-8da4-42e7a1146fab","resolution":{"observed_at":"2026-05-17T08:27:36.473449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-12T19:28:23.372660Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":"2207.12598","doi":"10.1109/cvpr52733.2024.02494","metadata_source":"pith","pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Classifier-Free Diffusion Guidance","venue":"cs.LG","work_id":"acf2c588-c088-4a6c-938e-150ad7c666d7","year":2022},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:f1bd193fe72577b5fd931685d9430273fcfb253ce4cfd80f05513f607e3f4e8c","observation_id":"09423b64-243b-4fa0-ba50-1aba21ecd796","resolution":{"observed_at":"2026-05-12T04:21:21.783411Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:4fa52a6d98aed5746519077ec83cfecc252346c52e4ab8e5e635e7eb7b512bd3","observation_id":"535fb7c0-8cb0-4a1e-bd76-4b22a9b40fee","resolution":{"observed_at":"2026-05-12T04:21:21.723082Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:1e2708eb7a1fbae1ed0546b4acbcd98402537463dc1317d4ad9d5f404b4cdd41","observation_id":"f6603291-b33a-48f9-96c6-0d546c127b3d","resolution":{"observed_at":"2026-05-12T04:21:21.812901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-08-10T10:43:25.582099Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":"2506.15742","doi":"10.48550/arxiv.2506.15742","metadata_source":"pith","pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","venue":"cs.GR","work_id":"5dfe19d5-3541-4803-8fe9-3c8b9e29b281","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:5bbe9e0b60c4116724aa288b9394bf096b942f4af4d43caa8c9b0fcbf966bfb4","observation_id":"d3923678-4c29-4760-878f-12d192b4b220","resolution":{"observed_at":"2026-05-12T04:21:21.774038Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08748","last_updated":"2024-05-14T16:33:25Z","snapshot_observed_at":"2026-07-06T18:14:16.386835Z","submitted_at":"2024-05-14T16:33:25Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","version":1},"cited_work":{"arxiv_id":"2405.08748","doi":"10.48550/arxiv.2405.08748","metadata_source":"pith","pith_arxiv_id":"2405.08748","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","venue":"cs.CV","work_id":"fde63b0b-25e7-43d9-9867-7d6a2ba6d710","year":2024},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2405.08748","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:ecc09a66e6bf486348e67d808a6e56a73d2c97dfea045d0586ffae81bd4a79cc","observation_id":"b4877599-743e-4b84-b4c6-fa145bfe051b","resolution":{"observed_at":"2026-05-16T14:58:37.566044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:8f098e42ccdb220b7d9b71a3a80dbf9e6e35b3a35bf39352f408ca1cbab98245","observation_id":"831f8b7c-14b5-48c4-9d64-4412b1b7cb22","resolution":{"observed_at":"2026-05-12T04:21:21.849533Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.22677","doi":"10.48550/arxiv.2511.22677","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled dmd: Cfg augmentation as the spear, distribution matching as the shield","venue":"ArXiv.org","work_id":"dd7b113f-29cc-40ce-b257-4d30880efdc4","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:a83db20764f18007c793c681e1341528ab7dbb949cfa82c5e06a6e5c831b76f5","observation_id":"57b00ae7-9786-45be-8bcc-ccab745ea67f","resolution":{"observed_at":"2026-05-12T04:21:21.788928Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":"2209.03003","doi":"10.48550/arxiv.2209.03003","metadata_source":"pith","pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","venue":"cs.LG","work_id":"a1989e1b-d66d-4533-be3a-fb9c5fd62290","year":2022},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:05d8fbd8b5ed21600c5dc650f4104fef09bdbf8c311495042e5f350f06b45947","observation_id":"9daadd08-2336-487c-aed9-ab2eea17eb5d","resolution":{"observed_at":"2026-05-12T04:21:21.838365Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11081","last_updated":"2025-03-01T09:52:49Z","snapshot_observed_at":"2026-07-06T19:33:30.263638Z","submitted_at":"2024-10-14T20:43:25Z","title":"Simplifying, Stabilizing and Scaling Continuous-Time Consistency Models","version":2},"cited_work":{"arxiv_id":"2410.11081","doi":"10.48550/arxiv.2410.11081","metadata_source":"pith","pith_arxiv_id":"2410.11081","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Simplifying, Stabilizing and Scaling Continuous-Time Consistency Models","venue":"cs.LG","work_id":"1151c0b6-2be7-436c-ab83-843d92dea769","year":2024},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2410.11081","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:49c8338b79f2418dfc7e46688bab61abae46ab92e8a083d307ff71cec2d0834a","observation_id":"61eabb09-1d45-48b0-b7e1-bbf84c146c6e","resolution":{"observed_at":"2026-05-13T10:26:23.772771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:52.637926+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:52.637926+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":"2502.10248","doi":"10.48550/arxiv.2502.10248","metadata_source":"pith","pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","venue":"cs.CV","work_id":"f9be7275-0997-4f96-bbde-dcd6ea138476","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:110fcb2bdfef33d36b9866e4284e94c8327e182f327ac7aa1f0c61e0f0a08966","observation_id":"84501807-5c5d-40ce-ab05-21253e441eaf","resolution":{"observed_at":"2026-05-19T08:02:24.560574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"216cba48-26a2-4253-a359-6864bc01ef46","year":2024},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:761a6504cdf7ee5bb4d06dcaa09b52307315dc3a631b40b1cae29c9ddcd4e7b0","observation_id":"2d91b283-abb0-44c4-b017-9e21abbb9038","resolution":{"observed_at":"2026-05-12T15:31:40.382768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20427","last_updated":"2025-12-10T16:37:54Z","snapshot_observed_at":"2026-08-12T22:14:17.982075Z","submitted_at":"2025-09-24T17:59:04Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","version":3},"cited_work":{"arxiv_id":"2509.20427","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.20427","snapshot_observed_at":"2026-07-11T00:07:42.259448Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","venue":"cs.CV","work_id":"15c839a0-48a3-4218-82b6-cac5b7f66e13","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2509.20427","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:edebf14d89d7c8f38b858041a97c281fe0be623e78759718e89e72bb48d0fdd8","observation_id":"e1319120-6eef-4a47-a424-13a2a80fea90","resolution":{"observed_at":"2026-05-12T16:39:00.957431Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:fce20247abc13b9a09d7dcc47c0098309f7045effe82352abd09b2b2744d929c","observation_id":"90aef01d-8a88-4dd8-a937-6060b8970b7c","resolution":{"observed_at":"2026-05-12T04:21:21.778483Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07584","last_updated":"2025-12-08T14:26:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-08T14:26:40Z","title":"LongCat-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2512.07584","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.07584","snapshot_observed_at":"2026-07-04T16:09:57.573753Z","title":"LongCat-Image Technical Report","venue":"cs.CV","work_id":"648d9514-ca31-4ba0-983a-1aba1057a97e","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2512.07584","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:e982e7aad4f3bf72a8885549a96b41cf5a82b5f03d0df59f481d6dd4fe29fa85","observation_id":"ded175fd-62e5-46e6-b4de-cfdc1c52817d","resolution":{"observed_at":"2026-05-16T08:04:13.097348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:1e454d4ef8335fe739f2cef1f1e37c318d2ee46e2f4301d14b88adc7f0ae4801","observation_id":"25d1f140-5b41-4e52-90a5-4dd901035ec7","resolution":{"observed_at":"2026-05-12T04:21:21.823690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.22319","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T17:51:14.844615Z","title":"Grpo-guard: Mitigating implicit over-optimization in flow matching via regulated clipping","venue":null,"work_id":"ca09b893-7353-413f-b231-16f132d92aee","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:9ce3cb660f4bf4a6bfa42ddc234cfb5847205e2438e5163402793fb3a1d1dc6a","observation_id":"c4344ff7-0e13-4814-a610-b7bc38a62547","resolution":{"observed_at":"2026-05-12T04:21:21.893249Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:097df8243b6d03572fab6dea9c311eff02f97e2356951dedf3b37178883ca6c3","observation_id":"729b0000-c840-4793-ac1a-b33dca31b29f","resolution":{"observed_at":"2026-05-12T04:21:21.867591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.03139","last_updated":"2026-05-19T12:34:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-03T05:45:25Z","title":"Diversity-Preserved Distribution Matching Distillation for Fast Visual Synthesis","version":2},"cited_work":{"arxiv_id":"2602.03139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.03139","snapshot_observed_at":"2026-07-04T19:50:11.418157Z","title":"Diversity-Preserved Distribution Matching Distillation for Fast Visual Synthesis","venue":"cs.CV","work_id":"ade4577e-f5b1-4604-8893-9398d6799847","year":2026},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2602.03139","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:692a6b6bde511358324967949c7cb16dad5cec14545f7959efc30cb01afc907a","observation_id":"d19d833c-4449-4b8f-9b1a-08a2521d9e32","resolution":{"observed_at":"2026-05-20T02:05:40.192775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":"2206.10789","doi":"10.48550/arxiv.2206.10789","metadata_source":"pith","pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","venue":"cs.CV","work_id":"0a105815-ff2e-43ce-8566-966cdcae1af4","year":2022},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:a9f226c440469765f605129df9fa018b2129c09ccba2234eaa541a5b8d6088b4","observation_id":"6a09a4a8-009a-4ee6-af10-d935d8e91d76","resolution":{"observed_at":"2026-05-12T04:49:31.747550Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":"2509.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-07-04T19:50:11.382174Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","venue":"cs.LG","work_id":"0ed3cf57-36ba-4962-847e-7a8f5f99901d","year":2025},"citing_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T04:21:18.312613Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2605.10730"},"observation_digest":"sha256:136204331a74774a339454a9c3d61525ee7098077a2ac5cf2e1384e453457687","observation_id":"25775d43-bfe8-4cd4-92d3-744b84d6990b","resolution":{"observed_at":"2026-05-13T16:54:31.055857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T22:15:05.384992Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":24,"verified_fuzzy":3},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 12 inbound Pith citation observations for arXiv:2605.10730."}