{"as_of":"2026-08-08T12:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed5160c463f394b61e19b0720345059affc9fe603141d69ccbd2fbf37f73b0e5","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:53:31.813629Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:26:55.937172Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T18:17:55.110392Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23325","snapshot_observed_at":"2026-08-07T11:26:55.937172Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02698","last_updated":"2025-06-06T03:14:26Z","snapshot_observed_at":"2026-08-08T05:11:32.954183Z","submitted_at":"2025-06-03T09:47:22Z","title":"Smoothed Preference Optimization via ReNoise Inversion for Aligning Diffusion Models with Varied Human Preferences","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:55.937172Z"},"links":{"cited_paper":"/paper/2505.23325","citing_paper":"/paper/2506.02698"},"observation_digest":"sha256:f89c3edcb6d7eab1854079900825216712e0e4110fb201b439b941563a1725b9","observation_id":"e603ddbb-b89c-4cf5-a06b-448d4669bad5","resolution":{"observed_at":"2026-08-07T11:26:55.937172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"cited_work":{"arxiv_id":"2505.23325","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23325","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dimension-reduction attack! video generative models are experts on controllable image synthesis","venue":null,"work_id":"5ef97af7-d902-425c-b24b-7d796c87372c","year":2025},"citing_paper":{"arxiv_id":"2512.04678","last_updated":"2025-12-28T11:15:39Z","snapshot_observed_at":"2026-08-04T14:52:25.854038Z","submitted_at":"2025-12-04T11:12:13Z","title":"Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T18:17:54.943863Z"},"links":{"cited_paper":"/paper/2505.23325","citing_paper":"/paper/2512.04678"},"observation_digest":"sha256:806fc691694bd6b60f08a21a1ca490da89231a51ada8e29697de2c3067ec3a3a","observation_id":"9f5f2eb9-e380-41f6-8387-72b8dca5ec5a","resolution":{"observed_at":"2026-05-16T18:17:55.112233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"cited_work":{"arxiv_id":"2505.23325","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23325","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dimension-reduction attack! video generative models are experts on controllable image synthesis","venue":null,"work_id":"5ef97af7-d902-425c-b24b-7d796c87372c","year":2025},"citing_paper":{"arxiv_id":"2605.03877","last_updated":"2026-05-05T15:37:50Z","snapshot_observed_at":"2026-08-04T08:46:20.575366Z","submitted_at":"2026-05-05T15:37:50Z","title":"DMGD: Train-Free Dataset Distillation with Semantic-Distribution Matching in Diffusion Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T17:42:00.634333Z"},"links":{"cited_paper":"/paper/2505.23325","citing_paper":"/paper/2605.03877"},"observation_digest":"sha256:593e09276077dbe2f2da51e946f84fbdc00ed0e34b2309104ad701f2f67bafe4","observation_id":"0b48afa5-599c-4ab0-b15a-ff69543bc923","resolution":{"observed_at":"2026-05-11T23:16:30.482415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"cited_work":{"arxiv_id":"2505.23325","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23325","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dimension-reduction attack! video generative models are experts on controllable image synthesis","venue":null,"work_id":"5ef97af7-d902-425c-b24b-7d796c87372c","year":2025},"citing_paper":{"arxiv_id":"2605.09433","last_updated":"2026-05-10T09:13:40Z","snapshot_observed_at":"2026-07-06T23:21:30.897592Z","submitted_at":"2026-05-10T09:13:40Z","title":"Offline Preference Optimization for Rectified Flow with Noise-Tracked Pairs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T02:10:27.595446Z"},"links":{"cited_paper":"/paper/2505.23325","citing_paper":"/paper/2605.09433"},"observation_digest":"sha256:c41eada451dac240cfde6436ce0bae16f80d6518b1ead38eb84367a086c5e835","observation_id":"a3b40466-56f7-4e69-8cc0-a1a7c82659c3","resolution":{"observed_at":"2026-05-12T02:11:15.477310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23325","snapshot_observed_at":"2026-07-30T20:27:19.050844Z","title":"Dimension-reduction attack! video generative models are experts on controllable image synthesis.arXiv preprint arXiv:2505.23325, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23518","last_updated":"2026-07-26T07:35:10Z","snapshot_observed_at":"2026-08-07T18:42:23.754736Z","submitted_at":"2026-07-26T07:35:10Z","title":"Chamaileon: Cross-Context Binder Design with Contextualized Modeling and Mixed Sampling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T20:27:19.050844Z"},"links":{"cited_paper":"/paper/2505.23325","citing_paper":"/paper/2607.23518"},"observation_digest":"sha256:cc2b4f4695506ad1f7adc3bcc656f8b6f5f850777ec51a7a771ba15c79564c88","observation_id":"23023443-cf99-4bdd-82b2-36e9945fdb08","resolution":{"observed_at":"2026-07-30T20:27:19.050844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23325/citation-record","integrity":"/paper/2505.23325/integrity","json":"/paper/2505.23325/citation-record.json","paper":"/paper/2505.23325"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T12:53:22.515728Z","title":"Qwen2.5-vl technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:22.515728Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:4a956f68b95322c272bf5939b0289849fa279ae9175466d2a4974f0c9bf6fc9f","observation_id":"aa8afa44-c11e-446f-8359-af55d0281a4d","resolution":{"observed_at":"2026-08-07T12:53:22.515728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:22.623707Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:22.623707Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:a155353c5335bc0c4ad31ec483db1909dcd5ccc6703b887e1bcc8f3cfd81ab9e","observation_id":"4fbbbc7a-2890-4382-b60f-0c5599f64eba","resolution":{"observed_at":"2026-08-07T12:53:22.623707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.14294","last_updated":"2021-05-24T17:49:18Z","snapshot_observed_at":"2026-08-04T11:32:10.695202Z","submitted_at":"2021-04-29T12:28:51Z","title":"Emerging Properties in Self-Supervised Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.14294","snapshot_observed_at":"2026-08-07T12:53:22.800605Z","title":"Emerging properties in self-supervised vision transformers, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:22.800605Z"},"links":{"cited_paper":"/paper/2104.14294","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:0b569dbb81a30df831df992cd6681e00853930aae73dee46fdf866426e668b43","observation_id":"3b1dda67-0a37-443f-b596-5aa667624430","resolution":{"observed_at":"2026-08-07T12:53:22.800605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.00364","last_updated":"2021-11-08T07:08:21Z","snapshot_observed_at":"2026-08-08T12:12:35.666197Z","submitted_at":"2020-12-01T09:42:46Z","title":"Pre-Trained Image Processing Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.00364","snapshot_observed_at":"2026-08-07T12:53:22.896819Z","title":"Pre-trained image processing transformer, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:22.896819Z"},"links":{"cited_paper":"/paper/2012.00364","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:41ce6e291ab4746e6a54b218067d58284c5112c7b31ae747610ca40dfd48c2b0","observation_id":"167968c9-5e1d-43ba-b228-924fa750ea1b","resolution":{"observed_at":"2026-08-07T12:53:22.896819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14491","last_updated":"2022-11-22T02:09:38Z","snapshot_observed_at":"2026-08-03T22:24:49.500281Z","submitted_at":"2022-09-29T00:57:28Z","title":"Re-Imagen: Retrieval-Augmented Text-to-Image Generator","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14491","snapshot_observed_at":"2026-08-07T12:53:23.012175Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:23.012175Z"},"links":{"cited_paper":"/paper/2209.14491","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:92c37ecba3b11fa7bdeaf6721f707a88e5e465d3c91f439c96b85921dcf6be30","observation_id":"0988faea-3c00-4d54-97a6-0e75efb97c5c","resolution":{"observed_at":"2026-08-07T12:53:23.012175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:36.135831Z","title":"Anydoor: Zero-shot object-level image customization","venue":null,"work_id":"8e4723fd-451c-428d-b73c-3fcb66e78d48","year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:23.149714Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:dc842e68a3b59903c1cbe5e8bd6dc785e1c6198deb16805287301d3cacfdc0ed","observation_id":"76dcc915-2829-404a-b84d-1a6bc0d21485","resolution":{"observed_at":"2026-08-07T12:53:36.274483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:35.816637Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics, 2024","venue":null,"work_id":"6b78ac55-2190-4875-be5b-fd859beddc77","year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:23.281171Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:0624a92c4cbc000ac52dda66d99a5f31ca026cb361ad41376a808bdc5ca05cd6","observation_id":"12f96487-8b01-4c9b-b8f7-051b18b6d64f","resolution":{"observed_at":"2026-08-07T12:53:35.936652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:23.378665Z","title":"Xtuner: A toolkit for efficiently fine-tuning llm.https://github.com/InternLM/ xtuner, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:23.378665Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:bac78dad876dde133f3700489032be448c869f42df51366e7cf16edcf612a93f","observation_id":"c2b4f917-7ab4-4834-ba56-c5a50cc25435","resolution":{"observed_at":"2026-08-07T12:53:23.378665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:23.483328Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:23.483328Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:aed9de69576f20aadbac78cb933fe42253c54ccea0222aa7209465821a314d1f","observation_id":"0d6a55c5-639e-4ad7-981f-4886edef6c9c","resolution":{"observed_at":"2026-08-07T12:53:23.483328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:23.547205Z","title":"Ranni: Taming text-to-image diffusion for accurate instruction following","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:23.547205Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:426b7941dce804ba60ed564d08b351b452560ef57f023866fed7f705d3df2a78","observation_id":"b5308a94-bedf-42c6-bce1-5c692b91b15a","resolution":{"observed_at":"2026-08-07T12:53:23.547205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:35.576712Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":"230e9cbf-2246-4353-a92d-32649c90edc7","year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:23.639105Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:0128f5f1b3e0eecc691d96556502d0744862876b5be0a85606cf42f58afe2e9e","observation_id":"cc51d835-1194-4856-ba3d-b9d11ef70b68","resolution":{"observed_at":"2026-08-07T12:53:35.713523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00086","last_updated":"2024-11-05T12:25:32Z","snapshot_observed_at":"2026-07-06T19:24:48.032228Z","submitted_at":"2024-09-30T17:56:27Z","title":"ACE: All-round Creator and Editor Following Instructions via Diffusion Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00086","snapshot_observed_at":"2026-08-07T12:53:23.885001Z","title":"Ace: All-round creator and editor following instructions via diffusion transformer, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:23.885001Z"},"links":{"cited_paper":"/paper/2410.00086","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:684848419151b374518663d30856eda5a9e6d9c21138f7eb43364df0e35791f3","observation_id":"82d05adb-55ee-4fea-b681-a7db3846a309","resolution":{"observed_at":"2026-08-07T12:53:23.885001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08500","last_updated":"2018-01-12T14:05:44Z","snapshot_observed_at":"2026-07-06T05:48:30.254634Z","submitted_at":"2017-06-26T17:45:23Z","title":"GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08500","snapshot_observed_at":"2026-08-07T12:53:24.079442Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:24.079442Z"},"links":{"cited_paper":"/paper/1706.08500","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:0c7eb551bd23d67bcb50fe2ca478a1bd358191b69823a147f055e4ebf37efbd5","observation_id":"e6da8599-da65-4d05-b483-5aefd3094d0c","resolution":{"observed_at":"2026-08-07T12:53:24.079442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T12:53:24.253804Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:24.253804Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:f1f1cbee0062be13f45aab6c0d4fb6f4d8a5b8b1d47b454d11f0bf2ee854cae3","observation_id":"d808e0ff-e324-4900-9bfe-45d038270315","resolution":{"observed_at":"2026-08-07T12:53:24.253804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17117","last_updated":"2024-06-13T06:37:20Z","snapshot_observed_at":"2026-07-06T16:54:02.725142Z","submitted_at":"2023-11-28T12:27:15Z","title":"Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17117","snapshot_observed_at":"2026-08-07T12:53:24.429433Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:24.429433Z"},"links":{"cited_paper":"/paper/2311.17117","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:31e7cd94a70070f0984fc563acb51dfa046b32a075b2514289e12980277f9509","observation_id":"50e0b927-0d49-4166-8d47-258b819aa63a","resolution":{"observed_at":"2026-08-07T12:53:24.429433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13691","last_updated":"2023-12-21T09:37:14Z","snapshot_observed_at":"2026-08-06T18:08:11.832641Z","submitted_at":"2023-12-21T09:37:14Z","title":"DreamTuner: Single Image is Enough for Subject-Driven Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13691","snapshot_observed_at":"2026-08-07T12:53:24.588321Z","title":"Dreamtuner: Single image is enough for subject-driven generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:24.588321Z"},"links":{"cited_paper":"/paper/2312.13691","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:4e096d3b8875f84465913a76df0690e36cdfc47c29b859563f34be25a6402780","observation_id":"a0f5eae7-47d0-46a1-bd50-8a90cc09322a","resolution":{"observed_at":"2026-08-07T12:53:24.588321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23775","last_updated":"2024-11-05T06:41:27Z","snapshot_observed_at":"2026-07-06T19:42:47.238254Z","submitted_at":"2024-10-31T09:45:00Z","title":"In-Context LoRA for Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23775","snapshot_observed_at":"2026-08-07T12:53:24.694788Z","title":"In-context lora for diffusion transformers, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:24.694788Z"},"links":{"cited_paper":"/paper/2410.23775","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:75af47cea9a4db51638af1b801fb5be5bb8885af062435d15f2d155d5f96a7df","observation_id":"b090f925-359c-49f5-bce4-e171ac7f2953","resolution":{"observed_at":"2026-08-07T12:53:24.694788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07405","last_updated":"2025-04-10T02:58:22Z","snapshot_observed_at":"2026-08-07T16:06:59.504748Z","submitted_at":"2025-04-10T02:58:22Z","title":"FlexIP: Dynamic Control of Preservation and Personality for Customized Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07405","snapshot_observed_at":"2026-08-07T12:53:24.822634Z","title":"Flexip: Dynamic control of preservation and personality for customized image generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:24.822634Z"},"links":{"cited_paper":"/paper/2504.07405","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:a79a0a552fd645e3da906b4a79ca39da5753ce294a86a0dd81af6fff00b5bc10","observation_id":"6fa9346b-0b09-4bb1-b965-7c95fa785143","resolution":{"observed_at":"2026-08-07T12:53:24.822634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.07004","last_updated":"2018-11-26T13:54:12Z","snapshot_observed_at":"2026-07-06T05:19:33.033655Z","submitted_at":"2016-11-21T20:48:16Z","title":"Image-to-Image Translation with Conditional Adversarial Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.07004","snapshot_observed_at":"2026-08-07T12:53:25.018774Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:25.018774Z"},"links":{"cited_paper":"/paper/1611.07004","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:f3f5eea99a65c3fe6ba1b0afe7010f76cc65b641b20300751426e2ff299102ab","observation_id":"57620f91-928c-473d-9ca4-898dcfdb13ee","resolution":{"observed_at":"2026-08-07T12:53:25.018774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:25.201902Z","title":"Hunyuanvideo: A systematic framework for large video generative models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:25.201902Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:ed6f31b0cab018f5efd7c42fc984b91c7463929d9b9adf9e623c49110d640aa4","observation_id":"83fe5650-905d-4252-8dec-ed2f9530e1c4","resolution":{"observed_at":"2026-08-07T12:53:25.201902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04488","last_updated":"2023-06-20T16:26:38Z","snapshot_observed_at":"2026-08-07T07:01:06.262803Z","submitted_at":"2022-12-08T18:57:02Z","title":"Multi-Concept Customization of Text-to-Image Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04488","snapshot_observed_at":"2026-08-07T12:53:25.463468Z","title":"Multi-concept customization of text-to-image diffusion, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:25.463468Z"},"links":{"cited_paper":"/paper/2212.04488","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:8cb31ca0ab19cc2a9082daa43302d6c8c6dceb4071ea0a743184d3947b3ca9ce","observation_id":"e006d9ce-ad44-4edf-863e-d7c0ac6451a5","resolution":{"observed_at":"2026-08-07T12:53:25.463468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:25.597628Z","title":"Generating multi-image synthetic data for text-to-image customization, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:25.597628Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:4f5fd32f775b4d2f1c060d6f619455103b9492505af2a0f775058ea3f703ae57","observation_id":"97659b9e-6620-4a7c-bf85-13c747931b93","resolution":{"observed_at":"2026-08-07T12:53:25.597628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:25.728120Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:25.728120Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:8b79219f91751a2f62af149ae1dab6602147eb242a6f55085cf313c26a5d6aa1","observation_id":"58320eb3-87f3-401e-abd8-53fd391b51d7","resolution":{"observed_at":"2026-08-07T12:53:25.728120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14720","last_updated":"2023-06-22T02:36:06Z","snapshot_observed_at":"2026-08-06T18:16:37.085389Z","submitted_at":"2023-05-24T04:51:04Z","title":"BLIP-Diffusion: Pre-trained Subject Representation for Controllable Text-to-Image Generation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14720","snapshot_observed_at":"2026-08-07T12:53:25.799515Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:25.799515Z"},"links":{"cited_paper":"/paper/2305.14720","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:18d7618eb0a7edcdfb939be137957888175afc7031b05a4dc41f10196b648ee9","observation_id":"4051e177-1810-428a-be08-a22d2a7e6297","resolution":{"observed_at":"2026-08-07T12:53:25.799515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:25.866127Z","title":"Visualcloze: A universal image generation framework via visual in-context learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:25.866127Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:d270ae067dd2ec9715804ed70de8b4a71f57d8e91ed4d6d1fc8baf73dcf5dae3","observation_id":"de67ca17-d3b0-44f3-abab-56e439259247","resolution":{"observed_at":"2026-08-07T12:53:25.866127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-07-06T03:42:37.507458Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-07T12:53:25.933812Z","title":"Lawrence Zitnick, and Piotr Dollár","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:25.933812Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:0cf4fa5f48dfe8ff07ac09b4ce325f9da1920c167caee803206733cb00a63dea","observation_id":"b144fdba-022b-44ad-88d1-baf77a4adf03","resolution":{"observed_at":"2026-08-07T12:53:25.933812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10406","last_updated":"2025-07-20T08:44:35Z","snapshot_observed_at":"2026-08-07T17:06:58.996059Z","submitted_at":"2025-03-13T14:31:52Z","title":"RealGeneral: Unifying Visual Generation via Temporal In-Context Learning with Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10406","snapshot_observed_at":"2026-08-07T12:53:26.025517Z","title":"Realgeneral: Unifying visual generation via temporal in-context learning with video models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:26.025517Z"},"links":{"cited_paper":"/paper/2503.10406","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:786d9835a9860d6b09264d590bf0296964a5d26ac0fa1a0a1bd1bff2bae645da","observation_id":"eebb71da-e1a6-4206-b3ba-b6d7b67678fd","resolution":{"observed_at":"2026-08-07T12:53:26.025517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T12:53:26.123096Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:26.123096Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:ae89ffe425410a8422022adaac6ebfa7d6d07944cfcfc66492775520d4886050","observation_id":"e0620991-1c15-45b6-8649-4e0a28f0d78b","resolution":{"observed_at":"2026-08-07T12:53:26.123096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02487","last_updated":"2025-01-15T13:07:56Z","snapshot_observed_at":"2026-07-06T20:16:40.311377Z","submitted_at":"2025-01-05T09:40:58Z","title":"ACE++: Instruction-Based Image Creation and Editing via Context-Aware Content Filling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02487","snapshot_observed_at":"2026-08-07T12:53:26.248424Z","title":"Ace++: Instruction-based image creation and editing via context-aware content filling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:26.248424Z"},"links":{"cited_paper":"/paper/2501.02487","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:5d0f49a0210f1846f73f41036705243daf55f9802e7d16bb83b455513bbd871a","observation_id":"0d1a92ec-5ef3-4e2e-a830-0fc4e02045dd","resolution":{"observed_at":"2026-08-07T12:53:26.248424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-08T06:35:17.078531Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-07T12:53:26.366072Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equations, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:26.366072Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:d9f53d88999c17e1afb728a5199e394c82dce4c848004ec8e583b525a04dabb9","observation_id":"52d2831d-ae13-4cb0-9654-7ee95a727e21","resolution":{"observed_at":"2026-08-07T12:53:26.366072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:35.229373Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models,","venue":null,"work_id":"488f244c-72d5-4fcd-b8c2-4cb75d054acf","year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:26.460823Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:55c45eca57a213ec179211e418dde1e64be31664031627cf09375a253835c634","observation_id":"e0b4540d-d307-4163-8434-ca7fdbc89f5f","resolution":{"observed_at":"2026-08-07T12:53:35.336112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:34.979892Z","title":"Kosmos-g: Generating images in context with multimodal large language models, 2024","venue":null,"work_id":"760e6624-708f-41fd-bf36-5e2057f25451","year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:26.689467Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:396fbff30ee152bdaa5229189eeae4f1bddf89df688e9d981ffc27cf14fa8282","observation_id":"cc656117-7b64-4218-8591-8b5265798ce8","resolution":{"observed_at":"2026-08-07T12:53:35.101862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-07-06T14:32:37.317828Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-07T12:53:26.850329Z","title":"Scalable diffusion models with transformers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:26.850329Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:3d2ae61b4248f9562cf998c55ce90ec1135da26467c97a67a1bf6c1b6cc3d0e5","observation_id":"243f49b9-f87a-46c2-afe4-94728d64eef4","resolution":{"observed_at":"2026-08-07T12:53:26.850329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T12:53:26.972678Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:26.972678Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:ab79a5e4a1db464eb4c8df00916e320782d7b1f5d03bbf8df82efb868afb84d3","observation_id":"6e9d63c4-de91-4ab4-8fc4-1e3fe876fdc7","resolution":{"observed_at":"2026-08-07T12:53:26.972678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13974","last_updated":"2024-01-25T06:18:20Z","snapshot_observed_at":"2026-08-03T00:16:06.403631Z","submitted_at":"2024-01-25T06:18:20Z","title":"BootPIG: Bootstrapping Zero-shot Personalized Image Generation Capabilities in Pretrained Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13974","snapshot_observed_at":"2026-08-07T12:53:27.096830Z","title":"Bootpig: Bootstrapping zero-shot personalized image generation capabilities in pretrained diffusion models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.096830Z"},"links":{"cited_paper":"/paper/2401.13974","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:2afeaa3721668357de588d8099b27d1edf1f5f36c7eb54e6a9c57b6d58cd8ce9","observation_id":"86f62b77-0205-4070-b02f-890ed7daf412","resolution":{"observed_at":"2026-08-07T12:53:27.096830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11147","last_updated":"2023-11-02T17:59:06Z","snapshot_observed_at":"2026-08-06T14:12:33.767391Z","submitted_at":"2023-05-18T17:41:34Z","title":"UniControl: A Unified Diffusion Model for Controllable Visual Generation In the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11147","snapshot_observed_at":"2026-08-07T12:53:27.194331Z","title":"Unicontrol: A unified diffusion model for controllable visual generation in the wild, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.194331Z"},"links":{"cited_paper":"/paper/2305.11147","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:0e784bbbdb358cc5cc3c38f7b0f829965e92fc871dc63d44e99a1c8251b48702","observation_id":"7a3873b5-8789-4556-9a85-19ba4b7cf5ab","resolution":{"observed_at":"2026-08-07T12:53:27.194331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T12:53:27.273796Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.273796Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:ff5518908067f1f0bf10f1d6ee1e5f7145d5ac35552f3a6f49626e7c60333cd9","observation_id":"51750bf5-8cc0-4955-9a6a-21315693b1d3","resolution":{"observed_at":"2026-08-07T12:53:27.273796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-07T12:53:27.441730Z","title":"High-resolution image synthesis with latent diffusion models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.441730Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:f97838943b028f370abb6ea7743eccb273766d1e860b8fb37a399301f6e6ae07","observation_id":"2bed482b-d625-492f-aab4-92a292a9fcd9","resolution":{"observed_at":"2026-08-07T12:53:27.441730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:34.763277Z","title":"Pathways on the image manifold: Image editing via video generation, 2025","venue":null,"work_id":"708c2709-7aa8-4e33-859d-0069d17e6da0","year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.519189Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:12daae782b6d9d73824792aa207eb84df9e5c556797f8b148c2ef1ab79dc7049","observation_id":"53d177e7-c07a-43cb-a859-9773f44859a2","resolution":{"observed_at":"2026-08-07T12:53:34.839305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-07-06T13:45:31.237782Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-08-07T12:53:27.573672Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.573672Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:591471800ad9a44718e604820cb594fd769d1cca56c231cdebae1bfb4a503d3b","observation_id":"0912837b-7be2-4506-9683-7809e2b7c9c2","resolution":{"observed_at":"2026-08-07T12:53:27.573672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-07T12:53:27.658040Z","title":"Roformer: Enhanced transformer with rotary position embedding, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.658040Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:82c9e7e8634cc9fe65007ceeb6e5190634931eb561190e7293a0a8d3750f54c8","observation_id":"aa974bee-d64e-4d0a-9454-dd74708d3f55","resolution":{"observed_at":"2026-08-07T12:53:27.658040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16224","last_updated":"2024-07-23T07:04:42Z","snapshot_observed_at":"2026-07-06T18:50:31.528338Z","submitted_at":"2024-07-23T07:04:42Z","title":"OutfitAnyone: Ultra-high Quality Virtual Try-On for Any Clothing and Any Person","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16224","snapshot_observed_at":"2026-08-07T12:53:27.768065Z","title":"Outfitanyone: Ultra-high quality virtual try-on for any clothing and any person","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.768065Z"},"links":{"cited_paper":"/paper/2407.16224","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:ecffe1fef7ba493a887c3b7d18f5bdf65b7c31857b05fe202c6f2b007b1a00f6","observation_id":"2e646a31-dff3-4317-92b8-7540b0931263","resolution":{"observed_at":"2026-08-07T12:53:27.768065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15098","last_updated":"2025-07-07T17:33:23Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T17:55:15Z","title":"OminiControl: Minimal and Universal Control for Diffusion Transformer","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15098","snapshot_observed_at":"2026-08-07T12:53:27.889742Z","title":"Ominicontrol: Minimal and universal control for diffusion transformer, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.889742Z"},"links":{"cited_paper":"/paper/2411.15098","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:751800f6c7fd8af33246d356443a6d26243dbaa855033bfa41086d63fb82f096","observation_id":"9bf47773-36cb-4c04-9e88-52b751623f84","resolution":{"observed_at":"2026-08-07T12:53:27.889742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:27.963363Z","title":"Emo: Emote portrait alive generating expressive portrait videos with audio2video diffusion model under weak conditions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:27.963363Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:3ed66d606f7ff3c5d0300bc72084087765b05cfd0ed677258dfe4c3b2d139ab6","observation_id":"9520d78b-51aa-498f-88b2-da9757dfdd97","resolution":{"observed_at":"2026-08-07T12:53:27.963363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T12:53:28.089019Z","title":"Wan: Open and advanced large-scale video generative models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:28.089019Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:339e92a6be28bd978b7c1802532b4c180fd615cdc355e12c3d231a17e106b840","observation_id":"3e20c2e0-2596-4a38-843b-847fc8d1698f","resolution":{"observed_at":"2026-08-07T12:53:28.089019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07209","last_updated":"2025-03-04T06:21:26Z","snapshot_observed_at":"2026-07-06T18:28:51.180903Z","submitted_at":"2024-06-11T12:32:53Z","title":"MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07209","snapshot_observed_at":"2026-08-07T12:53:28.265120Z","title":"Ms-diffusion: Multi-subject zero-shot image personalization with layout guidance, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:28.265120Z"},"links":{"cited_paper":"/paper/2406.07209","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:9798663d87fb3b44edc1206508f6d465b9dbf7c058b0f3ee1f4ed28f23986f20","observation_id":"35f5ae99-6e02-40e4-bc21-64cd33791876","resolution":{"observed_at":"2026-08-07T12:53:28.265120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02499","last_updated":"2023-03-24T07:10:47Z","snapshot_observed_at":"2026-08-06T18:08:11.618043Z","submitted_at":"2022-12-05T18:59:50Z","title":"Images Speak in Images: A Generalist Painter for In-Context Visual Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02499","snapshot_observed_at":"2026-08-07T12:53:28.364742Z","title":"Images speak in images: A generalist painter for in-context visual learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:28.364742Z"},"links":{"cited_paper":"/paper/2212.02499","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:2c26eded564b4f40dfae27aeb8f11e718808d0f02511f221e086f20768dec8fe","observation_id":"3ef60ca9-376e-400d-a205-e319dc938c54","resolution":{"observed_at":"2026-08-07T12:53:28.364742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:28.459005Z","title":"Bovik, H.R","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:28.459005Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:117182368e85a108cfa0a0895cd51fc2ebd169b19df4db33323a89271adbb45b","observation_id":"02e4607b-721c-426e-87a0-692699a9a502","resolution":{"observed_at":"2026-08-07T12:53:28.459005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13848","last_updated":"2023-08-18T17:12:13Z","snapshot_observed_at":"2026-08-04T02:07:54.822320Z","submitted_at":"2023-02-27T14:49:53Z","title":"ELITE: Encoding Visual Concepts into Textual Embeddings for Customized Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13848","snapshot_observed_at":"2026-08-07T12:53:28.602302Z","title":"Elite: Encoding visual concepts into textual embeddings for customized text-to-image generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:28.602302Z"},"links":{"cited_paper":"/paper/2302.13848","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:3a1077f657ee03f9d12455ed65f9158b27e2b724721f9828164d930da8f8e293","observation_id":"648dc1a1-1a9c-4e34-9a3f-2583a7f3dbe5","resolution":{"observed_at":"2026-08-07T12:53:28.602302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02160","last_updated":"2025-04-02T22:20:21Z","snapshot_observed_at":"2026-08-07T16:13:24.968703Z","submitted_at":"2025-04-02T22:20:21Z","title":"Less-to-More Generalization: Unlocking More Controllability by In-Context Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02160","snapshot_observed_at":"2026-08-07T12:53:29.227782Z","title":"Less-to-more generaliza- tion: Unlocking more controllability by in-context generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:29.227782Z"},"links":{"cited_paper":"/paper/2504.02160","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:efd32e422cf61fdee715af47e0426f1601d62a4a82c49b9b99fa9f4d2132cb30","observation_id":"320137bf-3f49-434a-a5a4-e127f3e0da13","resolution":{"observed_at":"2026-08-07T12:53:29.227782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11340","last_updated":"2024-11-21T14:09:12Z","snapshot_observed_at":"2026-07-06T19:16:51.512681Z","submitted_at":"2024-09-17T16:42:46Z","title":"OmniGen: Unified Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11340","snapshot_observed_at":"2026-08-07T12:53:29.727336Z","title":"Omnigen: Unified image generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:29.727336Z"},"links":{"cited_paper":"/paper/2409.11340","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:02bded51b28c57b41348b9677f049bb3f0abbc59e44c0152edad900ddc402f42","observation_id":"9ac4c8ac-ae23-4bdc-bb24-02da617503d2","resolution":{"observed_at":"2026-08-07T12:53:29.727336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:34.492843Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data, 2024","venue":null,"work_id":"055c6f08-bea7-449e-997f-ab11a9f1e140","year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:29.934326Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:e0223a3a32939887f2498bf9661be6f2b66c13411870a2dfb90020d19aed7ab5","observation_id":"46656ce4-947e-4829-a277-9ea6f2663364","resolution":{"observed_at":"2026-08-07T12:53:34.560875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:34.310043Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer,","venue":null,"work_id":"4af99cb4-4ebf-447e-93b2-687864602307","year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:29.975109Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:f4f2d7422c499a95f6456420371ede1128839b3d10a8b6009a1d2cfd11c25cc6","observation_id":"9ffd1d01-3d5c-4119-83eb-20b794d517b2","resolution":{"observed_at":"2026-08-07T12:53:34.394259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-07T12:53:30.237475Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:30.237475Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:447ea27186cc5e2e0cfc6fa65c13bfe7247b71842761cc0d081b035ce1e090ce","observation_id":"7e3fc520-b9d8-428b-9b0c-28d2492af878","resolution":{"observed_at":"2026-08-07T12:53:30.237475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08037","last_updated":"2025-03-11T04:42:59Z","snapshot_observed_at":"2026-08-07T17:14:25.226439Z","submitted_at":"2025-03-11T04:42:59Z","title":"ObjectMover: Generative Object Movement with Video Prior","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08037","snapshot_observed_at":"2026-08-07T12:53:30.408952Z","title":"Objectmover: Generative object movement with video prior, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:30.408952Z"},"links":{"cited_paper":"/paper/2503.08037","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:805b3feb91ab4bd2d85fd18f5c64d39237edaad396bf6a47f06eb11b0af69924","observation_id":"bfb670ce-16c0-4764-904c-1859e2507857","resolution":{"observed_at":"2026-08-07T12:53:30.408952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06187","last_updated":"2024-07-08T17:59:02Z","snapshot_observed_at":"2026-08-03T15:36:58.115205Z","submitted_at":"2024-07-08T17:59:02Z","title":"JeDi: Joint-Image Diffusion Models for Finetuning-Free Personalized Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06187","snapshot_observed_at":"2026-08-07T12:53:30.525808Z","title":"Patel, Haochen Wang, Xun Huang, Ting-Chun Wang, Ming-Yu Liu, and Yogesh Balaji","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:30.525808Z"},"links":{"cited_paper":"/paper/2407.06187","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:e3f292e7adefdc71da95dac2dc5ab3db8654a7ea87928a8f807ce17bceeb73c8","observation_id":"d2c46835-2ba1-4c49-be0d-83e2a74603b0","resolution":{"observed_at":"2026-08-07T12:53:30.525808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T12:53:30.136888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:30.136888Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:4336a9ec23702321328e87ab4b072f95a6969a6bb183501b67f6a01981d3da6e","observation_id":"34811bf5-c029-4d39-b90d-26e15c5fe086","resolution":{"observed_at":"2026-08-07T12:53:30.136888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-04T15:27:22.366324Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05543","snapshot_observed_at":"2026-08-07T12:53:30.777391Z","title":"Adding conditional control to text-to-image diffusion models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:30.777391Z"},"links":{"cited_paper":"/paper/2302.05543","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:66d3e3d831debd4a823f841e9f6f31de86ba7cb89c51497b8bb7f0788bb36ae6","observation_id":"52e12105-c447-46b7-9ad0-6f3318182959","resolution":{"observed_at":"2026-08-07T12:53:30.777391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:34.031742Z","title":"Framepainter: Endowing interactive image editing with video diffusion priors, 2025","venue":null,"work_id":"94af64ad-f8e9-4244-9ccc-d4ae9013a135","year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:30.944749Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:fd4de3764a2636656c899d91ec1c4f8c61a7cd1c95081056791501e9cbb4c6aa","observation_id":"c2ed3c3a-522d-4ff1-b216-ebdd426cf547","resolution":{"observed_at":"2026-08-07T12:53:34.178606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16272","last_updated":"2024-03-14T10:44:49Z","snapshot_observed_at":"2026-08-05T10:16:10.209837Z","submitted_at":"2023-12-26T14:39:11Z","title":"SSR-Encoder: Encoding Selective Subject Representation for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16272","snapshot_observed_at":"2026-08-07T12:53:31.038003Z","title":"Ssr-encoder: Encoding selective subject representation for subject-driven generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:31.038003Z"},"links":{"cited_paper":"/paper/2312.16272","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:d33560cdbed9582a273d5508e612d07725e971449138d751e13283aadd8a4951","observation_id":"80d9c484-5c5f-4e4e-baed-abe2d4be1325","resolution":{"observed_at":"2026-08-07T12:53:31.038003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-07T12:53:30.654223Z","title":"mixup: Beyond empirical risk minimization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:30.654223Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:cfc8558aa08f9f7eb1e3781ed4921e84ae033b3b47b81531c33e934025a70888","observation_id":"b7f7f55a-a9a4-4b17-b60a-7db377a29df6","resolution":{"observed_at":"2026-08-07T12:53:30.654223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16322","last_updated":"2023-10-29T15:59:24Z","snapshot_observed_at":"2026-07-06T15:33:31.386787Z","submitted_at":"2023-05-25T17:59:58Z","title":"Uni-ControlNet: All-in-One Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16322","snapshot_observed_at":"2026-08-07T12:53:31.319577Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:31.319577Z"},"links":{"cited_paper":"/paper/2305.16322","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:ec3ec57995d4626a0ef6ad22d8a197cb184b3d9cc0d64447157a08275f66c162","observation_id":"06d7d17d-210f-457b-8afc-ce0cb217cd38","resolution":{"observed_at":"2026-08-07T12:53:31.319577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.10593","last_updated":"2020-08-24T16:51:03Z","snapshot_observed_at":"2026-08-07T20:56:03.378091Z","submitted_at":"2017-03-30T17:44:17Z","title":"Unpaired Image-to-Image Translation using Cycle-Consistent Adversarial Networks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.10593","snapshot_observed_at":"2026-08-07T12:53:31.447194Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:31.447194Z"},"links":{"cited_paper":"/paper/1703.10593","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:2a8195acfd456a0a8d7f1804cd9e2ee27849918e3cdf4e83e4d2ac20b3823ca2","observation_id":"2f75b79a-8377-4460-ac67-91195de42a36","resolution":{"observed_at":"2026-08-07T12:53:31.447194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:33.819194Z","title":"[depth]","venue":null,"work_id":"7e2877b1-4330-4341-8123-5816794f1d9e","year":2024},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:31.608564Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:acd364788f7beeae977c88214c203fb473e63d492a29894eccaa73c28724b4ad","observation_id":"d969ff91-810a-4f4d-9b1e-a099d5a0c0c1","resolution":{"observed_at":"2026-08-07T12:53:33.885043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07027","last_updated":"2025-03-10T08:07:17Z","snapshot_observed_at":"2026-08-07T17:17:43.519906Z","submitted_at":"2025-03-10T08:07:17Z","title":"EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07027","snapshot_observed_at":"2026-08-07T12:53:31.157666Z","title":"Easycontrol: Adding efficient and flexible control for diffusion transformer, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:31.157666Z"},"links":{"cited_paper":"/paper/2503.07027","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:63bc9ae726e4dfb319edc35803c6aeea761a720cdb612f6bbe3819205db33f26","observation_id":"0d46ac32-7a64-40d5-8378-53326c8e5270","resolution":{"observed_at":"2026-08-07T12:53:31.157666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:33.449760Z","title":"Color: saturation, hue, brightness, and distribution","venue":null,"work_id":"f92e8518-0697-40ab-8fdd-05b73a2f3903","year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:31.707544Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:f0826527efed0f5aab2a7dbfb6fcf8531f2b14fb33f7814c6ea5b28871d5b015","observation_id":"1ffe697d-07fc-421c-bf41-2d15c0dea4e3","resolution":{"observed_at":"2026-08-07T12:53:33.584390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:53:33.244900Z","title":"subject_consistency\\","venue":null,"work_id":"2d23ea11-f26a-4551-875f-eab26d823f3a","year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:31.813629Z"},"links":{"citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:54dc70dc8d3f159d8dd76ba99e3ab3179a723fd1eb87d8f6b7e52f86e1070049","observation_id":"75cb6671-5972-4e80-9b3a-68cbd6ab7db3","resolution":{"observed_at":"2026-08-07T12:53:33.313391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-07T12:53:23.757908Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:23.757908Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:181ac9afde4849bb39729cfb7132ae366cae91471f59faf278e910d235a26499","observation_id":"4d06814a-e6b6-4d16-954e-52c660e4cdc7","resolution":{"observed_at":"2026-08-07T12:53:23.757908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-07-31T21:11:02.534986Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08453","snapshot_observed_at":"2026-08-07T12:53:26.559174Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:26.559174Z"},"links":{"cited_paper":"/paper/2302.08453","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:0a4ff7dca616cbcb08462a97bfbcdc86c66231c88790a9590b69ecb60dafa300","observation_id":"66349a54-4bfd-4207-a87b-96befd67ff80","resolution":{"observed_at":"2026-08-07T12:53:26.559174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T12:53:25.339574Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T12:53:25.339574Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2505.23325"},"observation_digest":"sha256:481ce866763053e51e53286fae46953abd9420412f2fa5ae5fd345ff553593b2","observation_id":"6f915303-3baa-4906-81ff-311cad3b66b0","resolution":{"observed_at":"2026-08-07T12:53:25.339574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23325","last_updated":"2025-05-29T10:34:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T12:45:44.638156Z","submitted_at":"2025-05-29T10:34:45Z","title":"Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 5 inbound Pith citation observations for arXiv:2505.23325."}