{"as_of":"2026-08-07T23:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fe622970f09c647883a634984d7ffae9f4db070a2becdccb795c33f25139bf2","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:57:02.637395Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.23134/citation-record","integrity":"/paper/2505.23134/integrity","json":"/paper/2505.23134/citation-record.json","paper":"/paper/2505.23134"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.192918Z","title":"Self-rectifying diffusion sampling with perturbed-attention guidance","venue":null,"work_id":"e665b0c3-44c1-4cbc-9468-9871de86e909","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.237908Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:bf1867d63036c1b705a0c0f471aefb7bfecfdaccb3787298cc5bcb95dbd7570c","observation_id":"74ac104b-71e7-4c0a-b966-b0a01bd697fb","resolution":{"observed_at":"2026-08-07T12:57:03.196147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.183083Z","title":"Cross-image attention for zero-shot appearance transfer","venue":null,"work_id":"cf57d662-6576-4bd4-bff0-91003197dddd","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.349817Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:739727fb9856a4c44db375b2c6f7553c61a67af954cbb257ad776cfb3b86f5f1","observation_id":"9a0c58ef-da45-4708-a9e0-c0085dc54ab0","resolution":{"observed_at":"2026-08-07T12:57:03.186990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.174383Z","title":null,"venue":null,"work_id":"3c8757a4-f696-4430-97e2-8ae288c24538","year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.457782Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:dafcdae98eb6bdafb6e4ec69b34c7807814e2db8f656a390aa2ec83897f569a5","observation_id":"23c7276f-0233-4326-ae4c-c653736092b4","resolution":{"observed_at":"2026-08-07T12:57:03.177649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T12:57:00.561585Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.561585Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:5d84c1136f569667e127bd5b411657cbe53739f1006f3c8fc3da2b1c31b11c48","observation_id":"ea03f960-50ba-41dd-9578-e88f573b1475","resolution":{"observed_at":"2026-08-07T12:57:00.561585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-07T12:57:00.670109Z","title":"Pixart- alpha: Fast training of diffusion transformer for pho- torealistic text-to-image synthesis.arXiv preprint arXiv:2310.00426, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.670109Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:9a0a990e9b7aeb667cccf5d64a37cc0166b28508bbd8e4dcb58bd6668f7f0292","observation_id":"cf4449c8-732a-4920-9914-fa4a736cf5ec","resolution":{"observed_at":"2026-08-07T12:57:00.670109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.163734Z","title":"Style injection in diffusion: A training-free approach for adapting large-scale diffusion models for style trans- fer","venue":null,"work_id":"44bf31eb-7cfc-4fe6-af9d-a611605fc661","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.773634Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:3112a3696eb0dddf9cd943461336bdc0498575198bda6044eade79af496f0775","observation_id":"636b417b-3f67-4221-b902-dcde4bb4e63e","resolution":{"observed_at":"2026-08-07T12:57:03.167833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05922","last_updated":"2024-02-29T21:06:58Z","snapshot_observed_at":"2026-07-06T16:30:00.114521Z","submitted_at":"2023-10-09T17:59:53Z","title":"FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05922","snapshot_observed_at":"2026-08-07T12:57:00.882278Z","title":"Flat- ten: optical flow-guided attention for consistent text- to-video editing.arXiv preprint arXiv:2310.05922,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.882278Z"},"links":{"cited_paper":"/paper/2310.05922","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:a6896f562e04b87f7f67671304ce9efaaefd777d544849f46ab608dee7e1055c","observation_id":"b5431def-66e2-43f6-9845-5681a5ce0f43","resolution":{"observed_at":"2026-08-07T12:57:00.882278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.154889Z","title":"Diffusion self-guidance for controllable image generation.Advances in Neu- ral Information Processing Systems, 36:16222–16239,","venue":null,"work_id":"b77a25d4-642f-4629-b336-4dccf4aefdb5","year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.027585Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:cf6ec709f31778915ac9efbe6c2b16d41cb7ce1d596db7328dd4b9d0e9c46a14","observation_id":"fb848470-fa14-422c-a3e7-957f34f6af66","resolution":{"observed_at":"2026-08-07T12:57:03.158206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.146091Z","title":"Ccedit: Creative and controllable video editing via diffusion models","venue":null,"work_id":"e6f95e3f-2885-4071-a91b-508a91570c90","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.039473Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:7fb4d73895a409618db3091334aea90ace02a6c78a812bd6ea0d2a2a266eaa15","observation_id":"4a1195fa-b86a-4286-8156-5f00cb6ddb99","resolution":{"observed_at":"2026-08-07T12:57:03.149397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-06T08:12:35.134201Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10373","snapshot_observed_at":"2026-08-07T12:57:01.047081Z","title":"Tokenflow: Consistent diffusion fea- tures for consistent video editing.arXiv preprint arXiv:2307.10373, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.047081Z"},"links":{"cited_paper":"/paper/2307.10373","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:e614c5f49a1b288d2db6efb075e0c3d37c5fbd2edd19fc7e1157920eb7d7192c","observation_id":"c7dec3b0-a135-47c6-94ea-d84839c5a38a","resolution":{"observed_at":"2026-08-07T12:57:01.047081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T12:57:01.070384Z","title":"Prompt- to-prompt image editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.070384Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:5559e69ea87895f7be21cbdb7d2bdc55fafbf245a35e3b0c6f9027dcddec08a5","observation_id":"010d8e28-9741-4f51-b562-b4f529fc68b5","resolution":{"observed_at":"2026-08-07T12:57:01.070384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.137062Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"34f204e3-3cd4-493a-9d00-f0b08f80a144","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.145825Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:7f145ec134e222663649c5841c8ce4eba573c8116ac11e8a07a9d0b1c43bf592","observation_id":"f1b6f616-88d9-4537-8ac9-54823eb7026c","resolution":{"observed_at":"2026-08-07T12:57:03.140320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.127987Z","title":"Rave: Ran- domized noise shuffling for fast and consistent video editing with diffusion models","venue":null,"work_id":"59c352c6-7ca2-43d0-a082-686c17852ce6","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.190370Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:55cd9bc7177850062d91b975e45294808399c4db299adcb4e3d0a6d35c396b95","observation_id":"d4150044-3ec4-4a98-bc26-da28a5d4a18a","resolution":{"observed_at":"2026-08-07T12:57:03.131285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.117949Z","title":"Gaussian deblur controlnet","venue":null,"work_id":"e35ed397-449f-46a7-ad08-c2afca3e5c3d","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.232429Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:7ad18f53c187ce16cb1d8fa0ae38224d557606269f94d0640ee15a22f74f361a","observation_id":"e4d695ae-4ed8-4842-b327-9c6b90af8727","resolution":{"observed_at":"2026-08-07T12:57:03.122023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-07T12:57:01.251723Z","title":"Anyv2v: A plug-and-play framework for any video-to-video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.251723Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:7be7f1cbe187160d4706d6b73c4cedcd8f6c59db20e72de20906db00868b68e1","observation_id":"bee24ced-75ec-4af9-b400-2dd06854b47a","resolution":{"observed_at":"2026-08-07T12:57:01.251723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12027","last_updated":"2025-04-17T01:49:31Z","snapshot_observed_at":"2026-08-07T16:01:49.396890Z","submitted_at":"2025-04-16T12:37:08Z","title":"Understanding Attention Mechanism in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12027","snapshot_observed_at":"2026-08-07T12:57:01.325386Z","title":"Under- standing attention mechanism in video diffusion mod- els.arXiv preprint arXiv:2504.12027, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.325386Z"},"links":{"cited_paper":"/paper/2504.12027","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:fb470c6f2f70d407b32e6264a930bb68eecc52e9e4b92b7d0a0e7d00bb9a1e06","observation_id":"9b77efe5-856d-4308-be80-e0fd4af3d99b","resolution":{"observed_at":"2026-08-07T12:57:01.325386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:01.377565Z","title":"Stablev2v: Stablizing shape con- sistency in video-to-video editing.arXiv preprint arXiv:2411.11045, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.377565Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:681147b1d3d39e9b04913b531f244b264adc4bc5bb7b9929fe158092a26394cf","observation_id":"8b17eb46-747d-42c4-8711-422cd15107af","resolution":{"observed_at":"2026-08-07T12:57:01.377565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.107763Z","title":"Colorization controlnet","venue":null,"work_id":"7a0a988e-8894-40d3-90d2-645a0bbb9260","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.423309Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:1b7f123b4604fb04e401ca10bcc94ca27388827f030072e61afc60e8f6cd1b78","observation_id":"df592e8e-1cef-48c5-94aa-8e22ab8135ee","resolution":{"observed_at":"2026-08-07T12:57:03.111364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.098412Z","title":"Tile controlnet","venue":null,"work_id":"cfe60854-3cd1-4bf0-a810-b78ddbb354a7","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.495380Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:649ad486450ef7c6e0d253370690f34b69e375d5eadb4d675023a0c85f273659","observation_id":"2098706c-3b16-43b5-9ad5-f7682224d08d","resolution":{"observed_at":"2026-08-07T12:57:03.101548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.087671Z","title":"Diffusion hyperfea- tures: Searching through time and space for seman- tic correspondence.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"00556cb5-c802-47d0-842a-ca56ddf2fa9f","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.537533Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:fe1395934a5b64cbcd3404b06cf8c9fa8c4bde002d6c23bb40b89cffc45517e3","observation_id":"594415c9-8425-4e48-90d3-6c46a5e5e5a1","resolution":{"observed_at":"2026-08-07T12:57:03.091339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02421","last_updated":"2023-11-20T09:08:42Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T16:43:56Z","title":"DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02421","snapshot_observed_at":"2026-08-07T12:57:01.594590Z","title":"Dragondiffusion: Enabling drag- style manipulation on diffusion models.arXiv preprint arXiv:2307.02421, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.594590Z"},"links":{"cited_paper":"/paper/2307.02421","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:bba93013e37c111786b23710c939da79feeed4bcefd0010c27d3580e2855cde5","observation_id":"ad534818-bee5-4b00-947d-75754ee73c5c","resolution":{"observed_at":"2026-08-07T12:57:01.594590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.078447Z","title":"Diffeditor: Boosting accuracy and flexibility on diffusion-based image editing","venue":null,"work_id":"a65e0484-d232-45c4-8d8a-c00456025ad3","year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.662819Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:420c9da4bc7066426f5172a11105f754a8d440a7ed1e62fe5de081a3a6e374ea","observation_id":"beb40a44-331d-4862-9f09-b0d242333ee7","resolution":{"observed_at":"2026-08-07T12:57:03.081787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.068845Z","title":"T2i- adapter: Learning adapters to dig out more control- lable ability for text-to-image diffusion models","venue":null,"work_id":"a49ed488-6f75-48d4-9e96-9e6530212dfe","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.720452Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:41d140f6969e6ebc396ec7dd30407a1e49c0e78409fec546a71b2234458ea3f5","observation_id":"15a3632a-111e-4246-9f61-da35d5089e0a","resolution":{"observed_at":"2026-08-07T12:57:03.072728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.059516Z","title":"I2vedit: First-frame-guided video edit- ing via image-to-video diffusion models","venue":null,"work_id":"b52608ae-cde1-408c-9c65-07f809a33807","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.773911Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:605735a4bfd95b60bae3be86599827c8785149dd86843e01cd88884d125362b0","observation_id":"6819682b-d97b-43b4-bce8-af587d306ea2","resolution":{"observed_at":"2026-08-07T12:57:03.063078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.050455Z","title":"Swapping autoencoder for deep image manipulation","venue":null,"work_id":"13c55e71-5234-4d2b-9d0d-e2bbee9d7d22","year":2020},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.823625Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:50687e65173b518c463ce312bdddde3f9c4d71233d1ffd2d7fc90b2059de9902","observation_id":"ec5b5a97-523a-4689-bf28-2c682435d91f","resolution":{"observed_at":"2026-08-07T12:57:03.053884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:01.867837Z","title":"Scalable diffu- sion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.867837Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:334204c1db0525f0f83e8b0c7d79a13da8236d981af5bad8e19d7f5fed28b0a4","observation_id":"5c8e1989-b0f3-4e0b-acd4-5bb0786c2e6c","resolution":{"observed_at":"2026-08-07T12:57:01.867837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.035427Z","title":"Fatezero: Fusing attentions for zero-shot text-based video editing","venue":null,"work_id":"46f0bda7-6df3-4e66-97aa-70f287669196","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.927362Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:d12c7f519f3da925e9dd1ad5dda5fed318eb5fd79de94159c6bdad770031e3a3","observation_id":"7c9f5e9e-953d-4690-9dc5-8f470d0d5d9a","resolution":{"observed_at":"2026-08-07T12:57:03.038920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11147","last_updated":"2023-11-02T17:59:06Z","snapshot_observed_at":"2026-08-06T14:12:33.767391Z","submitted_at":"2023-05-18T17:41:34Z","title":"UniControl: A Unified Diffusion Model for Controllable Visual Generation In the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11147","snapshot_observed_at":"2026-08-07T12:57:01.989913Z","title":"Unicontrol: A unified diffusion model for controllable visual gener- ation in the wild.arXiv preprint arXiv:2305.11147,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.989913Z"},"links":{"cited_paper":"/paper/2305.11147","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:71fb982ddd7bc98fea2135f663eafca30d470720f11bcda4f0dd70ddfced17af","observation_id":"d28e6ec6-73e9-487e-a04a-749b3892bbb4","resolution":{"observed_at":"2026-08-07T12:57:01.989913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.025335Z","title":"High- resolution image synthesis with latent diffusion mod- els","venue":null,"work_id":"8e35cc7f-ab13-4e4f-923e-3e51dfe257fc","year":2022},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.039980Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:de8f48a2c3640375037319a6756c00fa4b6e70bf510f87b2b7bde32b5aacfa92","observation_id":"ad0c5d5a-13e0-46d3-895e-07ee370763fb","resolution":{"observed_at":"2026-08-07T12:57:03.028875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T12:57:02.091475Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.091475Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:83d77c7ead618c3a816288d677852985f5d99a1814bb7b3abc6a19b076b46476","observation_id":"91a1c65c-a3dc-4ad4-9ec5-7c6609e344e3","resolution":{"observed_at":"2026-08-07T12:57:02.091475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15098","last_updated":"2025-07-07T17:33:23Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T17:55:15Z","title":"OminiControl: Minimal and Universal Control for Diffusion Transformer","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15098","snapshot_observed_at":"2026-08-07T12:57:02.163714Z","title":"Ominicontrol: Minimal and universal control for diffusion transformer.arXiv preprint arXiv:2411.15098, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.163714Z"},"links":{"cited_paper":"/paper/2411.15098","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:76b846ce6e879a7e590db8343fb8665c90dbd111f803863c84cada9aea95b4cf","observation_id":"633f499d-9eff-49f8-b5c1-f14332d2fa7a","resolution":{"observed_at":"2026-08-07T12:57:02.163714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08280","last_updated":"2025-03-11T10:50:14Z","snapshot_observed_at":"2026-08-07T17:13:28.752920Z","submitted_at":"2025-03-11T10:50:14Z","title":"OminiControl2: Efficient Conditioning for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08280","snapshot_observed_at":"2026-08-07T12:57:02.237633Z","title":"Ominicontrol2: Effi- cient conditioning for diffusion transformers.arXiv preprint arXiv:2503.08280, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.237633Z"},"links":{"cited_paper":"/paper/2503.08280","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:ea38b9aff971f95860b4e28089e7b8c98d6df73eac5f3bbeb48ac835e99d883a","observation_id":"76860890-9037-4535-9488-f9a4b67cb314","resolution":{"observed_at":"2026-08-07T12:57:02.237633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.013002Z","title":"Emergent correspondence from image diffusion.Advances in Neural Information Processing Systems, 36: 1363–1389, 2023","venue":null,"work_id":"3c8a895f-1d23-4d37-bb35-559746e86100","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.304265Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:342963643a764f1fe788006ceb32b289618fe401e98d32e0ab91f9381d84818b","observation_id":"4a65ed62-e686-4541-858f-7b06f9ed0436","resolution":{"observed_at":"2026-08-07T12:57:03.017499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.002773Z","title":"Training- free consistent text-to-image generation.ACM Trans- actions on Graphics (TOG), 43(4):1–18, 2024","venue":null,"work_id":"968c373f-8c2e-48d7-8a7e-2f6d88bb709c","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.360228Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:318259016d8c5784566def8e03af21f525c203cfcb950fd402e0ce8b7f7f93e6","observation_id":"8e1ca918-f75c-4135-9f64-b961777e7a52","resolution":{"observed_at":"2026-08-07T12:57:03.006437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.991840Z","title":"Splicing vit features for semantic appearance transfer","venue":null,"work_id":"c5b133bb-9a0d-444f-a049-eb5b705f284c","year":2022},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.429182Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:54fcd8e963689e537f47def21d2c374f67658576c7aba7c5b1cce9e50b965996","observation_id":"15f7a85b-10d8-4bc6-8d25-7ef6135d05a5","resolution":{"observed_at":"2026-08-07T12:57:02.995312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.980530Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"e7b80c2e-5c30-4c4b-a881-dce6671e2f5d","year":1921},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.478612Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:70b306b80c3695d75d12a5b772ba3c269ccc6d6b8ab368b88cad0331ee34f95f","observation_id":"2d45417f-156f-4f46-9a31-214b393d16ef","resolution":{"observed_at":"2026-08-07T12:57:02.984096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08850","last_updated":"2024-12-08T10:17:43Z","snapshot_observed_at":"2026-07-06T18:30:06.570612Z","submitted_at":"2024-06-13T06:27:13Z","title":"COVE: Unleashing the Diffusion Feature Correspondence for Consistent Video Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08850","snapshot_observed_at":"2026-08-07T12:57:02.523020Z","title":"Cove: Unleashing the diffu- sion feature correspondence for consistent video edit- ing.arXiv preprint arXiv:2406.08850, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.523020Z"},"links":{"cited_paper":"/paper/2406.08850","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:4d8376c08e98138d0ab6a336a9eedd1064a2328b7383cb0947b3eff0858c9d3c","observation_id":"79ec2916-65ad-41cb-8d74-c0339fa503a8","resolution":{"observed_at":"2026-08-07T12:57:02.523020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.970243Z","title":"Gmflow: Learning op- tical flow via global matching","venue":null,"work_id":"d9ef1dc5-ed7f-46b9-be88-3bb777f3da22","year":2022},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.574739Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:a18eebe1ba1166e365b1da4395283d17defa03d3a3bcf0874be636690734ceaf","observation_id":"365f647f-6a54-4c49-96f2-f0d04a6b9f4f","resolution":{"observed_at":"2026-08-07T12:57:02.974002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14201","last_updated":"2024-05-27T03:14:02Z","snapshot_observed_at":"2026-08-06T05:20:02.522596Z","submitted_at":"2024-05-23T06:01:13Z","title":"FreeTuner: Any Subject in Any Style with Training-free Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14201","snapshot_observed_at":"2026-08-07T12:57:02.582930Z","title":"Freetuner: Any subject in any style with training-free diffusion.arXiv preprint arXiv:2405.14201, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.582930Z"},"links":{"cited_paper":"/paper/2405.14201","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:c596030bcdbd5f95b30f849e5f51abe05a101c4ca030933abb996750c7db2192","observation_id":"52df8723-1e36-42d8-b5fe-8e9c63dad5a7","resolution":{"observed_at":"2026-08-07T12:57:02.582930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.958870Z","title":"Rerender a video: Zero-shot text-guided video- to-video translation","venue":null,"work_id":"0c11c8c8-8e32-4425-b7ad-bdf358cdc987","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.593931Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:a552da9a7996dc0101f8300329db5395e5850524fdc3ad648242a4fbcf6ec9bc","observation_id":"c56525f2-0f73-4546-8abe-1b6a8af376a4","resolution":{"observed_at":"2026-08-07T12:57:02.963085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.945923Z","title":"Fresco: Spatial-temporal correspondence for zero-shot video translation","venue":null,"work_id":"3a25ce59-2958-4502-97f4-3fb59697cf7a","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.600511Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:df161524c06aeec09cf43b068b7d7949e37525a0ca81c145dc87a0f71b974152","observation_id":"3bbe7f5b-b53f-415e-b62d-59f0e318193f","resolution":{"observed_at":"2026-08-07T12:57:02.950016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.935164Z","title":"Colormnet: A memory-based deep spatial- temporal feature propagation network for video col- orization","venue":null,"work_id":"62e0c79e-bba5-49d4-ac4f-a346f76b9378","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.608119Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:d1cf7a7fa55871754bed81333612d2e068585f884ee727db2acdad3624ebf8cc","observation_id":"ca16efb0-d261-48f2-a679-13d94bf04a6a","resolution":{"observed_at":"2026-08-07T12:57:02.939208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.924887Z","title":"Bistnet: Seman- tic image prior guided bidirectional temporal feature fusion for deep exemplar-based video colorization","venue":null,"work_id":"9017c2f4-bc96-4e3e-a58b-e6e674906040","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.614062Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:671efccd462953f0daf3a0022c33b8b60fd102e52d83d1db44702ff4cdf2d1bd","observation_id":"40c803a8-2bb0-4950-9748-53bf367d69ec","resolution":{"observed_at":"2026-08-07T12:57:02.928367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.913569Z","title":"A tale of two features: Stable dif- fusion complements dino for zero-shot semantic cor- respondence.Advances in Neural Information Pro- cessing Systems, 36, 2024","venue":null,"work_id":"29128e29-080a-4de0-a70b-9d9b21d55536","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.621810Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:cf3b1575b713ad5b28c1e1ac40d7d98b8bbb266bbbd182e14ca5998b7b8bfb90","observation_id":"a953d2d6-a5ea-4492-bcfa-093d6a139f2b","resolution":{"observed_at":"2026-08-07T12:57:02.917302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.900429Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"98ae0de6-daa4-4f4e-aa4d-c5ef5f82f794","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.630597Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:29b84039151adc93bdbfa61f62297933aeb28066e2b887b3f824d85c057e320e","observation_id":"91d72e78-bb16-4ff4-bbe4-7b2999733b83","resolution":{"observed_at":"2026-08-07T12:57:02.906215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-07T12:57:02.633813Z","title":"I2vgen-xl: High-quality image-to-video synthesis via cascaded diffusion mod- els.arXiv preprint arXiv:2311.04145, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.633813Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:350fb66604dbd92c1cfbcf399f4015182e2bc6a4da0682e7cc88cfc632f0ccdb","observation_id":"6836c1fe-5e1f-40c9-a6ad-51277fe85d0e","resolution":{"observed_at":"2026-08-07T12:57:02.633813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07027","last_updated":"2025-03-10T08:07:17Z","snapshot_observed_at":"2026-08-07T17:17:43.519906Z","submitted_at":"2025-03-10T08:07:17Z","title":"EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07027","snapshot_observed_at":"2026-08-07T12:57:02.637395Z","title":"Easycontrol: Adding efficient and flexible control for diffusion transformer.arXiv preprint arXiv:2503.07027, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.637395Z"},"links":{"cited_paper":"/paper/2503.07027","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:6c24d4748ec536098dcd245118cb5566e4aa2750fe910e00d569a99439121870","observation_id":"20e35e7d-f2ab-40a0-aea6-8dd9c21077ad","resolution":{"observed_at":"2026-08-07T12:57:02.637395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2505.23134."}