{"as_of":"2026-08-08T20:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c96076978f53ed02dd3d187bb41a158b3c9b2eec2c338fc627f4cbd7c2d585d","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:18:10.389722Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05745/citation-record","integrity":"/paper/2608.05745/integrity","json":"/paper/2608.05745/citation-record.json","paper":"/paper/2608.05745"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.312937Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence (AAAI) , volume =","venue":null,"work_id":"8bcf2923-0efc-4892-a6d9-01dcf739538e","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.160929Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:4ce7acb62582bf24ed00e46ea6cb656e31f61b72c21ec2e22a52fb04f15f6a39","observation_id":"2027197f-6796-4712-8942-52dd68b735f8","resolution":{"observed_at":"2026-08-08T00:18:11.316555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.302608Z","title":"Proceedings of the European Conference on Computer Vision (ECCV) , pages =","venue":null,"work_id":"9eda5564-62fe-464d-9523-2c6cc717e68f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.165360Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:fd4f08126550b5fdab43fa0d3cd1adda845164819e59bd32f3458385e2be6149","observation_id":"040dd07d-56af-4bfa-9e2c-f47e6b6ae1f4","resolution":{"observed_at":"2026-08-08T00:18:11.306271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.292239Z","title":"International Journal of Computer Vision , volume =","venue":null,"work_id":"cb8d97c6-5875-4f5c-b4ce-c3c77b27c0b3","year":2025},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.169001Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:dbfe9ad74af0bfdd0ff720abf4bc49dc14524d3f6f8f89630101190da4a0f1ff","observation_id":"44b58340-a81c-4454-b0fc-99ac300f941c","resolution":{"observed_at":"2026-08-08T00:18:11.296175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10499","last_updated":"2024-11-22T08:19:48Z","snapshot_observed_at":"2026-07-06T19:51:09.829522Z","submitted_at":"2024-11-15T11:02:23Z","title":"FitDiT: Advancing the Authentic Garment Details for High-fidelity Virtual Try-on","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10499","snapshot_observed_at":"2026-08-08T00:18:10.173095Z","title":"arXiv preprint arXiv:2411.10499 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.173095Z"},"links":{"cited_paper":"/paper/2411.10499","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:4f18b148586c9f6ef84332f84f8597a3ebf128d3ea702945f8b4f0fd317a5016","observation_id":"57465ee2-ba70-49a7-bcfb-754e3b7d5642","resolution":{"observed_at":"2026-08-08T00:18:10.173095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.282059Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"925f2dcb-36f7-4c05-85ee-f5eb59aed473","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.177206Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:d2587b97ed6cf6ab8b86b56a7ae0e0889435b2af3cb13112ea050ef716c21688","observation_id":"b953dee0-3d80-41ab-8697-a17826db0852","resolution":{"observed_at":"2026-08-08T00:18:11.285728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.270732Z","title":"International Journal of Computer Vision , volume =","venue":null,"work_id":"4cf08025-33d7-44e2-a542-6ff849829b95","year":2025},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.180743Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:929d66832505fbc86e345af0322fa79951769257edc17f453311f166e344d785","observation_id":"006be667-ebcd-4b6e-9c27-828d38ac76fc","resolution":{"observed_at":"2026-08-08T00:18:11.275213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.260520Z","title":"IEEE Transactions on Multimedia , volume =","venue":null,"work_id":"6c664485-abc2-49bb-b3e8-a15291b7b6d2","year":2024},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.184259Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:404e220255af24b5d20a7d691928e62d11da443d15a35a6436bd73245f0fed4f","observation_id":"261161d4-2df3-4bba-a012-2fc8bcf14ead","resolution":{"observed_at":"2026-08-08T00:18:11.263999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18350","last_updated":"2025-08-07T19:11:41Z","snapshot_observed_at":"2026-07-06T19:57:55.925634Z","submitted_at":"2024-11-27T13:53:09Z","title":"TryOffDiff: Virtual-Try-Off via High-Fidelity Garment Reconstruction using Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18350","snapshot_observed_at":"2026-08-08T00:18:10.187670Z","title":"arXiv preprint arXiv:2411.18350 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.187670Z"},"links":{"cited_paper":"/paper/2411.18350","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:b4d60599abb5c3cd609e154aeaaa88be1ea6225c9a82ce6777231cbbd7610bb8","observation_id":"d3cf88f5-0ab9-4b4f-964a-49902ad452b9","resolution":{"observed_at":"2026-08-08T00:18:10.187670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21270","snapshot_observed_at":"2026-08-08T00:18:10.191565Z","title":"arXiv preprint arXiv:2506.21270 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.191565Z"},"links":{"cited_paper":"/paper/2506.21270","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:a21236056bc4d4ea5905b22a355eba12b62330fff5ddff4365cde016c7da60e1","observation_id":"8aead11d-6794-4867-a0bb-00d0bfe66a75","resolution":{"observed_at":"2026-08-08T00:18:10.191565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11325","last_updated":"2025-01-20T08:09:36Z","snapshot_observed_at":"2026-08-08T02:53:10.035832Z","submitted_at":"2025-01-20T08:09:36Z","title":"CatV2TON: Taming Diffusion Transformers for Vision-Based Virtual Try-On with Temporal Concatenation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11325","snapshot_observed_at":"2026-08-08T00:18:10.195371Z","title":"arXiv preprint arXiv:2501.11325 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.195371Z"},"links":{"cited_paper":"/paper/2501.11325","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:8fdaca3832b83daf47d9912797dcadffd23e65f47c98b52feea1172fcb6a6260","observation_id":"5e46ed22-d538-4b1c-8a72-b8cbaec1f2b9","resolution":{"observed_at":"2026-08-08T00:18:10.195371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02807","last_updated":"2025-08-04T18:27:55Z","snapshot_observed_at":"2026-08-06T04:55:39.036850Z","submitted_at":"2025-08-04T18:27:55Z","title":"DreamVVT: Mastering Realistic Video Virtual Try-On in the Wild via a Stage-Wise Diffusion Transformer Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02807","snapshot_observed_at":"2026-08-08T00:18:10.199289Z","title":"arXiv preprint arXiv:2508.02807 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.199289Z"},"links":{"cited_paper":"/paper/2508.02807","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:798b8cd7d6ecdcbd851e4ac303e8aa1f316187148243d083576393183442610a","observation_id":"d814b52c-67a9-4937-9736-8ef6667486ac","resolution":{"observed_at":"2026-08-08T00:18:10.199289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09822","last_updated":"2025-07-28T07:49:34Z","snapshot_observed_at":"2026-08-01T21:24:54.954854Z","submitted_at":"2024-12-13T03:20:53Z","title":"Dynamic Try-On: Taming Video Virtual Try-on with Dynamic Attention Mechanism","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09822","snapshot_observed_at":"2026-08-08T00:18:10.203291Z","title":"arXiv preprint arXiv:2412.09822 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.203291Z"},"links":{"cited_paper":"/paper/2412.09822","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:aad6ec05b95ca810156b717fb5b4453b83f3fbb5e62bd0954af6c25c22bc406e","observation_id":"8486bbaa-fbd8-489c-9614-c8e3bd1fbe07","resolution":{"observed_at":"2026-08-08T00:18:10.203291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.207074Z","title":"arXiv preprint arXiv:2505.21325 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.207074Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:4f8000ccbc226a1990d076622212502d6992d3a83cec37d016aed797a4d12b96","observation_id":"410474b1-edf0-4e06-a8ce-002a5491e87c","resolution":{"observed_at":"2026-08-08T00:18:10.207074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07654","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.729538Z","title":"arXiv preprint arXiv:2510.07654 , year =","venue":null,"work_id":"472fabe7-24a6-411a-834b-245964e4ecff","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.210634Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:7d3f4ef3ad293a778c3f3cef4782f8b45efb00c58aba0ddbeb765f6b5a5a05b8","observation_id":"fc868d2c-fa0d-4001-b9da-4956ec352d3c","resolution":{"observed_at":"2026-08-08T00:18:10.735035Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11794","last_updated":"2024-05-28T04:08:09Z","snapshot_observed_at":"2026-07-06T18:16:33.179338Z","submitted_at":"2024-05-20T05:28:22Z","title":"ViViD: Video Virtual Try-on using Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11794","snapshot_observed_at":"2026-08-08T00:18:10.214093Z","title":"arXiv preprint arXiv:2405.11794 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.214093Z"},"links":{"cited_paper":"/paper/2405.11794","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:65fa8bc8163bb785f71b651188d71b0efd893450bae93f50ded26d244431c554","observation_id":"96ae3c7a-8b11-4cdb-b8fd-a38aa3c0ab4f","resolution":{"observed_at":"2026-08-08T00:18:10.214093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04833","last_updated":"2024-07-19T07:39:37Z","snapshot_observed_at":"2026-07-06T17:56:40.208379Z","submitted_at":"2024-04-07T06:56:51Z","title":"ShoeModel: Learning to Wear on the User-specified Shoes via Diffusion Model","version":2},"cited_work":{"arxiv_id":"2404.04833","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.04833","snapshot_observed_at":"2026-08-08T00:18:10.635639Z","title":"ShoeModel: Learning to Wear on the User-specified Shoes via Diffusion Model","venue":"cs.CV","work_id":"0319d688-7415-4972-95ca-41c11bed9cf8","year":2024},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.217865Z"},"links":{"cited_paper":"/paper/2404.04833","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:ba4d557aa4c4932cb58711283cb2fa8cc49688fc9eaba88056b038e205cd5210","observation_id":"a8595954-eb33-4d3a-9114-9618ad39529d","resolution":{"observed_at":"2026-08-08T00:18:10.639924Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.250614Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"f6c66c91-61cb-433d-8661-ca08bfbbeb63","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.221664Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:533c58d34cb58e5d8a9b0e70ca30070ffd215802301cb820b5133c23ad992604","observation_id":"75f636d7-241e-4a4b-8f1c-6bb1a71d8bc7","resolution":{"observed_at":"2026-08-08T00:18:11.254235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.240398Z","title":"Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) , pages =","venue":null,"work_id":"745110b8-a468-4bdd-aa31-178456b9b32f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.224985Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:d5b41ba9f944f40ea8e6337b6a138f6ab412b0700586b6c0bbb99f8e049b4e09","observation_id":"6732e5db-bc12-451e-a04a-844a71dac624","resolution":{"observed_at":"2026-08-08T00:18:11.244018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13795","last_updated":"2024-01-24T20:25:48Z","snapshot_observed_at":"2026-07-06T17:20:07.930031Z","submitted_at":"2024-01-24T20:25:48Z","title":"Diffuse to Choose: Enriching Image Conditioned Inpainting in Latent Diffusion Models for Virtual Try-All","version":1},"cited_work":{"arxiv_id":"2401.13795","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.13795","snapshot_observed_at":"2026-08-08T00:18:10.619795Z","title":"Diffuse to Choose: Enriching Image Conditioned Inpainting in Latent Diffusion Models for Virtual Try-All","venue":"cs.CV","work_id":"28d94f12-7e25-43ba-9e83-ccd823ee9e64","year":2024},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.228076Z"},"links":{"cited_paper":"/paper/2401.13795","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:5417264ea4beeb9cb400b5d8500f05f420ab30ff253e39427dc0bcdf01d874f3","observation_id":"c3973f0a-261a-49ba-84f5-de038375db0c","resolution":{"observed_at":"2026-08-08T00:18:10.623977Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.229993Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"b2240227-12f1-4fae-bba4-b96194b0271c","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.231190Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:5b34474ac24d4fa5e464d37fb61b9ce14a875579490bef25ebaab288733ff071","observation_id":"3f92caac-496a-483d-911a-c6087092c238","resolution":{"observed_at":"2026-08-08T00:18:11.233681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.219914Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"086f7fe0-7cef-43c1-b688-99893921ab72","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.234097Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:2c05d5fd7acd5fd95641846af93dffb51d6e4d279508539237596db4145cc471","observation_id":"35380740-c71d-4d74-888d-135cb3a0d5a9","resolution":{"observed_at":"2026-08-08T00:18:11.223521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.209430Z","title":"CVPR Workshops , volume =","venue":null,"work_id":"33d8d08e-190d-420f-9a72-258475516ecc","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.237031Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:279bb43de7f402960ce55e1f2795429cb5e34426b0eb0231f52bafa4f7c8b99d","observation_id":"1fb7354c-469f-4c94-806c-9ccdc7243154","resolution":{"observed_at":"2026-08-08T00:18:11.213207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.199262Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence , volume =","venue":null,"work_id":"afa7c357-322f-46b3-a681-094804b88e2a","year":2002},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.239983Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:8af926f27a670814ff276d3aee4f0042797b2ef2472bc3f3e60e78862bf54f4d","observation_id":"f2fbc477-d27f-46be-aa85-5c45815067d1","resolution":{"observed_at":"2026-08-08T00:18:11.202532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.189803Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages =","venue":null,"work_id":"36da16e5-51e6-4d09-9a25-f61d709af75c","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.243072Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:23ef33047dcbe0ab370513aa9b1b4f94d18122f02280fa107fc7099e95fbc313","observation_id":"3bd97ebd-4a52-4726-a87e-a52c94488a53","resolution":{"observed_at":"2026-08-08T00:18:11.192922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.180291Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"954f676e-1983-4157-b9cc-dca3d7ea8170","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.246085Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:2e82b2298e7c03d17f7c27c5e584e43300c71ecf4cfbbffb1400173c8aba7c8a","observation_id":"b9240e3b-3b38-48e7-9fa1-3c135ce8ed36","resolution":{"observed_at":"2026-08-08T00:18:11.183483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.170506Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"701ee831-ecbc-4dfe-8de0-ed38bf53d808","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.249085Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:67f626dd0e0de78c6b548d794b10631e7e182180f356739a84aaddd02f8f682c","observation_id":"ab67d358-ce58-4ae8-8526-6c11e79a25e5","resolution":{"observed_at":"2026-08-08T00:18:11.174048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.160233Z","title":"Proceedings of the ACM International Conference on Multimedia (ACM MM) , pages =","venue":null,"work_id":"6f207499-8e18-4cd4-9595-b9771a8c4f86","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.252378Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:ceba69168dd82b98c348d0a5374291cdb1f9455fbee48da417ae8dfb72672032","observation_id":"da6d92b6-575d-4ca2-964f-c05f7619391a","resolution":{"observed_at":"2026-08-08T00:18:11.163866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.150032Z","title":"Proceedings of the European Conference on Computer Vision (ECCV) , pages =","venue":null,"work_id":"8d3e7f54-d96a-42eb-a28e-9d70cdfe6ec8","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.255823Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:0f26fada95cd0a035257ee23ea1266b744ec243fcd18793fe5c8440ed99d9a92","observation_id":"f57d5a28-c656-4bc7-8657-f23e937a97a0","resolution":{"observed_at":"2026-08-08T00:18:11.153633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.139701Z","title":"Proceedings of the ACM International Conference on Multimedia (ACM MM) , pages =","venue":null,"work_id":"8de525f5-454b-431b-9f9e-2757611014b4","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.259035Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:a9294e08e2ae9c70bf6f3951d82a104167a2ba1e49a72f58f005f20878c9eeca","observation_id":"db354974-6214-4a7e-b63a-d7e3984c971e","resolution":{"observed_at":"2026-08-08T00:18:11.143218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.129313Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages =","venue":null,"work_id":"b18ed031-71bf-44e6-92d4-26a09e64e595","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.262463Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:aee7fd6b685d8498254fb83fda8d801206fae9f172b5c4d1889b6d1a19a6444b","observation_id":"45a59f1f-d0f7-4004-88ff-04c191ffb252","resolution":{"observed_at":"2026-08-08T00:18:11.133240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.119435Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"e7775072-0bc6-4635-a264-a29d4cb62e7c","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.265672Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:513e1311f6c4f094f7d859e63dbd68997f426c1dcf50e754dcb466aff873fd2d","observation_id":"136ff12c-1786-4898-a17f-12b6e95e1f78","resolution":{"observed_at":"2026-08-08T00:18:11.122968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.109040Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"6e50a8f6-549c-4995-b82e-3f0b9af71932","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.269101Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:62d1b80835c95556b657947cfb5ebe473c8592dcee5cae35392a1ba6614e2acb","observation_id":"4beb35cb-7482-45c7-84b1-a21a57c97a6c","resolution":{"observed_at":"2026-08-08T00:18:11.112695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.098745Z","title":"SIGGRAPH Asia 2024 Conference Papers , pages =","venue":null,"work_id":"5d4244a6-9211-4a35-8ef3-0c744408144a","year":2024},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.272670Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:f3ade22db5316993249050997631cd7a83ee1469de849233d46c65a96149ca77","observation_id":"f2ff5cd2-3b6f-40a7-aced-4efc0b2b540f","resolution":{"observed_at":"2026-08-08T00:18:11.102269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-08T00:18:10.276333Z","title":"arXiv preprint arXiv:2511.21631 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.276333Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:394893be7521dcbb47665b1b1574bb31f79014cfe1afce316438ef98b53b319c","observation_id":"f73797f8-ed8c-4519-8756-0de0c4351969","resolution":{"observed_at":"2026-08-08T00:18:10.276333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-08T00:18:10.279918Z","title":"arXiv preprint arXiv:2409.12191 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.279918Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:0e32ec1c7eef1a656708e1ace9d26187237f2ff1ae85e457741624d0cbd61112","observation_id":"523eed36-80a3-4e85-a1eb-eeb76394d55c","resolution":{"observed_at":"2026-08-08T00:18:10.279918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-08T00:18:10.283574Z","title":"arXiv preprint arXiv:2601.03267 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.283574Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:603769a44e5c6e7cd049d5ab4857054829a062a3efb7dde472f340518108e878","observation_id":"f635e137-aa16-46ce-927b-35f0610af67f","resolution":{"observed_at":"2026-08-08T00:18:10.283574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.088259Z","title":"IEEE/CAA Journal of Automatica Sinica , volume =","venue":null,"work_id":"4a808a7b-3a93-4fea-87b0-adcb2ec3181f","year":2025},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.287112Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:fd745ce5ef00508e2afcb9a422d8327c8051ff049aa2e30884ac5e0095a28246","observation_id":"f014d969-3601-41bc-ab8f-d0441c528dbc","resolution":{"observed_at":"2026-08-08T00:18:11.091975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-08T00:18:10.290960Z","title":"arXiv preprint arXiv:2507.06261 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.290960Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:ffb627dfde8d8d66b08873cb75d457e703d3a344e9162f6fb66463842ca260b1","observation_id":"08a9b915-051e-48dc-b54f-5efdaa367a9a","resolution":{"observed_at":"2026-08-08T00:18:10.290960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07372","last_updated":"2026-07-12T07:41:31Z","snapshot_observed_at":"2026-08-06T19:10:40.703812Z","submitted_at":"2026-01-12T09:54:49Z","title":"Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.07372","snapshot_observed_at":"2026-08-08T00:18:10.295235Z","title":"arXiv preprint arXiv:2601.07372 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.295235Z"},"links":{"cited_paper":"/paper/2601.07372","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:4c4019d033e5f0d8d69faaee320bc720d946ae55ca47b7a4023b6ffcf842636d","observation_id":"340ed926-34a7-4a88-8ee3-efdb3abc3c31","resolution":{"observed_at":"2026-08-08T00:18:10.295235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.077280Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"1a2cfa83-5377-4211-ad49-a3d6bbe17bb5","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.298739Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:355c2077d8aac100161726f7aee04b8c13b3afb460f0d537d533993ec5523779","observation_id":"9f85eb5e-af84-48bd-b036-5f2cc2e0694c","resolution":{"observed_at":"2026-08-08T00:18:11.081246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.066484Z","title":"arXiv preprint , year =","venue":null,"work_id":"8a3c87c7-31f4-48ca-9054-acfa7d1edb31","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.302258Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:12a52fde989344e8e9e558a6d393609c673cd4e232f5a1e589ecd623c86ad229","observation_id":"6545ecda-1985-4d03-b997-ca1bac2174fe","resolution":{"observed_at":"2026-08-08T00:18:11.070054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.056347Z","title":"arXiv preprint , year =","venue":null,"work_id":"395e90a8-3788-473e-95b0-3d4eed0dc72f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.305573Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:b70f720cc0bbb01168ab75f0cf1442d859ff7eb232e3ed05d3af115fc40e1eda","observation_id":"fedb7041-7940-4e55-aaf6-d1a4d45fd144","resolution":{"observed_at":"2026-08-08T00:18:11.059458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15574","last_updated":"2025-01-26T15:59:31Z","snapshot_observed_at":"2026-07-06T20:26:21.639525Z","submitted_at":"2025-01-26T15:59:31Z","title":"Instruction Tuning for Story Understanding and Generation with Weak Supervision","version":1},"cited_work":{"arxiv_id":"2501.15574","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15574","snapshot_observed_at":"2026-08-08T00:18:10.554666Z","title":"Instruction Tuning for Story Understanding and Generation with Weak Supervision","venue":"cs.CL","work_id":"185fd24a-19a1-4c98-950a-184af6314880","year":2025},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.308863Z"},"links":{"cited_paper":"/paper/2501.15574","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:4bbed9a98baa891ea61e1c19512c8126ee2de3d6e2212391f2b83bae4c204bd1","observation_id":"3e36189c-01d6-4e62-8598-2cf2efcd749c","resolution":{"observed_at":"2026-08-08T00:18:10.560699Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.046251Z","title":"Proceedings of the Annual Meeting of the Association for Computational Linguistics (ACL) , pages =","venue":null,"work_id":"09279676-9ff1-47d9-b87b-4b4bd80f98fd","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.312447Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:1df530207876d395e85b189bdd9dd956ad9681c3b8fe402e89b63053c55c788c","observation_id":"5e8285c4-b30e-457e-971f-ddac0291644b","resolution":{"observed_at":"2026-08-08T00:18:11.049944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.315797Z","title":"arXiv preprint arXiv:2510.08485 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.315797Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:79fcc6a88fcacc6eec79c80f3b117057ef444670806510e1d5ee5f3e11b04a08","observation_id":"36a91fea-9afa-4da8-8a9a-a062c4cacb5e","resolution":{"observed_at":"2026-08-08T00:18:10.315797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-08T00:18:10.319224Z","title":"arXiv preprint arXiv:2503.20314 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.319224Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:9a0b2b2d40afdb951bc7470704a3d0794ec5b6155c1b23e2599fd5010293f0b0","observation_id":"ca549662-9144-41c8-bc7d-ebb5ede9be20","resolution":{"observed_at":"2026-08-08T00:18:10.319224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.036410Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"2ec4c9d2-824b-49ff-88fb-2e72c59bb154","year":2021},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.322809Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:a923440696ef857ce3514df14639e018380eb2e32a6d2e445a3325d73b31428e","observation_id":"445aa634-98cf-4dd2-9c66-06d8b473e038","resolution":{"observed_at":"2026-08-08T00:18:11.039861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.026159Z","title":"Proceedings of the European Conference on Computer Vision (ECCV) , pages =","venue":null,"work_id":"537415c0-9cc8-4640-b82e-15adfd43b763","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.326114Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:aa4c54a8a3d8fc5308819a25c2ad9b1f9df88bc872b7466b28492e94b6c69d64","observation_id":"036791ef-6453-4ea7-9ba4-9025c1756838","resolution":{"observed_at":"2026-08-08T00:18:11.029738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.014716Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages =","venue":null,"work_id":"1ebfcc96-21f4-426e-b95c-395226130f39","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.329734Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:8446171982e1ba9319ae6f211dbd119d5d85f1c2112b3858a90967a07cab2f02","observation_id":"cc2062a4-d342-405b-8f17-b50603aee201","resolution":{"observed_at":"2026-08-08T00:18:11.018604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.333177Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.333177Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:0357e615045738f0132342dfb8cd7dd7e57712b038c6dfdc191fb71b20ba4538","observation_id":"ddc73dc8-6b82-4998-9677-af08e88334fc","resolution":{"observed_at":"2026-08-08T00:18:10.333177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.997610Z","title":"GitHub repository , year =","venue":null,"work_id":"d581f1ed-95e6-4933-a851-61e4e3b1fc84","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.336265Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:6bc1f7a98459c7b8911f2cf974a1e95d10172b29828a478825084714951b05cf","observation_id":"aeb68214-6262-4225-ae02-f97b17862d14","resolution":{"observed_at":"2026-08-08T00:18:11.001344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.986665Z","title":"Demystifying","venue":null,"work_id":"9e4d9b70-2029-4e91-a5d5-054c514b1499","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.339219Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:66905a360b658ca9ad42142d1c96f57d16e66dfcf01a05c3c3db41f1b26f1413","observation_id":"8e6edcbc-735f-41fd-b84c-23aaf1adafb5","resolution":{"observed_at":"2026-08-08T00:18:10.990128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.342186Z","title":"IEEE Transactions on Image Processing , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.342186Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:0ea0c08510f11edff7dcad1c00528d92013e3663dbb61f89f17139c9a6c8af36","observation_id":"ced65829-94ce-48e5-af16-fffcdc511b94","resolution":{"observed_at":"2026-08-08T00:18:10.342186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.969442Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"da498d05-3388-4482-8810-f9e375139295","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.345262Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:829f906ef978362a2cce937b3d38a5051ed28f91a32e06884c5fbacb5435095a","observation_id":"2f8a7f18-e814-4b14-a410-17b4e439accd","resolution":{"observed_at":"2026-08-08T00:18:10.973307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.958687Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"0cf52777-dfb0-4d1e-8bb8-cd741f80b80a","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.348162Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:7a6a5eab82ea8b3214c49540a10f6f3b9b7b56f4c4b7b3f99d084ef297e2cc9c","observation_id":"ec5f1ffe-2f69-4d3f-95c2-81c3fc9d92bf","resolution":{"observed_at":"2026-08-08T00:18:10.962510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.948288Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"10c93716-417d-4264-ab76-bfeadee19393","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.351052Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:bacabc66725621d35a4838e3cc01fe09baf2cf13b5dba963641d506abc462349","observation_id":"10dfddaf-507e-4800-8d5e-4839d888a202","resolution":{"observed_at":"2026-08-08T00:18:10.951912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15886","last_updated":"2025-02-16T03:41:41Z","snapshot_observed_at":"2026-07-06T18:50:13.559866Z","submitted_at":"2024-07-21T11:58:53Z","title":"CatVTON: Concatenation Is All You Need for Virtual Try-On with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15886","snapshot_observed_at":"2026-08-08T00:18:10.354134Z","title":"arXiv preprint arXiv:2407.15886 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.354134Z"},"links":{"cited_paper":"/paper/2407.15886","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:634d782b2165f0b1d0dcc7781ffccd7ec2294e1ea1c6bb9933b611f1af156689","observation_id":"c0df6ca8-6e70-4718-94c8-ca9f565dd147","resolution":{"observed_at":"2026-08-08T00:18:10.354134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.937713Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence (AAAI) , volume =","venue":null,"work_id":"1392d852-16f4-4c5d-80ff-37b67f8c529f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.357423Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:39799433e51f6846250d98efcc7282ce4a1c53ebe14698d8910cc7c5c9cddfe6","observation_id":"b62e114f-653a-405b-bae3-05d8e00e19a2","resolution":{"observed_at":"2026-08-08T00:18:10.941446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16010","last_updated":"2025-07-21T19:09:28Z","snapshot_observed_at":"2026-08-06T15:18:03.936359Z","submitted_at":"2025-07-21T19:09:28Z","title":"FW-VTON: Flattening-and-Warping for Person-to-Person Virtual Try-on","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16010","snapshot_observed_at":"2026-08-08T00:18:10.360702Z","title":"arXiv preprint arXiv:2507.16010 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.360702Z"},"links":{"cited_paper":"/paper/2507.16010","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:d39c7774fdbab11cf2feb5e96a029938275f4c49f18bf5f2062e3f436a1b75a8","observation_id":"e59b9402-cab5-4281-adb5-b6dee5a4a464","resolution":{"observed_at":"2026-08-08T00:18:10.360702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-08T00:18:10.364433Z","title":"arXiv preprint arXiv:1711.05101 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.364433Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:2a0292977875896995acc5a02a52cb3830fb96152649100b9a12aa8308e47001","observation_id":"aaaa009b-df71-46d4-b87c-0ffff95b0740","resolution":{"observed_at":"2026-08-08T00:18:10.364433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.926779Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , volume =","venue":null,"work_id":"ec972eb3-960c-468d-bbd6-e290a8d0553f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.368399Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:36812082786f17e80684fc2351ecf552533c79d54fbd2b741818c51a14a37089","observation_id":"1356253c-8c39-405c-9c3b-8d356d9527ed","resolution":{"observed_at":"2026-08-08T00:18:10.930707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.916061Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"2f0515f7-390d-456a-be41-6f847b13f6c1","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.372018Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:13c06facbf364f3dfce2b275feb88ef872f20a0543ef39386ac6be489742f1bd","observation_id":"c9d7c87b-c664-452d-885a-bad739602f70","resolution":{"observed_at":"2026-08-08T00:18:10.919605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.905395Z","title":"Proceedings of the International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"f3057d38-b716-4d2c-b7e4-a9bc3ee6e0b6","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.375640Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:70b93a797f30e97ac0ce8a5cec83e81edd50fc3af702057f832b4b84da0b82ce","observation_id":"af90270c-f03d-4842-945f-41de6908b329","resolution":{"observed_at":"2026-08-08T00:18:10.909013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.895294Z","title":", author =","venue":null,"work_id":"b1d517a6-a3bb-4678-b67e-894925f63a2c","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.379197Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:e09a62a49ad0a8a4c7ec4c3c0901203c68996591cd0a3514bb0b6644f97b744f","observation_id":"ad8aad74-7668-444d-a366-7345d466dfdd","resolution":{"observed_at":"2026-08-08T00:18:10.898689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.885376Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"1fd678d6-ea70-4f18-b5f3-e27636c53747","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.382823Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:729a9189d7c04e54892fb1e2916ed23bd657840d6b159042f5cc3b1c1ab17b6c","observation_id":"3e296947-5269-488b-ad05-579b3e14cb4c","resolution":{"observed_at":"2026-08-08T00:18:10.888965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-07-06T23:22:37.355450Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-08-08T00:18:10.386228Z","title":"arXiv preprint arXiv:2605.10730 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.386228Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:4871f88bd0bba4bba58fa4432b762d78b4b933cec4ea87db64e89f786f584a3a","observation_id":"0b1cd0c2-81a5-4bd0-9a59-19ed69b2d42a","resolution":{"observed_at":"2026-08-08T00:18:10.386228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.875399Z","title":"2: Frontier Visual Intelligence , author=","venue":null,"work_id":"3923a045-b0e7-453b-b195-5edbeef04597","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.389722Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:5ebb69008395ec48536dae0a842c885f071428f7a45deaaa34b56b9038b2190b","observation_id":"14a289dd-3cff-45b6-8131-5d01b55b2b21","resolution":{"observed_at":"2026-08-08T00:18:10.878729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T20:16:34.541185Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":42},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2608.05745."}