{"as_of":"2026-08-07T18:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8744739f0849d4fddbc30514019e73018562c140fe17e1d51a99e6750b54fa95","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:33:33.617642Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T18:05:54.603514Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T18:08:50.729202Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"cited_work":{"arxiv_id":"2506.21270","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.21270","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.21270 , year=","venue":null,"work_id":"3b707e1f-98c5-497c-99d0-b758faf4309e","year":null},"citing_paper":{"arxiv_id":"2605.16696","last_updated":"2026-05-15T23:19:43Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:19:43Z","title":"Face inpainting with Identity Preserving Latent Diffusion Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-20T18:05:54.603514Z"},"links":{"cited_paper":"/paper/2506.21270","citing_paper":"/paper/2605.16696"},"observation_digest":"sha256:bf6bdbd9dab6624a57b6209ad3854ded10e74ea48ff2c3e0284b857b9ea7e399","observation_id":"772d1f57-9eec-4786-852c-b7a356c0d7c2","resolution":{"observed_at":"2026-05-20T18:08:50.730819Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.21270/citation-record","integrity":"/paper/2506.21270/integrity","json":"/paper/2506.21270/citation-record.json","paper":"/paper/2506.21270"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.756281Z","title":"Multimodal garment designer: Human-centric latent diffusion models for fashion image editing","venue":null,"work_id":"c4d60a06-063a-42cc-ad09-665d790e57ac","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.130006Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:89d3256ef0b3188da127921d5e189731cc338e465f93f45b3dbbe2a4f65dbe7e","observation_id":"4da504b8-658f-49aa-9856-91d0382d0f45","resolution":{"observed_at":"2026-08-06T22:33:38.830638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00737","last_updated":"2019-05-02T13:40:43Z","snapshot_observed_at":"2026-07-06T07:49:58.221987Z","submitted_at":"2019-05-02T13:40:43Z","title":"The 2019 DAVIS Challenge on VOS: Unsupervised Multi-Object Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00737","snapshot_observed_at":"2026-08-06T22:33:28.229378Z","title":"The 2019 davis challenge on vos: Unsupervised multi-object seg- mentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.229378Z"},"links":{"cited_paper":"/paper/1905.00737","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:93c88da12cd04d75db51545df7f66d2ea056d5ca1e99be66df20af2470fdfb6a","observation_id":"c5fe83e3-5150-485e-873e-8f251aa87368","resolution":{"observed_at":"2026-08-06T22:33:28.229378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.549283Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset, 2018","venue":null,"work_id":"d14da306-fa0f-4ec3-825e-1520db209685","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.364085Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:3930adfaaf2976a5a50516feb5ab26721f6033769228acf91876918fe0dad539","observation_id":"30c22c77-3ef0-47d7-a9ee-ba279a7bd374","resolution":{"observed_at":"2026-08-06T22:33:38.648481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01090","last_updated":"2025-04-28T07:47:49Z","snapshot_observed_at":"2026-08-07T14:21:38.135535Z","submitted_at":"2023-11-02T08:55:11Z","title":"Infusion: internal diffusion for inpainting of dynamic textures and complex motion","version":4},"cited_work":{"arxiv_id":"2311.01090","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.01090","snapshot_observed_at":"2026-08-06T22:33:33.994826Z","title":"Infusion: internal diffusion for inpainting of dynamic textures and complex motion","venue":"cs.CV","work_id":"19bd1a03-099f-4ef5-a9b8-996562cd02d9","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.466276Z"},"links":{"cited_paper":"/paper/2311.01090","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:782608393e2e925daa710f297a3f2684ad4d2d809285b1d7309f7a7846429cfd","observation_id":"86abadc0-6f9b-4d0a-8f24-ad10a82f2273","resolution":{"observed_at":"2026-08-06T22:33:34.048052Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.375345Z","title":"Viton-hd: High-resolution virtual try-on via misalignment-aware normalization","venue":null,"work_id":"4d99c8be-7638-4745-951c-2f0b76c9ecca","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.583609Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:ae3513875e96b53cef8be75f3653ec76bb80482c83cb8904aa3ffc1d8ea6d388","observation_id":"b76e3d61-e6b4-422f-a27a-cf705e093132","resolution":{"observed_at":"2026-08-06T22:33:38.462091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.232930Z","title":"Mevis: A large-scale benchmark for video segmentation with motion expressions, 2023","venue":null,"work_id":"cd93aeac-c19b-4c31-907e-adcae5411eea","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.707724Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:4344dcf1b2fc6ee1b1eb2577e359591e98eb63cc8b5b8060ea090cea08304d24","observation_id":"e4b0043b-bf53-4a9d-92b8-25817ed08c54","resolution":{"observed_at":"2026-08-06T22:33:38.319265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.055341Z","title":"Fw-gan: Flow-navigated warping gan for video virtual try-on","venue":null,"work_id":"4d4e80b3-3346-4cf2-a8b0-ee042665526d","year":2019},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.820294Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:f18f08f64bd56d34648748e542b5305f0bcaf469f77623b30de3a0c0f13c8338","observation_id":"5d566195-28f4-4269-8b78-4d66757409c2","resolution":{"observed_at":"2026-08-06T22:33:38.137651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.863391Z","title":"Vivid: Video virtual try-on using diffusion models","venue":null,"work_id":"13215e00-bb19-4a70-82cc-b2cfb375bae4","year":null},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.914502Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:8b717334c05f2c0bbd7167a761669ad2ad669c3515d5670e18ba44cf1b5a3a07","observation_id":"43963753-5b8a-4570-94bf-d7707685368b","resolution":{"observed_at":"2026-08-06T22:33:37.959635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.671068Z","title":"Parser-free virtual try-on via distilling appearance flows","venue":null,"work_id":"319f03ff-4297-4358-90fd-cb555e4ef246","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.024352Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:c2ab991f5a654a427d34baa318a5173cfe1f8aad793c341ff450667b6f6f2e8f","observation_id":"2ff9778c-5ad3-4847-82e6-c1865e718b57","resolution":{"observed_at":"2026-08-06T22:33:37.773245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.481419Z","title":"Parser-free virtual try-on via distilling appearance flows","venue":null,"work_id":"ab094aec-198c-49ab-ab60-6c2be996c7c7","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.167956Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:b7738952d6ed6e31446ec7e88d4c3f0271225b66e0f145066d2479ab994df198","observation_id":"fa92ef1f-77b5-4976-b5ae-ebf7ee28abb9","resolution":{"observed_at":"2026-08-06T22:33:37.573227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.276139Z","title":"Parser-free virtual try-on via distilling appearance flows, 2021","venue":null,"work_id":"9122f336-0788-4214-a3fc-7ff962ac5c3e","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.287736Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:5d7267cb851281f58b4b79318cf4d1e0ae52ae06601322f9efd192cdfa5ec386","observation_id":"4fa4f9d1-50ad-4bf1-8ec1-8ce277cb7f73","resolution":{"observed_at":"2026-08-06T22:33:37.358343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06101","last_updated":"2023-08-11T12:23:09Z","snapshot_observed_at":"2026-07-06T16:05:15.383292Z","submitted_at":"2023-08-11T12:23:09Z","title":"Taming the Power of Diffusion Models for High-Quality Virtual Try-On with Appearance Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06101","snapshot_observed_at":"2026-08-06T22:33:29.377884Z","title":"Taming the power of diffusion models for high-quality virtual try-on with appearance flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.377884Z"},"links":{"cited_paper":"/paper/2308.06101","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:9cefad6b406a676cfda2f55232793e07840454199f45dcd688a49914877825fa","observation_id":"2e247f7b-bdb1-43ff-9a70-f9b6dcc59781","resolution":{"observed_at":"2026-08-06T22:33:29.377884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00251","last_updated":"2024-10-08T23:30:47Z","snapshot_observed_at":"2026-08-03T17:01:52.727473Z","submitted_at":"2024-04-30T23:49:26Z","title":"Semantically Consistent Video Inpainting with Conditional Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00251","snapshot_observed_at":"2026-08-06T22:33:29.485730Z","title":"Se- mantically consistent video inpainting with conditional dif- fusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.485730Z"},"links":{"cited_paper":"/paper/2405.00251","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:405c5a532b5284cb28bb92341306b567d1317726fc251e77c114f026daaaa31b","observation_id":"82790a37-c18b-4bfb-9bd7-c7670d967064","resolution":{"observed_at":"2026-08-06T22:33:29.485730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15368","last_updated":"2025-01-23T03:24:01Z","snapshot_observed_at":"2026-07-06T16:52:31.421394Z","submitted_at":"2023-11-26T17:48:48Z","title":"Flow-Guided Diffusion for Video Inpainting","version":2},"cited_work":{"arxiv_id":"2311.15368","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.15368","snapshot_observed_at":"2026-08-06T22:33:33.831357Z","title":"Flow-Guided Diffusion for Video Inpainting","venue":"cs.CV","work_id":"4354f191-5af5-44d6-895d-1777b4701f50","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.600770Z"},"links":{"cited_paper":"/paper/2311.15368","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:f68872178f656ab042c93b72ddd051a12770995d76435639ab7f80573a71da7d","observation_id":"d37e7bbd-e460-4ef1-a06f-4f0c2dfb65fc","resolution":{"observed_at":"2026-08-06T22:33:33.868933Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.144882Z","title":"Animatediff: Animate your personalized text-to- image diffusion models without specific tuning","venue":null,"work_id":"82ac525a-2453-4a04-8cf4-e7755595e161","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.701986Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:2bc48cce01ce7c0456d536e29467a51a142ebfc69e9b1bf62b5bb0a946022d3e","observation_id":"c955eee1-e158-42e9-b18a-4584b5692b7a","resolution":{"observed_at":"2026-08-06T22:33:37.196980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.995625Z","title":"Densepose: Dense human pose estimation in the wild, 2018","venue":null,"work_id":"10bea047-43a4-4758-ab72-faabfb4f654c","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.812495Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:7c86ae16985e6d3e13b9b761d3c94c3fc267f39ea808ba503a8213cb4192e03f","observation_id":"0cf3e20f-8587-4baf-af58-07ddb0a992de","resolution":{"observed_at":"2026-08-06T22:33:37.069351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.862921Z","title":"Viton: An image-based virtual try-on network","venue":null,"work_id":"e465afbc-44ad-4cb5-8646-65dc00f31774","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.946334Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:d060bad88d80d93a3dc97751342a098e0265e34007d5684ff4c8560e9948ccf5","observation_id":"a2bac317-7c1b-4180-b086-88d980d18e2c","resolution":{"observed_at":"2026-08-06T22:33:36.927008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.709544Z","title":"Can spatiotemporal 3d cnns retrace the history of 2d cnns and imagenet?, 2018","venue":null,"work_id":"057070a6-27a6-40ec-8c3a-b92a58f179bf","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.045522Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:7fa3a8695cdb4cd3f4b02185aee92e47e99ce53b267fe43a751621ddc0c99742","observation_id":"f85ceb3e-461f-4e2d-894d-91ee0ee06b8b","resolution":{"observed_at":"2026-08-06T22:33:36.766348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10625","last_updated":"2024-07-15T11:21:03Z","snapshot_observed_at":"2026-08-04T16:35:50.550791Z","submitted_at":"2024-07-15T11:21:03Z","title":"WildVidFit: Video Virtual Try-On in the Wild via Image-Based Controlled Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10625","snapshot_observed_at":"2026-08-06T22:33:30.153754Z","title":"Wildvidfit: Video virtual try- on in the wild via image-based controlled diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.153754Z"},"links":{"cited_paper":"/paper/2407.10625","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:0a89ff1a356721c14b192cea848642e403e62d2f4a7b6f06d7d4a098804b90c4","observation_id":"1cdfd2c2-24cb-47fa-b02b-f12623b03e25","resolution":{"observed_at":"2026-08-06T22:33:30.153754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.562449Z","title":"Lvos: A benchmark for large-scale long-term video object segmentation, 2024","venue":null,"work_id":"0dc06873-7a3a-4401-93b6-bf40c3e9e1ec","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.282570Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:6a7118e10b4b73488d5dca20d662bd1ea7d96ddec502457222753f308b0ecd4f","observation_id":"8ae0c3fe-66ee-4a3d-b5f0-c6045e6d59b9","resolution":{"observed_at":"2026-08-06T22:33:36.627797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.422995Z","title":"Do not mask what you do not need to mask: a parser-free virtual try-on","venue":null,"work_id":"7f9f4185-5d1a-423d-82fa-5cb099f37520","year":2020},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.367598Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:6b1325cafd46c7011d4d6639c7d90e3341500695afd8305a7ffff67f50718355","observation_id":"c19bd4a9-60c4-4389-ad77-dd2c1a67c550","resolution":{"observed_at":"2026-08-06T22:33:36.482460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.254438Z","title":"Cloth- former: Taming video virtual try-on in all module","venue":null,"work_id":"9598ef3d-19ad-4fab-bdb0-8ed9e19fdd75","year":2022},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.498552Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:711f29ee6f58c70cc4bc46aefcdfded91c5871f9572df73a9c15f2fa54ecefc3","observation_id":"bed5dc4e-f542-44b2-809c-ccb53083ec32","resolution":{"observed_at":"2026-08-06T22:33:36.354413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T22:33:30.636955Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.636955Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:1aab412afa68da036c9ce18dfe5165c94a9b308e906ea8ab9b79c0c73a085030","observation_id":"df1e7e3f-843f-4dd4-87b8-45e8c909f101","resolution":{"observed_at":"2026-08-06T22:33:30.636955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01725","last_updated":"2023-12-04T08:27:59Z","snapshot_observed_at":"2026-07-06T16:56:25.554848Z","submitted_at":"2023-12-04T08:27:59Z","title":"StableVITON: Learning Semantic Correspondence with Latent Diffusion Model for Virtual Try-On","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01725","snapshot_observed_at":"2026-08-06T22:33:30.776150Z","title":"Stableviton: Learning semantic correspon- dence with latent diffusion model for virtual try-on","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.776150Z"},"links":{"cited_paper":"/paper/2312.01725","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:6c8ab1d542dbf182f75d971bcf63dd1811c348af41d3cd41fe8fab0844513371","observation_id":"5ec1507b-2488-4acd-9268-a597b80ff799","resolution":{"observed_at":"2026-08-06T22:33:30.776150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.125928Z","title":"Stableviton: Learning semantic correspon- dence with latent diffusion model for virtual try-on","venue":null,"work_id":"c65c97bc-03cc-462d-aae6-6165c70341b4","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.927390Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:52364a59560f97c9b60bbacf916ccfb2aa126935d135f818f8587175c187196c","observation_id":"030a11b4-a825-4188-9647-d1e400ead44d","resolution":{"observed_at":"2026-08-06T22:33:36.193538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.995949Z","title":"Open-sora-plan, 2024","venue":null,"work_id":"b2f94c83-9c6b-4e75-800b-25ffccc38ab9","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.056768Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:f8c5902aaf96e6b993fd733f7a6d3d3d2cddb2c5e216d87dea90eba4d16270c2","observation_id":"f118e0eb-ff22-4092-adaa-dd5111e58235","resolution":{"observed_at":"2026-08-06T22:33:36.046597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.872607Z","title":"High-resolution virtual try-on with misalignment and occlusion-handled conditions","venue":null,"work_id":"ae8a116a-3dda-4536-803e-9415ff004ea7","year":2022},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.155436Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:2fe6a6ed03d8ce2c4b15a42239a23317dd4f4580b22128bf2aaaebc1747ba4a5","observation_id":"e52269dc-b746-4ea1-bd4c-bf5687db597b","resolution":{"observed_at":"2026-08-06T22:33:35.927669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.724124Z","title":"Latte: La- tent diffusion transformer for video generation","venue":null,"work_id":"9ed9429e-31a6-43db-9f6f-57905d90dcea","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.251033Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:3f941051f6515d7064bdb08da9bf86ca1522cdbd18beb06e5fb6166b70412a2f","observation_id":"dca791a6-3dfa-4bd4-a633-6cfb12d83e8f","resolution":{"observed_at":"2026-08-06T22:33:35.797280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.585700Z","title":"Dress code: high- resolution multi-category virtual try-on","venue":null,"work_id":"a116a421-6ac2-4138-8a7b-0c737bcc9ff0","year":2022},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.348309Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:54db4312b3b21b131d6779753fc807a4b5976c6efda57f4d486425de0920038c","observation_id":"834aaa02-2e77-4929-8cdf-730915ac3890","resolution":{"observed_at":"2026-08-06T22:33:35.616540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.467809Z","title":"LaDI- VTON: Latent Diffusion Textual-Inversion Enhanced Virtual Try-On","venue":null,"work_id":"8e2566ac-cb2f-4a32-97a8-1279103230e8","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.486573Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:7aa5d4dccb437183a07776af18b6564ee03aaaecd606825db9a6580ac3b44b17","observation_id":"ece7d6be-8a9f-47b0-bd4d-1da9cb9f9281","resolution":{"observed_at":"2026-08-06T22:33:35.505553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:31.610157Z","title":"Dinov2: Learning robust visual features with- out supervision, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.610157Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:2ed37f73a2b05e15b80942f56f20e8e16bacbb328b4bdac875ec6db36507a6b6","observation_id":"30adfadd-e849-4094-9a9a-83579d89e74b","resolution":{"observed_at":"2026-08-06T22:33:31.610157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.327346Z","title":"The 2017 davis challenge on video object segmentation, 2018","venue":null,"work_id":"37d699b6-9cbd-47ea-9a53-f507da4d9f40","year":2017},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.770602Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:97eeb5c3bc3adbf3c5781f0cdb75a5436a12b394f7d541ce836f73f7c3965231","observation_id":"0762a723-99d2-4681-a5fa-2c1b42a823fd","resolution":{"observed_at":"2026-08-06T22:33:35.382792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.166209Z","title":null,"venue":null,"work_id":"d272c311-9576-4b5e-b4e9-dc9c1f906fc0","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.870473Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:123620f81402c0be97bba7076c1f68b9c68bf1640d7af14c24c8ab5a5f04b750","observation_id":"1fa47860-afac-412a-97ba-0d5b868997e3","resolution":{"observed_at":"2026-08-06T22:33:35.247398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-06T22:33:31.977615Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.977615Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:428fc07c087deb86e549b78aac3571a9cbe0510b60473fe52529d047508ba76f","observation_id":"2c8c0f27-f62a-45d2-9f7e-075a9e081272","resolution":{"observed_at":"2026-08-06T22:33:31.977615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.011473Z","title":"Toward characteristic- preserving image-based virtual try-on network, 2018","venue":null,"work_id":"df4025fb-a0ba-4328-9ca3-f8670f549aca","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.086558Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:a293c31f35777582b643f39f9bc037904fda88f0e4269815b48ab829745b99a8","observation_id":"bec30d08-8efc-4416-9289-cedd85a2a0b7","resolution":{"observed_at":"2026-08-06T22:33:35.072731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.887483Z","title":"Toward characteristic- preserving image-based virtual try-on network","venue":null,"work_id":"6edf421f-4914-48a1-94df-343ab92aaf13","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.226653Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:77e563fd547ec8d181673d4e36be4fbe6434eefbf17cda163d79ad7809e2f96a","observation_id":"ed80d764-744f-407b-bc1e-c44d079dec11","resolution":{"observed_at":"2026-08-06T22:33:34.947162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:32.356796Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.356796Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:34cab11a7312077da1678e31c4ed117bcd04abdd34b03fd40784c2c3f5f6c8df","observation_id":"f5e7ccc1-7b6e-4477-80bd-a6ff518af292","resolution":{"observed_at":"2026-08-06T22:33:32.356796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01779","last_updated":"2024-03-07T06:35:35Z","snapshot_observed_at":"2026-07-06T17:38:59.580242Z","submitted_at":"2024-03-04T07:17:44Z","title":"OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01779","snapshot_observed_at":"2026-08-06T22:33:32.539943Z","title":"Oot- diffusion: Outfitting fusion based latent diffusion for control- lable virtual try-on","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.539943Z"},"links":{"cited_paper":"/paper/2403.01779","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:510aedb8f2733e903655040c0ee877a7a14e0c59792695221bc851a5571f4052","observation_id":"f64a0805-f465-4100-9954-2b7768857b03","resolution":{"observed_at":"2026-08-06T22:33:32.539943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.734223Z","title":"Tunnel try-on: Excavating spatial-temporal tunnels for high-quality virtual try-on in videos","venue":null,"work_id":"11d94e1a-63dd-4fc1-b2be-6bde4ff48398","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.686910Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:04a29a4a939b74152a9977f18c57eeb2ad67d4318b749a947a9ad42785ba9dc0","observation_id":"119d3a1f-21ae-40f0-b202-6f6dba68eb44","resolution":{"observed_at":"2026-08-06T22:33:34.795704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.583755Z","title":"Video instance seg- mentation, 2019","venue":null,"work_id":"82d56372-c248-4612-a328-a3912adb8499","year":2019},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.817596Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:51c2bbb7848128ad1b9484a2634e0bfb1cb5c43289c8e9b4acf0a2cf3de2cae4","observation_id":"902f8d4d-5392-4f98-8acd-6ba4ba799089","resolution":{"observed_at":"2026-08-06T22:33:34.646272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-06T22:33:32.970229Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.970229Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:064003cfad32ea3131557b7d109e5727f2307c05c19ef7ff9d45410ae4e9528b","observation_id":"d864a82e-59da-458c-8094-de70db713b8f","resolution":{"observed_at":"2026-08-06T22:33:32.970229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.425931Z","title":"Efros, Eli Shecht- man, and Oliver Wang","venue":null,"work_id":"4acaf639-1487-4b9e-944d-0696274b7397","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.065750Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:93bc4a7f13819a239fd7b35fd576e3727d5f34d2c03e508c42edd1e96c1c2327","observation_id":"07ff8f12-9be4-4c67-b683-aa5ffd2cfb0a","resolution":{"observed_at":"2026-08-06T22:33:34.489117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:33.178701Z","title":"Avid: Any-length video inpainting with dif- fusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.178701Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:c40e3953a762b9601bd8fba9855c0dbef68754910d2b7fd35423baac51522bb3","observation_id":"b2ac43eb-3ba7-4205-816f-a3301b07aa98","resolution":{"observed_at":"2026-08-06T22:33:33.178701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.252834Z","title":"Mv-ton: Memory-based video virtual try- on network","venue":null,"work_id":"d9608fc5-a66e-4bf9-bb3c-b602e979e669","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.346990Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:2100a9a98392fd567323424becbc3426fbbce35166ac6b35416b2ab487e225e0","observation_id":"06fc2638-a7e5-448c-bd90-16441dd3c15a","resolution":{"observed_at":"2026-08-06T22:33:34.317961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:33.480997Z","title":"Tryondiffusion: A tale of two unets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.480997Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:1775e4cff48a821d0ce223061841e458e513be6c89efdf9079094a3fc9d68059","observation_id":"eb52d74a-714a-4274-b656-d9fd60f49ca4","resolution":{"observed_at":"2026-08-06T22:33:33.480997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.136630Z","title":"Designing a better asymmetric vqgan for stablediffusion, 2023","venue":null,"work_id":"a13802cd-7f5d-4418-8af9-f162742b5204","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.617642Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:8ffe655c036c7ddf99a07c59338713db0cb7044ce87d71129c776f2911953e4f","observation_id":"805e54d5-7867-48cf-9aee-df9e213d18f2","resolution":{"observed_at":"2026-08-06T22:33:34.177378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":30},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2506.21270."}