{"as_of":"2026-08-07T08:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca07847e5323980f770faa0631a58fd0ecddc33836656f967e9746e6db87c2d0","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:55:34.085474Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.04556/citation-record","integrity":"/paper/2508.04556/integrity","json":"/paper/2508.04556/citation-record.json","paper":"/paper/2508.04556"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1801.01401","last_updated":"2021-01-14T05:36:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T15:25:26Z","title":"Demystifying MMD GANs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01401","snapshot_observed_at":"2026-08-05T23:55:33.930982Z","title":"Demystifying mmd gans.arXiv preprint arXiv:1801.01401, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.930982Z"},"links":{"cited_paper":"/paper/1801.01401","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:9dc792034a89f4cb029deda3187dd5134086269e7258a509117c8a0b995c476d","observation_id":"20e10ae6-f9f5-48b3-9561-3a6d081fbc49","resolution":{"observed_at":"2026-08-05T23:55:33.930982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.600780Z","title":"Robust treatment of collisions, contact and friction for cloth anima- tion","venue":null,"work_id":"20681dea-2284-40f7-a1c3-fa104db1aec3","year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.935066Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:b7ca392d7f96a89cba67b3df0470f44ac0bcd61dd96b75d782325f5fa4d0f211","observation_id":"95012925-a4f8-46ac-a472-9518fdab149a","resolution":{"observed_at":"2026-08-05T23:55:34.604091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.590812Z","title":"Anydoor: Zero-shot object-level im- age customization","venue":null,"work_id":"a8b34523-e0f1-489e-a812-fdc3602df17d","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.938379Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:51aaaff58914b0bd595737663e474656c66f8c28d0cbecd66753665c11dc9071","observation_id":"d393d671-bb34-4648-a964-bc1b0dad7f70","resolution":{"observed_at":"2026-08-05T23:55:34.594330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.581127Z","title":"Viton-hd: High-resolution virtual try-on via misalignment-aware normalization","venue":null,"work_id":"daf18dac-ed9c-4eb9-ac5a-f377c31294bd","year":2021},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.941596Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:9dbfc3858c57e6ad653f13f74c24f7c76dda2b3dc386f4484324150bf58dbaf4","observation_id":"35db57e2-d041-4da9-b86f-49f31bb33b3d","resolution":{"observed_at":"2026-08-05T23:55:34.584422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05139","last_updated":"2024-07-29T09:15:33Z","snapshot_observed_at":"2026-07-06T17:41:27.341898Z","submitted_at":"2024-03-08T08:12:18Z","title":"Improving Diffusion Models for Authentic Virtual Try-on in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05139","snapshot_observed_at":"2026-08-05T23:55:33.944896Z","title":"Improving diffusion models for vir- tual try-on.arXiv preprint arXiv:2403.05139, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.944896Z"},"links":{"cited_paper":"/paper/2403.05139","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:9f0f807830baeee8d416f5be8d6e7dc2876f088ed60dcb2ce066f0f55604a42b","observation_id":"41960fed-eef4-4ff8-a89a-802db33a6b44","resolution":{"observed_at":"2026-08-05T23:55:33.944896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15886","last_updated":"2025-02-16T03:41:41Z","snapshot_observed_at":"2026-07-06T18:50:13.559866Z","submitted_at":"2024-07-21T11:58:53Z","title":"CatVTON: Concatenation Is All You Need for Virtual Try-On with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15886","snapshot_observed_at":"2026-08-05T23:55:33.948223Z","title":"Catvton: Concatenation is all you need for virtual try- on with diffusion models.arXiv preprint arXiv:2407.15886,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.948223Z"},"links":{"cited_paper":"/paper/2407.15886","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:e133d2ccb20611d317505aee810cb039d88ae82ac56ad792d2b6b4f99d97ce8c","observation_id":"40085c33-bc1f-4916-86a1-05a9e5f3b5a3","resolution":{"observed_at":"2026-08-05T23:55:33.948223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.571559Z","title":"Street tryon: Learning in-the-wild virtual try-on from unpaired person images","venue":null,"work_id":"3c6e1738-3fcd-418d-924a-3313c3c85f2e","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.951670Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:4da51468bc22d8589b40122c100ed5857b8d848ccda86f12649746da93834c7d","observation_id":"19d9d965-168a-40f7-b810-308d61e829d2","resolution":{"observed_at":"2026-08-05T23:55:34.574754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:33.954795Z","title":"Image quality assessment: Unifying structure and texture similarity.IEEE transactions on pattern analysis and ma- chine intelligence, 44(5):2567–2581, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.954795Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:f25c44f02f89efd0353e86c3eb6e634f103971093c8f033b39635c8d27037371","observation_id":"431eb11c-8c6e-4ad2-8599-e4ed783ce6b6","resolution":{"observed_at":"2026-08-05T23:55:33.954795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.555740Z","title":"Parser-free virtual try-on via distilling appearance flows","venue":null,"work_id":"e0fd345e-2d0d-4c45-91c8-5d4055c947bf","year":2021},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.957939Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:84fe235ca93e744f5686f85672b3fd68ed63f3d6e927e02c03ede9de65c2786c","observation_id":"9b8fb793-b216-4d94-adaa-b14f09a8a255","resolution":{"observed_at":"2026-08-05T23:55:34.558877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.546152Z","title":"Humans in 4d: Re- constructing and tracking humans with transformers","venue":null,"work_id":"73f0aa13-0058-4c0d-91e2-d4d72b292c94","year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.960825Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:5953d1f8b7f93b0f44cc5f948c6322208eeae3eda878dace47d0398999cb44de","observation_id":"37c692f9-4093-498d-ab39-7239269e0586","resolution":{"observed_at":"2026-08-05T23:55:34.549375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.535867Z","title":"Taming the power of diffusion models for high-quality virtual try-on with appearance flow","venue":null,"work_id":"d081cf60-018a-42d1-9e95-e4d368a351e7","year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.964096Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:9ff2c6c13330b5af0382c95da68f43933906244cbc4961bb975a4cace12d4676","observation_id":"1a873293-8a95-4402-bb1d-5f5b6c38acd6","resolution":{"observed_at":"2026-08-05T23:55:34.539062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.526684Z","title":"Any2anytryon: Leveraging adaptive position embeddings for versatile virtual clothing tasks","venue":null,"work_id":"aa14833d-2b91-4d3c-89b4-c845d57e1fc7","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.967003Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:6abd573d5abfadf1a7b64f9b023c7000216e2c33778847a6b3f2579c7fb8fc24","observation_id":"6ca80180-fa07-4d4d-b991-4d8e707f2f1e","resolution":{"observed_at":"2026-08-05T23:55:34.529802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:33.970295Z","title":"Wildvidfit: Video virtual try- on in the wild via image-based controlled diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.970295Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:dc6ed20b389f0fc01d50ac4e79567a6fc03f230edd086c22b597bb9141686c02","observation_id":"9a0a4712-ff44-4a60-b907-8be6ebf5ae13","resolution":{"observed_at":"2026-08-05T23:55:33.970295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.511677Z","title":"Vton 360: High-fidelity virtual try-on from any viewing direction","venue":null,"work_id":"ab6898c0-1021-4126-857e-4aa8d7c33a6c","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.973022Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:b6e4bd61f9b027af6c7200766360a94f9ea6e7dd1704fea7f3897bcc788642ca","observation_id":"fa17e449-54f2-4325-a7b5-853faffeaaf1","resolution":{"observed_at":"2026-08-05T23:55:34.514604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.502980Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"d4ae67b3-ab2c-40cc-b91f-0050ab6d94ef","year":2017},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.975928Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:e0368c4a694bfbce3f2513cddb530fdfa04e20c9a7f40b441b383063e0c2db1c","observation_id":"21c99c61-b0e2-48f4-9041-585e71893676","resolution":{"observed_at":"2026-08-05T23:55:34.506151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T23:55:33.978697Z","title":"Classifier-free diffusion guidance.arXiv preprint arXiv:2207.12598, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.978697Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:0732be52ae88f1d262f880a82fbfccdb302505437072955ba1c172ea3837123b","observation_id":"bdac8ce7-a7c8-4d5b-b9d1-bf1e4e81f378","resolution":{"observed_at":"2026-08-05T23:55:33.978697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.493624Z","title":"From parts to whole: A unified reference framework for con- trollable human image generation, 2024","venue":null,"work_id":"d3cfe45c-6e1a-446b-ab4c-b8b71168748f","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.981830Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:2e9830c0ba2d5e433bab2544815ba4127b06d2bef38476223fa927b514fe82aa","observation_id":"c019f15a-a952-4d99-8a9c-e2a82ff81861","resolution":{"observed_at":"2026-08-05T23:55:34.496807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.484207Z","title":"Do not mask what you do not need to mask: a parser-free virtual try-on","venue":null,"work_id":"3623fd94-c74d-4c99-972b-0f5ab31520ea","year":2020},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.984584Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:357d3c1759c324baab5ec9f27cddc7e3d92e65611fae7e90f41694b21f8d0fbc","observation_id":"6719214a-7baf-4630-8810-6d307f7b13fc","resolution":{"observed_at":"2026-08-05T23:55:34.487382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10499","last_updated":"2024-11-22T08:19:48Z","snapshot_observed_at":"2026-07-06T19:51:09.829522Z","submitted_at":"2024-11-15T11:02:23Z","title":"FitDiT: Advancing the Authentic Garment Details for High-fidelity Virtual Try-on","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10499","snapshot_observed_at":"2026-08-05T23:55:33.987841Z","title":"Fitdit: Advancing the authentic garment details for high-fidelity virtual try-on","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.987841Z"},"links":{"cited_paper":"/paper/2411.10499","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:d6bb35c8ddf15a3012dd8e1ec054e9392c3bc93fccdc590cba2b7f097b49d986","observation_id":"ab6a4b08-9aeb-4593-b134-7b3f6dc5c395","resolution":{"observed_at":"2026-08-05T23:55:33.987841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.474687Z","title":"Text2human: Text-driven controllable human image generation.ACM Transactions on Graphics (TOG), 41(4):1–11, 2022","venue":null,"work_id":"8c3085a9-c1aa-4218-beac-878a80ab8fe7","year":2022},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.990839Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:c0f4a5f27427eca3d731370639b29bc45b1aee530e05ee11d3b84e5a7662ed61","observation_id":"486ffa62-53f0-4923-9082-40b85bf212e2","resolution":{"observed_at":"2026-08-05T23:55:34.477929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.464084Z","title":"Stableviton: Learning semantic correspon- dence with latent diffusion model for virtual try-on","venue":null,"work_id":"e44b31aa-6a8a-4d36-a210-71c4598296c7","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.993585Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:062fd8e80ddb459e5b8a87071601a76d8204323dff7f7af4cf521a5c211df4e3","observation_id":"6cef25d6-0192-48aa-a90c-7c04cfb82b47","resolution":{"observed_at":"2026-08-05T23:55:34.467690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.454444Z","title":"High-resolution virtual try-on with misalignment and occlusion-handled conditions","venue":null,"work_id":"b251ac52-3cbc-410f-beea-c7bb2356063d","year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.996261Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:7c7b3f22c9c14a11c846e66c0f77e128973bd7ef5278b4c6d78ca5a3d1f18cb7","observation_id":"313de8c7-44c5-42e2-9799-da649c6ebb16","resolution":{"observed_at":"2026-08-05T23:55:34.457675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.444681Z","title":"Self- correction for human parsing.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2020","venue":null,"work_id":"0daa5f12-db11-4b1d-9fa8-b6543707705a","year":2020},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.998939Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:eef4e141b9c7b1a2084863683cb83c93a85fcc29513bd071229195b2e70e2508","observation_id":"b0f17fb1-5219-43ee-937b-b3bed45d8e89","resolution":{"observed_at":"2026-08-05T23:55:34.447946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.435238Z","title":"In-situ tweedie discrete diffusion models, 2025","venue":null,"work_id":"cc632c20-8f3d-4fda-bd0f-65d84fc6d08b","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.001570Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:56026f6cb24f242eb1a5f27af37ee0286d87f30a3ae0a2fee36b58c2a96fabcc","observation_id":"9ad21b11-c484-4e0b-b591-7a490870942b","resolution":{"observed_at":"2026-08-05T23:55:34.438383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.425758Z","title":"Deepfashion: Powering robust clothes recog- nition and retrieval with rich annotations","venue":null,"work_id":"78f4c519-72de-42fa-af58-64e7cf674f1d","year":2016},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.004410Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:aff13f9131869346d4ec695b99bce592209d393cefc11f4878397e3f8bfd72ae","observation_id":"dbd02cb5-a89f-4116-bbdf-b61a9f6e1d20","resolution":{"observed_at":"2026-08-05T23:55:34.428929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T23:55:34.007006Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.007006Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:8967476a0660e7167855f2e3fe7084c83674f161bed9602259182d42138f8b31","observation_id":"2ab891f1-a1f1-40e1-8bdc-83182f054a45","resolution":{"observed_at":"2026-08-05T23:55:34.007006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.416090Z","title":"Ladi-vton: Latent diffusion textual-inversion enhanced virtual try-on","venue":null,"work_id":"e6a688ac-0424-4f0d-89ef-3261128ee710","year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.010021Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:b8130d394ca4e9f20cea07496e70cb84d2fdcdfe9ef306aa7bc03bce2a26ac3b","observation_id":"f383e4b5-be71-44cc-a1aa-f00e76cd7657","resolution":{"observed_at":"2026-08-05T23:55:34.419635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-05T23:55:34.012820Z","title":"Large language diffusion models.arXiv preprint arXiv:2502.09992, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.012820Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:3be3b5faf85b9f88b7e39d51d045fd4916e08203f07b5d490a17970154bf4652","observation_id":"3e606eae-5ae9-423b-bef5-6d6433e0d2be","resolution":{"observed_at":"2026-08-05T23:55:34.012820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T23:55:34.015859Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.015859Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:4a21acb69eb29d10b462453dd1637bd356b296cff46aa7a7e9be1e580eea7edf","observation_id":"440973cd-5371-4b34-a613-a2edb7175130","resolution":{"observed_at":"2026-08-05T23:55:34.015859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.406291Z","title":"Expressive body capture: 3d hands, face, and body from a single image","venue":null,"work_id":"0f2b86e2-0084-4b3e-a3c7-3249ad67dcc2","year":2019},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.018747Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:d207b02bf4edd37ab9eb60c91cef42e58c4825a1c72d49de2ca38b6d44973be8","observation_id":"98044ae7-5b13-4abf-a55a-fa3b885f613d","resolution":{"observed_at":"2026-08-05T23:55:34.409511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.021491Z","title":"Clothcap: Seamless 4d clothing capture and retar- geting.ACM Transactions on Graphics (ToG), 36(4):1–15,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.021491Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:90fbdee90182eaacb275037ba37358324ebf1794ecf7816bcbf1dc86a8067a09","observation_id":"52eebffc-ed70-41ae-9dd4-8df374ef8c72","resolution":{"observed_at":"2026-08-05T23:55:34.021491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.390589Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"e417a089-1c35-4ce2-bd17-79dc439684ab","year":2021},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.024233Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:dd1242805d92125c26348ea622823a5f0a04b33e12dcb1a5e56aeed80933d6eb","observation_id":"200a3bde-919d-4b49-b975-e9cfe06a78a6","resolution":{"observed_at":"2026-08-05T23:55:34.393922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.026916Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.026916Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:5cb5226d6a293f0e2bc4233cb8c0d85b6b3c89a1b08959f8578b7e18a6bd65f2","observation_id":"49426383-b39e-4a2d-b08e-233b7a8950fb","resolution":{"observed_at":"2026-08-05T23:55:34.026916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.373593Z","title":"Simple and effective masked dif- fusion language models.Advances in Neural Information Processing Systems, 37:130136–130184, 2024","venue":null,"work_id":"42e7997d-3dba-4f68-8235-c5c24658e4da","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.029575Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:9fa0f48acc8f3f8e78e68ce25666f974538e044e030a9fe5abc034b1cfd63c35","observation_id":"33efb427-89a9-4ac4-9e36-8fa1c3fe1488","resolution":{"observed_at":"2026-08-05T23:55:34.377104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T23:55:34.032490Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.032490Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:b73d910ad3d01a56554d0516751a9a081d912fee412afd2fac033527dc2d2ae0","observation_id":"0d74f97a-0a01-4aed-9c0e-fdc6f6fa7db4","resolution":{"observed_at":"2026-08-05T23:55:34.032490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.363445Z","title":"Tryoffdiff: Virtual-try-off via high-fidelity gar- ment reconstruction using diffusion models, 2024","venue":null,"work_id":"d70960fe-2baa-43e0-8c55-90e35523ed5b","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.035516Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:7d0efed76905e81ad35cdb9c2d21a2b4700a923c8bb79a97892626c27f4b413d","observation_id":"b108edf5-1075-4a3e-9ab2-509b403c19c9","resolution":{"observed_at":"2026-08-05T23:55:34.366620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.038248Z","title":"A connection between score matching and denoising autoencoders.Neural computation, 23(7):1661– 1674, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.038248Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:9c5341ee49cf50efb677cbf70e7976eb237e130ff1928561e24b6b43bea7f3e7","observation_id":"34a6008b-1eff-4f25-9eb2-e1d2bde609e4","resolution":{"observed_at":"2026-08-05T23:55:34.038248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.346444Z","title":"Toward characteristic- preserving image-based virtual try-on network","venue":null,"work_id":"76633ac1-7bc6-49b5-bb5d-5acbb70ed178","year":2018},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.040866Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:760b31636c081fc6e824ee75e54be30fc3b8272a412676314ed2336be5243dc8","observation_id":"0167e9c2-2f45-4fe3-a4f2-70795fb47a9d","resolution":{"observed_at":"2026-08-05T23:55:34.350280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.337124Z","title":"Mv-vton: Multi-view virtual try-on with diffusion models","venue":null,"work_id":"54a5d570-395a-492c-a0d4-0c44bcf490f4","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.043602Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:94926e63b86552e06aba2a2b990b8b7c0720e9db06a642b6a347323aaa9717bb","observation_id":"be6bd1f6-81ae-4f78-8e2f-d62a4fe058d4","resolution":{"observed_at":"2026-08-05T23:55:34.340242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10783","last_updated":"2024-03-16T03:05:07Z","snapshot_observed_at":"2026-07-06T17:45:35.519457Z","submitted_at":"2024-03-16T03:05:07Z","title":"StableGarment: Garment-Centric Generation via Stable Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10783","snapshot_observed_at":"2026-08-05T23:55:34.046194Z","title":"Stablegar- ment: Garment-centric generation via stable diffusion.arXiv preprint arXiv:2403.10783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.046194Z"},"links":{"cited_paper":"/paper/2403.10783","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:d66eab27e10f422c4991203450025d84b8be0c77a5093bfbfeb878d2c212e2be","observation_id":"d05a4d99-f095-4683-b2e4-1568af09cf5a","resolution":{"observed_at":"2026-08-05T23:55:34.046194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.327087Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE transactions on image processing, 13(4):600–612, 2004","venue":null,"work_id":"2405f8ed-21cc-4c8e-b9ce-fdb7e3e3320f","year":2004},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.049158Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:885362f82e0664da3b8d376d79a0fe7093b7b1a41bd960ab077a3e459e2ff7ce","observation_id":"00909a2b-922c-48d5-ac90-138c4c32d842","resolution":{"observed_at":"2026-08-05T23:55:34.330777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.317333Z","title":"Tryoffany- one: Tiled cloth generation from a dressed person, 2025","venue":null,"work_id":"083fa7f0-3c5c-478b-a4b0-2d96794f1443","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.052034Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:78d4cab68730d3a9d62debadb4a26a6670bd4e04f610a04b2697ece9d2793cdc","observation_id":"7ab19d63-4dac-4d02-923e-988cc154a4c3","resolution":{"observed_at":"2026-08-05T23:55:34.320572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.306861Z","title":"Gp- vton: Towards general purpose virtual try-on via collabora- tive local-flow global-parsing learning","venue":null,"work_id":"3f8c9c18-3a9b-4a4c-a7c6-0de51328a8c1","year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.054877Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:b6e53172956f75a1c8dddaabeefc1f135e4200debb97a356f3cc4c8e9b5449c4","observation_id":"89651f96-fdda-45dd-91ff-32c2ab6b67f4","resolution":{"observed_at":"2026-08-05T23:55:34.310291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.297080Z","title":"Dreamvton: Customizing 3d virtual try-on with personalized diffusion models","venue":null,"work_id":"2e26ea7f-a32a-4a44-b3c8-77ec7a6b6cb5","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.057357Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:0934fc7084617a58685e281e2d2a2b6d37407ad60df8cf83dd40936d23230acc","observation_id":"3f4c3c40-3a99-4ca4-af9f-9b0b47a1e56a","resolution":{"observed_at":"2026-08-05T23:55:34.300445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.287151Z","title":"Ootd- iffusion: Outfitting fusion based latent diffusion for control- lable virtual try-on","venue":null,"work_id":"3603470f-8519-447c-be67-bff798837595","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.059985Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:3045161ad03a06a64e8dfd2af2a5d8949ad06c613a75413f7eac2769805719e8","observation_id":"0d180ae1-6cdd-4b21-ac64-2ddeb606857d","resolution":{"observed_at":"2026-08-05T23:55:34.290496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.277194Z","title":"Bridging the discrete-continuous gap: Unified multimodal generation via coupled manifold discrete absorbing diffu- sion, 2026","venue":null,"work_id":"89157f61-28da-464f-a77a-5def0b1f12af","year":2026},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.062514Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:af234481f35dd0d93ac69a7de95c8fabbbb5d956adff001ca9f9b3f24a1e3844","observation_id":"a40d58a8-9c2f-4922-9195-6b8eabcfadbe","resolution":{"observed_at":"2026-08-05T23:55:34.280527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.267037Z","title":"Towards photo-realistic virtual try-on by adaptively generating-preserving image content","venue":null,"work_id":"ec46fa64-a86a-4d30-8d60-85d944dde409","year":2020},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.065227Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:079257578f2ab153f725e5b31e536add6b2b9994c111f4774c9cbe02d08df407","observation_id":"7f3f375b-1341-41b1-a526-472ef8c0685a","resolution":{"observed_at":"2026-08-05T23:55:34.270698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T23:55:34.067836Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models.arXiv preprint arXiv:2308.06721,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.067836Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:98375218a2c5b6196329c7e666cfe7801944af73485b8289ebbe56e5609f7fb7","observation_id":"9a9ed70d-d25b-4482-9c59-1dd5229d387f","resolution":{"observed_at":"2026-08-05T23:55:34.067836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.256685Z","title":"E0: Enhancing generalization and fine-grained con- trol in vla models via tweedie discrete diffusion, 2026","venue":null,"work_id":"a23ef0b4-9992-48f0-8edb-fb1ceb6c58db","year":2026},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.071257Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:c9c8427b2adc7ca80b679ec6a083a01ddf6a4d3aa93753f01a9793b179f1741e","observation_id":"d632b8c0-a60d-4a5a-b1de-ffc0d44c7d83","resolution":{"observed_at":"2026-08-05T23:55:34.260152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.074070Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.074070Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:161dffcdc125f069d5e00233e35a8362e24ebe4858b603743c06ba951c2e4402","observation_id":"a0e9b4ca-2feb-41aa-b6a4-7fc03c1bb49f","resolution":{"observed_at":"2026-08-05T23:55:34.074070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.076956Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.076956Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:75df13305a3d64f62e04ea99907f800a11ade8cc03a1801c7ee6d6b99b2cf330","observation_id":"314813b1-e0d0-41e4-9413-e190758f0023","resolution":{"observed_at":"2026-08-05T23:55:34.076956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.079685Z","title":"Tryondiffusion: A tale of two unets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.079685Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:fe94bfaf9c7824ed1877692137e0880d23754d666d50e06bb3a6e98f2ccbdf36","observation_id":"4a970445-a481-4980-b019-d59d72cbc25e","resolution":{"observed_at":"2026-08-05T23:55:34.079685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.227755Z","title":"Virtual Try-on Person-to-person Virtual Try-on.Fig","venue":null,"work_id":"26ef6554-9c47-4622-8aaf-eb7c31656a84","year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.082404Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:d1c88358041b33bd9b3dde4aa72e0d02759208f1a48d34e46d6d92e2ebc15a4c","observation_id":"f180cb4e-0804-43b3-a60b-141da933a4da","resolution":{"observed_at":"2026-08-05T23:55:34.231244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.216136Z","title":"Furthermore, our architecture is only intended for a single garment input, whereas multiple garment inputs may dramatically extend the input sequence","venue":null,"work_id":"a74d2645-c5e1-421e-b506-5dc7d3cb6c55","year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.085474Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:e82d5e44a335687f1ee800a61809fd655b5938ad03d954e069c62f56b95aa4bb","observation_id":"1f40d4b7-474f-4630-996a-03a4d80af528","resolution":{"observed_at":"2026-08-05T23:55:34.220891Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","latest_version":1,"primary_category":"cs.NI","snapshot_observed_at":"2026-08-05T23:55:33.564571Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2508.04556."}