{"as_of":"2026-08-07T10:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ce3e56925e359ee4d237f763743678721e8afa16c239476f2edbc74378bf3cd6","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:29:54.626256Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:31:28.795486Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T23:58:42.771188Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"cited_work":{"arxiv_id":"2507.02691","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02691","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Canonswap: High- fidelity and consistent video face swapping via canonical space modulation","venue":null,"work_id":"69d200af-e54c-4765-a113-dae2e552a9c8","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2507.02691","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:07ae6cdc97505b1454e415187d271962d5adf0354753fb18c77107728a505836","observation_id":"9ab1a915-a41d-4897-9c90-41b4f1e5c8c5","resolution":{"observed_at":"2026-05-16T23:58:42.773661Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02691","snapshot_observed_at":"2026-08-01T07:31:28.795486Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21434","last_updated":"2026-07-23T15:37:55Z","snapshot_observed_at":"2026-08-06T11:07:03.324787Z","submitted_at":"2026-07-23T15:37:55Z","title":"Adaptive Identity Anchoring: Closed-Loop Keyframe Placement for Synthetic Paired Supervision in Video Face Swapping","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T07:31:28.795486Z"},"links":{"cited_paper":"/paper/2507.02691","citing_paper":"/paper/2607.21434"},"observation_digest":"sha256:0934f23201a7fc85a06a0654854bcf19066f8889462f5472568b44debfff550a","observation_id":"2b1e2f86-a0c1-4be6-a0f5-bb9ada65d498","resolution":{"observed_at":"2026-08-01T07:31:28.795486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.02691/citation-record","integrity":"/paper/2507.02691/integrity","json":"/paper/2507.02691/citation-record.json","paper":"/paper/2507.02691"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.676403Z","title":"Creating a photoreal digital actor: The digital emily project","venue":null,"work_id":"0d14fc12-2438-4afe-8988-14370aca76e6","year":2009},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:49.883974Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:cae0f9d755eeeba1fef18aa0799dae7b93e77ec7d8c72ad2fea0d22dbb93df65","observation_id":"8b56fba1-849f-424a-b86a-4ec90abf84ea","resolution":{"observed_at":"2026-08-06T20:29:57.683090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07269","last_updated":"2024-09-11T13:43:53Z","snapshot_observed_at":"2026-07-06T19:13:46.489307Z","submitted_at":"2024-09-11T13:43:53Z","title":"Realistic and Efficient Face Swapping: A Unified Approach with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07269","snapshot_observed_at":"2026-08-06T20:29:49.961171Z","title":"Realistic and efficient face swapping: A unified approach with diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:49.961171Z"},"links":{"cited_paper":"/paper/2409.07269","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:9c7fa37143d2bc0524048fd3ad2caf1968d0cd2eaa54f37be7fa907566ba492b","observation_id":"740786d4-8e04-42fa-bc54-1d1b06783515","resolution":{"observed_at":"2026-08-06T20:29:49.961171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.655550Z","title":"Face swapping: automatically replacing faces in photographs","venue":null,"work_id":"4f8d801b-6b02-49c6-b97c-2c4571a1d7f9","year":2008},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.065492Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:7e5863a34058b39c3acb7326cbc9e643b434fa6030ca4e6a7330e4a45024ab15","observation_id":"ac567813-34ed-4b1b-9f09-14ce405fd676","resolution":{"observed_at":"2026-08-06T20:29:57.662014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T20:29:50.168820Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.168820Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:118cfe1927ccc1df14d61f4418c552158922bed1124e35974586e1ca1c73da38","observation_id":"baa18980-0e88-476c-b192-dc70b155eefa","resolution":{"observed_at":"2026-08-06T20:29:50.168820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.627261Z","title":"Vggface2: A dataset for recognising faces across pose and age","venue":null,"work_id":"1aa8abf1-2c47-48f7-a443-77d2fca976d6","year":2018},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.267848Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:e5ca4cac604030d85c31068e22fcad8fe53fdb70bcf3573da25edfb355db37be","observation_id":"c6ec3545-caca-4d09-823a-a1007875a40c","resolution":{"observed_at":"2026-08-06T20:29:57.632928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.606951Z","title":"Real-time eye blink detec- tion using facial landmarks","venue":null,"work_id":"73f4768c-14ff-424c-9d3d-aaaf1f0ea843","year":2016},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.350775Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:69a7eada9c935178f176ef5c556ae98064c9eec08d68586bf0f1707b525ab650","observation_id":"2b8ae195-18a8-45dc-91bd-086b87d5568c","resolution":{"observed_at":"2026-08-06T20:29:57.613524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.586138Z","title":"Simswap: An efficient framework for high fidelity face swapping","venue":null,"work_id":"eb9ec0a8-5e65-490f-9402-109d58594345","year":2003},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.447404Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:6a221e4b8aa72bd05a2e6dc419277a0dd9dd67cfd017de01f252b3c71c40ce80","observation_id":"8adb2d16-b31e-4948-818e-d9ba33f9ebe3","resolution":{"observed_at":"2026-08-06T20:29:57.592138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18293","last_updated":"2024-12-10T11:13:57Z","snapshot_observed_at":"2026-07-06T19:57:55.925634Z","submitted_at":"2024-11-27T12:30:24Z","title":"HiFiVFS: High Fidelity Video Face Swapping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18293","snapshot_observed_at":"2026-08-06T20:29:50.546579Z","title":"Hifivfs: High fidelity video face swapping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.546579Z"},"links":{"cited_paper":"/paper/2411.18293","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:e78fd1efae3118c51ddb59b8de3ebce2039ba33e538325537531a8a271fb3429","observation_id":"730b9c86-0ebc-4563-b9ca-0fe52ab39ae8","resolution":{"observed_at":"2026-08-06T20:29:50.546579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.564775Z","title":"Out of time: auto- mated lip sync in the wild","venue":null,"work_id":"01661fad-d074-4a4d-ab35-34b53f1fa5c4","year":2016},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.618724Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:fe0be8b412c7bb4e1956a6e04d71d68fb260bb7d9f75d69e44febcff36e7b0f1","observation_id":"3b26ce5b-f69e-4dae-8410-c2fbe6ef26df","resolution":{"observed_at":"2026-08-06T20:29:57.571344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.543400Z","title":"My face my choice: Privacy enhancing deepfakes for social me- dia anonymization","venue":null,"work_id":"ab31b7fe-4f94-4606-9c0d-581aa08f31db","year":2023},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.721539Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:7732ce2d218b76850ae82d3a6e51f326e5ec7993668d9bb9eeb0624a52d12d73","observation_id":"43da18de-2ff9-4feb-8e14-6f152c0b939d","resolution":{"observed_at":"2026-08-06T20:29:57.550920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.525560Z","title":"Arcface: Additive angular margin loss for deep face recognition","venue":null,"work_id":"7c699fb4-a356-4d3b-a5a8-21e304f6d9aa","year":2019},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.825444Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:4ba91c40ab460aff73d45af3687979ee846fdef42bdb26876f6113d65503e788","observation_id":"602e1771-a18f-4792-8a55-67f8f7547a63","resolution":{"observed_at":"2026-08-06T20:29:57.530956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.506708Z","title":"Disentangled and controllable face image genera- tion via 3d imitative-contrastive learning","venue":null,"work_id":"27cc0384-4734-40a9-aa26-4e25a6297ef1","year":2020},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:50.972183Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:53d73cc931005139c4bbb47a7cb63d52091da9caf16a23257dfb95dd534644a3","observation_id":"d68229f6-5bb0-485a-89c4-1e9942e2d2e4","resolution":{"observed_at":"2026-08-06T20:29:57.513483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:51.054803Z","title":"Megaportraits: One-shot megapixel neural head avatars","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.054803Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:b355f87783e00788f666c2d19b9768c61ba7938aa6b7c475bcece13f62fcf456","observation_id":"722484b8-6132-49f7-93bb-797067a4ef97","resolution":{"observed_at":"2026-08-06T20:29:51.054803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:51.133476Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.133476Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:c141c4f055ee4215bb1382b19480995d225849fc637a3f55c65a7f5fdf38421e","observation_id":"67e330b2-8076-4189-b1cf-108ea8cc97a7","resolution":{"observed_at":"2026-08-06T20:29:51.133476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.461044Z","title":"Information bottleneck disentanglement for iden- tity swapping","venue":null,"work_id":"191629f2-5a8e-404c-a154-777e956ee146","year":2021},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.219905Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:288f1f296fd3050f77f75d012f6a95380f282647cd51d3a326ec201a698acae7","observation_id":"b7c23417-bca4-4631-b88e-2302505a1fb7","resolution":{"observed_at":"2026-08-06T20:29:57.468003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.438230Z","title":"3d guided fine-grained face manipulation","venue":null,"work_id":"fe6cd1f5-e8f1-4203-9228-30717dc27e0f","year":2019},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.286485Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:1158c3cb9d8a0918477c17bffac2e9e3f0b6cedf4de89b0ece55b02d9e201b45","observation_id":"89c2a052-f734-4a0d-a9d3-6b4461ad99af","resolution":{"observed_at":"2026-08-06T20:29:57.444910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:51.388599Z","title":"Generative adversarial networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.388599Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:a202db75b7814c7b0a991972daf83e50c553e3509000642b5794ec3602ca509b","observation_id":"ff4d7407-9118-4e20-9325-2c24f1416f5f","resolution":{"observed_at":"2026-08-06T20:29:51.388599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T20:29:51.479811Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.479811Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:14fb4c058a4ce48f8c4a8e7501009caf7942f8c710e4fa5ba2988927e4f4575f","observation_id":"b19d7ea6-1587-4f52-ac2c-0f9c321f37ba","resolution":{"observed_at":"2026-08-06T20:29:51.479811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.406814Z","title":"Marionette: Few-shot face reenact- ment preserving identity of unseen targets","venue":null,"work_id":"026022f6-c649-4aa4-a578-3e39d17b2c01","year":2020},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.601425Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:5e882ae18c290f94e756e6692bcf321cce9e00bf53c5a1811cc00b960ea0f0b3","observation_id":"9bac77a4-7603-4784-b041-594292eb29ef","resolution":{"observed_at":"2026-08-06T20:29:57.413885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.378718Z","title":"Face-adapter for pre-trained diffusion models with fine- grained id and attribute control","venue":null,"work_id":"c9aaf57c-bd17-46a8-a6f5-2ae21abe27e9","year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.672921Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:de683ee53c8ec9327eaf2a1b71ca8480fd32b3585a289946fdece448c8f30bed","observation_id":"0e53a3f9-ae47-44ff-94ea-f0751e48a3fb","resolution":{"observed_at":"2026-08-06T20:29:57.391285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:51.763458Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.763458Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:6f0c12121a506d64344cb23814e2ac12026e75d9a03c0899d036a161653a5423","observation_id":"194e14cd-2cc4-444d-ae4f-ee7d49bd48ec","resolution":{"observed_at":"2026-08-06T20:29:51.763458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:51.840724Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.840724Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:ff544f7a99afb78b5ec090bddb23d6024d529b482ab1160eac503422fbd87453","observation_id":"d36215ab-59f7-4faa-9bd8-03919f5e31a0","resolution":{"observed_at":"2026-08-06T20:29:51.840724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:51.908185Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.908185Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:b7ed3cc3a317fdf647770df7457d0c5e3a9017b50b605f6d2571653ddeb89441","observation_id":"ba6a1ae8-a7ea-4a74-9614-6b753638a361","resolution":{"observed_at":"2026-08-06T20:29:51.908185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:51.997934Z","title":"Analyzing and improv- ing the image quality of stylegan","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:51.997934Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:d8bd555e6d2c47a9efda2cfe8c420ba48c070e7173849e192a98e1bc29d66860","observation_id":"544eb297-01f6-4216-b2c3-23ffb67fa886","resolution":{"observed_at":"2026-08-06T20:29:51.997934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.13344","last_updated":"2022-12-27T02:51:46Z","snapshot_observed_at":"2026-07-06T14:35:10.557623Z","submitted_at":"2022-12-27T02:51:46Z","title":"DiffFace: Diffusion-based Face Swapping with Facial Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.13344","snapshot_observed_at":"2026-08-06T20:29:52.095578Z","title":"Diffface: Diffusion-based face swapping with facial guid- ance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.095578Z"},"links":{"cited_paper":"/paper/2212.13344","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:c98f813bd1432ec734adc8e60e224cce26b8e9786c37290d7b728f3a510e70fb","observation_id":"4836434a-1de1-4805-8f29-64ff37965d5c","resolution":{"observed_at":"2026-08-06T20:29:52.095578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.283374Z","title":"Faceshifter: Towards high fidelity and occlusion aware face swapping","venue":null,"work_id":"cd4bf98a-afa2-4b15-bf6d-f0dbff5cb62b","year":2020},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.192723Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:a5f9a4a7fd70beb018af0ebd9021a899300cb1b2b8d9829262347ed5244d9fda","observation_id":"f8a3401f-ff8c-4b3c-a1f8-7ed2b1d5cf1a","resolution":{"observed_at":"2026-08-06T20:29:57.289352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:52.249914Z","title":"Freehand sketch generation from mechanical components","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.249914Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:4c43c6cad3333825ac6547c6e5e30d5aac52ba2ca66580adcd768665e0cf324a","observation_id":"5a97bc12-f1be-477a-90b8-c575247b2f7f","resolution":{"observed_at":"2026-08-06T20:29:52.249914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23907","last_updated":"2025-05-28T11:29:58Z","snapshot_observed_at":"2026-08-05T13:50:35.500148Z","submitted_at":"2025-03-31T09:58:11Z","title":"HumanAesExpert: Advancing a Multi-Modality Foundation Model for Human Image Aesthetic Assessment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23907","snapshot_observed_at":"2026-08-06T20:29:52.335510Z","title":"Humanaesexpert: Advancing a multi-modality foundation model for human image aesthetic assessment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.335510Z"},"links":{"cited_paper":"/paper/2503.23907","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:d07da80ab1cdde5bf3504fc2f53ed6783a6c24c0cef9bed8cafd3d940a9492d5","observation_id":"fb7c6555-4e36-4872-89ea-994fa93a64c5","resolution":{"observed_at":"2026-08-06T20:29:52.335510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10982","last_updated":"2025-03-02T07:31:57Z","snapshot_observed_at":"2026-07-06T20:37:13.753772Z","submitted_at":"2025-02-16T04:00:06Z","title":"TEASER: Token Enhanced Spatial Modeling for Expressions Reconstruction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10982","snapshot_observed_at":"2026-08-06T20:29:52.412065Z","title":"Teaser: Token enhanced spatial modeling for ex- pressions reconstruction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.412065Z"},"links":{"cited_paper":"/paper/2502.10982","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:8bc9dac895fd11d3770d583d4a77cc5a440531d55e4a0788d10ae3dcaf4604af","observation_id":"93f99af7-2240-44ed-b389-6e675591fb4f","resolution":{"observed_at":"2026-08-06T20:29:52.412065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.241116Z","title":"Fine-grained face swap- ping via regional gan inversion","venue":null,"work_id":"a9c54d39-e9d9-444b-aa94-f04cc181b1ad","year":2023},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.479553Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:80ed6078542ddd1deb87f372a0ee319b00c42597443d07900c78d2b10d7deca4","observation_id":"ebfa4e43-d0c6-4bba-941b-239fe7f122e2","resolution":{"observed_at":"2026-08-06T20:29:57.254154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.219188Z","title":"Codeswap: Symmetrically face swapping based on prior codebook","venue":null,"work_id":"ec08925b-aae2-408e-8ede-98f96b27bcea","year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.576020Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:9ccc9147049a9c5eca511844e419f3b81d93caee8989db502a0ac333e2d950df","observation_id":"ffda1456-e678-4f8e-9d77-d7d16735021b","resolution":{"observed_at":"2026-08-06T20:29:57.227211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.198568Z","title":"Swa- pitup: A face swap application for privacy protection","venue":null,"work_id":"82317799-21b6-42d8-b5f9-4e149459334d","year":2017},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.679174Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:430e8e11391bca8956c809576faa754cc719dd1dd7b8a7eeac73605e4945ba5d","observation_id":"7172528d-de8c-4f70-9eff-12e7f585412a","resolution":{"observed_at":"2026-08-06T20:29:57.205036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.177755Z","title":"pagan: real-time avatars using dy- namic textures","venue":null,"work_id":"915f7041-0905-463a-a624-7c1232b64319","year":2018},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.746893Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:c47b782d0764b6ebfd2a9772740759223939a70b45f9e2156d8c7a197f709e7f","observation_id":"14e22c4b-0f5a-4d50-86bd-99c3905c7136","resolution":{"observed_at":"2026-08-06T20:29:57.185097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.157025Z","title":"On face segmentation, face swapping, and face perception","venue":null,"work_id":"b07b20ec-3d7f-4f8f-89b9-9f95530471ce","year":2018},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.827891Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:38413ee10ca06c64bab3e4f5d820f4985dcf4500fa336ee990a39b49922015f3","observation_id":"13e29560-7130-4e57-88d1-02e1475d15bd","resolution":{"observed_at":"2026-08-06T20:29:57.163280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.138316Z","title":"FSGANv2: Improved subject agnostic face swapping and reenactment","venue":null,"work_id":"6117fc1a-424b-4d2b-a703-e6fc932d05e6","year":2022},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:52.931895Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:c9c3d431612b7f2cfb89e830cd060a163c3e62aee5dd35a85c8bc26d456abd41","observation_id":"bfbe8c2c-3aab-4383-81a9-36a17cf0b44d","resolution":{"observed_at":"2026-08-06T20:29:57.143950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.111133Z","title":"Make a face: Towards arbitrary high fidelity face manipu- lation","venue":null,"work_id":"f651f0ec-2b0b-4c2b-869f-ad94b3832e6a","year":2019},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.011646Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:5b74b4283a0faebbf52bea0886d22ea093394898e813f71b55deb4f3f63d40d7","observation_id":"b164f81a-9e70-4ab9-bde0-f9290fb7cadf","resolution":{"observed_at":"2026-08-06T20:29:57.124527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:53.105488Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.105488Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:b72b320d13bdc400ce6db210feab9c182879205f48ab1de79281a455b8bcb8f7","observation_id":"355d8792-d853-4eac-be42-d70161ba5ee9","resolution":{"observed_at":"2026-08-06T20:29:53.105488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:53.197781Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.197781Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:e4ef4176c9f932fa430d96454c8eb97ff0992352fc32d7ffde3a30d1b4a89d0b","observation_id":"69b66ff9-b4dd-4267-a934-cf8e46baf9bc","resolution":{"observed_at":"2026-08-06T20:29:53.197781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:53.292897Z","title":"Faceforen- sics++: Learning to detect manipulated facial images","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.292897Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:22c0844fa01bec1d87489b6f2e8377055f703c2be4373164ff35801df694a77e","observation_id":"661a0b9c-1939-46aa-9126-0b5715183dde","resolution":{"observed_at":"2026-08-06T20:29:53.292897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11279","last_updated":"2024-12-15T18:58:32Z","snapshot_observed_at":"2026-08-06T08:23:16.512545Z","submitted_at":"2024-12-15T18:58:32Z","title":"VividFace: A Diffusion-Based Hybrid Framework for High-Fidelity Video Face Swapping","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11279","snapshot_observed_at":"2026-08-06T20:29:53.418488Z","title":"Vividface: A diffusion-based hybrid frame- work for high-fidelity video face swapping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.418488Z"},"links":{"cited_paper":"/paper/2412.11279","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:0101e210106725ffc62535574e4e83e42f1fcf3ac22c42cba6d1588c77f60895","observation_id":"c7260589-e117-4303-a945-e20065a0f7e5","resolution":{"observed_at":"2026-08-06T20:29:53.418488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:57.048547Z","title":"Blendface: Re-designing identity encoders for face- swapping","venue":null,"work_id":"ee8bd1b5-06a3-40b7-83e6-c3785bbbb8a5","year":null},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.508810Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:9014519bde69103ba8f0b96ba193ab1e99a9bee1e1fde211846852606ab717f5","observation_id":"af3d28ad-253c-4574-aba0-771b4514dc95","resolution":{"observed_at":"2026-08-06T20:29:57.055235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:53.565412Z","title":"First order motion model for image animation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.565412Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:d2aef507c4bcdc527a71ce9514bc3bc22b15cab4074ef7854700db2b6fab3e8f","observation_id":"284cd656-c737-4ce4-b4fe-54c88b90afc9","resolution":{"observed_at":"2026-08-06T20:29:53.565412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:53.655224Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.655224Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:588c31c47d5e75abde7bd0de91229e7a04d5519e4835f0490949c2200de82788","observation_id":"fa663e8d-3836-41dc-964e-5b60eeb9056f","resolution":{"observed_at":"2026-08-06T20:29:53.655224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08553","last_updated":"2025-07-07T17:31:41Z","snapshot_observed_at":"2026-07-06T20:21:13.914417Z","submitted_at":"2025-01-15T03:28:14Z","title":"DynamicFace: High-Quality and Consistent Face Swapping for Image and Video using Composable 3D Facial Priors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08553","snapshot_observed_at":"2026-08-06T20:29:53.747621Z","title":"Dy- namicface: High-quality and consistent video face swap- ping using composable 3d facial priors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.747621Z"},"links":{"cited_paper":"/paper/2501.08553","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:2ca2c773c628f4d743529f4463d2d6db56d8fbca3f67f8179cfe707ed97ad71d","observation_id":"8a616ac9-d5f2-4b1f-8118-3e17106bcd88","resolution":{"observed_at":"2026-08-06T20:29:53.747621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:53.836309Z","title":"Disco: Disentangled control for realistic human dance generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.836309Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:f806098dd15ed66c821c61ae30c9024519cac244a0dca44c5b4ab92712e253b2","observation_id":"eca1cfdc-9da6-4481-8e22-99afb39d87f1","resolution":{"observed_at":"2026-08-06T20:29:53.836309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:53.903578Z","title":"One-shot free-view neural talking-head synthesis for video conferenc- ing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.903578Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:d97b3e622cc71c9b17e3db46ceed806453e6b08f7b72615c737dbf904afa02ef","observation_id":"39d1e2d6-10b8-49c3-b17c-8871774db58d","resolution":{"observed_at":"2026-08-06T20:29:53.903578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:56.966546Z","title":"Anytalk: Multi-modal driven multi-domain talk- ing head generation","venue":null,"work_id":"61c43e75-7505-4f03-9585-44ffd6bfac7d","year":2025},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:53.964913Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:6990e611ada58887a97962794e75a259f976ee9b9c1f92639339e547b0d48190","observation_id":"cad67a13-48bf-4b4b-a990-8e467916adc5","resolution":{"observed_at":"2026-08-06T20:29:56.971569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00396","last_updated":"2025-05-27T13:43:25Z","snapshot_observed_at":"2026-07-06T21:02:03.850521Z","submitted_at":"2025-04-01T03:37:30Z","title":"SPF-Portrait: Towards Pure Text-to-Portrait Customization with Semantic Pollution-Free Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00396","snapshot_observed_at":"2026-08-06T20:29:54.016923Z","title":"Spf-portrait: Towards pure portrait customization with semantic pollution-free fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.016923Z"},"links":{"cited_paper":"/paper/2504.00396","citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:67fb93985ec5a0dd6662bb7f8b3ec822b47766615431cce2a0df0ba37474c05a","observation_id":"fa66b6c5-6860-4a10-8a8d-966dedd11dc1","resolution":{"observed_at":"2026-08-06T20:29:54.016923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:56.688207Z","title":"Vfhq: A high-quality dataset and bench- mark for video face super-resolution","venue":null,"work_id":"db56414c-0ab8-4b33-a5b6-a77dd2c12848","year":2022},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.065281Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:7393cea8492f2c9e1faa4316bcd12b3aec5c85670b38c92bd675b9986831ca10","observation_id":"d7783d26-1ca5-4a9d-b217-8c3ff88b8696","resolution":{"observed_at":"2026-08-06T20:29:56.840664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:56.547297Z","title":"High-resolution face swapping via latent semantics disentanglement","venue":null,"work_id":"cfff885c-c491-4b6f-8917-b4838d800e4f","year":2022},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.126593Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:1f578633d9bb9aebfdd36961af9daf4c4f25ea7c06ba86d571ea69be732c1b00","observation_id":"01b214f8-851f-47ca-bf40-00c3fc0ade31","resolution":{"observed_at":"2026-08-06T20:29:56.608103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:56.098608Z","title":"Styleswap: Style-based generator empow- ers robust face swapping","venue":null,"work_id":"5c612eba-3a1b-4b37-98a0-679a1fd89232","year":2022},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.200644Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:4b9858e969a756fad71d09e1e17010c1206dc1da7e52c0551000bdf37685d9f6","observation_id":"9ba7563b-822b-4f6c-931b-6c31b5dccbf6","resolution":{"observed_at":"2026-08-06T20:29:56.406646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:55.795895Z","title":"Human motion video genera- tion: A survey","venue":null,"work_id":"10d86cab-e8ac-4376-b0c1-8cd7f9ec3703","year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.252436Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:6d6e1eca12457db10404310eb0e61fe3bbf6719fc256d1a032d8647a6019f994","observation_id":"593b3b08-e556-4157-adab-debe2fb7b6d5","resolution":{"observed_at":"2026-08-06T20:29:55.925878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:54.313615Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.313615Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:417020476329be3c22f40590b706abddb7d9b32b2ce6925c37e31d76467b2b6a","observation_id":"36e5d570-f0b9-41f2-9149-87a87683256f","resolution":{"observed_at":"2026-08-06T20:29:54.313615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:55.576582Z","title":"Accurate 3d face recon- struction with facial component tokens","venue":null,"work_id":"044ccc8c-574a-40e0-99c4-20d3184333da","year":2023},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.379366Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:98c516dcc67da91dc1e5b30525166c0e061b5ab5ac59f09a4d48f817a2ecd6ff","observation_id":"82761608-6104-4fcd-83fe-0da250e8397c","resolution":{"observed_at":"2026-08-06T20:29:55.647990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:55.329248Z","title":"Thin-plate spline motion model for image animation","venue":null,"work_id":"853b531c-b6cd-46b2-a481-0b04d34fa53d","year":2022},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.435451Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:c5d7b5d452d0243ec225b4b263c5022aff87f0ea9a11e8afd6674dde8e53908d","observation_id":"df89670f-1dd2-4a6a-a321-23b70371a7a2","resolution":{"observed_at":"2026-08-06T20:29:55.437072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:55.210698Z","title":"Diffswap: High-fidelity and con- trollable face swapping via 3d-aware masked diffusion","venue":null,"work_id":"209be896-6ecc-4f6f-8e39-cf655d2cf120","year":2023},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.502940Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:d8054c7a69918eb2160aeb149ba3fbdb8824368299f7f39b86393324b9191c2b","observation_id":"df1804ee-1b64-4024-829b-404750786abf","resolution":{"observed_at":"2026-08-06T20:29:55.273266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:55.079372Z","title":"One shot face swapping on megapixels","venue":null,"work_id":"e2d601be-ca8b-4430-8bca-0b7f744b3acf","year":2021},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.571551Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:1bc82c42870622165b60c7a67b09fc8338e6988027a464edc995528b0de1b35f","observation_id":"8b852954-5fac-43c4-8d4b-fbce6a14466b","resolution":{"observed_at":"2026-08-06T20:29:55.132536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:54.930660Z","title":"Stableswap: Stable face swapping in a shared and controllable latent space","venue":null,"work_id":"d7b9e39f-71fd-42a4-a4f7-33f88380760d","year":2024},"citing_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:54.626256Z"},"links":{"citing_paper":"/paper/2507.02691"},"observation_digest":"sha256:23cc3154ac588fe9e837e0ca59db7f22fddf93abde73edc922eb3020a75f7885","observation_id":"3f72b8f1-c49d-4adc-b079-f65dadb51d1a","resolution":{"observed_at":"2026-08-06T20:29:54.989271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 2 inbound Pith citation observations for arXiv:2507.02691."}