{"as_of":"2026-08-07T07:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c84b3ea5dc89bf0325c0deec8a01b39a0d287d5a8cb2632410f0f765622cdf53","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T23:56:41.488788Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2512.07951/citation-record","integrity":"/paper/2512.07951/integrity","json":"/paper/2512.07951/citation-record.json","paper":"/paper/2512.07951"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L2cs-net: Fine-grained gaze estimation in unconstrained environments","venue":null,"work_id":"f93f8bd8-7003-439b-b8bf-2492649916a7","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:2c1709e38b7f2e53ba818e6d88ffc54b4da914668b8f7fdb093b9c2775a9d303","observation_id":"675839d1-93fb-4c36-9c0e-0e71688621c2","resolution":{"observed_at":"2026-05-16T23:58:43.822674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:968e5dbf96c420d2c1ef53e5326a40db7ac93a04c5f9c1c3b273458f9380efc8","observation_id":"0f92c6a7-fc9f-41a3-8672-0a67bd304325","resolution":{"observed_at":"2026-05-16T23:58:42.817542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Masactrl: Tuning-free mu- tual self-attention control for consistent image synthesis and editing","venue":null,"work_id":"8b6ce9ab-7629-45f2-9c6f-8417eb4c0320","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:97d25e55bbe6e5e5221188e54594a493dc886209b35a9d36d12831f577d01bcf","observation_id":"d6aea9f5-a9b1-4ea6-b9e6-a44a2550d925","resolution":{"observed_at":"2026-05-16T23:58:43.836514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simswap: An efficient framework for high fidelity face swapping","venue":null,"work_id":"e781e5ac-6201-488e-80e1-f0b6cc0341f8","year":2020},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:6c4e81314d947a58dd9aa73cee959727d517c6f1292415da223c450b5dfacc15","observation_id":"ae5165ce-8b04-4bba-86ab-05a12988607f","resolution":{"observed_at":"2026-05-16T23:58:43.902991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18293","last_updated":"2024-12-10T11:13:57Z","snapshot_observed_at":"2026-07-06T19:57:55.925634Z","submitted_at":"2024-11-27T12:30:24Z","title":"HiFiVFS: High Fidelity Video Face Swapping","version":2},"cited_work":{"arxiv_id":"2411.18293","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18293","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hifivfs: High fidelity video face swapping","venue":null,"work_id":"8dff1af3-0d65-4dea-8a40-4a4651970952","year":2024},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2411.18293","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:6d53605a5fdebb1c1175acc1609cefcecfb53ae3f1092cf16e23b9f3efb5e1d1","observation_id":"caa9c512-8981-4c72-85f2-6625140c6327","resolution":{"observed_at":"2026-05-16T23:58:42.852402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:efa77de0a4ee472f5e1198a9f2c2329f6e511b937b9f49bc5c66e8a1c9a77025","observation_id":"a74ed102-69f8-41d0-83c0-f4a4d07d7f46","resolution":{"observed_at":"2026-05-16T23:58:42.787829Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://github.com/deepfakes/face- swap.Ac- cessed: 2020-12-20","venue":null,"work_id":"a50b77ba-0f8f-49f1-b397-f73cd24db455","year":2020},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:e128e5792f9c437acedc07d0bf6eec251d859c95ad99b3ddfcb2ce0c7fe9556e","observation_id":"61b57491-4517-47b7-a713-fe60f70542ec","resolution":{"observed_at":"2026-05-16T23:58:43.892643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":"2505.14683","doi":"10.48550/arxiv.2505.14683","metadata_source":"pith","pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emerging Properties in Unified Multimodal Pretraining","venue":"cs.CV","work_id":"e0cfd82c-f5d4-44fd-b531-ec73ab0a805b","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:a7793642e6a2dae6ef3b2be28383724deed494c5187805a54441d28ca3df4d89","observation_id":"b92f57fd-a0f4-4f15-9355-80329d33f7e3","resolution":{"observed_at":"2026-05-16T23:58:42.778446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accurate 3d face reconstruction with weakly-supervised learning: From single image to image set","venue":null,"work_id":"5fd9bbe0-d913-4d04-afcc-06cdbb59c91b","year":2019},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:e9bb695eafeab6bd624b159a007904dfc49c07a59441fca801467f32ef293923","observation_id":"1cd82916-5238-4654-a183-25991bcd933b","resolution":{"observed_at":"2026-05-16T23:58:43.895751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T09:16:07.203676Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":"a92e35c5-be55-4ec3-80cd-8bf130aa79ac","year":null},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:86146f3ed448e44bff06be558d830102a614986c11c28ba6a62dd61f2036b6b7","observation_id":"efcee4d0-3f7f-47fe-b73a-6a073c3607a1","resolution":{"observed_at":"2026-05-16T23:58:43.899489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Information bottleneck disentanglement for identity swapping","venue":null,"work_id":"1b9547cf-dd85-4bf8-8a34-841434d1b446","year":2021},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:624b88a4dbb9c7c36edf990b14126ad76cf2ed554a61cefb5f9caf010a8c3480","observation_id":"65c791ca-b71b-42e6-a131-28033d2e24c9","resolution":{"observed_at":"2026-05-16T23:58:43.906421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-06T08:12:35.134201Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"cited_work":{"arxiv_id":"2307.10373","doi":"10.1109/iccv51701.2025.005","metadata_source":"pith","pith_arxiv_id":"2307.10373","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","venue":"cs.CV","work_id":"2e967b53-6386-4564-b468-ffd540817064","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2307.10373","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:4a9ba443b98eda2370cf51f8f0fdfe4f831bcbc928fa1078a795ee790b643e7f","observation_id":"834dc603-b548-46a5-bcdb-69a7cbe7256d","resolution":{"observed_at":"2026-05-17T20:17:47.115702Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Keyframe-guided creative video inpainting","venue":null,"work_id":"9143aacc-8d8f-4230-b653-e12301bf0960","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:9ac8f1ec67b14bbe999d1a71967c0952a4863d834791d9e53793bfe8cc0de580","observation_id":"c24170f8-c8f6-466a-95fb-650a41f5367a","resolution":{"observed_at":"2026-05-16T23:58:43.887025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12970","last_updated":"2024-07-09T00:49:26Z","snapshot_observed_at":"2026-08-04T19:21:16.589508Z","submitted_at":"2024-05-21T17:50:12Z","title":"Face Adapter for Pre-Trained Diffusion Models with Fine-Grained ID and Attribute Control","version":2},"cited_work":{"arxiv_id":"2405.12970","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.12970","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Face adapter for pre-trained diffusion models with fine-grained id and attribute control","venue":null,"work_id":"f2f2b669-1ae0-4403-8b1a-2108e6af1f5a","year":2024},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2405.12970","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:53fbb24d0ed414c269dc115f4195c2ce92a8b9264db856a5c187c5bdaee9ff62","observation_id":"6fa2c206-9bc8-47db-bf4b-a81537ac8d88","resolution":{"observed_at":"2026-05-16T23:58:42.783378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Facefusion: Industry leading face manipulation platform","venue":null,"work_id":"e0028f0e-62f0-4da1-8cba-fe052551cf53","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:aa3c1d4faabd3121dbbb50a5c05521c1764413b03746c63dec0e37eafc44cf61","observation_id":"58cf681d-df4a-4ce9-965e-be1928134380","resolution":{"observed_at":"2026-05-16T23:58:43.883803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Delta de- noising score","venue":null,"work_id":"d046156a-f5e6-4c4e-a1d8-30e262fbc60e","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:6559af8f9234f7c3fc9a7fc8f97da76bdce30d1eecf1c5e94ca06949155984d0","observation_id":"9b914b9c-f8d1-4ba7-b851-a892ecfd5c79","resolution":{"observed_at":"2026-05-16T23:58:43.880225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-07-06T20:33:43.357335Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:3b3bc65fdf6b7bb9ee1b7c84568d2e0047d4a3d7f74b574392b3e848f7dedf7a","observation_id":"188979af-c8e7-4ac0-99bb-af9e86a4ee7a","resolution":{"observed_at":"2026-05-16T23:58:42.810029Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:3174f3b7b6ff97c1c0ffa3fd37e9bd685e42b330c6439511f4dcc49bdb2f5878","observation_id":"09909fcc-4724-473b-aa5b-eb8b76757c17","resolution":{"observed_at":"2026-05-16T23:58:42.829777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":"2503.07598","doi":"10.48550/arxiv.2503.07598","metadata_source":"pith","pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"VACE: All-in-One Video Creation and Editing","venue":"cs.CV","work_id":"c68efbde-3431-4655-a337-87e2871ad6a3","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:39328326a23a20a9c65be74780bbe2edba3776b52689860798adedb8381b8c66","observation_id":"ab28edc5-9f2c-4b62-abcc-c4498ebf9d06","resolution":{"observed_at":"2026-05-16T23:58:42.847194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:14.2036+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:14.2036+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01506","last_updated":"2023-10-19T13:02:21Z","snapshot_observed_at":"2026-08-05T14:13:30.114970Z","submitted_at":"2023-10-02T18:01:55Z","title":"Direct Inversion: Boosting Diffusion-based Editing with 3 Lines of Code","version":2},"cited_work":{"arxiv_id":"2310.01506","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.01506","snapshot_observed_at":"2026-07-09T21:16:34.354064Z","title":"Direct inversion: Boosting diffusion-based edit- ing with 3 lines of code.arXiv preprint arXiv:2310.01506","venue":"cs.CV","work_id":"eba12495-cf75-42e3-9cbb-d8ea203a3f5f","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2310.01506","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:98465062bd6c5609aa59a5dfd02605ae7d0a8e8e012a0b42f09e6ba0b9655ec9","observation_id":"7c18d17f-f127-47f1-8ef1-b7cf5461a0a6","resolution":{"observed_at":"2026-05-16T23:58:42.799322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-07-06T21:44:22.901650Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":"2506.15742","doi":"10.48550/arxiv.2506.15742","metadata_source":"pith","pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","venue":"cs.GR","work_id":"5dfe19d5-3541-4803-8fe9-3c8b9e29b281","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:9182c577e5c178be732ab4faa52decf17bed462319b39cf3ac9c16bac7eaccf2","observation_id":"4d1c8ec5-f762-41b0-b2ec-8b03cff6c36e","resolution":{"observed_at":"2026-05-16T23:58:42.838071Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openhumanvid: A large-scale high-quality dataset for enhancing human-centric video generation","venue":null,"work_id":"4e8cc759-bd75-45ac-b6e8-6d88b7d8f962","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:00e1258169d63898f4b0f1403e5008c48c1cd8786a0641827010d4f2f5a521bd","observation_id":"58c81c6d-d9e0-4cad-a18e-44d9ccf40cff","resolution":{"observed_at":"2026-05-16T23:58:43.876878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.13457","last_updated":"2020-09-15T07:43:58Z","snapshot_observed_at":"2026-07-06T08:47:53.346676Z","submitted_at":"2019-12-31T17:57:46Z","title":"FaceShifter: Towards High Fidelity And Occlusion Aware Face Swapping","version":3},"cited_work":{"arxiv_id":"1912.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1912.13457","snapshot_observed_at":"2026-06-29T13:03:25.853618Z","title":"Faceshifter: Towards high fidelity and occlusion aware face swapping","venue":null,"work_id":"52c63e44-c780-405b-98ae-86c5f50644dd","year":1912},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/1912.13457","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:4252c306ddf4e625c1f058515443301ba16ca22d2e879a8b123a0f5471b1f5be","observation_id":"57ea8217-5f49-4820-87b7-891edf9eaef8","resolution":{"observed_at":"2026-05-16T23:58:42.842991Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02691","last_updated":"2025-07-03T15:03:39Z","snapshot_observed_at":"2026-08-06T20:20:37.720631Z","submitted_at":"2025-07-03T15:03:39Z","title":"CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation","version":1},"cited_work":{"arxiv_id":"2507.02691","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02691","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Canonswap: High- fidelity and consistent video face swapping via canonical space modulation","venue":null,"work_id":"69d200af-e54c-4765-a113-dae2e552a9c8","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2507.02691","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:07ae6cdc97505b1454e415187d271962d5adf0354753fb18c77107728a505836","observation_id":"9ab1a915-a41d-4897-9c90-41b4f1e5c8c5","resolution":{"observed_at":"2026-05-16T23:58:42.773661Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pexels: Free stock photos and videos","venue":null,"work_id":"7ba7b91b-014a-4ef0-a5e2-4944e9c3d198","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:2e13b212ea227cc087f4c007375bd5040a67fafdea1bb0fc2963128cf83ddc61","observation_id":"fd8460ee-71c8-4a62-8e89-c8ce124ba71e","resolution":{"observed_at":"2026-05-16T23:58:43.869728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixabay: Free images and videos","venue":null,"work_id":"4072555c-c263-4f00-ac30-1d8458a88c90","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:8aef6da459fe6c49b5b8eeca2ae898612c1f7e6ee630ee9c81c2c0109eb7e1f9","observation_id":"8cfa4751-2e0b-44ac-82d5-2179eb54a43d","resolution":{"observed_at":"2026-05-16T23:58:43.873007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":"2209.14988","doi":"10.48550/arxiv.2209.14988","metadata_source":"pith","pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","venue":"cs.CV","work_id":"7529df29-9980-4a8a-b55e-307e3c2f357b","year":2022},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:58b5cbdfe3a439e7e5a0f7388c7d38ba4069e71222bf3168603e324ac0d8d832","observation_id":"36be8dc6-76a5-4977-a595-c82141068b42","resolution":{"observed_at":"2026-05-16T23:58:42.791916Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:01.924447+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:01.924447+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fatezero: Fus- ing attentions for zero-shot text-based video editing","venue":null,"work_id":"25e55829-46cd-4adc-8763-d1c036a03a53","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:8a5a5c6092170ad2c33661972003d8197ac1078937e1c65775b6fd3a879956ce","observation_id":"151252e9-f4cf-4fdc-b9ed-741e1a689789","resolution":{"observed_at":"2026-05-16T23:58:43.856204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Faceforen- sics++: Learning to detect manipulated facial images","venue":null,"work_id":"f6bd7497-0c8d-4b2c-86c0-c6fab536ea2c","year":2019},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:9c9c4bb0477a8009392348a8c0e27dc7704bf8e002a2f8dd5049f0b02e67b76c","observation_id":"029ab3f3-56f9-4dbe-88e9-01eea9158ee0","resolution":{"observed_at":"2026-05-16T23:58:43.859464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fine- grained head pose estimation without keypoints","venue":null,"work_id":"c00c3460-5935-46bf-8eda-81418930c5e9","year":2018},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:a40d98008b929877f7a00bf940dc42153869a0f10deded0399da0a0fac438d7e","observation_id":"7b7242c1-1e0f-4163-ad78-f6a67b9e6d4b","resolution":{"observed_at":"2026-05-16T23:58:43.850446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"05ec3d4b-8371-468e-b066-f9b6258b4114","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:dc2a389168bd8809c5e9c146a514f33233057eaf8a2ec1a8516b45e25b4f8503","observation_id":"c593081f-9444-4f33-aa0a-1e953c742659","resolution":{"observed_at":"2026-05-16T23:58:43.863023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blendface: Re-designing identity encoders for face- swapping","venue":null,"work_id":"27dcc37b-f1f1-4bb9-922a-2ace53d7bf9b","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:60051f094c4304b05278c5a4df5bb68e0da52e222b991e8acdf93b209edb8ae0","observation_id":"38373628-a658-40d0-a644-c25b343c3a9f","resolution":{"observed_at":"2026-05-16T23:58:43.842333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videoanydoor: High-fidelity video ob- ject insertion with precise motion control","venue":null,"work_id":"5306e55b-e036-4a7e-99b1-e29a836109a2","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:8e76498d12c428892dc32ee9940eadaf5ec0084c4405d4c0f654e6eba1fb9c3a","observation_id":"421f8d10-ea62-4dc5-b880-a28454d99063","resolution":{"observed_at":"2026-05-16T23:58:43.853125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":"1812.01717","doi":"10.48550/arxiv.1812.01717","metadata_source":"pith","pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","venue":"cs.CV","work_id":"72f42543-17d5-49aa-ba5a-25d67ffbb88a","year":2018},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:6c5dce683a8605bdb5b41e94dad452d21d56ddd06bf98a11ee22481357b2c19b","observation_id":"cc97ca24-85ce-4ae4-9a14-f9717fec7a65","resolution":{"observed_at":"2026-05-16T23:58:42.802287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cosface: Large margin cosine loss for deep face recognition","venue":null,"work_id":"44936841-97dd-4ab9-ad29-14defdad736c","year":2018},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:a869ee8ec2f090165342575644047a05f1198a6d954375963999ed22c08526dc","observation_id":"044474c2-2828-46e7-94e3-503f97bdd780","resolution":{"observed_at":"2026-05-16T23:58:43.889651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08553","last_updated":"2025-07-07T17:31:41Z","snapshot_observed_at":"2026-07-06T20:21:13.914417Z","submitted_at":"2025-01-15T03:28:14Z","title":"DynamicFace: High-Quality and Consistent Face Swapping for Image and Video using Composable 3D Facial Priors","version":2},"cited_work":{"arxiv_id":"2501.08553","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08553","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dy- namicface: High-quality and consistent video face swap- ping using composable 3d facial priors","venue":null,"work_id":"697d51df-e51c-4cd8-a24e-e53810c83359","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2501.08553","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:83d070bffec09f5f7f6dd0f97b0adf18ac906479b201288ff0b5db88c607d6d5","observation_id":"a1b2940a-bfeb-4707-b4bb-cbc86454b0dc","resolution":{"observed_at":"2026-05-16T23:58:42.806124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18978","last_updated":"2024-11-04T13:37:31Z","snapshot_observed_at":"2026-07-06T19:39:15.025945Z","submitted_at":"2024-10-24T17:59:51Z","title":"Framer: Interactive Frame Interpolation","version":2},"cited_work":{"arxiv_id":"2410.18978","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18978","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Framer: Interactive frame interpolation","venue":null,"work_id":"945d06de-b7dd-4f9a-87bb-8116b7b68f91","year":2024},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2410.18978","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:d97de723e9768804d606aaafa48b6eacb9e8a9135475508899f4f2cbc4f26859","observation_id":"e34585ca-1cb5-4b0c-9554-3a82df8f0d0d","resolution":{"observed_at":"2026-05-16T23:58:42.861636Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:459492a27784534c8503e8fbf0a070e9db87add16fa9fd74e5463b539da38ab5","observation_id":"6d8b21d9-ee5b-4419-8f04-0886406eb93c","resolution":{"observed_at":"2026-05-16T23:58:42.821219Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vfhq: A high-quality dataset and bench- mark for video face super-resolution","venue":null,"work_id":"b8a15942-0b12-4b61-be2e-5e24f9693235","year":2022},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:488ad834eca108fdec37eba960d3ea5da2d2f1b45642b6ac21ba43f4d86863cb","observation_id":"1c8e5fe3-e2bc-47d5-b543-3f31b7813c36","resolution":{"observed_at":"2026-05-16T23:58:43.831253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11627","last_updated":"2024-07-11T02:30:02Z","snapshot_observed_at":"2026-07-06T17:46:11.859512Z","submitted_at":"2024-03-18T09:58:52Z","title":"LoRA-Composer: Leveraging Low-Rank Adaptation for Multi-Concept Customization in Training-Free Diffusion Models","version":2},"cited_work":{"arxiv_id":"2403.11627","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.11627","snapshot_observed_at":"2026-07-03T01:37:30.939913Z","title":"Lora-composer: Leveraging low-rank adaptation for multi-concept customization in training-free diffusion models","venue":null,"work_id":"dc6c70c5-34e4-4c9d-af50-3bf6ad40c017","year":2024},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2403.11627","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:a18d3b3ff12d4108de6f530e8f61fa86c400456b64e79f27b6cd464397cb500e","observation_id":"bf8ff058-efd3-4391-9997-b02220394369","resolution":{"observed_at":"2026-05-16T23:58:42.857357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.21593","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Any-to-bokeh: One-step video bokeh via multi-plane image guided diffu- sion","venue":null,"work_id":"1f30a0b4-2c1e-4931-893d-077ab2d763af","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:585b04f4c45e72104633e6f4116c0b5997f3fa61e1aaebe4124f7e0e733a6018","observation_id":"ffc3535f-b4da-4db0-832e-e57a90b81bd0","resolution":{"observed_at":"2026-05-16T23:58:42.834345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12149","last_updated":"2024-03-18T08:36:02Z","snapshot_observed_at":"2026-08-06T13:30:35.015470Z","submitted_at":"2023-10-18T17:59:02Z","title":"Object-aware Inversion and Reassembly for Image Editing","version":2},"cited_work":{"arxiv_id":"2310.12149","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.12149","snapshot_observed_at":"2026-07-04T00:19:13.835961Z","title":"Object-aware inver- sion and reassembly for image editing","venue":null,"work_id":"29547e34-5447-47e5-a3c6-351bd052706c","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2310.12149","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:cd3dd6cff87d5a405527c2d63dce168cd9f7cbf371349b1e13ad6ac0903ee424","observation_id":"c3b2fd17-582c-45fd-9935-d48e66b9edd7","resolution":{"observed_at":"2026-05-16T23:58:42.795673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Effec- tive whole-body pose estimation with two-stages distillation","venue":null,"work_id":"12fcb115-42c5-45fb-9463-78f1323f71c8","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:f86bcf2b9ec6e502569334b1adb8c3e2cef91408c0efe3842b51ca6f2e228a3c","observation_id":"70d774f9-b5e7-48ef-a090-7554879454ed","resolution":{"observed_at":"2026-05-16T23:58:43.833928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bisenet: Bilateral segmentation network for real-time semantic segmentation","venue":null,"work_id":"05d6e313-b122-4010-88ff-c35c7e420ffb","year":null},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:f8a85352db692ed35234c3e434bf12643c07ada9b07af2996690f43f375c461a","observation_id":"e1a15b2b-b609-413e-9c50-dbc2ec07b339","resolution":{"observed_at":"2026-05-16T23:58:43.827122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Celebv-text: A large-scale facial text-video dataset","venue":null,"work_id":"3db3d511-ece8-4393-af7a-35ef43410cc9","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:59db42795113905de253691b03a3820438f4b0110e3386995b74bcd4abc375f5","observation_id":"28b76bfd-ba5a-408f-ad9b-83008c62d3e2","resolution":{"observed_at":"2026-05-16T23:58:43.866465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"b8044dc6-7faf-4785-9feb-4ee7fb709bad","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:61f02aa5ace415c764849c8879c97bde85d21aa6a53cc0f1c71aacd8141da9ec","observation_id":"f7e77208-9c13-4b95-b855-eaedbcdf8db0","resolution":{"observed_at":"2026-05-16T23:58:43.839250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diception: A generalist diffusion model for visual perceptual tasks","venue":null,"work_id":"78de0a00-3349-4b6f-915e-773a1004e783","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:7e765b381d59eaa4cef9d46935355aba4856f204eca3a22140677482be89ac96","observation_id":"0d20ab4e-686a-4b2f-ac91-bef327c4ac7a","resolution":{"observed_at":"2026-05-16T23:58:43.845283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12935","last_updated":"2025-01-22T15:06:30Z","snapshot_observed_at":"2026-08-07T01:27:03.735858Z","submitted_at":"2025-01-22T15:06:30Z","title":"3D Object Manipulation in a Single Image using Generative Models","version":1},"cited_work":{"arxiv_id":"2501.12935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.12935","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d object manipulation in a single image using generative models","venue":null,"work_id":"f2891c01-a65d-47cf-8b74-784b10a6fd77","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2501.12935","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:fca42ad2b1f95c075742dedf5ea34c6c9e7a7eb5f7ec5d186cdfed04f14f34f5","observation_id":"dfc5c8c9-ccf7-4db9-ab06-8ec68ad9ee32","resolution":{"observed_at":"2026-05-16T23:58:42.813688Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffswap: High-fidelity and con- trollable face swapping via 3d-aware masked diffusion","venue":null,"work_id":"c8158765-aaea-4da7-87a2-61ccec8a9af2","year":2023},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:7ac43b0426a3cec948e2816c01a87e6dbce221d7d3e9a29857b3b08287c644ba","observation_id":"7d1d6799-53b0-421c-8ba0-ced2df1f4276","resolution":{"observed_at":"2026-05-16T23:58:43.824807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Local conditional controlling for text-to-image diffu- sion models","venue":null,"work_id":"1f67ac61-f313-4682-b692-834566b77938","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:f90ccd918a608b5391741e985e5b8913d40b355f85cb7717463c24bc2158aa38","observation_id":"285705be-d0dc-45fe-8c80-b462f5d0b1a0","resolution":{"observed_at":"2026-05-16T23:58:43.848008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unleash- ing the potential of the diffusion model in few-shot semantic segmentation.Advances in Neural Information Processing Systems, 37:42672–42695","venue":null,"work_id":"a47b9e29-d800-4bb9-b217-e3b57bd2a9bf","year":2024},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:a7a7b3822f3df388d259e68944f032478823839fafa2e43ccddb0ca19fd6285a","observation_id":"01450775-3f84-4884-a3b0-52828988aaa1","resolution":{"observed_at":"2026-05-16T23:58:43.829204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":22,"verified_fuzzy":29},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2512.07951."}