{"as_of":"2026-08-23T01:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:325713b07894ed1a176d43b3163986817b98a46f0825ec5b39dfe92bd3a1fd3f","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:42:42.586028Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.07530/citation-record","integrity":"/paper/2501.07530/integrity","json":"/paper/2501.07530/citation-record.json","paper":"/paper/2501.07530"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.520139Z","title":"Im- age2stylegan: How to embed images into the stylegan latent space? 2019 IEEE/CVF International Conference on Com- puter Vision (ICCV), pages 4431–4440, 2019","venue":null,"work_id":"30f0d327-c51f-4034-b8a0-c827a4a1b8cd","year":2019},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.310640Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:4384ba556cd7531ec29a1eabebd45b841aa30512ed0a88986d977a0191c2337b","observation_id":"a870222d-d87e-4745-84b5-af0e4b3d8acc","resolution":{"observed_at":"2026-08-10T20:42:43.525330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.502895Z","title":"Im- age2stylegan++: How to edit the embedded images? In 2020 IEEE/CVF Conference on Computer Vision and Pat- tern Recognition (CVPR), pages 8293–8302, 2020","venue":null,"work_id":"e3a060f0-3051-42d5-b1cd-8587ce1d911e","year":2020},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.316014Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:eeee026708e2ad615b72f743be9d74969f5644e76d1e6512d1ff968afdceef6e","observation_id":"ef925e6c-854c-46e6-9dbf-a5c44ade8649","resolution":{"observed_at":"2026-08-10T20:42:43.509051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.485975Z","title":"Seman- tic photo manipulation with a generative image prior","venue":null,"work_id":"5b59c297-4ed8-45ec-ace2-621e4ae746d5","year":2019},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.321022Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:d1747e7cfef586eeca16f0ea2a67558faaf7268b79000c06a51cf173f8771267","observation_id":"5e8f5f6c-030a-4228-8918-0907f8ee4f16","resolution":{"observed_at":"2026-08-10T20:42:43.491145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.468694Z","title":null,"venue":null,"work_id":"84b4d326-5ef0-4541-805d-8922d4af8bd8","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.325892Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:5640d82a77c0c83467346e54db6bee91f4d0516cac3110ff134c670982486c4b","observation_id":"e42607d4-a7fa-4310-9e9d-c7646a580c8d","resolution":{"observed_at":"2026-08-10T20:42:43.473763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.452454Z","title":"Pix2video: Video editing using image diffusion","venue":null,"work_id":"2870d230-e08a-4c41-95a4-e4640027c79d","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.331280Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:85cfa83474a2d173dac602b0b70268e8485cf2aaf8b715f721dfb67959231b3d","observation_id":"e1af2e66-e2ae-4ca7-887b-7ddad155be16","resolution":{"observed_at":"2026-08-10T20:42:43.457523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.434818Z","title":"Stablevideo: Text-driven consistency-aware diffusion video editing","venue":null,"work_id":"e5d6864a-eebc-4242-b594-ca74047bc05f","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.336741Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:b39e84676572ffce85f241e6ab8e5e92a493aec82f64fbddeb0c19a3129476d2","observation_id":"f328256e-ce88-4b1c-b977-c4a2481b35ad","resolution":{"observed_at":"2026-08-10T20:42:43.441476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.418274Z","title":"Attend-and-excite: Attention-based se- mantic guidance for text-to-image diffusion models","venue":null,"work_id":"2d2c3710-a665-4b43-815f-32e4e742511e","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.342589Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:a4be1489bccdc3439730987c8843b659413c1f794678b7cc990620d785834b2b","observation_id":"5176611b-55bd-45ad-a9c1-e2cae32b3fd8","resolution":{"observed_at":"2026-08-10T20:42:43.423536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.401691Z","title":"Celebv- hq: A large-scale video facial attributes dataset","venue":null,"work_id":"f884566f-4106-4fb2-b4b7-5af572f6ef66","year":2022},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.347689Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:261da92047adc7fb3365c49b717c7557ac44079c2e80f3330004302f60295c11","observation_id":"49f02972-dc2b-4f57-8eac-b2136c205e09","resolution":{"observed_at":"2026-08-10T20:42:43.407261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.383362Z","title":"Arcface: Additive angular mar- gin loss for deep face recognition.IEEE Transactions on Pat- tern Analysis and Machine Intelligence , 44(10):5962–5979, Oct","venue":null,"work_id":"e95ccfce-82c6-4ad2-a61f-82fd065ec927","year":2022},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.353183Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:18c5db3044a2856ecdc13cfa56efef4df4bd781c81c45ef68a8149ee23111a64","observation_id":"b7443782-1c9d-41fc-9f47-d86d54d803e6","resolution":{"observed_at":"2026-08-10T20:42:43.388815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.367887Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"e18515cf-1e2e-4b60-b85d-35c07c6df5ad","year":2021},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.358038Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:cc19a6621537886533b77c983233466c2998ae5c09bc514db74fb62b3707a050","observation_id":"f9f198f0-9bfe-49a6-838d-9fbec773adfa","resolution":{"observed_at":"2026-08-10T20:42:43.372912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.351310Z","title":"Make-a-scene: Scene- based text-to-image generation with&nbsp;human priors","venue":null,"work_id":"e415f349-b75c-475c-a9c3-10c9e7e71f95","year":2022},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.363231Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:110373a1e9ac50ff972c0a37ca41cd0f066b5eaa271a065301b2eaef67939ab6","observation_id":"dbc6ca55-ef02-4e5c-8438-4658b6843513","resolution":{"observed_at":"2026-08-10T20:42:43.356772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.335652Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":"00a0a987-01ce-4263-aa31-b913321968c5","year":2022},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.368112Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:e71f912b5eb5e8a13d44e5ecbae6808b552da7287a07e044e00b1acad0456bdc","observation_id":"69d044f8-2976-40b6-a74a-3af76f19ff5c","resolution":{"observed_at":"2026-08-10T20:42:43.340750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.318771Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":"a010c3a3-b2b3-419e-89cb-3bbc8974942a","year":2021},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.373470Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:c702b2ee0596fe32f1d6f0b4873fdb337efb2b24b044a91ed38c4b5e810b847f","observation_id":"997de27a-11c5-485c-a9db-85325419be48","resolution":{"observed_at":"2026-08-10T20:42:43.324421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.301001Z","title":"Tokenflow: Consistent diffusion features for consistent video editing","venue":null,"work_id":"f207c6bd-0bd4-4afb-900b-f9f7eb6fd3ec","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.378368Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:ee186b0c803ee275081e6c2ed6d84191127f633e1f5c650488e9add8dd692b3a","observation_id":"fd78c4ca-f0f3-4673-9293-00730cab0e72","resolution":{"observed_at":"2026-08-10T20:42:43.307432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.281879Z","title":"Conditional generation from pre-trained diffusion models using denoiser representations","venue":null,"work_id":"ac07b615-abc7-417c-bf44-c93d5464b75f","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.383132Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:f7843c6902b05e1cee47e3779e5edb335daa0dd22fec22e8c299554889003bb8","observation_id":"a7a33b02-5726-475b-8e5e-05903aab18a5","resolution":{"observed_at":"2026-08-10T20:42:43.287803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.265611Z","title":"Image process- ing using multi-code gan prior","venue":null,"work_id":"1b797066-00b6-4311-8bbd-1c64abece664","year":2020},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.388007Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:b1cccea36ef7443c0da4d445522024004c4e8542224b79cb7dba5d9d6207837f","observation_id":"fe7845df-38b8-414b-a7ef-298493cefd21","resolution":{"observed_at":"2026-08-10T20:42:43.270774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.249205Z","title":"Prompt-to-prompt image editing with cross attention control","venue":null,"work_id":"a03a5cd9-9c24-45be-acaf-02d31996e4d7","year":2022},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.393195Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:61b7fea9367071292cc9d320e999534dbe7cde5938ee94489748aa008d100855","observation_id":"f6e25d3b-35c4-4ece-9271-91e6b34a8bd3","resolution":{"observed_at":"2026-08-10T20:42:43.254302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.232042Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"132cac69-4686-42bd-9ecd-5c6e1ad93ffa","year":2020},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.398028Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:71d369b88dd9ddfb6e5990616860ca9834f4ae9ad1beb45b62a97088db6a63b4","observation_id":"493ff6a4-6f42-4d87-926f-18557bc2d0cf","resolution":{"observed_at":"2026-08-10T20:42:43.237371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.215240Z","title":"Classifier-free diffusion guidance, 2022","venue":null,"work_id":"aa23470c-eccc-421d-8e74-f573d922ce55","year":2022},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.403117Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:436119c58e79778114d739fc15c272508bc2f87f871cb4ce8774b5a735197440","observation_id":"6ce896b9-a40d-47de-84d4-8f415486776e","resolution":{"observed_at":"2026-08-10T20:42:43.220840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.197692Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"4288b8a4-2298-42f7-a025-616dd4a5168f","year":2022},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.408183Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:2709aa3bdd12f6a792e90c69ba31f2c63477e43f55927b891709cf8d4690bce7","observation_id":"910ec066-2e7c-4cbb-9d02-0001106f4fb9","resolution":{"observed_at":"2026-08-10T20:42:43.203090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.179331Z","title":"Text2scene: Text-driven indoor scene stylization with part- aware details","venue":null,"work_id":"c34334d6-e937-4d1b-9626-cba78ba09970","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.413701Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:57b733c36818ca8292e857b34a9bbd441706bd754a0bb2ab529d40a14e223833","observation_id":"b1aa6fef-4c5b-4d5c-9c5b-c672a639c917","resolution":{"observed_at":"2026-08-10T20:42:43.185656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.161102Z","title":"Spatial transformer networks","venue":null,"work_id":"3d5c821a-2af1-4638-94b1-4e0d3e24910e","year":2015},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.418693Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:76b121772eea135b6ddf227168022cd22ef4c21f38cab0876a6c4b19d26bdaa9","observation_id":"5d353d00-53be-4772-a629-42603391bd3e","resolution":{"observed_at":"2026-08-10T20:42:43.167279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.142573Z","title":"Identity-aware and shape-aware propagation of face editing in videos","venue":null,"work_id":"a1890e25-6823-4133-af8b-870c1a43d2ac","year":2024},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.424843Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:df92b71b63a9115244d9895b73a8b4156922d1ac1b43c23d5b0469b8982f6757","observation_id":"527d216d-0392-44d5-8c43-34e41846e934","resolution":{"observed_at":"2026-08-10T20:42:43.147765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.125850Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":"2be3fabd-0ea4-4d2d-a6f3-cd7cdbbb5dd3","year":2019},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.429979Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:f465251f064e30d873a3970a18f2310b78e401094397093fc920a26a4d773f04","observation_id":"69d9a7c6-b79e-4f04-9540-d2f8edcbcde2","resolution":{"observed_at":"2026-08-10T20:42:43.131146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.108554Z","title":"Text2video-zero: Text- to-image diffusion models are zero-shot video generators","venue":null,"work_id":"1260d224-6947-483e-bd2d-4a2030d869d9","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.435093Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:02c6e77e304fe2ba6f914d7a2895ca43f7d34376c837d933c427de7afb342263","observation_id":"6953d3b9-ebbe-4613-be27-282016eca206","resolution":{"observed_at":"2026-08-10T20:42:43.113781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.092070Z","title":"Diffusion video autoencoders: Toward temporally consistent face video editing via disen- tangled video encoding","venue":null,"work_id":"78820d5d-a9d2-4ccb-bf9a-db842c045cee","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.440249Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:4703afbaab099e31ba148594259acf0fa686f1ccc1cdf7026494c4ca6e9125ea","observation_id":"b6737c0c-2200-40de-84d1-483b85ba940b","resolution":{"observed_at":"2026-08-10T20:42:43.097338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.075588Z","title":"Maskgan: Towards diverse and interactive facial image ma- nipulation","venue":null,"work_id":"e7403b63-d5e4-48cb-a3d5-3f544e66aee1","year":2020},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.445663Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:bd70e96f3f69e013176ea82186391d4b066049d12e04b1bf28f9a262f6645272","observation_id":"636846b3-a708-4772-9273-b29a62225b8d","resolution":{"observed_at":"2026-08-10T20:42:43.080799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.451286Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.451286Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:a4edb9efbfcbde11ff3cc43706fd19361f90e3e5c71a95b82fb5b7b4c8bc5068","observation_id":"2177148a-8d37-4214-aa43-e80179e84f84","resolution":{"observed_at":"2026-08-10T20:42:42.451286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.047844Z","title":"Deep learning face attributes in the wild","venue":null,"work_id":"2c8d14ca-7d17-4fc2-96be-c92d97dbd4a7","year":2015},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.456656Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:3207594ca799d58157ccceeaea6e0bb59597f79d216f38cf051254ecaa7d18c3","observation_id":"74eae308-ab3e-4a68-82f6-980ba390c423","resolution":{"observed_at":"2026-08-10T20:42:43.053540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.030020Z","title":"Dpm-solver: a fast ode solver for diffu- sion probabilistic model sampling in around 10 steps","venue":null,"work_id":"29197a77-00f4-4bd3-ad77-7d6d95519cd1","year":2024},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.461668Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:b67560c777d331d8f1800990f6332577113379a0522a2c13bd5edf6ff6765501","observation_id":"74cae4e5-0e67-481a-bbb3-77ad08a3b91a","resolution":{"observed_at":"2026-08-10T20:42:43.036190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:43.013438Z","title":"Introduction to Information Retrieval","venue":null,"work_id":"bb4c43d3-81be-4ac7-a616-e33238f3adf6","year":2008},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.466714Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:644ba586e7e5853676631bf3e064c48b09324e8f295aa453f621b1e588d04c0e","observation_id":"2c9c8294-3a20-4183-8b7c-1c529839655e","resolution":{"observed_at":"2026-08-10T20:42:43.018494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.996675Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equa- tions","venue":null,"work_id":"dac791b3-2a80-4e4e-b129-ae941d508489","year":2021},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.471518Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:2abaa6b539162d117d636094b83a3ad226a49ac3e7be5482c2bdc6f5070090d5","observation_id":"eeb46c23-50a3-41c3-850f-63c713e53c0c","resolution":{"observed_at":"2026-08-10T20:42:43.001986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01329","last_updated":"2023-02-02T18:58:58Z","snapshot_observed_at":"2026-08-16T15:58:06.886842Z","submitted_at":"2023-02-02T18:58:58Z","title":"Dreamix: Video Diffusion Models are General Video Editors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01329","snapshot_observed_at":"2026-08-10T20:42:42.476641Z","title":"Dreamix: Video diffusion models are general video editors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.476641Z"},"links":{"cited_paper":"/paper/2302.01329","citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:ba305bb76b41b99ba4d2172edadb4476695be1d4ac1dee29762c8032f586e215","observation_id":"0d8dc733-4d04-40a5-bb99-b84c14e84983","resolution":{"observed_at":"2026-08-10T20:42:42.476641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.482409Z","title":"Parkhi, Andrea Vedaldi, and Andrew Zisserman","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.482409Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:bd08807843aa0df9f96765082c7993b98dbede3a671a13f54da4f6cae380d740","observation_id":"94e11916-6dc7-45de-a32b-5a3522689b30","resolution":{"observed_at":"2026-08-10T20:42:42.482409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.968168Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"54bfd291-504d-453c-b286-90bca14002ad","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.488155Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:6ecd0aebd6411e014e08024337209b334584889a70e37ac324ee705946194964","observation_id":"4600ddc8-b6f6-449c-a5dd-7f3eb59eb8f0","resolution":{"observed_at":"2026-08-10T20:42:42.973496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.951494Z","title":"Fatezero: Fus- ing attentions for zero-shot text-based video editing","venue":null,"work_id":"1ed4a10c-e244-4309-87d6-1b0a6368545f","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.493242Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:8bd0917dc5ad0d59f703ebd5e7efcbde046c5c5dd066c91932a287961e4754fe","observation_id":"c4537355-1d79-4ab3-939f-f16dc8ada6f5","resolution":{"observed_at":"2026-08-10T20:42:42.956874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-10T20:42:42.499035Z","title":"Hierarchical text-conditional image gen- eration with clip latents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.499035Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:85da0ae4930fb86f80f5396b9a2b84f43f1bd594514b2bc24b8fcf27ddce9594","observation_id":"b992065a-29af-4acb-bb45-fe31bf8f5fa7","resolution":{"observed_at":"2026-08-10T20:42:42.499035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.505261Z","title":"Blattmann, Dominik Lorenz, Patrick Esser, and Bj ¨orn Ommer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.505261Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:06880be1cdf9df60693c2be8beee6775dd15ef497fdaa6880dc2b436c3b4a39c","observation_id":"07590090-09f6-410b-b9ae-0173585462bd","resolution":{"observed_at":"2026-08-10T20:42:42.505261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.921613Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"382590c4-d8ea-40e7-8e7b-e5031586b096","year":2015},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.510122Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:822b6e649f09c6b9bace0bae4f2e6d2b137cac00810b9da1f80b8341991bee45","observation_id":"235bf3fe-ac1c-4bf2-96cf-b463e011e646","resolution":{"observed_at":"2026-08-10T20:42:42.927438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.904512Z","title":"Sara Mahdavi, Raphael Gontijo-Lopes, Tim Salimans, Jonathan Ho, David J Fleet, and Mohammad Norouzi","venue":null,"work_id":"687375a6-c1b2-4c57-b1d4-7672b8ec8af9","year":2024},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.515026Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:de26a06224384b1cc945f770a1885622e8c18d5d90eb77cb062e7eb46a0fba91","observation_id":"29d3ea83-00f5-4530-bf24-81cf9910285d","resolution":{"observed_at":"2026-08-10T20:42:42.910187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.887604Z","title":"Facenet: A unified embedding for face recognition and clus- tering","venue":null,"work_id":"8371738b-d07c-42b4-b7de-ec58e3d9d360","year":2015},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.519965Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:ed78c47bd7a38d5eb7b3cca8d07f159ee69fcc1ce958854f3dec993b4213821c","observation_id":"bbac8cfd-e81c-41d5-9a5a-ead1118d222d","resolution":{"observed_at":"2026-08-10T20:42:42.893099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.870777Z","title":"Laion-5b: an open large-scale dataset for training next generation image-text models","venue":null,"work_id":"6f8f52f7-9413-4e23-925b-12f2ac9214e9","year":2024},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.525020Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:027b51f48216bee29f70b53c3f6405ffbe211db8ad6efb1f85bc98183fdad2d9","observation_id":"0719c823-20de-41e9-b2e5-23e6180fc191","resolution":{"observed_at":"2026-08-10T20:42:42.876078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.855012Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":"c6fed40c-cf14-44fd-9409-94ae86e2fa12","year":2020},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.530364Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:9e4ce59951bff85c2ebf4efd92b0352ff86f793e2c2ea96fb6662a32b3b8967a","observation_id":"22d0d308-7a9a-4b00-bc20-108b72f8b236","resolution":{"observed_at":"2026-08-10T20:42:42.860090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.838406Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":"206ce4fe-bd19-467a-9a19-e78f6364082e","year":2020},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.535183Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:734cdbea0404a2e3ddabcdcf66f9571a2784d9d91074adb7cc09fd361a464c09","observation_id":"5249e610-9abf-4c63-8810-c11407b8bc22","resolution":{"observed_at":"2026-08-10T20:42:42.843770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.820981Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"beacce3c-a29f-4430-a804-3f8a30c81834","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.540360Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:7e59ca3af1c14a8f3396c20d969809b9368227ca53895996bf5913942e6c678b","observation_id":"35786248-8cfb-4618-bf77-a8df8fe9d3ca","resolution":{"observed_at":"2026-08-10T20:42:42.827031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.804748Z","title":"Stitch it in time: Gan-based facial editing of real videos","venue":null,"work_id":"3d6bb504-091d-4004-b7fa-9520f346a630","year":2022},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.545154Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:27a7b54559654a3dbf525abdafcfd2080e7407e377b03ff8143b9dc1d3fe305d","observation_id":"4096dab2-1f9c-4ed9-bb41-800e6630fd75","resolution":{"observed_at":"2026-08-10T20:42:42.809669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.788045Z","title":"The trec-8 question answering track re- port","venue":null,"work_id":"805384dd-aa31-471e-9ae7-316ed7c7f4fb","year":1999},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.550148Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:e1ceb7d93f52b82b74e23cb666b9ea4f4e047ba59f8d6a9747329b3a8c30a68b","observation_id":"5c9c449e-41a6-4272-8841-9c7494e9c5ac","resolution":{"observed_at":"2026-08-10T20:42:42.793428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.770197Z","title":"Wang, Yitong Wang, Zheng Zhou, Xing Ji, Zhifeng Li, Dihong Gong, Jin Zhou, and Wei Liu","venue":null,"work_id":"e69ad338-b746-4e37-9aae-e9be1649a833","year":2018},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.555354Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:0da0076a82752b861c860269455a3e03acaee8abea51d243d23948be0e8c7985","observation_id":"ebb84dbd-66c6-4883-98a4-ca0897a0fe2e","resolution":{"observed_at":"2026-08-10T20:42:42.775989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.752538Z","title":"Tune-a-video: One-shot tuning of im- age diffusion models for text-to-video generation","venue":null,"work_id":"9d551860-b1c5-4ca8-9c10-522eadf21da1","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.560422Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:b9d50bd8721ba142ee8612c496f4795cc0c9369de3df9c05c5e7ac68813e3d66","observation_id":"0ae44a0a-e4c6-4f14-a637-b08f4efec777","resolution":{"observed_at":"2026-08-10T20:42:42.757767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.735753Z","title":"Tedigan: Text-guided diverse face image generation and ma- nipulation","venue":null,"work_id":"0f4cc823-73e6-4617-8ff5-a80014dbb7ca","year":2021},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.565438Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:df1eca5ed3b945bed8d0baf22cc5ee332d76719764522e87550847eb930c581f","observation_id":"839c442f-353a-458f-9ba8-5d71e67eb41b","resolution":{"observed_at":"2026-08-10T20:42:42.741073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.719083Z","title":"Wong, and Ping Luo","venue":null,"work_id":"2af5b70b-26b2-43d4-9421-6e07f39492d1","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.570300Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:abaa213226c3a398c329360b374ed265e35b9457372bed2496c557d604dac236","observation_id":"83816ad6-60df-422b-9244-b2a5df62f662","resolution":{"observed_at":"2026-08-10T20:42:42.724376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.702753Z","title":"A latent transformer for disentangled face editing in im- ages and videos","venue":null,"work_id":"00dd1575-9b08-4af6-bca2-0d70e388203e","year":2021},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.575094Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:8c068730e61d7c4251b8c2cfef5470222242f62d125561d465231a2fff816547","observation_id":"c9509112-e4ba-4a6d-a462-77638240f3fc","resolution":{"observed_at":"2026-08-10T20:42:42.707871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02616","last_updated":"2024-01-05T03:23:38Z","snapshot_observed_at":"2026-08-16T14:29:43.464011Z","submitted_at":"2024-01-05T03:23:38Z","title":"FED-NeRF: Achieve High 3D Consistency and Temporal Coherence for Face Video Editing on Dynamic NeRF","version":1},"cited_work":{"arxiv_id":"2401.02616","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02616","snapshot_observed_at":"2026-08-10T20:42:42.626523Z","title":"FED-NeRF: Achieve High 3D Consistency and Temporal Coherence for Face Video Editing on Dynamic NeRF","venue":"cs.CV","work_id":"d56924c2-974b-48d9-b6fe-aa86f307e967","year":2024},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.580413Z"},"links":{"cited_paper":"/paper/2401.02616","citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:5189e57471ee5223b51458de3e8e0a0d319ea54d57925c38dd4c13c32458c4f6","observation_id":"37f8d794-a005-42c9-9161-26d0345cd6c2","resolution":{"observed_at":"2026-08-10T20:42:42.634392Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:42:42.685532Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"6b9b8716-573c-4091-8cc3-086b0024cd6a","year":2023},"citing_paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:42.586028Z"},"links":{"citing_paper":"/paper/2501.07530"},"observation_digest":"sha256:b664254701bfb118a3142cc8cf9ac9b77f8cecc33b24d28ec5c0314da29638cd","observation_id":"3d7d7046-8bf6-475e-b87e-e4e7b793bc90","resolution":{"observed_at":"2026-08-10T20:42:42.690921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.07530","last_updated":"2025-01-13T18:08:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T13:51:23.990355Z","submitted_at":"2025-01-13T18:08:27Z","title":"IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":47},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2501.07530."}