{"as_of":"2026-08-08T18:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bbcc61e222f5c5630f6d6eb757dade743612a6d90c8c227abc76c205e9597f94","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T04:54:58.686040Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05648/citation-record","integrity":"/paper/2608.05648/integrity","json":"/paper/2608.05648/citation-record.json","paper":"/paper/2608.05648"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.01392","last_updated":"2024-12-10T01:32:23Z","snapshot_observed_at":"2026-08-06T12:36:01.385451Z","submitted_at":"2024-07-01T15:43:25Z","title":"Diffusion Forcing: Next-token Prediction Meets Full-Sequence Diffusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01392","snapshot_observed_at":"2026-08-08T04:54:58.639683Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffusion.arXiv preprint arXiv:2407.01392, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.639683Z"},"links":{"cited_paper":"/paper/2407.01392","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:c677bef2de54c4731ab30f6569c499a33c53d32ee5f99134739b8c01d97f522c","observation_id":"14876000-a03e-4650-b884-99611cdddd6e","resolution":{"observed_at":"2026-08-08T04:54:58.639683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09113","last_updated":"2025-06-28T11:58:23Z","snapshot_observed_at":"2026-08-01T16:09:18.068564Z","submitted_at":"2025-06-10T17:56:11Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09113","snapshot_observed_at":"2026-08-08T04:54:58.647292Z","title":"Seedance 1.0: Exploring the boundaries of video generation models.arXiv preprint arXiv:2506.09113,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.647292Z"},"links":{"cited_paper":"/paper/2506.09113","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:6c018e29a91071e0f9f9339268c171cd1224c0461cc28fe6f45b582d5fc659f9","observation_id":"694d1c61-ed22-4361-b70e-37d4d2dc49a7","resolution":{"observed_at":"2026-08-08T04:54:58.647292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03233","last_updated":"2026-01-06T18:24:41Z","snapshot_observed_at":"2026-07-06T22:40:51.136169Z","submitted_at":"2026-01-06T18:24:41Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03233","snapshot_observed_at":"2026-08-08T04:54:58.650815Z","title":"Ltx-2: Efficient joint audio-visual foundation model.arXiv preprint arXiv:2601.03233,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.650815Z"},"links":{"cited_paper":"/paper/2601.03233","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:693c8c61367c26fbd02c5c7662aeefadbbcc6d74b9881a65652d50a68d62f93f","observation_id":"d25c41a4-1df8-4587-af7b-1bf1dcea5886","resolution":{"observed_at":"2026-08-08T04:54:58.650815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-08T04:54:58.658009Z","title":"Self forcing: Bridging the train- test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.658009Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:e37d39b62406970ebada2b76f0107eaf8a8040ea18f5ad5890b9a0059f4a40dd","observation_id":"f6fa9955-a18d-487f-8b09-5d0b3c84cff8","resolution":{"observed_at":"2026-08-08T04:54:58.658009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-08T04:54:58.661523Z","title":"Anyv2v: A tuning-free framework for any video-to-video editing tasks.arXiv preprint arXiv:2403.14468,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.661523Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:cc0f2dc60a20631215dfcf9f791f1f77bec2fe9dd7680bdc3042f3df73dc5c37","observation_id":"91ea9fcc-b054-465a-9e74-1cafd7393850","resolution":{"observed_at":"2026-08-08T04:54:58.661523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.22940","last_updated":"2026-05-19T15:28:34Z","snapshot_observed_at":"2026-08-02T05:15:20.627790Z","submitted_at":"2025-11-28T07:30:10Z","title":"One-to-All Animation: Alignment-Free Character Animation and Image Pose Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.22940","snapshot_observed_at":"2026-08-08T04:54:58.667551Z","title":"One-to-all animation: Alignment-free character animation and image pose transfer.arXiv preprint arXiv:2511.22940,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.667551Z"},"links":{"cited_paper":"/paper/2511.22940","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:fbac1ae0c24f8038e664d80d121328362338c7b84695db8da698e83e9eb75665","observation_id":"9438765d-d80d-42f6-bb78-657360bcfe7b","resolution":{"observed_at":"2026-08-08T04:54:58.667551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-08T04:54:58.670639Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.670639Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:8a323ad8fcb0c3341a40f1d1e3cfe687a0c4e87c8de558007767840e7ddc029b","observation_id":"99330b26-b962-428f-9d6e-ed4b9a17c12a","resolution":{"observed_at":"2026-08-08T04:54:58.670639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:54:58.677211Z","title":"Unianimate-dit: Human image animation with large-scale video diffusion transformer.arXiv preprint arXiv:2504.11289,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.677211Z"},"links":{"citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:a5e12f1e2f050f1556af9f6eeb57d58b479f32d61adae40051ada8209000dc97","observation_id":"75a0b93e-7885-4c3b-be6b-3beb7251ee16","resolution":{"observed_at":"2026-08-08T04:54:58.677211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.10804","last_updated":"2026-08-05T01:57:13Z","snapshot_observed_at":"2026-08-08T18:10:18.434573Z","submitted_at":"2026-06-09T12:49:34Z","title":"SCAIL-2: Unifying Controlled Character Animation with End-to-End In-Context Conditioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.10804","snapshot_observed_at":"2026-08-08T04:54:58.680041Z","title":"Scail-2: Unifying controlled character animation with end-to-end in-context conditioning.arXiv preprint arXiv:2606.10804, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.680041Z"},"links":{"cited_paper":"/paper/2606.10804","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:61db832f8575715f0431aa7d6ec4a11babcb256274dcb207c3dd86ffdcb67a15","observation_id":"f01d21ae-a35f-41aa-a0cd-21ca06c4ba1f","resolution":{"observed_at":"2026-08-08T04:54:58.680041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19320","last_updated":"2026-05-18T02:38:41Z","snapshot_observed_at":"2026-08-02T10:22:49.004993Z","submitted_at":"2025-11-24T17:15:55Z","title":"SteadyDancer: Harmonized and Coherent Human Image Animation with First-Frame Preservation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19320","snapshot_observed_at":"2026-08-08T04:54:58.683114Z","title":"Steadydancer: Harmonized and coherent human image animation with first-frame preservation.arXiv preprint arXiv:2511.19320,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.683114Z"},"links":{"cited_paper":"/paper/2511.19320","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:ebcd0021feced25b1e2e534412ef3b37fce8ed3385af1cf9927ef154be687271","observation_id":"5bc91c86-05b6-4636-90b4-a3ee629a747e","resolution":{"observed_at":"2026-08-08T04:54:58.683114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12389","last_updated":"2025-01-21T18:59:31Z","snapshot_observed_at":"2026-07-06T20:24:03.105038Z","submitted_at":"2025-01-21T18:59:31Z","title":"Taming Teacher Forcing for Masked Autoregressive Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12389","snapshot_observed_at":"2026-08-08T04:54:58.686040Z","title":"Ni, and Heung-Yeung Shum","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.686040Z"},"links":{"cited_paper":"/paper/2501.12389","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:1078bc886f71223a3ae4f6a4a9d12730b9a2411dd44ae982e8c45c01b59a4cee","observation_id":"ea3bcdc1-ed91-4ee5-aa03-278c26125255","resolution":{"observed_at":"2026-08-08T04:54:58.686040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:54:58.664692Z","title":"Dreamactor-m2: Universal character image animation via spatiotemporal in-context learning.arXiv preprint arXiv:2601.21716,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.664692Z"},"links":{"citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:8f43aa8a19d65743226e79974cfcb423d98819e4139ef9b9440312fad3def39f","observation_id":"9eb543e8-d88d-4823-bb44-91125cb2dd70","resolution":{"observed_at":"2026-08-08T04:54:58.664692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-08T04:54:58.673754Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.673754Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:37ac3b78b5c0a092786c14662bd5ce6876eb4d25ff9d11e63df88b6b2c23449a","observation_id":"e7b16efa-ece7-4586-a970-745ac168715d","resolution":{"observed_at":"2026-08-08T04:54:58.673754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00830","last_updated":"2025-06-01T04:27:13Z","snapshot_observed_at":"2026-08-07T20:51:49.766697Z","submitted_at":"2025-06-01T04:27:13Z","title":"SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00830","snapshot_observed_at":"2026-08-08T04:54:58.643717Z","title":"Skyreels-audio: Omni audio-conditioned talking portraits in video diffusion transformers.arXiv preprint arXiv:2506.00830,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.643717Z"},"links":{"cited_paper":"/paper/2506.00830","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:5d39efc32d82892d82de5e05b83ba3e837a6c507fdc815ffbe06267b7ac20bd7","observation_id":"74bb284c-54b8-47aa-99d2-c80300e66aec","resolution":{"observed_at":"2026-08-08T04:54:58.643717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-08T15:15:48.227139Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04512","snapshot_observed_at":"2026-08-08T04:54:58.654243Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.654243Z"},"links":{"cited_paper":"/paper/2505.04512","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:0ea4156814d6ebd3ae97f7f48915f0a3b78233d31b5474085ef8741e495d1588","observation_id":"7b68b13c-0de6-45ee-807e-dc1472fd2363","resolution":{"observed_at":"2026-08-08T04:54:58.654243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T18:15:49.267923Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2608.05648."}