{"as_of":"2026-08-08T15:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a6636468aa85c8599fa6d61b29c99706156bf135292b8288121d8da20761a508","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:30:04.553334Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17985/citation-record","integrity":"/paper/2607.17985/integrity","json":"/paper/2607.17985/citation-record.json","paper":"/paper/2607.17985"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-01T16:30:00.429471Z","title":"Blattmann, Tim Dockhorn, Sumith Kulal, Daniel Mendelevitch, Maciej Kilian, and Dominik Lorenz","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.429471Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:b5fee0905ed1439c748e9592e42077059c89386662ae147998d41751c3941090","observation_id":"62c2ad04-0d31-48f4-9872-71f78fa01e0e","resolution":{"observed_at":"2026-08-01T16:30:00.429471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:00.458702Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.458702Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:e3c1afc47cb6affd8b10049b05ac1522f1a0edac55f1df42dc2034355d1a1892","observation_id":"1e104759-3959-497d-b6e0-ba8b7fc1b8e5","resolution":{"observed_at":"2026-08-01T16:30:00.458702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02436","last_updated":"2025-04-03T09:50:50Z","snapshot_observed_at":"2026-08-07T16:12:03.138083Z","submitted_at":"2025-04-03T09:50:50Z","title":"SkyReels-A2: Compose Anything in Video Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02436","snapshot_observed_at":"2026-08-01T16:30:00.510556Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.510556Z"},"links":{"cited_paper":"/paper/2504.02436","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:6685f75d9497d5f5d53479687e5e3d27a92f9786cc1bd0c072ee126b019acef3","observation_id":"78d4f218-73d2-4042-bb9a-9381a80e5282","resolution":{"observed_at":"2026-08-01T16:30:00.510556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:00.570190Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.570190Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:b239ade2fe55ff21abcc5c6f7b9ae63a216ec1ece226d9e7cbef5c7a6c6f6396","observation_id":"692d5f19-cbb4-448c-ab76-7a842c9e7242","resolution":{"observed_at":"2026-08-01T16:30:00.570190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03233","last_updated":"2026-01-06T18:24:41Z","snapshot_observed_at":"2026-07-06T22:40:51.136169Z","submitted_at":"2026-01-06T18:24:41Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03233","snapshot_observed_at":"2026-08-01T16:30:00.642094Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.642094Z"},"links":{"cited_paper":"/paper/2601.03233","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:52d85566383e0d7b6d8bc03f8e729e72e06f25534005cca1424b7a3ff1871822","observation_id":"48d1ccee-a491-44e1-9614-3f43aff0d163","resolution":{"observed_at":"2026-08-01T16:30:00.642094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:00.753393Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.753393Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:5c96048d4dde450bd931477ed75e8934119754b020b36b1d56767407f9d1e47a","observation_id":"33604e0c-5e7e-403e-8167-433a2f741184","resolution":{"observed_at":"2026-08-01T16:30:00.753393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15275","last_updated":"2024-06-25T16:57:27Z","snapshot_observed_at":"2026-07-06T18:04:33.726854Z","submitted_at":"2024-04-23T17:59:43Z","title":"ID-Animator: Zero-Shot Identity-Preserving Human Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15275","snapshot_observed_at":"2026-08-01T16:30:00.853862Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.853862Z"},"links":{"cited_paper":"/paper/2404.15275","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:b653f9198e1c178ada6da43cb747cb128610211379f23571d8801d1f7e808f63","observation_id":"fcbc52fa-fe1e-4f81-b417-bd20cd291dba","resolution":{"observed_at":"2026-08-01T16:30:00.853862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-01T16:30:00.947807Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.947807Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:332772c335e9313cb5fdaafc06689b57eb8b3c90e5c2b528c653cbf12de808ff","observation_id":"4363859b-038d-4234-a026-37895a06a231","resolution":{"observed_at":"2026-08-01T16:30:00.947807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.030597Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.030597Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:92c2b927851cd3e92a17f1ae7c889722899739a21f69da9a461d8856650c5f12","observation_id":"aaaafe40-a2ec-47ca-894b-49bc6ba74b91","resolution":{"observed_at":"2026-08-01T16:30:01.030597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.108811Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.108811Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:d782847093959ef9b7c4e885c64c027b3f2a79deaf3cccf7dc3e9112bd6b0165","observation_id":"3205ed26-bd19-4a6c-8447-70f85fa45cf8","resolution":{"observed_at":"2026-08-01T16:30:01.108811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-07T15:49:08.614735Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04512","snapshot_observed_at":"2026-08-01T16:30:01.157173Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.157173Z"},"links":{"cited_paper":"/paper/2505.04512","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:973765734931645e9e68e4bc46bb8ba6dcb82a50f88b4afb81d4490db93c9095","observation_id":"63374138-3231-45c3-9427-fbcf3959b7d1","resolution":{"observed_at":"2026-08-01T16:30:01.157173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.212680Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.212680Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:58a6d6b72acf978bebc82e1cae384e704ec7fc5835b28b32c9633066c9c4ce97","observation_id":"09d71504-c4d6-4c7b-a13a-6dc963a3bf6f","resolution":{"observed_at":"2026-08-01T16:30:01.212680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.300612Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.300612Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:3d0dfb4caa6f3ae2e75d6fbf73606078da4191ec9627e1bea4103d59247730d9","observation_id":"697bf589-f47c-4cfa-89b0-8a8c7b8cdd4b","resolution":{"observed_at":"2026-08-01T16:30:01.300612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18664","last_updated":"2024-11-27T15:59:48Z","snapshot_observed_at":"2026-08-02T00:08:30.121502Z","submitted_at":"2024-11-27T15:59:48Z","title":"Spatiotemporal Skip Guidance for Enhanced Video Diffusion Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18664","snapshot_observed_at":"2026-08-01T16:30:01.410540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.410540Z"},"links":{"cited_paper":"/paper/2411.18664","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:cb7393262014e19cdb189c9f051574be824779a80559c237a00853dce1d27e9c","observation_id":"44926563-879f-4ec5-9ab8-35b9736413b3","resolution":{"observed_at":"2026-08-01T16:30:01.410540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.592084Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.592084Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:d2dbdf06e85c62b9883a7b72907ad9531c33d345cf520882c0e0ca2d175600ea","observation_id":"b8678673-6ceb-40a0-bc80-e830a302d51d","resolution":{"observed_at":"2026-08-01T16:30:01.592084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.855436Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.855436Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:dce2af9bf3fb96996f7abdc2f58c87463e8dd94a51b1be7ee6e4907cdc6872f4","observation_id":"b5c60c1d-9ff4-46a9-ab68-9b2626726cfb","resolution":{"observed_at":"2026-08-01T16:30:01.855436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.011707Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.011707Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:08e1753f8fb5480af3c966ddc8e702ef755044ccc6240b5de05049324a9d870e","observation_id":"60b17d2a-3e2f-4cb6-a7b1-48a2bca50daf","resolution":{"observed_at":"2026-08-01T16:30:02.011707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11079","last_updated":"2025-04-10T10:24:37Z","snapshot_observed_at":"2026-08-07T18:14:57.828140Z","submitted_at":"2025-02-16T11:02:50Z","title":"Phantom: Subject-consistent video generation via cross-modal alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11079","snapshot_observed_at":"2026-08-01T16:30:02.172800Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.172800Z"},"links":{"cited_paper":"/paper/2502.11079","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:a672fc47a4077a1fa0ac7d8f89cb6c0f4d65ceec2e31d5874019de322ba7024a","observation_id":"95c4ed9a-fded-45a9-8f3e-332d66048293","resolution":{"observed_at":"2026-08-01T16:30:02.172800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.279990Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.279990Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:9cba0812850a852e5d89a9fd829f21de45fae2a1c593b689bda4484349a25f0f","observation_id":"20599548-f0ad-4f56-8112-7477de1fc060","resolution":{"observed_at":"2026-08-01T16:30:02.279990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.414882Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.414882Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:6e628b29f284c350e12ffcd805d398ff030bc4e0a21bc39bd07a0c4bbad16167","observation_id":"432c8137-e1ec-4db4-810f-b94a983a9826","resolution":{"observed_at":"2026-08-01T16:30:02.414882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-01T16:30:02.524792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.524792Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:c06dd359bdd72a93a7ed1518943cc68f3573b7ea244d1841451d4cf2753b4719","observation_id":"46da6c95-c055-4615-8e89-39d88256335f","resolution":{"observed_at":"2026-08-01T16:30:02.524792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.637753Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.637753Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:af3d2987630c7f00afcc58f65fed37e553167fcb6c2c570109a5905f53e405d8","observation_id":"a3fe3430-f316-40ec-94a9-5dd286bf86e0","resolution":{"observed_at":"2026-08-01T16:30:02.637753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.766100Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.766100Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:f4f33cd40c19d2477a46c60fc6e164be42f636b71330b59c0b31debcd57f69f5","observation_id":"38424cb4-39d0-49d2-970e-cec544a10353","resolution":{"observed_at":"2026-08-01T16:30:02.766100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-01T16:30:02.915052Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.915052Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:51ca8c116a14c80a0e3600b26296eba5d3f84b7eaa04a5d905c5c678369cb70b","observation_id":"c51012ff-39c7-4e09-8270-b7c23790c11b","resolution":{"observed_at":"2026-08-01T16:30:02.915052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07519","last_updated":"2024-02-02T16:15:22Z","snapshot_observed_at":"2026-08-06T23:08:20.817133Z","submitted_at":"2024-01-15T07:50:18Z","title":"InstantID: Zero-shot Identity-Preserving Generation in Seconds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07519","snapshot_observed_at":"2026-08-01T16:30:03.029124Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.029124Z"},"links":{"cited_paper":"/paper/2401.07519","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:169eeb6eedfd4d7a03cb5ca0820639393d6eee8ea7f00560348ecd538dd61410","observation_id":"9ffa9875-30ed-4ce8-8806-d2d0fd10fc29","resolution":{"observed_at":"2026-08-01T16:30:03.029124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:03.142391Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.142391Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:68d7b6a993ed94385c4e279d2e44d1076e72f2f222efc64cb403825b4d010b92","observation_id":"71063fc1-03b5-485c-9aaa-1987537acbf5","resolution":{"observed_at":"2026-08-01T16:30:03.142391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:03.302371Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.302371Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:3742f98ad347e2b33241d1b58551ebf06702e833776c5a234e7fd7911ad546c0","observation_id":"19d622e7-2c87-45ad-9b42-7881c18895de","resolution":{"observed_at":"2026-08-01T16:30:03.302371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T16:30:03.466687Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.466687Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:11e36ffbef4f17d188b0382cf1c0f015fa540ac6a774f55e7daa5c9526cd0973","observation_id":"cd7b591c-86cf-4368-a3a3-bed8b3ddf4ff","resolution":{"observed_at":"2026-08-01T16:30:03.466687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-01T16:30:03.585565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.585565Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:7cd69f4d1079154519584e4a9cfed629df4aaf3408cbaf43aef8f98ccefae5fa","observation_id":"8390885e-8528-48cd-a290-9380c0237e21","resolution":{"observed_at":"2026-08-01T16:30:03.585565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-01T16:30:03.704291Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.704291Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:844d5feeaeaa3ec7e1c3c8a15b886140e12a733ad510cb7399fd2a23bb3eda98","observation_id":"c54403e0-d6a2-49bf-a8c8-713562b9674b","resolution":{"observed_at":"2026-08-01T16:30:03.704291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:03.779522Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.779522Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:06b6ce536083118c77606b17f7d622212df5cb976be2dba1865d1f5a93378b85","observation_id":"23c989a7-31be-4d9c-aa8f-7dd1e13e19ca","resolution":{"observed_at":"2026-08-01T16:30:03.779522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-03T19:47:26.577384Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.22699","snapshot_observed_at":"2026-08-01T16:30:03.927817Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.927817Z"},"links":{"cited_paper":"/paper/2511.22699","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:7ca021de64de4d18b888c513717f9ac6058a800248bbf5dc953a76dacc96ecf0","observation_id":"1921c729-8b41-4951-a22c-dcc4d34f5bbf","resolution":{"observed_at":"2026-08-01T16:30:03.927817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16855","last_updated":"2025-04-01T08:48:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-22T04:40:24Z","title":"GME: Improving Universal Multimodal Retrieval by Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16855","snapshot_observed_at":"2026-08-01T16:30:04.128293Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:04.128293Z"},"links":{"cited_paper":"/paper/2412.16855","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:724ce5e319f0a96302ef830cb99d0654d349b05f6f523b28dac681f905e8daf3","observation_id":"46cdcb53-b3d8-41b4-b2cd-1fa2bca5199d","resolution":{"observed_at":"2026-08-01T16:30:04.128293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13995","last_updated":"2025-02-19T06:50:27Z","snapshot_observed_at":"2026-08-07T18:06:33.363289Z","submitted_at":"2025-02-19T06:50:27Z","title":"FantasyID: Face Knowledge Enhanced ID-Preserving Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13995","snapshot_observed_at":"2026-08-01T16:30:04.250929Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:04.250929Z"},"links":{"cited_paper":"/paper/2502.13995","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:da47a3e3d6b4846ec276e294ebf43fcde87d97453ea955a2af400f7b4607a881","observation_id":"dc0b91e6-fa3c-4772-9ac4-29365237e992","resolution":{"observed_at":"2026-08-01T16:30:04.250929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-01T16:30:04.412387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:04.412387Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:d3ecd98ec707b059ae4696017e79806b9128050ecf9d1d66d8e42910a684c6ef","observation_id":"7d29063b-980b-41c3-aa6c-e2e477edfe10","resolution":{"observed_at":"2026-08-01T16:30:04.412387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14151","last_updated":"2025-07-02T11:55:35Z","snapshot_observed_at":"2026-08-07T16:55:11.462308Z","submitted_at":"2025-03-18T11:17:32Z","title":"Concat-ID: Towards Universal Identity-Preserving Video Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14151","snapshot_observed_at":"2026-08-01T16:30:04.553334Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:04.553334Z"},"links":{"cited_paper":"/paper/2503.14151","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:78205e4013340247549a651ccce9eaaf46dc04e329b60f323bd0daa72bc3aeef","observation_id":"3f81bf54-63c4-4c42-8e08-ccca8efde4db","resolution":{"observed_at":"2026-08-01T16:30:04.553334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-01T16:30:00.798434Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.798434Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:6708902a8e4b7212859f3ced4c2d51b89922ef5d0360e100bbb20e387486276f","observation_id":"70bee08d-2902-4e5e-939f-eb6aaec530e9","resolution":{"observed_at":"2026-08-01T16:30:00.798434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-08-01T16:30:01.743389Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.743389Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:bc067c0c3ea7e7c761bbc8a3aa613f7da33bd53a17ce7097bcb766c0d52027f0","observation_id":"ba7228ea-e629-4140-99db-114b9735c5c2","resolution":{"observed_at":"2026-08-01T16:30:01.743389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T17:34:45.129558Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2607.17985."}