{"as_of":"2026-08-12T21:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c44f6777e678fb6216c3184acc68504886a67a33cc31b23d4f9af15a09441d26","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T18:19:46.024756Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2601.01955/citation-record","integrity":"/paper/2601.01955/integrity","json":"/paper/2601.01955/citation-record.json","paper":"/paper/2601.01955"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lumiere: A space-time diffusion model for video generation","venue":null,"work_id":"c92f5328-235b-44cb-8a34-6bbe0b80d4a8","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:8b72817503e09223a86a59e7f21e40959d08179c356005ecc5654887e7ee673c","observation_id":"0d94300a-e6e6-42ec-9a90-cf6aa7f92fe5","resolution":{"observed_at":"2026-05-16T18:21:09.603402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:71902b96e82839f772ec1ca78fac87d62aa93475f9c1caa1c4377c748abc499d","observation_id":"8d23dacf-9c0b-4b16-bdfd-de38c37e1868","resolution":{"observed_at":"2026-05-16T18:21:09.355785Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":"9f089de7-b6d6-49ff-977a-a087c33fe2e3","year":2023},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:4e5f2cae72a01a47458685e86dcd96466238bae92c1cf0f57f15c0114d6c5f9e","observation_id":"fe8e065c-343d-43c7-bf1a-9518b5195fcf","resolution":{"observed_at":"2026-05-16T18:21:09.585670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Goku: Flow based video generative foundation models","venue":null,"work_id":"7276098d-b867-449e-884e-b9b93ac4bb5f","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:d575936cb65d1ac7ee4823c5d9b902c0bb07d9570fed505d497d9dd7afcff48a","observation_id":"0a0342c8-85bd-450c-a3d0-956ce1871225","resolution":{"observed_at":"2026-05-16T18:21:09.618821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memflow: Optical flow esti- mation and prediction with memory","venue":null,"work_id":"c122137b-d414-4b41-b4fc-b0bee2411a31","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:3660053ea4f388ffa44d47e4b7c6744fde2b0e44e5d11c894050fc99bd22eeb6","observation_id":"9963cec7-b478-4aeb-8f10-e3aed33e242f","resolution":{"observed_at":"2026-05-16T18:21:09.616791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motion prompt- ing: Controlling video generation with motion trajectories","venue":null,"work_id":"eef69d3b-16a0-4059-8529-64344d6f62b7","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:50860316d18fce95d3f94724343d032b1d898908c814f02e2545eadea44ec42d","observation_id":"d4ffdc71-06df-4cb8-85e9-e746a3b31d55","resolution":{"observed_at":"2026-05-16T18:21:09.565123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.13344","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:28:38.506158Z","title":"Ropecraft: Training-free motion transfer with trajectory-guided rope optimization on diffusion trans- formers","venue":null,"work_id":"0ae5eb4d-7f44-49ba-8429-2a3aa63c2344","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:8bf3eccce6b2a2d69326b6857904b80f3f239e1a82be06d2dfc4cb4a9ee0b2f9","observation_id":"838b69d2-3e21-4ce0-91a1-1c4c8d0e9cec","resolution":{"observed_at":"2026-05-16T18:21:09.359089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":"207ae636-d221-4f92-bd0d-199ac7dc1626","year":2021},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:cffa21c56186574fd550645cf1f401a985acb5c4d7d73d5f4ecc4e709acf245d","observation_id":"e71fadd6-a1c4-4db0-81e3-185cf929a81f","resolution":{"observed_at":"2026-05-16T18:21:09.620837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:16:06.360207Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"3b7528e0-76f2-4623-adb7-1afa4ce6cb5b","year":null},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:b5f5b81a36b0872a78f21627529985be0696efd4c723651bd54c434a8a71a751","observation_id":"f52da805-dcff-4a6e-ae6d-7be5085d8192","resolution":{"observed_at":"2026-05-16T18:21:09.605787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"48256f92-5a65-463c-8289-31c11c706efd","year":2022},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:daa67b92a3d6aa0b0d51c07f31215d13849b407b23a6a4436ca5f1cdc490e5dc","observation_id":"472c813c-a6b4-4321-bb9f-abaf497f7808","resolution":{"observed_at":"2026-05-16T18:21:09.557472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Comd: Training-free video motion transfer with camera-object mo- tion disentanglement","venue":null,"work_id":"7521c750-f564-4c2e-9c0c-61cde233a993","year":null},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:b7bfd09a592414a9ea7ad893282d063c4df6f8cda5f638a1e3e11136c703f93d","observation_id":"1c9842a5-0a94-4fc3-84c4-eeb8c6edb0dc","resolution":{"observed_at":"2026-05-16T18:21:09.639958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videomage: Multi-subject and motion customization of text-to-video dif- fusion models","venue":null,"work_id":"e7c14358-5a53-4993-b6a9-5b9b9d20c648","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:6b491d4fb4436b1afeb6f748bf2df639af30cc0ebc0041aa02dac02c97a91f6a","observation_id":"389a1dc3-e94e-44e3-813d-066e68e67d96","resolution":{"observed_at":"2026-05-16T18:21:09.628363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vmc: Video motion customization using temporal attention adap- tion for text-to-video diffusion models","venue":null,"work_id":"f42fdf18-e114-45de-b8cc-e8746f6f1be5","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:294923c05687532f7f9947825e047ecb3f7b35a4607d71b5823dac6b7b73bff8","observation_id":"d5203253-365b-4898-a996-f406def122e2","resolution":{"observed_at":"2026-05-16T18:21:09.614739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Co- tracker: It is better to track together","venue":null,"work_id":"ef6953e8-594c-4020-aed1-08418f9b65e2","year":null},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:e0981761e2ac3e75931beec035667a5a2dbb7d6a9cfa7ee174d95d77fbbaf000","observation_id":"68a8a6d6-7a0d-43a9-966d-c076dfabc713","resolution":{"observed_at":"2026-05-16T18:21:09.626012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mo- tionclone: Training-free motion cloning for controllable video generation","venue":null,"work_id":"9f91d78c-b9dc-4587-92e6-12cfb9a991a9","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:3692bd6b2266886adaa64feb18c9a16ef03ec65e1c959ac9a3ec9d5b8c46ba3b","observation_id":"5464d195-cf2f-4e73-af89-26965357579a","resolution":{"observed_at":"2026-05-16T18:21:09.589852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motionshot: Adaptive motion transfer across arbitrary objects for text-to-video generation","venue":null,"work_id":"cc1deacb-d8a9-4bca-9ee1-e08943f8192e","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:203297832c25dcbd0a19d42931f48fe8d30cc878596929ace5827e493ca30bb5","observation_id":"c5730103-9c05-48ea-813b-c7dc1e494beb","resolution":{"observed_at":"2026-05-16T18:21:09.587910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Freelong: Training-free long video generation with spectralblend tem- poral attention","venue":null,"work_id":"a46c4e01-5a88-4761-b2a5-f2054825c5fb","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:0fca3a5b8aee27578dc1ac7700584bf9a478a52001d01916a98e99902899c4a3","observation_id":"19d7cb39-3bc7-4377-8070-f89837f6b31c","resolution":{"observed_at":"2026-05-16T18:21:09.632719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trailblazer: Trajectory control for diffusion-based video gen- eration","venue":null,"work_id":"75bc22d5-8002-4208-97a3-0b9f11726ad2","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:706d5b2dbaa8d0d2d37a77d90955d8c5ab7e842917f0a89320f0d672ac84359c","observation_id":"709b7445-0cd0-41b5-9151-29342e701aba","resolution":{"observed_at":"2026-05-16T18:21:09.561326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Follow your pose: Pose- guided text-to-video generation using pose-free videos","venue":null,"work_id":"cbd0f68a-73a2-4f6a-870e-ec9379522c77","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:423c4574f23c63ecba4211defd2beae9eef7dcd330051f2693cc577f8db0a814","observation_id":"738f7527-4db0-4b33-9c27-1549f0424816","resolution":{"observed_at":"2026-05-16T18:21:09.594707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08268","last_updated":"2024-03-13T05:44:37Z","snapshot_observed_at":"2026-07-06T17:43:44.153710Z","submitted_at":"2024-03-13T05:44:37Z","title":"Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts","version":1},"cited_work":{"arxiv_id":"2403.08268","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.08268","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Follow-your-click: Open-domain regional image animation via short prompts","venue":null,"work_id":"8e5acd09-d7f4-4d92-8074-b66ea5cb1782","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"cited_paper":"/paper/2403.08268","citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:334d2ead10497a5ecdb140da5f31c5f151a447bd2e8f137f83cb661e474b7fa7","observation_id":"c17a0331-9879-4fb7-89a0-8b1ca1d4f4cb","resolution":{"observed_at":"2026-05-16T18:21:09.373035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.05207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T10:27:02.501243Z","title":"Follow-your-motion: Video motion transfer via efficient spatial-temporal decoupled finetuning","venue":null,"work_id":"f6cf64f2-dc9e-4eee-a7c8-2fc27058ca5c","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:ef6e536b78b87e2c75243c78476a57d70ff55604f41e7cffed87f8ed017942fc","observation_id":"be463454-eff3-46ed-9edc-1a34ba3bc689","resolution":{"observed_at":"2026-05-16T18:21:09.362832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lang-segment-anything","venue":null,"work_id":"5c2a73ae-73fe-49b4-9196-8965ead40424","year":2023},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:8b30a3721aba2cb417e71384ce177d5d952a5de00bb67880c29c5938010adf6c","observation_id":"067fdb3b-58ab-4297-8222-90ff3bfc031f","resolution":{"observed_at":"2026-05-16T18:21:09.641939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sg-i2v: Self-guided trajectory control in image-to-video generation","venue":null,"work_id":"dd3f9004-ef52-4cde-87d2-6bb3548b1c9d","year":null},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:2e9d000365090347e1f9c339daedae44b202d3ed5b8143e3fd1811448fdd0d9f","observation_id":"0e6eb82d-5abc-4f2d-bfc8-e6abd4a66ca7","resolution":{"observed_at":"2026-05-16T18:21:09.646774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Glide: Towards photorealistic image genera- tion and editing with text-guided diffusion models","venue":null,"work_id":"82496e54-8dd6-4872-b49d-a7f880072a4c","year":2021},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:3e634696a60d5f0828b11b6882c20915e2ab712bc35cd51d6f72e1b56d3d7271","observation_id":"616d36b3-115f-4e41-bdef-cf764473db40","resolution":{"observed_at":"2026-05-16T18:21:09.601126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f5181f1a-90fd-41fc-b4c4-0e9e7db413b2","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:41b09be401f877efcc85b5f37b93d2cd676b70f14c371863474eee83e7e62baf","observation_id":"f77a9081-cff1-45ca-83f0-5fb9331c45c4","resolution":{"observed_at":"2026-05-16T18:21:09.596927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spectral motion alignment for video motion transfer using diffusion models","venue":null,"work_id":"80f60442-658a-46f4-846e-97c326bff643","year":null},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:8e01296ddcde0dc127a580abbdec9b9548d10b73d8532116ac1aba959a1cf4fa","observation_id":"19bea09c-7cd4-400e-9c80-42b8d6662fc5","resolution":{"observed_at":"2026-05-16T18:21:09.573418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"723e2cc4-fcad-4c8e-b2aa-7195501ca77a","year":2023},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:3cba3d8490396c793beffd6085ee2c8c02331f66445d60473a333dea8c18293f","observation_id":"cbea9d9c-58f1-4de4-b9a1-6c14d2fe900e","resolution":{"observed_at":"2026-05-16T18:21:09.579412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video motion transfer with diffusion transformers","venue":null,"work_id":"64b94a9f-6192-450b-97be-fa827f83ac03","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:2513cffa05a78ede5026c551a22965ccc1de443e0fd8397bef173b875856986d","observation_id":"9ba9f202-d873-4dab-9add-79389d704934","resolution":{"observed_at":"2026-05-16T18:21:09.563256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":"1704.00675","doi":"10.48550/arxiv.1704.00675","metadata_source":"pith","pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","venue":"cs.CV","work_id":"e062a88c-5ea8-4ba0-97f0-3aae55fee107","year":2017},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:5cda47b1771b05a6ff0259922e0a36ad547af10348d4101b5c5494806cbbb899","observation_id":"46f60690-fc99-4a26-b19f-0987e1ac3b92","resolution":{"observed_at":"2026-05-16T18:21:09.379964Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16863","last_updated":"2024-06-24T17:59:56Z","snapshot_observed_at":"2026-08-12T19:01:22.928992Z","submitted_at":"2024-06-24T17:59:56Z","title":"FreeTraj: Tuning-Free Trajectory Control in Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2406.16863","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16863","snapshot_observed_at":"2026-07-04T03:39:29.806203Z","title":"arXiv preprint arXiv:2406.16863 (2024) 18 Meric et al","venue":null,"work_id":"298fdc53-947d-4bb0-ba62-06dcd8b3606a","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"cited_paper":"/paper/2406.16863","citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:8b2902880facf7c36c8a239667d4e1e1c983e9308bc5c18cbd1b87d5640feb12","observation_id":"a6924bb9-3903-4854-ba27-20e0555f74f7","resolution":{"observed_at":"2026-05-16T18:21:09.366202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer.JMLR, pages 1–67","venue":null,"work_id":"f04c34e4-42c2-425b-af77-9986e477f0b6","year":2020},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:df075e353609d5407139d2e08ee633b69fec199e8517743db1ee9a3a154b7ee3","observation_id":"3593837a-7159-4b69-8be8-028b030fed20","resolution":{"observed_at":"2026-05-16T18:21:09.569059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"3724f281-8471-4878-bb0f-22951727985f","year":2022},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:4f074d13eaa9bfad5eeb3673d5a285ad57263812331f1fff989e7d0ddb07cd6a","observation_id":"c9edad58-99f5-4888-baa7-608966dadfd6","resolution":{"observed_at":"2026-05-16T18:21:09.555502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Photorealistic text-to-image diffusion models with deep lan- guage understanding","venue":null,"work_id":"78711912-0692-4fcc-9c86-c59034858673","year":2022},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:04e824c82bf35750c22f0941759ac7d0040dd83a49e0ea01dd7514869bb3e33b","observation_id":"d572f498-2584-44af-a9fd-23481d691b3d","resolution":{"observed_at":"2026-05-16T18:21:09.649238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decouple and track: Bench- marking and improving video diffusion transformers for mo- tion transfer","venue":null,"work_id":"bb50fbdf-46d1-4141-9ee3-ae5f375bab35","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:1a76e9571b0a4f4eacbf9cf5e5ff814e67b9631c0fdbd57022b673c565ae91d3","observation_id":"2023b6b3-a59b-4f8c-a7dc-b55b806b6479","resolution":{"observed_at":"2026-05-16T18:21:09.571644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion implicit models","venue":null,"work_id":"d70d34f6-fb01-46c7-b6b5-eafc822f1f6c","year":2021},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:917185b25e65aab8860210b0914e9f168b39d198d80f26af7b49febb34b621a8","observation_id":"a0b30664-85ba-4ced-b9c6-c8dadb79ed1a","resolution":{"observed_at":"2026-05-16T18:21:09.599118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emergent correspondence from image diffusion","venue":null,"work_id":"64428782-4f94-419e-acd9-7568a7111e47","year":2023},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:164c2c4b3c445fc52e010a96ae13651cf7afe4b61dc7493271fd5d986f64acea","observation_id":"4f3e9730-57e9-47a8-a7c5-d60742299aa7","resolution":{"observed_at":"2026-05-16T18:21:09.651769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:ab82ad1efc82b43c49358410faccfb1ec69cf0bb0d1426a5a71ab7fc0f76db63","observation_id":"d61bb5ba-1e8e-4bbc-b936-f3cfb8ef3356","resolution":{"observed_at":"2026-05-16T18:21:09.352713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-10T01:52:30.999213Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":"2308.06571","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-07-11T01:57:50.025885Z","title":"ModelScope Text-to-Video Technical Report","venue":"cs.CV","work_id":"1b1baf78-58ec-44d0-b700-84dff57b2f1f","year":2023},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:9a5d51c7db8aa2906af45beebd387521e78cd400ca02390319bc3c3e2becc5fd","observation_id":"608e50a0-f6e3-4882-9896-03f83f1ce709","resolution":{"observed_at":"2026-05-16T18:21:09.376342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motion inversion for video customization","venue":null,"work_id":"448410a7-1152-4f6c-b76e-7589c2dbae19","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:4c897d7d3497e07b0b86764820163d1fec6127fb80c38196f3648de77656ff5a","observation_id":"a666ad69-159e-4bf7-bb40-b05173518753","resolution":{"observed_at":"2026-05-16T18:21:09.581554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motion inversion for video customization","venue":null,"work_id":"aaf16edc-c55f-4371-a982-6985cbd93442","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:c52d86e0fea76080496c1ee1cef38a67f8747d5e73aad0180d42c5e8303f6d7c","observation_id":"cd4539d5-7cc8-45cb-af32-50ccfc4f3bfc","resolution":{"observed_at":"2026-05-16T18:21:09.575190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:b1952ff74857e4986df71873521174d61b9ff0042ff42558e8c91bcc2274f8b3","observation_id":"4edce8c8-8039-4896-874a-b2e18d6591cd","resolution":{"observed_at":"2026-05-16T18:21:09.369544Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Freeinit: Bridging initialization gap in video diffusion models","venue":null,"work_id":"835dca16-0939-405b-90bc-f78fc657dbf1","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:150a1611083dc715b4e2515d3e11500d2b10a27e6e5fa524455f319185c4091c","observation_id":"f41d5a81-8114-400c-a287-80a9315e251d","resolution":{"observed_at":"2026-05-16T18:21:09.630491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video diffusion models are training-free motion interpreter and con- troller","venue":null,"work_id":"67cc121d-34b0-4dc9-8d10-3cf10525a792","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:b3ca5dc5810daf7624a90b0a4d1d76076779e379c02f305e15832b2d8102bbf0","observation_id":"dcfeb0c5-54e4-4456-94ed-89f3c6bcbbc5","resolution":{"observed_at":"2026-05-16T18:21:09.608105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motioncanvas: Cinematic shot design with controllable image-to-video generation","venue":null,"work_id":"ea89719c-94e3-4f64-9d48-bbad37df9162","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:9f3d94e9cc83c521667d021a9374927fac309c075cf82b395a7f71c501c7e6bb","observation_id":"d4e56af9-83b6-49e2-89b1-ed9465edb724","resolution":{"observed_at":"2026-05-16T18:21:09.577103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Direct-a-video: Customized video generation with user- directed camera movement and object motion","venue":null,"work_id":"90621119-9dbf-4a5b-a1a2-3bd2524bdd30","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:be0934827b72fabdce85777bfbf97d91f53f12b45ba5a31f89bba5dce8fc80c4","observation_id":"38c63e4e-737d-4ddf-8770-b3a40f0c3d73","resolution":{"observed_at":"2026-05-16T18:21:09.612695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":"efc49fd9-af2c-47ce-beff-492381dd24db","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:97c52d88699aec76853032ee133a03d3c9672f3c88cb8cb69352c1edbb12a5e3","observation_id":"185ad330-fcf8-4840-bc34-1075d2f0d8c2","resolution":{"observed_at":"2026-05-16T18:21:09.637430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Space-time diffusion features for zero-shot text-driven motion transfer","venue":null,"work_id":"e23a0af6-28ed-4294-a696-fa92b7f0b60c","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:24004c5e431b5ae2209124a0a46749748f630259e682089fe527a889f01038ea","observation_id":"48e0f11a-defe-47f6-bfea-6239ac211e47","resolution":{"observed_at":"2026-05-16T18:21:09.571325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Freqprior: Improving video diffusion models with frequency filtering gaussian noise","venue":null,"work_id":"c15a6c1c-4107-46f0-a48d-8db368c271fe","year":2025},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:e035c2b673037abfb36ae93f982e77c4efc6426209ebdd816b5bdedc61a18b24","observation_id":"6cc04d1c-5645-4807-ae94-31b679c5f373","resolution":{"observed_at":"2026-05-16T18:21:09.610410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A tale of two features: Stable diffusion complements dino for zero-shot semantic correspondence","venue":null,"work_id":"7890ec52-36e7-4996-9ee8-c38a1fc5ce69","year":2023},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:3d554af622d9f72b58e6abc49fbb8fdf51f63414bc4bd3fdae11b9c290228891","observation_id":"9daccf21-8599-44b1-b94e-094a46eb94fb","resolution":{"observed_at":"2026-05-16T18:21:09.634651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motiondirector: Motion customization of text-to-video diffu- sion models","venue":null,"work_id":"21f60a7a-065a-41c0-99e1-96090392d695","year":2024},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:292466792f8e88293d8c2bd90fd382c9e815b17e0a20c54c9dd161cac3a211c9","observation_id":"3f3488ae-8466-4ad9-9594-5c68462a7099","resolution":{"observed_at":"2026-05-16T18:21:09.644419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Details of T2V and I2V Pipelines As discussed in Sec.4.1 in the main manuscript, ourMo- tionAdaptersupports both T2V and I2V pipelines","venue":null,"work_id":"3d0ca439-84c6-4f3b-ab53-c967958aa3c3","year":null},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:519968f66f20b6e970f4b40ca33a46c7fd3b3de841fd0f8422f0d0b9b9febc9f","observation_id":"0956dc66-50ac-44b6-b3d4-e6d224bb490d","resolution":{"observed_at":"2026-05-16T18:21:09.592466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"For more details, please refer to Sec.3 of the main paper","venue":null,"work_id":"e3898662-2423-42ba-aa07-c10f32ab8367","year":null},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:3e8eaf8d781ad11519dcdaa7e866c220b166b6999eedd8075541163cf9725cac","observation_id":"9fe5ffb8-a4a1-4801-a268-46f9eb91a95f","resolution":{"observed_at":"2026-05-16T18:21:09.567135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quantitative Results Tab","venue":null,"work_id":"a4225523-cea5-4c6a-baba-36f2f6757c8c","year":null},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:f7bdcf5aefaf3c460960a20eb5c48f20d9bcf95ba7ffedfe878618c7d9bec696","observation_id":"a39a958f-976f-4a23-a8c1-c50c2a954a30","resolution":{"observed_at":"2026-05-16T18:21:09.562408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"As shown in Tab","venue":null,"work_id":"9f55db73-d0a5-4809-9b41-6c7fccfdfa23","year":null},"citing_paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T18:19:46.024756Z"},"links":{"citing_paper":"/paper/2601.01955"},"observation_digest":"sha256:db997cae01acd1a7c9fb2f832200c9dcd7aba4e551731f431f4ec87f5d5447a4","observation_id":"49e60cd5-f2ec-43f4-9cc3-58a40932baa6","resolution":{"observed_at":"2026-05-16T18:21:09.623425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.01955","last_updated":"2026-04-07T07:29:30Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T13:49:01.686998Z","submitted_at":"2026-01-05T10:01:27Z","title":"MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":9,"verified_fuzzy":44},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2601.01955."}