{"as_of":"2026-08-07T15:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a67059c71e9606269e3c96303700b135b34c67fef43834643c5ae88f1e386c5","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:20:00.434620Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16310/citation-record","integrity":"/paper/2507.16310/integrity","json":"/paper/2507.16310/citation-record.json","paper":"/paper/2507.16310"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.997155Z","title":"Skeleton- aware networks for deep motion retargeting","venue":null,"work_id":"ca97b677-6f3d-40b9-a25d-7605681d079a","year":2020},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.035073Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:3c3a5bc9877bb89f28de880e4eaedb8a02ef000c7dccba9c7c6afb2d81153649","observation_id":"bd3f0630-f9c5-47bc-a5dc-7011e145f12c","resolution":{"observed_at":"2026-08-06T15:20:02.002977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.05814","last_updated":"2022-10-15T21:18:49Z","snapshot_observed_at":"2026-08-07T13:01:28.667448Z","submitted_at":"2021-12-10T20:15:03Z","title":"Deep ViT Features as Dense Visual Descriptors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.05814","snapshot_observed_at":"2026-08-06T15:20:00.044930Z","title":"Deep vit features as dense visual descriptors","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.044930Z"},"links":{"cited_paper":"/paper/2112.05814","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:4b860d7e6b43f79c9499895809c267959d08ca96b33a06371bbf437f2b434653","observation_id":"bbb79a4f-d31c-4cea-b127-90f5b0070a05","resolution":{"observed_at":"2026-08-06T15:20:00.044930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T15:20:00.053725Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.053725Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:3c3714fa2c1aea5e48d66b9eeba81c9cd7dcb5c079ea076b5d18e7993f18080d","observation_id":"3765f2f8-c505-4dcc-b47a-c3e0e4fdc275","resolution":{"observed_at":"2026-08-06T15:20:00.053725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.976219Z","title":"Bookstein","venue":null,"work_id":"2accd161-b18a-4eb2-9386-3c540d8dc2d6","year":1989},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.060780Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:717a9a88edc560b1eb02a166fb1374adeef04f04e0c6463e211f3fdf412fd019","observation_id":"c5c0da4d-8b85-4af7-8ea5-0b2bc133f285","resolution":{"observed_at":"2026-08-06T15:20:01.982900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.952071Z","title":"Attend-and-excite: Attention-based se- mantic guidance for text-to-image diffusion models","venue":null,"work_id":"49892990-6a16-41af-b212-378eb03ac8e4","year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.068668Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:ee61c32b3b3efbb87ac62b2bf7508f05c60d56e07d4fa95b8909344a861a0d23","observation_id":"a3d4fbcb-e263-4b20-9db3-0319d63bc4dc","resolution":{"observed_at":"2026-08-06T15:20:01.961399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-07T10:15:15.859263Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T15:20:00.075763Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.075763Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:b597218b23a6b7f34b1403e81c46a804dd9150110f86e867fe93c76a1dfbfbbb","observation_id":"b4a1deb5-66ff-4975-b55a-97e8de553122","resolution":{"observed_at":"2026-08-06T15:20:00.075763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.932418Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"32515abf-7dff-4ac2-93e7-41040b87a9ac","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.081517Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:7a3526aacb16f534f773da94d8267cb09b1b0929b93e5acacf37d7daea594fea","observation_id":"f63ffb98-7d64-410c-bfbe-16d7100b6f21","resolution":{"observed_at":"2026-08-06T15:20:01.939107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.912375Z","title":"Online motion retar- getting","venue":null,"work_id":"3fe2a7ec-35ef-41fd-a66c-4cee844f4475","year":2000},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.087715Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:0f8f23fe87b3524fc3a4458740d7d15f48d5d2969b82ecc84b47218dd1391168","observation_id":"80f40a3b-56f2-469f-8bd6-560cbae5b975","resolution":{"observed_at":"2026-08-06T15:20:01.917417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.888880Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"370663ad-8e96-4dc4-9ec9-3e1a0ea669b0","year":2021},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.093650Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:e1d5f73afa8595e2e4f4dc28694ebb675e577930fe85b09a91b0b9b6cd1dfc95","observation_id":"f3637c41-85f3-4dd9-93bb-68afc611a005","resolution":{"observed_at":"2026-08-06T15:20:01.896195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.866517Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":"4a89d569-44d4-4bf4-8512-be03ed9d077e","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.098732Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:a4ef8e9a30d9ec924b54605b8c51c3670ac4dcc380e7b1faa7fc99ee3034ed0d","observation_id":"dd51fc53-d32b-4b42-87d5-ee6c4997ed37","resolution":{"observed_at":"2026-08-06T15:20:01.874385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.847168Z","title":"Similarity distribution based member- ship inference attack on person re-identification","venue":null,"work_id":"8957ac21-ca89-41ad-b781-ec013c7e09bb","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.103868Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:624da7a75b6577e6f469be58243e6d5fc008c087ed1597ca871d5ee8fa5c6b3b","observation_id":"7ca8d662-b9dc-47d9-833e-2f3802c6d00d","resolution":{"observed_at":"2026-08-06T15:20:01.852426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01414","last_updated":"2025-02-23T13:45:34Z","snapshot_observed_at":"2026-08-06T05:30:05.390704Z","submitted_at":"2024-07-01T16:05:18Z","title":"StyleShot: A Snapshot on Any Style","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01414","snapshot_observed_at":"2026-08-06T15:20:00.108959Z","title":"Styleshot: A snap- shot on any style","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.108959Z"},"links":{"cited_paper":"/paper/2407.01414","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:22cfd097829049835daabe25584e3982a910b28d82b9e2becdfb5a78a7d2166c","observation_id":"00315d3d-09bb-4bcb-aae7-ba39f5209432","resolution":{"observed_at":"2026-08-06T15:20:00.108959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00740","last_updated":"2025-03-02T05:35:57Z","snapshot_observed_at":"2026-07-06T20:45:08.434808Z","submitted_at":"2025-03-02T05:35:57Z","title":"FaceShot: Bring Any Character into Life","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00740","snapshot_observed_at":"2026-08-06T15:20:00.114303Z","title":"Faceshot: Bring any character into life","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.114303Z"},"links":{"cited_paper":"/paper/2503.00740","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:583b0d0871d1be0e6416c566c2c24751e1b222810a735841c1124802f8dc205b","observation_id":"6f5a178a-6c7f-4b63-83cd-686740e24cdf","resolution":{"observed_at":"2026-08-06T15:20:00.114303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.828596Z","title":"Retargetting motion to new characters","venue":null,"work_id":"f0835588-38ff-4123-8bb8-e34e0d59fbd6","year":1998},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.119910Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:1f41ad6dbb7b9dc1e4b296b4097b95a45801635aa808d45e6f3cbd9d85d01fd7","observation_id":"4b6d4663-bca3-42b1-a877-f42396614749","resolution":{"observed_at":"2026-08-06T15:20:01.833449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T15:20:00.128643Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.128643Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:2e8afab88733984986a5f3204957a59b7918392f8cdba372d49bb92849d6b37c","observation_id":"ee2e4806-8d35-4198-8c92-8a8f9a00d846","resolution":{"observed_at":"2026-08-06T15:20:00.128643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.808257Z","title":"Sparsectrl: Adding sparse controls to text-to-video diffusion models","venue":null,"work_id":"c9adb38f-36a3-471d-84e2-f687b514f677","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.134905Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:f861888ecc7ecbd49412b7eb188bcec6d2427139acd5dc351db0b0ec81f7fe48","observation_id":"b64a74d0-bdc1-4f5d-bbe6-7621f4d9c3e7","resolution":{"observed_at":"2026-08-06T15:20:01.814918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.789144Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"715bd76a-6aea-4f9c-87c3-de1173412476","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.139194Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:47c8fef42481bc647901bae7cc40f14c0eed4458a3095c6c636bdec0db4c724b","observation_id":"125e4a45-7e06-40f3-9845-2973e86fd541","resolution":{"observed_at":"2026-08-06T15:20:01.794894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-07-06T14:22:24.004857Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-06T15:20:00.144802Z","title":"Latent video diffusion models for high-fidelity long video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.144802Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:bcbbb5c0e2647f137b7ceccfff1432647229585b660b00149eff59cc468b75b4","observation_id":"a272ca92-206b-4825-a0f6-816e15124bcc","resolution":{"observed_at":"2026-08-06T15:20:00.144802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.765510Z","title":"Unsupervised keypoints from pretrained diffusion models","venue":null,"work_id":"b3d9dffb-8169-4aca-84c3-78acffb974c1","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.150807Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:e9b6338caf83787566759cb7ec010af469e542388de56c35d1dbb3b5040422ea","observation_id":"42ae0736-66b6-4bb6-af3d-7da4745ef585","resolution":{"observed_at":"2026-08-06T15:20:01.773003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.155759Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.155759Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:4fb774212c707d94dac6f9c66eb2e9f9ee7e77358a99f75e8e42041b5928fd76","observation_id":"bccfff4d-bd01-4a5e-adea-5638e6143f3f","resolution":{"observed_at":"2026-08-06T15:20:00.155759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.731225Z","title":"Video dif- fusion models","venue":null,"work_id":"105298f6-a7c1-42a0-99a9-18f07b13d339","year":2022},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.160567Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:0afd0d7d2873b51a2b563ee265eeefac2b3ff18bc6e32dcdb448e255702d83e8","observation_id":"60bb89f4-9638-46d0-87dc-dceb46c55843","resolution":{"observed_at":"2026-08-06T15:20:01.736114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.712833Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":"85ec3866-067a-4fd2-8578-e58277e4e808","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.165029Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c7ad45401ac137b27109b4a06c61834f74ccf95bee336b87e5e6d0545434bcc9","observation_id":"0bf141dc-1044-4f58-8662-591fa87c33a6","resolution":{"observed_at":"2026-08-06T15:20:01.718859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.694772Z","title":"Pose-aware attention network for flexible mo- tion retargeting by body part","venue":null,"work_id":"85fe1143-8d69-4f52-a2bb-576498ea888e","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.170578Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:f7ec70ffe169fd346648dbdb2572672e4ea37055668778f51f3f96dbcbefdcd0","observation_id":"75153607-6fe5-4e6c-a178-87eb711a6521","resolution":{"observed_at":"2026-08-06T15:20:01.700232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.677775Z","title":"Vmc: Video motion customization using temporal attention adap- tion for text-to-video diffusion models","venue":null,"work_id":"05a813f0-f4a8-44db-883d-83a72e1dba78","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.175383Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c269643f743809e38fe86188abf7a9083a59f4f32332391cbc53ce1f682ca03b","observation_id":"0612f6dc-78f7-4eec-8f1e-0c362d6ce645","resolution":{"observed_at":"2026-08-06T15:20:01.683105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.652895Z","title":"Text2performer: Text- driven human video generation","venue":null,"work_id":"bb1cca37-ee1d-4436-b6dd-85296a5de435","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.180158Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:6415a05bf53c8a37452e4517dd7a902da20f5be766ca4d47e9cd1eff9390ecaa","observation_id":"5454983c-f25a-42d5-9a42-f5006acf298b","resolution":{"observed_at":"2026-08-06T15:20:01.658703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11831","last_updated":"2024-10-15T17:56:32Z","snapshot_observed_at":"2026-08-03T21:35:04.144048Z","submitted_at":"2024-10-15T17:56:32Z","title":"CoTracker3: Simpler and Better Point Tracking by Pseudo-Labelling Real Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11831","snapshot_observed_at":"2026-08-06T15:20:00.184671Z","title":"Co- tracker3: Simpler and better point tracking by pseudo- labelling real videos","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.184671Z"},"links":{"cited_paper":"/paper/2410.11831","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:5dd3b3e1133762dd9271c5f6a3af48b59f0708900f72145fea3c2d11d75db642","observation_id":"9b0387f6-38f9-4c9f-bffe-367900018389","resolution":{"observed_at":"2026-08-06T15:20:00.184671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.635309Z","title":"Text2video-zero: Text- to-image diffusion models are zero-shot video generators","venue":null,"work_id":"864cd593-12cb-46b0-8c6c-7fe5984a621f","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.190842Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:a2399dc76e1e5240dca39ce76c6cd97da9447cdc9da6361c205f90fdd3db63b3","observation_id":"96ce2440-c0df-4aa0-853b-6d4e78e0f70d","resolution":{"observed_at":"2026-08-06T15:20:01.641074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.615856Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross B","venue":null,"work_id":"fcac5500-6a24-4f8e-940c-bd17902aa772","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.195923Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:1ea832b193dfad5b57a40aae9be67bc18d5918bb292c5b86e148a79931e8f3c8","observation_id":"a5c0396c-d7f8-4478-a3c4-3818c23794b4","resolution":{"observed_at":"2026-08-06T15:20:01.620798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.597381Z","title":"Hunyuanvideo: A systematic framework for large video generative models, 2025","venue":null,"work_id":"e3509489-f2e9-458e-8528-28b8965c6d0c","year":2025},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.200418Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:6784049ad8e31bc0198d469f09404b1c14d70b24a22c3974d77eb4530d44347e","observation_id":"87c6b038-176d-42d8-9319-be28e8131f70","resolution":{"observed_at":"2026-08-06T15:20:01.603380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.578431Z","title":"A hierarchical approach to interactive motion editing for human-like figures","venue":null,"work_id":"d74012c1-95f6-4226-99ea-6519157dcd6c","year":1999},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.205535Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:624522ac1210a79ab9ef2f1d73771792fac58c1062e4e876315f2400ac3e0697","observation_id":"17a0df18-f548-4ba2-b91a-164b2b4563b8","resolution":{"observed_at":"2026-08-06T15:20:01.583696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-07-06T19:51:24.166504Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"cited_work":{"arxiv_id":"2411.10836","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10836","snapshot_observed_at":"2026-08-06T15:20:00.775292Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","venue":"cs.CV","work_id":"02f416cb-d24f-44ad-b8b4-7ab1e8b84f01","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.210090Z"},"links":{"cited_paper":"/paper/2411.10836","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:2ab5ea21e43c60555c76fd6a708c6ad777972ccea6a554c72194b9b41d9d1f11","observation_id":"1ca179f3-3f28-4ced-86d1-326e20dfe177","resolution":{"observed_at":"2026-08-06T15:20:00.783634Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00398","last_updated":"2023-09-07T08:11:01Z","snapshot_observed_at":"2026-07-06T16:13:15.274672Z","submitted_at":"2023-09-01T11:14:43Z","title":"VideoGen: A Reference-Guided Latent Diffusion Approach for High Definition Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00398","snapshot_observed_at":"2026-08-06T15:20:00.215127Z","title":"Videogen: A reference-guided latent diffusion ap- proach for high definition text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.215127Z"},"links":{"cited_paper":"/paper/2309.00398","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:6f08c940720f2710576cba0543463fca62042a8360958ac13a05b5685dc8d172","observation_id":"bc71c382-163c-4713-8504-8f6343960edc","resolution":{"observed_at":"2026-08-06T15:20:00.215127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.562720Z","title":"Pmnet: Learning of disentangled pose and movement for unsuper- vised motion retargeting","venue":null,"work_id":"3e498628-8cc1-403a-a71f-05f07ad84dde","year":2019},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.220568Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:3aedb9e2494f1af499e38001a530d0bf048d77cbb85257e2201d3e0290a93dfc","observation_id":"47e74b41-5ecd-4705-bc4d-1d99b272204d","resolution":{"observed_at":"2026-08-06T15:20:01.567353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05338","last_updated":"2024-10-22T04:22:16Z","snapshot_observed_at":"2026-07-06T18:27:28.886692Z","submitted_at":"2024-06-08T03:44:25Z","title":"MotionClone: Training-Free Motion Cloning for Controllable Video Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05338","snapshot_observed_at":"2026-08-06T15:20:00.225551Z","title":"Motionclone: Training-free motion cloning for controllable video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.225551Z"},"links":{"cited_paper":"/paper/2406.05338","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:e9a8101ad6cf64fd6f5508d253b0842bae620bad437b88946b9127a17a9868a2","observation_id":"9816a2a6-1b21-48f5-9a73-1213c3fb9f89","resolution":{"observed_at":"2026-08-06T15:20:00.225551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.542723Z","title":"Diffusion hyperfeatures: Search- ing through time and space for semantic correspondence","venue":null,"work_id":"7de08747-f7c3-43a0-a803-4e758f0f906e","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.230529Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:bfc5796f6e0fb05be89e3eaac03400d7ec01848346f5f9d6c51fa4518f07e898","observation_id":"cd2ce4a4-5a68-47aa-ac2b-562f7212e5a8","resolution":{"observed_at":"2026-08-06T15:20:01.547532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-02T13:01:06.918463Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-06T15:20:00.234807Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.234807Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:e101ee349a230f0ea49d69aefc38d5df35759d15048ded1afb1a4ea7b6de7b1b","observation_id":"4640302b-5adb-4309-aa6a-1f0a89b6f369","resolution":{"observed_at":"2026-08-06T15:20:00.234807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.527161Z","title":"Follow your pose: Pose- guided text-to-video generation using pose-free videos","venue":null,"work_id":"3f2c295e-170f-4d85-9d89-99d855fb8b54","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.239489Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:a445a2ae7b29ee3eeda10db9ab11c1f41030b3725588d5b9a89d8277fb8517e6","observation_id":"099c95a2-c7c7-42a2-8971-61788b74dde9","resolution":{"observed_at":"2026-08-06T15:20:01.532016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.509545Z","title":"Follow-your-emoji: Fine-controllable and expressive freestyle portrait animation","venue":null,"work_id":"a8b0e5a0-5e98-49f3-8d65-73385ddd9bc7","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.243968Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:04494e9beccf5d27a864df83b7bdad1c82c2d5af6ed5746014b243830b633f47","observation_id":"3661260e-c930-43ed-bd48-925674816eeb","resolution":{"observed_at":"2026-08-06T15:20:01.515681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.489625Z","title":"Principal components analysis (pca)","venue":null,"work_id":"bacec1ab-bfc0-4d3c-bc28-d133d16050ea","year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.248448Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:9e168b55c0786b8a9d3451004e10f3611c91193548e5214487cc8c98e697075c","observation_id":"f7213836-b34b-4162-aab4-2e59bbcd2397","resolution":{"observed_at":"2026-08-06T15:20:01.494785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.467785Z","title":"Conform: Contrast is all you need for high- fidelity text-to-image diffusion models","venue":null,"work_id":"d85db258-1b27-4c06-82c9-6befb88fbcea","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.253323Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:a28a516d3b3cf6cd0790d941d950ac5ee110648fae3178062e232a2dcb9fabd0","observation_id":"dd6324d7-a7be-4fca-8e6e-2ac9249d92a5","resolution":{"observed_at":"2026-08-06T15:20:01.473280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05275","last_updated":"2024-12-06T18:59:12Z","snapshot_observed_at":"2026-07-06T20:02:57.733746Z","submitted_at":"2024-12-06T18:59:12Z","title":"MotionFlow: Attention-Driven Motion Transfer in Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05275","snapshot_observed_at":"2026-08-06T15:20:00.258863Z","title":"Motionflow: Attention-driven mo- tion transfer in video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.258863Z"},"links":{"cited_paper":"/paper/2412.05275","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:01cd47adbbf0254cd32634c4b990f21f05bb719fa7e3ae608e8d85daa1ca9fbc","observation_id":"b42af1ad-ff3d-4459-a102-248ac4e33cf5","resolution":{"observed_at":"2026-08-06T15:20:00.258863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-06T15:20:00.263264Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.263264Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:233fee57951ccc7bb2ad54c62dc8ef32992ff14329fc27571868695ba679aa9e","observation_id":"03cc3d6e-efe7-44d5-9bff-29628e98aa63","resolution":{"observed_at":"2026-08-06T15:20:00.263264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.452536Z","title":"Mofa-video: Controllable image animation via generative motion field adaptions in frozen image-to-video diffusion model","venue":null,"work_id":"80c026bf-6ffe-40cc-83b7-cd0856dbe068","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.268132Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:a05d8bca65348a95833b13dcf089dce3f09c4e6620d3dfaf7838811339e9aec3","observation_id":"1c6961a8-c10c-4728-bd38-1336bc6dc61d","resolution":{"observed_at":"2026-08-06T15:20:01.457454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T15:20:00.272267Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.272267Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:102675d06b2ad203b7e06c6cfedd34805fcd6e5441e6e9732cf66a4240c41a99","observation_id":"9a1dda97-1d9c-47ed-991a-913af5de72b4","resolution":{"observed_at":"2026-08-06T15:20:00.272267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.436628Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"5531e708-7b41-4eae-b8ec-61c98f9161e3","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.277874Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:18d995ee3665ee235f03926d52fc862d7e2d70ac82447c69f608c8a0d0666515","observation_id":"7cc60a65-1226-4f93-883f-3feb91fdba2f","resolution":{"observed_at":"2026-08-06T15:20:01.441870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.417670Z","title":"The 2017 davis challenge on video object segmentation, 2018","venue":null,"work_id":"0abd287b-b8f9-4957-836b-6eb9610e7e64","year":2017},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.282677Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:86473d72a07925bd580ccb61ac8c9781ddc15eb12d7ce2ddcb57f17f5f9bb594","observation_id":"8f647a4c-a3a4-4448-868a-afd755abeb86","resolution":{"observed_at":"2026-08-06T15:20:01.423627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.401022Z","title":null,"venue":null,"work_id":"9fab07b4-538d-4a8a-93c1-33429fafccf9","year":1999},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.295138Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:768adf0f94401ab0a77c36476cfc1e8aad40f179461fbea91d582be1a7b50ee3","observation_id":"7b9eba82-639f-40b9-87b5-a861375515b4","resolution":{"observed_at":"2026-08-06T15:20:01.406644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-06T15:20:00.299556Z","title":"Hierarchical text-conditional image gen- eration with clip latents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.299556Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:0e719843c2fa922331dec3c690eda336621c003d8f86d7ef473b2f8ea324517e","observation_id":"85979e80-d5cc-47c2-b97d-db3d460e1576","resolution":{"observed_at":"2026-08-06T15:20:00.299556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.384464Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"31d54571-8921-4476-954f-502c7661381d","year":2022},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.304671Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:f4de063b3a1a7c2925fa9f6d7aa887e450d6cea7b14f56c39627503d4bb130c7","observation_id":"9a6cc2b0-8f54-4539-b099-67a35a830c05","resolution":{"observed_at":"2026-08-06T15:20:01.389241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.368075Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"da295239-43a2-427f-979c-3ada1001ab5a","year":2015},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.309357Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:d2b3360d2f7b2c4e485db3571249be50767857329574e47f8fe120b7c57de42d","observation_id":"631255fa-ae46-4b7e-af9d-e6dc394ddcf1","resolution":{"observed_at":"2026-08-06T15:20:01.372654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-06T15:20:00.313940Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.313940Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:52702e19d9e052b5a963f0a8a52cd5013395411d892c841e0f8221a3987a4f8f","observation_id":"fd5cf308-4131-4d5f-a5cb-b4cc5f1ea67b","resolution":{"observed_at":"2026-08-06T15:20:00.313940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T15:20:00.318893Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.318893Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:8d48c82381db574d597e5d518fbb64bb2465d4af1e5c3ca32377ee682241b747","observation_id":"6a2a90a0-5e7a-457a-a952-537bba1b62ae","resolution":{"observed_at":"2026-08-06T15:20:00.318893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.352869Z","title":"Emergent correspondence from image diffusion","venue":null,"work_id":"393d4833-56e2-4a7e-839f-2dcfcfdf894d","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.324418Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:abdaa9225e328092c94fa84ee208a5c98d41b6929877425e848479b58d94ace6","observation_id":"1a274f71-a3d8-4550-a794-3dea28f4819d","resolution":{"observed_at":"2026-08-06T15:20:01.357396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.337549Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"ce341182-f77a-4b9e-9058-b36aa7785b64","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.329518Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:bcd23ea3fd1b3f1097a70f10f288d9bf9d1f062a4d39b18b5badfa08b84cd32d","observation_id":"8d885f95-8c5b-4a96-a2fd-858d1475a3f9","resolution":{"observed_at":"2026-08-06T15:20:01.342158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.322870Z","title":"Neural kinematic networks for unsupervised motion retargetting","venue":null,"work_id":"ab6e05fb-bf0a-4acf-8d99-11251a01dd63","year":2018},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.334398Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:2812b48ac4fe9dd3a6d3e5dd59ab542ead83f9443fa87e73e86dcd0459e3f261","observation_id":"213f3258-3277-4e87-bb91-73d84b9355ec","resolution":{"observed_at":"2026-08-06T15:20:01.327598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.305943Z","title":"Contact-aware retargeting of skinned motion","venue":null,"work_id":"e310aba9-e2be-4b21-92f7-aab9e41eb3bc","year":2021},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.339495Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:ac08379fcbbeed868935c48e9e2c0d29aa0057b9229d339aa5479f6aba696076","observation_id":"e7898b8e-f378-44a1-8952-968939d21c61","resolution":{"observed_at":"2026-08-06T15:20:01.311650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20193","last_updated":"2024-10-16T18:35:31Z","snapshot_observed_at":"2026-08-06T01:11:00.872917Z","submitted_at":"2024-03-29T14:14:22Z","title":"Motion Inversion for Video Customization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20193","snapshot_observed_at":"2026-08-06T15:20:00.344605Z","title":"Motion inversion for video customization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.344605Z"},"links":{"cited_paper":"/paper/2403.20193","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:1e2c0644997929123bc7634246b4c1570a923f09f74e7aef8f24c272c2351a84","observation_id":"d655b8ec-0be4-4d28-9db3-aec63df831f1","resolution":{"observed_at":"2026-08-06T15:20:00.344605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.288943Z","title":"Videocomposer: Compositional video synthesis with motion controllability","venue":null,"work_id":"1d582827-effe-488f-be6d-9a04baabf748","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.350372Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:da0d13363bc59fb9f3925039284a324a8e0801a5426e49a8bf74898bf44d882b","observation_id":"ce151277-351e-42b2-8c4a-feebeb2eb51b","resolution":{"observed_at":"2026-08-06T15:20:01.293816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.271668Z","title":"Lavie: High-quality video generation with cascaded latent diffusion models","venue":null,"work_id":"ec695c40-f72d-4b0b-b8e5-08618a12a903","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.355033Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:7ef2adc2d1b0dc55bf7d4ea39b8734594a97461abed5573a83f552d6acc2fa57","observation_id":"b97df926-1564-4b93-b5ec-94fa936f9446","resolution":{"observed_at":"2026-08-06T15:20:01.277103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.254481Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"9cb0d681-8957-4440-b04e-680e39847ec7","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.359626Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:dcaca0e56d0fc9d48cab0ba0b0231582c81bf67ca95aa7f3890b362e557cf163","observation_id":"9467d295-d430-46ac-8a13-a55028aea53c","resolution":{"observed_at":"2026-08-06T15:20:01.259539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.235510Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":"ffc642fe-2a96-459f-a5f4-cb1ac25ab772","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.364434Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:32fcfbd8926fddb2ba914efb582a9ea1eb3e54474441c710e05c384544038576","observation_id":"9b676962-85c2-4552-9d86-09929ab9099e","resolution":{"observed_at":"2026-08-06T15:20:01.242149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.162432Z","title":"Make-your-video: Cus- tomized video generation using textual and structural guid- ance","venue":null,"work_id":"0ce53d07-d1cd-41fd-9405-4be39a74f179","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.369118Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:e37ccf619262526c565aee161589237107a00e03a982251a125e8701b58a527e","observation_id":"41bb9991-77dd-455c-b77a-0f6333293ae6","resolution":{"observed_at":"2026-08-06T15:20:01.182494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.102501Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":"13dbbbda-1e7c-40d5-accc-a05ad72e927d","year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.373675Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:dd4bbbfd80a7763f25fc457e038fd9b355aaebd701acc6bb08478ef40600da85","observation_id":"acef2303-f9b1-4659-8ac8-f676140604c9","resolution":{"observed_at":"2026-08-06T15:20:01.122156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.054183Z","title":"X- pose: Detecting any keypoints","venue":null,"work_id":"46279538-eba3-4c19-8055-d3135fe55789","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.378006Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:d9123f2ae205a6afe088479abd1a0288b318b9f1871a82d6eaaf9c5bbafd8d10","observation_id":"c8dbdace-9513-4002-9b8e-61885c557148","resolution":{"observed_at":"2026-08-06T15:20:01.077922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T15:20:00.386351Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.386351Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:5cdb9e54ea93281e201b5903a950a002dba98685e589fd7be5406bfbabf3e20f","observation_id":"5e49d73f-48d0-4858-80f9-fcf86dfda42d","resolution":{"observed_at":"2026-08-06T15:20:00.386351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-08-06T15:20:00.390737Z","title":"Dragnuwa: Fine-grained control in video generation by integrating text, image, and trajectory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.390737Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:098be664937c632588ae6127ee77247641e47b588e41fe38940c39ef1333b6f7","observation_id":"a58c4096-0e3f-4d9b-b39d-ec4be06ecf6b","resolution":{"observed_at":"2026-08-06T15:20:00.390737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12346","last_updated":"2023-03-22T07:10:09Z","snapshot_observed_at":"2026-07-06T15:06:30.864553Z","submitted_at":"2023-03-22T07:10:09Z","title":"NUWA-XL: Diffusion over Diffusion for eXtremely Long Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12346","snapshot_observed_at":"2026-08-06T15:20:00.395492Z","title":"Nuwa-xl: Diffusion over diffusion for extremely long video generation.arXiv preprint arXiv:2303.12346, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.395492Z"},"links":{"cited_paper":"/paper/2303.12346","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:b6e9596b32db970d6ef39cf7b11cdcab96e6bac594b053d35ed9f936040b9bf3","observation_id":"7c602629-254a-4976-9277-a33ee6582be8","resolution":{"observed_at":"2026-08-06T15:20:00.395492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.033570Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation","venue":null,"work_id":"6dc53674-019f-42d0-b228-62b01052f6ac","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.400011Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:7eb53e8c5ecfbf6059cdb574a7cae3f3239b33d4195ce51fa666334406aececc","observation_id":"101463d0-eacb-46e8-ab6a-3bf5a23cc740","resolution":{"observed_at":"2026-08-06T15:20:01.039251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.014448Z","title":"A tale of two features: Stable diffusion complements dino for zero-shot semantic correspondence","venue":null,"work_id":"c1d6af71-540a-48c3-af6e-f6554ee4fc89","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.404725Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:ed3253eef64198c0ead17198fa5b437d4e185f4bc71dd75de72bc311452bf741","observation_id":"5f1597f4-8910-4b28-8a07-3750998dc4b8","resolution":{"observed_at":"2026-08-06T15:20:01.019928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.995020Z","title":"Skinned motion retargeting with residual per- ception of motion semantics & geometry","venue":null,"work_id":"1b6415dd-d779-4e0c-9bdf-ca1005650299","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.409011Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:954feff792823e3d058060e191193db83899c9b3d6b17e467728dd6f634e2876","observation_id":"0452a693-10c4-4298-9558-92290baf9957","resolution":{"observed_at":"2026-08-06T15:20:01.000237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.973746Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"21526058-01eb-409b-8878-504c2b4e6107","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.413219Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:9ed58c4271c22e0915f0b30f75522d695967e349b0bee6d338eac2238b4733ed","observation_id":"4deeb550-89bf-472f-b7f1-74a6d09e75e8","resolution":{"observed_at":"2026-08-06T15:20:00.980701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07563","last_updated":"2025-01-13T18:53:08Z","snapshot_observed_at":"2026-08-06T00:23:29.895816Z","submitted_at":"2025-01-13T18:53:08Z","title":"Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency Loss","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07563","snapshot_observed_at":"2026-08-06T15:20:00.418690Z","title":"Training-free motion-guided video generation with en- hanced temporal consistency using motion consistency loss","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.418690Z"},"links":{"cited_paper":"/paper/2501.07563","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c9b18012be92a200d47329ff92706f6e74e7a706b342d18ddd009264d78b334a","observation_id":"19751861-2879-4d50-8411-6926c5b41537","resolution":{"observed_at":"2026-08-06T15:20:00.418690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.952980Z","title":"Motiondirector: Motion customization of text-to-video diffusion models","venue":null,"work_id":"88cb829d-cccb-4f75-b8ce-9cff146c71db","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.423617Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:29e6f1b07628faded5f36b994dc90a5c99ea05c00af52381e0388a8c7180117c","observation_id":"8304b2a7-a721-49fd-933c-63046789d9be","resolution":{"observed_at":"2026-08-06T15:20:00.960213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-06T15:20:00.429235Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.429235Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:1e483b6ac02c940accd1f0966880728777e1b4a196d08a011ef557a75e469d50","observation_id":"5e45d62c-902a-46f5-bd3f-3e36d91c1a4b","resolution":{"observed_at":"2026-08-06T15:20:00.429235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11018","snapshot_observed_at":"2026-08-06T15:20:00.434620Z","title":"Magicvideo: Efficient video generation with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.434620Z"},"links":{"cited_paper":"/paper/2211.11018","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:bcb1dc0020e3041259b96e9b9f26ee949d1d5ab65bf00ab92e07df402b637651","observation_id":"2f856dd9-7dca-4503-b248-a55961661149","resolution":{"observed_at":"2026-08-06T15:20:00.434620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":48},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2507.16310."}