{"as_of":"2026-08-07T23:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:81c395f7e99eaf58345946ed9420b99b566e494a1a93fcd818b4450788d5956d","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:19:32.853110Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.05963/citation-record","integrity":"/paper/2507.05963/integrity","json":"/paper/2507.05963/citation-record.json","paper":"/paper/2507.05963"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.04233","last_updated":"2024-05-07T11:52:49Z","snapshot_observed_at":"2026-08-07T18:37:30.995998Z","submitted_at":"2024-05-07T11:52:49Z","title":"Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04233","snapshot_observed_at":"2026-08-06T19:19:32.682892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.682892Z"},"links":{"cited_paper":"/paper/2405.04233","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:2d11f837ddc1a3838412bc74525f4f2ea6fcf5a0ea25a5d2960f66a263534849","observation_id":"e7c00d3a-a334-42de-98db-1afb1b1e3d4b","resolution":{"observed_at":"2026-08-06T19:19:32.682892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T19:19:32.687160Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.687160Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:1f1094fd9020733c47a0c3c23ad8aaa5791e7c72ef34e39c2c48ac747fe4c73a","observation_id":"32dcd412-4ed6-4a65-bb3e-e2afc1f9a3a9","resolution":{"observed_at":"2026-08-06T19:19:32.687160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.701235Z","title":null,"venue":null,"work_id":"01f48466-9c48-4e92-ac79-89d99465420f","year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.690131Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:1cef1475f2f0963201f942d8ca065830b862f12285709fb08def3ecbec3e663e","observation_id":"e50ac166-af50-4580-a8d8-4f046e25ea15","resolution":{"observed_at":"2026-08-06T19:19:33.704272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-07T10:15:15.859263Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T19:19:32.693569Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.693569Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:61a978c88282dd9ad8e8e4c8d62598b6d597760f1ba83165cd7b6c9a6152f78f","observation_id":"a1b9f00b-cf1c-4b90-9f57-66ca701ad735","resolution":{"observed_at":"2026-08-06T19:19:32.693569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06187","last_updated":"2025-03-20T17:59:56Z","snapshot_observed_at":"2026-07-06T20:19:26.003822Z","submitted_at":"2025-01-10T18:59:54Z","title":"Multi-subject Open-set Personalization in Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06187","snapshot_observed_at":"2026-08-06T19:19:32.696568Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.696568Z"},"links":{"cited_paper":"/paper/2501.06187","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:3bbe38953585efa407787ce35d86ce53d269522fe1c9fa0b530c7de8d1b40f10","observation_id":"9a6c98ec-89b8-4676-9790-ba98b2e8c4de","resolution":{"observed_at":"2026-08-06T19:19:32.696568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12886","last_updated":"2023-12-04T05:43:53Z","snapshot_observed_at":"2026-07-06T16:50:46.608196Z","submitted_at":"2023-11-21T03:47:54Z","title":"AnimateAnything: Fine-Grained Open Domain Image Animation with Motion Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12886","snapshot_observed_at":"2026-08-06T19:19:32.699721Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.699721Z"},"links":{"cited_paper":"/paper/2311.12886","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:8d3476f82d133156658450c4b586920b5b3c5ba453de30165307c25104baaa8f","observation_id":"91605dfc-3399-414a-a14e-2bd96df2718e","resolution":{"observed_at":"2026-08-06T19:19:32.699721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.703347Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.703347Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:c887cd0634c203e218383ac18f715f9b4a093da3bd13cd37064cf7e5240942b5","observation_id":"419d6a97-b0fb-4e9a-8376-a7fd00145812","resolution":{"observed_at":"2026-08-06T19:19:32.703347Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T19:19:32.706546Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.706546Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:e77a50ee0a5a82d6b5f3689c6f5fe5e0e23ab8d0b5a0ad8528457420eba371f8","observation_id":"4c9a3cb5-fbb6-48ac-8bd4-af498bb23657","resolution":{"observed_at":"2026-08-06T19:19:32.706546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15275","last_updated":"2024-06-25T16:57:27Z","snapshot_observed_at":"2026-07-06T18:04:33.726854Z","submitted_at":"2024-04-23T17:59:43Z","title":"ID-Animator: Zero-Shot Identity-Preserving Human Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15275","snapshot_observed_at":"2026-08-06T19:19:32.709390Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.709390Z"},"links":{"cited_paper":"/paper/2404.15275","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:7649d1de148613c6a7eaf458440dc575cac4fbe4e165691f138efc699099a50b","observation_id":"e31dc367-dbb4-4267-bedf-77dc9ba78886","resolution":{"observed_at":"2026-08-06T19:19:32.709390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T19:19:32.712440Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.712440Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:5537bde11410519cb86a2f2e0c5b8232a954a5403ea1f8dbf8b158f381a4dc7c","observation_id":"bf3f3a87-9bc6-44df-8de6-3110c42fc581","resolution":{"observed_at":"2026-08-06T19:19:32.712440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.715398Z","title":"Belongie","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.715398Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:c5e722aeb6510f2d92c5e20c8414057c72c10b18d277e3607f856c632feb7c67","observation_id":"dc5ef23a-c6c7-4892-b421-0a72d9516478","resolution":{"observed_at":"2026-08-06T19:19:32.715398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04698","last_updated":"2025-05-13T06:42:52Z","snapshot_observed_at":"2026-08-07T17:10:22.188545Z","submitted_at":"2025-01-08T18:59:01Z","title":"ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04698","snapshot_observed_at":"2026-08-06T19:19:32.718300Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.718300Z"},"links":{"cited_paper":"/paper/2501.04698","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:83e8af83d800ccd0b3f4be6fe4978227a7ba17135273080a5a6d1a83162d8aaa","observation_id":"e6a7988e-ba77-4313-8e12-a66031786887","resolution":{"observed_at":"2026-08-06T19:19:32.718300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11831","last_updated":"2024-10-15T17:56:32Z","snapshot_observed_at":"2026-08-03T21:35:04.144048Z","submitted_at":"2024-10-15T17:56:32Z","title":"CoTracker3: Simpler and Better Point Tracking by Pseudo-Labelling Real Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11831","snapshot_observed_at":"2026-08-06T19:19:32.723415Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.723415Z"},"links":{"cited_paper":"/paper/2410.11831","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:5f7be314ef26e4cb7ac17c2d6a4471af4f29aa9fc65a9b551bb4b2f5385e7b38","observation_id":"75382ee8-5cc4-4c38-9d3c-28fb3b1fd6ff","resolution":{"observed_at":"2026-08-06T19:19:32.723415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.693674Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":"31eddf01-8ff9-4f36-8496-644d1a37a0c0","year":2015},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.726024Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:b6a8f9ee25acab491f3ac91533bd839d684667ab94bf06843b92e41b61fed7f2","observation_id":"662c5e11-d6d5-466b-b3d0-983a065aaff0","resolution":{"observed_at":"2026-08-06T19:19:33.696392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T19:19:32.729402Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.729402Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:c17b494060ba543cff4de19db5ae81bacbff203e53768d48548a38c8a0baa8ec","observation_id":"f5f1de0d-664e-4e93-bfb5-e44e35800fb3","resolution":{"observed_at":"2026-08-06T19:19:32.729402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.684986Z","title":null,"venue":null,"work_id":"f2a0ea9e-5f6c-405f-9d5a-c1a7b2a789a7","year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.732659Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:904cbc1d33d3923a4c8c9b2b24f50563bc3cfa39b3204744bf04e654ad687269","observation_id":"416969e8-0ea3-40a8-b229-4721deae0f3c","resolution":{"observed_at":"2026-08-06T19:19:33.688349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.677222Z","title":null,"venue":null,"work_id":"5f422ade-4544-40d6-b863-7f05ed22c914","year":2022},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.738465Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:7d01ff278048eb2fe5b62a9cb3ce40f167532178f713f4ebf0a75ec54f7c67ad","observation_id":"99d10444-7524-458b-81cb-9b6756c15095","resolution":{"observed_at":"2026-08-06T19:19:33.680317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.741413Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.741413Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:95a65a6c9455120b78fc3ef9d6dfddd31f3fb738eac1c6464cf1e0b066fb789c","observation_id":"9e6c64cf-85a0-4afd-8142-a494d579fc34","resolution":{"observed_at":"2026-08-06T19:19:32.741413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.747559Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.747559Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:8d61d6a04df57cf1e66a31989b2edca8203fc35f17313c07de75f37cf42ffebf","observation_id":"58fa5504-5905-4b2b-85a9-f81d5eb6c763","resolution":{"observed_at":"2026-08-06T19:19:32.747559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.753385Z","title":"Lewis, and W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.753385Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:8c51145ff71100e7d5daf6250383830a5959ad67af881d75f12b8c4899a9ec4f","observation_id":"12261570-8aee-4e11-bd3d-8422735ecb4d","resolution":{"observed_at":"2026-08-06T19:19:32.753385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.659028Z","title":null,"venue":null,"work_id":"a30d35d5-533c-4770-9ad7-7e484655f936","year":2022},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.756641Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:e1c4ef3f43869186f0bb5f7367f5b0a7689de140161c4cfca74d5d10245e0a10","observation_id":"bdbafbff-f22a-40b6-8a28-aa64b977fbb4","resolution":{"observed_at":"2026-08-06T19:19:33.661515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.650906Z","title":null,"venue":null,"work_id":"bc8eb37f-00b6-4d05-86af-db5abcdefc6b","year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.759920Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:cc3760d51d3f1a6306e760d2e69f3fbb1dffc420bd8cbf331c31ca2e9fcdca19","observation_id":"96f2e214-38d0-4c61-970b-83968411f596","resolution":{"observed_at":"2026-08-06T19:19:33.653783Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.763213Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.763213Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:a31f4b2ade9c7570a128bbbf20f8105a1ac8c6ac0e5e1c733d10d7278b0eb6f1","observation_id":"84626625-3669-47d4-b636-437e5bec0db4","resolution":{"observed_at":"2026-08-06T19:19:32.763213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-06T19:19:32.766455Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.766455Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:7f5ddedb664b12227f26307bb89804179d7065356ed9c2f70d472a098f24854e","observation_id":"03b093e9-5210-4af3-b679-40633855ac20","resolution":{"observed_at":"2026-08-06T19:19:32.766455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.643053Z","title":null,"venue":null,"work_id":"c2126782-a947-4961-8ccb-3bf1c6d81b23","year":2021},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.769349Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:0d9a72199cc7dc64739cdea370ecfb3aed19b49811a8b354100a41da96f99881","observation_id":"f6d8ec5c-290b-4025-a544-72362122ae93","resolution":{"observed_at":"2026-08-06T19:19:33.645652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-06T19:19:32.772303Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.772303Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:ee2eb680f2b6d0c7c7f8aefee492026d42ca3f09c4fc203d84d56fc4d24ac776","observation_id":"f260c96b-52f4-4030-aeb8-6da56438729e","resolution":{"observed_at":"2026-08-06T19:19:32.772303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.775391Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.775391Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:b7eb835f1d7364ddf863ad8bba9a4b95a8b36b9da26247efe78fce40ae85a77d","observation_id":"3b8d167b-adf7-4cec-825d-760780f505b6","resolution":{"observed_at":"2026-08-06T19:19:32.775391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.634494Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"07630ee7-e9f9-4fc8-95a0-74108f3e979e","year":2017},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.781564Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:33b0efd544a1a36628775c6abfcb615876279d1fcb951b37d53651603683bbe5","observation_id":"8d69a452-23cd-404a-ad0c-bf499b7346b2","resolution":{"observed_at":"2026-08-06T19:19:33.638121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.785118Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.785118Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:f05561cb74275f7f8789ef4b87063b8087723335cb7e1291363bf40709520747","observation_id":"d8bdaf3e-3966-4774-8c9c-9540635a12d6","resolution":{"observed_at":"2026-08-06T19:19:32.785118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15214","last_updated":"2025-03-28T07:08:24Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:56Z","title":"LeviTor: 3D Trajectory Oriented Image-to-Video Synthesis","version":2},"cited_work":{"arxiv_id":"2412.15214","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15214","snapshot_observed_at":"2026-08-06T19:19:33.137921Z","title":"LeviTor: 3D Trajectory Oriented Image-to-Video Synthesis","venue":"cs.CV","work_id":"84d80b7b-91ef-412d-84d4-43796734566d","year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.787994Z"},"links":{"cited_paper":"/paper/2412.15214","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:a57663b8efbf428bfccc6c786a1273d8e251fe074224fa2e2e6f01ce514eb961","observation_id":"ae5b0764-e846-4b18-9cd6-c05959a633bc","resolution":{"observed_at":"2026-08-06T19:19:33.142053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-07T17:54:54.749604Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-06T19:19:32.791046Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.791046Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:7da36ed778bd71ab3a32f141dc55974371320da1af9849697a2ab22a9d4f4f89","observation_id":"bea9ee0d-24ae-4b3a-a14c-954a2a8e8211","resolution":{"observed_at":"2026-08-06T19:19:32.791046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.625834Z","title":null,"venue":null,"work_id":"e2a75dde-0cc1-4138-9bd7-5bf44eb476f3","year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.794812Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:1eaecd02b73d736134dbd9ab8c66eebde1ae7df299b31712524cfedfdc9fcc51","observation_id":"3bfa7c37-2c0f-4f1f-b41f-6b9790a6fb6c","resolution":{"observed_at":"2026-08-06T19:19:33.629170Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03641","last_updated":"2024-07-16T17:27:10Z","snapshot_observed_at":"2026-07-06T16:57:51.263433Z","submitted_at":"2023-12-06T17:49:57Z","title":"MotionCtrl: A Unified and Flexible Motion Controller for Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03641","snapshot_observed_at":"2026-08-06T19:19:32.801506Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.801506Z"},"links":{"cited_paper":"/paper/2312.03641","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:0e070b8c17acbd3f628884159bc86364c53ad7e16590df67f746ad925de5144d","observation_id":"ce584b98-af79-4a62-8e1c-6977b0b4dc70","resolution":{"observed_at":"2026-08-06T19:19:32.801506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.805554Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.805554Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:ae12f092a38df262cac6144dc048f7d7ee2b685766d2f5a1c370ca5e5089c193","observation_id":"58a01c6e-bdcc-4d81-9e8a-3335c06686a8","resolution":{"observed_at":"2026-08-06T19:19:32.805554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13830","last_updated":"2024-10-17T17:52:57Z","snapshot_observed_at":"2026-08-04T21:33:12.208001Z","submitted_at":"2024-10-17T17:52:57Z","title":"DreamVideo-2: Zero-Shot Subject-Driven Video Customization with Precise Motion Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13830","snapshot_observed_at":"2026-08-06T19:19:32.808058Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.808058Z"},"links":{"cited_paper":"/paper/2410.13830","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:987b4db132b128799c3bbfed6ac38557c61382e2085cf9d59e6292ea8789193a","observation_id":"a5d0f6d7-e87d-4094-b86f-b83cfeac222b","resolution":{"observed_at":"2026-08-06T19:19:32.808058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17758","last_updated":"2024-10-29T11:56:27Z","snapshot_observed_at":"2026-07-06T18:36:51.761148Z","submitted_at":"2024-06-25T17:42:25Z","title":"MotionBooth: Motion-Aware Customized Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17758","snapshot_observed_at":"2026-08-06T19:19:32.810973Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.810973Z"},"links":{"cited_paper":"/paper/2406.17758","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:3474348b84c7d48f52e6ade4b74b183dfd37adc95c9322b963ccd96a725070c2","observation_id":"3d14095e-a6ca-47ed-967e-2f705de22637","resolution":{"observed_at":"2026-08-06T19:19:32.810973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-72670-5_19","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.872082Z","title":null,"venue":null,"work_id":"72af74b7-e1d5-4f9b-a575-fc7ff6287f74","year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.813828Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:708e534160b16ac15058686ca3ed5128262d8d2453d24dbe55749c25f59e2972","observation_id":"1ae47dde-4bec-4506-bfe4-19f52dcf1838","resolution":{"observed_at":"2026-08-06T19:19:32.876234Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.816886Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.816886Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:1d613423823214ddac61e9036f767408fb13c305c8d4891258aec19f20cc1657","observation_id":"3eb82112-e176-4ff2-9c2c-2e4a19fd315d","resolution":{"observed_at":"2026-08-06T19:19:32.816886Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T19:19:32.820584Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.820584Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:06948985a260c7bbf110bb47f1b79f707564fff0ad2f5aa4e916c8b24b1a0683","observation_id":"9e0eb750-03da-4d23-8af8-c54c7691d235","resolution":{"observed_at":"2026-08-06T19:19:32.820584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T19:19:32.823127Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.823127Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:a83a677a9169003c69eeaff293ca71a0c782652a1d6992a50f49d19123a8d97e","observation_id":"02ed10ef-bede-46f4-a483-cd6bb016f8a8","resolution":{"observed_at":"2026-08-06T19:19:32.823127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-06T19:19:32.826492Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.826492Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:64a69bc7826d3e8d0fdfd5bc130034e872b9ba36a5502ed30531de7ad95d1a14","observation_id":"7bef87a3-95cb-46e3-bdc8-2c827d1f890a","resolution":{"observed_at":"2026-08-06T19:19:32.826492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-08-06T19:19:32.829938Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.829938Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:8a675174f6c6c10310e613ca5e4794240984e9fddb03ec88948f93ea22760fbb","observation_id":"db2135ed-0ae7-4693-9b1c-363150118714","resolution":{"observed_at":"2026-08-06T19:19:32.829938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.617743Z","title":"Hauptmann, Ming-Hsuan Yang, Yuan Hao, Irfan Essa, and Lu Jiang","venue":null,"work_id":"c352933b-be29-4a44-b7d2-cd03c9c1eb00","year":null},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.832727Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:fd570ff5912714d3aaa8fd40557273bf3524ebafc780aa7a4fd9bfcdc228ae3a","observation_id":"aab7c5a2-580c-4af0-ab5c-be6a183447d4","resolution":{"observed_at":"2026-08-06T19:19:33.621249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17440","last_updated":"2025-03-25T23:08:48Z","snapshot_observed_at":"2026-07-06T19:57:18.481261Z","submitted_at":"2024-11-26T13:58:24Z","title":"Identity-Preserving Text-to-Video Generation by Frequency Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17440","snapshot_observed_at":"2026-08-06T19:19:32.838413Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.838413Z"},"links":{"cited_paper":"/paper/2411.17440","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:88940a400bb7a40737ea3f324c4876c6d2983c921f65395162ed72c040607aa0","observation_id":"9a45fe12-994c-4630-b9ce-94e3317f18ec","resolution":{"observed_at":"2026-08-06T19:19:32.838413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-06T19:19:32.841304Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.841304Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:d83f6935d7ab3719a0c04291ec0995e1871cdfeb32f9c7330954afdcab96c0ea","observation_id":"e6505ed6-933f-425c-8908-88abddc4d402","resolution":{"observed_at":"2026-08-06T19:19:32.841304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21705","last_updated":"2025-03-14T03:03:31Z","snapshot_observed_at":"2026-07-06T18:55:07.177656Z","submitted_at":"2024-07-31T15:53:20Z","title":"Tora: Trajectory-oriented Diffusion Transformer for Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21705","snapshot_observed_at":"2026-08-06T19:19:32.844361Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.844361Z"},"links":{"cited_paper":"/paper/2407.21705","citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:f99400b946ffc6c0bfb147b9cbc84d137ddcbfc39ae99ced43a68e2883c6a3a3","observation_id":"6a7ba737-4382-4c06-a889-d4119f6ef446","resolution":{"observed_at":"2026-08-06T19:19:32.844361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.847246Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.847246Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:0172f0600ef1b12ef36fbc99b6803f4da0572f86d7408ad6b092ec078e30d9ca","observation_id":"69a6ed76-dc13-448f-8cae-20174372f285","resolution":{"observed_at":"2026-08-06T19:19:32.847246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.850168Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.850168Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:10db39141179aab205b644a4b86ba1fb297f8b1bc56d18756f982c468a67ab05","observation_id":"3583f5cc-ea83-4274-8a10-8aa5bb00644a","resolution":{"observed_at":"2026-08-06T19:19:32.850168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.665895Z","title":null,"venue":null,"work_id":"557eb124-17f6-4492-a2fb-5afeb17d9235","year":2022},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.750688Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:91aaa55579fdaca3ef14556b7ca52d3a3e1404dd84ba0bb7565bc9f5bc98b49a","observation_id":"5298f6c8-9cf2-4937-bd9d-30b3273cf454","resolution":{"observed_at":"2026-08-06T19:19:33.668874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:32.835374Z","title":"InIEEE Conf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.835374Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:03e81e4a0cdd9d02c2cf1c1f4befc491199c56ddde968487cd9d7910c7fb01d3","observation_id":"ebc512b1-0392-4144-b927-bcab6607cb28","resolution":{"observed_at":"2026-08-06T19:19:32.835374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:19:33.606909Z","title":null,"venue":null,"work_id":"8135ceb1-4dcf-4917-87f6-2c6e74bc19b1","year":2024},"citing_paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:19:32.853110Z"},"links":{"citing_paper":"/paper/2507.05963"},"observation_digest":"sha256:4f53303d90e2fac826de0237d49c178e98ad20b81c998a822abc73c3469c7d4a","observation_id":"80423c71-d15d-492c-96e4-992d8b721356","resolution":{"observed_at":"2026-08-06T19:19:33.609516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05963","last_updated":"2025-07-09T07:01:34Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T03:43:57.352835Z","submitted_at":"2025-07-08T13:11:40Z","title":"Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2507.05963."}