{"as_of":"2026-08-08T03:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d81ccc4630263cbc6c797ffe29fcad6a2713f40ed3912c4a288fdce7a45642a","coverage":[{"denominator":121,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:25:28.645155Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.05678/citation-record","integrity":"/paper/2507.05678/integrity","json":"/paper/2507.05678/citation-record.json","paper":"/paper/2507.05678"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.18673","last_updated":"2025-05-06T13:11:14Z","snapshot_observed_at":"2026-07-06T19:58:13.816588Z","submitted_at":"2024-11-27T18:49:13Z","title":"AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18673","snapshot_observed_at":"2026-08-06T19:25:27.901583Z","title":"Ac3d: Analyzing and improving 3d camera control in video diffusion trans- formers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.901583Z"},"links":{"cited_paper":"/paper/2411.18673","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:6a67691e249484840da1ac29f53f29200d48e7662d006bc804cb5660fe69101c","observation_id":"bb4b803a-b2d9-49db-9fca-e734ec4d3cc4","resolution":{"observed_at":"2026-08-06T19:25:27.901583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.908945Z","title":"Scaling learning algo- rithms towards AI","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.908945Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2a16155a4fcd8c4ec0336e215aa5e593470cab188a5dd1ade7681004ac0fce13","observation_id":"659403e8-6fc7-4efe-a971-169b07e861f2","resolution":{"observed_at":"2026-08-06T19:25:27.908945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.915710Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.915710Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:245d53a97f775a36e01c4ff48419f3e50ecca283f541a441de4da1a3368f6a98","observation_id":"479d2291-927d-4602-8288-455babe42b7c","resolution":{"observed_at":"2026-08-06T19:25:27.915710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T19:25:27.926620Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.926620Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:3c633fac34250c9263c162dfd5456b8804c69a29c09e1581b0ce77d0ac67deae","observation_id":"6f5c573a-b932-4538-94ec-16987f5bc3a8","resolution":{"observed_at":"2026-08-06T19:25:27.926620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.934400Z","title":"Align your latents: High-resolution video synthe- sis with latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.934400Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a8fcb9d53ba0efdb847094b8e2ad0e15371e107882fd8cc7b022193bb9a53626","observation_id":"5c144f3c-bb33-431c-8a15-fe3070cfc85b","resolution":{"observed_at":"2026-08-06T19:25:27.934400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.940235Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.940235Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:dabb3025e7128c46fdf216dab2016c6d988475c9a49e7a1629856879b26c9a7b","observation_id":"ad38f38f-5eaa-421d-86f8-e88cf1b10343","resolution":{"observed_at":"2026-08-06T19:25:27.940235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.947458Z","title":"Mvsformer: Multi-view stereo by learning robust image features and temperature-based depth","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.947458Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:59611757cb5f6b1afbe04c2a6c9e7b4e7d13d15c6773044fc4a9b8ce3b00f705","observation_id":"d7087095-442d-430d-88c8-73500ea2d96b","resolution":{"observed_at":"2026-08-06T19:25:27.947458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08674","last_updated":"2024-07-11T17:06:53Z","snapshot_observed_at":"2026-07-06T18:44:57.578408Z","submitted_at":"2024-07-11T17:06:53Z","title":"Still-Moving: Customized Video Generation without Customized Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08674","snapshot_observed_at":"2026-08-06T19:25:27.961459Z","title":"Still-moving: Customized video generation without customized video data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.961459Z"},"links":{"cited_paper":"/paper/2407.08674","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:c808f670a4eba0e43838398c8b1e0b6ab4bb1389216bfa8752d15cd147de09a9","observation_id":"aa11c1e8-73bc-49aa-98ac-3d334a9e9e8a","resolution":{"observed_at":"2026-08-06T19:25:27.961459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10150","last_updated":"2025-01-08T15:15:12Z","snapshot_observed_at":"2026-07-06T17:17:27.444056Z","submitted_at":"2024-01-18T17:22:37Z","title":"Motion-Zero: Zero-Shot Moving Object Control Framework for Diffusion-Based Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10150","snapshot_observed_at":"2026-08-06T19:25:27.973928Z","title":"Motion-zero: Zero-shot mov- ing object control framework for diffusion-based video gen- eration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.973928Z"},"links":{"cited_paper":"/paper/2401.10150","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:9a60649ecd35764bf55bad9325f3ca29e324682a9cae7489ac00ea95de77aaca","observation_id":"69d2d4ed-0b5c-41a4-bd3d-c6afdf3d927e","resolution":{"observed_at":"2026-08-06T19:25:27.973928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-07T10:15:15.859263Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T19:25:27.981103Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.981103Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:ae9ad79f00021953d9f4c240bb2673ebfd0c2eebdf30c34fd434eab610034aab","observation_id":"15d65ccb-59b8-430d-991f-7d4d86189b12","resolution":{"observed_at":"2026-08-06T19:25:27.981103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.992339Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.992339Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:310ec5cb4df53f184243fc747cedabf70689c833f6ef4b31b73d10c45d07ea53","observation_id":"f029a99e-a435-46da-bc96-bbdfc27a00b0","resolution":{"observed_at":"2026-08-06T19:25:27.992339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.000425Z","title":"Seine: Short-to-long video diffu- sion model for generative transition and prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.000425Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:63ab30fc9e02d3ba8e9428dc4cde8faaa5036464ef5a212c6338b27dccf13dd6","observation_id":"6a642508-7fae-4b6e-bbed-02d2761e118a","resolution":{"observed_at":"2026-08-06T19:25:28.000425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.005392Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.005392Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:774f1502fafdda0355203fffccc5301a205ddb852e7dcd2f23a0010b5255c137","observation_id":"d4143bc7-f2c6-4ae3-ade4-56b32d450860","resolution":{"observed_at":"2026-08-06T19:25:28.005392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.012429Z","title":"Parameter-efficient fine-tuning of large-scale pre-trained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.012429Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:d33215c1c3701689c6c8640493fe19ae31821c66df67a36013ba4f745a26e601","observation_id":"416d7ea5-bdf8-4f2d-857b-ddec80aeca2a","resolution":{"observed_at":"2026-08-06T19:25:28.012429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.018612Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.018612Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:4ddadea13ae69b8abb46645e4d4f3ccb5679781fe2f6f8923697c45e7224942e","observation_id":"29ba5a0e-6d2f-45fd-ab6f-e163f789f716","resolution":{"observed_at":"2026-08-06T19:25:28.018612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.028943Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.028943Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:418b4c865162b5dadee93b778dbcc02f98826424abe3939bb6c6e873a0713c60","observation_id":"01e9fa65-7eb8-4d29-84d8-b0fdc2ecf9c7","resolution":{"observed_at":"2026-08-06T19:25:28.028943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06525","last_updated":"2025-02-28T06:40:38Z","snapshot_observed_at":"2026-07-06T19:48:05.525731Z","submitted_at":"2024-11-10T16:59:39Z","title":"I2VControl-Camera: Precise Video Camera Control with Adjustable Motion Strength","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06525","snapshot_observed_at":"2026-08-06T19:25:28.036792Z","title":"I2vcontrol-camera: Precise video camera control with adjustable motion strength","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.036792Z"},"links":{"cited_paper":"/paper/2411.06525","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:ca10324cfceb8f32fb628f01b8db3faa565bf55e9cf04c21d0e0657ed973054d","observation_id":"f565dae8-8858-4085-9f20-d5a11b6a27dc","resolution":{"observed_at":"2026-08-06T19:25:28.036792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.042603Z","title":"Preserve your own cor- relation: A noise prior for video diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.042603Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:89288c0f979694fad6dd2cb31571ae37ed161d26d027e5797b5e6b559db8d71b","observation_id":"aa9e0dd6-9118-4d29-ac13-42d77efe553b","resolution":{"observed_at":"2026-08-06T19:25:28.042603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10709","last_updated":"2024-08-02T18:55:25Z","snapshot_observed_at":"2026-08-02T11:56:15.393496Z","submitted_at":"2023-11-17T18:59:04Z","title":"Emu Video: Factorizing Text-to-Video Generation by Explicit Image Conditioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10709","snapshot_observed_at":"2026-08-06T19:25:28.048695Z","title":"Emu video: Factoriz- ing text-to-video generation by explicit image conditioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.048695Z"},"links":{"cited_paper":"/paper/2311.10709","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:de185d25b6dae02ddce883ba2607eefc9701c51c9d3810470f8cc4d3c25d103b","observation_id":"3f5dd659-901c-45e7-aeb2-0eab12855c8c","resolution":{"observed_at":"2026-08-06T19:25:28.048695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.059760Z","title":"Deep learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.059760Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:bc43ac8e50c911abf5f13b0948e618658c5fd24204aa1760fbd9fee21eeac75d","observation_id":"a8e739df-6c96-4f4e-b602-81ebacf61bfd","resolution":{"observed_at":"2026-08-06T19:25:28.059760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16933","last_updated":"2023-11-28T16:33:08Z","snapshot_observed_at":"2026-07-06T16:53:55.269172Z","submitted_at":"2023-11-28T16:33:08Z","title":"SparseCtrl: Adding Sparse Controls to Text-to-Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16933","snapshot_observed_at":"2026-08-06T19:25:28.065592Z","title":"Sparsectrl: Adding sparse con- trols to text-to-video diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.065592Z"},"links":{"cited_paper":"/paper/2311.16933","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:304ed845a2b681b1cdb003a8ac4fef21419e87eaa75ca7b16b70f47308575d03","observation_id":"bfd6b53b-71f0-4045-a02e-60a64cf5e295","resolution":{"observed_at":"2026-08-06T19:25:28.065592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T19:25:28.082739Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.082739Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:bbdf524fadf5efe142f573a29d4f4a43be8d8a600a643ae337df393f462f6a3c","observation_id":"d781f33d-65ed-4885-afbe-211cd3f35677","resolution":{"observed_at":"2026-08-06T19:25:28.082739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-06T19:25:28.087675Z","title":"Cameractrl: En- abling camera control for text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.087675Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:5b75c97e919772cb0304bf20b41eac567e4b05b6cdfad3496d0d3a60759c14c1","observation_id":"5dfc89ce-96c4-4810-bc20-961025596c76","resolution":{"observed_at":"2026-08-06T19:25:28.087675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.094595Z","title":"Co-speech gesture video genera- tion via motion-decoupled diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.094595Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:4e68b36762cf7d0369e308db1b3d4548219301c2ba1b5d7f1ec1a86e31017137","observation_id":"98ef21f2-44b4-44fc-95d4-bced516bb387","resolution":{"observed_at":"2026-08-06T19:25:28.094595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.101760Z","title":"Epipolar transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.101760Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7492332ece190c1e3e025db2de214dbcbaac7a0044c1c8ef74206920367af03c","observation_id":"318f8b21-fa0f-467e-b0fb-51a85d45aaab","resolution":{"observed_at":"2026-08-06T19:25:28.101760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-07-06T14:22:24.004857Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-06T19:25:28.108360Z","title":"Latent video diffusion models for high-fidelity long video generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.108360Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:d43fe8580732bbb58542833738e4008baccd59f8107ad4abc72df8c76204ff8f","observation_id":"a6326546-dab6-4310-97ec-64de28790f88","resolution":{"observed_at":"2026-08-06T19:25:28.108360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.116331Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.116331Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:182810de0f547936e31281c55064fe238e243ae0fcdf5424d24bb144d7ac7082","observation_id":"a6ba4793-bca3-4dc6-91cf-0b412fc88e4b","resolution":{"observed_at":"2026-08-06T19:25:28.116331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.122033Z","title":"Hinton, Simon Osindero, and Yee Whye Teh","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.122033Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2fe1e6c4b35817fd0809241633bd8096a0842887dd081184d85a012fe400c785","observation_id":"b21372c1-1638-4277-a7cd-a46cc453fcc4","resolution":{"observed_at":"2026-08-06T19:25:28.122033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T19:25:28.131571Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.131571Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7c303d2dab0c3e520d26d9c95987509ff184c2bbd385ecfa0017fe2f6408be82","observation_id":"20ad04ba-cd74-4cfc-bc89-278f7e9893eb","resolution":{"observed_at":"2026-08-06T19:25:28.131571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.138404Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.138404Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7b08939c591200528f571c324927cb78e5ca786fd981a76aad60c37effa6d79c","observation_id":"6534bfa1-3523-4bde-851d-67b1243ab395","resolution":{"observed_at":"2026-08-06T19:25:28.138404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T19:25:28.152738Z","title":"Lora: Low-rank adaptation of large language models.arXiv preprint arXiv:2106.09685, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.152738Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:46f4eb5c155622f1a5e1863d6f66433624ecb6b8466259c6b49681413a6d713e","observation_id":"8c875bc6-c240-4083-b023-9678ee54e717","resolution":{"observed_at":"2026-08-06T19:25:28.152738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.159982Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.159982Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:58f755acb3eec896c853e09c8940c955c119456f5c26127fb5426e79edde8d66","observation_id":"81c59291-4d5e-4f98-b027-1c3b60d97f7c","resolution":{"observed_at":"2026-08-06T19:25:28.159982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15789","last_updated":"2024-05-01T02:37:18Z","snapshot_observed_at":"2026-07-06T18:04:54.726338Z","submitted_at":"2024-04-24T10:28:54Z","title":"MotionMaster: Training-free Camera Motion Transfer For Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15789","snapshot_observed_at":"2026-08-06T19:25:28.165930Z","title":"Mo- tionmaster: Training-free camera motion transfer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.165930Z"},"links":{"cited_paper":"/paper/2404.15789","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a03cc9d5820737c5b7205196dbe5d7edada852895057d513f6f232faad39fd41","observation_id":"09e2d8b0-f7ab-47a5-b43e-8bfa92ee983b","resolution":{"observed_at":"2026-08-06T19:25:28.165930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13269","last_updated":"2024-08-19T03:31:19Z","snapshot_observed_at":"2026-07-06T15:58:08.777051Z","submitted_at":"2023-07-25T05:39:21Z","title":"LoraHub: Efficient Cross-Task Generalization via Dynamic LoRA Composition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13269","snapshot_observed_at":"2026-08-06T19:25:28.175661Z","title":"Lorahub: Efficient cross- task generalization via dynamic lora composition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.175661Z"},"links":{"cited_paper":"/paper/2307.13269","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:70d7f5c1a9c001b704c92af9249450941b05f77144dbe5e3208dd4d158a256d9","observation_id":"8297e1c4-b74b-4044-b004-dc1303d9888e","resolution":{"observed_at":"2026-08-06T19:25:28.175661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.185561Z","title":"Peekaboo: Interactive video generation via masked- diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.185561Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:0704fcb444b9c48ca218758de7d1670337c4647d2d4bf76ee803d138638b9d8b","observation_id":"e1a156d0-5fa0-4e40-952c-74a74d15b3be","resolution":{"observed_at":"2026-08-06T19:25:28.185561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.191479Z","title":"A survey of multimodal con- trollable diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.191479Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:571205168d36d2cd53f635f08adfea0e896a0bc75d8e3fa506b8f80f4f545e72","observation_id":"26e5c20d-e2b2-440d-a3c9-380b401c2968","resolution":{"observed_at":"2026-08-06T19:25:28.191479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.196912Z","title":"Consistent4d: Consistent 360° dynamic object gener- ation from monocular video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.196912Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:92e6064af8e0712681b5b5e76b4f08568986b9818d6eb66c346e01a638d9fd0d","observation_id":"f8b8b050-dfe6-45a5-88cc-2373917be3c2","resolution":{"observed_at":"2026-08-06T19:25:28.196912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.207923Z","title":"Animate3d: Animating any 3d model with multi-view video diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.207923Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:866878247f970b79c9e38797b2c22f59496e4781feefcf52d0afd3b46f81930b","observation_id":"30739176-2e02-4511-aa13-815b8346457c","resolution":{"observed_at":"2026-08-06T19:25:28.207923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.222210Z","title":"Spad: Spatially aware multi-view diffusers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.222210Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:27d3e7ea1e1ea7cbe6022cb68a324e473d850c3fde4bfb9cce6905c10a52ac07","observation_id":"19c5c7c1-2b5e-438d-8112-9e4b20a8ee95","resolution":{"observed_at":"2026-08-06T19:25:28.222210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.228235Z","title":"Co- tracker: It is better to track together","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.228235Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:f05711f7eac8052ec62ef2545d70bb69ea16289648af266f298fe6dd00c1090a","observation_id":"23a662ba-bbc9-4096-89a6-0084289c6fbc","resolution":{"observed_at":"2026-08-06T19:25:28.228235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.234440Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.234440Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:cd41ba013b1f6e2e321b052162c18872880fa2ab67e638874fcb014bb4c84a99","observation_id":"587556b8-1407-451f-abb6-83aef16250cd","resolution":{"observed_at":"2026-08-06T19:25:28.234440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T19:25:28.241286Z","title":"Hunyuanvideo: A systematic frame- work for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.241286Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:b4087efb19af25761f019f904a84252d1ec64d48f05bd7fc7a235cbf880c34d0","observation_id":"3d36a287-2444-4a78-b6f5-d80719df1b7c","resolution":{"observed_at":"2026-08-06T19:25:28.241286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.248424Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.248424Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:9e9397698293710b81438b47d0e1f51274622098a69343a90a60153f025d714b","observation_id":"986cec0b-11f0-41fb-9bfc-744a263a3d40","resolution":{"observed_at":"2026-08-06T19:25:28.248424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10059","last_updated":"2025-07-13T08:12:15Z","snapshot_observed_at":"2026-08-07T19:30:54.254942Z","submitted_at":"2025-02-14T10:21:49Z","title":"RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10059","snapshot_observed_at":"2026-08-06T19:25:28.257406Z","title":"Realcam-i2v: Real-world image- to-video generation with interactive complex camera con- trol","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.257406Z"},"links":{"cited_paper":"/paper/2502.10059","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:e64b0a8974efb0db11d9edcd6e22417a20a9b671344b2403d8c3314c39ea1ed8","observation_id":"a2f7f41d-cd25-4ba8-b417-106690dcdd37","resolution":{"observed_at":"2026-08-06T19:25:28.257406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.263256Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.263256Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:9d897141ef6eb3ae1a46b2f7066774e5da46aaa84548575c878cc8b4697022a3","observation_id":"6a00fbd4-699c-4c92-81fc-39f70875d4c7","resolution":{"observed_at":"2026-08-06T19:25:28.263256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.272483Z","title":"Generative image dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.272483Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:60a8223eea4966da4063aed39b2e6adb553134a02b5bdd1d5c951153c8fa2bff","observation_id":"f8947772-6a2b-4443-995e-90eeb9056db0","resolution":{"observed_at":"2026-08-06T19:25:28.272483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-06T19:25:28.277835Z","title":"Open-sora plan: Open-source large video generation model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.277835Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:c1e55560e6b9f7c6b395f8ac9200a589ebecca977ff76dd21d95688a0ea2f89d","observation_id":"a8cd39e5-82eb-46f8-a618-d7bb3e907bec","resolution":{"observed_at":"2026-08-06T19:25:28.277835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.284512Z","title":"Magic3d: High- resolution text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.284512Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7739191e036d788114cd157858cc98fc17bf9bd6da841af5a846a7df888cc32c","observation_id":"b1308da2-1597-4b26-9d35-a9c80a33a74d","resolution":{"observed_at":"2026-08-06T19:25:28.284512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.294426Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.294426Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2d8c47ade320e6decbef79d06f1c38dafbee64ae40220265c17ec968278d355f","observation_id":"661319d0-fa38-4e59-a8b9-de61566f206c","resolution":{"observed_at":"2026-08-06T19:25:28.294426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.300814Z","title":"Zero-1-to- 3: Zero-shot one image to 3d object","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.300814Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7c8fecbe54d81aa48b7ccac1056746ced17727129ca5d70fe071b33b76cf1561","observation_id":"50ac9d32-0635-48ba-ac64-904d7729f9ea","resolution":{"observed_at":"2026-08-06T19:25:28.300814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-02T13:01:06.918463Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-06T19:25:28.308116Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.308116Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:142e2a4d4b11e9f8afd141683129f18c387cbef54227df3acc9a42407c597815","observation_id":"0340335f-c1ea-4341-a78b-10d573741493","resolution":{"observed_at":"2026-08-06T19:25:28.308116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.314474Z","title":"Follow your pose: Pose- guided text-to-video generation using pose-free videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.314474Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:5e39adcfab476ccc12956f5a10f2766e172bc0f23d0907cb8e32b404f52f1c79","observation_id":"59a96822-259c-496a-b4cd-94ea57a38597","resolution":{"observed_at":"2026-08-06T19:25:28.314474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-07-06T11:34:54.333802Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-06T19:25:28.321318Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.321318Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a588ed2298a7ab7f96f5748d04d74166d54718e2d754a616ad6a5f67a0e10e16","observation_id":"151f142e-2e0b-4914-8555-42544cb7a23a","resolution":{"observed_at":"2026-08-06T19:25:28.321318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.326882Z","title":"On distillation of guided diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.326882Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a2658c953bba7698fe853527e60731575096fd1964c0fcf48e9912152a87adaf","observation_id":"06af80e2-42b6-417c-9cdb-fe6ac32aa1f3","resolution":{"observed_at":"2026-08-06T19:25:28.326882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.331820Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.331820Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:86772bf76e12a22b2dce46f673384bbbd83b52ac86e24ccec6a3696632d6116e","observation_id":"2c0e195b-e141-4d5b-ae61-df90144dc82d","resolution":{"observed_at":"2026-08-06T19:25:28.331820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.339198Z","title":"T2i-adapter: Learn- ing adapters to dig out more controllable ability for text-to- image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.339198Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:3615f0eaec8e3369edbc6d1a3fb66c1bf69fcd0a0e2e52d697ca4bb9063a92ae","observation_id":"15830ac2-12bd-4209-9b51-bb2429f7d787","resolution":{"observed_at":"2026-08-06T19:25:28.339198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04989","last_updated":"2025-02-25T17:27:47Z","snapshot_observed_at":"2026-08-04T03:59:52.003288Z","submitted_at":"2024-11-07T18:56:11Z","title":"SG-I2V: Self-Guided Trajectory Control in Image-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04989","snapshot_observed_at":"2026-08-06T19:25:28.344139Z","title":"Sg-i2v: Self- guided trajectory control in image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.344139Z"},"links":{"cited_paper":"/paper/2411.04989","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:557ba4bc738a5d5fa19e3a739429dd08fe37c5967e1d519adce9bf34469cddbc","observation_id":"b9073dfa-b28b-4e8a-a54a-89e3025d6cbd","resolution":{"observed_at":"2026-08-06T19:25:28.344139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18461","last_updated":"2025-03-02T12:44:06Z","snapshot_observed_at":"2026-08-07T17:49:16.116942Z","submitted_at":"2025-02-25T18:59:12Z","title":"K-LoRA: Unlocking Training-Free Fusion of Any Subject and Style LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18461","snapshot_observed_at":"2026-08-06T19:25:28.349449Z","title":"K-lora: Unlock- ing training-free fusion of any subject and style loras.arXiv preprint arXiv:2502.18461, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.349449Z"},"links":{"cited_paper":"/paper/2502.18461","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2eb3fc65aec22c658b4de8e5c6fba71a683407bb9bc4d48414b9c3828b073761","observation_id":"907d01d0-c2c0-4f51-a4da-d2cadf9a67db","resolution":{"observed_at":"2026-08-06T19:25:28.349449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.358091Z","title":"Global Structure-from-Motion Revisited","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.358091Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:1e3e66103607aea7531480ff435028204c97ee81c4790603cdd4839d9e725996","observation_id":"df301191-9c40-4d96-859b-650f9d7e3228","resolution":{"observed_at":"2026-08-06T19:25:28.358091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.363569Z","title":"Scalable diffusion mod- els with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.363569Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:d52d6c72cb924042c3070784d9664905eb232354eadb50091d7d338b6648b0b4","observation_id":"1cb4a8d4-95c1-4469-bbba-ea82907d23cd","resolution":{"observed_at":"2026-08-06T19:25:28.363569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06070","last_updated":"2025-03-08T08:43:03Z","snapshot_observed_at":"2026-07-06T18:59:34.520274Z","submitted_at":"2024-08-12T11:41:18Z","title":"ControlNeXt: Powerful and Efficient Control for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06070","snapshot_observed_at":"2026-08-06T19:25:28.370404Z","title":"Controlnext: Powerful and effi- cient control for image and video generation.arXiv preprint arXiv:2408.06070, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.370404Z"},"links":{"cited_paper":"/paper/2408.06070","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:19c22aea1f4044b76ed7898e20b667b1e199e985b7f2fb7e5b88a81901fde7fe","observation_id":"cef70ea0-f8cb-4780-bbfc-789b0a089316","resolution":{"observed_at":"2026-08-06T19:25:28.370404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.375612Z","title":"Analytisch-Geometrische Entwicklungen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.375612Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:aabbc24c7c3c96b91fcaf2e5e8fa71d436ac6ccdc9f61bb21619daa7b7fed5bd","observation_id":"433439a7-ba41-4f5b-bcf7-ef17639fc7e7","resolution":{"observed_at":"2026-08-06T19:25:28.375612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-06T19:25:28.383145Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.383145Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:72f7bc95a204abc6feb3b8e63e61a71d7e9d70f7511704486918771742ac8713","observation_id":"9d4ccddd-5101-4fec-8c30-7838581f1252","resolution":{"observed_at":"2026-08-06T19:25:28.383145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-06T19:25:28.390174Z","title":"Hierarchical text-conditional image generation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.390174Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:0d279eaf4d69f3a80b95a9c7266f9f436d655e6e0d989c72ae06007b03dbf5ae","observation_id":"5c75b183-2bd9-4926-8f8c-ce3ec0a2008d","resolution":{"observed_at":"2026-08-06T19:25:28.390174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04324","last_updated":"2024-07-01T03:57:55Z","snapshot_observed_at":"2026-08-04T02:26:31.748049Z","submitted_at":"2024-02-06T19:08:18Z","title":"ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04324","snapshot_observed_at":"2026-08-06T19:25:28.396056Z","title":"Consisti2v: En- hancing visual consistency for image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.396056Z"},"links":{"cited_paper":"/paper/2402.04324","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:ad7c4e3e02421766256707f921e71a16d87cdf8df279b06aa4c485df62d08f0e","observation_id":"bcba4b91-6999-41c5-9b81-fac20d222ce1","resolution":{"observed_at":"2026-08-06T19:25:28.396056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.403350Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.403350Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:336ff8b636652efd425a97357be93bb7ce49f22493e1a0f8123c8dfe3db21eea","observation_id":"6771a957-5fa1-4c6f-8ba2-8ae87212cb52","resolution":{"observed_at":"2026-08-06T19:25:28.403350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.413485Z","title":"Mm-diffusion: Learning multi-modal diffusion mod- els for joint audio and video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.413485Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:e8b9c6dba62ba700b5c3520b2cce76635f97c6edf450b69b4f04fd94a51a488e","observation_id":"90f1b51e-584c-4041-9ace-de1ef9ece206","resolution":{"observed_at":"2026-08-06T19:25:28.413485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:33.337802Z","title":"Gen-3 alpha","venue":null,"work_id":"3977f596-a393-4811-b954-d7fd7713ea67","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.419871Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2f56f86a3768ba99f8c2d6f8bd1c4c90e3841d57b83aeeb619aa3259c036c7ed","observation_id":"f20a4cbd-e81c-4c73-bb1d-f1783e107555","resolution":{"observed_at":"2026-08-06T19:25:33.395074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:33.218503Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":"58dac751-944e-423a-a3c3-35ef72623623","year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.428617Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:c362606210c8be8e218e54ecfab90e779033edb7488f7ae45fb880ed29b3df27","observation_id":"0584869b-a021-4ed2-8fd8-7ed76229aefe","resolution":{"observed_at":"2026-08-06T19:25:33.271231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.435992Z","title":"Structure-from-motion revisited","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.435992Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:cce7d84170e5349f153426a3b771630f82b436f8aab34413198ee8029b0c4a0a","observation_id":"ff4d4496-0c39-48ee-b56c-b0112a4c3263","resolution":{"observed_at":"2026-08-06T19:25:28.435992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:33.111671Z","title":"Structure-from-Motion Revisited","venue":null,"work_id":"4cda7a91-02e2-4b2f-82d9-651223afc1af","year":2016},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.442871Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:dd83f2057a557b73dfdfe4c4a0b8640200fe40cef95b0c23ac6a5f8ac74ecb10","observation_id":"c50a4da4-5ee1-4151-8566-17e282ca0c7f","resolution":{"observed_at":"2026-08-06T19:25:33.164491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.936228Z","title":"Pixelwise view selection for unstructured multi-view stereo","venue":null,"work_id":"73169ef5-08e3-497c-8589-c6c32d7c347c","year":2016},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.448276Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:5724d3881f14127f1b990ee3d19c1217746802d7412250db508ba599c406fd16","observation_id":"dd554bce-630c-42ba-80bf-edec40010b3b","resolution":{"observed_at":"2026-08-06T19:25:33.017680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.778278Z","title":"Ziplora: Any subject in any style by effectively merging loras","venue":null,"work_id":"1bc1735e-659a-4570-bdf4-fd54ecb833e3","year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.455212Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:d1d6f32fe0e3544fead3220be5822d13964f995113fa2ce9dfb332ed79ef2eec","observation_id":"9a8a278d-c0b6-4efa-8703-1616d2a8ca7e","resolution":{"observed_at":"2026-08-06T19:25:32.827955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05674","last_updated":"2024-04-08T16:55:49Z","snapshot_observed_at":"2026-08-05T11:14:17.753389Z","submitted_at":"2024-04-08T16:55:49Z","title":"MoMA: Multimodal LLM Adapter for Fast Personalized Image Generation","version":1},"cited_work":{"arxiv_id":"2404.05674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.05674","snapshot_observed_at":"2026-08-06T19:25:29.669593Z","title":"MoMA: Multimodal LLM Adapter for Fast Personalized Image Generation","venue":"cs.CV","work_id":"0103a678-8407-4842-aed9-19b8d56af99c","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.468845Z"},"links":{"cited_paper":"/paper/2404.05674","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:4f90e882d053069ce9449e17a84d3166990fc76e3f12f948dd857c9a91190df1","observation_id":"f5252754-2555-4908-a5df-f20c5573683e","resolution":{"observed_at":"2026-08-06T19:25:29.680556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-06T19:25:28.478735Z","title":"Score- based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.478735Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:b1945218792c2b38a791daf2aa7ba676fb3d7fc43f5a2487803347e024e87289","observation_id":"e3f62e5c-eac9-46c5-b392-b3af7754167a","resolution":{"observed_at":"2026-08-06T19:25:28.478735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04928","last_updated":"2024-11-07T18:07:31Z","snapshot_observed_at":"2026-08-06T07:44:13.960536Z","submitted_at":"2024-11-07T18:07:31Z","title":"DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04928","snapshot_observed_at":"2026-08-06T19:25:28.485901Z","title":"Dimensionx: Create any 3d and 4d scenes from a single image with con- trollable video diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.485901Z"},"links":{"cited_paper":"/paper/2411.04928","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:e9ed38e07179ea704016532a07b3adc08209bf39849fa5aba5166aa0a4678db2","observation_id":"aa499822-13ce-48d2-bfee-33fa71b14ed0","resolution":{"observed_at":"2026-08-06T19:25:28.485901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09305","last_updated":"2024-02-07T08:15:51Z","snapshot_observed_at":"2026-07-06T17:02:05.607732Z","submitted_at":"2023-12-14T19:18:38Z","title":"Stable Score Distillation for High-Quality 3D Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09305","snapshot_observed_at":"2026-08-06T19:25:28.493365Z","title":"Stable score distillation for high-quality 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.493365Z"},"links":{"cited_paper":"/paper/2312.09305","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:6ff93d237d8a817336930b3c5bd54a39ceb5ee6a1575164d2149956f20a94d71","observation_id":"32230957-325d-4f58-bd71-1d1f865fe31c","resolution":{"observed_at":"2026-08-06T19:25:28.493365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-06T19:25:28.499516Z","title":"Dreamgaussian: Generative gaussian splat- ting for efficient 3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.499516Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:0ef51ee943cda61b4cddfd3711ae0ad0a9423f3980b81855963cd0552dea04d3","observation_id":"4b768435-bf98-4eba-b45f-8ed33a645e6b","resolution":{"observed_at":"2026-08-06T19:25:28.499516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.602021Z","title":"Any-to-any generation via composable diffusion","venue":null,"work_id":"fd9db68b-e068-47ab-b007-3161dc2127f5","year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.505384Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:c73804afe01729679634ce91bf9e923f0f6d6b1c096ccef4b9deb71b97bc7591","observation_id":"029284de-5e81-4093-8751-f5984dfb5aca","resolution":{"observed_at":"2026-08-06T19:25:32.652113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17485","last_updated":"2024-08-08T03:48:38Z","snapshot_observed_at":"2026-07-06T17:36:11.854303Z","submitted_at":"2024-02-27T13:10:11Z","title":"EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17485","snapshot_observed_at":"2026-08-06T19:25:28.512015Z","title":"Emo: Emote portrait alive-generating expressive portrait videos with audio2video diffusion model under weak conditions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.512015Z"},"links":{"cited_paper":"/paper/2402.17485","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:13cf62b32a61dc9886788fdf4b17220c132fe3c3d2276ec7709deb26f4e27e47","observation_id":"373443ca-b19e-4fc8-b795-9da3e87a7a33","resolution":{"observed_at":"2026-08-06T19:25:28.512015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.433396Z","title":"Vision transformers need registers","venue":null,"work_id":"a5d42f1a-595d-4309-8d64-073ecc6f69a3","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.518091Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:21d9df4cf0b0ba31681a8b7b25b187091b635fa91bb52b88f09f113fecd4e316","observation_id":"9d407440-9fe4-4a45-8d7c-547fa84eccf5","resolution":{"observed_at":"2026-08-06T19:25:32.480367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.293562Z","title":"Consistent view syn- thesis with pose-guided diffusion models","venue":null,"work_id":"282999ea-39f9-43b7-a6b6-fb2765d34494","year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.523545Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:775b0384d72aa44b3e622b58afedb2824417e0dd1f6339e4979f47c30afc2a39","observation_id":"34ab8c20-16ed-4a51-b94b-38d4e4eaccc8","resolution":{"observed_at":"2026-08-06T19:25:32.335109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-06T19:25:28.529325Z","title":"Towards accurate generative models of video: A new met- ric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.529325Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:e76d0016611aab54c8473b78008c35536b4fa79d217b7322b7fa6070f193517b","observation_id":"4d44d9ac-058a-4f2d-bb41-b6650767826e","resolution":{"observed_at":"2026-08-06T19:25:28.529325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-07T17:54:54.749604Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-06T19:25:28.535130Z","title":"Modelscope text-to-video technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.535130Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:107cbcf5b6a85ad632eeb30391c8042d07deed131f55f8d7009d32d30c6006a9","observation_id":"d82f31f4-f576-4434-95ce-d253f1e5f7a9","resolution":{"observed_at":"2026-08-06T19:25:28.535130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.154507Z","title":"Disco: Disentangled control for referring hu- man dance generation in real world","venue":null,"work_id":"792fa61d-1242-4540-bb7c-195666e7a031","year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.545304Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:e440a7b90d6f479339db243c70e7962f1a7d575a6b94ab23192920225f1b9e0f","observation_id":"80d897ab-fc34-4d12-bf01-d340b94f8e5d","resolution":{"observed_at":"2026-08-06T19:25:32.202336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.000470Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video gen- eration, 2024","venue":null,"work_id":"bfa46d16-47ad-4b0d-9819-b2b71e99c27e","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.551122Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:491fe9a10d452729aeac649bdfbcd564a89af5786148f66fbe7868328aa3235f","observation_id":"e5d724a3-506f-45e4-9e3c-9d6b23262dc7","resolution":{"observed_at":"2026-08-06T19:25:32.069319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.860381Z","title":"Videocomposer: Compositional video syn- thesis with motion controllability","venue":null,"work_id":"441b6376-041a-490a-a773-bfd2f76e3d2f","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.557578Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:3ee8f10be5a3e5d150fe48a26ac087f69cf3c737fba22e3bceb81803b4ce55d2","observation_id":"22e113c8-6cf1-40b7-a4ab-2e28b1a36f3f","resolution":{"observed_at":"2026-08-06T19:25:31.908165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-08-06T19:25:28.562803Z","title":"Lavie: High-quality video genera- tion with cascaded latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.562803Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:36595c24a43e550abf4507e7f4102b1dfaa30599f8eadb11caa425fea92e9b45","observation_id":"baecef64-c3f0-4999-909b-2d9a94a61892","resolution":{"observed_at":"2026-08-06T19:25:28.562803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.570065Z","title":"Customvideo: Customizing text- to-video generation with multiple subjects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.570065Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:8d9ea347ea01395b300d675ac8af6ae97a6f1fef3a6f7e5aaa73b23cfe981dcb","observation_id":"e55b5b6f-ebb4-4049-8a25-7da9c4b34cea","resolution":{"observed_at":"2026-08-06T19:25:28.570065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.721917Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"377cf64e-aa7d-4c00-87f2-d246bed812a7","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.576427Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a141cd8257f0bb3709200ebd11398e5ab69beb048e857417f77c7104e650cd5d","observation_id":"34aab84b-58ea-4e2d-9ddc-ad434d1e9b87","resolution":{"observed_at":"2026-08-06T19:25:31.778486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.555896Z","title":"Dreamvideo: Composing your dream videos with customized subject and motion","venue":null,"work_id":"d074e16d-fa20-4dad-a038-3ee4442615f8","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.581016Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7bf9d3041c84151bbcc916554473814ddff5beae7d589f008cbf55fd3bf7bed3","observation_id":"3bbb9efe-b297-427e-8a10-5ea234eef09c","resolution":{"observed_at":"2026-08-06T19:25:31.601048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17758","last_updated":"2024-10-29T11:56:27Z","snapshot_observed_at":"2026-07-06T18:36:51.761148Z","submitted_at":"2024-06-25T17:42:25Z","title":"MotionBooth: Motion-Aware Customized Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17758","snapshot_observed_at":"2026-08-06T19:25:28.587239Z","title":"Motionbooth: Motion-aware customized text-to- video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.587239Z"},"links":{"cited_paper":"/paper/2406.17758","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2a5414bc2afade070b9c478805eb7335075b90c0fc99bd8f57a225f254ba74ee","observation_id":"35cbd15c-cd64-46a2-81bf-f4de539d0907","resolution":{"observed_at":"2026-08-06T19:25:28.587239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.595414Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.595414Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:31d4c20abfefabeb8991703b831be23ca9a508ef0ba1f9aab777a8d6ffe12a8d","observation_id":"34073bb9-765c-400f-b380-a7bc307973ec","resolution":{"observed_at":"2026-08-06T19:25:28.595414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.373036Z","title":"Spherediffusion: Spherical geometry-aware distortion resilient diffusion model","venue":null,"work_id":"281f0b26-6bac-495e-ba34-a8610befde92","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.601496Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:b4f6a503d955ab118e7f5b39a0a4a192e5454ca494cd376499af14f7f5834e30","observation_id":"79e1ffb1-8477-4e1a-93d3-516736898600","resolution":{"observed_at":"2026-08-06T19:25:31.465298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13239","last_updated":"2024-12-27T13:58:39Z","snapshot_observed_at":"2026-08-06T22:56:59.304423Z","submitted_at":"2024-08-23T17:26:06Z","title":"CustomCrafter: Customized Video Generation with Preserving Motion and Concept Composition Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13239","snapshot_observed_at":"2026-08-06T19:25:28.606305Z","title":"Customcrafter: Customized video generation with pre- serving motion and concept composition abilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.606305Z"},"links":{"cited_paper":"/paper/2408.13239","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:9ce5fef76d1166fa77252b20bef2b0a3d1e5ef09de25be73527c14eaaa6fce60","observation_id":"0677294d-f440-4c04-a91c-5c05305f1206","resolution":{"observed_at":"2026-08-06T19:25:28.606305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.240211Z","title":"Draganything: Motion control for any- thing using entity representation","venue":null,"work_id":"ef608817-88ee-4dc0-905c-f9ac93abb5f6","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.613022Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:8d7111bd93c5d78e48470d147d56ab2a47b5d85fea0411cc98a2ff4795bd953a","observation_id":"48ca9f1f-4b19-4b22-aa66-fb79b7058d64","resolution":{"observed_at":"2026-08-06T19:25:31.292623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08240","last_updated":"2024-11-06T13:03:20Z","snapshot_observed_at":"2026-08-06T07:05:06.994888Z","submitted_at":"2024-09-12T17:39:23Z","title":"IFAdapter: Instance Feature Control for Grounded Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08240","snapshot_observed_at":"2026-08-06T19:25:28.620707Z","title":"Ifadapter: Instance feature con- trol for grounded text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.620707Z"},"links":{"cited_paper":"/paper/2409.08240","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:4cd302b16dc01671046b1a9f100b34cc699419bc9114e83db64ccdda2bdb2bd0","observation_id":"9718f27c-7aeb-4f3a-811a-0e272c817403","resolution":{"observed_at":"2026-08-06T19:25:28.620707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.063414Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":"f69ce5c6-49a9-44f0-b957-b1a5a305da7f","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.625464Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:6b707baff3540283d132b9b460840a0fbbd46ef014b456d1c2fbd9df2f098622","observation_id":"29824997-39ab-4337-868a-0a5b419beeba","resolution":{"observed_at":"2026-08-06T19:25:31.138312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-04T13:02:12.217544Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-08-06T19:25:28.637654Z","title":"Camco: Camera-controllable 3d-consistent image-to-video genera- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.637654Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:12167f7c96a486672c8786481b92f152bf8568c710ad79c2b6950f89117f4b1a","observation_id":"2f9020d9-57ba-4813-a6be-d152ec65d6dd","resolution":{"observed_at":"2026-08-06T19:25:28.637654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:30.921225Z","title":"Magicanimate: Temporally consistent human image animation using diffusion model","venue":null,"work_id":"8a3ed5b4-7b82-45fe-8cd9-4d555af77246","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.645155Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:729a5cfb9c11dd382eb7898b08b74a7da13ad0824a4e54e4dc54a5dcc4eeec95","observation_id":"275117c1-dc71-4acb-82c9-391a9d955932","resolution":{"observed_at":"2026-08-06T19:25:30.985323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":82,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":121},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 121 outbound references and 0 inbound Pith citation observations for arXiv:2507.05678."}