{"as_of":"2026-08-14T07:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2dc77dd90ef76998ed2a92b052d88c71cc3af1fec9c5759314bbd5f47c0503ed","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:09:26.217767Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:28:15.758987Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T13:28:15.841296Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"cited_work":{"arxiv_id":"2412.06029","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06029","snapshot_observed_at":"2026-08-07T13:28:15.841296Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","venue":"cs.CV","work_id":"e801f6c3-e1d9-4224-b2df-af69297dab59","year":2024},"citing_paper":{"arxiv_id":"2505.21876","last_updated":"2026-05-28T08:11:37Z","snapshot_observed_at":"2026-08-07T13:18:12.902974Z","submitted_at":"2025-05-28T01:45:26Z","title":"EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:15.758987Z"},"links":{"cited_paper":"/paper/2412.06029","citing_paper":"/paper/2505.21876"},"observation_digest":"sha256:0c718ea19c923a64838ece1a75239a90d2acaca371e10ec777dbb5970c3ee57e","observation_id":"caa02212-344e-4660-858c-66f50bb2be53","resolution":{"observed_at":"2026-08-07T13:28:15.897713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.06029/citation-record","integrity":"/paper/2412.06029/integrity","json":"/paper/2412.06029/citation-record.json","paper":"/paper/2412.06029"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-08-13T21:55:34.606308Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-08-11T20:09:26.059474Z","title":"Latent-Shift: Latent Diffu- sion with Temporal Shift for Efficient Text-to-Video Gener- ation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.059474Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:4caca211fffc2eb35711b6d25612471c82d866bf8dda7645bd96700b0010ec07","observation_id":"812eee19-68e4-4feb-8a99-6071cc6a5fe4","resolution":{"observed_at":"2026-08-11T20:09:26.059474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21273","last_updated":"2024-10-28T17:59:13Z","snapshot_observed_at":"2026-08-14T06:51:43.928055Z","submitted_at":"2024-10-28T17:59:13Z","title":"On Inductive Biases That Enable Generalization of Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2410.21273","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.21273","snapshot_observed_at":"2026-08-11T20:09:26.354899Z","title":"On Inductive Biases That Enable Generalization of Diffusion Transformers","venue":"cs.CV","work_id":"24286925-5abc-4b8f-a8b8-276e1ad0153c","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.063162Z"},"links":{"cited_paper":"/paper/2410.21273","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:9ec21e0c7b0a9ad39d283a340f1e8380db79d9be339ea2663181fb354b2d2fee","observation_id":"dd749c36-164b-4e96-9c29-5e6d88b7bfe9","resolution":{"observed_at":"2026-08-11T20:09:26.359815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02414","last_updated":"2024-01-04T18:55:01Z","snapshot_observed_at":"2026-08-13T04:48:51.156960Z","submitted_at":"2024-01-04T18:55:01Z","title":"Bring Metric Functions into Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02414","snapshot_observed_at":"2026-08-11T20:09:26.065841Z","title":"Bring metric functions into diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.065841Z"},"links":{"cited_paper":"/paper/2401.02414","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:014d931b11b649e375c446d0da2f48191ad3c66b90a657fa29d714a92dcdcf6b","observation_id":"a608900b-f220-4e3f-827e-e57222279721","resolution":{"observed_at":"2026-08-11T20:09:26.065841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.590457Z","title":"Align your latents: High-Resolution Video Synthesis with Latent Diffusion Models","venue":null,"work_id":"2c5b259e-ab33-48c4-9617-76c5eb06d0be","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.069636Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:ed4aff0abdf39194142c7fe6c41722554564d8913063c38c46cddb1a1fd75c36","observation_id":"048624cc-8ad7-406f-9e6d-7029b903d33e","resolution":{"observed_at":"2026-08-11T20:09:26.593867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-13T01:39:12.659510Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-11T20:09:26.072386Z","title":"VideoCrafter1: Open Dif- fusion Models for High-Quality Video Generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.072386Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:05ed2846f180170242fcbbdd8c59168acb81c7a5ca8b26e5ebcfc3a26122e2b4","observation_id":"134d1a11-ff1d-4aad-ab6d-d9e231fba72f","resolution":{"observed_at":"2026-08-11T20:09:26.072386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09047","last_updated":"2024-01-17T08:30:32Z","snapshot_observed_at":"2026-08-13T04:40:49.704758Z","submitted_at":"2024-01-17T08:30:32Z","title":"VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09047","snapshot_observed_at":"2026-08-11T20:09:26.076081Z","title":"VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffu- sion Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.076081Z"},"links":{"cited_paper":"/paper/2401.09047","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:6741a72965b3769d32dd85d8c21d0d44f81de9eab3fa963e8307d644288d7f64","observation_id":"ba12f3e2-9e05-44c5-9b51-004e8cca5fd4","resolution":{"observed_at":"2026-08-11T20:09:26.076081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.079596Z","title":"Instantsplat: Unbounded sparse-view pose-free gaus- sian splatting in 40 seconds, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.079596Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:017d5f071e0cdd30001a77f6327d39111a2d5cef7df76cf80f8171aaddbfc275","observation_id":"3f352b9e-2658-44f9-b929-f5ef04db577b","resolution":{"observed_at":"2026-08-11T20:09:26.079596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.082918Z","title":"Preserve Your Own Correlation: A Noise Prior for Video Diffusion Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.082918Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:bfad1d0d86388e07084914e654aaeb0443c526e1c77cf15d8dd17c50effe40a2","observation_id":"95218c3e-97bf-4226-b960-3279becab947","resolution":{"observed_at":"2026-08-11T20:09:26.082918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.574171Z","title":"Animatediff: Animate your personalized text-to- image diffusion models without specific tuning","venue":null,"work_id":"e2b4dd85-a1da-4245-9c7d-cc8a24053609","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.085746Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:f973c90a9974c6542f9808a742b1456c947a797b0035ddfc9dee40db3336c6c5","observation_id":"60684632-ef57-4819-be1d-ab91ec906ca3","resolution":{"observed_at":"2026-08-11T20:09:26.576861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.565507Z","title":"AnimateDiff: Animate Your Personalized Text-to- Image Diffusion Models without Specific Tuning","venue":null,"work_id":"e9de6651-280f-4870-8425-8890b1e1c427","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.088637Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:adb9d13c84e22e3a881a8177d3e3b16a7a58dde1d8095387c5a314d90cbb5926","observation_id":"f43224c7-286e-4da2-b8c0-9fff15ca40f4","resolution":{"observed_at":"2026-08-11T20:09:26.568351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-12T01:27:32.593496Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-11T20:09:26.091643Z","title":"Cameractrl: Enabling camera control for text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.091643Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:eaaf1d6cd19a9f70340d8de463d0aa09c1ea9bc015088a46a6f6fcad9fd9eeb3","observation_id":"21b7cc7e-85d0-44f0-9ed7-e5e111cb3b73","resolution":{"observed_at":"2026-08-11T20:09:26.091643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.555905Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":"9e9075c3-a52a-4715-811d-483d6f3e6366","year":2017},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.095407Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:fd290a8f9a63b5138be77016f7104f15bd163dd29ea5717e1c3717fa4b94f5c0","observation_id":"fbde206d-4b82-434c-97bd-2d197a97d0fa","resolution":{"observed_at":"2026-08-11T20:09:26.559823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.098449Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.098449Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:cd8b18156ba9e3dab7859d2b17daa55553610f849761494da53fa04b27736652","observation_id":"a5881420-f2fe-4079-b2e5-33f74b80ea54","resolution":{"observed_at":"2026-08-11T20:09:26.098449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-11T20:09:26.100856Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.100856Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:1001fe674ffe835c9de2b5aa10f2621d96c36aeed999288444b4c4d0bbd1f473","observation_id":"b3974b29-d660-4819-bdba-ed28a7cf8762","resolution":{"observed_at":"2026-08-11T20:09:26.100856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.543515Z","title":"Video Diffu- sion Models","venue":null,"work_id":"dc745ece-1dab-45b5-ab6f-f4d80f4fed82","year":2022},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.104192Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:6b80e60fee31a24959250ab27f888cd52c6effb66d900088de4a72c87311ce0d","observation_id":"555a93fc-fbeb-457d-8a6d-dfec23ab2704","resolution":{"observed_at":"2026-08-11T20:09:26.546753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10126","last_updated":"2025-02-25T00:32:29Z","snapshot_observed_at":"2026-08-13T14:03:38.366155Z","submitted_at":"2024-06-14T15:33:00Z","title":"Training-free Camera Control for Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10126","snapshot_observed_at":"2026-08-11T20:09:26.107083Z","title":"Training-free camera control for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.107083Z"},"links":{"cited_paper":"/paper/2406.10126","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:b77ad934e452efc4b1e96e39a347886237ba01d04af27da0c8de3428abd0f510","observation_id":"225a167a-0256-453c-80e2-1ce6740ac057","resolution":{"observed_at":"2026-08-11T20:09:26.107083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T20:09:26.110601Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.110601Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:f649847059555763e9b0cd8dbc0febfef0fc6340093e1dedbca66b0b6ff613d5","observation_id":"0e2c8c91-5007-4f00-9b6e-c3c4bd05b59d","resolution":{"observed_at":"2026-08-11T20:09:26.110601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.13640","last_updated":"2021-05-07T02:34:03Z","snapshot_observed_at":"2026-08-08T12:31:55.574538Z","submitted_at":"2020-07-27T15:40:46Z","title":"Solving Linear Inverse Problems Using the Prior Implicit in a Denoiser","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.13640","snapshot_observed_at":"2026-08-11T20:09:26.113046Z","title":"Solving linear inverse problems using the prior implicit in a denoiser.arXiv preprint arXiv:2007.13640, 2020","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.113046Z"},"links":{"cited_paper":"/paper/2007.13640","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:952d43809f5fc09f68a853e04c2f0bd5f0ed90d0f48771e211a2334178b217f8","observation_id":"5cc081ed-7fa9-453c-a603-b87878b6f061","resolution":{"observed_at":"2026-08-11T20:09:26.113046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.116001Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.116001Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:1edfa0a9c53fcba3bec2787a640f3642d7ccf8f76129cb880e48a3e3ece6a65f","observation_id":"cc0c6c35-d0c3-4433-95c5-e4f45322ce43","resolution":{"observed_at":"2026-08-11T20:09:26.116001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.532371Z","title":"Fifo-diffusion: Generating infinite videos from text without training","venue":null,"work_id":"b0b1bc76-54da-43be-853e-34a81fc0b69d","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.118703Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:b2a28e54121c29bc3bbd2662747b1f92d88e0d8941eb00223f4f8007a6b7e6d1","observation_id":"5a61912f-53df-4acf-bb45-68fdeff89234","resolution":{"observed_at":"2026-08-11T20:09:26.535424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.524601Z","title":"Ground- ing image matching in 3d with mast3r, 2024","venue":null,"work_id":"4707bb2e-502a-449c-ab64-fb366945dc6f","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.120729Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:186ec049cef3f998b0499e465b1f8a4796a36040a14b3e8883993863fd8f0245","observation_id":"d0c2f7c2-8f9d-4a9a-b5c9-752b71b894f2","resolution":{"observed_at":"2026-08-11T20:09:26.527976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.517774Z","title":"Re- conx: Reconstruct any scene from sparse views with video diffusion model, 2024","venue":null,"work_id":"a367be18-3261-4841-8f4d-d7666ee099d3","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.122615Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:b45cfbeef7e5d477c762da4aac620ae824b4d1e44d91726a51c296c474f07bb7","observation_id":"eefe9455-2d78-4554-af60-1c3f56fea41b","resolution":{"observed_at":"2026-08-11T20:09:26.519923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.510557Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":"44c1a240-2748-4305-95da-51db6b15cdc7","year":2022},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.124480Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:588a95494afd6359cb3a2cdaec088aa31203869f0b6757af76aa3bcef502fc03","observation_id":"e3e75ca5-70ce-4f5b-a42c-68eddb1187c0","resolution":{"observed_at":"2026-08-11T20:09:26.513442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.127144Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.127144Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:23dd8663c17c429d6fa9afc2fb5d620c7d3dbe30bb8aaaf34cfc9b76b2932202","observation_id":"cb6b4f51-dc86-41c7-8115-f263766fe271","resolution":{"observed_at":"2026-08-11T20:09:26.127144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.129755Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.129755Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:7d26d64a878436fd36c9981b1f06e58e926cc296352383bb0ca5b79213374565","observation_id":"92a1db0b-14e9-4e8b-9e67-735d6f378de5","resolution":{"observed_at":"2026-08-11T20:09:26.129755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.131900Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.131900Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:62a42feba33161037b1f6a8a0a1425082d1a079973b95d17d1aa775554653eda","observation_id":"6cb675ce-d5fe-4ee3-8260-719895cedfa1","resolution":{"observed_at":"2026-08-11T20:09:26.131900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08501","last_updated":"2020-07-16T17:53:02Z","snapshot_observed_at":"2026-07-06T09:38:53.228850Z","submitted_at":"2020-07-16T17:53:02Z","title":"Accelerating 3D Deep Learning with PyTorch3D","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08501","snapshot_observed_at":"2026-08-11T20:09:26.134277Z","title":"Accelerating 3d deep learning with pytorch3d","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.134277Z"},"links":{"cited_paper":"/paper/2007.08501","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:1a65742077d50bf49d7a5f42399dac7a4ef118eb7842bfff5304baae9148d921","observation_id":"f72b536e-3171-4599-ab0e-b9d4c29d858c","resolution":{"observed_at":"2026-08-11T20:09:26.134277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.490813Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"12c62ccd-877d-477e-9f6f-14c07be182c0","year":2015},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.138103Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:12886e52e544a8c3d9fc41c3616df608f849358d39571b2c49339bb164d7ab85","observation_id":"0aeb3646-7e2c-4b3e-aee5-70cf8e95e082","resolution":{"observed_at":"2026-08-11T20:09:26.494012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.482610Z","title":"Dragdiffusion: Harnessing diffusion models for interactive point-based image editing","venue":null,"work_id":"996da594-09a9-45ac-a206-6f43ea5b1b7a","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.141422Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:37d01e1a16dd50dff6916fa0e7fb8ea9926d46c51423a89e28dd4c724f87cc93","observation_id":"eb6aaded-c9a7-4cea-bcb3-a65e66330b43","resolution":{"observed_at":"2026-08-11T20:09:26.486480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.474338Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","venue":null,"work_id":"6bd31c1d-b1e9-4055-aaaa-c6e02b20c1f8","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.144101Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:cf894384048258b37e05a0b4133ded89c2e65bda6c6f14319912d047e8f19330","observation_id":"24d1f096-4339-479d-acef-ab702819c9b9","resolution":{"observed_at":"2026-08-11T20:09:26.477195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13912","last_updated":"2024-08-27T19:06:57Z","snapshot_observed_at":"2026-08-05T11:12:55.434512Z","submitted_at":"2024-08-25T18:27:20Z","title":"Splatt3R: Zero-shot Gaussian Splatting from Uncalibrated Image Pairs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13912","snapshot_observed_at":"2026-08-11T20:09:26.146544Z","title":"Splatt3r: Zero-shot gaussian splatting from uncalibrated image pairs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.146544Z"},"links":{"cited_paper":"/paper/2408.13912","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:bc8dd11a0f96758650e5e79b72c1ffb51cf336c46ca9eb4d5388ba6aeec3e2a2","observation_id":"53a27d15-ca11-41a4-8eae-72eabb4ef455","resolution":{"observed_at":"2026-08-11T20:09:26.146544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.149774Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.149774Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:a1ff6ef553adf25020bd7e77f34e47612582d64c396120edafd73cb7a4599240","observation_id":"2ec0f422-616f-4b5b-91e8-9ccd9631c7e3","resolution":{"observed_at":"2026-08-11T20:09:26.149774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-11T20:09:26.152603Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.152603Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:7bd76af01315b1e90e91074432603c227143ae4ab82cb9de26c65ee37edb4e65","observation_id":"00b0058a-7bf1-482e-9680-622cf9348f5a","resolution":{"observed_at":"2026-08-11T20:09:26.152603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-11T20:09:26.155309Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.155309Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:f8117ff1e2ca6e926aff48cb3009dc92f0f4623395e1c31cb2b2be13cadc1b2b","observation_id":"152fe9ef-0338-4c97-b18b-b022e92f040c","resolution":{"observed_at":"2026-08-11T20:09:26.155309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-11T02:30:38.877941Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-11T20:09:26.158396Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.158396Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:4048317b2f318ed3c160fac510eb63a217cfa61566336d741a21839bf68092f5","observation_id":"ec924fe2-73c1-4ef0-bc97-34fd4b38899d","resolution":{"observed_at":"2026-08-11T20:09:26.158396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.462979Z","title":"Phenaki: Variable Length Video Generation from Open Do- main Textual Description","venue":null,"work_id":"cc9ed1b4-977b-4d73-9b11-c3d7025940bc","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.162019Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:afdc1f165d32eda9d972a25906558232ee2ddca7f7a4fe675e81ae7336795504","observation_id":"18e8b20e-f38d-473a-9b96-31a6a1a44cca","resolution":{"observed_at":"2026-08-11T20:09:26.466062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.454333Z","title":"MCVD-Masked Conditional Video Diffusion for Pre- diction, Generation, and Interpolation","venue":null,"work_id":"bb513084-d994-4ba6-b6da-e7956662bcea","year":2022},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.164841Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:0949faec7c7c40714f3f5517e4c4576fd9417579a02722f5fb5c56b6fc2ded5b","observation_id":"356554c1-71d8-44d6-b411-2678b8681ca5","resolution":{"observed_at":"2026-08-11T20:09:26.457433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.445971Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":"40fc00c6-d29f-489f-8f35-d16c61e66f44","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.167720Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:7d7e477ad87b6307d6fac9978bf22ff92bc645584052425e54ad089646f88c64","observation_id":"0a8dfdf0-cba8-4dfc-9a98-6f7f74f4c223","resolution":{"observed_at":"2026-08-11T20:09:26.448953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.437487Z","title":"VideoComposer: Compositional Video Synthesis with Motion Controllability","venue":null,"work_id":"d82b48bf-e86c-42ef-9e60-1e9f932a326b","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.170951Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:0572f5be050b99bff78be4f365368025ba19c00a1d61035e4f2fc6d3f8966b7d","observation_id":"939a4f95-f6ed-424b-abd9-082d3cf96539","resolution":{"observed_at":"2026-08-11T20:09:26.441108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.429709Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"3eb5d56a-a4b1-4fca-be3f-b3bf5bdfd0e5","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.173336Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:744919b6ba4b27433db004817fa99e0d0e65a8717f02f8cf1c38d94e4417b460","observation_id":"550446b2-3e6b-4da4-ac66-8e473776fc9e","resolution":{"observed_at":"2026-08-11T20:09:26.432430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.422814Z","title":"Tune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation","venue":null,"work_id":"83778d9d-d9a4-41ea-b97a-6eaa3b09997a","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.175702Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:3f039736667300def32c0b6631df706f6f056c802e4bc18e554aa789c70595a7","observation_id":"85e2739c-649f-432c-b1fa-744cd63f0157","resolution":{"observed_at":"2026-08-11T20:09:26.425544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-04T13:02:12.217544Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-08-11T20:09:26.178025Z","title":"Camco: Camera- controllable 3d-consistent image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.178025Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:92cae3b2735217f25080f47f0aa77eb51e6b62e3cd4a08a18c252b58ed8bee0d","observation_id":"2590fe22-3bae-4736-85ee-4e428214c23b","resolution":{"observed_at":"2026-08-11T20:09:26.178025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.414398Z","title":"Direct-a-video: Customized video generation with user- directed camera movement and object motion","venue":null,"work_id":"1d27d223-4a49-4b2a-86b8-fb445fed88ca","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.181298Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:5e69ad25249a74bc1a92c688ab1e1f908cf4aea19f57d195d9c95f2da9411d73","observation_id":"bd40c098-42b4-4013-b9ff-cb5d317d51ac","resolution":{"observed_at":"2026-08-11T20:09:26.418277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24207","last_updated":"2024-10-31T17:58:22Z","snapshot_observed_at":"2026-08-12T22:10:19.047880Z","submitted_at":"2024-10-31T17:58:22Z","title":"No Pose, No Problem: Surprisingly Simple 3D Gaussian Splats from Sparse Unposed Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24207","snapshot_observed_at":"2026-08-11T20:09:26.184389Z","title":"No pose, no problem: Surprisingly simple 3d gaussian splats from sparse unposed images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.184389Z"},"links":{"cited_paper":"/paper/2410.24207","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:e37882ef8ec5498cc77ceab98e986c6ae99eef33fea914a8f9596929a3cac225","observation_id":"55f58ed6-41fb-4c12-8da5-378d14c6cd3d","resolution":{"observed_at":"2026-08-11T20:09:26.184389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-08-11T20:09:26.187222Z","title":"Dragnuwa: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.187222Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:b31f70b7fb60504f8858497cfdf3b43c9ea22f0c3041977a813152130e94f27c","observation_id":"e83e1f48-76e9-4652-b2af-b5e015e576f6","resolution":{"observed_at":"2026-08-11T20:09:26.187222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-08-11T20:09:26.190032Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis.arXiv preprint arXiv:2409.02048, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.190032Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:ed93580998b5a402f07ade8de13158c3404d54171843b9e2edb5563f149b364d","observation_id":"d410265e-3b9e-4337-b12e-401add4067fe","resolution":{"observed_at":"2026-08-11T20:09:26.190032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05003","last_updated":"2024-11-07T18:59:45Z","snapshot_observed_at":"2026-08-12T22:05:23.810573Z","submitted_at":"2024-11-07T18:59:45Z","title":"ReCapture: Generative Video Camera Controls for User-Provided Videos using Masked Video Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05003","snapshot_observed_at":"2026-08-11T20:09:26.192738Z","title":"Recapture: Gener- ative video camera controls for user-provided videos using masked video fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.192738Z"},"links":{"cited_paper":"/paper/2411.05003","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:4683c0547431585c26d1eb6cc5b2107909a8515327cdcbf6c8497d2fdcb44ee9","observation_id":"d1130f18-a86c-48ce-9ced-e628cbf40f9f","resolution":{"observed_at":"2026-08-11T20:09:26.192738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03825","last_updated":"2025-05-08T08:32:16Z","snapshot_observed_at":"2026-07-06T19:28:08.374354Z","submitted_at":"2024-10-04T18:00:07Z","title":"MonST3R: A Simple Approach for Estimating Geometry in the Presence of Motion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03825","snapshot_observed_at":"2026-08-11T20:09:26.195788Z","title":"Monst3r: A simple approach for estimat- ing geometry in the presence of motion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.195788Z"},"links":{"cited_paper":"/paper/2410.03825","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:553df78248cb2c2d076570aded595472cff917f0a3976b3e0fabd8772df87941","observation_id":"26e1618f-0236-45a3-9ae0-79b1fb0bda40","resolution":{"observed_at":"2026-08-11T20:09:26.195788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07206","last_updated":"2024-04-10T17:59:59Z","snapshot_observed_at":"2026-08-13T00:33:11.789785Z","submitted_at":"2024-04-10T17:59:59Z","title":"GoodDrag: Towards Good Practices for Drag Editing with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07206","snapshot_observed_at":"2026-08-11T20:09:26.198399Z","title":"Good- drag: Towards good practices for drag editing with diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.198399Z"},"links":{"cited_paper":"/paper/2404.07206","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:95984a3bfca37bc4f3853380c0e1d0c2f19aa221309e9c08f1463d51e691a73d","observation_id":"ca5addaa-c94e-4e1c-b84f-e915a73c9fc8","resolution":{"observed_at":"2026-08-11T20:09:26.198399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09817","last_updated":"2018-05-24T17:58:02Z","snapshot_observed_at":"2026-07-06T06:41:05.545426Z","submitted_at":"2018-05-24T17:58:02Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09817","snapshot_observed_at":"2026-08-11T20:09:26.201718Z","title":"Stereo magnification: Learning view synthesis using multiplane images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.201718Z"},"links":{"cited_paper":"/paper/1805.09817","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:a73c66efb588bfa4329994239d131cc1e53afd2a4c0c3f7fd9462ae99bb709e6","observation_id":"495511b9-182f-4105-a368-40eb1a8cbb5f","resolution":{"observed_at":"2026-08-11T20:09:26.201718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.406484Z","title":"Denoising is conducted using the video diffusion model until reaching the predetermined latent reframing step, which is step 8","venue":null,"work_id":"112cc974-6534-4029-839d-f2fad541adcd","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.205649Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:a1b2e13eddc2647fb9092a4285153b402a776c96c5fa34b396cd3e352e5503b7","observation_id":"184b73bf-6bbb-4cf3-9afe-5cefe9fc8627","resolution":{"observed_at":"2026-08-11T20:09:26.409363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.397164Z","title":"3.2, is then applied to generate the reframed video at the target camera pose","venue":null,"work_id":"ffd65d74-9862-4aa0-bc85-1be3eccbbbae","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.208723Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:d4608f9e22287d6942ad40d0c6f6c3bc1be477481436f7e11ec1e415ae0fb1fd","observation_id":"816b8473-d6a2-42f7-a70a-1ff99592800e","resolution":{"observed_at":"2026-08-11T20:09:26.400492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.388415Z","title":"As outlined in Sec","venue":null,"work_id":"45998ca4-8223-4495-8a5e-2e04ae743420","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.211115Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:8cff62c2ab02e4370aed6a1bd0d23dfcbf4566ea479acd14f38314884306db40","observation_id":"1c7457cd-8c84-4135-931d-9674c5488aae","resolution":{"observed_at":"2026-08-11T20:09:26.391325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.380573Z","title":"At this stage, the input to the denoising network combines un- known and known regions, as described in Eq","venue":null,"work_id":"14c6c83c-b205-4882-ac5d-e65b684a8ee4","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.214345Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:cbe765931de2eaf88e17458612dc8966d61b3c4edd7aa46cc34a9df9b359f75c","observation_id":"33654b29-9b04-4df5-8b32-2184c0a07842","resolution":{"observed_at":"2026-08-11T20:09:26.383889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.372591Z","title":"After this, the known region is no longer merged","venue":null,"work_id":"2530f981-500e-4f19-8c97-80f062f61152","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.217767Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:c5119a6cfeb5eea849d30c6cf485fefaa14fb74ff0e4aa4f47740abe3299df25","observation_id":"1609c16c-0273-4805-aabb-216b985fda7c","resolution":{"observed_at":"2026-08-11T20:09:26.375955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2412.06029."}