{"as_of":"2026-08-08T15:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:daa30a0da8a62973643a3694afb088444da41eb3bbdd433b238610a36a6fd11a","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:54:20.099641Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T04:29:51.659833Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T15:48:34.930375Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"cited_work":{"arxiv_id":"2506.01144","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01144","snapshot_observed_at":"2026-07-03T15:48:34.930375Z","title":"Flowmo: Variance-based flow guidance for coherent motion in video generation","venue":null,"work_id":"94e2565d-43d6-49ba-9566-3e5231e52f32","year":2025},"citing_paper":{"arxiv_id":"2603.05539","last_updated":"2026-05-08T14:58:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-04T10:39:04Z","title":"VDCook:DIY video data cook your MLLMs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T16:52:36.882218Z"},"links":{"cited_paper":"/paper/2506.01144","citing_paper":"/paper/2603.05539"},"observation_digest":"sha256:4c50d667d4b00c0ea78e5b1971687a59364caf3d4cf8acee7ea966a3b0555770","observation_id":"c1ce709e-94b9-4f23-9438-521f7f690cfc","resolution":{"observed_at":"2026-05-15T16:56:19.194186Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"cited_work":{"arxiv_id":"2506.01144","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01144","snapshot_observed_at":"2026-07-03T15:48:34.930375Z","title":"Flowmo: Variance-based flow guidance for coherent motion in video generation","venue":null,"work_id":"94e2565d-43d6-49ba-9566-3e5231e52f32","year":2025},"citing_paper":{"arxiv_id":"2606.11969","last_updated":"2026-06-10T11:49:54Z","snapshot_observed_at":"2026-07-06T23:50:58.297354Z","submitted_at":"2026-06-10T11:49:54Z","title":"SpecLoR: Spectral Lookahead Rectification for Motion-Coherent Text-to-Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T10:00:35.608696Z"},"links":{"cited_paper":"/paper/2506.01144","citing_paper":"/paper/2606.11969"},"observation_digest":"sha256:f82fb80467db4bfa0c30b070179d2b8d4a151d8bb5390e76f8c22acc3adb4bfb","observation_id":"f2cd8623-32b8-4492-a12c-aa18d650d88c","resolution":{"observed_at":"2026-07-03T10:27:56.796822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"cited_work":{"arxiv_id":"2506.01144","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01144","snapshot_observed_at":"2026-07-03T15:48:34.930375Z","title":"Flowmo: Variance-based flow guidance for coherent motion in video generation","venue":null,"work_id":"94e2565d-43d6-49ba-9566-3e5231e52f32","year":2025},"citing_paper":{"arxiv_id":"2607.01962","last_updated":"2026-07-02T09:56:50Z","snapshot_observed_at":"2026-08-08T07:29:09.225372Z","submitted_at":"2026-07-02T09:56:50Z","title":"NeoMap: Training-free Novel-View Synthesis from Single Images and Videos","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-03T15:45:57.331627Z"},"links":{"cited_paper":"/paper/2506.01144","citing_paper":"/paper/2607.01962"},"observation_digest":"sha256:95b850b08b301c961bb8242c74937957a5d20271629f66a8e63ffdf08a073cbe","observation_id":"902465e9-4c8e-4ca0-8a3a-74991f3c0e0a","resolution":{"observed_at":"2026-07-03T15:48:34.931796Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01144","snapshot_observed_at":"2026-08-01T04:29:51.659833Z","title":"arXiv preprint arXiv:2506.01144 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22531","last_updated":"2026-07-24T17:59:39Z","snapshot_observed_at":"2026-08-07T13:04:18.211748Z","submitted_at":"2026-07-24T17:59:39Z","title":"Twins: Learn to Predict Unified Representations with Focal Loss","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-01T04:29:51.659833Z"},"links":{"cited_paper":"/paper/2506.01144","citing_paper":"/paper/2607.22531"},"observation_digest":"sha256:7528198901bf65398545b308c21eee99e7f51241e3cd54274ce1cc562089dc08","observation_id":"c0071cdd-3cab-42dd-8e85-8544a608aabc","resolution":{"observed_at":"2026-08-01T04:29:51.659833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01144/citation-record","integrity":"/paper/2506.01144/integrity","json":"/paper/2506.01144/citation-record.json","paper":"/paper/2506.01144"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T11:54:12.226960Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.226960Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:c95c972c974fbe9960af5b5abc6258da2b4855f23a39dc1d6f7ffa019acae2bb","observation_id":"bcde0d0d-f41f-4cc1-ba67-665d398cc6b9","resolution":{"observed_at":"2026-08-07T11:54:12.226960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-07T11:54:12.337229Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.337229Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:8357c86d9aa3a845bb3f364050ac3eff75f0c44b953ca78933d7ce9e6731e0ee","observation_id":"a740271e-a4b5-4cc4-84b5-10649469610c","resolution":{"observed_at":"2026-08-07T11:54:12.337229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02492","last_updated":"2025-05-26T13:56:07Z","snapshot_observed_at":"2026-08-04T22:35:38.752893Z","submitted_at":"2025-02-04T17:07:10Z","title":"VideoJAM: Joint Appearance-Motion Representations for Enhanced Motion Generation in Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02492","snapshot_observed_at":"2026-08-07T11:54:12.520467Z","title":"Videojam: Joint appearance-motion representations for enhanced motion generation in video models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.520467Z"},"links":{"cited_paper":"/paper/2502.02492","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6170ee6d7267b7742533bc19a10ca661d41c977ee575e6b5d1f22a84b8cf0ae8","observation_id":"8ba1652b-0765-49c2-8246-f68df6ddb1f5","resolution":{"observed_at":"2026-08-07T11:54:12.520467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:24.202219Z","title":"How far is video generation from world model: A physical law perspective, 2024","venue":null,"work_id":"1849c017-d022-421f-9ebf-b09608c77a7b","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.659311Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:444065cbd0645d389732b5239276e156e4e28f8925e95ee6a744747b7364fcd3","observation_id":"dca6690c-f771-4a9f-8bf1-2278e7bb9f85","resolution":{"observed_at":"2026-08-07T11:54:24.283477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:12.823817Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.823817Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6a88450df97dd2b67a544efe15d1a01a81c01a43e6f2cb3cdd4efff1eab26e23","observation_id":"4cafe62c-6daa-461b-b6d6-877404396b40","resolution":{"observed_at":"2026-08-07T11:54:12.823817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:24.063789Z","title":"Motion prompting: Controlling video generation with motion trajectories, 2024","venue":null,"work_id":"ff5ed6bf-a992-4e49-a15f-621476acf3d9","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.000481Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:feeb3bb47483dd24361c028b47eedf84a6e8ef52eeccb61de2b1dcdb0aa8347c","observation_id":"ad101ca1-a908-4111-91ab-24aba3b27cc2","resolution":{"observed_at":"2026-08-07T11:54:24.138825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.960386Z","title":null,"venue":null,"work_id":"8c81cce7-43d8-4efe-ab3e-89021be97a2f","year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.090493Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:b3370a7588a88372493efb1e15c12a0383939d0bc5c03f5d85c5f9fdc25d5b87","observation_id":"b1306df7-84ca-4aba-a6c6-e26b12c2e08f","resolution":{"observed_at":"2026-08-07T11:54:24.009855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.794700Z","title":"Physgen: Rigid-body physics- grounded image-to-video generation","venue":null,"work_id":"de40dc48-33ff-4ba7-8206-5934e6630eeb","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.203424Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:09bd96b1b584c194ff13131afde3bbf69cc32c34fef1916e20bb27d0a436f773","observation_id":"333ad736-d379-457a-954b-565849da96c9","resolution":{"observed_at":"2026-08-07T11:54:23.873455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05922","last_updated":"2024-02-29T21:06:58Z","snapshot_observed_at":"2026-07-06T16:30:00.114521Z","submitted_at":"2023-10-09T17:59:53Z","title":"FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05922","snapshot_observed_at":"2026-08-07T11:54:13.311391Z","title":"Flatten: optical flow-guided attention for consistent text-to-video editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.311391Z"},"links":{"cited_paper":"/paper/2310.05922","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:be7aa2feed4f51ad89b0eeff954ef52bf9af2dbc17652398e524b4239ad334cc","observation_id":"02428eb5-5419-4ed3-9f29-b1dab5781601","resolution":{"observed_at":"2026-08-07T11:54:13.311391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.609918Z","title":"Tulyakov, Ming-Yu Liu, Xiaodong Yang, and Jan Kautz","venue":null,"work_id":"7ab90b20-9167-4bc9-80f9-06a54b7f859d","year":2018},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.464182Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6d9fbf00af2caa7eabbc1e647913ee1f181e386d76ed86bc37302860e407691c","observation_id":"56974d30-cd79-4573-a968-cad8123bfae6","resolution":{"observed_at":"2026-08-07T11:54:23.695990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:13.558832Z","title":"Video-lavit: Unified video-language pre-training with decoupled visual-motional tokenization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.558832Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:766132ab6f5fb14e3d4f5ca7b1c589e4d912d7c62c70c19091b4f8b702ed48c9","observation_id":"fcda0f6a-5dde-47e0-8e97-b390e013a7ca","resolution":{"observed_at":"2026-08-07T11:54:13.558832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:13.632879Z","title":"Packing input frame context in next-frame prediction models for video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.632879Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:d4844e692c16635f266f86446875e66a830871ee3e9cd3cc98c2e32c13d5b674","observation_id":"348bcd06-c83b-4acb-a45f-c0324d533118","resolution":{"observed_at":"2026-08-07T11:54:13.632879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06434","last_updated":"2016-01-07T23:09:39Z","snapshot_observed_at":"2026-08-04T04:34:27.861448Z","submitted_at":"2015-11-19T22:50:32Z","title":"Unsupervised Representation Learning with Deep Convolutional Generative Adversarial Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06434","snapshot_observed_at":"2026-08-07T11:54:13.696184Z","title":"Unsupervised representation learning with deep convolutional generative adversarial networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.696184Z"},"links":{"cited_paper":"/paper/1511.06434","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:d16e387294b136ee06a6786db4e8172529cc9e1d10e384b7d034fc475a1d0af2","observation_id":"e81ba6fc-2d44-4a4f-aa32-b7f07bcf75c4","resolution":{"observed_at":"2026-08-07T11:54:13.696184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.372294Z","title":"Interpreting the latent space of gans for semantic face editing","venue":null,"work_id":"1ed54c7e-84a3-44f6-b4d1-9dbff442d729","year":2020},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.778916Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:1533c96b7a657e2046bf96abc4ed51d7eb738ec23ab960158ce9cd5a2b692760","observation_id":"87bd38d7-03b5-4574-9ab9-da0d5e4f23f5","resolution":{"observed_at":"2026-08-07T11:54:23.514531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.153180Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":"1d838b0d-697a-48cf-bbc7-2d9691d15d54","year":2021},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.865689Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:8b38566f75c80cc3a22e6e0d29bf3bdd38e3af66de4dc63a5a8e646adc5c021f","observation_id":"a32091da-ece2-45d9-8771-f3ef9017f601","resolution":{"observed_at":"2026-08-07T11:54:23.283900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.036216Z","title":"VBench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.036216Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:13c7896ebfda154547fc89cba205d9839a7cfa0e156eecb09f15d7ab4d35a24c","observation_id":"d1baa659-603f-4fd9-921b-a19d536bb34b","resolution":{"observed_at":"2026-08-07T11:54:14.036216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.137209Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.137209Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:fd280ff312f0113d9ed786801ea6ff4399163f20da025c877a5680deb0674530","observation_id":"1d576c2a-9ac1-421a-90bd-7231628fda3d","resolution":{"observed_at":"2026-08-07T11:54:14.137209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-07T11:54:14.238268Z","title":"Kingma, Ben Poole, Mohammad Norouzi, David J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.238268Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:fd8618e71d5630bc51be5dd26033631ba5e8bb24530c8393971331b0491032a9","observation_id":"986b43fd-d1f9-4733-98ad-b87ed723bfd0","resolution":{"observed_at":"2026-08-07T11:54:14.238268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.05233","last_updated":"2021-06-01T17:49:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-11T17:50:24Z","title":"Diffusion Models Beat GANs on Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.05233","snapshot_observed_at":"2026-08-07T11:54:14.414120Z","title":"Diffusion models beat GANs on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.414120Z"},"links":{"cited_paper":"/paper/2105.05233","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:da1cecc2412424a6108a2c301d29619473ad0c6c282ca8e4bad9af822daf9347","observation_id":"f2aef76a-a48f-4048-a8f2-7035a3def5e4","resolution":{"observed_at":"2026-08-07T11:54:14.414120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.595545Z","title":"Zero-shot text-to-image generation, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.595545Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:8a513a89eef525ea4586d68879db521333e3cdcacf03655319142d8f0e12e0b8","observation_id":"3ee96893-1516-49c5-914b-92815bd810ec","resolution":{"observed_at":"2026-08-07T11:54:14.595545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.730911Z","title":"Sara Mahdavi, Rapha Gontijo Lopes, Tim Salimans, Jonathan Ho, David J Fleet, and Mohammad Norouzi","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.730911Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:32c86d51fa3d9bc972c00218e3fa9da6263ec087345935e73ff95af80b972743","observation_id":"d8c8e943-6f5c-4661-9e2d-a1b8207b2970","resolution":{"observed_at":"2026-08-07T11:54:14.730911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-07T11:54:14.846340Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.846340Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:74fc536e8c7cdb6f39b0a3309eeb5f5ca5db1aad16a97c36582cd0723bc3111c","observation_id":"b9486b8e-5c53-4e3f-b728-8ba37bcc0f97","resolution":{"observed_at":"2026-08-07T11:54:14.846340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08674","last_updated":"2024-07-11T17:06:53Z","snapshot_observed_at":"2026-07-06T18:44:57.578408Z","submitted_at":"2024-07-11T17:06:53Z","title":"Still-Moving: Customized Video Generation without Customized Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08674","snapshot_observed_at":"2026-08-07T11:54:14.966753Z","title":"Still-moving: Customized video generation without customized video data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.966753Z"},"links":{"cited_paper":"/paper/2407.08674","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:4eea302022ae1d3b4516fc5c5a0ab5c8e4c98b500624eff204a8c68fc6aa8a88","observation_id":"58189385-bfee-4dcf-86be-d1d92520676f","resolution":{"observed_at":"2026-08-07T11:54:14.966753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:22.941185Z","title":"Emu edit: Precise image editing via recognition and generation tasks","venue":null,"work_id":"43671189-7940-4d89-83bb-ad289ad4479d","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.113609Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:c3cbb74fcd247c5ef5d232b323cff4f2dcba20545c41c1be832919f7ecae1f10","observation_id":"1e27b8c3-6ce3-40b7-a676-31bf332b8def","resolution":{"observed_at":"2026-08-07T11:54:23.016317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:22.749044Z","title":"Video editing via factorized diffusion distillation","venue":null,"work_id":"b83e7746-5315-4fbe-9c31-a819a414eb35","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.178735Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:295d401a62bb36f734af1d532b6f46a64adf059d4c1c762abffcc6a3928cd35b","observation_id":"ee2f62c9-2ade-4513-851f-63e0f31465d5","resolution":{"observed_at":"2026-08-07T11:54:22.838361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T11:54:15.308313Z","title":"Prompt-to- prompt image editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.308313Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6b6486400e78c9e2c5f5907569c79b716e37ea7849e19ce32df2f19089d94076","observation_id":"84888083-4b88-4eee-ba96-7f667bd4d423","resolution":{"observed_at":"2026-08-07T11:54:15.308313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.426301Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.426301Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6923e40cd0b254203cfd4f1914d3ca43fe900e4e0ee5166d73d0019b06c61d71","observation_id":"3f42684c-d814-4988-93a1-a9448ff0ba86","resolution":{"observed_at":"2026-08-07T11:54:15.426301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07232","last_updated":"2024-11-12T07:49:39Z","snapshot_observed_at":"2026-08-06T03:09:10.188671Z","submitted_at":"2024-11-11T18:50:09Z","title":"Add-it: Training-Free Object Insertion in Images With Pretrained Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07232","snapshot_observed_at":"2026-08-07T11:54:15.551826Z","title":"Add-it: Training-free object insertion in images with pretrained diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.551826Z"},"links":{"cited_paper":"/paper/2411.07232","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:8d6de424c49dad4e110a6095be3f5c2fdd89279a1ae8deab40ef73faadfe54ab","observation_id":"91c02129-6184-4915-affe-98017b22ba7b","resolution":{"observed_at":"2026-08-07T11:54:15.551826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.635219Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.635219Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:3eeb444e82767e460512594997204f3a346f6eda7f62978e26a3c1ae906df3b9","observation_id":"a3eaf77e-ad85-4e94-90a3-4ebda8501765","resolution":{"observed_at":"2026-08-07T11:54:15.635219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:22.410805Z","title":"Geodiffuser: Geometry-based image editing with diffusion models","venue":null,"work_id":"f49fc993-585d-4f6e-ba62-9c76bf1dc0d0","year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.734079Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:54466d5c2f6d41f7b4dca6d83b9c7caa6fbd88ed268c9fb807dd80110f515c0d","observation_id":"9523449d-0f27-41c8-9192-e6f9ca84b859","resolution":{"observed_at":"2026-08-07T11:54:22.578846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.902601Z","title":"Paint by example: Exemplar-based image editing with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.902601Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:9b548ffcd6019631a65119a0c5eee9fc153df4b87988887d5d0843e7b134424e","observation_id":"c4a37e6d-418a-423c-94eb-c794c85eaa71","resolution":{"observed_at":"2026-08-07T11:54:15.902601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15282","last_updated":"2021-12-17T17:21:04Z","snapshot_observed_at":"2026-08-07T06:41:10.116700Z","submitted_at":"2021-05-30T17:14:52Z","title":"Cascaded Diffusion Models for High Fidelity Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15282","snapshot_observed_at":"2026-08-07T11:54:16.018444Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.018444Z"},"links":{"cited_paper":"/paper/2106.15282","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:dc47c38b7be47d6009872a317eb7f9e8bd3d75e861bcc9d402a33e559d1934a4","observation_id":"5013d213-eba1-4ef5-9ae4-dcaed096f2be","resolution":{"observed_at":"2026-08-07T11:54:16.018444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12945","last_updated":"2024-02-05T16:36:30Z","snapshot_observed_at":"2026-08-08T15:14:24.281572Z","submitted_at":"2024-01-23T18:05:25Z","title":"Lumiere: A Space-Time Diffusion Model for Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12945","snapshot_observed_at":"2026-08-07T11:54:16.125338Z","title":"Lumiere: A space-time diffusion model for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.125338Z"},"links":{"cited_paper":"/paper/2401.12945","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:067ad5277e422d74531097c3b66aed060ae9fa2686cb177e0de6eaa2e82cdb4f","observation_id":"9d8e8843-b0c3-4aaf-a7ab-f5a92e81f075","resolution":{"observed_at":"2026-08-07T11:54:16.125338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-07-06T15:16:38.500909Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-08-07T11:54:16.255631Z","title":"Latent-Shift: Latent diffusion with temporal shift for efficient text-to-video generation.arXiv preprint arXiv:2304.08477, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.255631Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:0e82c4732e9d49b767f726bca249c635988c1abc964c51850c66b7adac3303ef","observation_id":"b20bc81f-a5e8-4dcd-9d71-4606a068ac54","resolution":{"observed_at":"2026-08-07T11:54:16.255631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T11:54:16.397022Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.397022Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:108dd8309990bcadd70e4c25058519438ef2ee90265c870289a624734f3199e2","observation_id":"13f4c28b-51d2-409c-a6ab-5e75404bc1cc","resolution":{"observed_at":"2026-08-07T11:54:16.397022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:16.493439Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.493439Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:8342e998ee3142e7a84f6d5bbcfbfec0d61c9ee78be41cf6adb315c41a435438","observation_id":"a04bdd92-13ed-4648-9efa-5acb5cc4d400","resolution":{"observed_at":"2026-08-07T11:54:16.493439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T11:54:16.605290Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.605290Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:5dbf87b601f4642c8e4d53b5a153940c59e66f092e947eaf7b1f75a31812c884","observation_id":"86bd3e09-9dac-41a3-986b-9ec23eefac01","resolution":{"observed_at":"2026-08-07T11:54:16.605290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:22.159104Z","title":"Hedra: Ai-powered character video generation","venue":null,"work_id":"5ef8b27b-1e7a-496e-a9fc-233124550eb7","year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.670794Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:29a01943bfafaed75a0348662033caad2aef32e2b694fb596d006be2d755c146","observation_id":"208ba36b-ef60-423b-baf2-a3d9c0216345","resolution":{"observed_at":"2026-08-07T11:54:22.269405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.985629Z","title":"Sora: Text-to-Video Generation","venue":null,"work_id":"227b17c3-6dae-4bd6-8eba-3d4c7d107999","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.761636Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:e63e0c9186545443697d00dd5d218f0501c3e40d018fa6ad3639ba0ce749213c","observation_id":"952daa87-b890-4d2d-9799-636dfc93a7a5","resolution":{"observed_at":"2026-08-07T11:54:22.082194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.797787Z","title":"Genie 2: A Large-Scale Foundation World Model","venue":null,"work_id":"6c8a761f-1bc2-4c32-aa42-70688ed10dbe","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.824942Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:76c915d5ab5e0a31d765ffa959a4a099d55844c58571d778252f760186376859","observation_id":"ab1186b4-1a2a-4ddb-8761-ea8b013f8eed","resolution":{"observed_at":"2026-08-07T11:54:21.874155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.669716Z","title":"Generating worlds","venue":null,"work_id":"eb1d9d95-57ee-4ef4-84ff-bda18c9ff9a6","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.948467Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:cea1d2140a87c656690613b3f307f043e408e56b32de0f9a63addb469be0a000","observation_id":"09851d89-a861-4c5e-80ce-1ec83df90418","resolution":{"observed_at":"2026-08-07T11:54:21.723532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.026073Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.026073Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6f155eaf8c074c816f9d200a9db38c0c16cde1f04894ac08372f6261ea3c5853","observation_id":"008218d2-5563-4e76-97ee-6c0a8aaf333a","resolution":{"observed_at":"2026-08-07T11:54:17.026073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T11:54:17.147582Z","title":"SDXL: improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.147582Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:c5da124177a2df6622064d46f591d442a5354effddbfc4ae850091126defa13a","observation_id":"01badb3d-5710-4aea-b42f-b357da2f1711","resolution":{"observed_at":"2026-08-07T11:54:17.147582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T11:54:17.305170Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.305170Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:ff768c91631831f68988148f7552ab30982a0d373cc29e72dc69a383489ffbf9","observation_id":"2f2ddd89-9648-432f-9e32-39b40b93bd80","resolution":{"observed_at":"2026-08-07T11:54:17.305170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-08-07T11:54:17.448129Z","title":"LaVie: High-quality video generation with cascaded latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.448129Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:99698719d6a00381aae7eba65ec19ac2838ad991722511387972268bf6ca857f","observation_id":"599b2380-78f2-4781-8571-9df2c5b38fe3","resolution":{"observed_at":"2026-08-07T11:54:17.448129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.585649Z","title":"Unipc: A unified predictor-corrector framework for fast sampling of diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.585649Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:51b40dfb01bd05ef0f37ca3f0c947a77618e31054601cd5b878a030ed601516f","observation_id":"42035c57-0568-4a06-9bb3-1a4db4336fc4","resolution":{"observed_at":"2026-08-07T11:54:17.585649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.755544Z","title":"Attend-and-excite: Attention- based semantic guidance for text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.755544Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:b05eff350c6d910cb86c8b6c804ea9ba9f0b56782c0b7304cb225feb80a75a46","observation_id":"f44b32ae-cd93-4150-ae14-83e34a708943","resolution":{"observed_at":"2026-08-07T11:54:17.755544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.508584Z","title":"Be yourself: Bounded attention for multi-subject text-to-image generation","venue":null,"work_id":"998d845f-46b9-4dfe-8f8d-170168cd7a4f","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.878728Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:66e7f2d0198ce0d4105c58da4b52f47e545d82c56b43b1b6e59e849e5d78eb2f","observation_id":"0c3980e8-daa6-4c13-85d4-ea6a254ee7d9","resolution":{"observed_at":"2026-08-07T11:54:21.562097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-07T11:54:17.996781Z","title":"Make it count: Text-to-image generation with an accurate number of objects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.996781Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:f499d212b06338c33434639e4866927f2da483391ffdeb3a0e603c39947075f0","observation_id":"0ea45198-da49-4e43-8899-98e48f061e84","resolution":{"observed_at":"2026-08-07T11:54:17.996781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.361143Z","title":"Separate-and-enhance: Compositional finetuning for text-to-image diffusion models","venue":null,"work_id":"08a21f9e-bdb3-455e-b24c-8215326c7c71","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.095074Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:c3d865b183c898fbd6e5c7d2d50805803b997b5b99381767df2d5e3c62275a20","observation_id":"a5f46d6f-33e8-4320-9615-3f3bca0b5425","resolution":{"observed_at":"2026-08-07T11:54:21.448426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08641","last_updated":"2025-04-11T15:41:43Z","snapshot_observed_at":"2026-08-07T16:06:29.686223Z","submitted_at":"2025-04-11T15:41:43Z","title":"Training-free Guidance in Text-to-Video Generation via Multimodal Planning and Structured Noise Initialization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08641","snapshot_observed_at":"2026-08-07T11:54:18.192758Z","title":"Training-free guidance in text-to-video generation via multimodal planning and structured noise initialization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.192758Z"},"links":{"cited_paper":"/paper/2504.08641","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:4b41d7e06a9825d39930f7997615404f7526aab2e53dc44006752ad0b8629e17","observation_id":"6720005f-9818-41c1-a6a0-76b3308019ba","resolution":{"observed_at":"2026-08-07T11:54:18.192758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17414","last_updated":"2025-04-24T10:12:40Z","snapshot_observed_at":"2026-08-07T15:59:34.814750Z","submitted_at":"2025-04-24T10:12:40Z","title":"3DV-TON: Textured 3D-Guided Consistent Video Try-on via Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17414","snapshot_observed_at":"2026-08-07T11:54:18.253635Z","title":"3dv-ton: Textured 3d-guided consistent video try-on via diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.253635Z"},"links":{"cited_paper":"/paper/2504.17414","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:406d2137ea34adbf34b94ab4be5135fc790d3ce1123565b239e89da70b3faecb","observation_id":"e80b3d91-0dd4-422e-a3b3-219f86f177be","resolution":{"observed_at":"2026-08-07T11:54:18.253635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:18.329926Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.329926Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6867345144396f6de0922fb41cd6a5da31a812eb25f3751b0552b85a41843e36","observation_id":"72295fd9-144c-45a8-a96a-29bf918a5168","resolution":{"observed_at":"2026-08-07T11:54:18.329926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.113609Z","title":"Boosting text-to-video generative model with mllms feedback","venue":null,"work_id":"a4889a4a-2864-4319-bd26-3d16d34bd11b","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.461604Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6e49467e84ccc47558bb14c211ac89bb61ae0e29aae6558b39641066aa2e57af","observation_id":"dc7d759c-2fea-46b3-825c-bc1228b823dc","resolution":{"observed_at":"2026-08-07T11:54:21.164469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-07-06T14:22:24.004857Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-07T11:54:18.599038Z","title":"Latent video diffusion models for high-fidelity long video generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.599038Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:17164899c2d109e9018a47b916fdf0ba937d5b0150bb280dc257172a66a06abc","observation_id":"65f06f51-70c2-4fe5-8ead-59156da97739","resolution":{"observed_at":"2026-08-07T11:54:18.599038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02399","last_updated":"2022-10-05T17:18:28Z","snapshot_observed_at":"2026-08-04T09:09:48.463217Z","submitted_at":"2022-10-05T17:18:28Z","title":"Phenaki: Variable Length Video Generation From Open Domain Textual Description","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02399","snapshot_observed_at":"2026-08-07T11:54:18.735580Z","title":"Phenaki: Variable length video generation from open domain textual description","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.735580Z"},"links":{"cited_paper":"/paper/2210.02399","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:d0acd9746b85f96d7cc6f1bb989c8bf65b3ed82faf8a68fdfbe7f7518540e7a9","observation_id":"9bc833d1-adcb-40ad-a2f6-5f4b84af3815","resolution":{"observed_at":"2026-08-07T11:54:18.735580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18264","last_updated":"2023-05-29T17:38:18Z","snapshot_observed_at":"2026-07-06T15:34:51.593721Z","submitted_at":"2023-05-29T17:38:18Z","title":"Gen-L-Video: Multi-Text to Long Video Generation via Temporal Co-Denoising","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18264","snapshot_observed_at":"2026-08-07T11:54:18.828455Z","title":"Gen-l-video: Multi-text to long video generation via temporal co-denoising","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.828455Z"},"links":{"cited_paper":"/paper/2305.18264","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:43870851283992cc5998e8c5d9c930b17f35807012cd49ba826f9a1ea072e3de","observation_id":"3b43765b-a46a-4d6e-9428-248c8e95320e","resolution":{"observed_at":"2026-08-07T11:54:18.828455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15169","last_updated":"2024-01-30T16:44:20Z","snapshot_observed_at":"2026-08-03T19:40:46.693368Z","submitted_at":"2023-10-23T17:59:58Z","title":"FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15169","snapshot_observed_at":"2026-08-07T11:54:18.995420Z","title":"FreeNoise: Tuning-free longer video diffusion via noise rescheduling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.995420Z"},"links":{"cited_paper":"/paper/2310.15169","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:1a397b7cb05357f5d6bda0a23463b8b03b03b26ec726007d0afaf0169400cc61","observation_id":"b5a41aca-9d57-44c5-8104-fdc003789d06","resolution":{"observed_at":"2026-08-07T11:54:18.995420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07537","last_updated":"2024-07-25T09:10:52Z","snapshot_observed_at":"2026-07-06T17:00:37.507046Z","submitted_at":"2023-12-12T18:59:16Z","title":"FreeInit: Bridging Initialization Gap in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07537","snapshot_observed_at":"2026-08-07T11:54:19.101085Z","title":"Freeinit: Bridging initialization gap in video diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.101085Z"},"links":{"cited_paper":"/paper/2312.07537","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:07f88484e9ada9d46bf4045844e8ce98c2c117121a7880780f069719b057e75a","observation_id":"876626fd-8d04-4c27-9de5-738d8bbe83de","resolution":{"observed_at":"2026-08-07T11:54:19.101085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04364","last_updated":"2024-12-08T18:01:25Z","snapshot_observed_at":"2026-07-06T19:28:30.731752Z","submitted_at":"2024-10-06T05:46:17Z","title":"VideoGuide: Improving Video Diffusion Models without Training Through a Teacher's Guide","version":3},"cited_work":{"arxiv_id":"2410.04364","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04364","snapshot_observed_at":"2026-08-07T11:54:20.270545Z","title":"VideoGuide: Improving Video Diffusion Models without Training Through a Teacher's Guide","venue":"cs.CV","work_id":"a2770cd5-f683-4ebd-90b6-7c62ba1db2f9","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.234083Z"},"links":{"cited_paper":"/paper/2410.04364","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:8c238e521c8b5de0427c7d8a53c69ab852e99bf6f6daa288dfdc349f77344ff9","observation_id":"07a5c2ac-08b3-453f-a11f-136be8bc5f68","resolution":{"observed_at":"2026-08-07T11:54:20.315867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-07T11:54:19.341546Z","title":"AnimateD- iff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.341546Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:9b9c5747e199f5f367dcd303039b7a5123c09c843d534c30151b56f2f6caa0bd","observation_id":"2ea746f8-453d-441a-867c-01d062ee81f9","resolution":{"observed_at":"2026-08-07T11:54:19.341546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:20.983547Z","title":"FLUX, 2024","venue":null,"work_id":"f21b73a2-1319-4930-a9b0-30d8fc0045f4","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.498956Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:b20dd07e2e76ae48183d8ef112a39c48f07b4bf3cd8aee2f0c1899f17d6800cb","observation_id":"3e686fc9-2ca5-4e0a-90fc-b7199a262d38","resolution":{"observed_at":"2026-08-07T11:54:21.039465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:20.823056Z","title":"Sampson, Shikai Li, Simone Parmeggiani, Steve Fine, Tara Fowler, Vladan Petrovic, and Yuming Du","venue":null,"work_id":"033900d0-b0e6-4eef-9574-9e4464855213","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.616036Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:c581ca59709f39addb21c1bd37ecd8d44c067e1c2e7dc6c259365c4649e8cdeb","observation_id":"046f19d7-c6ce-4d65-8be3-efe75632e3c3","resolution":{"observed_at":"2026-08-07T11:54:20.918700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T11:54:19.711389Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.711389Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:b4b382621a55a68a80b967b7bbf77795d1e961c4be5f0724c25a73efc9e8aad7","observation_id":"fa7058c4-df51-466b-be7b-61e43022fcbe","resolution":{"observed_at":"2026-08-07T11:54:19.711389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11775","last_updated":"2025-01-27T06:25:11Z","snapshot_observed_at":"2026-08-07T07:54:21.393889Z","submitted_at":"2024-06-17T17:32:42Z","title":"Task Me Anything","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11775","snapshot_observed_at":"2026-08-07T11:54:19.818821Z","title":"Task me anything","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.818821Z"},"links":{"cited_paper":"/paper/2406.11775","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:0eee15403154beb502663a1eec2a0010a3a1709c7f2417e3ddd95daee5ad56f6","observation_id":"d4181f97-fd03-46a5-91c9-578fda78c8b5","resolution":{"observed_at":"2026-08-07T11:54:19.818821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04324","last_updated":"2024-07-01T03:57:55Z","snapshot_observed_at":"2026-08-04T02:26:31.748049Z","submitted_at":"2024-02-06T19:08:18Z","title":"ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04324","snapshot_observed_at":"2026-08-07T11:54:19.929505Z","title":"Consisti2v: Enhancing visual consistency for image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.929505Z"},"links":{"cited_paper":"/paper/2402.04324","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:705fff796e9f4d9292f24a95793622d2791c01fcd53185489fc02d334ae943fc","observation_id":"beb7080d-8567-44d0-9290-5c3ebd28c418","resolution":{"observed_at":"2026-08-07T11:54:19.929505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15275","last_updated":"2024-06-25T16:57:27Z","snapshot_observed_at":"2026-07-06T18:04:33.726854Z","submitted_at":"2024-04-23T17:59:43Z","title":"ID-Animator: Zero-Shot Identity-Preserving Human Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15275","snapshot_observed_at":"2026-08-07T11:54:19.998936Z","title":"Id- animator: Zero-shot identity-preserving human video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.998936Z"},"links":{"cited_paper":"/paper/2404.15275","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:93a398d7c0fe7ebfe7cae55aad8929b2aa77d618d12b0b8601f3f2ad6499f0fe","observation_id":"05324431-2995-46dd-bffe-ac91db57e4b7","resolution":{"observed_at":"2026-08-07T11:54:19.998936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-05T07:44:02.175955Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T11:54:20.099641Z","title":"Young Adult Male Doing Handstand on the beach","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:20.099641Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:f09b1767d5124307b7ae8a2877b131efd8288a38e49244ac4adec26cf496ab12","observation_id":"35d18506-4223-4ae8-bf53-66c4e275635a","resolution":{"observed_at":"2026-08-07T11:54:20.099641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 4 inbound Pith citation observations for arXiv:2506.01144."}