{"as_of":"2026-08-10T00:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a7165ce5c5ed23a1acd8e6d29bfc36885e4444808bc89381fc384cf22ecfa008","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:39:34.477198Z","state":"measured"},{"denominator":104,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":104,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T03:27:02.232039Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T11:36:54.921392Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"cited_work":{"arxiv_id":"2507.12952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12952","snapshot_observed_at":"2026-07-02T11:36:54.921392Z","title":"Ozgur Kara, Krishna Kumar Singh, Feng Liu, Duygu Ceylan, James M Rehg, and Tobias Hinz","venue":null,"work_id":"50ec58d1-5155-4133-a023-cd811e7c5a35","year":2025},"citing_paper":{"arxiv_id":"2510.02283","last_updated":"2025-10-02T17:55:42Z","snapshot_observed_at":"2026-08-09T17:36:50.125769Z","submitted_at":"2025-10-02T17:55:42Z","title":"Self-Forcing++: Towards Minute-Scale High-Quality Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T22:39:53.995700Z"},"links":{"cited_paper":"/paper/2507.12952","citing_paper":"/paper/2510.02283"},"observation_digest":"sha256:7d46955d61579958c1327b772f77c9cab18f9bfc78c7f58bded120458d58c3b6","observation_id":"c11f3f19-4b58-4c41-b0fd-5700f12afb32","resolution":{"observed_at":"2026-05-15T22:39:54.408878Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"cited_work":{"arxiv_id":"2507.12952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12952","snapshot_observed_at":"2026-07-02T11:36:54.921392Z","title":"Ozgur Kara, Krishna Kumar Singh, Feng Liu, Duygu Ceylan, James M Rehg, and Tobias Hinz","venue":null,"work_id":"50ec58d1-5155-4133-a023-cd811e7c5a35","year":2025},"citing_paper":{"arxiv_id":"2603.28489","last_updated":"2026-07-04T13:25:12Z","snapshot_observed_at":"2026-08-05T11:17:52.410204Z","submitted_at":"2026-03-30T14:23:45Z","title":"Video Generation Models as World Models: Efficient Paradigms, Architectures and Algorithms","version":2},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-05-14T01:35:14.878069Z"},"links":{"cited_paper":"/paper/2507.12952","citing_paper":"/paper/2603.28489"},"observation_digest":"sha256:503faf225a39a04a4f8a966d084a4798d5c602575061031bdacaf451be947ced","observation_id":"25e430b6-2f4d-4213-b08d-e3079e0a33f0","resolution":{"observed_at":"2026-05-14T01:38:35.824892Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"cited_work":{"arxiv_id":"2507.12952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12952","snapshot_observed_at":"2026-07-02T11:36:54.921392Z","title":"Ozgur Kara, Krishna Kumar Singh, Feng Liu, Duygu Ceylan, James M Rehg, and Tobias Hinz","venue":null,"work_id":"50ec58d1-5155-4133-a023-cd811e7c5a35","year":2025},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-07-06T23:03:21.422544Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2507.12952","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:54cfac64fc7cd00e5684a10683e63606ad60f5f67f7a0dc47a1cb6253b738ddc","observation_id":"41fb8877-9314-4e70-8168-f7d697adbe0f","resolution":{"observed_at":"2026-05-10T09:03:26.289108Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"cited_work":{"arxiv_id":"2507.12952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12952","snapshot_observed_at":"2026-07-02T11:36:54.921392Z","title":"Ozgur Kara, Krishna Kumar Singh, Feng Liu, Duygu Ceylan, James M Rehg, and Tobias Hinz","venue":null,"work_id":"50ec58d1-5155-4133-a023-cd811e7c5a35","year":2025},"citing_paper":{"arxiv_id":"2605.18733","last_updated":"2026-05-18T17:54:34Z","snapshot_observed_at":"2026-08-01T05:47:01.861403Z","submitted_at":"2026-05-18T17:54:34Z","title":"Advancing Narrative Long Video Generation via Training-Free Identity-Aware Memory","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T11:22:27.209556Z"},"links":{"cited_paper":"/paper/2507.12952","citing_paper":"/paper/2605.18733"},"observation_digest":"sha256:c3e3dbe610ca5941075f9cc0419a39564b22629cd2e8055c5ffac7b6035141fc","observation_id":"f8f20515-3ab1-45cb-b4c1-5c6bc6887129","resolution":{"observed_at":"2026-05-20T11:23:13.954123Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"cited_work":{"arxiv_id":"2507.12952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12952","snapshot_observed_at":"2026-07-02T11:36:54.921392Z","title":"Ozgur Kara, Krishna Kumar Singh, Feng Liu, Duygu Ceylan, James M Rehg, and Tobias Hinz","venue":null,"work_id":"50ec58d1-5155-4133-a023-cd811e7c5a35","year":2025},"citing_paper":{"arxiv_id":"2605.23610","last_updated":"2026-05-22T13:20:29Z","snapshot_observed_at":"2026-08-08T10:04:13.494103Z","submitted_at":"2026-05-22T13:20:29Z","title":"EM-Vid: Training-Free Entity-Centric Memory for Efficient and Consistent Multi-Shot Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-25T04:57:13.479165Z"},"links":{"cited_paper":"/paper/2507.12952","citing_paper":"/paper/2605.23610"},"observation_digest":"sha256:ce204c058af3949e78eb6d070344cc23a00f481626d47c856c008ede38080815","observation_id":"9371b6bb-a56e-4b8f-883b-2f2005ae3c56","resolution":{"observed_at":"2026-05-25T05:00:22.453810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"cited_work":{"arxiv_id":"2507.12952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12952","snapshot_observed_at":"2026-07-02T11:36:54.921392Z","title":"Ozgur Kara, Krishna Kumar Singh, Feng Liu, Duygu Ceylan, James M Rehg, and Tobias Hinz","venue":null,"work_id":"50ec58d1-5155-4133-a023-cd811e7c5a35","year":2025},"citing_paper":{"arxiv_id":"2606.04527","last_updated":"2026-06-03T07:09:01Z","snapshot_observed_at":"2026-08-06T03:22:24.182739Z","submitted_at":"2026-06-03T07:09:01Z","title":"Echo-Infinity: Learning Evolving Memory for Real-Time Infinite Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T03:27:02.232039Z"},"links":{"cited_paper":"/paper/2507.12952","citing_paper":"/paper/2606.04527"},"observation_digest":"sha256:d14723a5624f9273c391a4a5f0a657d9bebdef70fc0039bf3ca3fb56b8e009a7","observation_id":"292b576f-c86f-4d63-973f-845e5ad3adf6","resolution":{"observed_at":"2026-07-02T11:36:54.922789Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12952/citation-record","integrity":"/paper/2507.12952/integrity","json":"/paper/2507.12952/citation-record.json","paper":"/paper/2507.12952"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:20.313800Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:20.313800Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:4472292b3aeeff0e73ad43d53b856bf76b6cd33a2b853449996945bd7171e36f","observation_id":"b54bbc14-fd25-48b6-9cbd-2974b1c66193","resolution":{"observed_at":"2026-08-06T16:39:20.313800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:20.430340Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:20.430340Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:9d2ee8c6fd82ae6abcb42969f438992f1400d8d7275d6262a97843754dc6832e","observation_id":"ee3e2dc1-272a-42e5-a444-dd0a8bf26b28","resolution":{"observed_at":"2026-08-06T16:39:20.430340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15571","last_updated":"2023-03-09T15:18:40Z","snapshot_observed_at":"2026-08-08T19:32:58.342274Z","submitted_at":"2022-09-30T16:30:31Z","title":"Building Normalizing Flows with Stochastic Interpolants","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15571","snapshot_observed_at":"2026-08-06T16:39:20.558409Z","title":"S.; and Vanden-Eijnden, E","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:20.558409Z"},"links":{"cited_paper":"/paper/2209.15571","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:578761cab896510d048ca1b02bd534e5061a8515226db911d011cb8167043c00","observation_id":"802de11c-601e-4a0e-915d-babe1d1a21cf","resolution":{"observed_at":"2026-08-06T16:39:20.558409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T16:39:20.699087Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:20.699087Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:bb89a537b6de8b5b5a4a2488b60f02b23b5a838fcb84e9e4335e77cc21c35d99","observation_id":"983e8f45-a3bc-4a6d-b96b-7210b97482a3","resolution":{"observed_at":"2026-08-06T16:39:20.699087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04682","last_updated":"2024-11-08T05:45:45Z","snapshot_observed_at":"2026-08-08T14:17:53.985522Z","submitted_at":"2024-05-07T21:52:39Z","title":"TALC: Time-Aligned Captions for Multi-Scene Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04682","snapshot_observed_at":"2026-08-06T16:39:20.837113Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:20.837113Z"},"links":{"cited_paper":"/paper/2405.04682","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:3349ea58d97ca9e9e8091a17f975741317605db2a08951b39b7f5040f7d1b8a4","observation_id":"0417c5fc-31fa-4223-9446-89fc25712067","resolution":{"observed_at":"2026-08-06T16:39:20.837113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:20.982097Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:20.982097Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:f3ab29cad249b436e9aceab6c7bb7e53f82078d2b32eb86dcf5996b60b807935","observation_id":"73943300-38d1-490a-829c-fe2c4b029c43","resolution":{"observed_at":"2026-08-06T16:39:20.982097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:21.180076Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:21.180076Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:59b82a400e4dd099bf39215b999e7717e0f8874ea0334b23b074c741fd718eb8","observation_id":"c25125f7-dc02-44fc-8b66-84027d41d4cf","resolution":{"observed_at":"2026-08-06T16:39:21.180076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T16:39:21.310256Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:21.310256Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:c32a0d86277a73e606073b5e00867e38e7b584cf8dba551fa14722192b958c87","observation_id":"c2487460-bc9e-41ca-94a5-8b301bb0daee","resolution":{"observed_at":"2026-08-06T16:39:21.310256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:21.441711Z","title":"W.; Fidler, S.; and Kreis, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:21.441711Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:b0ec1f9a55e51146f856085118f5a092035378d12eb8230a819a8fb0a7f04105","observation_id":"06c30866-1e08-4508-8182-411520f4687f","resolution":{"observed_at":"2026-08-06T16:39:21.441711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:21.556532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:21.556532Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:669f08c4ce568fe0c68c71ee89309c9252af3cdeb89c824de6875602eef12584","observation_id":"1665c47a-05c1-4295-8a3e-1b70400508cb","resolution":{"observed_at":"2026-08-06T16:39:21.556532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13074","last_updated":"2025-04-21T10:34:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-17T16:37:27Z","title":"SkyReels-V2: Infinite-length Film Generative Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13074","snapshot_observed_at":"2026-08-06T16:39:21.748152Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:21.748152Z"},"links":{"cited_paper":"/paper/2504.13074","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:7354b7e2e9858b0f2f0111544c5f25bb4c7ac7b25374385913c0d86c0a18d1cf","observation_id":"cba667dc-faab-4108-919a-57ce19bf34d7","resolution":{"observed_at":"2026-08-06T16:39:21.748152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-07T10:15:15.859263Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T16:39:21.916399Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:21.916399Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:fd12d7bd045d4a3b5e59b9812bb76b97b297e36f3fb4aca1e634fb3ff84480ec","observation_id":"6c9fcc23-b086-4b9b-92d3-f3a8e8bcbf8c","resolution":{"observed_at":"2026-08-06T16:39:21.916399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:22.067158Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:22.067158Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:09c3478b3288c0c1d2c634baa49c161a500191a0ba1612746ce0f68cc4e9c2b2","observation_id":"ba92e749-12ac-4e50-87eb-4f4128b3b233","resolution":{"observed_at":"2026-08-06T16:39:22.067158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09019","last_updated":"2025-01-15T18:59:15Z","snapshot_observed_at":"2026-08-01T17:57:05.196587Z","submitted_at":"2025-01-15T18:59:15Z","title":"Ouroboros-Diffusion: Exploring Consistent Content Generation in Tuning-free Long Video Diffusion","version":1},"cited_work":{"arxiv_id":"2501.09019","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09019","snapshot_observed_at":"2026-08-06T16:39:36.157444Z","title":"Ouroboros-Diffusion: Exploring Consistent Content Generation in Tuning-free Long Video Diffusion","venue":"cs.CV","work_id":"659db8db-8fe6-405c-a904-cd6ddd0b77b6","year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:22.191563Z"},"links":{"cited_paper":"/paper/2501.09019","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:7a9d3c2e96b304774dab12fffb819a60d05db10bcc4641cdc9d1dd65883148de","observation_id":"b8d6433a-5708-4b02-88a4-6a1b9dc48bfe","resolution":{"observed_at":"2026-08-06T16:39:36.304042Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:22.328581Z","title":"E.; Fang, Y.; Lee, H.-Y.; Ren, J.; Yang, M.-H.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:22.328581Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:2d75439529ef2de6965be21cbe4c165a49de3e73bbfe1875e452c192fedf54fd","observation_id":"1a632ce2-92e5-4f94-bf16-959af5c98dfa","resolution":{"observed_at":"2026-08-06T16:39:22.328581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:22.391194Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:22.391194Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:d52f8667b8792c7d165b744ddb3fe149d69c4d79266da97644cf30d94a676a1f","observation_id":"6428dbb2-4140-4437-8ad0-952ab3c98c84","resolution":{"observed_at":"2026-08-06T16:39:22.391194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05298","last_updated":"2025-04-07T17:56:31Z","snapshot_observed_at":"2026-08-07T16:07:51.376018Z","submitted_at":"2025-04-07T17:56:31Z","title":"One-Minute Video Generation with Test-Time Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05298","snapshot_observed_at":"2026-08-06T16:39:22.491454Z","title":"C.; Kautz, J.; Guestrin, C.; et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:22.491454Z"},"links":{"cited_paper":"/paper/2504.05298","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:eb7583dbcbd7da9f144dae282dcbd44ffcadb6efe5185f95bc80a4fda6c9eea9","observation_id":"8a142697-b602-4519-961b-481517619a7e","resolution":{"observed_at":"2026-08-06T16:39:22.491454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:22.632104Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:22.632104Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:5a12cfbb5aebb5d8a8460bd7747c4355f6d11af188a8716a2af0053247f0db45","observation_id":"f3679204-8fbc-4746-85aa-6aa38dce5b70","resolution":{"observed_at":"2026-08-06T16:39:22.632104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17574","last_updated":"2025-05-23T07:33:25Z","snapshot_observed_at":"2026-08-09T05:23:10.336112Z","submitted_at":"2025-05-23T07:33:25Z","title":"InfLVG: Reinforce Inference-Time Consistent Long Video Generation with GRPO","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17574","snapshot_observed_at":"2026-08-06T16:39:22.782837Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:22.782837Z"},"links":{"cited_paper":"/paper/2505.17574","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:60c9119e7400dfed6741d730048dcc97c3c7afc141c2f7c01fdd674a38d0c20c","observation_id":"4bd4bfc5-c69f-40ec-bfd0-22be3e54ff57","resolution":{"observed_at":"2026-08-06T16:39:22.782837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10981","last_updated":"2024-06-16T15:37:22Z","snapshot_observed_at":"2026-07-06T18:31:45.125236Z","submitted_at":"2024-06-16T15:37:22Z","title":"ViD-GPT: Introducing GPT-style Autoregressive Generation in Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10981","snapshot_observed_at":"2026-08-06T16:39:22.906941Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:22.906941Z"},"links":{"cited_paper":"/paper/2406.10981","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:cc351cd826894b6b9b70d4c78e28ccb02a06e1fd78ca64fb40b2eac94e6045e2","observation_id":"b033239e-d88d-4a8f-89dd-46da93d05877","resolution":{"observed_at":"2026-08-06T16:39:22.906941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-06T08:05:31.883352Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-06T16:39:23.020880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:23.020880Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:7e6dd5cbc4115bfa87fd37150654290edfab3d53344fc94216962965cfd96697","observation_id":"d2d60708-f89c-49fe-9fa1-029466172e46","resolution":{"observed_at":"2026-08-06T16:39:23.020880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03549","last_updated":"2023-09-07T08:12:58Z","snapshot_observed_at":"2026-07-06T16:15:35.656382Z","submitted_at":"2023-09-07T08:12:58Z","title":"Reuse and Diffuse: Iterative Denoising for Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03549","snapshot_observed_at":"2026-08-06T16:39:23.166205Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:23.166205Z"},"links":{"cited_paper":"/paper/2309.03549","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:779279bfd4e35cf4845cd8dd30975e15d3486c1db690e9eea22f06f898dde403","observation_id":"1d96e988-0c82-4594-882b-763dd5d9a8a5","resolution":{"observed_at":"2026-08-06T16:39:23.166205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19325","last_updated":"2025-05-18T02:27:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T03:38:06Z","title":"Long-Context Autoregressive Video Modeling with Next-Frame Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19325","snapshot_observed_at":"2026-08-06T16:39:23.275597Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:23.275597Z"},"links":{"cited_paper":"/paper/2503.19325","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:6dfaab95610a4abdebb5e1ca6592768738e1dc4a7b01fe775e0eb438db069444","observation_id":"c24ddccb-c82e-48fe-a731-828dc983a993","resolution":{"observed_at":"2026-08-06T16:39:23.275597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T16:39:23.420946Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:23.420946Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:5f816bc8d69670e77d9fc482091c7c287d738c4c12b199c14149b6670e536d6b","observation_id":"7e5b5acf-9fc7-4f44-aa39-7aebe126da2e","resolution":{"observed_at":"2026-08-06T16:39:23.420946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10589","last_updated":"2025-03-13T17:40:07Z","snapshot_observed_at":"2026-08-07T17:06:18.944213Z","submitted_at":"2025-03-13T17:40:07Z","title":"Long Context Tuning for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10589","snapshot_observed_at":"2026-08-06T16:39:23.564667Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:23.564667Z"},"links":{"cited_paper":"/paper/2503.10589","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:3d8e66dc3f943c10a3e716596af992db71382924b70c33a52fd4ff0328208129","observation_id":"02620058-ac81-4ad0-96f2-5e083b777a16","resolution":{"observed_at":"2026-08-06T16:39:23.564667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-06T16:39:23.691375Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:23.691375Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:58664ebe6a26a3a63a5064044f2aa64906d68177b0aef3ee2697edfd77ec142a","observation_id":"7cb1e8d0-381f-4fa5-ae70-b2c7e326db4f","resolution":{"observed_at":"2026-08-06T16:39:23.691375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:23.831023Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:23.831023Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:f56ea279fee4c060e7fec9be49f145455fbdde09d5f148bb22a786f710c3020e","observation_id":"3f91f4d1-48c4-4065-a61b-690bb0365e2a","resolution":{"observed_at":"2026-08-06T16:39:23.831023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14773","last_updated":"2025-04-16T13:38:58Z","snapshot_observed_at":"2026-08-09T14:37:44.086189Z","submitted_at":"2024-03-21T18:27:29Z","title":"StreamingT2V: Consistent, Dynamic, and Extendable Long Video Generation from Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14773","snapshot_observed_at":"2026-08-06T16:39:23.968359Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:23.968359Z"},"links":{"cited_paper":"/paper/2403.14773","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:4b471dd5a516bcc168efba1ec6e830590f5ca4a516da5d83d1b3139d084b8b12","observation_id":"014f3436-9cb0-4c81-bfff-c417f4e07c2b","resolution":{"observed_at":"2026-08-06T16:39:23.968359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-06T16:39:24.111745Z","title":"P.; Poole, B.; Norouzi, M.; Fleet, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:24.111745Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:8d8c65148fede0c12e2a371de0e055ba99411b77ac64e750a9c889916ac95bdd","observation_id":"0da473c4-425d-423a-be6f-94e3b2d2a14c","resolution":{"observed_at":"2026-08-06T16:39:24.111745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:24.235260Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:24.235260Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:f995107bb7ffc885bae35a3bcefedaedadbd4034b36ae8faa7e39d0527047161","observation_id":"bd1cb9dc-8531-434d-b430-03cec75f3afc","resolution":{"observed_at":"2026-08-06T16:39:24.235260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:24.361751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:24.361751Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:6f084832e16d686c0b2f1a5e2aafc852d8f36524f9c29f11b4cf8d7ff001d901","observation_id":"f631c940-a4de-4b8a-9cf3-3dc6f7fefc62","resolution":{"observed_at":"2026-08-06T16:39:24.361751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-06T16:39:24.508909Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:24.508909Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:b8a2e945687778f65330454593d1391254d89a0607412d5d573fd5c06f65201e","observation_id":"0d9c8bfd-9578-4c35-ad8f-a267699440f4","resolution":{"observed_at":"2026-08-06T16:39:24.508909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:24.641227Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:24.641227Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:2f97b941cef941e7db8ddb072e1acb3531e72bc672a5606b6facf5daf5160a53","observation_id":"4f884925-f11f-4d95-8ff4-5eb07dfe21e9","resolution":{"observed_at":"2026-08-06T16:39:24.641227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:24.807234Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:24.807234Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:7407c10558c404f01d5a66e70c452cc2e06b7e635984bf79c2d85c99ef26c085","observation_id":"cd784214-ade2-41cb-bb3e-680cd0c1cf35","resolution":{"observed_at":"2026-08-06T16:39:24.807234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06310","last_updated":"2026-05-19T15:23:11Z","snapshot_observed_at":"2026-08-09T02:58:00.845337Z","submitted_at":"2025-03-08T19:04:36Z","title":"Scene-Action Prompt Fusion for Coherent Text-to-Video Storytelling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06310","snapshot_observed_at":"2026-08-06T16:39:24.959148Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:24.959148Z"},"links":{"cited_paper":"/paper/2503.06310","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:c7cc9616ffb363aa4a173cbd35c836fbdfccdf5056de570db8841bb8de9be51b","observation_id":"be1bde9e-a37a-4970-93e5-03ebf4c863ba","resolution":{"observed_at":"2026-08-06T16:39:24.959148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07652","last_updated":"2025-05-12T15:22:28Z","snapshot_observed_at":"2026-08-07T16:54:24.912782Z","submitted_at":"2025-05-12T15:22:28Z","title":"ShotAdapter: Text-to-Multi-Shot Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07652","snapshot_observed_at":"2026-08-06T16:39:25.127558Z","title":"K.; Liu, F.; Ceylan, D.; Rehg, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:25.127558Z"},"links":{"cited_paper":"/paper/2505.07652","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:8f1bc52d19c69093e9fbbbd2eff3e22f785bc888c0b48de448a72c2066fc1439","observation_id":"25fc22a4-82b8-4e38-a725-ab4140fa5bcc","resolution":{"observed_at":"2026-08-06T16:39:25.127558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:25.278748Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:25.278748Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:e50618ddfaa4e2f34a4a6964064bf5f0cdedcc96c1d491913fba5058ca8ff360","observation_id":"155925b9-7d4c-451d-bb2d-8e1594cd9d0d","resolution":{"observed_at":"2026-08-06T16:39:25.278748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08605","last_updated":"2025-03-11T16:43:45Z","snapshot_observed_at":"2026-08-07T17:12:25.713576Z","submitted_at":"2025-03-11T16:43:45Z","title":"Tuning-Free Multi-Event Long Video Generation via Synchronized Coupled Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08605","snapshot_observed_at":"2026-08-06T16:39:25.481732Z","title":"W.; Wang, J.-H.; Lee, J.-Y.; and Shin, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:25.481732Z"},"links":{"cited_paper":"/paper/2503.08605","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:4ec3861a84f79f01def5bdb1a9a0c688321f887366505e561951c354215858d6","observation_id":"60457099-dcba-4072-a7de-d642b3887afd","resolution":{"observed_at":"2026-08-06T16:39:25.481732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T16:39:25.682086Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:25.682086Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:88b46610fe3b60aa4e507fb301c0d02aa4c227ff0e13c1ec5ab4b804d53c36e3","observation_id":"c8bf3bf1-864a-48d5-be97-463ca1b52466","resolution":{"observed_at":"2026-08-06T16:39:25.682086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:25.843527Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:25.843527Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:f19c22259b2c95858c47b93f0c76763d0385d8f7148c1e4dbf11bf7c3cba521f","observation_id":"8d55f9fb-2e25-4b17-ab2c-411d2fe858ef","resolution":{"observed_at":"2026-08-06T16:39:25.843527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13501","last_updated":"2025-03-18T13:55:22Z","snapshot_observed_at":"2026-07-06T17:47:38.508384Z","submitted_at":"2024-03-20T10:58:58Z","title":"VSTAR: Generative Temporal Nursing for Longer Dynamic Video Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13501","snapshot_observed_at":"2026-08-06T16:39:25.940232Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:25.940232Z"},"links":{"cited_paper":"/paper/2403.13501","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:d860b30eb753fe09ae9f5aa49ba5a73b8e946f390495f688809e5622ed8fe69a","observation_id":"13dcb863-32ec-4c1f-a8f8-796d75bcaa0b","resolution":{"observed_at":"2026-08-06T16:39:25.940232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20502","last_updated":"2025-04-15T14:06:28Z","snapshot_observed_at":"2026-08-09T19:12:58.820557Z","submitted_at":"2024-10-27T16:28:28Z","title":"ARLON: Boosting Diffusion Transformers with Autoregressive Models for Long Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20502","snapshot_observed_at":"2026-08-06T16:39:26.086878Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:26.086878Z"},"links":{"cited_paper":"/paper/2410.20502","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:e9bbeb13777d31d29910ca4667b92d8557f49233c2533447a1703b496e3472d5","observation_id":"57f11cb5-f0d1-423e-9b17-c90a6b3d5278","resolution":{"observed_at":"2026-08-06T16:39:26.086878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-09T23:28:59.299375Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-06T16:39:26.285608Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:26.285608Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:01bfec853dbe6289cd8bc01e6175cd1e1cbaefed65fdd74d8e530655c878ee42","observation_id":"e4efc5c6-a17b-4d9f-8d9b-43459d74bf9c","resolution":{"observed_at":"2026-08-06T16:39:26.285608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:26.413315Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:26.413315Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:6f7cd878a703d4241608d8dca376de175ee3ed90eb80b3c59ce2d824eb59b77f","observation_id":"f602dc2f-8400-48d8-aae5-de77c2227fcf","resolution":{"observed_at":"2026-08-06T16:39:26.413315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-06T16:39:26.512525Z","title":"T.; Ben-Hamu, H.; Nickel, M.; and Le, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:26.512525Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:2080e9d0775deb92075eac4acdfc4dc27aa60f9dae7e03aa102b6c713ea54982","observation_id":"a774b12a-5bf0-4956-bfd8-95de5eaea878","resolution":{"observed_at":"2026-08-06T16:39:26.512525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06782","last_updated":"2025-02-12T10:07:07Z","snapshot_observed_at":"2026-08-08T14:18:27.556352Z","submitted_at":"2025-02-10T18:58:11Z","title":"Lumina-Video: Efficient and Flexible Video Generation with Multi-scale Next-DiT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06782","snapshot_observed_at":"2026-08-06T16:39:26.590107Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:26.590107Z"},"links":{"cited_paper":"/paper/2502.06782","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:67c121fbe1f13aa844a5db029ed8f9ed61c5aa296be2b567e9b5779d9cc99754","observation_id":"3383d472-7743-42d3-b396-5a4653c84353","resolution":{"observed_at":"2026-08-06T16:39:26.590107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-06T16:39:26.763548Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:26.763548Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:3cf4a91dda72fe99f69220ca1b27b0dde7fbbb8694bdd969c56766be6d9a1d4f","observation_id":"b3292fab-1cec-4e76-80b8-0645f5a18d5f","resolution":{"observed_at":"2026-08-06T16:39:26.763548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:26.949590Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:26.949590Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:a38b410815ef585bf7b5bc973696e86f1c4146f29b64d7b9216c6fcef54baba0","observation_id":"e7b6af1b-d2ca-4c58-89ea-cf09b0a33357","resolution":{"observed_at":"2026-08-06T16:39:26.949590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:27.084307Z","title":"???? FreeLong: Training-Free Long Video Generation with SpectralBlend Temporal Attention","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:27.084307Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:158bd3463e9e1d6db94e35e84a958802ae2e38d8eaf42e0c59f0e4e3ff453ab7","observation_id":"ebe13acf-7cea-4087-bf9f-fbf5ab518a17","resolution":{"observed_at":"2026-08-06T16:39:27.084307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-08-06T16:39:27.203630Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:27.203630Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:634eb50462c9928309e473a96b6f3c86d10959f8e6a3b05f5ebd3690bc7a3ebc","observation_id":"5d7a3676-ba21-4ee9-a63f-7a56cdfe51ad","resolution":{"observed_at":"2026-08-06T16:39:27.203630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:27.365685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:27.365685Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:20fd6c227b98e77e53f2ca0646c8e7459afa9d2f97ad086c19847cb1ee86531a","observation_id":"9d5afaa0-edf3-400d-96fb-cc4a9ffd990d","resolution":{"observed_at":"2026-08-06T16:39:27.365685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18620","last_updated":"2024-04-29T11:41:34Z","snapshot_observed_at":"2026-07-06T18:07:02.343211Z","submitted_at":"2024-04-29T11:41:34Z","title":"FlexiFilm: Long Video Generation with Flexible Conditions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18620","snapshot_observed_at":"2026-08-06T16:39:27.525241Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:27.525241Z"},"links":{"cited_paper":"/paper/2404.18620","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:07589d6380bf67f31f3d2ad00461f06fce134b75509f917dc179b18b93138b27","observation_id":"757fe3bd-32a9-49b7-b38f-4309419485f9","resolution":{"observed_at":"2026-08-06T16:39:27.525241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:27.632053Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:27.632053Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:463d91675260948e82598c3e666ccd0fe35aa97537b218f556eb77d778b42f4d","observation_id":"bc9d51d3-53d2-4040-91b9-8724e1097e94","resolution":{"observed_at":"2026-08-06T16:39:27.632053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-09T03:17:30.671491Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-06T16:39:27.790649Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:27.790649Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:8fbb90836692fbf627ec555d4c746abb0936fef8663a9dda4cb1892ace7c9d87","observation_id":"a526ccb9-1282-4617-a76c-fb6a4f82f176","resolution":{"observed_at":"2026-08-06T16:39:27.790649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19881","last_updated":"2025-03-25T17:46:50Z","snapshot_observed_at":"2026-08-07T16:37:42.099795Z","submitted_at":"2025-03-25T17:46:50Z","title":"Mask$^2$DiT: Dual Mask-based Diffusion Transformer for Multi-Scene Long Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19881","snapshot_observed_at":"2026-08-06T16:39:27.937544Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:27.937544Z"},"links":{"cited_paper":"/paper/2503.19881","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:64bb6217fef898589ed879816204fa585b36b762d2f94b2eb40cfd6c741fd71e","observation_id":"3e8a0b4d-bf8b-490e-8a88-4d4aee0a8b22","resolution":{"observed_at":"2026-08-06T16:39:27.937544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15169","last_updated":"2024-01-30T16:44:20Z","snapshot_observed_at":"2026-08-03T19:40:46.693368Z","submitted_at":"2023-10-23T17:59:58Z","title":"FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15169","snapshot_observed_at":"2026-08-06T16:39:28.051576Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:28.051576Z"},"links":{"cited_paper":"/paper/2310.15169","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:58dbbaf8f6f40bd390f7545e6d2b2845ab2dbe42b59141226db5ca175cbfd919","observation_id":"c2262f1e-3b55-465b-8c61-708674ea7ab1","resolution":{"observed_at":"2026-08-06T16:39:28.051576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:28.174882Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:28.174882Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:59bb9126836dfa262c86c53585bf686a80b30c6acb8b21cbe2839c8d7dcdf61e","observation_id":"494736e6-fc22-4874-859d-b09ec6795b42","resolution":{"observed_at":"2026-08-06T16:39:28.174882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:28.366109Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:28.366109Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:852606725b556aca1da76efd9f0f625f91d2e22590643f026b5006cfd923a4a3","observation_id":"fd5aba9a-b930-48a2-b47d-a1be53fcf496","resolution":{"observed_at":"2026-08-06T16:39:28.366109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:38.696114Z","title":"???? Rolling Diffusion Models","venue":null,"work_id":"1ec16fd3-53b9-4600-828d-f80fd8ce7737","year":null},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:28.516368Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:1371254bea1b347ba075bd142e8a81b48ca5627b99d70847e655698ff49b0dbd","observation_id":"1fcff833-9f76-47a1-9297-48d1b83bac6a","resolution":{"observed_at":"2026-08-06T16:39:38.788295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:28.633155Z","title":"P.; Wang, X.; and Gool, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:28.633155Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:48e06202086661a27b56d66d3883ae2d193892bb96db61b0023fa6af1f013da3","observation_id":"70fb7642-ba53-46f8-8a00-9897c8b27d58","resolution":{"observed_at":"2026-08-06T16:39:28.633155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T16:39:28.856380Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:28.856380Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:cf9f957874a09e3de5f3a8c02df74bffd9a047769dd94018f23052a65fb90b41","observation_id":"eac4ea2f-c476-43f5-9d53-a2cf7f40863d","resolution":{"observed_at":"2026-08-06T16:39:28.856380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06764","last_updated":"2025-07-24T03:58:47Z","snapshot_observed_at":"2026-08-07T11:01:49.684719Z","submitted_at":"2025-02-10T18:44:25Z","title":"History-Guided Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06764","snapshot_observed_at":"2026-08-06T16:39:28.975951Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:28.975951Z"},"links":{"cited_paper":"/paper/2502.06764","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:57202c0c4820d97813f11e484ad578c46781be2e76a820fea987aca7e2ab0d34","observation_id":"a259c9f8-fdcf-46d7-bbad-b4163c8a14c4","resolution":{"observed_at":"2026-08-06T16:39:28.975951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:29.146308Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:29.146308Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:ccac6dd23b28c64cbca436518daf099a99e6058ac6c423e4d174d86fd5b5147e","observation_id":"e2eed724-c101-4eff-bf95-ad37cc13c9cd","resolution":{"observed_at":"2026-08-06T16:39:29.146308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09551","last_updated":"2024-12-12T18:41:20Z","snapshot_observed_at":"2026-08-04T21:06:09.580586Z","submitted_at":"2024-12-12T18:41:20Z","title":"Video Creation by Demonstration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09551","snapshot_observed_at":"2026-08-06T16:39:29.282755Z","title":"J.; Li, Y.; Jia, X.; Adam, H.; Hariharan, B.; Zhao, L.; and Liu, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:29.282755Z"},"links":{"cited_paper":"/paper/2412.09551","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:185116f9a644d4f2e4bd4e9ec2b0c747c2d445dadd9071a9ab3cdb9fa4e6ff32","observation_id":"57458440-faa6-40d5-a536-e073db3177e7","resolution":{"observed_at":"2026-08-06T16:39:29.282755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13211","last_updated":"2025-05-19T14:58:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-19T14:58:50Z","title":"MAGI-1: Autoregressive Video Generation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13211","snapshot_observed_at":"2026-08-06T16:39:29.387852Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:29.387852Z"},"links":{"cited_paper":"/paper/2505.13211","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:c26a456959f94d1de83731a5d1e761f223efbf9ad1347f8056426ca6a7faf1f1","observation_id":"7c131c3b-5a39-4411-82f3-90d470617721","resolution":{"observed_at":"2026-08-06T16:39:29.387852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:29.520523Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:29.520523Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:1c40c733db818a511bb0ddbf3375dbb358aca3bcd11b91ac533efc79e06341bb","observation_id":"d1a68448-7d1b-4a92-b4f8-40c1d70a78d4","resolution":{"observed_at":"2026-08-06T16:39:29.520523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-06T16:39:29.722394Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:29.722394Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:04a5288c170c0e896b461329be0d3a92717e20a4a2aa1c32151cdc299a820e14","observation_id":"bf1dd830-37c3-4725-b272-4e4204c83917","resolution":{"observed_at":"2026-08-06T16:39:29.722394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18264","last_updated":"2023-05-29T17:38:18Z","snapshot_observed_at":"2026-08-09T05:07:43.219616Z","submitted_at":"2023-05-29T17:38:18Z","title":"Gen-L-Video: Multi-Text to Long Video Generation via Temporal Co-Denoising","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18264","snapshot_observed_at":"2026-08-06T16:39:29.844730Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:29.844730Z"},"links":{"cited_paper":"/paper/2305.18264","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:5258382e61220ffe0401a5cb467025965ac5397040785da7ff265e4f12b28d49","observation_id":"9363dd6f-8a08-4e47-9055-b5e2b90c59f8","resolution":{"observed_at":"2026-08-06T16:39:29.844730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:38.392500Z","title":null,"venue":null,"work_id":"1d09b660-af8b-4993-ae6d-6b2b60f5c846","year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:29.991975Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:12cc8f52739f27f64637d891c2e486dcaa368ce8fed7b478a30c5ee45f248d56","observation_id":"048dec3c-1938-42a2-ad81-a6dd8cf2bbe4","resolution":{"observed_at":"2026-08-06T16:39:38.548979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:38.101165Z","title":null,"venue":null,"work_id":"bc20b422-a4da-41fc-b013-e365bb50f2d5","year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:30.162429Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:684b0bba98255c76b9a4b67e3c52105276d41da06fa22b9c1e14f5ef7a8b317d","observation_id":"d5b160f7-fd11-45a2-8d9f-28d4565ba631","resolution":{"observed_at":"2026-08-06T16:39:38.253987Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15838","last_updated":"2025-06-16T11:00:16Z","snapshot_observed_at":"2026-08-08T13:28:27.170223Z","submitted_at":"2025-06-16T11:00:16Z","title":"EchoShot: Multi-Shot Portrait Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15838","snapshot_observed_at":"2026-08-06T16:39:30.293459Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:30.293459Z"},"links":{"cited_paper":"/paper/2506.15838","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:4be40bbd04d5095fc4c5e979d2f55dcf17ab069a5dbeb3ae70d56ca9198bd6dc","observation_id":"bc74f25f-970c-400b-ad6f-6aecec47a64e","resolution":{"observed_at":"2026-08-06T16:39:30.293459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-07T17:54:54.749604Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-06T16:39:30.416152Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:30.416152Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:3ef485cf0c5f4d72267348cf14e5000b85010831c128714564e6d94bce6eb42c","observation_id":"c64c7ad9-11e2-4239-993b-2920ac77f0d5","resolution":{"observed_at":"2026-08-06T16:39:30.416152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:37.862740Z","title":null,"venue":null,"work_id":"9a581a49-e479-4b6b-aaeb-a6c0a407d408","year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:30.596489Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:f2b3d1afa4dcf40886d7c2ea8bd4ac038d418644c898103e3d35529d6c29b491","observation_id":"ac125223-8f67-4a30-ba53-70974369191a","resolution":{"observed_at":"2026-08-06T16:39:37.955188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-06T16:39:30.750694Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:30.750694Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:fd75abe3eeced3843764e6cc55402f3b1662874c3c43b476c24829c1b138b549","observation_id":"4545fb88-e229-402d-a9d1-46d9a3e1f23b","resolution":{"observed_at":"2026-08-06T16:39:30.750694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05263","last_updated":"2025-03-08T01:36:55Z","snapshot_observed_at":"2026-08-06T10:13:32.954773Z","submitted_at":"2024-12-06T18:52:20Z","title":"Mind the Time: Temporally-Controlled Multi-Event Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05263","snapshot_observed_at":"2026-08-06T16:39:30.923686Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:30.923686Z"},"links":{"cited_paper":"/paper/2412.05263","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:d28b3faa8c4d25d60f4de86e66a0184cd895d343dbd59bd60aad4174cc56a7a8","observation_id":"5aa8db55-713e-49a5-a3e9-57d2580ee01c","resolution":{"observed_at":"2026-08-06T16:39:30.923686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09455","last_updated":"2024-06-12T18:55:51Z","snapshot_observed_at":"2026-08-08T08:58:45.984697Z","submitted_at":"2024-06-12T18:55:51Z","title":"Pandora: Towards General World Model with Natural Language Actions and Video States","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09455","snapshot_observed_at":"2026-08-06T16:39:31.052113Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:31.052113Z"},"links":{"cited_paper":"/paper/2406.09455","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:c355748932fa324bf37d4deb3237c6c07d0b8975ab769549bc7e4ea5af4bb559","observation_id":"7f869406-415f-4155-8be8-86ee51d25e18","resolution":{"observed_at":"2026-08-06T16:39:31.052113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06173","last_updated":"2025-06-07T09:44:59Z","snapshot_observed_at":"2026-07-06T20:19:26.003822Z","submitted_at":"2025-01-10T18:52:11Z","title":"VideoAuteur: Towards Long Narrative Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06173","snapshot_observed_at":"2026-08-06T16:39:31.199272Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:31.199272Z"},"links":{"cited_paper":"/paper/2501.06173","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:3aff1e3d9589d2e114ba8d124bd00c5ee0b70e04ee4765800230ab7a7b5ba0fa","observation_id":"f4d812f4-934d-4c2e-9044-aede51c34249","resolution":{"observed_at":"2026-08-06T16:39:31.199272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:31.335983Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:31.335983Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:22f61292946e8ef48a9edea1152e6d65911f630fd165d9a776103bd971ee3e27","observation_id":"3ac6e74d-951d-4ce2-852b-e66e27e3181f","resolution":{"observed_at":"2026-08-06T16:39:31.335983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08151","last_updated":"2025-05-18T06:43:40Z","snapshot_observed_at":"2026-08-06T10:06:06.704733Z","submitted_at":"2024-10-10T17:36:15Z","title":"Progressive Autoregressive Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08151","snapshot_observed_at":"2026-08-06T16:39:31.503175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:31.503175Z"},"links":{"cited_paper":"/paper/2410.08151","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:3c23a9309db135d2a8c1d440e786db0f35ec2eb4cd4ec203dfc249d44e6298ce","observation_id":"a5ef56df-b721-4595-b522-ec2b69fa28a9","resolution":{"observed_at":"2026-08-06T16:39:31.503175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:37.558540Z","title":null,"venue":null,"work_id":"f0c00db4-aa53-413d-8a55-144d7a35d3bc","year":2022},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:31.665978Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:647ac457f7c759093e8e8d8aae71073057a02118ed3aaef978b30685cbba6540","observation_id":"5310631a-a039-42db-af7f-d20f511225fd","resolution":{"observed_at":"2026-08-06T16:39:37.705218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01316","last_updated":"2025-03-29T08:56:56Z","snapshot_observed_at":"2026-07-06T20:00:05.118831Z","submitted_at":"2024-12-02T09:32:36Z","title":"Long Video Diffusion Generation with Segmented Cross-Attention and Content-Rich Video Data Curation","version":2},"cited_work":{"arxiv_id":"2412.01316","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.01316","snapshot_observed_at":"2026-08-06T16:39:35.226413Z","title":"Long Video Diffusion Generation with Segmented Cross-Attention and Content-Rich Video Data Curation","venue":"cs.CV","work_id":"2a1e1446-b490-475a-9e18-3eb42eb78355","year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:31.809545Z"},"links":{"cited_paper":"/paper/2412.01316","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:e201eebda0a3a85082c3f6bcd5ca9b6b8041d275d0f4fa8e482263f9a0ff587d","observation_id":"d2fea119-a772-4558-8bd2-58ed1aa34cdb","resolution":{"observed_at":"2026-08-06T16:39:35.405901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T16:39:31.964894Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:31.964894Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:9b647e25bc170176b2f42008eaa486163e931116888efc2b3f13a530728cb319","observation_id":"78bfd3a1-65d9-4340-a795-cc2b830667fe","resolution":{"observed_at":"2026-08-06T16:39:31.964894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:37.286512Z","title":null,"venue":null,"work_id":"24e54c4b-5da9-4cca-a737-199301b523cc","year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:32.136536Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:cfdc5bc5c7913893685aba49e86bf9c604682e2986c50d5348bb74a4efae4d4a","observation_id":"45200924-caa0-4176-b19c-b5eea61a8dfa","resolution":{"observed_at":"2026-08-06T16:39:37.413127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:32.289683Z","title":"T.; Durand, F.; Shechtman, E.; and Huang, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:32.289683Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:a662667fd38b39d9b636e590051dc60a750cc0078777c9fb9a5813f98ae31a04","observation_id":"f94e4378-e779-4c3b-9fef-00b09f50dffb","resolution":{"observed_at":"2026-08-06T16:39:32.289683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12632","last_updated":"2025-07-08T04:03:03Z","snapshot_observed_at":"2026-08-07T18:09:53.585923Z","submitted_at":"2025-02-18T08:22:50Z","title":"MALT Diffusion: Memory-Augmented Latent Transformers for Any-Length Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12632","snapshot_observed_at":"2026-08-06T16:39:32.420016Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:32.420016Z"},"links":{"cited_paper":"/paper/2502.12632","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:80999bc8f319a00948bc9f8bae04e094997dd9ce9799eb6c14526fcf15a3286d","observation_id":"3323f728-a27c-467a-96dc-3029bb5c0670","resolution":{"observed_at":"2026-08-06T16:39:32.420016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:32.607479Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:32.607479Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:c3434e5aedbdfd7eb64ceeff1ac19f6706e12ea900d150c3ab8d87a5055315b4","observation_id":"bcf17446-f0de-48c2-834c-7cf73be31d56","resolution":{"observed_at":"2026-08-06T16:39:32.607479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23884","last_updated":"2025-05-29T17:50:34Z","snapshot_observed_at":"2026-08-08T17:47:51.120243Z","submitted_at":"2025-05-29T17:50:34Z","title":"Test-Time Training Done Right","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23884","snapshot_observed_at":"2026-08-06T16:39:32.791626Z","title":"T.; and Tan, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:32.791626Z"},"links":{"cited_paper":"/paper/2505.23884","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:05ccab16d2997094a0c9876c41de951dc505a278f79500955275d4e7dc2655b7","observation_id":"9d3ebcb0-7dea-409b-adab-c30caf04e06e","resolution":{"observed_at":"2026-08-06T16:39:32.791626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:32.918440Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:32.918440Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:388e21c0fc0f605c455725b35f6759165855d99ff61f3999787c97b8ba817922","observation_id":"a4091469-9aed-4d67-808c-f62361f9da45","resolution":{"observed_at":"2026-08-06T16:39:32.918440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:33.119508Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:33.119508Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:04dfee9a0e745b1a27c4609ee60596c39a207bb52153ef6281e851f594166663","observation_id":"a8a23e61-3148-4f85-892d-53478308cd08","resolution":{"observed_at":"2026-08-06T16:39:33.119508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15894","last_updated":"2025-08-07T08:48:51Z","snapshot_observed_at":"2026-08-07T17:57:38.872776Z","submitted_at":"2025-02-21T19:28:05Z","title":"RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15894","snapshot_observed_at":"2026-08-06T16:39:33.290335Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:33.290335Z"},"links":{"cited_paper":"/paper/2502.15894","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:bdfdc95fbc4714079bbf22342559e601b3537762a7f99fae9317ab96852b8659","observation_id":"a2b3aa22-a0a2-4b1e-99c0-bc6ae7c5529c","resolution":{"observed_at":"2026-08-06T16:39:33.290335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20827","last_updated":"2025-05-27T07:39:43Z","snapshot_observed_at":"2026-08-08T07:47:50.701180Z","submitted_at":"2025-05-27T07:39:43Z","title":"Frame-Level Captions for Long Video Generation with Complex Multi Scenes","version":1},"cited_work":{"arxiv_id":"2505.20827","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20827","snapshot_observed_at":"2026-08-06T16:39:34.724653Z","title":"Frame-Level Captions for Long Video Generation with Complex Multi Scenes","venue":"cs.CV","work_id":"754c9ce9-ac48-4861-a9b2-ec051c8e8b59","year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:33.443014Z"},"links":{"cited_paper":"/paper/2505.20827","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:2a855414f8f80fcbbcfdcfa5779e4d8c47f08a3bbef7cfaf6c7e7ed35b17aca0","observation_id":"672da83a-bf59-448e-b9c2-ffe3a00488e4","resolution":{"observed_at":"2026-08-06T16:39:34.798842Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:33.571497Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:33.571497Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:9d1f69e9d508b4caf1d62742fb5b65de71cb271c7d06499cfc75fc99bf2b60e1","observation_id":"1d39b46f-4605-4284-b5b9-976cb935f66e","resolution":{"observed_at":"2026-08-06T16:39:33.571497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-06T16:39:33.706117Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:33.706117Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:48c637cd73bcf8973cfcf53e7aad2bf5aa9c4a91143d00b0bd2565b08e421d26","observation_id":"96ac594f-e721-4a09-b61a-9d0089b18dc7","resolution":{"observed_at":"2026-08-06T16:39:33.706117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15458","last_updated":"2024-10-20T17:51:35Z","snapshot_observed_at":"2026-08-09T19:18:25.696349Z","submitted_at":"2024-10-20T17:51:35Z","title":"Allegro: Open the Black Box of Commercial-Level Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15458","snapshot_observed_at":"2026-08-06T16:39:33.844639Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:33.844639Z"},"links":{"cited_paper":"/paper/2410.15458","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:87e8ce2f0aac46b53a232ba6ec7ea1091f7e79732d30251bee2664d10d013466","observation_id":"7ac1f8d8-de29-43b0-bfbf-1d16fead640c","resolution":{"observed_at":"2026-08-06T16:39:33.844639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:37.047081Z","title":null,"venue":null,"work_id":"df408aa1-3157-49e6-8837-be1cbbef26bb","year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:33.996120Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:5814a99839972c5695352f6f78ec4ff1912b3390fc31744b0af311feb1bbb766","observation_id":"d202ef82-52f4-4dd9-a752-65fdaaf1ad93","resolution":{"observed_at":"2026-08-06T16:39:37.161186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:36.734831Z","title":null,"venue":null,"work_id":"3c0ddc3b-8d37-46d1-b69e-8c282b9cb17c","year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:34.150969Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:195019c1ab260a54d12b13ea9446dc952b9437aa3a13135d977c439a572a6e00","observation_id":"537acc34-ac8a-44db-a599-b4db7e84fa95","resolution":{"observed_at":"2026-08-06T16:39:36.859328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12489","last_updated":"2025-05-21T04:44:19Z","snapshot_observed_at":"2026-08-07T15:43:38.172964Z","submitted_at":"2025-05-18T16:22:58Z","title":"Video-GPT via Next Clip Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12489","snapshot_observed_at":"2026-08-06T16:39:34.284396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:34.284396Z"},"links":{"cited_paper":"/paper/2505.12489","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:de9ae90728087fbc0b0e4d19b9ec6e03836b9d982a1f9598cc987e8c094d5046","observation_id":"8ff811dc-e3d0-45e2-81b4-679f280ad10e","resolution":{"observed_at":"2026-08-06T16:39:34.284396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:36.512397Z","title":null,"venue":null,"work_id":"b0f856d9-b97b-4164-a0db-9701f9ddd5c4","year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:34.477198Z"},"links":{"citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:e1976b60a63f1ea07e8661b1f04cd3b363c9725ac998c4ba89e3853184d4dd95","observation_id":"4a0ce6d7-c176-46bb-8c25-77653bb1ef79","resolution":{"observed_at":"2026-08-06T16:39:36.594840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":94,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 6 inbound Pith citation observations for arXiv:2507.12952."}