{"as_of":"2026-08-08T16:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0224b0bda4513b2e5770f6f410b35b9652d531fe9180c1c3b10fa06d79607f72","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:50:50.165451Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.04228/citation-record","integrity":"/paper/2506.04228/integrity","json":"/paper/2506.04228/citation-record.json","paper":"/paper/2506.04228"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:50.950847Z","title":"2024.URL https://openai","venue":null,"work_id":"9c394a6c-61f0-47a3-a599-acfd37310d6a","year":2024},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.035547Z"},"links":{"citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:c6d5ba5b593f5b1aada08b7b41c58f47b06d9705126b94ee9e91b8893d60020b","observation_id":"50809537-1686-4dd2-8e75-940ce38b23ff","resolution":{"observed_at":"2026-08-07T10:50:50.957454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:50.937266Z","title":"Haoxin Chen, Yong Zhang, Xiaodong Cun, Menghan Xia, Xintao Wang, Chao Weng, and Ying Shan","venue":null,"work_id":"1ecc12ef-b3b7-4374-9fa1-57f10616fe77","year":2024},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.049020Z"},"links":{"citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:6abc24ffe52ad1a950f545d30f57437a074b9ee9d0dbbd51a58af050f8e6d70f","observation_id":"9a682572-e2d8-407d-b9e5-cba08077bf2c","resolution":{"observed_at":"2026-08-07T10:50:50.941705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09047","last_updated":"2024-01-17T08:30:32Z","snapshot_observed_at":"2026-08-04T07:40:19.403363Z","submitted_at":"2024-01-17T08:30:32Z","title":"VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09047","snapshot_observed_at":"2026-08-07T10:50:50.064772Z","title":"arXiv:2401.09047 [cs.CV] Xuewei Chen, Zhimin Chen, and Yiren Song","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.064772Z"},"links":{"cited_paper":"/paper/2401.09047","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:9ba561cecb37651353b604e655be5be08f7295bd69bee5bd9e0abce64efaae55","observation_id":"8705ad1b-fe0f-4a58-b78f-2c4d74e7b2da","resolution":{"observed_at":"2026-08-07T10:50:50.064772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06558","last_updated":"2023-05-11T04:33:08Z","snapshot_observed_at":"2026-08-03T19:49:16.800693Z","submitted_at":"2023-05-11T04:33:08Z","title":"Segment and Track Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06558","snapshot_observed_at":"2026-08-07T10:50:50.093556Z","title":"Zeqi Gu, Wenqi Xian, Noah Snavely, and Abe Davis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.093556Z"},"links":{"cited_paper":"/paper/2305.06558","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:707df3e67a3ce96b06b6bf456039d5ea8a7b5e60476444bb31bc1a5a4b7692af","observation_id":"29f7552e-8ec6-4694-ac33-60863cf5c5c7","resolution":{"observed_at":"2026-08-07T10:50:50.093556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:50.923154Z","title":"Yuwei Guo, Ceyuan Yang, Anyi Rao, Zhengyang Liang, Yaohui Wang, Yu Qiao, Maneesh Agrawala, Dahua Lin, and Bo Dai","venue":null,"work_id":"141846a9-7e4a-4fd7-985b-be25a71e1579","year":2023},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.099298Z"},"links":{"citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:8f941e5a29135f51b13cd4c33d08c3d859306df0a4bb3c2ee6dace614d4e82cc","observation_id":"ddd15a67-603a-403b-982f-a2e54a07acb4","resolution":{"observed_at":"2026-08-07T10:50:50.928116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-07T10:50:50.104928Z","title":"Jonathan Ho, Ajay Jain, and Pieter Abbeel","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.104928Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:f560f271bde8050c2a7e4bd737e731e27ad97f415b6fadfbebe326b2e9633772","observation_id":"7f1f448b-8410-443f-9c68-272f0df99def","resolution":{"observed_at":"2026-08-07T10:50:50.104928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16500","last_updated":"2024-08-29T12:59:12Z","snapshot_observed_at":"2026-08-05T11:54:14.447608Z","submitted_at":"2024-08-29T12:59:12Z","title":"CogVLM2: Visual Language Models for Image and Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16500","snapshot_observed_at":"2026-08-07T10:50:50.116063Z","title":"Edward J Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.116063Z"},"links":{"cited_paper":"/paper/2408.16500","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:9c4621dfb4babfb320ca75160d6866721c2fec25bea07b3870039c170a15cff0","observation_id":"4fbc802f-525f-457b-a1cc-6b238be05542","resolution":{"observed_at":"2026-08-07T10:50:50.116063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16683","last_updated":"2025-03-24T16:08:09Z","snapshot_observed_at":"2026-07-06T19:56:43.637339Z","submitted_at":"2024-11-25T18:59:57Z","title":"Generative Omnimatte: Learning to Decompose Video into Layers","version":2},"cited_work":{"arxiv_id":"2411.16683","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16683","snapshot_observed_at":"2026-08-07T10:50:50.493574Z","title":"Generative Omnimatte: Learning to Decompose Video into Layers","venue":"cs.CV","work_id":"fd9a56ff-fb3b-43c6-bdb9-475c6bb51229","year":2024},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.127276Z"},"links":{"cited_paper":"/paper/2411.16683","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:f0517f119b85efc9ea687de2589356d519361b0deaa832ad07a4ad2f8fd20ec2","observation_id":"4d0c3cd3-4140-440e-a405-696ba22cac3c","resolution":{"observed_at":"2026-08-07T10:50:50.544136Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00896","last_updated":"2024-04-08T18:40:31Z","snapshot_observed_at":"2026-08-06T12:11:11.088129Z","submitted_at":"2023-12-31T10:51:52Z","title":"TrailBlazer: Trajectory Control for Diffusion-Based Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00896","snapshot_observed_at":"2026-08-07T10:50:50.133238Z","title":"William Peebles and Saining Xie","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.133238Z"},"links":{"cited_paper":"/paper/2401.00896","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:d2e4622afd7bec7f379fad1775fd0b6924ac6967f8690c2022011335a3cb39aa","observation_id":"a0781798-fcd4-4357-bbfd-555f7b035ffa","resolution":{"observed_at":"2026-08-07T10:50:50.133238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14826","last_updated":"2024-08-27T07:13:44Z","snapshot_observed_at":"2026-08-08T02:15:12.007829Z","submitted_at":"2024-08-27T07:13:44Z","title":"Alfie: Democratising RGBA Image Generation With No $$$","version":1},"cited_work":{"arxiv_id":"2408.14826","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.14826","snapshot_observed_at":"2026-08-07T10:50:50.227302Z","title":"Alfie: Democratising RGBA Image Generation With No $$$","venue":"cs.CV","work_id":"79892434-8797-4200-a89e-8343b49eb94f","year":2024},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.138129Z"},"links":{"cited_paper":"/paper/2408.14826","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:4871875e8ffbe6188d28f24dbba8fa35491cd2e679d905dec757bdadf8401302","observation_id":"bb7af53b-c1b4-4956-a755-35ebba059f0f","resolution":{"observed_at":"2026-08-07T10:50:50.345938Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:50.893063Z","title":"Zhouxia Wang, Ziyang Yuan, Xintao Wang, Yaowei Li, Tianshui Chen, Menghan Xia, Ping Luo, and Ying Shan","venue":null,"work_id":"76c5e6c1-1dbd-4c25-bed9-84057fc4a71b","year":2025},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.148829Z"},"links":{"citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:0a478fcc582e6023858bf0697ae1d6ea569650004624b170557dce89b718dbb3","observation_id":"eba059de-a530-4a7b-a71f-9c1bdc8ff392","resolution":{"observed_at":"2026-08-07T10:50:50.901297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T10:50:50.153933Z","title":"InSIGGRAPH","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.153933Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:ee993cdf798b16fab153e301e30fd0cf8e8dbab7f067f31c15c8943ec0dbbfec","observation_id":"d2a27329-2d6f-4acc-a5d1-057d87a2caa6","resolution":{"observed_at":"2026-08-07T10:50:50.153933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17113","last_updated":"2024-06-23T03:47:27Z","snapshot_observed_at":"2026-08-07T05:26:05.587260Z","submitted_at":"2024-02-27T01:19:53Z","title":"Transparent Image Layer Diffusion using Latent Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17113","snapshot_observed_at":"2026-08-07T10:50:50.159541Z","title":"Youcai Zhang, Xinyu Huang, Jinyu Ma, Zhaoyang Li, Zhaochuan Luo, Yanchun Xie, Yuzhuo Qin, Tong Luo, Yaqian Li, Shilong Liu, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.159541Z"},"links":{"cited_paper":"/paper/2402.17113","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:c5d16ffd94e9f7119a3943893fadb90ee6d7eb938dce261abda801b7b9ee3337","observation_id":"368f3e43-daaa-46db-aab6-dc831f1697da","resolution":{"observed_at":"2026-08-07T10:50:50.159541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:50.743722Z","title":"InProceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"411a6080-05a6-4cac-a87f-6faa5dd16974","year":2025},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.165451Z"},"links":{"citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:5b1ad8c3e733cd4fe010c7ea40158f5de3b7e1ac580eabc0bd7b591d4a5a71c7","observation_id":"57dd2b00-44e5-4c0b-b493-3b2f1f9a4a58","resolution":{"observed_at":"2026-08-07T10:50:50.819864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:50.909665Z","title":"Petru-Daniel Tudosiu, Yongxin Yang, Shifeng Zhang, Fei Chen, Steven McDonagh, Gerasimos Lampouras, Ignacio Iacobacci, and Sarah Parisot","venue":null,"work_id":"ad7d3ae1-5c76-41e3-b541-1b14631ca500","year":2020},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.143059Z"},"links":{"citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:5efbaaf0fc3574538b3a395235432dbc1e79011e0c7cb74920cd1afedf3c5578","observation_id":"c97a3a1b-13b1-43d7-9f78-cc271bf018ba","resolution":{"observed_at":"2026-08-07T10:50:50.913911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T10:50:50.121723Z","title":"Ziqi Huang, Yinan He, Jiashuo Yu, Fan Zhang, Chenyang Si, Yuming Jiang, Yuanhan Zhang, Tianxing Wu, Qingyang Jin, Nattapol Chanpaisit, et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.121723Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:f48d0d24fe890dbf590b7f54483408a0f30728d14b7ce8cb10504ec04f8fce10","observation_id":"b736bf6e-0097-475f-a138-9864e7080793","resolution":{"observed_at":"2026-08-07T10:50:50.121723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-07T10:50:50.110465Z","title":"arXiv:2205.15868(2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.110465Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:a07978feaa2d672fc5860a76b23f18927e2bb936a3b8aa0aec95831d8b565dec","observation_id":"d59743b2-2731-4524-9647-7a43ced24ce4","resolution":{"observed_at":"2026-08-07T10:50:50.110465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T10:50:50.011460Z","title":"Jianhong Bai, Tianyu He, Yuchi Wang, Junliang Guo, Haoji Hu, Zuozhu Liu, and Jiang Bian","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.011460Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:78d4571fc45a1ead9647ca9b0c18ebc308c04c3c6493df5bdebe5c7952a64996","observation_id":"8ce5774b-e753-4248-a126-2b14f5fbf1b5","resolution":{"observed_at":"2026-08-07T10:50:50.011460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13185","last_updated":"2024-04-07T12:11:28Z","snapshot_observed_at":"2026-08-04T22:46:26.821486Z","submitted_at":"2024-02-20T17:52:12Z","title":"UniEdit: A Unified Tuning-Free Framework for Video Motion and Appearance Editing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13185","snapshot_observed_at":"2026-08-07T10:50:50.023344Z","title":"Tim Brooks, Bill Peebles, Connor Holmes, Will DePue, Yufei Guo, Li Jing, David Schnurr, Joe Taylor, Troy Luhman, Eric Luhman, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.023344Z"},"links":{"cited_paper":"/paper/2402.13185","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:645d50c662db926a160cb480f9201324793ac203a0f5057675a545357fb5f3b5","observation_id":"4360ffb0-b213-4187-8302-41751344b343","resolution":{"observed_at":"2026-08-07T10:50:50.023344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17934","last_updated":"2025-03-23T04:27:46Z","snapshot_observed_at":"2026-08-07T16:43:41.324698Z","submitted_at":"2025-03-23T04:27:46Z","title":"TransAnimate: Taming Layer Diffusion to Generate RGBA Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17934","snapshot_observed_at":"2026-08-07T10:50:50.077864Z","title":"Yangming Cheng, Liulei Li, Yuanyou Xu, Xiaodi Li, Zongxin Yang, Wenguan Wang, and Yi Yang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.077864Z"},"links":{"cited_paper":"/paper/2503.17934","citing_paper":"/paper/2506.04228"},"observation_digest":"sha256:a616319686f6d91e162979be5b3cc2825d26a5a53cb977341a2dfd1579d7d763","observation_id":"3de337be-0dc6-4e9a-bf43-20b4bebe5a56","resolution":{"observed_at":"2026-08-07T10:50:50.077864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04228","last_updated":"2025-06-04T17:59:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:42:55.229411Z","submitted_at":"2025-06-04T17:59:58Z","title":"LayerFlow: A Unified Model for Layer-aware Video Generation"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2506.04228."}