{"as_of":"2026-08-06T19:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5aa666185b9487c9a27d7418167678b01b0490030af6d4974d7c5c8975a5a62f","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:37:19.677839Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T19:41:59.059940Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T14:59:55.942413Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-08-03T19:41:59.059940Z","title":"Captain cinema: Towards short movie generation.arXiv preprint arXiv:2507.18634, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.22973","last_updated":"2026-06-22T15:51:03Z","snapshot_observed_at":"2026-08-03T19:41:54.757475Z","submitted_at":"2025-11-28T08:25:59Z","title":"BIFE: Better Interaction, Fewer Errors for Minute-Long Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T19:41:59.059940Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2511.22973"},"observation_digest":"sha256:5e4a0bbd3c39b961707b6a640e5058d1d19dffea071c32f391f7c912fc43b563","observation_id":"63537b16-9827-43e2-b758-187cbdf2d7be","resolution":{"observed_at":"2026-08-03T19:41:59.059940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2512.01843","last_updated":"2026-05-18T11:10:13Z","snapshot_observed_at":"2026-07-06T22:37:26.652349Z","submitted_at":"2025-12-01T16:28:13Z","title":"PhyDetEx: Detecting and Explaining the Physical Plausibility of T2V Models","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-21T17:57:57.263574Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2512.01843"},"observation_digest":"sha256:d91fb91fc94be68c1011ce71dabeb1e8320daa25ec5b78b97f8b2974e8c351a5","observation_id":"abfb6319-8505-46f5-8ff8-a01f3fd50871","resolution":{"observed_at":"2026-05-21T18:00:27.248908Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2604.09195","last_updated":"2026-04-10T10:27:52Z","snapshot_observed_at":"2026-07-06T22:58:08.579543Z","submitted_at":"2026-04-10T10:27:52Z","title":"Camera Artist: A Multi-Agent Framework for Cinematic Language Storytelling Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:05.066473Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2604.09195"},"observation_digest":"sha256:5ffaf78b17e9216e718f7717ac731b6a0d9e4a35800ccdb0638981d7add9d4f2","observation_id":"afadce48-32b7-4e84-8369-99ec3ae92481","resolution":{"observed_at":"2026-05-11T08:01:01.570248Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2604.17195","last_updated":"2026-07-06T16:02:36Z","snapshot_observed_at":"2026-07-12T19:05:14.645592Z","submitted_at":"2026-04-19T01:51:41Z","title":"DreamShot: Personalized Storyboard Synthesis with Video Diffusion Prior","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T07:21:45.633310Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2604.17195"},"observation_digest":"sha256:54e70d92e733c9ca1e47e0bb1fcd78b9671d4fe3a70a246bca4745b3693c4798","observation_id":"e7a2cc86-4464-453d-827e-cb22e91e798b","resolution":{"observed_at":"2026-05-10T07:21:55.043841Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2605.18233","last_updated":"2026-05-18T11:28:45Z","snapshot_observed_at":"2026-08-01T23:39:03.834779Z","submitted_at":"2026-05-18T11:28:45Z","title":"Enhancing Train-Free Infinite-Frame Generation for Consistent Long Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T10:56:16.054496Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2605.18233"},"observation_digest":"sha256:1e178b082a78d7adeed56b2c0fd08dabd6ea8e3d2b702ae58f669cc02cec04d2","observation_id":"ef195e7e-f74a-4fbc-a190-e241234cd53f","resolution":{"observed_at":"2026-05-20T10:58:13.834486Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2605.23610","last_updated":"2026-05-22T13:20:29Z","snapshot_observed_at":"2026-07-31T18:23:31.169556Z","submitted_at":"2026-05-22T13:20:29Z","title":"EM-Vid: Training-Free Entity-Centric Memory for Efficient and Consistent Multi-Shot Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-25T04:57:13.479165Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2605.23610"},"observation_digest":"sha256:7de40c36cb77b1b09ad3008f4df29607b677d77ba0d001f5176b9021fd7f8b3a","observation_id":"cef2477f-1136-4ecc-9c98-119b7c78b6fd","resolution":{"observed_at":"2026-05-25T05:00:22.443351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2605.25266","last_updated":"2026-05-24T21:39:54Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-24T21:39:54Z","title":"DeltaCam: Differential Intrinsic Camera Modeling for Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T11:44:08.734390Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2605.25266"},"observation_digest":"sha256:204d242ffa93050b62b851801d08b5b63f81b6782f8401c8c9951395712db64a","observation_id":"6b660e25-bebb-40b1-811d-aa009acc8675","resolution":{"observed_at":"2026-06-30T11:44:37.854342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2606.20799","last_updated":"2026-07-15T15:45:17Z","snapshot_observed_at":"2026-08-02T10:48:03.144592Z","submitted_at":"2026-06-18T18:00:03Z","title":"GroundShot: Visually Consistent Multi-Shot Long Video Generation via Entity-Grounded Shot Scheduling","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-26T18:15:51.862192Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2606.20799"},"observation_digest":"sha256:01e3ecc3983741ba6c9f7774904602ba51078a76fd048f0acf1b44cd4a9499a6","observation_id":"607f397c-641a-4ef2-99a3-5d141abab559","resolution":{"observed_at":"2026-07-04T03:19:30.257281Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-08-02T10:48:07.353522Z","title":"Captain cinema: Towards short movie generation.arXiv preprint arXiv:2507.18634, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20799","last_updated":"2026-07-15T15:45:17Z","snapshot_observed_at":"2026-08-02T10:48:03.144592Z","submitted_at":"2026-06-18T18:00:03Z","title":"GroundShot: Visually Consistent Multi-Shot Long Video Generation via Entity-Grounded Shot Scheduling","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T10:48:07.353522Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2606.20799"},"observation_digest":"sha256:e73b21e4f349b9dcbf299eff0d6928e515aa11db298e1fd0f9b01da3000f02dc","observation_id":"f36c35e0-2b7f-42c3-96f8-bd1df5bedaf7","resolution":{"observed_at":"2026-08-02T10:48:07.353522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2606.21661","last_updated":"2026-06-19T18:06:15Z","snapshot_observed_at":"2026-08-02T10:44:02.035539Z","submitted_at":"2026-06-19T18:06:15Z","title":"UnityShots: Memory-Driven Multi-Shot Audio-Video Generation with Boundary-Aware Gating","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-26T14:30:48.687642Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2606.21661"},"observation_digest":"sha256:91f09b15d05ea74317260a54afe16e41dbe91f146f2006be0527d48426b2ec7c","observation_id":"4d3da473-bdd5-40e8-b45a-188af54f1830","resolution":{"observed_at":"2026-07-04T06:29:36.876998Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2606.22370","last_updated":"2026-06-21T07:39:37Z","snapshot_observed_at":"2026-07-06T23:57:14.069903Z","submitted_at":"2026-06-21T07:39:37Z","title":"Towards Error-Free Long Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T10:49:36.838492Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2606.22370"},"observation_digest":"sha256:df86922806b6f307ea4035d62574c2b9c92778701d04462e23d331af46a8d7ae","observation_id":"5faf2770-0320-49d5-9e85-0c4a91f0fcb9","resolution":{"observed_at":"2026-07-04T08:59:42.105231Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"cited_work":{"arxiv_id":"2507.18634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18634","snapshot_observed_at":"2026-07-04T14:59:55.942413Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":"f9a119c5-1df4-4a57-a6a5-0d1ac0d94b19","year":2025},"citing_paper":{"arxiv_id":"2606.24107","last_updated":"2026-07-03T09:17:12Z","snapshot_observed_at":"2026-08-01T13:42:02.404759Z","submitted_at":"2026-06-23T03:50:28Z","title":"DramaDirector: Geometry-Guided Short Drama Generation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-26T01:57:15.550335Z"},"links":{"cited_paper":"/paper/2507.18634","citing_paper":"/paper/2606.24107"},"observation_digest":"sha256:22ce9101e4c77b63d9d2040f181bc7d4d0bb10a55741d8fbe1a88388f26946c2","observation_id":"3a8b4695-7398-40c7-8820-896963fb6e29","resolution":{"observed_at":"2026-07-04T14:59:55.943778Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.18634/citation-record","integrity":"/paper/2507.18634/integrity","json":"/paper/2507.18634/citation-record.json","paper":"/paper/2507.18634"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.755789Z","title":"The narrative construction of reality.Critical inquiry, 18(1):1–21, 1991","venue":null,"work_id":"8d7bf3fa-f2f5-4dbf-81a5-f8d98d1bc79d","year":1991},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.349234Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:cd9ce0883fb8b8bacaa31f98cdc418c6da3b29d9751a9c3886864c027a5f577d","observation_id":"2a7157df-14ba-4670-871b-7f363e77fe94","resolution":{"observed_at":"2026-08-06T14:37:23.773455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.714746Z","title":"Random House, 2014","venue":null,"work_id":"b68e0b45-9ffd-490a-8fa8-d01cbe9b40f4","year":2014},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.356637Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:3430d97c31929d3d7a2ce0fb533af1395c9d724f81901f8a9ea004b20f12b1f9","observation_id":"969fc287-9399-4d72-9bd4-7481ff453806","resolution":{"observed_at":"2026-08-06T14:37:23.743016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.695954Z","title":"Video diffusion models","venue":null,"work_id":"1a286e81-c3e0-4892-920a-0658b6117267","year":2022},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.359285Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:d59a1da8be2cbad44799ee39fc0777d01265be54d953b58cd382cd7df2a39256","observation_id":"daee2889-1425-4f10-8baf-c8b5c3c58e8b","resolution":{"observed_at":"2026-08-06T14:37:23.699528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.656098Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":"4cf2c3bc-06be-4fce-8877-dfaafb8c9743","year":2022},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.362014Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:e27944d7359e0ce40d22ef342c2944dbbc3dff1fdab128aa1bc789442aeb7f95","observation_id":"69bde413-65a1-42d7-ae2b-64f57e6539da","resolution":{"observed_at":"2026-08-06T14:37:23.660737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.607308Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":"4d5d21dc-fb7c-492e-80b5-0b18d3044d4e","year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.364840Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:632570e24b46c0c86a82cf21a162864328a09ff784b5aec047f3bd221f2dbdbe","observation_id":"880211b3-6e56-402f-af6d-058a47bf5117","resolution":{"observed_at":"2026-08-06T14:37:23.615086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.591368Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":"618ab4da-657b-421b-9937-a0ed8b524685","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.367471Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:dd4ff4cbd1bb885d5db5958219969caac2daf496291097ff1fcf3ee6ee7f2326","observation_id":"7b6887b2-d4c5-4b64-b2b3-f4c2825c293a","resolution":{"observed_at":"2026-08-06T14:37:23.596770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.572399Z","title":"Imagen video: High definition video generation with diffusion models","venue":null,"work_id":"d821f204-aa95-491b-b19d-ed8edbf429fd","year":2022},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.370351Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:b497a6f2edc24c5369030edfaa77b1a0aeb96e62dabb5852ddcfe5a4a658a0b6","observation_id":"acf3cd06-6e4c-494c-a402-3b8fbf98cd7a","resolution":{"observed_at":"2026-08-06T14:37:23.579126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.484927Z","title":"Modelscope text-to-video technical report","venue":null,"work_id":"3091d462-3c74-47d9-a1ae-c4f9c4c37801","year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.372946Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:65bef72f97aa4bbbfe6f61ad9272e35811ac207f8ac0e682942f83666d124dbd","observation_id":"bcbe7ba7-9d27-4e74-943d-47f98b1dd594","resolution":{"observed_at":"2026-08-06T14:37:23.524744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.435157Z","title":"Magicvideo: Efficient video generation with latent diffusion models","venue":null,"work_id":"e98dc47c-5052-4004-b534-f79d5b26b57e","year":2022},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.394741Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:b3a0e1146e1692a4073d0a38febb8d8eb25553e41544d0335bd5325d60c634c0","observation_id":"b3f1057e-cd85-4505-8ab9-3b9d7accf21d","resolution":{"observed_at":"2026-08-06T14:37:23.455242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.415802Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.415802Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:65e0960d3b71b4830dd28ce86fb36664a240bb4402ae114943c9e2a7b67c962b","observation_id":"a5869d76-66c0-4300-99cf-8b7ffeaf83bb","resolution":{"observed_at":"2026-08-06T14:37:19.415802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:23.217480Z","title":"Video generation models as world simulators, 2024","venue":null,"work_id":"dab52ae6-189c-4e6b-93ff-a298cc44b604","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.423480Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:c820ddde60b33a84ff07ee427e50e9f0c138a62c92fe1c164f3fea26fe76845a","observation_id":"954f5c2a-3d28-4d33-9ad4-c956aebbf592","resolution":{"observed_at":"2026-08-06T14:37:23.304911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:22.937714Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":"709390fb-8ef3-4932-adae-e00a6ed74c0e","year":2022},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.426471Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:8427344216929e1d1dbe6efc30af88bf75cd69d144a680af9c0eafa28102d164","observation_id":"f47a9657-8bae-4e9d-9886-4541611ce708","resolution":{"observed_at":"2026-08-06T14:37:23.054744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:22.607632Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":"e15c8879-74e1-4ff0-b2d1-b6545dccb4a6","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.429558Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:bb24b6ed84cbdefae40b668633f18ea3402bc41430c79f3101aa672fb4ed7b06","observation_id":"38adc90d-f0c5-47af-a455-37f79ea02f57","resolution":{"observed_at":"2026-08-06T14:37:22.794150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:22.382963Z","title":"Videopoet: A large language model for zero-shot video generation","venue":null,"work_id":"77e74e15-7d70-43a5-8902-04e8a5241aaf","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.434105Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:1db5274f516c982e2fc8eba434dc1fad23b0d521d3c9747c7f9b07942f9b9d7f","observation_id":"b9af96de-29a9-4331-8f42-45650efe91de","resolution":{"observed_at":"2026-08-06T14:37:22.481718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.436651Z","title":"Emu: Generative pretraining in multimodality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.436651Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:e1e73b2a03932251ec9223a198d0ca8582ba5598196a303f48636b623428adde","observation_id":"56930e11-dacb-4eef-a4aa-e9d6cedce457","resolution":{"observed_at":"2026-08-06T14:37:19.436651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.439709Z","title":"Generative multimodal models are in-context learners","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.439709Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:0e85d8e58cab4eca473593c68376da7c561f545cb587c3ca49ab31882f1f733f","observation_id":"c1f751ec-5668-4fde-814c-3222954701c4","resolution":{"observed_at":"2026-08-06T14:37:19.439709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.442245Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.442245Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:1d0ece2da8f5a0797ccdc9f6456e53c77b8df8452c48621f4301bf778bcc3580","observation_id":"f4cf5d03-76bb-49f2-aea9-439d1ccc5490","resolution":{"observed_at":"2026-08-06T14:37:19.442245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:21.984741Z","title":"Livephoto: Real image animation with text-guided motion control","venue":null,"work_id":"cabf76dc-322e-46a4-b687-fa84790e460d","year":2025},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.444873Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:1a01e4de9496bdb15db436446449ec422172983284e061394dc94d25ec390e6b","observation_id":"d5038a57-0933-4be6-94e4-7826225ac369","resolution":{"observed_at":"2026-08-06T14:37:22.080728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:21.754745Z","title":"Magicanimate: Temporally consistent human image animation using diffusion model","venue":null,"work_id":"cbc7ce04-72ee-4bc0-ad2a-bfe4aad3a468","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.447302Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:25fefd0e33ec1b1ca7ab8e76d76497a93d2cabf21d4dfea7aa96d0ee5de7c280","observation_id":"f5608adc-8ae0-48c1-a6c7-521a416810ac","resolution":{"observed_at":"2026-08-06T14:37:21.834835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:21.465701Z","title":"Ccedit: Creative and controllable video editing via diffusion models","venue":null,"work_id":"25184a57-66ad-4f6a-9c52-b27bf94cbcdc","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.449798Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:3f94da06c41c36f2437e93dc91db3f41e188a884993cd3cfa12660c262522bb0","observation_id":"ba288f50-2b62-4ff3-b3d2-8bf8fcdd4dd3","resolution":{"observed_at":"2026-08-06T14:37:21.566646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:21.145756Z","title":"Pix2video: Video editing using image diffusion","venue":null,"work_id":"4d4a1ebc-12aa-42cf-a998-3ca9739f920c","year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.453414Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:f76eb4d33c1c0196bd406f196bd3f18607bd6f3cb65379ad61c4ba7fadaef1c9","observation_id":"12853725-e245-4d27-be15-40e080c9a3e2","resolution":{"observed_at":"2026-08-06T14:37:21.202198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:21.105788Z","title":"Style-a-video: Agile diffusion for arbitrary text-based video style transfer","venue":null,"work_id":"058e03d2-b310-4d10-905c-302cde52b27f","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.457178Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:94d22100eaeda8405ed6facf2280ea94da1c24544423c79ee71e7d6f2810d47d","observation_id":"e7446a3b-e101-4f0b-9589-3e90b9c18ba3","resolution":{"observed_at":"2026-08-06T14:37:21.127559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.464217Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.464217Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:9b6e1161f91483dd465fdfb693a4bba06ea1d108b0a20b8e72ffb8d70c333b3f","observation_id":"1173cc40-8ebe-4cde-a8f4-09f7b9014ce2","resolution":{"observed_at":"2026-08-06T14:37:19.464217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:21.021737Z","title":"Dreamllm: Synergistic multimodal comprehension and creation","venue":null,"work_id":"12188771-da87-4cc8-bf80-1c3b67d7d69d","year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.466854Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:4838e1799663b64a09bb424e33585dc5dfe4adf996c91400913793ae94a4655b","observation_id":"c6ce38d5-746a-4551-8cda-e12b182d8de4","resolution":{"observed_at":"2026-08-06T14:37:21.055115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.945717Z","title":"Mm-interleaved: Interleaved image-text generative modeling via multi-modal feature synchronizer","venue":null,"work_id":"a24b32aa-b7fe-483b-a930-bf632c82f2a6","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.473640Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:d42e19ac0a09461f7548f221af7c0f40a4ef5fbad73dd24acabe3295008d7fd4","observation_id":"8a51a960-bdc5-4c32-b52f-8878cb5de642","resolution":{"observed_at":"2026-08-06T14:37:20.964802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.918777Z","title":"Seed-x: Multimodal models with unified multi-granularity comprehension and generation","venue":null,"work_id":"2c983d28-8034-423d-add3-3d5079aeb187","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.478138Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:2e9cc16602ec58e1293d7b4c5f46893e27ca7e31fb569c1fd5a0d3cf8f6cb40a","observation_id":"6ed82a71-7d55-4444-aef2-8e1e680de5f9","resolution":{"observed_at":"2026-08-06T14:37:20.938433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.888704Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":"8d9815ad-1614-48d7-b7f0-0e907c284a45","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.481030Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:f6cab996d2bbfe438cc435770738848cdfc12f08c57b0e6e014bf81d4af1d521","observation_id":"7297e818-619b-4149-9107-f50f00178d55","resolution":{"observed_at":"2026-08-06T14:37:20.895479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.868359Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":"9ee47978-2607-450a-b4e3-145a48ca5a6d","year":2022},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.484359Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:8c2710b7ffdeaa628bb4cf5f3c7e5fb3c3a96e02fd1742585a898689d23c8b40","observation_id":"1c9a0900-d182-4159-8c21-aaa62bd94497","resolution":{"observed_at":"2026-08-06T14:37:20.873474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.487501Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.487501Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:532e1368bea03f33e73b4eba34097c3a57b92e3b9bf7fa93a30a6b619ae7e3df","observation_id":"49b44bb3-ebb7-43af-a3ef-c0ab1087cbe6","resolution":{"observed_at":"2026-08-06T14:37:19.487501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.846089Z","title":"Scaling language-image pre-training via masking","venue":null,"work_id":"edb5b5a9-07ad-4b93-8f8e-473925dde065","year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.493385Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:78186b1c3d5cdc1aea7d378d043f1a1b3b765c8589b0c824cb066f2cc7565cbf","observation_id":"8e73bf43-54f0-479c-ae6d-c1042d44a4f7","resolution":{"observed_at":"2026-08-06T14:37:20.849732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.822415Z","title":"Eva-clip: Improved training techniques for clip at scale","venue":null,"work_id":"94988aa9-9144-4fb4-8e08-f920c109af90","year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.496877Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:6e9473546604bea4d1374f0f6fc4e470f06f06940a5e231554c0245aa78a5a05","observation_id":"ab8eb41b-f422-4aca-be10-63005ac2d6ed","resolution":{"observed_at":"2026-08-06T14:37:20.836918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.803589Z","title":"Datacomp: In search of the next generation of multimodal datasets","venue":null,"work_id":"6d4bedd5-78f4-467a-ab13-08f525e068af","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.500977Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:165324c78f3a47d717e76ea1770e1685e0c8f4954f16fd5f61f0d58323ed14c3","observation_id":"b386bcab-06ee-4d1b-bba7-9352222ebf47","resolution":{"observed_at":"2026-08-06T14:37:20.812254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.786444Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"6b5e31d7-5811-4f8f-8a4a-01fb8b5823fd","year":2022},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.503677Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:584bc0d74b04922095df57e6b1f9cf0fee5adec58dcb843f86c7d34837030355","observation_id":"baaced9d-5b78-4a5f-918c-66c666c7824c","resolution":{"observed_at":"2026-08-06T14:37:20.790310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T14:37:19.506567Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.506567Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:ac91b833151d87f2f1d23e5aedb1af02a88a064fb2723cdf1b75655ce5ce3b03","observation_id":"c0728e28-159b-47c6-bb12-19d4f22bf1e6","resolution":{"observed_at":"2026-08-06T14:37:19.506567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.511805Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.511805Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:066c7c8546e0d3223cb20985c3a2d7e3f326b5fc18029278efe32863770857bc","observation_id":"69ebcd9a-c3a8-47e5-b5dd-edecf021e2e2","resolution":{"observed_at":"2026-08-06T14:37:19.511805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.714862Z","title":"Visual instruction tuning","venue":null,"work_id":"24aef018-9fc5-408b-9e96-2d1ccfd798d3","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.514642Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:a60b8cff03e5a4e2d105196f2ee4fb43fbf9b4be70ffaca7641fbdcbd57a52fa","observation_id":"79c30a78-2e57-46d9-b524-fd210d230ae0","resolution":{"observed_at":"2026-08-06T14:37:20.733419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.622120Z","title":"Visionllm: Large language model is also an open-ended decoder for vision-centric tasks","venue":null,"work_id":"9d6ff559-50bb-43dd-80f8-33fa6838940d","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.517281Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:c4355108570f1d096d034c2f798ccd224ec058c428893e79a1829ebcd305dd7f","observation_id":"ff7bacf1-cba2-4959-8af9-a8a0d950153b","resolution":{"observed_at":"2026-08-06T14:37:20.633850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06173","last_updated":"2025-06-07T09:44:59Z","snapshot_observed_at":"2026-07-06T20:19:26.003822Z","submitted_at":"2025-01-10T18:52:11Z","title":"VideoAuteur: Towards Long Narrative Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06173","snapshot_observed_at":"2026-08-06T14:37:19.519784Z","title":"Videoauteur: Towards long narrative video generation.arXiv preprint arXiv:2501.06173, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.519784Z"},"links":{"cited_paper":"/paper/2501.06173","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:c26fd92e9402f872554b0c9dc00699fdfa3f5b350469e7714c2f11168aeab4e8","observation_id":"701e833e-6830-458f-a1bb-9a7901ee4c7d","resolution":{"observed_at":"2026-08-06T14:37:19.519784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10589","last_updated":"2025-03-13T17:40:07Z","snapshot_observed_at":"2026-08-03T15:12:54.197163Z","submitted_at":"2025-03-13T17:40:07Z","title":"Long Context Tuning for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10589","snapshot_observed_at":"2026-08-06T14:37:19.522905Z","title":"Long context tuning for video generation.arXiv preprint arXiv:2503.10589, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.522905Z"},"links":{"cited_paper":"/paper/2503.10589","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:21d0f2a06325a20f6f13ff07ed276bd4f5dcfca28eb8c9fa27ec426f1d5c98aa","observation_id":"42fb464e-0f95-46f8-bc8d-19593f606416","resolution":{"observed_at":"2026-08-06T14:37:19.522905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.567085Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffusion.Advancesin Neural Information Processing Systems, 37:24081–24125, 2024","venue":null,"work_id":"12159334-e5f1-496b-90c4-6fcbf5402592","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.526187Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:2bb0743dc954879fbcc63a404e691fe6f229ac1e8043fae7da69a70ca9f8f1ea","observation_id":"2e4fcdcf-a885-4b2a-b861-0c826fc7b443","resolution":{"observed_at":"2026-08-06T14:37:20.586528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.547789Z","title":"Pusa: Thousands timesteps video diffusion model, 2025","venue":null,"work_id":"3589ce6a-55ce-4cdf-bd25-4b0c342a897f","year":2025},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.531861Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:6e071a171696062e164cc699b6ed845c75b3710ff44e0d80cd29bd087e586d8a","observation_id":"7f40b3b3-1776-4294-b628-2c9f556cea26","resolution":{"observed_at":"2026-08-06T14:37:20.553906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.526483Z","title":"Videodirectorgpt: Consistent multi-scene video generation via llm-guided planning","venue":null,"work_id":"a730743c-622a-426f-b459-403ca777a067","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.534438Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:24c1e7c1a232aa6798dfb294a9a7869679277a9737dc8a258eafafa9954927f6","observation_id":"f6c0a756-887c-454d-a60b-dff215717955","resolution":{"observed_at":"2026-08-06T14:37:20.529642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.513981Z","title":"Vlogger: Make your dream a vlog","venue":null,"work_id":"3cda096e-6f94-4d1e-8ff4-bb0bcd0c0d46","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.537774Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:c9dde69194025fd79630e9429959bc6e079760114cb8c7303bbefdc856ed6416","observation_id":"7ce68caa-eaf0-4c22-b83a-6019a2c236f8","resolution":{"observed_at":"2026-08-06T14:37:20.517371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06940","last_updated":"2023-07-13T17:57:13Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:57:13Z","title":"Animate-A-Story: Storytelling with Retrieval-Augmented Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06940","snapshot_observed_at":"2026-08-06T14:37:19.540244Z","title":"Animate-a-story: Storytelling with retrieval-augmented video generation.arXiv preprint arXiv:2307.06940, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.540244Z"},"links":{"cited_paper":"/paper/2307.06940","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:77386199fb0e46e6d175fa01f8dba783d22f5833846f7eec78c30b88c8762c4c","observation_id":"8a291c57-cc2f-4f82-899f-1b67b193c78f","resolution":{"observed_at":"2026-08-06T14:37:19.540244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04277","last_updated":"2024-10-14T07:20:01Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-06-06T17:25:33Z","title":"VideoTetris: Towards Compositional Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2406.04277","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04277","snapshot_observed_at":"2026-08-06T14:37:20.227358Z","title":"VideoTetris: Towards Compositional Text-to-Video Generation","venue":"cs.CV","work_id":"c87180ae-68de-40ad-9f1e-ba53951ce55b","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.543006Z"},"links":{"cited_paper":"/paper/2406.04277","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:c3afd4e7eebe278153145edae7e655122dcd6948fd0149b0860a820c83bb4038","observation_id":"1077ed0b-a8be-4314-b30e-be646de116ec","resolution":{"observed_at":"2026-08-06T14:37:20.241925Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23775","last_updated":"2024-11-05T06:41:27Z","snapshot_observed_at":"2026-07-06T19:42:47.238254Z","submitted_at":"2024-10-31T09:45:00Z","title":"In-Context LoRA for Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23775","snapshot_observed_at":"2026-08-06T14:37:19.547161Z","title":"In-context lora for diffusion transformers.arXiv preprint arXiv:2410.23775, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.547161Z"},"links":{"cited_paper":"/paper/2410.23775","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:0fc3ad3f56fcccc1c2e6d1de57e54d1df9532767b45c0defa51eb539eebdfa66","observation_id":"afade176-d3d2-45b0-ba24-5be73adedac5","resolution":{"observed_at":"2026-08-06T14:37:19.547161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01434","last_updated":"2024-05-02T16:25:16Z","snapshot_observed_at":"2026-07-06T18:08:52.053005Z","submitted_at":"2024-05-02T16:25:16Z","title":"StoryDiffusion: Consistent Self-Attention for Long-Range Image and Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01434","snapshot_observed_at":"2026-08-06T14:37:19.550434Z","title":"Storydiffusion: Consistent self-attention for long-range image and video generation.arXiv preprint arXiv:2405.01434, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.550434Z"},"links":{"cited_paper":"/paper/2405.01434","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:ad6baeae1fb111b7002aedccdc027e00bcde09df5066c2724c27c0e803846d1a","observation_id":"1f260030-9288-462a-b515-645c586c44a2","resolution":{"observed_at":"2026-08-06T14:37:19.550434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-07-06T18:44:57.578408Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-06T14:37:19.553823Z","title":"Seed-story: Multimodal long story generation with large language model.arXiv preprint arXiv:2407.08683, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.553823Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:3093b8f85bd135f8283c7eedb4c75f10e59cc1a06f18712bcb2df954af4b375e","observation_id":"e0ff973f-9df2-4bfb-b8b7-588ae49f19f2","resolution":{"observed_at":"2026-08-06T14:37:19.553823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.557561Z","title":"Moviedreamer: Hierarchical generation for coherent long visual sequence.arXiv preprint arXiv:2407.16655, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.557561Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:6184947140a06ae0c47746ce5e67ff6241bf1952bbcdcdc22d31b807e1bfbd06","observation_id":"f3f5d199-db12-4424-ab37-fcb88c0ba6fa","resolution":{"observed_at":"2026-08-06T14:37:19.557561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.563223Z","title":"Packing input frame context in next-frame prediction models for video generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.563223Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:e7388b749f4134681ba562fe1735539a9e56e5734aa8eb8fb7d2c1f89a8742d7","observation_id":"c4d1c8ba-d2f0-4c9a-80cf-7cba940cc933","resolution":{"observed_at":"2026-08-06T14:37:19.563223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.491748Z","title":"FlexTok: Resampling images into 1d token sequences of flexible length, 2025","venue":null,"work_id":"4592d4f7-4d80-4dee-ac84-eacf2bdc9b12","year":2025},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.566119Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:dd5dabada8aee98f6627b1ca02c695931913349e67cccb5f54610e355f61f907","observation_id":"12cf2b92-5221-4716-ad1c-0d5a04b13a23","resolution":{"observed_at":"2026-08-06T14:37:20.497973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-06T14:37:19.568681Z","title":"Ltx-video: Realtime video latent diffusion.arXiv preprint arXiv:2501.00103, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.568681Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:db8298a065afb47322147062ad6fd3808f6e9c7ab85488f0699f371751d1b2bc","observation_id":"4c1d0ea8-c65b-45f4-b9c7-44b2afaffed0","resolution":{"observed_at":"2026-08-06T14:37:19.568681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.464147Z","title":"Pyramidal flow matching for efficient video generative modeling, 2024","venue":null,"work_id":"1ee20be0-0ea7-4554-b61c-763835cdb9bc","year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.571128Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:52cdff1aaeb0f1f82b378442dc3d6b68e0b979a72b9da45d71a7fdb66460fd8e","observation_id":"92cd9b78-2571-472e-afae-fcaaa8bf304f","resolution":{"observed_at":"2026-08-06T14:37:20.476069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.454744Z","title":"Long-context autoregressive video modeling with next-frame prediction, 2025","venue":null,"work_id":"8558f5ee-7e84-4fb2-bc83-268315376084","year":2025},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.573548Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:d32644bf0d403f7f4c15bf17c06c5a5d81da7ced92e8f8f1c02ebb22027656b2","observation_id":"42f4ed45-fcfb-404d-b8e3-3d956c4e5b8c","resolution":{"observed_at":"2026-08-06T14:37:20.458029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11513","last_updated":"2025-03-14T15:36:39Z","snapshot_observed_at":"2026-07-06T20:52:45.934843Z","submitted_at":"2025-03-14T15:36:39Z","title":"HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models","version":1},"cited_work":{"arxiv_id":"2503.11513","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.11513","snapshot_observed_at":"2026-08-06T14:37:19.832727Z","title":"HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models","venue":"cs.CV","work_id":"4ac024c4-e7a5-4e7c-984d-1f5bb89c5c5a","year":2025},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.577468Z"},"links":{"cited_paper":"/paper/2503.11513","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:ae3ebeb6319033f134891d02a111a4b1461f57fe6105e5934bc65d4f3c1023a3","observation_id":"a52f5ce6-6f7c-4238-961f-780b3eeacda7","resolution":{"observed_at":"2026-08-06T14:37:19.837982Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.411669Z","title":"Pyscenedetect v0.6","venue":null,"work_id":"52c843fd-d52f-42f9-8507-e17de45ccf07","year":2021},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.582113Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:b4d12a77c79f293f2717d7e0f1c5ec29da1f1b42d03d67e22ea3501a343581b1","observation_id":"4e522c7d-294e-4615-94dd-15e49a7e4cc4","resolution":{"observed_at":"2026-08-06T14:37:20.416815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T14:37:19.586328Z","title":"Gemini: A family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.586328Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:77385229986f705475908dfce8352aa909a6f652fafa4366a51ca30683970a52","observation_id":"0b76cad6-231b-41dc-b01d-bd7a2ba79244","resolution":{"observed_at":"2026-08-06T14:37:19.586328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.591079Z","title":"Flux.https://github.com/black-forest-labs/flux, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.591079Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:759bb2f7c7b5b2d7e96ac3af652b63451d82515c0a4e4270558c65e636c837c9","observation_id":"d388bce2-e6fa-4c3d-898c-2c4d593e3552","resolution":{"observed_at":"2026-08-06T14:37:19.591079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08685","last_updated":"2025-05-05T03:31:30Z","snapshot_observed_at":"2026-07-06T21:08:01.403325Z","submitted_at":"2025-04-11T16:46:20Z","title":"Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08685","snapshot_observed_at":"2026-08-06T14:37:19.596333Z","title":"Seaweed-7b: Cost-effective training of video generation foundation model.arXiv preprint arXiv:2504.08685, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.596333Z"},"links":{"cited_paper":"/paper/2504.08685","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:411a6a03d01bb4ee8a90cae15c7a8f5c28371dbe27e5bb8e71cfd40fd6d30085","observation_id":"28f4dee5-1382-4b9f-a426-c16db3a73d7f","resolution":{"observed_at":"2026-08-06T14:37:19.596333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-08-06T14:37:19.606223Z","title":"Vbench-2.0: Advancing video generation benchmark suite for intrinsic faithfulness.arXiv preprint arXiv:2503.21755, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.606223Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:b7e3827a11718786fef1e21b63b52b50ca492186cfa78a316694eb68cec6c05c","observation_id":"23d6fb22-4488-48a7-8a50-d147162e58e6","resolution":{"observed_at":"2026-08-06T14:37:19.606223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:19.624751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.624751Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:0a742ed7fa5a0af936e945994462d04dce314c49c7ad714e9c0f71467da8be6b","observation_id":"3a8c98d3-b8fe-47dd-86c9-892a214633ec","resolution":{"observed_at":"2026-08-06T14:37:19.624751Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.334140Z","title":null,"venue":null,"work_id":"739ba2e9-22b9-4817-bd89-a10db5cdbb07","year":null},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.646302Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:d49119c11ddede355fd7e9e911fe8e67b8e815a1b2d221f9dad4bdbd5d2c2e94","observation_id":"2fa57d58-999c-403c-9911-7fa0d448a885","resolution":{"observed_at":"2026-08-06T14:37:20.337782Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:37:20.301264Z","title":"character_consistency","venue":null,"work_id":"1af5baaa-110a-457a-a2a7-be69dfd38994","year":null},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.677839Z"},"links":{"citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:e79ca53685ab931a0716bf2d09f3cd622e70090fe8c32b144ce53e145bbe899f","observation_id":"0bf674d6-14b2-4099-a32b-ac715b410fbf","resolution":{"observed_at":"2026-08-06T14:37:20.308866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T14:37:18.436315Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":22,"verified_exact":2,"verified_fuzzy":38},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 12 inbound Pith citation observations for arXiv:2507.18634."}