{"as_of":"2026-08-21T22:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ee6b14581efa75ccba71e39ce218ce861a6d591370e5bb39da594601c22f3f0","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:52:04.456970Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:31:56.426125Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T14:06:17.109079Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12223","snapshot_observed_at":"2026-08-16T11:31:56.426125Z","title":"Can video generation replace cinematographers? research on the cinematic language of generated video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15376","last_updated":"2025-08-29T09:26:15Z","snapshot_observed_at":"2026-08-17T19:28:53.623882Z","submitted_at":"2025-04-21T18:34:57Z","title":"Towards Understanding Camera Motions in Any Video","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:56.426125Z"},"links":{"cited_paper":"/paper/2412.12223","citing_paper":"/paper/2504.15376"},"observation_digest":"sha256:b05373afc4d7bec46444e0dafe1d956ae6a796ee8200176d1ec2f19069464afa","observation_id":"da734167-211c-4d1c-a33b-8ed90ab449ab","resolution":{"observed_at":"2026-08-16T11:31:56.426125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12223","snapshot_observed_at":"2026-07-12T05:16:19.750976Z","title":"arXiv preprint arXiv:2412.12223 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03043","last_updated":"2026-07-03T07:33:28Z","snapshot_observed_at":"2026-08-15T00:54:13.958555Z","submitted_at":"2026-07-03T07:33:28Z","title":"Natural Language Camera Movement Understanding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T05:16:19.750976Z"},"links":{"cited_paper":"/paper/2412.12223","citing_paper":"/paper/2607.03043"},"observation_digest":"sha256:4ffcaf04cc0808ce32cb9c7faf11a22f0b9a5d637871a14e6099144edae9eb9b","observation_id":"57df0b89-4c9c-4c6a-8a6a-1aac18ca925e","resolution":{"observed_at":"2026-07-12T05:16:19.750976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"cited_work":{"arxiv_id":"2412.12223","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.12223","snapshot_observed_at":"2026-08-12T14:06:17.109079Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","venue":"cs.CV","work_id":"7454419c-d738-4101-810e-24a4519ea383","year":2024},"citing_paper":{"arxiv_id":"2608.10932","last_updated":"2026-08-11T14:00:02Z","snapshot_observed_at":"2026-08-14T23:12:19.619353Z","submitted_at":"2026-08-11T14:00:02Z","title":"Temporally Grounded Compositional Camera Motion Understanding via Geometric Knowledge Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T14:06:16.740457Z"},"links":{"cited_paper":"/paper/2412.12223","citing_paper":"/paper/2608.10932"},"observation_digest":"sha256:70fe6c216ba876f9ce255c983900ad99b65456873e3a027d8a06257854ddf946","observation_id":"ef6adfc5-8d40-421e-8d1c-141d5467603e","resolution":{"observed_at":"2026-08-12T14:06:17.112505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.12223/citation-record","integrity":"/paper/2412.12223/integrity","json":"/paper/2412.12223/citation-record.json","paper":"/paper/2412.12223"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2007.12673","last_updated":"2020-06-05T14:34:33Z","snapshot_observed_at":"2026-08-15T18:18:56.849354Z","submitted_at":"2020-06-05T14:34:33Z","title":"Genetic Algorithm: Reviews, Implementations, and Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.12673","snapshot_observed_at":"2026-08-11T14:52:04.268282Z","title":"Genetic algorithm: Reviews, implemen- tations, and applications","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.268282Z"},"links":{"cited_paper":"/paper/2007.12673","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:63a28c8a7509c93d605618a6ff27ba48c504f9e7bf12307178e200c1607612ce","observation_id":"375f553b-a259-44bb-9d47-037546a7f72b","resolution":{"observed_at":"2026-08-11T14:52:04.268282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.272775Z","title":"Frozen in time: A joint video and image encoder for end-to-end retrieval","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.272775Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:99f90e6ce6c656d0219bd85ef54c35ab7c836288aab34fba00e0cbba10515ea4","observation_id":"959e2757-a431-47c2-9afb-7fc8a9a34b6b","resolution":{"observed_at":"2026-08-11T14:52:04.272775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-20T09:39:07.545813Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-11T14:52:04.276344Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.276344Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:594eaee5ceefec495904f26f3aff91a1ecac4db7b65ece894d68f28ddebb49d4","observation_id":"14bbcf77-fa86-45ce-a1b5-f9f38415fdbc","resolution":{"observed_at":"2026-08-11T14:52:04.276344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.280401Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.280401Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:5206ef6b6aca31d9888727936f692656294614d5d0baec657ca6ebe92c860cdc","observation_id":"31b30414-febf-45de-9ade-323fb3e8f4e4","resolution":{"observed_at":"2026-08-11T14:52:04.280401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.284320Z","title":"Collecting highly paral- lel data for paraphrase evaluation","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.284320Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:11708e3909abdfdb05d8e79c86d72bed458868351bd3e48cd032d57ecd5cbe2a","observation_id":"d2e5ba77-fe6e-4cb0-90ad-49704a170433","resolution":{"observed_at":"2026-08-11T14:52:04.284320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-19T21:14:32.076838Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-11T14:52:04.288493Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.288493Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:8c5f459270f727d3a7d543079f1a5e02adf43e77502f87e0ef1ed0dcf725e92c","observation_id":"0ee5c73a-211b-4372-8d96-788bca3dddde","resolution":{"observed_at":"2026-08-11T14:52:04.288493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04325","last_updated":"2024-06-06T17:58:54Z","snapshot_observed_at":"2026-08-16T13:45:24.844176Z","submitted_at":"2024-06-06T17:58:54Z","title":"ShareGPT4Video: Improving Video Understanding and Generation with Better Captions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04325","snapshot_observed_at":"2026-08-11T14:52:04.292949Z","title":"Sharegpt4video: Improving video understand- ing and generation with better captions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.292949Z"},"links":{"cited_paper":"/paper/2406.04325","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:5fb60ad5bd67eac28cb986147a84b0baa5b02f8106aa52410f5322c17c7f1341","observation_id":"17a07dd3-0067-4586-a54f-f922941b0114","resolution":{"observed_at":"2026-08-11T14:52:04.292949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.981650Z","title":"Vqgan-clip: Open domain image generation and editing with natural language guidance","venue":null,"work_id":"c4d674cf-a5df-48f6-9912-7f6113721e65","year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.297145Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:e7f139bcbf3f1163eed71aed271cd82a45c951fc5dbaee3b745e41965a01914c","observation_id":"ef0ff874-56c8-4b24-afb8-8a6bb97b263f","resolution":{"observed_at":"2026-08-11T14:52:04.984997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.971026Z","title":"Clipdraw: Exploring text-to-drawing synthesis through language-image encoders","venue":null,"work_id":"0c48a14e-b645-4836-acd6-54a341fbe70f","year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.301240Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:e45c4b2b3f2f32b5fd4878672162ae89efb52de20028005a4fec0988c5a5a335","observation_id":"63aa037b-4a69-4310-b07b-29a87e1f2656","resolution":{"observed_at":"2026-08-11T14:52:04.974673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.960649Z","title":"Genetic algorithms in search, optimiza- tion, and machine learning","venue":null,"work_id":"b3fca3eb-e0a7-4257-b3b0-a6c46fe5c441","year":1989},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.304835Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:aeb3cd5ede38a65d049f6455f415df2b5b3307b56aa4edad7ae5c62d0e3222c9","observation_id":"aaeb91af-d23c-4643-8bfe-7252def77f5d","resolution":{"observed_at":"2026-08-11T14:52:04.964337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.948111Z","title":"Open-vocabulary object detection via vision and language knowledge distillation","venue":null,"work_id":"4e2ef1a1-61ec-4366-8dcd-d9a2148d6b12","year":2021},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.308891Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:d29ae0b2dbe4f98c37bf9bb2f48f6cfa4a2fde935b0748eccc64af3e8cbd9ea8","observation_id":"8941ef0b-cdae-4c48-abe0-e0e0fa26874b","resolution":{"observed_at":"2026-08-11T14:52:04.952005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.312360Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.312360Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:bac6397acccf9117aeda3fec58fd9c811e134d92f47499567c63425fa8d1a4b2","observation_id":"75bfbd1d-0555-409e-8621-1a54827bcb45","resolution":{"observed_at":"2026-08-11T14:52:04.312360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-16T17:39:09.604516Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-11T14:52:04.315759Z","title":"Cameractrl: Enabling camera control for text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.315759Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:779c41eb881d7441937512d98a8dadc175e7b1a67ed5a4b775a77b0225800107","observation_id":"aae3ae33-3bff-4ec0-b6d5-c3563893a060","resolution":{"observed_at":"2026-08-11T14:52:04.315759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.319886Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.319886Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:05229e3949a34b4210305f700b0e498e986bd238ac43955f117b409e3704c652","observation_id":"129abff1-a78b-4dae-82b8-d3dc4df0ee76","resolution":{"observed_at":"2026-08-11T14:52:04.319886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-08-21T17:27:27.238302Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-11T14:52:04.323354Z","title":"Imagen video: High definition video generation with diffusion mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.323354Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:826c904d8b698f569f9a09e7e9a44be73381828915819a29bb011887d570685c","observation_id":"8e3aa7a1-95e4-4cc7-9e79-3f6b98bb1e5e","resolution":{"observed_at":"2026-08-11T14:52:04.323354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.327298Z","title":"Lora: Low- rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.327298Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:34a730419d06b8a8ecc8e228da54bfd6e23eb718cb79601401dc876c88fc75df","observation_id":"f9d1b718-66db-4cd5-89e9-023d8afd0947","resolution":{"observed_at":"2026-08-11T14:52:04.327298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.330518Z","title":"Language-driven semantic seg- mentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.330518Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:b49cf178df283a1e2cfdd86852ae7d6e01ba6ba8957dfc4abb43cb5b1ca66fdc","observation_id":"3aee8cf5-323d-4cc5-9052-8489189d668b","resolution":{"observed_at":"2026-08-11T14:52:04.330518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-08-18T11:56:50.710310Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-11T14:52:04.333805Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.333805Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:4e9340007d43bf5a05c3389208063429adb759198ec2ee802ead1752917f0f18","observation_id":"87c2dbb2-1dd9-42d1-8725-6819dd82e18a","resolution":{"observed_at":"2026-08-11T14:52:04.333805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.337506Z","title":"Grounded language-image pre-training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.337506Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:c641133a02a031e21deb8c3185585d8fcd5658f9150b4cf1205795e0184885c5","observation_id":"8d1806eb-b47b-4d55-a369-008f5faa7af8","resolution":{"observed_at":"2026-08-11T14:52:04.337506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.900960Z","title":"Clip4clip: An empirical study of clip for end to end video clip retrieval and captioning","venue":null,"work_id":"631d5a6c-bc3a-4b55-970d-f11307093a6d","year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.340939Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:ada4f7536f8f145fdd61b2ffe2176ff8fa77d6605e66a609aa64ce1cdb88374d","observation_id":"7a93eeef-ab2e-478f-8457-7d093b3a809e","resolution":{"observed_at":"2026-08-11T14:52:04.904761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02371","last_updated":"2025-02-13T10:13:24Z","snapshot_observed_at":"2026-08-07T10:03:56.902190Z","submitted_at":"2024-07-02T15:40:29Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02371","snapshot_observed_at":"2026-08-11T14:52:04.344269Z","title":"Openvid-1m: A large-scale high-quality dataset for text-to- video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.344269Z"},"links":{"cited_paper":"/paper/2407.02371","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:82f5f7c8d09d89f3d013ed1ca3d3156ca37eb6bfba986d72bae568ddb4609019","observation_id":"527fd4cb-1cc0-44a2-977f-e261c85129d4","resolution":{"observed_at":"2026-08-11T14:52:04.344269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.889710Z","title":"Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, Gretchen Krueger, and Ilya Sutskever","venue":null,"work_id":"b2413bdf-5453-4c61-9137-95505cdf873e","year":2021},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.348319Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:01fe13e0674e9bd413f13500d9909f0184311388c0b518da795363b43f3fd0f6","observation_id":"9a9d807c-3634-4dc7-9029-fafc9cc4cea8","resolution":{"observed_at":"2026-08-11T14:52:04.893730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-11T14:52:04.351789Z","title":"Hierarchical text-conditional image gen- eration with clip latents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.351789Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:dd167e96febf3be7f76e8d4e41c839a6ab8fb792585f9bf3739a31174dc7b74a","observation_id":"f9bc02aa-9d28-466d-8401-f29774ebfc17","resolution":{"observed_at":"2026-08-11T14:52:04.351789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.356725Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.356725Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:719c524b22a52747e2e25a6c319ad1f47dc694f8f9b3e40cb4b09cc65abbc9b7","observation_id":"105c4f95-1fa1-4882-8c20-078cf3e041df","resolution":{"observed_at":"2026-08-11T14:52:04.356725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.872631Z","title":null,"venue":null,"work_id":"bce7d2e1-f19e-4c14-9bba-840a28f68d97","year":2023},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.360114Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:5d05b7e3ed81c6a84d68041085588f7a95392e65010c727dffef0cafc0e2ceda","observation_id":"85e6d462-c248-4215-be66-d2d105201021","resolution":{"observed_at":"2026-08-11T14:52:04.876175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.861670Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":"600582ff-b5f0-421b-a889-0c05ab8b3bd7","year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.363428Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:4c485b097a4d08a57cfb7e45cdc9d8403a432d614d85a8e1a90abd580cbe2edb","observation_id":"0b3caa55-963c-4c50-9421-8a316f6a87d9","resolution":{"observed_at":"2026-08-11T14:52:04.865528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.367087Z","title":"Tempo- ral generative adversarial nets with singular value clipping","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.367087Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:951d3a53ca9f02872ec11a0beaa3097ea11cf73627d8b5f0eff4bb78fb44f753","observation_id":"827a4352-3bb0-4b90-a251-fcb1bc7381bb","resolution":{"observed_at":"2026-08-11T14:52:04.367087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.841155Z","title":"Cinescale: A dataset of cinematic shot scale in movies","venue":null,"work_id":"45eef98e-49a9-452b-88a6-b672df4ba031","year":2021},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.371117Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:e738e7f68b3196d98c05cedba74474856049b5e2583d65843365a64a7ba0742b","observation_id":"28e1a3b2-0c8f-4f15-a32c-277ba58c38b6","resolution":{"observed_at":"2026-08-11T14:52:04.845584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.829433Z","title":"Cinescale2: a dataset of cinematic camera features in movies","venue":null,"work_id":"72614449-e41b-468c-806b-8048982e5975","year":2023},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.375215Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:89dc5bd9e098c6fc4a09b0a8f0ea904ffda439ad83273040d7664e181ec1ab0c","observation_id":"3720e106-351c-43bd-ac50-d979466ff682","resolution":{"observed_at":"2026-08-11T14:52:04.833584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.379548Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.379548Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:64a1e2beb47e119f56ae3e8f40428d80001553c3224169fcf47fcad8014565e2","observation_id":"a544eaf5-1c54-4c3c-bee1-4a301d0081d7","resolution":{"observed_at":"2026-08-11T14:52:04.379548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.809950Z","title":"Stylegan-v: A continuous video generator with the price, image quality and perks of stylegan2","venue":null,"work_id":"7a15f8c8-fab5-4f0b-8ea3-7db2c897e53d","year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.384245Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:60d5255261d78d57f24e97ca4e4d585b4f463852b4a619e11a6ca1d7caef3657","observation_id":"bf293bf8-f741-4037-a771-6b0713b2c3f3","resolution":{"observed_at":"2026-08-11T14:52:04.814403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.388280Z","title":"Mocogan: Decomposing motion and content for video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.388280Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:02a403fd2c88336bed7ecd2c158e28e85f26c82be5411c843e813283bab217b0","observation_id":"8edb603d-e2b5-49cf-91c7-a9c25da554f5","resolution":{"observed_at":"2026-08-11T14:52:04.388280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-18T04:00:09.136122Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-11T14:52:04.392788Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.392788Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:3be1d50a137e28acdb9c39110880f887115bd0946a13e696dc7215ee7a28fd39","observation_id":"d4614245-0881-4484-a1f4-50a4edcc97e0","resolution":{"observed_at":"2026-08-11T14:52:04.392788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.399561Z","title":"Clipasso: Semantically-aware object sketching","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.399561Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:e270078d3738e3cf21b9b235e3f16b2ce33a13bbc284c897ea13491daebe702c","observation_id":"221e54e0-23b1-4f57-ace5-bdb43787a163","resolution":{"observed_at":"2026-08-11T14:52:04.399561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.782754Z","title":"Generating videos with scene dynamics","venue":null,"work_id":"daa8368e-4ec0-41e1-bacf-ae7c0512ce10","year":2016},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.403491Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:7c18b7de1979fa216f2b849f3ddf1bf5d3678de9850159e5d9f4abb4efcb2525","observation_id":"f9673331-481e-4a84-93d7-c12370abcc61","resolution":{"observed_at":"2026-08-11T14:52:04.786848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.770202Z","title":"Cocaclip: Exploring distillation of fully- connected knowledge interaction graph for lightweight text- image retrieval","venue":null,"work_id":"20093231-f748-40b9-a04a-539e0f72e2f1","year":2023},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.410138Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:1f8249dc4a0e67aea453d7c467d3fdc30ab148768c078fbe8b2abbf83104d196","observation_id":"01eae950-b823-4b0a-8309-939db9388289","resolution":{"observed_at":"2026-08-11T14:52:04.774618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.756932Z","title":"Videoclip-xl: Advancing long descrip- tion understanding for video clip models","venue":null,"work_id":"d9db71e9-2a49-4555-a80b-b3b7cff652f1","year":2024},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.414924Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:3b39decd7f42926688850be3ba93a5d3c07034530d83c75839536f47c7e05671","observation_id":"f1e1a69a-c6a8-406d-a4a1-9b528f994fa6","resolution":{"observed_at":"2026-08-11T14:52:04.761169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.746079Z","title":"Videocomposer: Compositional video synthesis with motion controllability","venue":null,"work_id":"543a2f4a-ea61-473a-bf78-d2e2da372dab","year":2024},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.420380Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:034b9f8613beb1d074f5ec12a8e44efac3f3a919d7e660e92f4c9769648547b0","observation_id":"3b7a3a6c-6e3d-4998-90ea-e40b57284cc0","resolution":{"observed_at":"2026-08-11T14:52:04.749565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.735599Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation","venue":null,"work_id":"d5b844b8-5a75-4f31-aef8-92ffab86563b","year":2023},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.424691Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:f5ef9a20b8fd2b7af1286eff9c8c3762986ff5d7c054d1550fcdb0f7e1576328","observation_id":"4d7eafa1-72e3-448a-9e89-79500ab9becc","resolution":{"observed_at":"2026-08-11T14:52:04.739134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.723532Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"7577a605-e974-4b69-b140-ce37ab97ba43","year":2024},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.429014Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:6305a0dc647d0a6a3fbaf2bdea9654f98087ae323e7d2c3abf256ab6bb3640d3","observation_id":"349c49d7-2360-4e99-91d4-3954c72df6a0","resolution":{"observed_at":"2026-08-11T14:52:04.727900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.711467Z","title":"Videoclip: Contrastive pre-training for zero-shot video-text understanding","venue":null,"work_id":"a51f5ce0-03e7-4a22-90be-36bf80786f44","year":2021},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.433727Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:37be52c840a2aaab01c52d82b14bba0e7c949891031886c23cb42f21964cf5ab","observation_id":"34559d55-451e-4522-b182-e07537dd5f04","resolution":{"observed_at":"2026-08-11T14:52:04.715605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.438399Z","title":"Groupvit: Semantic segmentation emerges from text supervision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.438399Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:2f91da141bf8fffabe82afe92ddbb23edaecc9ec5dafb31388b5ff9028c1308f","observation_id":"040774fe-f20e-4acd-a470-052d8ef5a949","resolution":{"observed_at":"2026-08-11T14:52:04.438399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.691376Z","title":"Direct-a-video: Customized video generation with user- directed camera movement and object motion","venue":null,"work_id":"14091072-ce90-4687-99da-d360dbca5f8f","year":null},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.443170Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:8146043bc51f4bce8d4f32dd87c60c20da5776d43d805e59aeaa43ed1bf3c32f","observation_id":"0ff325ef-4319-4dd7-87a8-83048304ceef","resolution":{"observed_at":"2026-08-11T14:52:04.695723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.678880Z","title":"Long-clip: Unlocking the long-text capability of clip","venue":null,"work_id":"7b4b3e65-cff0-4230-8880-26fb93510f40","year":2025},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.448122Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:8621cde949a94001dcca18ed9a7a5e0fa80199d204ef120de19f9ef7db802e8c","observation_id":"30bfe89b-fcac-463a-a20e-59773296072e","resolution":{"observed_at":"2026-08-11T14:52:04.682926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16843","last_updated":"2024-11-19T02:52:45Z","snapshot_observed_at":"2026-08-16T14:15:11.306545Z","submitted_at":"2024-02-26T18:59:18Z","title":"Multi-LoRA Composition for Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16843","snapshot_observed_at":"2026-08-11T14:52:04.452484Z","title":"Multi-lora composition for image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.452484Z"},"links":{"cited_paper":"/paper/2402.16843","citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:c49945a200dc6d8174088410a0b5fbc6a87fd52187b5391179328e639d5c9175","observation_id":"38b99fee-15b0-499a-99bc-18db78878446","resolution":{"observed_at":"2026-08-11T14:52:04.452484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:52:04.663990Z","title":"Stereo magnification: learning view synthesis using multiplane images","venue":null,"work_id":"fea4153c-92a9-45a4-aa97-7d2d2f210ae2","year":2018},"citing_paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T14:52:04.456970Z"},"links":{"citing_paper":"/paper/2412.12223"},"observation_digest":"sha256:1abb574092522da00aa2564f90e91bb12864f667981e4e5b068987940a2523a1","observation_id":"4546e254-d153-4496-8f75-4e064a1458de","resolution":{"observed_at":"2026-08-11T14:52:04.670235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.12223","last_updated":"2025-03-28T03:50:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T03:18:45.580820Z","submitted_at":"2024-12-16T09:02:24Z","title":"Can video generation replace cinematographers? Research on the cinematic language of generated video"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 3 inbound Pith citation observations for arXiv:2412.12223."}