{"as_of":"2026-08-20T10:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3263c6d3c7cc45160c8ae12d74616eff2a3042ddb700a203c8d3855477d208a9","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:40:30.402063Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.12048/citation-record","integrity":"/paper/2504.12048/integrity","json":"/paper/2504.12048/citation-record.json","paper":"/paper/2504.12048"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-16T12:40:30.348607Z","title":"CoRR, abs/2106.09685","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.348607Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:19b2d10b50095f2f130add18ec1cf5784436d1dbe0b4464f6491f0effd531248","observation_id":"a31ef44f-82f0-483a-b13d-993cf912ba2d","resolution":{"observed_at":"2026-08-16T12:40:30.348607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17444","last_updated":"2024-05-04T19:28:10Z","snapshot_observed_at":"2026-08-19T08:52:20.968876Z","submitted_at":"2023-09-29T17:54:46Z","title":"LLM-grounded Video Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17444","snapshot_observed_at":"2026-08-16T12:40:30.359580Z","title":"arXiv preprint arXiv:2309.17444","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.359580Z"},"links":{"cited_paper":"/paper/2309.17444","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:9bf7648c568e757c5f144bc35991cec14365e1b01a81380320aab45c2b2f1407","observation_id":"27ce3552-4bcb-4387-aade-d3c3e7c168cb","resolution":{"observed_at":"2026-08-16T12:40:30.359580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15091","last_updated":"2024-07-12T18:03:29Z","snapshot_observed_at":"2026-08-16T14:57:26.944781Z","submitted_at":"2023-09-26T17:36:26Z","title":"VideoDirectorGPT: Consistent Multi-scene Video Generation via LLM-Guided Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15091","snapshot_observed_at":"2026-08-16T12:40:30.364741Z","title":"arXiv preprint arXiv:2309.15091","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.364741Z"},"links":{"cited_paper":"/paper/2309.15091","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:ee477922cdcad3aa92054c99a37f855889aafc00623b3cbea1095e8d398548de","observation_id":"da526b20-e2af-4894-9bad-7f2e8aa2df57","resolution":{"observed_at":"2026-08-16T12:40:30.364741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01256","last_updated":"2024-09-16T16:05:18Z","snapshot_observed_at":"2026-08-18T16:04:40.085710Z","submitted_at":"2024-01-02T15:56:48Z","title":"VideoStudio: Generating Consistent-Content and Multi-Scene Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01256","snapshot_observed_at":"2026-08-16T12:40:30.368998Z","title":"arXiv preprint arXiv:2401.01256","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.368998Z"},"links":{"cited_paper":"/paper/2401.01256","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:77ecaacdac1cff2b5caa40befe43d577125627027c0ef11238f01e38876b5f5d","observation_id":"ff54fb46-5f72-42b3-839d-9545869c7874","resolution":{"observed_at":"2026-08-16T12:40:30.368998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15813","last_updated":"2023-11-27T13:39:44Z","snapshot_observed_at":"2026-08-19T14:56:20.623284Z","submitted_at":"2023-11-27T13:39:44Z","title":"FlowZero: Zero-Shot Text-to-Video Synthesis with LLM-Driven Dynamic Scene Syntax","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15813","snapshot_observed_at":"2026-08-16T12:40:30.373854Z","title":"arXiv preprint arXiv:2311.15813","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.373854Z"},"links":{"cited_paper":"/paper/2311.15813","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:0f72a1f32d9513fd9371bda6a84dcdefcc63acc0734a4a4ff8538a7ee01d9b1c","observation_id":"dd7a0f79-4d2d-474d-8480-b9688d2f0d77","resolution":{"observed_at":"2026-08-16T12:40:30.373854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15169","last_updated":"2024-01-30T16:44:20Z","snapshot_observed_at":"2026-08-20T10:30:10.430914Z","submitted_at":"2023-10-23T17:59:58Z","title":"FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15169","snapshot_observed_at":"2026-08-16T12:40:30.377899Z","title":"arXiv preprint arXiv:2310.15169","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.377899Z"},"links":{"cited_paper":"/paper/2310.15169","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:5c363ac8621ddf53947c270d541ed6aae12f5c7e5982246e5d4de11ea78fae45","observation_id":"b5fb3320-2e0d-4221-a85a-972eb8a8e50c","resolution":{"observed_at":"2026-08-16T12:40:30.377899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-16T12:40:30.392437Z","title":"arXiv preprint arXiv:2209.14792","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.392437Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:cef0071112552be4f2e5177a55fb2ae4e8aa7e15553ae5b5868840274917f989","observation_id":"ddf8c19b-3445-4aeb-944a-638b30d5a532","resolution":{"observed_at":"2026-08-16T12:40:30.392437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:30.589515Z","title":null,"venue":null,"work_id":"902b9e24-66bc-4575-b834-bce8abb3b805","year":2021},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.402063Z"},"links":{"citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:02a8bee38ddc7bc7cded61513400644f0317ab0df1dc65001d6458eb856f066d","observation_id":"6bfc736a-5d05-4d71-97e2-eb53f2f5a157","resolution":{"observed_at":"2026-08-16T12:40:30.595418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18264","last_updated":"2023-05-29T17:38:18Z","snapshot_observed_at":"2026-08-18T16:07:07.101501Z","submitted_at":"2023-05-29T17:38:18Z","title":"Gen-L-Video: Multi-Text to Long Video Generation via Temporal Co-Denoising","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18264","snapshot_observed_at":"2026-08-16T12:40:30.397158Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.397158Z"},"links":{"cited_paper":"/paper/2305.18264","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:8d54dc0848674a93e9a48e9ebee3455c850e5a9f47b96c0c84ab9d86c43add24","observation_id":"b483865c-2068-41ed-9cff-d5ffa912eca8","resolution":{"observed_at":"2026-08-16T12:40:30.397158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16933","last_updated":"2023-11-28T16:33:08Z","snapshot_observed_at":"2026-08-20T00:21:09.704724Z","submitted_at":"2023-11-28T16:33:08Z","title":"SparseCtrl: Adding Sparse Controls to Text-to-Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16933","snapshot_observed_at":"2026-08-16T12:40:30.337376Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.337376Z"},"links":{"cited_paper":"/paper/2311.16933","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:cd633048e2a04f8811c5801222c5106f198e00e53dded3dcc9d0e1980952141d","observation_id":"42958e16-0f65-4ac4-bd16-a7fb9afa2907","resolution":{"observed_at":"2026-08-16T12:40:30.337376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-16T12:40:30.353816Z","title":"arXiv preprint arXiv:1412.6980","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.353816Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:70a2ec5353a208c60d623f6e0b77a174e4507fe648749985126514ccc248bd5c","observation_id":"2575fb15-52a2-4d50-9590-e8acf333a1a4","resolution":{"observed_at":"2026-08-16T12:40:30.353816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:30.606379Z","title":"In Medical image computing and computer-assisted intervention–MICCAI 2015: 18th international conference, Munich, Germany, October 5-9, 2015, proceedings, part III 18, 234–241","venue":null,"work_id":"9b2e09ba-f358-4c61-9061-19ebeb3b8643","year":2015},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.387636Z"},"links":{"citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:06ff5c9cba21044669dc0b78435338029eba93d53e7ead75a0d105f84c68eedd","observation_id":"eea5614c-0aae-4046-8abe-bb9a102a4791","resolution":{"observed_at":"2026-08-16T12:40:30.612390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-20T09:39:07.545813Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-16T12:40:30.332391Z","title":"In Proceedings of the IEEE/CVF international conference on computer vision, 1728–1738","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.332391Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:81873d86116065ae87887b166102fbf155601fe5e7f7442e9a9eeabd62876649","observation_id":"36ee8dc8-5978-4059-9353-03e61090f352","resolution":{"observed_at":"2026-08-16T12:40:30.332391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-16T12:40:30.382392Z","title":"arXiv preprint arXiv:2204.06125, 1(2):","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.382392Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:26a75422ac2d1f49de475d6436f07f0489a84c7e7d6e2b896b1c28d32147455d","observation_id":"8a56eb9c-6696-46c0-bdb1-5aa14a55b02b","resolution":{"observed_at":"2026-08-16T12:40:30.382392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T12:40:30.327338Z","title":"arXiv preprint arXiv:2303.08774","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.327338Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:71b1c2359da46267d19e64d02d67434a0f780d0930901274c6504365b002524c","observation_id":"5cda7574-28d5-474c-9523-4135edf102af","resolution":{"observed_at":"2026-08-16T12:40:30.327338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14773","last_updated":"2025-04-16T13:38:58Z","snapshot_observed_at":"2026-08-18T16:04:07.176253Z","submitted_at":"2024-03-21T18:27:29Z","title":"StreamingT2V: Consistent, Dynamic, and Extendable Long Video Generation from Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14773","snapshot_observed_at":"2026-08-16T12:40:30.343410Z","title":"arXiv preprint arXiv:2403.14773","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:30.343410Z"},"links":{"cited_paper":"/paper/2403.14773","citing_paper":"/paper/2504.12048"},"observation_digest":"sha256:2b36e01b2ee751451dc1f2003b419fadbcf9f63bc077df535236eb33219814d4","observation_id":"433f0dc1-69cc-49a4-acb5-0f8ec08338d5","resolution":{"observed_at":"2026-08-16T12:40:30.343410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.12048","last_updated":"2025-04-16T13:04:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T18:10:16.190206Z","submitted_at":"2025-04-16T13:04:01Z","title":"Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2504.12048."}