{"as_of":"2026-08-17T20:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6a481c395e5f3dd8deb2301e3966727a2c569fa1d938a5c4980f9295df166235","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:33:11.314247Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.15182/citation-record","integrity":"/paper/2504.15182/integrity","json":"/paper/2504.15182/citation-record.json","paper":"/paper/2504.15182"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.781701Z","title":"https://openai.com/sora/","venue":null,"work_id":"2c236e57-96f3-4458-9b61-b4f0d4f46ad3","year":null},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.173525Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:03e5eed8ecdc5d14ffeae0f5a4fb58c87ab43ce8ed94bd1100eaa51c4615dc32","observation_id":"838823df-bf67-48d3-a41c-d6d5eecd531b","resolution":{"observed_at":"2026-08-16T11:33:11.786392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08675","last_updated":"2016-09-27T21:21:49Z","snapshot_observed_at":"2026-08-14T21:37:52.670253Z","submitted_at":"2016-09-27T21:21:49Z","title":"YouTube-8M: A Large-Scale Video Classification Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08675","snapshot_observed_at":"2026-08-16T11:33:11.178608Z","title":"Youtube-8m: A large-scale video classifica- tion benchmark","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.178608Z"},"links":{"cited_paper":"/paper/1609.08675","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:bb9e74f471c33fbf7ca17cc15866f6abd8d58a54af09f8353882b0e9ff16ece9","observation_id":"25356778-7415-44d1-9c2a-376f8ad968f3","resolution":{"observed_at":"2026-08-16T11:33:11.178608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-16T11:33:11.183454Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.183454Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:e0c8b0e2775fab72be60f60d29510746336f710e3f968ad415c1220105bb0d56","observation_id":"f61b6439-2dbc-48a1-b7d2-2c6bdfba5e10","resolution":{"observed_at":"2026-08-16T11:33:11.183454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.767912Z","title":"Improving image generation with better captions","venue":null,"work_id":"bd3c22a7-84a3-44d6-bce3-f98e556c7c6f","year":2023},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.188180Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:d1daff06eff8faf190aade4604131a4713da1b9d8c6b1c7144fb09c6c1402e8a","observation_id":"e29c2af7-37c8-44e1-ad7a-a533c2dad6cd","resolution":{"observed_at":"2026-08-16T11:33:11.772422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.754139Z","title":"Activitynet: A large-scale video benchmark for human activity understanding","venue":null,"work_id":"4bd80e93-7b1a-42a1-966f-8e3f1c7eba79","year":2015},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.192347Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:059d7b416277d9a3c08b90867c431053b1c3f568f2f4c26155e903df155da6bc","observation_id":"97dd00ab-bbf5-460d-a486-60be0f095f9d","resolution":{"observed_at":"2026-08-16T11:33:11.758659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.740282Z","title":"PySceneDetect","venue":null,"work_id":"261e5c05-1ab9-4fd9-baec-51677c755917","year":null},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.196759Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:1107c9ff705e916ecd622dd4c5d276cc6c09a079592a4279db9f2b7e95aac8c2","observation_id":"d22d2305-10bc-404d-bad3-429db519db5c","resolution":{"observed_at":"2026-08-16T11:33:11.744700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.725935Z","title":"Panda-70m: Captioning 70m videos with multiple cross-modality teachers","venue":null,"work_id":"34f9fab4-3cab-430a-87ff-8c5d7f1d0297","year":2024},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.201286Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:6ce13d9457281261d86f8fa7efb20148c9eb0d6ecc37f2e2d37d47ca02e4ad30","observation_id":"b53ebf1d-0e01-491a-96a9-b48996508074","resolution":{"observed_at":"2026-08-16T11:33:11.730585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.712173Z","title":"From lifestyle vlogs to everyday interactions","venue":null,"work_id":"86908709-11c4-4097-b87f-f318235c6bd3","year":2018},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.205879Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:2dd3bde7eeeeff88798440d38f44130189914b858a8faf5c3ab43c7827046b28","observation_id":"2bf24b4a-51f6-4bcc-b65a-2df78e6d9e92","resolution":{"observed_at":"2026-08-16T11:33:11.716796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-16T11:33:11.210668Z","title":"Ltx-video: Realtime video latent diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.210668Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:4073f70d60facc357010ca4248dd08da7040e30551eccbbfb7d411df574afaa0","observation_id":"25ec7f45-091d-4bc8-82aa-a3d212cf19b8","resolution":{"observed_at":"2026-08-16T11:33:11.210668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.698070Z","title":"Svd: A large-scale short video dataset for near-duplicate video retrieval","venue":null,"work_id":"bd66ca10-bc0a-4958-9e80-d2ff7898f849","year":2019},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.215336Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:db49bd6049dc30a06a44c2b6a980abe51ddc0d7834797ece92fdc05e94035046","observation_id":"556a4106-87bd-4889-8b88-ee9d4acc2433","resolution":{"observed_at":"2026-08-16T11:33:11.702717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.00836","last_updated":"2017-07-04T07:42:05Z","snapshot_observed_at":"2026-08-14T20:49:54.575768Z","submitted_at":"2017-07-04T07:42:05Z","title":"DeepStory: Video Story QA by Deep Embedded Memory Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.00836","snapshot_observed_at":"2026-08-16T11:33:11.219871Z","title":"Deepstory: Video story qa by deep embedded memory networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.219871Z"},"links":{"cited_paper":"/paper/1707.00836","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:3030756818effa4d2442080774437bef76197a6ca6f5cb01e179d1b5e5d588ca","observation_id":"cb8c99cb-5ec8-4eac-b7af-78f5b655ce83","resolution":{"observed_at":"2026-08-16T11:33:11.219871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-16T11:33:11.224817Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.224817Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:d07cc04f20fff9c51e26c095c171f66ab64ffc1e04598df401b7a8b05cfb9891","observation_id":"0b42e244-6e41-44d1-bbd4-a3a45124d45c","resolution":{"observed_at":"2026-08-16T11:33:11.224817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.03001","last_updated":"2022-06-14T12:00:10Z","snapshot_observed_at":"2026-08-16T16:54:52.743317Z","submitted_at":"2022-06-07T04:33:50Z","title":"PP-OCRv3: More Attempts for the Improvement of Ultra Lightweight OCR System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.03001","snapshot_observed_at":"2026-08-16T11:33:11.229264Z","title":"Pp-ocrv3: More attempts for the improvement of ultra lightweight ocr system","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.229264Z"},"links":{"cited_paper":"/paper/2206.03001","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:06684b7d95db5b836b4d67cf86a30842f4731dce9903c9821013b1c9f481d6b4","observation_id":"17dd7eaa-ed2d-48c5-8849-634f68ad7b70","resolution":{"observed_at":"2026-08-16T11:33:11.229264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10059","last_updated":"2025-07-13T08:12:15Z","snapshot_observed_at":"2026-08-17T20:10:03.387661Z","submitted_at":"2025-02-14T10:21:49Z","title":"RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10059","snapshot_observed_at":"2026-08-16T11:33:11.234686Z","title":"Realcam-i2v: Real-world image-to-video generation with interactive complex camera control.arXiv preprint arXiv:2502.10059, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.234686Z"},"links":{"cited_paper":"/paper/2502.10059","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:7981ae6545f37ae23b6c0e04de694259b93a9fc23a1f96612f9548db2eae9505","observation_id":"974a1b30-588c-4832-9c04-06ef420d6f41","resolution":{"observed_at":"2026-08-16T11:33:11.234686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00330","last_updated":"2024-09-12T06:50:53Z","snapshot_observed_at":"2026-08-16T14:38:36.179170Z","submitted_at":"2023-12-01T03:53:21Z","title":"StyleCrafter: Enhancing Stylized Text-to-Video Generation with Style Adapter","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00330","snapshot_observed_at":"2026-08-16T11:33:11.238926Z","title":"Stylecrafter: Enhancing stylized text-to-video generation with style adapter","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.238926Z"},"links":{"cited_paper":"/paper/2312.00330","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:78a20c11c70b243b1c3ae802b91f5a61080bee1ae108c21d6b37fa97b3943aa7","observation_id":"e5d3e483-4b1a-47c7-bf67-06d31decb9f8","resolution":{"observed_at":"2026-08-16T11:33:11.238926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08268","last_updated":"2024-03-13T05:44:37Z","snapshot_observed_at":"2026-08-16T14:10:19.583849Z","submitted_at":"2024-03-13T05:44:37Z","title":"Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08268","snapshot_observed_at":"2026-08-16T11:33:11.243626Z","title":"Follow-your-click: Open-domain regional image animation via short prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.243626Z"},"links":{"cited_paper":"/paper/2403.08268","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:53ef47b309191b3b58cfd6d4929be5a95ba10461c19abcd5328bf1100a3e66d4","observation_id":"9b5132b6-c37c-4f94-b4b6-044d7f05edc0","resolution":{"observed_at":"2026-08-16T11:33:11.243626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.682546Z","title":"Follow-your-emoji: Fine-controllable and expressive freestyle portrait animation","venue":null,"work_id":"298a8a5d-48e9-427e-8b8a-06f3ebb56332","year":2024},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.248207Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:ae3568333638d2276c57d30ed187862c93d0f77ee76ecb0fb169f5cb32852b3f","observation_id":"8bc57d35-90d5-4fad-b70b-8dfd23e7a12e","resolution":{"observed_at":"2026-08-16T11:33:11.687661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.667285Z","title":"Howto100m: Learning a text-video embedding by watching hundred million nar- rated video clips","venue":null,"work_id":"0c256e71-7c66-4319-b53e-3da786f4a857","year":2019},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.252348Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:bbda2978abd5c310b8da5024edd485c75d497e63649b26e4727213241c725158","observation_id":"15ca60d8-d8c3-4d21-9319-a23944496286","resolution":{"observed_at":"2026-08-16T11:33:11.672130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.652692Z","title":"A dataset for movie description","venue":null,"work_id":"3e9b206d-1a42-471d-8fe6-4511ccbc1121","year":2015},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.256242Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:ad73c57846dd69407e1485bef45c2bea204c4132c75316aa741f520e1644c555","observation_id":"a8760b4c-e2c3-4809-96a5-e8599ea1ce61","resolution":{"observed_at":"2026-08-16T11:33:11.657346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00347","last_updated":"2018-12-07T07:03:52Z","snapshot_observed_at":"2026-08-14T18:05:47.659963Z","submitted_at":"2018-11-01T12:47:11Z","title":"How2: A Large-scale Dataset for Multimodal Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00347","snapshot_observed_at":"2026-08-16T11:33:11.260740Z","title":"How2: a large-scale dataset for multimodal language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.260740Z"},"links":{"cited_paper":"/paper/1811.00347","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:c708520d2fcf7312b052e47464b5a5e5ece5afd272efa301a0d14b9381602295","observation_id":"2116a2ed-7786-406b-8e9f-0ea5e7abdb7e","resolution":{"observed_at":"2026-08-16T11:33:11.260740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.637846Z","title":"Transnet v2: An effective deep network architecture for fast shot transition detection","venue":null,"work_id":"81a6fa57-b36c-4e9a-8dcf-ec8c759cb731","year":2024},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.265191Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:9a6b1a2538687ff71e3e0dee9064687968c01008b0e65aa43d25e26e3a678f9c","observation_id":"13ec5ca0-c579-4117-a5c6-cd9922a6e52d","resolution":{"observed_at":"2026-08-16T11:33:11.642410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.623540Z","title":"Movieqa: Understanding stories in movies through question-answering","venue":null,"work_id":"e32a5c7b-04f2-43dc-8c01-6623d5efcb00","year":2016},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.269491Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:1b434f6e98458d77f712eadd3284a8d9276a7b3e10ae7da677a71822bbdda420","observation_id":"1c26f955-d5fa-4c9a-b99f-75e0243e966b","resolution":{"observed_at":"2026-08-16T11:33:11.628146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-16T11:33:11.273757Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.273757Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:43a77e0ae0b6808698a510f96293fd1ca69742a7b5d81c5f2743e0861751e2a0","observation_id":"f1cefcfa-e74a-4166-bb6f-995e7ec4b14d","resolution":{"observed_at":"2026-08-16T11:33:11.273757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08260","last_updated":"2025-04-26T17:58:24Z","snapshot_observed_at":"2026-08-16T13:10:35.398679Z","submitted_at":"2024-10-10T17:57:49Z","title":"Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08260","snapshot_observed_at":"2026-08-16T11:33:11.278104Z","title":"Koala-36m: A large-scale video dataset improving con- sistency between fine-grained conditions and video content","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.278104Z"},"links":{"cited_paper":"/paper/2410.08260","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:6b2ca5c039714fcd436a305333d06b282a5d4f44796651ac31f91b6dab4c110a","observation_id":"82b0bf69-6a06-48a0-96da-0cc5d46caabb","resolution":{"observed_at":"2026-08-16T11:33:11.278104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19645","last_updated":"2024-12-30T02:50:45Z","snapshot_observed_at":"2026-08-17T02:27:59.468242Z","submitted_at":"2024-12-27T13:49:25Z","title":"VideoMaker: Zero-shot Customized Video Generation with the Inherent Force of Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19645","snapshot_observed_at":"2026-08-16T11:33:11.282581Z","title":"Videomaker: Zero-shot customized video generation with the inherent force of video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.282581Z"},"links":{"cited_paper":"/paper/2412.19645","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:1da2f4ed37580ce24ef4670a5bc2eb0f84e6976f591397aab6a34aecb24b1fd7","observation_id":"dcc6d590-eba2-4688-b6e3-daffc7ced655","resolution":{"observed_at":"2026-08-16T11:33:11.282581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.609617Z","title":"Customcrafter: Customized video generation with preserving motion and concept composition abilities","venue":null,"work_id":"86e2d65f-29f0-4b28-9000-c8722b9bb18a","year":2025},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.287880Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:b639aa11cf1ec0e19da92e30c7892db57af7ab11324cec51f09472479be87e4d","observation_id":"ed178c76-75cd-4681-a79c-f042d2204aac","resolution":{"observed_at":"2026-08-16T11:33:11.614416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.292095Z","title":"Msr-vtt: A large video description dataset for bridging video and language","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.292095Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:6ba515c375706ac170f6ef1aa1ac41643399b6db6a8e8d4f02da26091781a752","observation_id":"47efae95-362d-4d8d-a627-a9b69909b521","resolution":{"observed_at":"2026-08-16T11:33:11.292095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.587044Z","title":"Advancing high-resolution video-language representation with large-scale video transcriptions","venue":null,"work_id":"6fc788f6-cd48-428d-bd1c-6bc86b517e8b","year":2022},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.296708Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:229fb60dac18fa3ba5441f4cdeb9f9173e02e43359f92dffaaf5e4687d60320b","observation_id":"37068fea-078b-4f5a-8641-d91ad0555003","resolution":{"observed_at":"2026-08-16T11:33:11.591712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-16T11:33:11.301236Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.301236Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:211c179081cf2ddf1d7070e8bb1681476ebb4706636c0d6018ad9ec69337a489","observation_id":"acfb60c0-5b2d-4be9-90fd-4c730da392f8","resolution":{"observed_at":"2026-08-16T11:33:11.301236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:11.570924Z","title":"Merlot: Multimodal neural script knowledge models","venue":null,"work_id":"1a52153b-06b9-4789-b1b8-f559d365495a","year":2021},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.305432Z"},"links":{"citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:aa0a66c121533535aee8b8d655a5c103f72292bdb3579e0e5a138e1e24228a07","observation_id":"6b1f785b-c102-4e64-b27a-a9d4331d7e79","resolution":{"observed_at":"2026-08-16T11:33:11.577070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-08-16T13:07:25.626052Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-16T11:33:11.309593Z","title":"Cami2v: Camera- controlled image-to-video diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.309593Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:b929286ebe6f8c4f09376519f5ea51eba31b9970e3af9d9be71214d9d25e3cc4","observation_id":"8e5a9561-4d20-4f92-9b5a-2642780cbab0","resolution":{"observed_at":"2026-08-16T11:33:11.309593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08212","last_updated":"2025-04-11T02:35:19Z","snapshot_observed_at":"2026-08-16T12:42:11.823965Z","submitted_at":"2025-04-11T02:35:19Z","title":"RealCam-Vid: High-resolution Video Dataset with Dynamic Scenes and Metric-scale Camera Movements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08212","snapshot_observed_at":"2026-08-16T11:33:11.314247Z","title":"Realcam-vid: High-resolution video dataset with dynamic scenes and metric-scale camera movements","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:11.314247Z"},"links":{"cited_paper":"/paper/2504.08212","citing_paper":"/paper/2504.15182"},"observation_digest":"sha256:3a302ef8a0c8acc132c46300f04b918a21e18b73144988b5c62cfc2ce2acebaf","observation_id":"4cb67d8f-8d01-47f1-be77-94b82fd1ad9b","resolution":{"observed_at":"2026-08-16T11:33:11.314247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.15182","last_updated":"2025-04-21T15:44:06Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T02:28:54.035293Z","submitted_at":"2025-04-21T15:44:06Z","title":"Tiger200K: Manually Curated High Visual Quality Video Dataset from UGC Platform"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2504.15182."}