{"as_of":"2026-08-18T09:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:81b828b44104c1eaafcb191a24050a9cb63999308cea1bde3de9a3453207dca2","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T08:00:47.144439Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T23:47:57.910030Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30090","snapshot_observed_at":"2026-07-30T23:47:57.910030Z","title":"Directorbench: Diagnosing long-form video generation with personalized multi-agent evaluation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26694","last_updated":"2026-08-17T13:29:53Z","snapshot_observed_at":"2026-08-18T09:17:21.147735Z","submitted_at":"2026-07-29T09:40:23Z","title":"Visko Orbis 1.0: A Live Model for Real-Time Interactive Long Video Generation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-30T23:47:57.910030Z"},"links":{"cited_paper":"/paper/2605.30090","citing_paper":"/paper/2607.26694"},"observation_digest":"sha256:7fb1f49642a958d74f6cf92178083e8f230a8156b768990c0bbf5a3c28e23fcc","observation_id":"31342146-3dac-4bc3-96fd-3af25ff9da09","resolution":{"observed_at":"2026-07-30T23:47:57.910030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.30090/citation-record","integrity":"/paper/2605.30090/integrity","json":"/paper/2605.30090/citation-record.json","paper":"/paper/2605.30090"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Kimi large language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:564e767097d205dba62bb607da53762abc2ade0eca751e579ba501ac67d50db4","observation_id":"21de5c7f-7246-4d24-b562-bf980ed49cd8","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":"2212.08073","doi":"10.48550/arxiv.2212.08073","metadata_source":"pith","pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Constitutional AI: Harmlessness from AI Feedback","venue":"cs.CL","work_id":"faaaa4e0-2676-4fac-a0b4-99aef10d2095","year":2022},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:e1fe71ce45491133c8a50c7f61fcb5f932b9ac59493782d47a7431aa9b176d75","observation_id":"89099676-9a28-45aa-946e-0d834f5b0652","resolution":{"observed_at":"2026-06-29T08:03:13.616634Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-15T03:08:13.900899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T03:08:13.900899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"The opencv library.Dr","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:08d0617206edea923d60fa30ed2616541bccccc27ac977376b4f6dcbbe6a41b5","observation_id":"09466ef0-99b8-4e95-9c9d-59fc9ebcf7dc","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Pyscenedetect: Intelligent scene cut detection and video splitting tool","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:d71f2ecbab11400b7079cb631286fa270c0c09c6c2b4d082cff94aab5ffee906","observation_id":"9c7a45e2-ad83-4db2-8df4-c8329ad3dfa7","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Seed 2.0: Bytedance foundation model","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:97e71bfa45ec8caa1193792518e096b992d2bd6ffe1c77f2976438bcfeb6daf2","observation_id":"158304ac-fae6-41f2-b36d-d80fee33c712","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-54427-4","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Out of time: Automated lip sync in the wild","venue":"Lecture notes in computer science","work_id":"7d6ee6eb-469a-4b2c-b07f-d6566aa2a699","year":2016},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:bf225b75fd44b9288164c97b5960fda28cae5ad0c34c0148458f13bfcd97f8fd","observation_id":"3a55a4fd-2c99-4a5b-906d-5ad651ca90d7","resolution":{"observed_at":"2026-06-29T08:03:13.601142Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":"2602.15763","doi":"10.48550/arxiv.2602.15763","metadata_source":"pith","pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","venue":"cs.LG","work_id":"ad29b1a2-bf77-46b3-9ead-fb62b1d2c6fe","year":2026},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:4787d263b077fa63f9d4d134220e355372c295e8b33b267fa491f9fcb0a96e46","observation_id":"a598295a-6615-4459-a517-3da946f4b4e8","resolution":{"observed_at":"2026-06-29T08:03:13.613689Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":"2411.15594","doi":"10.1016/j.xinn.2025.101253","metadata_source":"pith","pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on LLM-as-a-Judge","venue":"cs.CL","work_id":"2676656a-67bd-4ad5-bad6-cb6f5fcdbfbe","year":2024},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:fccdad6c4f462f01ec5fa2ce928f2aa518ddb78e419efa14168421eadd0ebe32","observation_id":"0633c586-491d-49c8-bbe3-6ee7a5ab3cce","resolution":{"observed_at":"2026-06-29T08:03:13.592756Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:01.818871+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:01.818871+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2734.2025","doi":"10.1109/cvpr52734.2025","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Freeman, Frédo Durand, Eli Shechtman, and Xun Huang","venue":null,"work_id":"d0e5199d-8907-47b1-905a-07ab8b623a4c","year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:c39590d39784da1766fb9e80ec2e4bc864f18066e792d5e4bfc8113670391e64","observation_id":"ed5d2f1a-1d87-415e-bc8a-419c51ff7865","resolution":{"observed_at":"2026-06-29T08:03:13.979916Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:50:06.316117+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:50:06.316117+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:e5a06a49a897c68896959c1a25927a0997e66598d9656eab0ef91fa0ce206fd9","observation_id":"0b3a3416-45f0-4400-b1eb-2f9b44bcf8da","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Vimax: Agentic video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:035cef72a0f00450dea09d5ce53e02e276436aeeb1589995a9b2478e0e2b8792","observation_id":"6a620480-72d7-43c3-beb0-b90d0bc253e8","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2733.2024","doi":"10.1109/cvpr52733.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emogen: Emotional image content generation with text-to-image diffusion models","venue":null,"work_id":"7efbc2dd-b0f2-4f71-bb1c-d2fcf110d805","year":2024},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:208851180f0aeda64170846174addc6d9b6bf9e5c2747ccb31aa08b112ecb94b","observation_id":"e78fd8b0-5b36-47b6-a394-655aba43ce39","resolution":{"observed_at":"2026-06-29T08:03:13.578680Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.363389","doi":"10.1109/tpami.2025.3633890","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VBench++: Comprehensive and versatile benchmark suite for video generative models.IEEE Transactions on Pattern Analysis and Machine Intelligence","venue":"IEEE Transactions on Pattern Analysis and Machine Intelligence","work_id":"9219076c-d64f-4366-9de2-fa0a1af07a73","year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:5f325f857c5b5dafb8c23f9eff62c2096f3350ed6409e2b746d489e23e002668","observation_id":"c367aa8b-737e-404e-93c5-9e332b8d37ab","resolution":{"observed_at":"2026-06-29T08:03:13.566523Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-20T12:52:03.964154+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T12:52:03.964154+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Videopoet: A large language model for zero-shot video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:5b2d8dd50b420cc17be1b41e0c8617e5ec4d6b79466d8a7ea6968efb0535e3db","observation_id":"b7530070-428c-4132-8239-1cb2ef3a7a63","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07343","last_updated":"2026-07-30T00:53:05Z","snapshot_observed_at":"2026-08-13T09:56:35.343625Z","submitted_at":"2026-04-08T17:55:00Z","title":"Personalized RewardBench: Evaluating Reward Models with Human Aligned Personalization","version":2},"cited_work":{"arxiv_id":"2604.07343","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07343","snapshot_observed_at":"2026-07-01T18:55:58.587686Z","title":"Personalized RewardBench: Evaluating Reward Models with Human Aligned Personalization","venue":"cs.CL","work_id":"9dda2b23-6d6c-41ef-8399-fe1ff2e39908","year":2026},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2604.07343","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:7d5d31301bfbd5b57b55068006b86a1b2ee9ef47660b4ee36ee6d756acc520b0","observation_id":"5bb11fdd-d4b4-4093-b0ad-32ecc0ed2f26","resolution":{"observed_at":"2026-06-29T08:03:13.982149Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Video shot boundary detection based on color histogram","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:c44aab03a18a01a2503fb459e6f702058bc2c4921005609a9f2367cf50f1afe3","observation_id":"2043f72e-7ac8-4042-8958-656b9e62f954","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:f4a0dafcc199c368bb376d5e2689d4f07a6bbb443efb8d46c7b1318910ef9e39","observation_id":"e2da2795-77d3-4f23-9d68-06501e1c9c78","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.25080/majora-7b98e3ed-003","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and McVicar, Matt and Battenberg, Eric and Nieto, Oriol , title =","venue":"Proceedings of the Python in Science Conferences","work_id":"ded17916-e8ef-4cbd-88a6-fbd0a17e4087","year":2015},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:2904bfa5d2af1ae27fbf74a6808e0f10ad07daa67d599c377ca1bc46692f8cc6","observation_id":"88c4da9a-5afb-49d9-b184-a8a56e32a60b","resolution":{"observed_at":"2026-06-29T08:03:13.609716Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:23:44.114444+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:23:44.114444+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20822","doi":"10.48550/arxiv.2510.20822","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Team Seawead, Ceyuan Yang, Zhijie Lin, Yang Zhao, Shanchuan Lin, Zhibei Ma, Haoyuan Guo, Hao Chen, Lu Qi, Sen Wang, et al","venue":"ArXiv.org","work_id":"86271608-cd60-4a6d-8e48-468ae623ded6","year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:ce683da70d07bf1da71dafddc330e6109c7f5dd283f2168677d5b320e2309aa5","observation_id":"18f3878f-6566-4797-8879-5108a9347d22","resolution":{"observed_at":"2026-06-29T08:03:13.603775Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Minimax m2.7 model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:6b45472ef6ca7c2a07b7f87653cec3310d3601501223921b994c487993ca777f","observation_id":"29dc082b-58d1-4bc7-91b8-9259afa871e9","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:3f694e3e90813c5cde3629071c911b19f9ebb5fc9a2dadb9a1fe2f7fe068f2a5","observation_id":"36034938-3aa8-41f0-ad29-6dcff8219302","resolution":{"observed_at":"2026-06-29T08:03:13.592466Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Video generation models as world simulators.OpenAI TechnicalReport, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:6d027e55657b33e15434513a024b367e0b58e78cbbde6fc458a866581ffe84fd","observation_id":"c818b98b-cd4e-4061-badd-9a646fea28bd","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-14T22:40:32.716624Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:78b9a56599ee3fcd9aded6b71adf75a50870e1df13c418043646472387bd9500","observation_id":"b1d7fa2f-2238-42cd-a960-9ca2d61ab926","resolution":{"observed_at":"2026-06-29T08:03:13.595934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Dreambench++: A human-aligned benchmark for personalized image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:0c916cc07986fc98970fb4b1c69dbf9ad4f6113202571c2235bba9df17378f4e","observation_id":"dd77adc6-8d70-4e09-b6c4-1f65939e14f2","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1410","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:56:41.012481Z","title":"Sentence- BERT : Sentence Embeddings using S iamese BERT -Networks","venue":"Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing (EMNLP-IJCNLP)","work_id":"cf07889b-1f35-4d81-9514-4ad3ed223c57","year":2019},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:ed64f77451e215f9a2d541e37dc1a59ef30a9c19ad534e59c883639012534b54","observation_id":"65a2aeb6-7caa-48ce-afc0-210882b29510","resolution":{"observed_at":"2026-06-29T08:03:13.575655Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-14T23:08:17.316518+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-14T23:08:17.316518+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Goodfellow, Wojciech Zaremba, Vicki Cheung, Alec Radford, and Xi Chen","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:9dec377d1ed92fcdc6ecda1703033c90d9184df8fbbc19d7c16579c9a0beb84b","observation_id":"4f96e171-4caf-43c5-bbfe-d498e4cca62f","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:681b806c7d2a55bea8c2d82b6055e227605408f26d656daafd1512b5b62cf050","observation_id":"2d911d5d-48ea-4bdd-99e4-dbf95fbd8476","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:8b357367f3ab63288e57af3b8bed10ca811140e8422c050c0934a4736037ce0b","observation_id":"806adda9-59b0-49a5-8c09-697a45dbfb5c","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-18T04:00:09.136122Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":"1812.01717","doi":"10.48550/arxiv.1812.01717","metadata_source":"pith","pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","venue":"cs.CV","work_id":"72f42543-17d5-49aa-ba5a-25d67ffbb88a","year":2018},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:57ff5995474617ed228888d873ecc5d7c1cfbd6eb78fc4334c7acdcfd249ba85","observation_id":"2c1b4a59-8920-4e01-ae33-a85cf2702343","resolution":{"observed_at":"2026-06-29T08:03:13.977218Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Phenaki: Variable length video generation from open domain textual descriptions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:5d6d72f15270b75c85b311b00f396c7bd199c54f171e9f37e89b603c6113e813","observation_id":"02c44848-5a0e-4006-99d5-7bf919650659","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:00:47.144439Z","title":"Mavis: A multi-agent framework for long-sequence video storytelling","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:797b86ea8e774c9b36efc9a126820ba934c4f5ca24baed2afa395a5162482df4","observation_id":"f53b265c-802a-4f37-94e0-6e2e629652d9","resolution":{"observed_at":"2026-06-29T08:00:47.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2003.819861","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:47:05.725412Z","title":"Bovik, Hamid R","venue":null,"work_id":"a9ba8a9e-c00a-45ff-9d73-a0ae0919d283","year":2004},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:509bfe6b12a889c4dc8910fed4740aba313dba1b0f547504cfa9aed6db04d017","observation_id":"e6d908a9-095a-4c93-b5cf-7f8e86d5c5fb","resolution":{"observed_at":"2026-06-29T08:03:13.585497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.22431","doi":"10.48550/arxiv.2510.22431","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2510.22431 , year=","venue":"arXiv (Cornell University)","work_id":"f09261e3-7abe-40ff-9f58-34f0b973beda","year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:7946a47710e1abd50348436d6e5cb92c3e4b12a422a5b7a2cf125f07cd65ac6e","observation_id":"dbe3e52d-4d06-44e3-b48e-8e0ed46c7d81","resolution":{"observed_at":"2026-06-29T08:03:13.598834Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2015.729887","doi":"10.1109/cvpr.2015.7298873","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to detect motion boundaries","venue":null,"work_id":"352a6f03-d489-441b-a3ad-bed5b73c595b","year":2015},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:8ecfca2a41cfeda92082fe54d35974f70b8137c7047d3bd894632b3eeb3c2713","observation_id":"3588181a-eb65-469d-85b9-42ce32fc6c79","resolution":{"observed_at":"2026-06-29T08:03:13.600792Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07314","last_updated":"2025-03-10T13:33:27Z","snapshot_observed_at":"2026-08-16T12:51:31.201892Z","submitted_at":"2025-03-10T13:33:27Z","title":"Automated Movie Generation via Multi-Agent CoT Planning","version":1},"cited_work":{"arxiv_id":"2503.07314","doi":"10.48550/arxiv.2503.07314","metadata_source":"pith","pith_arxiv_id":"2503.07314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Automated movie generation via multi-agent cot plan- ning.ArXiv, abs/2503.07314","venue":"cs.CV","work_id":"c99751d3-5254-47ac-9000-2f6228af3dcf","year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2503.07314","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:3e882ae1e26113a7142ac35a1337988a02b790803b184b04df8e5e5f37cc222e","observation_id":"d1aef313-fad0-4286-a704-efae258635d9","resolution":{"observed_at":"2026-06-29T08:03:13.589380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-10T19:18:56.696331+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T19:18:56.696331+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9334.364571","doi":"10.1145/3589334.3645710","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding human preferences: Towards more personalized video to text generation","venue":null,"work_id":"454cc48e-3e54-4bad-93f5-b2ea510d77a7","year":2024},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:be08643c232fe8677bc658cfb35f56fbb9c12f9cc45b771928b539da36acc96a","observation_id":"acfb28a7-559f-4de8-ab6d-997f7d0bf019","resolution":{"observed_at":"2026-06-29T08:03:13.568119Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.20192","doi":"10.48550/arxiv.2603.20192","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lumosx: Relate any identities with their attributes for personalized video generation.CoRR, abs/2603.20192, 2026","venue":"arXiv (Cornell University)","work_id":"4153ade6-a482-4e7d-b843-41346f7b7c7d","year":2026},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:59d97da824c13c091714d439e8636584481b909226e954f4f0689b36f0f31428","observation_id":"6377c2b1-d48f-4bc8-a207-724d9e003482","resolution":{"observed_at":"2026-06-29T08:03:13.564258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07312","last_updated":"2025-08-10T12:01:58Z","snapshot_observed_at":"2026-08-14T03:50:26.703654Z","submitted_at":"2025-08-10T12:01:58Z","title":"MobileViCLIP: An Efficient Video-Text Model for Mobile Devices","version":1},"cited_work":{"arxiv_id":"2508.07312","doi":"10.48550/arxiv.2508.07312","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07312","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Mobileviclip: An efficient video-text model for mobile devices","venue":null,"work_id":"2191516f-17e2-4bfd-9ce8-30601d16f6af","year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2508.07312","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:52d6ae4a83fa1513a938471d9ca75ef09c98f4f3b56331c75442b4506007e2bf","observation_id":"422b1f83-c561-4a74-9e9c-c4a5b0099dd4","resolution":{"observed_at":"2026-06-29T08:03:13.577866Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-08-15T12:21:16.936063Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":"2503.21755","doi":"10.48550/arxiv.2503.21755","metadata_source":"pith","pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","venue":"cs.CV","work_id":"14060202-ac5f-48e9-b91a-24d150775431","year":2025},"citing_paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:47.144439Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2605.30090"},"observation_digest":"sha256:08543fb02643330299c58018ca624a7b030a19179f7fd0ee73dc2117743f73c0","observation_id":"77964db8-ffa5-477a-a3c7-3e178f32fe9f","resolution":{"observed_at":"2026-06-29T08:03:13.607331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.30090","last_updated":"2026-05-28T15:35:34Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T12:50:54.923458Z","submitted_at":"2026-05-28T15:35:34Z","title":"DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":2,"metadata_mismatch":8,"parse_uncertain":0,"unresolved":17,"verified_exact":12,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2605.30090."}