{"as_of":"2026-08-08T23:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:554c181caf5234ad534e64f05411708686d88e99569f91cf9d272f83f9befdd1","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T12:16:44.879850Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05485/citation-record","integrity":"/paper/2608.05485/integrity","json":"/paper/2608.05485/citation-record.json","paper":"/paper/2608.05485"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.880622Z","title":"Wan2.2-V ACE-Fun-A14B, 2025","venue":null,"work_id":"be64899a-9a48-4fc7-96be-80a4d377de0e","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.625731Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:0373635e92884978f2531de5e6f82d0c61ba82c19f621d5fa202483bb6d9c48d","observation_id":"f3024a84-9e41-4b75-a945-c57d57ecf7bd","resolution":{"observed_at":"2026-08-08T12:16:46.884732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.870807Z","title":"Introducing Claude Opus 4.8, 2026","venue":null,"work_id":"ed184923-39e9-4534-b2be-37cc6f0fe36d","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.632135Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:409cc02f5347fcdc24608b2b5994baeea5bcf1adbaa690995f95d6acb497b37d","observation_id":"c4ad8a92-ea21-4935-83ad-80039a396b85","resolution":{"observed_at":"2026-08-08T12:16:46.874678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.636943Z","title":"Sana-video: Efficient video generation with block linear diffusion transformer.arXiv preprint arXiv:2509.24695, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.636943Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:de4065d300f6b157950eabc062fb1ca25670555c0ff7305efed79d664436f7a2","observation_id":"b7f568b1-6949-42f8-bcaf-192691708af7","resolution":{"observed_at":"2026-08-08T12:16:44.636943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.641153Z","title":"Ivebench: Modern benchmark suite for instruction-guided video editing assessment.arXiv preprint arXiv:2510.11647, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.641153Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:a45c0cd32e94840216e27e00847df3a46da5bafb5f094f796d21c2bedd06fab2","observation_id":"92cf486a-ff02-4e4c-91ed-7b746d92e0db","resolution":{"observed_at":"2026-08-08T12:16:44.641153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.645017Z","title":"Magref: Masked guid- ance for any-reference video generation with subject disen- tanglement.arXiv preprint arXiv:2505.23742, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.645017Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:3ed23af59807bec83efe9c0feadd65d01797eff5a379fb30ce583593631debae","observation_id":"cfb085e4-7b92-4323-876d-efc25c368d6f","resolution":{"observed_at":"2026-08-08T12:16:44.645017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.851331Z","title":"Gemini 3.1 Pro: Model card, 2026","venue":null,"work_id":"10834873-4edd-4658-b62e-9b75b2b32548","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.649217Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:ad8527db948c6a9e642c4d29e239ad3d506df7b66905b27f942eaf2501d65627","observation_id":"883ba724-856e-4408-b5d6-ee7e0eed42bd","resolution":{"observed_at":"2026-08-08T12:16:46.864266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.839684Z","title":"Veo 3 Model Card","venue":null,"work_id":"e248621a-9bf7-4f16-86f4-a1e534f82084","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.653181Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:681a974eaf9eb5d5aee66c4d8e5354389594fb58ae69034e46e23f0fc95215a6","observation_id":"2289aca0-a75c-4fe3-9fd9-579e70773def","resolution":{"observed_at":"2026-08-08T12:16:46.844417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-08T12:16:44.657247Z","title":"Ltx-video: Realtime video latent diffusion.arXiv preprint arXiv:2501.00103,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.657247Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:cb3ce549e6a03eefd1383b182bd2701fc1f8c8720a9b157ac979e2d0535c2aba","observation_id":"95df5e91-9c1d-481d-a73f-3cc4bfabf1e9","resolution":{"observed_at":"2026-08-08T12:16:44.657247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.661497Z","title":"Openve-3m: A large-scale high-quality dataset for instruction-guided video editing.arXiv preprint arXiv:2512.07826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.661497Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:bbfaa9bf31ca0165ca5caa1c80e21728af5435e11364ca9fabbefce794672edf","observation_id":"c16f47e2-8914-4725-9eaf-4d991528485f","resolution":{"observed_at":"2026-08-08T12:16:44.661497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-08T15:15:48.227139Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04512","snapshot_observed_at":"2026-08-08T12:16:44.665393Z","title":"Hunyuancustom: A multimodal-driven architecture for customized video gener- ation.arXiv preprint arXiv:2505.04512, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.665393Z"},"links":{"cited_paper":"/paper/2505.04512","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d29c2dda297a4af0a9520013ade98764dea90d2a5b199af2360c563fccf72062","observation_id":"f7d9a41d-ccf7-4740-93f2-eabb73556743","resolution":{"observed_at":"2026-08-08T12:16:44.665393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-08-08T12:16:44.671113Z","title":"Promptcap: Prompt-guided task- aware image captioning.arXiv preprint arXiv:2211.09699,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.671113Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:466980b0b834945f777692193a1325b6b61c9c1ae130f3b4dfc33a7bce5cfc03","observation_id":"1f83d1d8-d99a-4b81-a0da-95d0766194d8","resolution":{"observed_at":"2026-08-08T12:16:44.671113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09733","last_updated":"2024-10-13T05:35:09Z","snapshot_observed_at":"2026-08-02T08:33:00.410905Z","submitted_at":"2024-10-13T05:35:09Z","title":"MMCOMPOSITION: Revisiting the Compositionality of Pre-trained Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09733","snapshot_observed_at":"2026-08-08T12:16:44.676377Z","title":"Mmcomposition: Revisiting the compositionality of pre-trained vision-language models.arXiv preprint arXiv:2410.09733, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.676377Z"},"links":{"cited_paper":"/paper/2410.09733","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:53d3613c678a988e2e62082e38a16a6632836a1c0379bb03c60c2bbe7fc67757","observation_id":"7b4dbd12-f7ba-49db-8bed-d4a396b798c9","resolution":{"observed_at":"2026-08-08T12:16:44.676377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19415","last_updated":"2025-05-27T20:10:09Z","snapshot_observed_at":"2026-08-07T14:12:18.054397Z","submitted_at":"2025-05-26T02:07:24Z","title":"MMIG-Bench: Towards Comprehensive and Explainable Evaluation of Multi-Modal Image Generation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19415","snapshot_observed_at":"2026-08-08T12:16:44.681599Z","title":"Mmigbench: Towards comprehensive and explainable evaluation of multi-modal image generation models.arXiv preprint arXiv:2505.19415, 3, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.681599Z"},"links":{"cited_paper":"/paper/2505.19415","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:e1b5c0bb26cd26d1ceb23daa3fa1bc057cbe6bb34f4b9d4662734562ecbb6100","observation_id":"f88a1b98-a342-4fd0-93d6-3d990ade54d9","resolution":{"observed_at":"2026-08-08T12:16:44.681599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11251","last_updated":"2025-03-14T10:01:55Z","snapshot_observed_at":"2026-08-08T15:16:51.480953Z","submitted_at":"2025-03-14T10:01:55Z","title":"Step-Video-TI2V Technical Report: A State-of-the-Art Text-Driven Image-to-Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11251","snapshot_observed_at":"2026-08-08T12:16:44.687142Z","title":"Step-video-ti2v technical re- port: A state-of-the-art text-driven image-to-video genera- tion model.arXiv preprint arXiv:2503.11251, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.687142Z"},"links":{"cited_paper":"/paper/2503.11251","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:c897ab1b9d333e8d7c1bcba222ac59b613b140de1f7638aec6a1a594c42a003b","observation_id":"51b6d96d-10e3-4dd3-b386-20e12e2a075e","resolution":{"observed_at":"2026-08-08T12:16:44.687142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.732245Z","title":"Vbench: Comprehensive bench- mark suite for video generative models","venue":null,"work_id":"f394c070-cdca-4532-9b54-ed3967dc3e7a","year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.692436Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d1eb25fdc38b123ade4d076b5b8fe64a189e67912838051160c2e685aed2830c","observation_id":"bc2f26c9-c31a-48c7-8389-9acd2deacfbe","resolution":{"observed_at":"2026-08-08T12:16:46.832436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.698653Z","title":"Vace: All-in-one video creation and editing","venue":null,"work_id":"35b746a5-c6f7-4c97-87e9-9eaa2a1e5314","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.697969Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d1d2a2fd6fc8e6629e80b65f148872a5dbe0772ac6d79cf40e991221b680cfcd","observation_id":"11b19253-6a42-447f-ae99-645ad0ba67fb","resolution":{"observed_at":"2026-08-08T12:16:46.703008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20360","last_updated":"2026-04-18T01:38:10Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T17:59:30Z","title":"EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.20360","snapshot_observed_at":"2026-08-08T12:16:44.702972Z","title":"Editverse: Unifying image and video editing and generation with in-context learning.arXiv preprint arXiv:2509.20360, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.702972Z"},"links":{"cited_paper":"/paper/2509.20360","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:34aea49432dac1ae31b568abba2b7a25499f8be6baddeabe126d4b47dfe0f540","observation_id":"474b4297-571f-4ccf-bb7f-c70936a7e35f","resolution":{"observed_at":"2026-08-08T12:16:44.702972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-08T12:16:44.707094Z","title":"Anyv2v: A tuning-free framework for any video-to- video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.707094Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:1946bb0f1a9dd551abdf3cf3d5863f5cd7e46cb8cf9ede4ebe09bbe5072ee9ae","observation_id":"19bb3541-0439-4422-9c09-67e0f00c4524","resolution":{"observed_at":"2026-08-08T12:16:44.707094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.689135Z","title":"Kling AI Launches 3.0 Model, Ush- ering in an Era Where Everyone Can Be a Director, 2026","venue":null,"work_id":"d8dfdbe6-83b5-4edb-b744-653059f5f165","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.712409Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:52c04f187265e16a71b3c8c59f2c82f2e2ece2eb9db61be25229f51acdc6024e","observation_id":"32a2a8ae-fcaa-44f6-9ed9-4e820c224c55","resolution":{"observed_at":"2026-08-08T12:16:46.692536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.716955Z","title":"Skyreels-v3 technique report","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.716955Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:7137b5ad226d5eaf0fb59eba1ae3a058736ed3f5c15d614add49171d162cb3cb","observation_id":"c99fe9af-3db6-43d8-9510-1d2043848754","resolution":{"observed_at":"2026-08-08T12:16:44.716955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.508274Z","title":"Five-bench: A fine-grained video editing benchmark for evaluating emerging diffusion and rectified flow models","venue":null,"work_id":"305bf177-cbee-4c50-8149-5f68ed82c50b","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.721069Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:77713141ebbf3dadc729cb5949b756e71e238ee14ba956c666999f8c952cd5a8","observation_id":"17524af8-6f2d-4c5a-8d7e-7d51dd9582e4","resolution":{"observed_at":"2026-08-08T12:16:46.590406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.725253Z","title":"Bindweave: Subject-consistent video generation via cross-modal integration.arXiv preprint arXiv:2510.00438, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.725253Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:81a5cc5a6c368d87140fb418340f55e0b5b1a4997a16002c762aeb0cf4007b37","observation_id":"a1bcf71c-3ef6-4052-bd77-df701de5ea79","resolution":{"observed_at":"2026-08-08T12:16:44.725253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.459585Z","title":"Videoxum: Cross- modal visual and textural summarization of videos.IEEE Transactions on Multimedia, 26:5548–5560, 2023","venue":null,"work_id":"608a3858-0253-4155-a52c-3f2c5ef83b2e","year":2023},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.729363Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:963767175a40846c51dcd2f3923c9e1d388b0ae1ae80a814f7d391f7e9d26a7f","observation_id":"0b0ecad0-6b65-47ae-818e-f2db421da0f3","resolution":{"observed_at":"2026-08-08T12:16:46.499936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02175","last_updated":"2026-05-13T06:57:11Z","snapshot_observed_at":"2026-07-31T17:42:41.975872Z","submitted_at":"2026-03-02T18:46:28Z","title":"Kiwi-Edit: Versatile Video Editing via Instruction and Reference Guidance","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.02175","snapshot_observed_at":"2026-08-08T12:16:44.733443Z","title":"Kiwi-edit: Versatile video edit- ing via instruction and reference guidance.arXiv preprint arXiv:2603.02175, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.733443Z"},"links":{"cited_paper":"/paper/2603.02175","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d81fdab5205f26b0a0c0161e7db7bb8d116b1918d52f4f4ffdb09acafa2dcb28","observation_id":"2f7209ca-05aa-4b22-9e51-cabd231c8770","resolution":{"observed_at":"2026-08-08T12:16:44.733443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.375342Z","title":"Phantom: Subject-consistent video generation via cross- modal alignment","venue":null,"work_id":"43997fe6-54e4-4527-8e48-cbdc252cdb87","year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.737319Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:db924311ae812cc31855bacd93624146f6963bc6d45912b2a8d6a49701b4ae2a","observation_id":"b47b7651-7284-4269-8034-92ff3ff37c63","resolution":{"observed_at":"2026-08-08T12:16:46.426385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.363144Z","title":"Evalcrafter: Benchmarking and eval- uating large video generation models","venue":null,"work_id":"a4416ce1-15c2-4c3a-915e-689b343b5340","year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.741315Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:5daa37e2e0ae0701b47d3818824adf2737b0de4a6f29620375dfd43392f70952","observation_id":"10ae334f-c9e3-4892-b089-7d9ae2f2c664","resolution":{"observed_at":"2026-08-08T12:16:46.366902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-08-08T12:16:44.745272Z","title":"Step-video-t2v technical re- port: The practice, challenges, and future of video founda- tion model.arXiv preprint arXiv:2502.10248, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.745272Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:7cfd71b3f956e9a842458deaf740e07d98888718b3b7d77f5f486d2cee68faf5","observation_id":"c5e2e806-9400-428a-bcce-a2533d70337c","resolution":{"observed_at":"2026-08-08T12:16:44.745272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05363","last_updated":"2024-10-07T17:56:04Z","snapshot_observed_at":"2026-08-08T09:48:34.424815Z","submitted_at":"2024-10-07T17:56:04Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05363","snapshot_observed_at":"2026-08-08T12:16:44.749653Z","title":"Towards world simulator: Crafting physical commonsense-based benchmark for video generation.arXiv preprint arXiv:2410.05363, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.749653Z"},"links":{"cited_paper":"/paper/2410.05363","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d5f6d1323bbfa13cec8a8f9d2681f6af41c9424a48e8c68a653873a91b845df4","observation_id":"3fb93422-dd37-4e82-b381-bc06916b7182","resolution":{"observed_at":"2026-08-08T12:16:44.749653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.353510Z","title":"GPT-5.6 system card, 2026","venue":null,"work_id":"7fa6deb3-49d8-4f69-9266-a5701eb7b0a2","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.754532Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:bfde604dd7dad775d4e24aabaa239cd513f4cb7c2835add4f352884e9a6eb95f","observation_id":"d25e84af-91ad-42f1-8cc4-13490733b054","resolution":{"observed_at":"2026-08-08T12:16:46.357130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.758766Z","title":"Omniweaving: Towards unified video generation with free-form composition and reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.758766Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:274cf44963515d710cfcfe5559200c214e98a74f95f1aab3b75323f2df76685f","observation_id":"f73d2211-82e6-4af8-b94a-fb0044fd4a0d","resolution":{"observed_at":"2026-08-08T12:16:44.758766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.342952Z","title":"Pixabay: Royalty-free images and videos.https: //pixabay.com, 2026","venue":null,"work_id":"1beb6288-51d6-41a3-84d9-95c75f6991ea","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.762524Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:5eb6ac4d9f6b17c5fcb312f412cb495e383a18d4e2a9a6b056e052a91cba5c76","observation_id":"486b556f-6584-47bb-9465-f6a6ae0803dd","resolution":{"observed_at":"2026-08-08T12:16:46.346401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.332976Z","title":"Qwen3.6-27B: Flagship-level coding in a 27B dense model, 2026","venue":null,"work_id":"2de7d494-cc29-4fad-94f5-15ed75937f75","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.766419Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:ffd13991d2ec12090c81a3273132c54c439ed18c23ce310566019fc5501b94c8","observation_id":"0998ea8a-608a-476d-ad98-998d6b46c40a","resolution":{"observed_at":"2026-08-08T12:16:46.336570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-07-06T23:02:00.082783Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-08T12:16:44.769866Z","title":"Seedance 2.0: Advanc- ing video generation for world complexity.arXiv preprint arXiv:2604.14148, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.769866Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d529b4a426765b7fa0b5d6ae76d1b5df396a67385ce4c0d07c9a1dc2ef98da21","observation_id":"1dd5f689-5e55-4392-9b06-d939107545b1","resolution":{"observed_at":"2026-08-08T12:16:44.769866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.775154Z","title":"T2v-compbench: A comprehen- sive benchmark for compositional text-to-video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.775154Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:f0d464be494d3aabe61580c9b34523324434e9c6fce51cf3bcbb4e212448d7a3","observation_id":"f96ff7d6-e314-43bb-b574-0dd980bf18d5","resolution":{"observed_at":"2026-08-08T12:16:44.775154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.779094Z","title":"Video-lmm post-training: A deep dive into video reasoning with large multimodal models.arXiv preprint arXiv:2510.05034, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.779094Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:ea7860a5c2013b7e006849b8640164a604653037b5a036cbc32d13092426ef61","observation_id":"0af05ddf-9c21-4556-930e-279e2c02a8b7","resolution":{"observed_at":"2026-08-08T12:16:44.779094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.782827Z","title":"Lucy edit: Open-weight text-guided video editing, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.782827Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:184ce98287e231b3417300292d2b72e89f678614fd06f4d30dd5e5da7446e272","observation_id":"5f2fc3c5-a8fc-4954-9bcf-3ca3b7a300a7","resolution":{"observed_at":"2026-08-08T12:16:44.782827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.309564Z","title":"Gemma 4 technical report, 2026","venue":null,"work_id":"939c1e96-47b4-4415-8767-52ad5b2a3fc4","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.787491Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:0389deca11539b89fc6cdd1149a084ab05ed658081defcc1963c7bb9c6b8229e","observation_id":"988ad96b-8dc7-4ad5-bb9f-eb9e756f05aa","resolution":{"observed_at":"2026-08-08T12:16:46.313523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.792627Z","title":"Longcat-video techni- cal report.arXiv preprint arXiv:2510.22200, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.792627Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:e78f38230f8bab1bd4e5bf2f5ab927711d82173cf1b4aa5e9bd3b728d14b6bd5","observation_id":"e376cdd5-80f4-4f42-b5a2-3af01ed69e99","resolution":{"observed_at":"2026-08-08T12:16:44.792627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-08T12:16:44.796295Z","title":"Wan: Open and advanced large-scale video gen- erative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.796295Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:c9844ff908f4261823d05cd8428500d3be7fa65f4ff2b9277a5db230a5da0819","observation_id":"0c949280-2d1b-42e5-a590-6522acdff149","resolution":{"observed_at":"2026-08-08T12:16:44.796295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25743","last_updated":"2026-06-29T08:23:47Z","snapshot_observed_at":"2026-08-08T15:15:46.111735Z","submitted_at":"2026-03-26T17:59:57Z","title":"RefAlign: Representation Alignment for Reference-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.25743","snapshot_observed_at":"2026-08-08T12:16:44.799989Z","title":"Refalign: Repre- sentation alignment for reference-to-video generation.arXiv preprint arXiv:2603.25743, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.799989Z"},"links":{"cited_paper":"/paper/2603.25743","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:39934b0873e516cbd23a60fd63664aaaa6ad13900cc1796cf2a84d96d5812488","observation_id":"19c4003a-59d5-4d7f-a706-68799627988f","resolution":{"observed_at":"2026-08-08T12:16:44.799989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.276933Z","title":"Groupdancer: Music to multi-people dance synthesis with style collaboration","venue":null,"work_id":"02452284-4701-40f8-a80b-023d8e494a65","year":2022},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.804549Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:9053cb1f31fd78ee87a55fd164920b211c5b0932f5bfb39806d09c87c7afd0ac","observation_id":"3694f8df-fdb4-46ff-a867-f495cb517607","resolution":{"observed_at":"2026-08-08T12:16:46.303102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.200518Z","title":"Dance- camera3d: 3d camera movement synthesis with music and dance","venue":null,"work_id":"16525c92-5df8-4b87-84fb-cccfc519324d","year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.809570Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:e5e8e564699477bfdc7f3191f6d3fb076c735e2dcfcd14f58e26897694f6dc3b","observation_id":"e762aba0-8b1b-4526-90fb-0d3594ab4aeb","resolution":{"observed_at":"2026-08-08T12:16:46.242406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.182359Z","title":"Dancecamanimator: Keyframe- based controllable 3d dance camera synthesis","venue":null,"work_id":"5c8cbf6b-84fe-43d9-be05-3358b28b7d68","year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.813364Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:03d97b763bfb6d6d005ee7c8fbad4949e539773639f337b25855d820127c9797","observation_id":"49b431a5-866a-4b0d-99ae-7752132052c1","resolution":{"observed_at":"2026-08-08T12:16:46.186876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08377","last_updated":"2026-07-03T16:46:11Z","snapshot_observed_at":"2026-08-07T16:29:46.498912Z","submitted_at":"2025-10-09T16:01:30Z","title":"UniVideo: Unified Understanding, Generation, and Editing for Videos","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.08377","snapshot_observed_at":"2026-08-08T12:16:44.816528Z","title":"Univideo: Unified understanding, generation, and editing for videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.816528Z"},"links":{"cited_paper":"/paper/2510.08377","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:10c100da97c7252ee688771d31de42a4407a83032dc5be9ed3a62dbc8fa23eb9","observation_id":"792a3c7b-e677-477f-9104-59b7fa1676d2","resolution":{"observed_at":"2026-08-08T12:16:44.816528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.171272Z","title":"Univbench: Towards unified evaluation for video founda- tion models","venue":null,"work_id":"01f0b189-a184-4a9c-b983-86c3cd81c809","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.820695Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:b1cdea1cdb897baa68a89b4c60df3267ae6b2727883093c3a4aa586e89da76ee","observation_id":"9463e00b-0cf8-494f-bee7-4243e3ab15c9","resolution":{"observed_at":"2026-08-08T12:16:46.175808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.18870","last_updated":"2025-11-25T02:52:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-24T08:22:07Z","title":"HunyuanVideo 1.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.18870","snapshot_observed_at":"2026-08-08T12:16:44.824877Z","title":"Hunyuanvideo 1.5 technical report.arXiv preprint arXiv:2511.18870, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.824877Z"},"links":{"cited_paper":"/paper/2511.18870","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d06915938f00dcb07bfbd36acb8ca1423e4413b2d80d54fff67a7d2672f2dcbf","observation_id":"ae876613-a5fb-4be2-95e1-d298d7938f53","resolution":{"observed_at":"2026-08-08T12:16:44.824877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.829047Z","title":"Omni-video 2: Scaling mllm-conditioned diffu- sion for unified video generation and editing.arXiv preprint arXiv:2602.08820, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.829047Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:3cc2603c7c79d5805dc53d48bb8dc6eb14cf4dfa5a8f65d909eebc41f040a3d3","observation_id":"8b7ae10a-f4e6-4c8e-83bc-a631262920c7","resolution":{"observed_at":"2026-08-08T12:16:44.829047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.159390Z","title":"Videocof: Unified video editing with temporal reasoner","venue":null,"work_id":"51a35768-6191-446a-857c-30ae9875891e","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.832844Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:529cb812c522ef782bea0ce2d47fa020f3e66398b8be16c8094d6d93ba18c3f2","observation_id":"fa9d86ea-9eb4-4a23-96f4-fd6ac4cdce2f","resolution":{"observed_at":"2026-08-08T12:16:46.164290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23452","last_updated":"2025-04-27T02:59:54Z","snapshot_observed_at":"2026-08-08T18:55:02.320359Z","submitted_at":"2025-03-30T14:12:21Z","title":"VideoGen-Eval: Agent-based System for Video Generation Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23452","snapshot_observed_at":"2026-08-08T12:16:44.836637Z","title":"Videogen-eval: Agent-based system for video gen- eration evaluation.arXiv preprint arXiv:2503.23452, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.836637Z"},"links":{"cited_paper":"/paper/2503.23452","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:887e0afaec6aadbda26326db894288ef54b86ebdcf234240d6b8b7714db2f712","observation_id":"3a9301c4-5fa8-4e41-9298-06eaa43d9566","resolution":{"observed_at":"2026-08-08T12:16:44.836637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.148642Z","title":"Cogvideox: Text-to- video diffusion models with an expert transformer","venue":null,"work_id":"93d229d9-da53-4092-9beb-77a2b6a6a072","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.840573Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:849cfa89d1a1c64ead277a3c7fccc8e3e687731b69de72c884dd46691fd4966d","observation_id":"a8c9eb7c-d07b-43c3-a7f0-d477175e09cd","resolution":{"observed_at":"2026-08-08T12:16:46.152996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.092196Z","title":"Omnipaint: Mastering object-oriented editing via disentan- gled insertion-removal inpainting","venue":null,"work_id":"a3a7eeff-6626-41d9-ba0e-6dbac05da2ac","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.843619Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:fb8ea4feef47a68ec1d184f08a27e0f96ece9bdd1c2c87306a2b5480a82d2a02","observation_id":"a7092899-5802-4143-b91c-62e52039faa0","resolution":{"observed_at":"2026-08-08T12:16:46.128662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18748","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-08-02T06:15:05.492636Z","submitted_at":"2026-05-18T17:59:03Z","title":"Aurora: Unified Video Editing with a Tool-Using Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18748","snapshot_observed_at":"2026-08-08T12:16:44.847796Z","title":"Aurora: Uni- fied video editing with a tool-using agent.arXiv preprint arXiv:2605.18748, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.847796Z"},"links":{"cited_paper":"/paper/2605.18748","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:166537113ce80dff02b308919f2252d8eb00275ef5e775be06e1f475c9c12dc5","observation_id":"f22534fe-6380-4805-b755-3b9be06cde03","resolution":{"observed_at":"2026-08-08T12:16:44.847796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:45.996237Z","title":"Opens2v- nexus: A detailed benchmark and million-scale dataset for subject-to-video generation.Advances in Neural Informa- tion Processing Systems, 38, 2026","venue":null,"work_id":"63409cb2-7cbd-4daa-88cc-2416634f148d","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.853334Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:3b320100f30c480207fab4bfd32356289423d3c341516d26eba94da838ccb1ff","observation_id":"a4ef4198-f17b-40b9-a39c-7af7b245fde7","resolution":{"observed_at":"2026-08-08T12:16:46.026618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:45.985234Z","title":"Use of artificial intelligence to de- tect dental caries on intraoral photos.Quintessence interna- tional, 2025","venue":null,"work_id":"a293c67c-f385-41ea-98b2-090fd2aab91f","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.857239Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:4b98a08f6fd42d5abac7dfa7ad289a25ffd47fd38a994570b92044779ea6e2d4","observation_id":"a6a5aa84-4ea7-430f-ba5c-0283c0028f8e","resolution":{"observed_at":"2026-08-08T12:16:45.989401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:45.972310Z","title":"Automated detection and quanti- tative assessment of dental plaque in intraoral images.ACM Transactions on Computing for Healthcare, 7(2):1–12, 2026","venue":null,"work_id":"6fc6b167-e091-4a14-a814-a9785af56119","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.860993Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:2c88d98ca9ea3b9b97c3d00c9691ef0466751dc093ecbc9424bff89862483137","observation_id":"26dd898b-4b68-4d42-837f-5149f34dcc38","resolution":{"observed_at":"2026-08-08T12:16:45.976698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:45.943454Z","title":"Mira: Multimodal iterative reasoning agent for image editing","venue":null,"work_id":"d7166d56-a887-496f-8a6b-f8af31e80530","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.864845Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:48e992fcbe4edd614659c863a00abc91910f12395d65adf4678535dd8038e1b9","observation_id":"22fd2e73-2e62-4e88-814e-219399de2f11","resolution":{"observed_at":"2026-08-08T12:16:45.963337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18652","last_updated":"2026-05-18T16:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-18T16:57:36Z","title":"MementoGUI: Learning Agentic Multimodal Memory Control for Long-Horizon GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18652","snapshot_observed_at":"2026-08-08T12:16:44.868821Z","title":"Mementogui: Learning agentic mul- timodal memory control for long-horizon gui agents.arXiv preprint arXiv:2605.18652, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.868821Z"},"links":{"cited_paper":"/paper/2605.18652","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:1d477c7f10e32fd5debd22fbeb8d2c7420d5d1453f580e8fe0ba4343eb8cbf3c","observation_id":"45aceae2-729c-4b06-b1cf-a577e7d74e09","resolution":{"observed_at":"2026-08-08T12:16:44.868821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.872691Z","title":"Region-constraint in-context generation for instructional video editing.arXiv preprint arXiv:2512.17650, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.872691Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:30b223f592991961d2f07ab7ca1bdd4dd432be479cebfaed3d906034e298ddd8","observation_id":"33d1cbd9-cd31-4817-8aab-f6043f5a42dc","resolution":{"observed_at":"2026-08-08T12:16:44.872691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.876390Z","title":"Kaleido: Open-sourced multi-subject reference video generation model.arXiv preprint arXiv:2510.18573, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.876390Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:142b86d1b41a2689881a60598e084325fe9581a5f726b461568fcba6d9a09551","observation_id":"6ac7bfcb-f5eb-4f7b-abaf-1f3af08da5be","resolution":{"observed_at":"2026-08-08T12:16:44.876390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-08-08T12:16:44.879850Z","title":"Vbench-2.0: Advancing video generation benchmark suite for intrinsic faithfulness.arXiv preprint arXiv:2503.21755, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.879850Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:6a21cccd0d942c2e785005ce7412cc8cbcd4099104fead29f5d9993d0fda4dd8","observation_id":"41bbc627-9bb7-4905-9a59-c7c66726b61a","resolution":{"observed_at":"2026-08-08T12:16:44.879850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T23:15:12.957146Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2608.05485."}