{"as_of":"2026-08-11T22:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:147bd14641b0088db1ae50613e5aa36e54a6f5fc7e08bc3e7bf80d2b591e017c","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:08:54.361117Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.02706/citation-record","integrity":"/paper/2501.02706/integrity","json":"/paper/2501.02706/citation-record.json","paper":"/paper/2501.02706"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.908472Z","title":"Image quality assessment in the modern age,","venue":null,"work_id":"d802c20f-f713-48aa-b46d-c897c661652f","year":2021},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.198740Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:67a0b5de56dd66769aedcbb09fabb2aa06cefce66ecb011531ec36ab44c0d4db","observation_id":"a9f6610c-17e0-479b-bded-e395233f1dc1","resolution":{"observed_at":"2026-08-10T22:08:54.912125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.896900Z","title":"Study of subjective and objective quality assessment of audio-visual signals,","venue":null,"work_id":"26a5cb6c-04a7-4f58-a30f-be8023c177a0","year":2020},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.202996Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:48d0067935ec303f1fef3f6fce3e6d9199cf9e4a6511c353475d447b2acbc049","observation_id":"85c70d1d-5caa-4377-ba0d-6c78486d97f2","resolution":{"observed_at":"2026-08-10T22:08:54.900895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.885094Z","title":"A completely blind video integrity oracle,","venue":null,"work_id":"76521c61-c67f-4192-9306-f163b36c6245","year":2015},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.206577Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:031c9446680f200a5fea91a0a177648010c6a2550f174f590e9f9660f79a03fe","observation_id":"4b492d20-8c7b-44b0-865a-f4aeb001777d","resolution":{"observed_at":"2026-08-10T22:08:54.889003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.873894Z","title":"Blind prediction of natural video quality,","venue":null,"work_id":"13497a9b-7dca-4adc-af96-39c7a720b63e","year":2014},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.210990Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:382517fadb10884b81843ef8c0cf02fedb32c3253b2df415370c7c06d0e0324b","observation_id":"bc5c3f7d-ecfd-4731-a4d8-58a635188f8f","resolution":{"observed_at":"2026-08-10T22:08:54.877594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.862160Z","title":"Shortform ugc video quality assessment based on multi-level video fusion with rank-aware,","venue":null,"work_id":"8bacae80-d220-407e-bf59-729706eaac47","year":2024},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.215291Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:c884b8a9c7b397c68dd54d1e529d68b4e0a80f941e3b0885a0585976b04a2981","observation_id":"72de9d77-5b5c-490e-b8f7-ee3547df1b4d","resolution":{"observed_at":"2026-08-10T22:08:54.866960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.849708Z","title":"Spatiotemporal statistics for video quality assessment,","venue":null,"work_id":"24c4092c-40bf-4aa8-85f4-1801779bc43b","year":2016},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.219918Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:1f5c32cad5d49a49b9993a06485d848dec499d0577d6a6edca35b299fa23aa2a","observation_id":"43df110d-5b02-43a4-bb5a-0ad5b6cfd70c","resolution":{"observed_at":"2026-08-10T22:08:54.854280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.837593Z","title":"An optical flow-based no-reference video quality assessment algorithm,","venue":null,"work_id":"27ce3321-5019-418e-8cae-08c2c20f2b47","year":2016},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.223922Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:a22edb0c5062a041726ad51b1d06c38e130559c34a854a64280bf698400538b1","observation_id":"d02acb8f-75ab-44c8-a81b-80fa312bc393","resolution":{"observed_at":"2026-08-10T22:08:54.842694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.229878Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.229878Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:aacce3b5f14f863e5ab2b9e321f0ae80c10d6f2fe16358b9dca077fb79a7dad1","observation_id":"962f4d09-fe6e-4456-ab05-eb1717a50024","resolution":{"observed_at":"2026-08-10T22:08:54.229878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.232990Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.232990Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:68560bc47b85da733e92562402dd9c609d604f009c6270eb6c9d68fd082aacfb","observation_id":"531ddb8e-88a7-4a1b-b037-cfbab4ace488","resolution":{"observed_at":"2026-08-10T22:08:54.232990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.236249Z","title":"Video swin transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.236249Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:b1cab0a3c93a66601545ea40353e3bdd58350a5baa771b51cb05c74b5de63c32","observation_id":"8582cc8c-c37d-4329-97dd-f88590da405d","resolution":{"observed_at":"2026-08-10T22:08:54.236249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.805736Z","title":"No-reference video quality assessment via feature learning,","venue":null,"work_id":"1be47e1e-30e3-44c1-b7de-8c624f85811e","year":2014},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.239467Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:9a61145ae995e75749c545e22b845b2f285d6381979f0f8bf6c6d1e74a780784","observation_id":"9cb16702-7675-4362-a911-d74ca85ded5e","resolution":{"observed_at":"2026-08-10T22:08:54.810443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.794177Z","title":"Deep blind video quality assessment based on temporal human perception,","venue":null,"work_id":"db063cd9-8500-4c91-ad31-26a9c1265765","year":2018},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.243152Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:7d709efa53b23456274ccaebee199b45c16a2cc43ce1c8c4ca018e4364528d07","observation_id":"4cc96a3a-1d66-4b4f-b75e-996385e960a8","resolution":{"observed_at":"2026-08-10T22:08:54.798565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.783445Z","title":"Rirnet: Recurrent-in-recurrent network for video quality assessment,","venue":null,"work_id":"417fc2d1-fe3e-4c95-b9fc-cc87ddfcb27d","year":2020},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.246338Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:e637b12cca90afa15e784b9cc4a43341ba49e753f1d293f953291a42ef9e698d","observation_id":"7a150180-6716-4413-9fe3-97b5612daaaa","resolution":{"observed_at":"2026-08-10T22:08:54.787404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.771828Z","title":"A deep learning based no- reference quality assessment model for ugc videos,","venue":null,"work_id":"4f5f6afc-0c26-4e98-ae5a-70dbac8b54f0","year":2022},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.249952Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:627964b8470312cd07c7747f64bfbae191be0315efb3214bffc4fe45c81af5ea","observation_id":"5020a9fc-265e-4cfc-9825-9638a0c24b6e","resolution":{"observed_at":"2026-08-10T22:08:54.776002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.760672Z","title":"Zoom-vqa: Patches, frames and clips integration for video quality assessment,","venue":null,"work_id":"7ea92670-9eeb-4649-9416-3ebd4b78b320","year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.253914Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:c7615a807f966858259712b37d875bb3b8e2aeaf3b0d36417ada0fb97eb817d7","observation_id":"7ae08b92-42c5-49de-9fdb-23d8112198b0","resolution":{"observed_at":"2026-08-10T22:08:54.765049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.257518Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.257518Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:b2d6f4e5b716a6850643c8a64b440127a24347f1724aadd7783071ab1ca20eb9","observation_id":"63956685-e722-495f-8249-cba645b37725","resolution":{"observed_at":"2026-08-10T22:08:54.257518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.261611Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.261611Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:9508dce304685b9438e17c497945384dbf75526430d977d702ca54e03fdf771c","observation_id":"4b465d66-14a1-46b8-824d-26bead1d157d","resolution":{"observed_at":"2026-08-10T22:08:54.261611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.732886Z","title":"Ntire 2024 quality assessment of ai-generated content challenge,","venue":null,"work_id":"92489f36-070e-4b0c-87bc-f387dfca757e","year":2024},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.269365Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:405bfec9e13799858ed190ffd2cbabc4e11be7a28f5dca434b4e900893c05b66","observation_id":"7076f63b-08aa-4531-8aba-6dfb82ba00ab","resolution":{"observed_at":"2026-08-10T22:08:54.736937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11956","last_updated":"2024-08-07T17:02:00Z","snapshot_observed_at":"2026-07-06T17:46:25.142387Z","submitted_at":"2024-03-18T16:52:49Z","title":"Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11956","snapshot_observed_at":"2026-08-10T22:08:54.273396Z","title":"Subjective-aligned dataset and metric for text-to-video quality assessment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.273396Z"},"links":{"cited_paper":"/paper/2403.11956","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:3bd35fc142b85292dc3b5a1c51ba9c27b4c40239e8f32bdceb9a8c1da96f2808","observation_id":"0dffa7d4-cee1-458b-901f-bd1426b89b8f","resolution":{"observed_at":"2026-08-10T22:08:54.273396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13439","last_updated":"2023-03-23T17:01:59Z","snapshot_observed_at":"2026-08-09T04:35:25.283269Z","submitted_at":"2023-03-23T17:01:59Z","title":"Text2Video-Zero: Text-to-Image Diffusion Models are Zero-Shot Video Generators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13439","snapshot_observed_at":"2026-08-10T22:08:54.277611Z","title":"Text2video-zero: Text-to-image dif- fusion models are zero-shot video generators,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.277611Z"},"links":{"cited_paper":"/paper/2303.13439","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:efee8efaacdbf476dcc9a2702c557f0dd621c1e39cc3ea90c054a06d23ae7b73","observation_id":"6ffc738d-3afc-4965-b736-daf07fbe5a6f","resolution":{"observed_at":"2026-08-10T22:08:54.277611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-10T22:08:54.282734Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.282734Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:3f7ea17d40c6bfcba7197c8d3857ae0c764ac3fb2ab5c2d26c1860ea284d399f","observation_id":"55f449f2-1835-48c4-b49a-6cd94495e8b7","resolution":{"observed_at":"2026-08-10T22:08:54.282734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-08-10T22:08:54.286698Z","title":"Videofusion: Decomposed diffusion models for high-quality video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.286698Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:de9b96b99b47fc774195428f157b03d54edf87122043927c5d29d5165d5b2524","observation_id":"9e43cdae-2324-4f17-888c-2cf8d618468e","resolution":{"observed_at":"2026-08-10T22:08:54.286698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-10T01:52:30.999213Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-10T22:08:54.291366Z","title":"Modelscope text-to-video technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.291366Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:da6eb2d2b4f0d4cfffda0beaf362ce428efebde584e2b9043b1014eb55d2f263","observation_id":"c3ce35dc-cd98-40e7-93ff-ce18f0949386","resolution":{"observed_at":"2026-08-10T22:08:54.291366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.721648Z","title":"Latent video diffusion models for high-fidelity long video generation,","venue":null,"work_id":"aafe806e-2cf7-4564-9c92-8028087e543a","year":2022},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.295086Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:77f1b032291b9a9a27882ac9feb196961c978504f80fbc87a0f4cca1035aa742","observation_id":"9e68c11c-84ea-4e4e-8c40-7261e07af676","resolution":{"observed_at":"2026-08-10T22:08:54.725713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15818","last_updated":"2025-05-30T03:55:20Z","snapshot_observed_at":"2026-08-05T00:59:34.191472Z","submitted_at":"2023-09-27T17:44:18Z","title":"Show-1: Marrying Pixel and Latent Diffusion Models for Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15818","snapshot_observed_at":"2026-08-10T22:08:54.299570Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.299570Z"},"links":{"cited_paper":"/paper/2309.15818","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:b91bfd940bf3ad08d458ca062906fa2a3fd36a304e6076a0f698d27c1b3e8496","observation_id":"a270f01b-d46c-4bac-9c24-7a0b2e1a68b2","resolution":{"observed_at":"2026-08-10T22:08:54.299570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.304308Z","title":"Large-scale study of perceptual video quality,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.304308Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:53f769c81f885bfae8c19ad457fd02c380244d801daccdb98329b06fbf4eb49f","observation_id":"7f5c8f57-9ede-483c-a52c-ef73457bc7c0","resolution":{"observed_at":"2026-08-10T22:08:54.304308Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.308456Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.308456Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:8dbc5532e61ae4e169d1057ae8c80efa38ef665a98c9d26308e39ee4da4c71da","observation_id":"25df0c9e-d473-489f-8e15-1902a6fb8188","resolution":{"observed_at":"2026-08-10T22:08:54.308456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.316994Z","title":"Imagereward: Learning and evaluating human preferences for text-to- image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.316994Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:df10021a26e6be50aec0e448c09aff4e0e123eae0f004e95143b4ea07c5284a1","observation_id":"d95d4986-97d4-40ef-b19e-b3656bd5fd82","resolution":{"observed_at":"2026-08-10T22:08:54.316994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-10T22:08:54.320861Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.320861Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:50b9f13213e7c7a5182c4c5ed6be44438c6d766f5cf10069b854c861e722a78d","observation_id":"a9fe933a-7450-4abe-84e2-758c87633611","resolution":{"observed_at":"2026-08-10T22:08:54.320861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01813","last_updated":"2023-12-26T05:27:46Z","snapshot_observed_at":"2026-08-10T16:47:09.837714Z","submitted_at":"2023-11-03T09:46:05Z","title":"FETV: A Benchmark for Fine-Grained Evaluation of Open-Domain Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01813","snapshot_observed_at":"2026-08-10T22:08:54.325695Z","title":"Fetv: A benchmark for fine-grained evaluation of open-domain text-to-video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.325695Z"},"links":{"cited_paper":"/paper/2311.01813","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:5486da74658be0ac4c6096cab6d04d835b9de791107fe4d6fbf4d51ad1eb6b22","observation_id":"b7adbdf0-ff70-41f1-a43f-21b2277e72b5","resolution":{"observed_at":"2026-08-10T22:08:54.325695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.329638Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.329638Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:8da05637c559826987e29d99a63a41292559c8c99c651a8113883776bdb302e4","observation_id":"497994ec-7962-41e9-9a14-3b8671d6c355","resolution":{"observed_at":"2026-08-10T22:08:54.329638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.333660Z","title":"Making a “completely blind","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.333660Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:4704484b717b82f13bf6311d665b5f4d5ca79ab4ee2115fbdf8640360836d464","observation_id":"5675045f-3df4-46fe-8175-04f9bb794afb","resolution":{"observed_at":"2026-08-10T22:08:54.333660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.686589Z","title":"Faver: Blind quality prediction of variable frame rate videos,","venue":null,"work_id":"2de9b53d-2b51-46e6-8b79-4b6f13780828","year":2024},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.337497Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:e62dfd39cf5ae9eb822d022a66ca77e7fec4ab4893d60d3347fe8a61208c54e4","observation_id":"3b178912-f47d-478a-90af-3bccbd5de7a8","resolution":{"observed_at":"2026-08-10T22:08:54.690856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.675302Z","title":"Exploring clip for assessing the look and feel of images,","venue":null,"work_id":"77491527-1586-4103-86fe-6af92edba574","year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.341536Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:325f660c5542d6b40c0070a31fb80eb842be87777af13a9b25171d999a9b7944","observation_id":"c17c5883-93bf-4b57-acce-e7efa3cbc35f","resolution":{"observed_at":"2026-08-10T22:08:54.679726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.344958Z","title":"Blindly assess quality of in-the-wild videos via quality-aware pre-training and motion perception,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.344958Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:6616b978f3fce85bb324ed08d1c12a43f995e542bab44b7a73103bf19b05c7ff","observation_id":"0b81aee4-feb7-48f2-a0f7-2848ba446f7c","resolution":{"observed_at":"2026-08-10T22:08:54.344958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.348645Z","title":"Fast-vqa: Efficient end-to-end video quality assessment with fragment sampling,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.348645Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:4565b738794c0b8b0b5bb0f41e4f3ae0f7ca7bde5631f10d56d317a53f0e8a0b","observation_id":"af7be65a-adf6-486b-af46-b06f7745ba8f","resolution":{"observed_at":"2026-08-10T22:08:54.348645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:08:54.648366Z","title":"Neighbourhood representative sampling for efficient end-to- end video quality assessment,","venue":null,"work_id":"3efbaf86-9914-4c8a-b240-3a277fc8c4d9","year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.353252Z"},"links":{"citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:8e79469949ce3bb3fb4fd3cb4f1bb0f0c732d2f87983db389dd009f4055abc19","observation_id":"2ac35e91-7d2d-4c7b-8da1-c95f2245e921","resolution":{"observed_at":"2026-08-10T22:08:54.652553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13269","last_updated":"2023-02-26T08:46:07Z","snapshot_observed_at":"2026-07-06T14:55:53.398088Z","submitted_at":"2023-02-26T08:46:07Z","title":"Exploring Opinion-unaware Video Quality Assessment with Semantic Affinity Criterion","version":1},"cited_work":{"arxiv_id":"2302.13269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.13269","snapshot_observed_at":"2026-08-10T22:08:54.404424Z","title":"Exploring Opinion-unaware Video Quality Assessment with Semantic Affinity Criterion","venue":"cs.CV","work_id":"ca5f25ba-4d65-4895-bb62-c9623a0c5805","year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.356713Z"},"links":{"cited_paper":"/paper/2302.13269","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:46d8be0ba08f568cd4f3f3c322a05556d0585336684855a04c2038de4ee9d476","observation_id":"a41ed59e-35f5-4ab7-9c4f-c3ad730c7266","resolution":{"observed_at":"2026-08-10T22:08:54.411128Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17090","last_updated":"2023-12-28T16:10:25Z","snapshot_observed_at":"2026-08-02T07:14:02.308302Z","submitted_at":"2023-12-28T16:10:25Z","title":"Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17090","snapshot_observed_at":"2026-08-10T22:08:54.361117Z","title":"Q-align: Teaching lmms for visual scoring via discrete text-defined levels,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.361117Z"},"links":{"cited_paper":"/paper/2312.17090","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:fff3a5dc8dcb1dda65619dc97378074eac088505071fb22dd174a1d8a71be9ad","observation_id":"9e6499df-dd75-46c3-b53a-756ab497c0b6","resolution":{"observed_at":"2026-08-10T22:08:54.361117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-10T22:08:54.265025Z","title":"Available: https://arxiv.org/abs/2103.00020","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.265025Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:676e1262dce2128c661bc68f6363fd6a72d025270b169c3e297da05c0a8a0b4f","observation_id":"fb1cf802-32d1-48d2-b2d1-95f17faa8ac7","resolution":{"observed_at":"2026-08-10T22:08:54.265025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-09T08:39:37.884261Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-10T22:08:54.312338Z","title":"Available: https://arxiv.org/abs/2201.12086","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:54.312338Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2501.02706"},"observation_digest":"sha256:a22c12cc665008e16a41d42689a3a1060dadc4db9dc72c59e88cc02131683bc0","observation_id":"4bfdaa4b-4bbd-4caf-9e20-00cb41d9d5b8","resolution":{"observed_at":"2026-08-10T22:08:54.312338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.02706","last_updated":"2025-01-06T01:18:11Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T22:04:51.641295Z","submitted_at":"2025-01-06T01:18:11Z","title":"Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2501.02706."}