{"as_of":"2026-08-07T23:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c01925ec366e50cdd099936b404eff56922984bfad1378f06ddac3a78c276c0","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:09:50.876311Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16314/citation-record","integrity":"/paper/2505.16314/integrity","json":"/paper/2505.16314/citation-record.json","paper":"/paper/2505.16314"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T15:09:42.013137Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.013137Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:63d03a3c66100f03f303da75aadc38e44cb2c98bb7e1448d622d88af7ac92662","observation_id":"e929890f-7c22-408b-8827-cda41a539c40","resolution":{"observed_at":"2026-08-07T15:09:42.013137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:59.143895Z","title":"Xgboost: A scalable tree boosting system","venue":null,"work_id":"5578a232-2320-4a95-8038-d197330be672","year":2016},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.074455Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:885c29b31b6143463210bd68d51b6d113cad4098c027972f5337f683f3568efa","observation_id":"9e05d5ea-f606-4b73-92b9-2ca9dd39794b","resolution":{"observed_at":"2026-08-07T15:09:59.199280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.06679","last_updated":"2022-11-21T15:39:52Z","snapshot_observed_at":"2026-07-06T14:17:30.922581Z","submitted_at":"2022-11-12T14:48:55Z","title":"AltCLIP: Altering the Language Encoder in CLIP for Extended Language Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.06679","snapshot_observed_at":"2026-08-07T15:09:42.198262Z","title":"Altclip: Altering the lan- guage encoder in clip for extended language capabilities","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.198262Z"},"links":{"cited_paper":"/paper/2211.06679","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:861015047edbde990d8436eb4f55c5acb3dd1f057dff8ae12646aa0e5dd9dcd2","observation_id":"a940a387-5253-45c4-9e9b-4b49d87856c3","resolution":{"observed_at":"2026-08-07T15:09:42.198262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:59.025857Z","title":"Teacher-guided learning for blind image quality assessment","venue":null,"work_id":"937f7614-edb6-47f7-9bd8-e07075484ce2","year":2022},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.268599Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:07deb798ed550100c58cb4b96893f5437908a9805a7e4fe899e9a2222c417b36","observation_id":"fd697631-9e78-465c-bab7-f0c29442016f","resolution":{"observed_at":"2026-08-07T15:09:59.080409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10161","last_updated":"2024-11-15T13:07:22Z","snapshot_observed_at":"2026-07-06T19:50:56.818819Z","submitted_at":"2024-11-15T13:07:22Z","title":"SEAGULL: No-reference Image Quality Assessment for Regions of Interest via Vision-Language Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10161","snapshot_observed_at":"2026-08-07T15:09:42.405928Z","title":"Seagull: No-reference image quality assess- ment for regions of interest via vision-language instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.405928Z"},"links":{"cited_paper":"/paper/2411.10161","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:596beab4a25dd3c86b20e11b070f7e44a33424574996f58d5b01e9458fbc4b5d","observation_id":"4a662c05-09dd-41e8-b956-9eef91aacce1","resolution":{"observed_at":"2026-08-07T15:09:42.405928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T15:09:42.460938Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test- time scaling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.460938Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:2db1a210c2eaf280376867f9667d7c1bc8aea4a2b95e217b2125ba924adff8c4","observation_id":"a075c7a6-6f15-4551-b397-40d6859966ba","resolution":{"observed_at":"2026-08-07T15:09:42.460938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:58.871699Z","title":"NTIRE 2025 challenge on image super-resolution (×4): Methods and results","venue":null,"work_id":"40134307-4e06-432f-ac4a-2c1659ef6c1d","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.527816Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:6b9e24fd7bd56b6b9f4465c2c8ccf846af6b81895cc9c9ae14ab83fe26ecd5cd","observation_id":"78e5e8a8-d527-461b-af00-4d9105298f9f","resolution":{"observed_at":"2026-08-07T15:09:58.940972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:58.757518Z","title":"Promptiqa: Boosting the performance and generalization for no-reference image quality assessment via prompts","venue":null,"work_id":"f5d25790-a215-47d7-bb5e-9ef9ca67c62b","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.677012Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:990a1e2b32bbe66bf3e644cab2345a417c5f1ed55376bc7315b76877b8238935","observation_id":"8d8fdd6c-2844-42a4-9e12-0a77db1b6d6e","resolution":{"observed_at":"2026-08-07T15:09:58.798336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:58.607477Z","title":"NTIRE 2025 challenge on real-world face restoration: Methods and results","venue":null,"work_id":"f7c9e132-f932-4834-85a1-316617b0d4ee","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.819120Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:3ba2e09893603edd267d925d91f76a17555112e1c194c817d895a2d7852d879d","observation_id":"ed58c9d2-a31f-4af8-9bdd-797bc4e6b8a5","resolution":{"observed_at":"2026-08-07T15:09:58.677195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:58.480178Z","title":"NTIRE 2025 challenge on raw image restoration and super-resolution","venue":null,"work_id":"7b1528b1-4bb8-4c78-9fbc-3bd544e79385","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.888818Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:cebbc3b1955316eaba7992675ee8a882aefbbce8475c52f7e92656eb209fb521","observation_id":"a19b45a1-6df7-4907-81b0-07c84fa0b8ad","resolution":{"observed_at":"2026-08-07T15:09:58.543603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:58.325111Z","title":"Raw image reconstruc- tion from RGB on smartphones","venue":null,"work_id":"0657f397-a6e5-4809-b113-0b41267743c4","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:42.987664Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:5f02dbe6534531b12ea824826a94f7bbf1b48745dc353d88eddb96627532f557","observation_id":"e138687e-2807-446c-910d-fc62872b2b1b","resolution":{"observed_at":"2026-08-07T15:09:58.414465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:58.200995Z","title":"NTIRE 2025 challenge on night photography rendering","venue":null,"work_id":"9a113979-691d-487f-a659-9aa6da6d5daa","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:43.045558Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:3b035c05cf80136ecd2f9961ca3178d4c4e77a827eb1dc0d92acd1909fdad9d4","observation_id":"06553da2-39b5-4417-b0dc-d2b545978c8c","resolution":{"observed_at":"2026-08-07T15:09:58.262311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.07636","last_updated":"2022-12-05T13:53:51Z","snapshot_observed_at":"2026-07-06T14:18:10.647862Z","submitted_at":"2022-11-14T18:59:52Z","title":"EVA: Exploring the Limits of Masked Visual Representation Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.07636","snapshot_observed_at":"2026-08-07T15:09:43.266466Z","title":"Eva: Exploring the limits of masked visual represen- tation learning at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:43.266466Z"},"links":{"cited_paper":"/paper/2211.07636","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:ce813656a2b0f9c6c5bbe7ebebe549789da4d798ddf15c6193ce97c6c16c5095","observation_id":"ce6e330a-06a9-4c8b-afc1-1e0a5dd192ee","resolution":{"observed_at":"2026-08-07T15:09:43.266466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:58.034065Z","title":"NTIRE 2025 challenge on cross-domain few-shot object detection: Methods and results","venue":null,"work_id":"626b1505-64ee-48c0-8dfd-7d6df0c56226","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:43.411749Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:9978b8182a47aba5a1f20459b08028bf7572465a7673c629a3a7c82218bf77c2","observation_id":"413ae559-0e28-4060-94c6-5c330398e1e2","resolution":{"observed_at":"2026-08-07T15:09:58.119929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:09:43.581023Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:43.581023Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:36b9f386807414cfd2d740fc6661d69754ce3a20bd4ff97b4af798940297e7f2","observation_id":"30006855-dcad-4077-921c-7d7c7014e513","resolution":{"observed_at":"2026-08-07T15:09:43.581023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:57.869902Z","title":"Evalmuse-40k: A reliable and fine-grained benchmark with comprehensive human annotations for text- to-image generation model evaluation, 2024","venue":null,"work_id":"7bc3af40-4694-4147-8f73-20495c17c581","year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:43.677784Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:42142ba2744eb2bf15267f96e1a8e2c7ebd56506484934a0f556aceac7f9d74a","observation_id":"2246a11c-dda8-41f7-90aa-2bbc57c4fa1c","resolution":{"observed_at":"2026-08-07T15:09:57.929801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:57.674597Z","title":"NTIRE 2025 challenge on text to image generation model quality assess- ment","venue":null,"work_id":"1b4eaab8-740a-4794-9e68-8cdea7929e41","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:43.743374Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:c38746bde3eb83fdde184c86616494e743af5c2228861865e73eca78d9bcd771","observation_id":"23edce82-59ba-475a-a903-e1410ecd5350","resolution":{"observed_at":"2026-08-07T15:09:57.772739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-07-06T14:22:24.004857Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-07T15:09:43.897689Z","title":"Latent video diffusion models for high-fidelity video generation with arbitrary lengths","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:43.897689Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:bf54887743b38eacd34c398b162dc511a46033b754f91218db235837a7cd4341","observation_id":"a8ee6e06-a43c-4b47-b737-312b67132778","resolution":{"observed_at":"2026-08-07T15:09:43.897689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:57.493038Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"4ff487b9-7f3a-45c4-8d6c-144c2b4fe357","year":2022},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:44.072340Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:1b2bd0cd78ff0fed2f76af85d5df99597bf1fc765781e1782365c776c8ff8370","observation_id":"ff830603-2229-45c0-b0b0-30770ccab734","resolution":{"observed_at":"2026-08-07T15:09:57.567749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:57.359791Z","title":"Tifa: Accu- rate and interpretable text-to-image faithfulness evaluation with question answering","venue":null,"work_id":"745b1002-77cd-41a0-90fa-df5a51f0d26f","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:44.219607Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:a8a627abccdc695152345fe0fb923890bac057f3ff6866f0246f4359ee00b333","observation_id":"1cc6692b-dd77-4ae6-8125-7db296717b59","resolution":{"observed_at":"2026-08-07T15:09:57.420224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:57.185412Z","title":"NTIRE 2025 challenge on video quality enhancement for video con- ferencing: Datasets, methods and results","venue":null,"work_id":"a41f356e-60a0-47fd-869d-9409c7912222","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:44.404966Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:fe6e47c147b8bd09bf4034257141bf7e02a222d9ba12f9614caef9c236ad23fa","observation_id":"c4c692a6-51e4-41c8-bd76-5dacdbd6df8f","resolution":{"observed_at":"2026-08-07T15:09:57.249495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:57.074349Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"0db81362-1bdc-4b5f-8187-73fd9d05f5cb","year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:44.568726Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:9f2f95c25afc6d2490f509f3c0901baf6ba9f4346ff4d3d196df745c94fe44c0","observation_id":"aa76e1ff-fa81-4447-9425-a7a4abd22870","resolution":{"observed_at":"2026-08-07T15:09:57.138367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:44.850367Z","title":"NTIRE 2025 challenge on efficient burst hdr and restoration: Datasets, methods, and results","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:44.850367Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:9739d1c7fba8bcde37552575eb2a9cec8c18e002e9df3f2a1ed63ee790f46cba","observation_id":"299aeca2-5274-4555-a128-4836304edf1e","resolution":{"observed_at":"2026-08-07T15:09:44.850367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-07-30T19:48:58.731788Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-07T15:09:44.988041Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:44.988041Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:ca02bd25a28c7613869f05f39d4cd269361fb6fb3af013e9583f5f2de45cdb9a","observation_id":"a8ab0b5e-2c44-4626-a456-6b8df16829bd","resolution":{"observed_at":"2026-08-07T15:09:44.988041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T15:09:45.122803Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:45.122803Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:e3a914a1b53cd7f02f150137419e9169e35ac4a10a232e7a2f753757d9581191","observation_id":"da29c1ac-a414-4647-85c9-78986351272d","resolution":{"observed_at":"2026-08-07T15:09:45.122803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:56.945950Z","title":"Agiqa-3k: An open database for ai-generated image quality assessment","venue":null,"work_id":"03ad86ab-5f2f-4db7-a7f0-40c44270be66","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:45.270038Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:5cf0d3606f5c69a02bb8702eef1ae4b5022ce9271e1c9a540a9f439da0fd2720","observation_id":"4d09e96a-16e0-4157-8823-360827be5e9e","resolution":{"observed_at":"2026-08-07T15:09:57.006346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:56.847006Z","title":"Aigiqa-20k: A large database for ai- generated image quality assessment","venue":null,"work_id":"3e8cc58a-3fd8-4776-9426-b697e76e7b13","year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:45.427516Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:755ef6553b3832e83184f89e37389405ceabcc4272892b94691b1f70d60e9880","observation_id":"b941df22-625f-413c-9cdd-493f63786b76","resolution":{"observed_at":"2026-08-07T15:09:56.889493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:56.687383Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"87a18d29-dd22-4aa5-9e9b-c24370371a7c","year":2022},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:45.568435Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:e76874545d070ca1c2292287a132e192736b0d81bea4674dac53f68ebf7cac55","observation_id":"08777ad3-e71e-4624-80a1-f045fec8cb55","resolution":{"observed_at":"2026-08-07T15:09:56.761697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:56.504218Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"dfe906d9-1ac3-4ac2-846f-d76c1f6fd2b0","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:45.696735Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:c5c3f60af360f1590c00137cffc1e4a8388626e6e61a56b8839d6a26de4df5d4","observation_id":"b65be012-890b-4565-a1bb-6cc88ffde44e","resolution":{"observed_at":"2026-08-07T15:09:56.595977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:56.383305Z","title":"NTIRE 2025 challenge on day and night raindrop removal for dual-focused images: Methods and results","venue":null,"work_id":"86d78867-0135-4ed0-8226-479d73141114","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:45.844056Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:3257c1a5bdbd30d84f3aa68a2517feafbf2be5984a8b80c4a05f8394a743c766","observation_id":"284e4e4b-5766-48c0-8554-0d335f5aedfb","resolution":{"observed_at":"2026-08-07T15:09:56.424775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:56.270573Z","title":"NTIRE 2025 challenge on short-form ugc video quality assessment and enhancement: Kwaisr dataset and study","venue":null,"work_id":"feb70210-8237-411e-9ded-72cd463cf8e3","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:45.968683Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:c86eba5901f349985085223c2ba25aa989ccb8d3a2e17db0af8eea80b85d1bdb","observation_id":"278ed33d-dc08-4c3d-ae0b-fd167c7ab5c4","resolution":{"observed_at":"2026-08-07T15:09:56.308953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:56.135181Z","title":"NTIRE 2025 challenge on short-form ugc video quality assessment and enhancement: Methods and results","venue":null,"work_id":"6d0dbc0d-8572-4f75-91d3-7f5a7158eec8","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:46.107215Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:fbafd1f9e7108379ea1541370f8b2a9b5e49b3645cbeca65437522b5f13a46c3","observation_id":"64453233-e32f-4469-9efd-d5762acc1166","resolution":{"observed_at":"2026-08-07T15:09:56.196257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:46.278883Z","title":"NTIRE 2025 the 2nd restore any image model (RAIM) in the wild challenge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:46.278883Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:a9250126358094f02342e90530496b4d923bcad3b2666911023ffe525e8fd253","observation_id":"39fc6385-8b9e-41ad-96c6-2b1085b76825","resolution":{"observed_at":"2026-08-07T15:09:46.278883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:56.004391Z","title":"Rich human feedback for text-to-image generation","venue":null,"work_id":"a6682846-2b21-4ebb-b086-60be4d791dc3","year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:46.345766Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:43d9737f94dec4d6344ca0cba78d8d86f3cb4f7c9a3299accf1e46852f1e0de1","observation_id":"566c90c3-1d30-4b0b-b44c-cbee5062a62d","resolution":{"observed_at":"2026-08-07T15:09:56.045722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:46.456817Z","title":"Evaluating text-to-visual generation with image-to-text gen- eration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:46.456817Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:834319047f2cb8d08b2e95cf8d98428f3821d0c8bd4dfe907915dfcc14631227","observation_id":"6f465708-2daa-43dc-8deb-2fb026a50177","resolution":{"observed_at":"2026-08-07T15:09:46.456817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:55.847608Z","title":"NTIRE 2025 XGC quality assessment chal- lenge: Methods and results","venue":null,"work_id":"abd3bfcf-e97a-4e03-83d9-531341c44fcf","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:46.578546Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:a5bd04e6e84d7d25b7f7bc09191d89760df3ab5a3ba8a46c809944ec1af90a19","observation_id":"dd871405-ecc8-4b35-a227-c1b9ba227326","resolution":{"observed_at":"2026-08-07T15:09:55.910720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:46.761725Z","title":"NTIRE 2025 challenge on low light image enhancement: Methods and results","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:46.761725Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:25089254c9d2a6a5f8c25f0238e06ab9daa686df1ba7449dd1a8dcc7625f2b33","observation_id":"32dc8943-1cfd-4b58-a98b-304da3be1866","resolution":{"observed_at":"2026-08-07T15:09:46.761725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:55.699109Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"3779a3da-5631-47b9-bad5-222af3a54cd0","year":2021},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:46.870022Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:7ca78c368b65aa94211c5fd8994dabe0437e50985fdc772eb299a7ab524cfb8b","observation_id":"c8943ba2-5b1c-4e7c-9385-3d5061573032","resolution":{"observed_at":"2026-08-07T15:09:55.754117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20797","last_updated":"2024-06-17T17:51:50Z","snapshot_observed_at":"2026-08-07T21:47:16.436942Z","submitted_at":"2024-05-31T13:59:18Z","title":"Ovis: Structural Embedding Alignment for Multimodal Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20797","snapshot_observed_at":"2026-08-07T15:09:47.031949Z","title":"Ovis: Structural em- bedding alignment for multimodal large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:47.031949Z"},"links":{"cited_paper":"/paper/2405.20797","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:f71cc89271dd4bd2eeb469f79ded0be1f73d43c9afc369e9c49b37cbf5e8ff91","observation_id":"8d565fb3-4a9a-4d30-9dc0-c791df6aad28","resolution":{"observed_at":"2026-08-07T15:09:47.031949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:47.142042Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:47.142042Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:355321efa201c25bc7459a051def8121e42e7da0da45cc156338fe445d99ebb4","observation_id":"556d63fb-f748-44fe-a0d8-f434d5f9ae80","resolution":{"observed_at":"2026-08-07T15:09:47.142042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:55.553269Z","title":"The tenth NTIRE 2025 efficient super- resolution challenge report","venue":null,"work_id":"0a03c52b-4188-4731-815d-989368c42847","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:47.276328Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:81918085c0f75e5257a789001577c3589a0b06e5aed93593a451d639000c4119","observation_id":"66ff6b2d-9a04-4999-9f91-6b17107da5ed","resolution":{"observed_at":"2026-08-07T15:09:55.606842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:55.393174Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":"407ef382-8873-4a8f-a3bf-09d4bd7220d5","year":2015},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:47.410493Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:ea8278712c9791da5d0388cfa394afe8834555efeb7969bd79ee33c562b625b6","observation_id":"aff8ac72-e62f-4937-af03-fe5923ee6f86","resolution":{"observed_at":"2026-08-07T15:09:55.487411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:55.144724Z","title":"NTIRE 2025 challenge on UGC video enhancement: Meth- ods and results","venue":null,"work_id":"3523add3-5a03-40e7-9a6f-6b0b482bea0a","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:47.516008Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:fdff9dde1d666fee9fded9e3e22993425c9edb61b64c17e0e555ac232b1fd5d7","observation_id":"1f5d5c42-6608-45f2-ae19-3373d64bfcbf","resolution":{"observed_at":"2026-08-07T15:09:55.278500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:54.917208Z","title":"NTIRE 2025 challenge on event-based image deblurring: Methods and results","venue":null,"work_id":"afb24159-69ca-4db7-bffa-9bd4d6f5e70d","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:47.602234Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:9c8f2919b9f949290f9968716f1ca0700da961c0f43372b53975690159ff61f4","observation_id":"13d5b861-8ea3-4ea4-877f-708f16357d75","resolution":{"observed_at":"2026-08-07T15:09:54.999725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:54.718164Z","title":"The tenth ntire 2025 image denoising challenge report","venue":null,"work_id":"d0220c56-d2fd-48b0-ac05-608731482054","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:47.734361Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:72740c3871fd5b1c7d2069d008dcf89882969d6e36a563df5a4fe5123cc61d0a","observation_id":"0d15b770-d46a-46b8-9705-aef62e4720e9","resolution":{"observed_at":"2026-08-07T15:09:54.811728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:54.541288Z","title":"Blind quality assessment for in-the-wild images via hierarchical feature fusion and iterative mixed database training","venue":null,"work_id":"d9d680e9-aff0-4ae0-9aef-ae2cd8ad0843","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:47.893084Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:0c0ec2b5623da573ac85f5d9a59bf92eed844eef74130db9d384c2ea0e8e47db","observation_id":"5be8130c-858a-47d4-a475-ba75bdb5caab","resolution":{"observed_at":"2026-08-07T15:09:54.619811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-07T15:09:48.049439Z","title":"Siglip 2: Multilingual vision-language en- coders with improved semantic understanding, localization, and dense features","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:48.049439Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:eb08df87d7724b233eef37e7042eaeb9a53e43b05aa07c19ac30f1b0abc83861","observation_id":"d4fdfaf6-97f9-47d4-9518-ba95d9c0dc64","resolution":{"observed_at":"2026-08-07T15:09:48.049439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:54.275648Z","title":"NTIRE 2025 image shadow removal challenge report","venue":null,"work_id":"4e0649a2-4042-4601-b0bb-06f087635666","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:48.179508Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:3401a99aa1cc772034263ce18dd8f157bef2b4482be7283871a12906c3de8f9a","observation_id":"362a9418-d02b-48b8-8337-7c62080f17fd","resolution":{"observed_at":"2026-08-07T15:09:54.396302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:54.001156Z","title":"NTIRE 2025 ambi- ent lighting normalization challenge","venue":null,"work_id":"6cdd144d-a208-47a8-824d-49fb4c7d0e8b","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:48.292439Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:6512f71aa8b575d963923d7c5b818bf609ce239210a64037ccf6ece864cf4b79","observation_id":"9af1d693-3081-4b3a-9baf-5d4aefc4996e","resolution":{"observed_at":"2026-08-07T15:09:54.127462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:53.790170Z","title":"Hierarchical curriculum learning for no-reference image quality assessment","venue":null,"work_id":"364ab240-f4ab-41e3-b234-d0707af6e124","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:48.419212Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:e38df13773ee6997fdbf8b47a93d2e16bdc2cd283a98abe8b8096a0df28fa52c","observation_id":"72d91ad0-f022-491b-affe-13db8bb37fdd","resolution":{"observed_at":"2026-08-07T15:09:53.900013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:53.580904Z","title":"Aigciqa2023: A large-scale image quality assessment database for ai generated images: from the perspectives of quality, authenticity and correspondence","venue":null,"work_id":"db886686-a701-45a7-a962-dc6840658c21","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:48.538863Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:e456281b9400b86e666d468874f335da49e3eeed9211b4bac1522553789c83a9","observation_id":"995404a8-2555-42fe-bf4f-61e38fb53443","resolution":{"observed_at":"2026-08-07T15:09:53.675955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:53.426006Z","title":"NTIRE 2025 challenge on light field image super-resolution: Methods and results","venue":null,"work_id":"0e63a9cf-b4f1-4efa-9dc2-5473c9712a66","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:48.672463Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:addae8ef9668a3f62367ab24754856da92dc36b3f6e5679f404cb04a4650de9b","observation_id":"b8fa76ce-f3d3-4ecd-9c21-2f29632dc4e3","resolution":{"observed_at":"2026-08-07T15:09:53.491924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05236","snapshot_observed_at":"2026-08-07T15:09:48.791344Z","title":"Unified reward model for multimodal understanding and generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:48.791344Z"},"links":{"cited_paper":"/paper/2503.05236","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:ef43b4a9694e52f618b371a1eba794ac7d89b6230427938e5e28967aad0e9e98","observation_id":"c323d025-d429-4df1-b32b-be0564420642","resolution":{"observed_at":"2026-08-07T15:09:48.791344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14896","last_updated":"2023-07-06T11:53:19Z","snapshot_observed_at":"2026-08-04T19:36:09.411861Z","submitted_at":"2022-10-26T17:54:20Z","title":"DiffusionDB: A Large-scale Prompt Gallery Dataset for Text-to-Image Generative Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14896","snapshot_observed_at":"2026-08-07T15:09:48.923294Z","title":"Diffu- siondb: A large-scale prompt gallery dataset for text-to- image generative models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:48.923294Z"},"links":{"cited_paper":"/paper/2210.14896","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:569ee04d0ba4900b1ef6f213f4913f1b2c03b49635c3eeab9efbfd8f099722bd","observation_id":"07b73ccc-01c4-4ff5-97f0-22ce089d250a","resolution":{"observed_at":"2026-08-07T15:09:48.923294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16820","last_updated":"2025-03-17T15:53:14Z","snapshot_observed_at":"2026-07-06T18:05:42.862609Z","submitted_at":"2024-04-25T17:58:43Z","title":"Revisiting Text-to-Image Evaluation with Gecko: On Metrics, Prompts, and Human Ratings","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16820","snapshot_observed_at":"2026-08-07T15:09:49.004067Z","title":"Revisiting text-to-image evaluation with gecko: On met- rics, prompts, and human ratings","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.004067Z"},"links":{"cited_paper":"/paper/2404.16820","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:14b7d583a2c7cbfcf333db8038ad9e05f54f688c55b5c8a384b61819b7a1d84d","observation_id":"ace5e260-5e3c-49bd-adc4-946f4dc02aba","resolution":{"observed_at":"2026-08-07T15:09:49.004067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17090","last_updated":"2023-12-28T16:10:25Z","snapshot_observed_at":"2026-08-02T07:14:02.308302Z","submitted_at":"2023-12-28T16:10:25Z","title":"Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17090","snapshot_observed_at":"2026-08-07T15:09:49.142943Z","title":"Q-align: Teaching lmms for visual scoring via discrete text-defined levels","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.142943Z"},"links":{"cited_paper":"/paper/2312.17090","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:e9bab0c56d11ddb25b3e1add8e66466c172d10c88d559ed102f46d997a659d66","observation_id":"cbf7cad9-744a-4897-ad7d-7b90c7042071","resolution":{"observed_at":"2026-08-07T15:09:49.142943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:53.289435Z","title":"Human preference score: Better aligning text- to-image models with human preference","venue":null,"work_id":"d02eb515-2d5d-4f73-8a2c-a5f449883dd0","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.237437Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:27d51d114db0ac6c8277da6033a2a96d802cab4e6f3de705a76fc9b08ed52b26","observation_id":"e05afebe-0a04-49e8-bd4f-a5f055d7f8a3","resolution":{"observed_at":"2026-08-07T15:09:53.357887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T15:09:49.315150Z","title":"Deepseek-vl2: Mixture-of- experts vision-language models for advanced multimodal understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.315150Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:38680012c6cf6be67cfdcc0f157ac9d1bd46004f669bc7ee38b1e1e49693d18d","observation_id":"0c9448f7-1303-4394-bfd1-9413147c6951","resolution":{"observed_at":"2026-08-07T15:09:49.315150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:53.151795Z","title":"Florence-2: Advancing a unified representation for a variety of vision tasks","venue":null,"work_id":"4c51991d-5f0b-4d2e-ad58-78a9a97a1f76","year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.407087Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:24003425bfcb92469ef3fb45c6e38e531e4587672a268ead69fb2bf0333000e3","observation_id":"178f0670-d488-436d-8d86-c2c953a0d908","resolution":{"observed_at":"2026-08-07T15:09:53.206034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:49.477026Z","title":"Sam2-unet: Segment anything 2 makes strong encoder for natural and medical image segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.477026Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:868489931ca4d0258fd1a1b4d3c5b44070042f0481abf703d2b919b906258f80","observation_id":"74e39e8c-431c-4e65-a14a-c2826a7ab82d","resolution":{"observed_at":"2026-08-07T15:09:49.477026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:53.009336Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":"61998b75-0eec-4cea-87e0-8da1fcfe8f06","year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.571316Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:ffa221bcf77958dea05370c806a29ca61e5ab25f601374cb9ff968536cece2a7","observation_id":"8a08317c-e244-4eb8-a703-ee5876bfbd4a","resolution":{"observed_at":"2026-08-07T15:09:53.086628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:52.852344Z","title":"Boosting image quality assessment through efficient transformer adaptation with lo- cal feature enhancement","venue":null,"work_id":"4fb4d78d-4ab7-4802-9738-a25528f85486","year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.651579Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:07c6cbc226832762394a9e4fc313de9340dc3a8a38ab8bcbf0433118b465d0c9","observation_id":"b989a894-b547-4ec3-b3ab-c51694939b47","resolution":{"observed_at":"2026-08-07T15:09:52.919377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19435","last_updated":"2025-02-15T16:01:36Z","snapshot_observed_at":"2026-08-06T05:38:31.927956Z","submitted_at":"2024-06-27T17:59:49Z","title":"A Sanity Check for AI-generated Image Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19435","snapshot_observed_at":"2026-08-07T15:09:49.781921Z","title":"A sanity check for ai-generated image detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.781921Z"},"links":{"cited_paper":"/paper/2406.19435","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:6d06ba1ed964b7fb5470d312c9df00992addb77536fe0ff9282db3e93547de67","observation_id":"df519ae5-de4b-4893-bbeb-b8609af7f300","resolution":{"observed_at":"2026-08-07T15:09:49.781921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:52.723041Z","title":"NTIRE 2025 challenge on single image reflection removal in the wild: Datasets, methods and results","venue":null,"work_id":"a9b37d95-c3ce-4d17-89e6-ca3ac3ede386","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.859011Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:80dc2e95e19ac2cb7164157650e151ac96aa8080e0e370ea8ae64c032e03a875","observation_id":"cc04a7d4-5e61-4bc5-a94b-7261c0bff3e0","resolution":{"observed_at":"2026-08-07T15:09:52.771844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:52.580896Z","title":"Maniqa: Multi-dimension attention network for no-reference image quality assessment","venue":null,"work_id":"24fdba55-f658-4cb9-957a-de5f2cad9e30","year":2022},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.922414Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:fa38905cd82c21a4e36783056be59fc6d5c8a0e8edfb415fffad394f67891864","observation_id":"4cd89c44-2a47-4abf-8b0b-8edcdc12e06c","resolution":{"observed_at":"2026-08-07T15:09:52.633899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:52.454662Z","title":"mplug- owl2: Revolutionizing multi-modal large language model with modality collaboration","venue":null,"work_id":"52585952-d5d9-4e3e-941b-fb25b1cf9c6a","year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:49.986248Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:eaa1a7fc4800df525d767f7266ec716daa92ddd0717f41c74170dc7d591fdc8b","observation_id":"a43ba5b8-a0e2-4f5d-93a5-306a84c4053f","resolution":{"observed_at":"2026-08-07T15:09:52.503359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:50.150469Z","title":"Teaching large language models to regress accurate image quality scores using score distribution","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:50.150469Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:1d3789830d75ed73e47e7e648c4c06d63fcbe1177c8cd0b053f81c7505f5b93a","observation_id":"8db9ef52-85f2-4f87-b34c-9297e26133d0","resolution":{"observed_at":"2026-08-07T15:09:50.150469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:52.345935Z","title":"Instruction-augmented multimodal alignment for image-text and element matching","venue":null,"work_id":"e8369ea4-c7a7-46ad-bb92-d7fe4ceeba26","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:50.236678Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:3bde78d30e1eb2f0f350c13fc835bc12323c0ea47f1b40b99ac479b98d736dc1","observation_id":"767aef20-b7d5-4659-8b90-5d5efa3e74a6","resolution":{"observed_at":"2026-08-07T15:09:52.390982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:52.230630Z","title":"NTIRE 2025 challenge on hr depth from images of specular and transparent surfaces","venue":null,"work_id":"df194599-be7a-42c6-ab66-7985fd71ff16","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:50.371824Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:f2e7bc1d83d3b881e5256294407dfbd096261951b2b1ffbe827f35b1e0f525d7","observation_id":"1ccd165d-6b1e-4233-9632-b8feeb53644a","resolution":{"observed_at":"2026-08-07T15:09:52.272425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:52.137888Z","title":"Blind image quality assessment using a deep bilinear convolutional neural network","venue":null,"work_id":"31c7a738-7c4c-4eb2-bde4-452b24f0cdbd","year":2020},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:50.454940Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:9552bec53a26e5f09deae46153123f2e6762c1c780ee8f5f3a2d9fd8fdc279f9","observation_id":"b9eabf49-9714-41f3-bf80-26fe3144495c","resolution":{"observed_at":"2026-08-07T15:09:52.177141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:51.988941Z","title":"Blind image quality assessment via vision- language correspondence: A multitask learning perspective","venue":null,"work_id":"21d7c33c-30e9-4312-9375-6c0c6bf5c792","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:50.537549Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:c4df5aea2b0270537890a475acd80571bb01abd644580083b1dafad48135609a","observation_id":"0015bd98-3492-42c7-96a1-ac64e327e6b3","resolution":{"observed_at":"2026-08-07T15:09:52.057106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:51.847084Z","title":"A perceptual quality assessment exploration for aigc images","venue":null,"work_id":"d7854d92-2643-42ec-920c-3c30122bd5ac","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:50.652805Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:40698e1f9e3b7b08616267f5f57b2164af321160dd8fda5fd8bd5e8206d1dbe5","observation_id":"a8d9c08d-32f8-44ee-ae98-16ee660b7b53","resolution":{"observed_at":"2026-08-07T15:09:51.919313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:51.736503Z","title":"Tokenfocus-vqa: Enhancing text-to-image alignment with position-aware focus and multi-perspective aggregations on lvlms, 2025","venue":null,"work_id":"b6dc6e6b-3550-4875-b8eb-0b41efaee4fb","year":2025},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:50.727111Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:ee1d060c2f574b22b3ee71899c3a8ea7905117b2f4911c5b60feee2ddf3675f1","observation_id":"b7113197-5357-4962-ba2c-648620721343","resolution":{"observed_at":"2026-08-07T15:09:51.774925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:51.601232Z","title":"Study group learning: Improving retinal vessel segmentation trained with noisy labels","venue":null,"work_id":"6381c8c3-c182-4a34-8ef5-2ab2ef4bdbe4","year":2021},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:50.800134Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:dad05f600b75fc35e47f7cf76919431496070775cc0daaaf6f571a7b4a502975","observation_id":"b524e6b2-d060-4909-9710-067324c27949","resolution":{"observed_at":"2026-08-07T15:09:51.669463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:51.449166Z","title":"Detrs with col- laborative hybrid assignments training","venue":null,"work_id":"9a11577b-ba8b-4209-8029-e43c2f7ffbd8","year":2023},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:50.876311Z"},"links":{"citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:2086f69e26f8cb286769bb11f79bd70f048e00ce9fbad92a46c9646ffa184e5d","observation_id":"b41587d1-425c-43b5-bc80-a6f4045b3dad","resolution":{"observed_at":"2026-08-07T15:09:51.507749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T21:47:57.996975Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":51},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2505.16314."}