{"as_of":"2026-08-08T02:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d0826b11aefb1a615dfa70678ccf976c7531df770fd0ce39a7404585889f880","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T08:00:12.781392Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:17:33.979030Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-20T10:43:12.590798Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04300","snapshot_observed_at":"2026-08-07T14:17:33.979030Z","title":"T2i-factualbench: Benchmarking the factuality of text-to-image models with knowledge-intensive concepts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19415","last_updated":"2025-05-27T20:10:09Z","snapshot_observed_at":"2026-08-07T14:12:18.054397Z","submitted_at":"2025-05-26T02:07:24Z","title":"MMIG-Bench: Towards Comprehensive and Explainable Evaluation of Multi-Modal Image Generation Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:33.979030Z"},"links":{"cited_paper":"/paper/2412.04300","citing_paper":"/paper/2505.19415"},"observation_digest":"sha256:6d68b55cb6322e5ddba94538bb083ee56f8f0d0f75c2f8328b60dc245c5699ca","observation_id":"8f14445d-b9a3-4d2a-88dd-81f43faf8828","resolution":{"observed_at":"2026-08-07T14:17:33.979030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"cited_work":{"arxiv_id":"2412.04300","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04300","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","venue":"cs.CV","work_id":"f9cb6196-c554-4748-aba4-61abf30670ce","year":2024},"citing_paper":{"arxiv_id":"2605.19111","last_updated":"2026-05-18T20:57:07Z","snapshot_observed_at":"2026-08-02T22:51:08.290850Z","submitted_at":"2026-05-18T20:57:07Z","title":"FAGER: Factually Grounded Evaluation and Refinement of Text-to-Image Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T10:40:37.777253Z"},"links":{"cited_paper":"/paper/2412.04300","citing_paper":"/paper/2605.19111"},"observation_digest":"sha256:48c34cd4b8e5beceaba2b753a4e05de26a96f4743cd03b8c8ded0cb007925f8a","observation_id":"24604e82-1036-4a6d-96fb-14dfce1c20de","resolution":{"observed_at":"2026-05-20T10:43:12.592454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.04300/citation-record","integrity":"/paper/2412.04300/integrity","json":"/paper/2412.04300/citation-record.json","paper":"/paper/2412.04300"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0d63a5e9-81f5-4925-896c-43bd17557270","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:dcbb95b880479d6b6a7b5407f37ffdd8ec9e8e01a93af3f54afa1a274b845e7b","observation_id":"7e894a9a-9267-476d-be30-7b74c2d72305","resolution":{"observed_at":"2026-05-23T08:02:44.939607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:0080a2a6d371e9cdb5a8d6717b5343b7ef00d1813820389167b314e147a0e5a6","observation_id":"2d6c3d82-f412-4b51-9cc3-fb42595e5525","resolution":{"observed_at":"2026-05-23T08:02:43.294964Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fd0c2131-39ab-4629-acb3-d1cfd5ffa7f3","year":2023},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:6eb558a519250d23c921aca0c5f6030d72b55e96ae3022f33e9a4b7c98fac041","observation_id":"822c1dbe-f962-4756-9270-51c711b3e79d","resolution":{"observed_at":"2026-05-23T08:02:44.935818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12119","last_updated":"2026-05-29T11:31:58Z","snapshot_observed_at":"2026-08-07T18:11:25.128924Z","submitted_at":"2025-02-17T18:43:41Z","title":"PRISM: Self-Pruning Intrinsic Selection Method for Training-Free Multimodal Data Selection","version":4},"cited_work":{"arxiv_id":"2502.12119","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.12119","snapshot_observed_at":"2026-07-02T10:16:52.282333Z","title":"Prism: Self-pruning intrinsic selection method for training-free multimodal data selection.arXiv preprint arXiv:2502.12119","venue":"cs.CV","work_id":"4632bb3f-4c6e-4c82-bb65-04b4b98fa796","year":2025},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2502.12119","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:4c9430e6165fbacada270fc5685ce536281a81592e0c807cf85cd0e0d478be38","observation_id":"765467d5-b7fd-45de-b313-abd3605d845d","resolution":{"observed_at":"2026-06-01T02:03:19.353447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12359","last_updated":"2025-01-07T15:36:54Z","snapshot_observed_at":"2026-07-06T20:08:12.033767Z","submitted_at":"2024-12-16T21:14:11Z","title":"LLaVA Steering: Visual Instruction Tuning with 500x Fewer Parameters through Modality Linear Representation-Steering","version":2},"cited_work":{"arxiv_id":"2412.12359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.12359","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e7fdaa4c-6c00-4e0b-9932-cfe501dab126","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2412.12359","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:4be266d9a8d2fb27036439398da5f618aaabc88458b228449383fb0495c1b7c6","observation_id":"25d6f7b9-f6ce-4e61-8de5-2d4c8d4961c7","resolution":{"observed_at":"2026-05-23T08:02:43.336718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0a59d7b5-078b-4026-967c-fcf8dbba0916","year":2021},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:eaeb43823efdb635025ecfd4d228e07645ac7a6e6c97db314668dbae81090a4e","observation_id":"a2df1d7b-af4e-466b-81d0-49420838d83d","resolution":{"observed_at":"2026-05-23T08:02:44.942701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kwok, Ping Luo, Huchuan Lu, and Zhenguo Li","venue":null,"work_id":"92d15aa7-eeff-4938-85a3-822803ea05a8","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:12fd0c901f83f2f7360944db07d7bcaf9803c12ec9c00535c67f7fbdd547d1a8","observation_id":"c233b1b4-3b4c-4038-b494-12103e3ccd58","resolution":{"observed_at":"2026-05-23T08:02:44.946092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"70030fbd-2bc7-46e4-9e7e-83318739d261","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:465ce3c0f21469e00b5cb5064a9c1ceb081feef930e60f56d220a2e289748e05","observation_id":"20f725bf-de3c-4ec4-b5b2-5abf14810460","resolution":{"observed_at":"2026-05-23T08:02:44.956767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2403.03206","doi":"10.48550/arxiv.2403.03206","metadata_source":"pith","pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"4dc55d76-271e-42dd-878f-c20546599c69","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:c43fea47240cd21c88e517378d60fb467b4573cc8bcb3b1fcad6dd07ad313658","observation_id":"96889241-728e-4c84-8ba6-0aaa181b89e4","resolution":{"observed_at":"2026-05-23T08:02:43.089478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:19:49.764146+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:19:49.764146+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07546","last_updated":"2024-08-12T19:33:52Z","snapshot_observed_at":"2026-07-06T18:29:08.586253Z","submitted_at":"2024-06-11T17:59:48Z","title":"Commonsense-T2I Challenge: Can Text-to-Image Generation Models Understand Commonsense?","version":2},"cited_work":{"arxiv_id":"2406.07546","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07546","snapshot_observed_at":"2026-07-04T13:09:50.423322Z","title":"Commonsense-t2i challenge: Can text-to-image generation models understand commonsense?","venue":null,"work_id":"4e3b9283-2aa2-4823-b228-dc40ffd87114","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2406.07546","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:f4a24f980527d0f526ad27f1e188fb958a6fd02ec29a6be177af42b77f1b3d20","observation_id":"afdcc556-0802-4452-b94d-39fe4267e5f9","resolution":{"observed_at":"2026-05-23T08:02:43.281911Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11821","last_updated":"2025-01-29T08:48:10Z","snapshot_observed_at":"2026-07-06T17:46:20.935124Z","submitted_at":"2024-03-18T14:24:20Z","title":"A Survey on Quality Metrics for Text-to-Image Generation","version":5},"cited_work":{"arxiv_id":"2403.11821","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.11821","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2403.11821","venue":null,"work_id":"a61f5613-5249-40d6-a3b6-fe1f87038f4e","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2403.11821","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:e9562fcc7a92143f5175b4ddbed8138930a949539107ab5c96c7a7066cd64ea8","observation_id":"c2075f61-d8bc-45e8-8d3f-b397d4f3e93a","resolution":{"observed_at":"2026-05-23T08:02:43.255414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07614","last_updated":"2024-07-11T11:05:53Z","snapshot_observed_at":"2026-08-06T02:29:21.167648Z","submitted_at":"2024-07-10T12:52:49Z","title":"MARS: Mixture of Auto-Regressive Models for Fine-grained Text-to-image Synthesis","version":2},"cited_work":{"arxiv_id":"2407.07614","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.07614","snapshot_observed_at":"2026-07-02T21:27:24.441164Z","title":"Mars: Mixture of auto-regressive models for fine-grained text-to-image synthesis","venue":null,"work_id":"50822597-546e-4083-9ced-932e5e1ba3e7","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2407.07614","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:b2915026ade24e5cdb6cb35ecd941033e60c1926fa0eef6100d44b5714829731","observation_id":"61fe701b-d584-442e-a2fd-5a71f2a9ff36","resolution":{"observed_at":"2026-05-23T08:02:43.319764Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":"2104.08718","doi":"10.48550/arxiv.2104.08718","metadata_source":"pith","pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","venue":"cs.CV","work_id":"2dd7e0b7-c69c-4976-a406-12d4f5b18d14","year":2021},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:5122b9bb015b7a103c33939c1a2f3996610a9f6641d0dbb22c59e1caf77bae9e","observation_id":"dcd4ba30-9b3e-4100-a6a1-cc5ce2a7aad3","resolution":{"observed_at":"2026-05-23T08:02:43.247094Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"59341e63-99ad-4523-a10c-5d2de2fa6ad1","year":2017},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:c1d0bb4fb2f3ab7db58872071bf9d79b0de344a9737434df7edd2e48d3968416","observation_id":"dff5b305-4e16-4062-8f80-712d11fff708","resolution":{"observed_at":"2026-05-23T08:02:44.902375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cbee4a60-fac0-4b50-a4d5-2ed065d8bc9a","year":2023},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:b7bc583a8128a88b2686b91b53dd6cb3b1ac73be7c0c005e9e19bc9562be26db","observation_id":"b20ea277-3ca8-4f19-9629-1cd42ea85123","resolution":{"observed_at":"2026-05-23T08:02:44.923843Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11824","last_updated":"2025-07-28T09:36:29Z","snapshot_observed_at":"2026-07-06T19:34:01.458836Z","submitted_at":"2024-10-15T17:50:37Z","title":"KITTEN: A Knowledge-Intensive Evaluation of Image Generation on Visual Entities","version":2},"cited_work":{"arxiv_id":"2410.11824","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.11824","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6e524019-71ab-48f5-b172-3441fd5921e7","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2410.11824","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:e160ab50b15b48d03b0c85548f8139c06b0f3b75aa1b8f5db805908f4df5814a","observation_id":"10ffc89b-8cb0-4d87-b381-32929dc5bcb9","resolution":{"observed_at":"2026-05-23T08:02:43.261766Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5275d9c0-7861-4ac6-a003-02011307dbb2","year":2023},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:4056f298defc9b77520e7de8e1e83ae0d9ccbbbbfbb24c364cbceabd2efe5d17","observation_id":"deaed8b9-4b19-4392-91b0-ffd3e7949405","resolution":{"observed_at":"2026-05-23T08:02:44.928043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8d64d339-c133-466e-bb36-503306d0bd88","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:3708c909d3c89930b1f9add53a720f1c90c33e9f39ef63a696e3085a19346a64","observation_id":"c6e89d5e-e435-46ca-8a4d-f67c9609e8d6","resolution":{"observed_at":"2026-05-23T08:02:44.953643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f5f60147-52d1-4c7c-8b57-4b0c2a506942","year":2023},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:71da1898011d6e3789ed0c85eb02fb032f3b9fc92a58ae19587da0abf5d1f400","observation_id":"6a93b224-9a35-40c8-9c4b-68bb63bcdb4f","resolution":{"observed_at":"2026-05-23T08:02:44.820698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7e04b1ff-d917-436b-9d5f-4d0aa6ff232e","year":2018},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:c90a071641feb39bc5bf9ef27856a7af7d26f8fc0a1339c86cfc4b3fd8ae7728","observation_id":"8189eebd-0af6-44f4-91ff-6988e43f3314","resolution":{"observed_at":"2026-05-23T08:02:44.823999Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:7d3c3c9b5cb5c3380658e95a057b8df33f893dbc54ac49c7f37ce4a1ba3636ac","observation_id":"e61fc56c-1aac-4393-9111-0fc58d5d9837","resolution":{"observed_at":"2026-05-23T08:02:43.325540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01596","last_updated":"2024-03-10T21:41:51Z","snapshot_observed_at":"2026-07-06T16:26:46.131908Z","submitted_at":"2023-10-02T19:41:42Z","title":"ImagenHub: Standardizing the evaluation of conditional image generation models","version":4},"cited_work":{"arxiv_id":"2310.01596","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.01596","snapshot_observed_at":"2026-07-02T16:07:09.099618Z","title":"Imagenhub: Standardizing the evaluation of conditional image generation models.arXiv preprint arXiv:2310.01596,","venue":null,"work_id":"857dff1d-9f17-4510-9916-c90004d04de7","year":2023},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2310.01596","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:af5f30c46276365c6b9287a9b3f064482bec50101e0fcb17934dc115b83b3a46","observation_id":"13c0705d-4fa1-456a-a907-0ef032f5232a","resolution":{"observed_at":"2026-05-23T08:02:43.388860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"472972fa-897d-43a7-a827-1d022dc6359f","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:26b0169365c14c9fce030deca54d70b6d08b3bed863e1f24fd528804cb3ce463","observation_id":"1fc3ad04-1dcc-4fed-9653-46d6d9502922","resolution":{"observed_at":"2026-05-23T08:02:44.814278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-07-30T19:48:58.731788Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:9465982de482ceb67b1daba855a8f8983b9d5a25df306274ae2734c3128c6ad9","observation_id":"009c486e-e436-413d-a1e7-b38533cac5f6","resolution":{"observed_at":"2026-05-23T08:02:43.382527Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"84389b1c-a399-4b5e-aa72-0e79cac5be47","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:e741152499b0a106b8dfd45a11d99a972ba3084ec164203befe70d6b73bfbc1d","observation_id":"cca168f9-a1b7-476c-b550-c5a25fe718b7","resolution":{"observed_at":"2026-05-23T08:02:44.817236Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17245","last_updated":"2024-02-27T06:31:52Z","snapshot_observed_at":"2026-07-06T17:36:01.939242Z","submitted_at":"2024-02-27T06:31:52Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":"2402.17245","doi":"10.48550/arxiv.2402.17245","metadata_source":"pith","pith_arxiv_id":"2402.17245","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","venue":"cs.CV","work_id":"53c64fda-8566-434d-bc10-2fdfbc6a55ad","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2402.17245","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:6f78ec091659f1db865952856aa64257c935b3d5655d3b09ed40376e1f70f5dd","observation_id":"b076256b-8112-49ce-b681-e46c394b7f6f","resolution":{"observed_at":"2026-05-23T08:02:43.111250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d853fc47-9ced-454b-9522-eca5e6af03fd","year":2022},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:eaaf477ba069995ec16754aaae0eef4832e7a88a8ed76ab78069873c485081f9","observation_id":"fd531027-5a4b-4a7f-a6ee-b70d151cd42e","resolution":{"observed_at":"2026-05-23T08:02:44.811203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09856","last_updated":"2024-08-19T09:58:53Z","snapshot_observed_at":"2026-08-02T11:34:57.319290Z","submitted_at":"2024-08-19T09:58:53Z","title":"TeamLoRA: Boosting Low-Rank Adaptation with Expert Collaboration and Competition","version":1},"cited_work":{"arxiv_id":"2408.09856","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.09856","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"10141010-615c-4537-b791-f0bdab57c86a","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2408.09856","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:07eb78d94fbed11970a19635d1a06cc2f9d7639babdc06bcc65fc6e2d6bd73a9","observation_id":"09a481e8-7b19-475a-98b0-11b52454bcaa","resolution":{"observed_at":"2026-05-23T08:02:43.348684Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19684","last_updated":"2025-02-17T15:32:50Z","snapshot_observed_at":"2026-07-06T20:13:45.123960Z","submitted_at":"2024-12-27T15:21:17Z","title":"Boosting Private Domain Understanding of Efficient MLLMs: A Tuning-free, Adaptive, Universal Prompt Optimization Framework","version":2},"cited_work":{"arxiv_id":"2412.19684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19684","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6264f763-8214-48b9-b0be-32422193240b","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2412.19684","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:fd3b291a35be4dc1a44127c7c6986fd7bbb90d2c98c4540b804e89c73c1feb3b","observation_id":"15660616-820d-4ace-b611-5878892086a3","resolution":{"observed_at":"2026-05-23T08:02:43.342981Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"27c5ad9f-2272-4e7e-8e4c-ef17bb67f3a4","year":2025},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:318dc8b7359c0f55061aaa957afbd159ba91ddbc2a0de0e24df2d8552e98961b","observation_id":"0623135b-982a-4c59-8800-c722bcdc3f2c","resolution":{"observed_at":"2026-05-23T08:02:44.932012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8f822e3d-30b5-4ed8-9333-e5011de1e997","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:d7242650ea746f1af49ac188da929dc55a427785858ac64bab839f6a7f5a069f","observation_id":"4b03d600-4e24-4f3a-973d-69627d4381e8","resolution":{"observed_at":"2026-05-23T08:02:44.808053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d6b9c10e-aec3-40ab-8218-5735659c3698","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:76ea14cbf7bce35e033abe58cc7498663e5430759021c8419d129cb252b40e41","observation_id":"009d0553-71ed-40cf-a037-fe42df84978f","resolution":{"observed_at":"2026-05-23T08:02:44.826902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1c251635-3c35-480a-a633-7430d7ab2e57","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:65b1ba0edb95e90fb2be7d017e9b2a28e159723080ecc5717a77b9dea27b3c49","observation_id":"71ff72f8-5a43-4539-abb2-b1d6d6becd30","resolution":{"observed_at":"2026-05-23T08:02:44.950062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11802","last_updated":"2024-09-21T06:53:58Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:49:01Z","title":"PhyBench: A Physical Commonsense Benchmark for Evaluating Text-to-Image Models","version":3},"cited_work":{"arxiv_id":"2406.11802","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11802","snapshot_observed_at":"2026-07-04T13:19:50.687532Z","title":"PhyBench: A physical com- monsense benchmark for evaluating text-to-image models","venue":null,"work_id":"b8a57ef1-ee0d-4bb1-8b6d-b9bacbdc8317","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2406.11802","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:f0c6c24c4868b1dfd97c0a05983f731c7da77d163f3dcbbd80cd9e0e8f3da4ef","observation_id":"a315203a-d6e4-41da-8ea4-77402fa764f2","resolution":{"observed_at":"2026-05-23T08:02:43.359287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"58e4617e-5a4d-40a0-a692-b6539d9694ba","year":2012},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:8e6032fb139fb298dd15a72e60ff5227f85b0d6997899681e2a8272dce1ab9f0","observation_id":"c78048f7-343e-4bb9-8fcf-1e680af0cd72","resolution":{"observed_at":"2026-05-23T08:02:44.891457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cdb1b539-b77c-4b8c-92aa-a0a73d779ad0","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:30cbeaac3afaa8f20b723f7f69e88dd28d7b0a9b9c16c7582421e7094a86fdae","observation_id":"fff61906-122f-422a-af8a-ff5dfc7bb7c6","resolution":{"observed_at":"2026-05-23T08:02:44.899095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"38571b87-e350-4d39-b20a-74875cc59449","year":2022},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:48e3b04568fd5236ebe26b2fabb898d66907b742924246e89c17149e664a7d35","observation_id":"70b17459-e215-44cf-a198-31c5c46bb9a9","resolution":{"observed_at":"2026-05-23T08:02:44.888148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8ed9f59f-9275-47ff-a28e-58dd123a38fb","year":2021},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:919c1d2ff8321438ae26235fd6d84151c0bf56561bdaa656651dfd40c1482935","observation_id":"5f4bfb5c-5f0e-477f-b4e2-05ce08ec69f6","resolution":{"observed_at":"2026-05-23T08:02:44.881677Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16855","last_updated":"2025-03-09T02:57:28Z","snapshot_observed_at":"2026-08-07T22:08:49.929764Z","submitted_at":"2024-06-24T17:58:47Z","title":"DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation","version":2},"cited_work":{"arxiv_id":"2406.16855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16855","snapshot_observed_at":"2026-07-03T21:08:57.517878Z","title":"Dreambench++: A human-aligned bench- mark for personalized image generation","venue":null,"work_id":"07df1e79-a136-4532-b85e-ec5bd5030414","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2406.16855","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:0143dd1812e8cd0e09b6cb3972b555cc467907d1c1e753faa1b368b0caca8621","observation_id":"12f8b749-040f-43c5-8b53-40e58d7eadc2","resolution":{"observed_at":"2026-05-23T08:02:43.364774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7d3f5bbd-bc41-43d4-8058-7512a7746ca1","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:5df832815b5d53c0a27488d30cac6d50dbc6ac6f8c43e601c3596b7a0013ebe9","observation_id":"45af72aa-623e-4f94-ba08-46a4a7194f8a","resolution":{"observed_at":"2026-05-23T08:02:44.884834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eb76c57b-f5fb-4d9e-bef0-2435f0da5519","year":2021},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:4d479a42b59b29706bf2b6b12b55eacc5a1364ffa63e8d394d9a17a843980cde","observation_id":"c4b4d029-4673-4c35-b1cf-9ed6b12f31c3","resolution":{"observed_at":"2026-05-23T08:02:44.895820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2688.2022","doi":"10.1109/cvpr52688.2022","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A ConvNet for the 2020s","venue":null,"work_id":"0a23d1b7-bd56-43cc-8a80-7c43ce994e1e","year":2022},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:117a68a03f238da9d6618556917f489c72a460e1f6c0c8eefa12d2d40e46f5ff","observation_id":"47482999-d34e-4df9-af07-255c6ebbf320","resolution":{"observed_at":"2026-05-23T08:02:43.100989Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T17:19:41.038772+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T17:19:41.038772+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ff76eeb2-21fe-46ae-bb70-0031c685a7ac","year":2022},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:9cfb89300edc41deed2b9b23247976380c3b3e9398802bd088a3e6dabbf3ccda","observation_id":"99750f1f-d414-4958-b0a2-13f5878fe2be","resolution":{"observed_at":"2026-05-23T08:02:44.852373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"02bdb646-70db-42cd-a7df-f75223ab873c","year":2016},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:d54cd8176178f15bfe5200532ab375149608ba0d2f05d619617469c76ec65a88","observation_id":"dda9354f-b947-44fa-b6fa-d1d3164f9ebe","resolution":{"observed_at":"2026-05-23T08:02:44.875083Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06527","last_updated":"2025-02-20T02:55:52Z","snapshot_observed_at":"2026-07-06T20:34:02.031605Z","submitted_at":"2025-02-10T14:50:32Z","title":"CustomVideoX: 3D Reference Attention Driven Dynamic Adaptation for Zero-Shot Customized Video Diffusion Transformers","version":2},"cited_work":{"arxiv_id":"2502.06527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06527","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Customvideox: 3d reference attention driven dynamic adaptation for zero-shot customized video diffusion transformers","venue":null,"work_id":"0e0813ab-6006-419a-8846-ea13f8226b20","year":2025},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2502.06527","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:660564c2591932b7a0b75e3d53da1aa3b9c3b8bbdb163319dfb434ef772db91a","observation_id":"80c9d323-bb98-4d2f-aa1c-02fe1675b923","resolution":{"observed_at":"2026-05-23T08:02:43.354145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":"2406.06525","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-07-10T11:37:03.266757Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","venue":"cs.CV","work_id":"41efe203-9377-4c63-b1d6-e499cd6e46f6","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:836621eb2670b702a81c16eb8f074f1819980e966d4b6d414c52b2675d95a0fc","observation_id":"19bc07dc-343b-418e-9e7a-1ff367711a53","resolution":{"observed_at":"2026-05-23T08:02:43.240098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa4b2c91-4a4b-4883-a688-66e67495f851","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:a08fcb1119b6ab85f618ce019385e7be582ee21e6257c3dc594d34d5326be988","observation_id":"c914d491-be39-48b5-b3a1-fe69bac96c35","resolution":{"observed_at":"2026-05-23T08:02:44.845457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"73f84d47-e98a-4acb-a242-fbf32a9887f9","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:b7fd00bcd9320ea26d6bcb3979034a20ccb4757b41d237a507f200ec0ffe34b6","observation_id":"02c0d635-4087-497b-b023-8c9bf7da8c9d","resolution":{"observed_at":"2026-05-23T08:02:44.849259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"a m \\\"a l \\","venue":null,"work_id":"4f4c6d77-3a96-46de-bf0d-d568d8f7e7ff","year":2023},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:7079f1593fdf18848413242028d24c57c3f41d5bc336b9a88f4244e7e039a595","observation_id":"6f39fc07-9048-44f9-bb0c-eeb9b6d5878c","resolution":{"observed_at":"2026-05-23T08:02:44.878262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:c0f39301be435a9b39650b6a0e8953f9cf2a10930677134a26e7a48bee49cba1","observation_id":"2eee3215-ed7b-4ab7-ae04-6a8fddd5f452","resolution":{"observed_at":"2026-05-23T08:02:43.370211Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10291","last_updated":"2025-03-13T12:03:37Z","snapshot_observed_at":"2026-08-07T21:25:47.268391Z","submitted_at":"2025-03-13T12:03:37Z","title":"VisualPRM: An Effective Process Reward Model for Multimodal Reasoning","version":1},"cited_work":{"arxiv_id":"2503.10291","doi":"10.48550/arxiv.2503.10291","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.10291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VisualPRM: An effective process reward model for multimodal reasoning","venue":"ArXiv.org","work_id":"46b472b9-53d9-497b-9538-71913aa4aa92","year":2025},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2503.10291","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:d37a0d3a6280fb4c06c3464b40b58c0a43c82f67e1aa1582c41ab3584bccaed0","observation_id":"0357deb5-f945-4f28-954b-f79a9557f837","resolution":{"observed_at":"2026-05-23T08:02:43.301816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07209","last_updated":"2025-03-04T06:21:26Z","snapshot_observed_at":"2026-07-06T18:28:51.180903Z","submitted_at":"2024-06-11T12:32:53Z","title":"MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance","version":3},"cited_work":{"arxiv_id":"2406.07209","doi":"10.48550/arxiv.2406.07209","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07209","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi Wang, Yinan He, Yizhuo Li, Kunchang Li, Jiashuo Yu, Xin Ma, Xinhao Li, Guo Chen, Xinyuan Chen, Yaohui Wang, et al","venue":"arXiv (Cornell University)","work_id":"273757ff-d85e-4208-bb7c-e5881a8119e4","year":2025},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2406.07209","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:de7a84877236f1b4413e178cc736300b480c11d2a8c061444a752f4e37c1e55c","observation_id":"f2f202ca-55c7-436d-ad5d-3d1d62dda530","resolution":{"observed_at":"2026-05-23T08:02:43.066441Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":"2409.18869","doi":"10.48550/arxiv.2409.18869","metadata_source":"pith","pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emu3: Next-Token Prediction is All You Need","venue":"cs.CV","work_id":"720d288e-fac0-464c-9929-19efd9a52afc","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:69d654c36efc4ffea646a5b7896009367032cf6398cc10409ce19193e0b063b6","observation_id":"9438b33d-66df-4c53-a501-bcf468df31e5","resolution":{"observed_at":"2026-05-23T08:02:43.307168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.01298","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T08:16:48.466289Z","title":"Mint: Multi-modal chain of thought in unified generative models for enhanced image generation.arXiv:2503.01298, 2025","venue":null,"work_id":"bda48dc3-bde2-49bc-9fc7-9a75d20d7f00","year":2025},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:de69cfb5e04071feb114727a46bcfe4c0c649acc8dbf9e0d9c8c013166ed872f","observation_id":"41a4428c-a675-4031-b3b8-9c4247367081","resolution":{"observed_at":"2026-05-23T08:02:43.288428Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c292c000-65b6-4075-8096-185ad8accc73","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:e379828794504245f1cc6d727b077e6d4319745a7e2ca04cc5bdeea6af3fd874","observation_id":"2da67082-53bb-4547-b4ec-1214a1221650","resolution":{"observed_at":"2026-05-23T08:02:44.842223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-07-06T15:43:07.989730Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2306.09341","doi":"10.48550/arxiv.2306.09341","metadata_source":"pith","pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","venue":"cs.CV","work_id":"40702548-f094-4c67-a5db-a62f426f852e","year":2023},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:719f333787a4959f544edabdf3a057d6140dc02e5deed0e7107cf5eb638b9e80","observation_id":"a3ae2f24-d652-48d1-90e9-5d658f17e546","resolution":{"observed_at":"2026-05-23T08:02:43.393708Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14339","last_updated":"2024-08-26T15:08:12Z","snapshot_observed_at":"2026-08-06T09:18:54.806043Z","submitted_at":"2024-08-26T15:08:12Z","title":"ConceptMix: A Compositional Image Generation Benchmark with Controllable Difficulty","version":1},"cited_work":{"arxiv_id":"2408.14339","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14339","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conceptmix: A com- positional image generation benchmark with controllable difficulty","venue":null,"work_id":"9b1c96b9-fc05-4169-8d7d-0fd246cfd2fd","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2408.14339","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:aa3f2b600595263ad69f56dfdf96d6b3f3ff48ed4512ba14fe192fb997281c03","observation_id":"ab610bf9-60d9-4db1-a95b-78301aa662b8","resolution":{"observed_at":"2026-05-23T08:02:43.222176Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14233","last_updated":"2025-01-06T13:58:45Z","snapshot_observed_at":"2026-08-06T04:19:00.792438Z","submitted_at":"2024-04-22T14:46:10Z","title":"Detecting and Mitigating Hallucination in Large Vision Language Models via Fine-Grained AI Feedback","version":2},"cited_work":{"arxiv_id":"2404.14233","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.14233","snapshot_observed_at":"2026-07-04T03:19:30.624198Z","title":"Detecting and mitigating hallucination in large vision language models via fine-grained ai feedback","venue":null,"work_id":"363d4f3b-36b2-4a84-a740-6feee730f332","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2404.14233","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:b5e732f0692d7e64aecf15ee3b2a5f6217e7feb8a9862b2cd5c375d02ca429d2","observation_id":"88bb567c-e926-4e7a-b70e-0b643059a907","resolution":{"observed_at":"2026-05-23T08:02:43.313619Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-07-06T19:36:45.701678Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:4c6c44d0ed9c196308fc5a5483a336bb2569b92d54cb635a7d3820c58f170725","observation_id":"519dfa99-5557-425f-8788-51f51b6b75ce","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"419e7a90-d8c8-4905-b225-f43c505fd4e6","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:436df2ad5f77213bf7b1e42aadc108d408b7fedfe25d88e52ff1d7d4b4106288","observation_id":"8e511445-2a67-46f7-85d7-499ef6190a85","resolution":{"observed_at":"2026-05-23T08:02:44.838965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":"2206.10789","doi":"10.48550/arxiv.2206.10789","metadata_source":"pith","pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","venue":"cs.CV","work_id":"0a105815-ff2e-43ce-8566-966cdcae1af4","year":2022},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:f0141776cc7c476d15dc810a9bdf27780aa8f8b5ecbfb4083b5ac7fd73a1d3c3","observation_id":"9d8816d3-7bb2-4e7a-9683-94a1d219df76","resolution":{"observed_at":"2026-05-23T08:02:43.331108Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01361","last_updated":"2023-11-02T16:11:09Z","snapshot_observed_at":"2026-08-02T05:59:18.612817Z","submitted_at":"2023-11-02T16:11:09Z","title":"GPT-4V(ision) as a Generalist Evaluator for Vision-Language Tasks","version":1},"cited_work":{"arxiv_id":"2311.01361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.01361","snapshot_observed_at":"2026-07-04T19:50:10.159661Z","title":"arXiv preprint arXiv:2311.01361 , year=","venue":null,"work_id":"e6312c2f-443e-483c-829a-68c7cc05eb4e","year":2023},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2311.01361","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:bc331c7839ade0a072d59441ba99ac8d57a5bd72d790af25678d73ff04e54fd0","observation_id":"a7874158-7cd8-4d9c-b8a6-0879cefef147","resolution":{"observed_at":"2026-05-23T08:02:43.269386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16272","last_updated":"2024-03-14T10:44:49Z","snapshot_observed_at":"2026-08-05T10:16:10.209837Z","submitted_at":"2023-12-26T14:39:11Z","title":"SSR-Encoder: Encoding Selective Subject Representation for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":"2312.16272","doi":"10.48550/arxiv.2312.16272","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.16272","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"arXiv (Cornell University)","work_id":"9e562ed4-318a-416d-bb76-8e98bbd851fe","year":2023},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2312.16272","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:41db521207a6f8e27a879eec7b9ebe038d34e2d059b9ddbce06a21c95b9081f9","observation_id":"9df727a5-eb7b-4d0e-8911-b6742226a8fd","resolution":{"observed_at":"2026-05-23T08:02:43.080070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09997","last_updated":"2024-02-15T15:02:46Z","snapshot_observed_at":"2026-08-07T18:58:03.665110Z","submitted_at":"2024-02-15T15:02:46Z","title":"LoraRetriever: Input-Aware LoRA Retrieval and Composition for Mixed Tasks in the Wild","version":1},"cited_work":{"arxiv_id":"2402.09997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.09997","snapshot_observed_at":"2026-07-03T04:47:38.609955Z","title":"Loraretriever: Input-aware lora retrieval and composition for mixed tasks in the wild","venue":null,"work_id":"8c4c5257-7f07-412c-92a5-dd674f1d858c","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2402.09997","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:cc9697516f6f9ec82d7a6fea229bcf6de0642864801fb6c04214b1fdde1c8993","observation_id":"dcdb400b-c8c0-4af9-8a94-4df983a5b122","resolution":{"observed_at":"2026-05-23T08:02:43.230552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T15:21:13.256394Z","title":"online\" 'onlinestring :=","venue":null,"work_id":"f969ad36-6879-4127-aa9a-2fab0f2ec82b","year":null},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:478879d68ecafdb51c0ab5c70894c54123d533e371470fa8f0e8dd35634d7982","observation_id":"e1754af9-60a8-45df-926c-0fe09712cf94","resolution":{"observed_at":"2026-05-23T08:02:44.835085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:56:11.963345Z","title":"write newline","venue":null,"work_id":"b6ace3ad-bd44-4a95-86ee-c7b73bd4cda2","year":null},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:fb7cbe8dee4c1629c151a01ed4cf1846e42ae67a999a1f10c4ce5b843e31ae89","observation_id":"211fe17a-5a30-42ed-920b-7def1ede29b5","resolution":{"observed_at":"2026-05-23T08:02:44.830816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T07:59:46.765003Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":29,"verified_exact":31,"verified_fuzzy":4},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 2 inbound Pith citation observations for arXiv:2412.04300."}