{"as_of":"2026-08-22T12:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e6e743032d83543595e330c3aafe7ea1281b66fb550ccf74bda94de6a517aa0f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":59,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:35:43.571101Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-07T13:23:47.427719Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-12T15:54:23.988818Z","title":"GenAI-Bench: Evaluat- ing and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-20T21:12:51.676578Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.988818Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:be9916e5cca85cdbcd022e942c0f07e800198659fd40622c12d20aba321c7192","observation_id":"fffa1bfe-1607-440d-97e7-b7bc8f092de5","resolution":{"observed_at":"2026-08-12T15:54:23.988818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-12T14:55:42.098059Z","title":"Genai-bench: Evaluating and im- proving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14808","last_updated":"2025-03-02T08:53:47Z","snapshot_observed_at":"2026-08-19T13:28:24.510124Z","submitted_at":"2024-11-22T09:08:58Z","title":"High-Resolution Image Synthesis via Next-Token Prediction","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T14:55:42.098059Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2411.14808"},"observation_digest":"sha256:a879bb4ee67e898a42bd413ff957eb0a78feeecb8fdc4d6ae5cd5ef7049ee78d","observation_id":"c00f906e-fc29-4576-8777-748cefb19812","resolution":{"observed_at":"2026-08-12T14:55:42.098059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-11T22:45:32.398178Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.398178Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:97c67dab81d7e50efcf68bfa44130ddcfe725cb2276b37cc11c5e0ab70b472f8","observation_id":"376e513f-6908-436a-b939-e06b0f8971c1","resolution":{"observed_at":"2026-08-11T22:45:32.398178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-15T01:57:23.693588Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:bb0648bace6a9d691f24589c633e0bcbd8bd9f0d204a987c4ea77888fd4332ab","observation_id":"009c486e-e436-413d-a1e7-b38533cac5f6","resolution":{"observed_at":"2026-05-23T08:02:43.382527Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-11T15:50:16.760415Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10604","last_updated":"2024-12-18T17:49:32Z","snapshot_observed_at":"2026-08-18T04:13:34.486226Z","submitted_at":"2024-12-13T23:15:35Z","title":"EvalGIM: A Library for Evaluating Generative Image Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T15:50:16.760415Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2412.10604"},"observation_digest":"sha256:928828e5a67b66dc321712b57d1cacf0b5036148eac3175e54beb1b8762cb965","observation_id":"a6f06a76-e92b-4222-bda5-9dcebc36ae81","resolution":{"observed_at":"2026-08-11T15:50:16.760415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-11T05:02:20.998785Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18150","last_updated":"2024-12-25T15:00:36Z","snapshot_observed_at":"2026-08-19T18:58:04.469177Z","submitted_at":"2024-12-24T04:08:25Z","title":"EvalMuse-40K: A Reliable and Fine-Grained Benchmark with Comprehensive Human Annotations for Text-to-Image Generation Model Evaluation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T05:02:20.998785Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2412.18150"},"observation_digest":"sha256:2fb4cf5b7b37814bac0072c18ea5c07629fd229f19a66acc33cd0955131e9fc4","observation_id":"cb6b0374-f776-4503-8711-0803822a4cb4","resolution":{"observed_at":"2026-08-11T05:02:20.998785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2503.07265","last_updated":"2026-06-02T17:11:50Z","snapshot_observed_at":"2026-08-16T12:51:32.079370Z","submitted_at":"2025-03-10T12:47:53Z","title":"WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T16:24:27.407376Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2503.07265"},"observation_digest":"sha256:fbd4dfe86e790263c1579661caaeae7aa3775b25dccf9f0c7cb632947911783c","observation_id":"d5891fbb-79d0-44d8-be45-48376fc8b49d","resolution":{"observed_at":"2026-05-15T16:24:27.632420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-16T10:35:43.571101Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation.arXiv preprint arXiv:2406.13743, 2024a","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.17789","last_updated":"2025-04-27T23:01:22Z","snapshot_observed_at":"2026-08-19T03:52:56.793330Z","submitted_at":"2025-04-24T17:59:56Z","title":"Token-Shuffle: Towards High-Resolution Image Generation with Autoregressive Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:43.571101Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2504.17789"},"observation_digest":"sha256:271c72f2c3376db98be26c0ae55dbb07d28001d7fe53bff604b064c089b35232","observation_id":"9b2c457f-ebf4-44f0-8d14-8898f957bb99","resolution":{"observed_at":"2026-08-16T10:35:43.571101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-16T04:43:11.304450Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00759","last_updated":"2025-05-12T20:46:35Z","snapshot_observed_at":"2026-08-16T09:38:06.751547Z","submitted_at":"2025-05-01T17:47:55Z","title":"Multi-Modal Language Models as Text-to-Image Model Evaluators","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T04:43:11.304450Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.00759"},"observation_digest":"sha256:3c805b571736f476480592dd58dac481efed7578d908aec6fb8eae779d6a620c","observation_id":"031f252d-3a54-4090-9bf8-ff7c55b0c9b9","resolution":{"observed_at":"2026-08-16T04:43:11.304450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-16T01:02:21.676638Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02236","last_updated":"2025-05-04T20:24:57Z","snapshot_observed_at":"2026-08-19T00:04:14.149977Z","submitted_at":"2025-05-04T20:24:57Z","title":"Improving Physical Object State Representation in Text-to-Image Generative Systems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T01:02:21.676638Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.02236"},"observation_digest":"sha256:5b8747b598af0bedebff446a7c80f05e73b1931d91c5e1c6d0b01fe1eec9599a","observation_id":"fa7aeb7f-a96e-4b26-ba40-5ed73e0c247c","resolution":{"observed_at":"2026-08-16T01:02:21.676638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-16T00:00:51.595885Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-22T02:16:39.350583Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.595885Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:a9095535be73ddfd2a1bf3c876801a5b4e3742798d354e1881eecfd9cdb8282e","observation_id":"81838fe5-29bc-4b25-8eb6-c8fbb5e161c5","resolution":{"observed_at":"2026-08-16T00:00:51.595885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-15T23:21:13.126285Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-21T05:30:31.348509Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"reference_index":233,"source":"arxiv_source","source_observed_at":"2026-08-15T23:21:13.126285Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.04921"},"observation_digest":"sha256:6b3b9f3e1cf1d637cb6175ddef5e1410a8ff17181608c70c6655951b8a78ec4a","observation_id":"712bbeb4-4630-4507-975e-d301c26d874b","resolution":{"observed_at":"2026-08-15T23:21:13.126285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-07T15:09:44.988041Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16314","last_updated":"2025-05-22T07:12:36Z","snapshot_observed_at":"2026-08-18T03:22:25.137553Z","submitted_at":"2025-05-22T07:12:36Z","title":"NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:44.988041Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.16314"},"observation_digest":"sha256:bfc84afaa02412345aadce79d1d7453d70ae03552ad18389ae5162f793b910d3","observation_id":"a8ab0b5e-2c44-4626-a456-6b8df16829bd","resolution":{"observed_at":"2026-08-07T15:09:44.988041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-07T14:29:16.838722Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18730","last_updated":"2025-05-24T14:56:09Z","snapshot_observed_at":"2026-08-16T14:15:52.264369Z","submitted_at":"2025-05-24T14:56:09Z","title":"Align Beyond Prompts: Evaluating World Knowledge Alignment in Text-to-Image Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:16.838722Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.18730"},"observation_digest":"sha256:0b10dccb8c89754cb01f6f0ab64bfdb1c917adfb41b95057a0c5b5de0a5e70d2","observation_id":"1bd714eb-f125-4c00-9927-2646a537b6fc","resolution":{"observed_at":"2026-08-07T14:29:16.838722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-07T14:17:34.670156Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19415","last_updated":"2025-05-27T20:10:09Z","snapshot_observed_at":"2026-08-17T01:54:45.003378Z","submitted_at":"2025-05-26T02:07:24Z","title":"MMIG-Bench: Towards Comprehensive and Explainable Evaluation of Multi-Modal Image Generation Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:34.670156Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.19415"},"observation_digest":"sha256:89eeb1dce489510db2915895b8f563821902cf8622d169432f5d416d429a6bc4","observation_id":"a6d82efc-93f1-4e0a-9be3-468e66cde8ea","resolution":{"observed_at":"2026-08-07T14:17:34.670156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-07T12:48:52.975148Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23493","last_updated":"2025-05-29T14:43:46Z","snapshot_observed_at":"2026-08-17T00:12:26.393808Z","submitted_at":"2025-05-29T14:43:46Z","title":"R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:48:52.975148Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.23493"},"observation_digest":"sha256:e44513b7fca7e21da14b0fbda960b6bd72d296461841e51620a8d6da0f14f5d1","observation_id":"836d8399-db45-4cb3-84f0-0bbc4b029464","resolution":{"observed_at":"2026-08-07T12:48:52.975148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-07T05:25:44.179662Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07977","last_updated":"2025-06-26T15:47:09Z","snapshot_observed_at":"2026-08-16T19:31:18.122184Z","submitted_at":"2025-06-09T17:50:21Z","title":"OneIG-Bench: Omni-dimensional Nuanced Evaluation for Image Generation","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:25:44.179662Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2506.07977"},"observation_digest":"sha256:77c43c9856f640408c92d7248ce412f5afc309ab07670d69d79ab77aa0738ab5","observation_id":"57a1ef34-babb-4bcd-8a90-6077c31f9dce","resolution":{"observed_at":"2026-08-07T05:25:44.179662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-07T05:20:51.096656Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation.arXiv preprint arXiv:2406.13743, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08210","last_updated":"2025-06-09T20:29:53Z","snapshot_observed_at":"2026-08-13T15:52:16.724752Z","submitted_at":"2025-06-09T20:29:53Z","title":"A Comprehensive Study of Decoder-Only LLMs for Text-to-Image Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:51.096656Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2506.08210"},"observation_digest":"sha256:e5685f21558c2b2a00efed1487616b918250709d5e437f4d71bc6775f74f2a12","observation_id":"4093adbf-4e7f-4333-9802-e5abbf15e686","resolution":{"observed_at":"2026-08-07T05:20:51.096656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-07T05:14:43.654181Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09081","last_updated":"2025-07-28T19:31:25Z","snapshot_observed_at":"2026-08-14T15:34:17.408928Z","submitted_at":"2025-06-10T04:19:02Z","title":"FlagEvalMM: A Flexible Framework for Comprehensive Multimodal Model Evaluation","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:14:43.654181Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2506.09081"},"observation_digest":"sha256:c11da77678c59485b103e06a46ffb70ff937b896feec1864ed11cb0e4c9a9d57","observation_id":"c609c333-7627-4635-9bbd-fa9e148f5191","resolution":{"observed_at":"2026-08-07T05:14:43.654181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-08-14T01:48:52.921086Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T16:36:02.016696Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2506.15742"},"observation_digest":"sha256:530f8017ef3c6017d8db00630f809f532f33af6b32375b208cec5965fecf206d","observation_id":"a7b6832e-462a-4b40-b691-402e80d01c12","resolution":{"observed_at":"2026-05-10T16:36:02.124232Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-06T21:03:01.652996Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01255","last_updated":"2025-07-02T00:20:06Z","snapshot_observed_at":"2026-08-15T02:03:45.493317Z","submitted_at":"2025-07-02T00:20:06Z","title":"AIGVE-MACS: Unified Multi-Aspect Commenting and Scoring Model for AI-Generated Video Evaluation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T21:03:01.652996Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2507.01255"},"observation_digest":"sha256:c1c89ab450569495001fb5fbfc6a81a0efc52734d3603fef36761311ae969a55","observation_id":"e00c755e-965c-4a5d-baba-242b3ce242be","resolution":{"observed_at":"2026-08-06T21:03:01.652996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-06T18:52:39.016490Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07105","last_updated":"2025-07-09T17:59:19Z","snapshot_observed_at":"2026-08-17T14:15:07.534062Z","submitted_at":"2025-07-09T17:59:19Z","title":"4KAgent: Agentic Any Image to 4K Super-Resolution","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-06T18:52:39.016490Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2507.07105"},"observation_digest":"sha256:ba500a92931c2e3b78122816b9f8b327db70b32a732ed480778e4564a711fbb9","observation_id":"00571947-fd5a-4889-aa9f-1a4e481338b5","resolution":{"observed_at":"2026-08-06T18:52:39.016490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-15T18:16:44.456825Z","title":"Genai-bench: Evaluat- ing and improving compositional text-to-visual gener- ation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18374","last_updated":"2025-07-24T12:50:46Z","snapshot_observed_at":"2026-08-20T09:17:50.652250Z","submitted_at":"2025-07-24T12:50:46Z","title":"Towards Effective Human-in-the-Loop Assistive AI Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:16:44.456825Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2507.18374"},"observation_digest":"sha256:bbffd26aa4889f8f822696efb7120e18c97fa7b865178b2a5c66fae50164b004","observation_id":"dc4ce276-d8bb-4f72-b948-675d50d021df","resolution":{"observed_at":"2026-08-15T18:16:44.456825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-06T12:08:01.739030Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22100","last_updated":"2025-07-29T17:59:16Z","snapshot_observed_at":"2026-08-14T05:11:21.393015Z","submitted_at":"2025-07-29T17:59:16Z","title":"Trade-offs in Image Generation: How Do Different Dimensions Interact?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T12:08:01.739030Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2507.22100"},"observation_digest":"sha256:39fb1c8e9ae16cc28c2d714ba419958b3f6479619ec97292fde4abb6debb68bb","observation_id":"8c680697-6155-42b6-8e81-e2a24850fc4a","resolution":{"observed_at":"2026-08-06T12:08:01.739030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-05T20:44:13.367107Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09987","last_updated":"2025-08-13T17:59:28Z","snapshot_observed_at":"2026-08-19T18:52:45.346695Z","submitted_at":"2025-08-13T17:59:28Z","title":"Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T20:44:13.367107Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2508.09987"},"observation_digest":"sha256:c3645618a3ed1564369923ac155198c4c2170f561e27bd940da9e5d223531cde","observation_id":"d33fa69b-7a28-4909-9114-fbebdc2da3be","resolution":{"observed_at":"2026-08-05T20:44:13.367107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-05T14:43:49.808398Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21032","last_updated":"2025-08-28T17:35:03Z","snapshot_observed_at":"2026-08-13T14:40:57.080958Z","submitted_at":"2025-08-28T17:35:03Z","title":"Reusing Computation in Text-to-Image Diffusion for Efficient Generation of Image Sets","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T14:43:49.808398Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2508.21032"},"observation_digest":"sha256:ad9a05306c4cd1aba1e2ad0838728c0971248288d406760dfc6a6dd78ff52fb0","observation_id":"1b15b544-8055-4470-8502-c0d2b6fc4c0a","resolution":{"observed_at":"2026-08-05T14:43:49.808398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-04T18:48:03.732027Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation.arXiv preprint arXiv:2406.13743, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09680","last_updated":"2025-09-11T17:59:59Z","snapshot_observed_at":"2026-08-20T21:06:45.900297Z","submitted_at":"2025-09-11T17:59:59Z","title":"FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T18:48:03.732027Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2509.09680"},"observation_digest":"sha256:df2b01df06fe7b7e6248ca6172fd3ebbbea36dbb4c0b22140af240bf9fafd769","observation_id":"817fe4d2-c078-4b26-b7d9-ae1f0aec9d92","resolution":{"observed_at":"2026-08-04T18:48:03.732027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-03T17:42:43.835726Z","title":"Genai-bench: Evaluat- ing and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.08505","last_updated":"2026-06-28T19:01:59Z","snapshot_observed_at":"2026-08-18T03:22:28.683067Z","submitted_at":"2025-12-09T11:45:01Z","title":"Early Estimation of Language to Latent Alignment in Diffusion Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T17:42:43.835726Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2512.08505"},"observation_digest":"sha256:3fd0a5ad5d7abc383f8e1646d789bafc2f79393e1bd67d6e1ec6b105b0cbfdc1","observation_id":"9e2288a9-e8a4-4b19-85a0-1741d6505915","resolution":{"observed_at":"2026-08-03T17:42:43.835726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-03T05:41:50.523463Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation.arXiv preprint arXiv:2406.13743,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01658","last_updated":"2026-06-03T07:50:03Z","snapshot_observed_at":"2026-08-18T07:45:16.162747Z","submitted_at":"2026-02-02T05:24:31Z","title":"Efficient Adversarial Attacks on High-dimensional Offline Bandits","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-03T05:41:50.523463Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2602.01658"},"observation_digest":"sha256:dd57c8dec9a95cf3b367ff76b98ab296b4acf33c45d0ead34f768db69c4ba985","observation_id":"c3bcdb40-25d5-437a-b8f1-11cddfe3a4ac","resolution":{"observed_at":"2026-08-03T05:41:50.523463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-03T03:04:43.907476Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual gen- eration.arXiv preprint arXiv:2406.13743, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-12T17:14:29.445906Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:43.907476Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:880b956566b183c4a031cee10ced7c666215df54ba712e63e54f6df7229cff53","observation_id":"c3ab40fd-af2a-469c-ae65-5e2b8f8c5654","resolution":{"observed_at":"2026-08-03T03:04:43.907476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2603.00166","last_updated":"2026-05-11T07:16:33Z","snapshot_observed_at":"2026-08-14T05:34:40.144628Z","submitted_at":"2026-02-26T08:11:09Z","title":"Exploring the AI Obedience: Why is Generating a Pure Color Image Harder than CyberPunk?","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T19:15:11.575505Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2603.00166"},"observation_digest":"sha256:ea29196b76d2c03e8918e1dd17da074b84fea4bfaa64b9e6e512c67a6fd0bb79","observation_id":"69cea2fc-8951-494a-8d96-e5548f0ecd28","resolution":{"observed_at":"2026-05-15T19:16:31.468959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2604.08641","last_updated":"2026-04-09T17:30:10Z","snapshot_observed_at":"2026-08-15T05:11:10.086632Z","submitted_at":"2026-04-09T17:30:10Z","title":"On Semiotic-Grounded Interpretive Evaluation of Generative Art","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T18:35:53.179645Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2604.08641"},"observation_digest":"sha256:d3c11cc2e974af6fecfe0024ce37e7f1ea1c60b37e7ebf1fe291cc33e546a40d","observation_id":"13c95945-8010-4ad6-914c-d1fcba15056e","resolution":{"observed_at":"2026-05-11T00:20:52.709568Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2604.20157","last_updated":"2026-04-22T03:51:19Z","snapshot_observed_at":"2026-08-13T03:25:52.592184Z","submitted_at":"2026-04-22T03:51:19Z","title":"HumanScore: Benchmarking Human Motions in Generated Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T01:17:16.513512Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2604.20157"},"observation_digest":"sha256:3f9c52a20b797de5105d4f636feb783a4bb866ef07a52d96d3ec8559e0cb1019","observation_id":"6a32781a-b527-43d7-82f3-65dbd40bec98","resolution":{"observed_at":"2026-05-11T13:41:04.347648Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2604.20329","last_updated":"2026-06-03T18:02:24Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T08:23:48Z","title":"Image Generators are Generalist Vision Learners","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T01:14:05.034951Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2604.20329"},"observation_digest":"sha256:771e60c79577c88c53f4a070f21a10c9fe71925655de107f47a0f14e34538732","observation_id":"32463b92-e760-475d-8085-4653538e6cd4","resolution":{"observed_at":"2026-05-11T13:41:06.134499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2604.20329","last_updated":"2026-06-03T18:02:24Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T08:23:48Z","title":"Image Generators are Generalist Vision Learners","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T07:40:46.090808Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2604.20329"},"observation_digest":"sha256:da794742019e2f0fd2b76ba7ab479cb74471c25fcb5397a48c4299d1763724ba","observation_id":"283e7cd2-6d6d-429e-8925-a71eca6cf748","resolution":{"observed_at":"2026-05-15T07:45:14.691380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2605.06170","last_updated":"2026-05-07T12:53:51Z","snapshot_observed_at":"2026-08-13T06:55:23.841654Z","submitted_at":"2026-05-07T12:53:51Z","title":"DynT2I-Eval: A Dynamic Evaluation Framework for Text-to-Image Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T13:54:00.141439Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2605.06170"},"observation_digest":"sha256:97668b0b5f3913317cc9595365136e20e9028f861c085d730ccb54b3af317711","observation_id":"83bbd6d8-da19-4878-aff4-eb58cfb26284","resolution":{"observed_at":"2026-05-11T18:46:10.544499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2605.13062","last_updated":"2026-05-13T06:33:54Z","snapshot_observed_at":"2026-08-17T02:25:29.632988Z","submitted_at":"2026-05-13T06:33:54Z","title":"Edit-Compass & EditReward-Compass: A Unified Benchmark for Image Editing and Reward Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T20:22:20.464966Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2605.13062"},"observation_digest":"sha256:9cefd199f7bb8398698dcee28cdd7b28b94cf23768362a5c534e83d6e7373034","observation_id":"90f61cbc-c0ed-42e3-8c56-36e56bd61672","resolution":{"observed_at":"2026-05-14T20:22:54.501735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2605.13974","last_updated":"2026-07-07T14:14:24Z","snapshot_observed_at":"2026-08-11T13:10:01.467370Z","submitted_at":"2026-05-13T18:00:12Z","title":"Few Channels Draw The Whole Picture: Revealing Massive Activations in Diffusion Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T05:58:55.640862Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2605.13974"},"observation_digest":"sha256:3ae5f335e6465eb36ecd487f58e20e79c7762b465bf82eb9444fe208c2422f7b","observation_id":"5db012ac-f001-4fc2-9543-e58e5fff7793","resolution":{"observed_at":"2026-05-15T05:59:48.815652Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-12T16:52:22.264276Z","title":"GenAI-Bench: Evaluating and improving compositional text-to-visual generation.arXiv preprint arXiv:2406.13743, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.13974","last_updated":"2026-07-07T14:14:24Z","snapshot_observed_at":"2026-08-11T13:10:01.467370Z","submitted_at":"2026-05-13T18:00:12Z","title":"Few Channels Draw The Whole Picture: Revealing Massive Activations in Diffusion Transformers","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T16:52:22.264276Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2605.13974"},"observation_digest":"sha256:f5eefda8333367ae34b7eb9fbca15eb33ed4907032474ee3efaff4150acd7d65","observation_id":"f4129ff1-c1a0-43b1-9001-6706b1fb21a9","resolution":{"observed_at":"2026-07-12T16:52:22.264276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2605.17602","last_updated":"2026-05-20T20:58:48Z","snapshot_observed_at":"2026-08-02T06:34:30.012151Z","submitted_at":"2026-05-17T19:00:44Z","title":"AutoRubric-T2I: Robust Rule-Based Reward Model for Text-to-Image Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T12:11:23.775843Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2605.17602"},"observation_digest":"sha256:beed09d02de79250edf306ab22eea38610a9093c9b54e08b8a57529cc6873d4a","observation_id":"526d8ec4-e8c5-4d8e-ac59-387d73ae046d","resolution":{"observed_at":"2026-05-20T12:13:16.139717Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2605.17602","last_updated":"2026-05-20T20:58:48Z","snapshot_observed_at":"2026-08-02T06:34:30.012151Z","submitted_at":"2026-05-17T19:00:44Z","title":"AutoRubric-T2I: Robust Rule-Based Reward Model for Text-to-Image Alignment","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T09:19:39.848194Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2605.17602"},"observation_digest":"sha256:c70ea2441b1b9f852369a1679630b3a9bb800f5b6cd98b1a3ad322e4887e944e","observation_id":"ab9d56a3-38b7-4d84-8e9d-cb1af0d9c4db","resolution":{"observed_at":"2026-05-22T09:21:21.381629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2605.18324","last_updated":"2026-05-18T12:42:34Z","snapshot_observed_at":"2026-08-20T04:08:02.089607Z","submitted_at":"2026-05-18T12:42:34Z","title":"Improved Baselines with Representation Autoencoders","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T11:40:14.358108Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2605.18324"},"observation_digest":"sha256:ec9f1424d33599a0fda134c86acfa5bd6253810693223468531538293e42f88d","observation_id":"1bf4a8e9-f5d5-495c-b01a-abb200617bf5","resolution":{"observed_at":"2026-05-20T11:43:15.287042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2605.19111","last_updated":"2026-05-18T20:57:07Z","snapshot_observed_at":"2026-08-16T03:45:31.372515Z","submitted_at":"2026-05-18T20:57:07Z","title":"FAGER: Factually Grounded Evaluation and Refinement of Text-to-Image Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T10:40:37.777253Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2605.19111"},"observation_digest":"sha256:1d1fc86bd14aebafe26e8336171e6c297a312381b7973bc4d5e2e756cd90d619","observation_id":"6847c576-9c14-42e9-b9f4-4a121e927b81","resolution":{"observed_at":"2026-05-20T10:43:12.583779Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2605.28091","last_updated":"2026-06-25T07:49:03Z","snapshot_observed_at":"2026-08-15T02:58:16.122211Z","submitted_at":"2026-05-27T07:46:43Z","title":"Qwen-Image-Bench: From Generation to Creation in Text-to-Image Evaluation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T14:05:25.988619Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2605.28091"},"observation_digest":"sha256:d42eaa06487b52762d9a05beba844cd48e130230c6a5458c512ec8712e3103a6","observation_id":"eae3f1c9-55fd-4969-bed2-cc8b7662be54","resolution":{"observed_at":"2026-06-29T14:13:30.367898Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2606.21498","last_updated":"2026-06-19T14:50:22Z","snapshot_observed_at":"2026-08-15T23:10:11.947357Z","submitted_at":"2026-06-19T14:50:22Z","title":"Balancing Performance and Diversity in GRPO Autoregressive Text-to-Image Post-Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T14:14:45.547957Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2606.21498"},"observation_digest":"sha256:a3d7dc142e45c976cac9ae4703f3bb81e5944d1db1ecf51c2b7c1f03b52881d6","observation_id":"75bb3396-436e-428e-a6d6-399bf5c2bf4e","resolution":{"observed_at":"2026-07-04T06:49:37.323604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2606.24888","last_updated":"2026-06-23T17:59:55Z","snapshot_observed_at":"2026-08-08T16:38:03.178919Z","submitted_at":"2026-06-23T17:59:55Z","title":"DiffusionBench: On Holistic Evaluation of Diffusion Transformers","version":1},"reference_index":163,"source":"arxiv_source","source_observed_at":"2026-06-26T00:06:11.951205Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2606.24888"},"observation_digest":"sha256:068792ffdc497cf57e63aba2a951d52f901d02b848df0345e7a1dff8d17a2aa8","observation_id":"35627ccb-01a3-4d97-8f7c-af6743445c11","resolution":{"observed_at":"2026-07-04T16:59:58.175350Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2606.26738","last_updated":"2026-07-15T11:15:44Z","snapshot_observed_at":"2026-08-12T22:11:57.422164Z","submitted_at":"2026-06-25T08:20:34Z","title":"Do Image Editing Models Understand Lighting?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T05:29:42.024146Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2606.26738"},"observation_digest":"sha256:46412e001e00f796e6f4f1b79056a1573c7682adbb87c986fd9002c19b031b3d","observation_id":"04b7e5aa-3c6e-4917-ac17-8378278fc930","resolution":{"observed_at":"2026-07-04T13:09:50.457779Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-02T10:10:09.220449Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation.arXiv preprint arXiv:2406.13743, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26738","last_updated":"2026-07-15T11:15:44Z","snapshot_observed_at":"2026-08-12T22:11:57.422164Z","submitted_at":"2026-06-25T08:20:34Z","title":"Do Image Editing Models Understand Lighting?","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T10:10:09.220449Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2606.26738"},"observation_digest":"sha256:e62bc745c5a1387f827884c56e4c615ff8271331ac739a842da0e96701a94540","observation_id":"b743acc6-2c6b-4af4-b431-f86c2087cd54","resolution":{"observed_at":"2026-08-02T10:10:09.220449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2607.01312","last_updated":"2026-07-01T17:51:08Z","snapshot_observed_at":"2026-08-05T09:02:18.107000Z","submitted_at":"2026-07-01T17:51:08Z","title":"KathaTrace: Diagnosing Semantic Trajectory Collapse in Generated Visual Narratives","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-03T21:14:13.641041Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2607.01312"},"observation_digest":"sha256:d27c9db07d8d96788c2fd5531840f85a0149cb7060af2ac59ebba27013a5cb0f","observation_id":"bf99cfa5-c3d5-4670-a33c-09f9076753aa","resolution":{"observed_at":"2026-07-03T21:18:58.049200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-11T18:59:01.561509Z","title":"arXiv preprint arXiv:2406.13743 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04461","last_updated":"2026-07-05T19:02:32Z","snapshot_observed_at":"2026-08-09T12:38:38.991970Z","submitted_at":"2026-07-05T19:02:32Z","title":"Flash-BoN: Instant Drafts for Inference-Time Scaling in Diffusion Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T18:59:01.561509Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2607.04461"},"observation_digest":"sha256:176c21240f3bd1ffc4843c11bfaf69ce9745367600efab400180f2bc1742b58d","observation_id":"0baa27bf-ac84-4a85-af00-b16d21e2ff83","resolution":{"observed_at":"2026-07-11T18:59:01.561509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":"2406.13743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-07T13:23:47.427719Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation","venue":"cs.CV","work_id":"ffa16d7b-7d66-45d0-a42d-0c4d621b7342","year":2024},"citing_paper":{"arxiv_id":"2607.05382","last_updated":"2026-07-24T20:32:35Z","snapshot_observed_at":"2026-08-21T06:11:55.881049Z","submitted_at":"2026-07-06T17:56:12Z","title":"Search Beyond What Can Be Taught: Evolving the Knowledge Boundary in Agentic Visual Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-07T13:18:50.793715Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2607.05382"},"observation_digest":"sha256:1eb335034dd6a42333f4ec72686cdc699d8145502b18b703cd68f0dc184236de","observation_id":"59690c0c-82df-4b81-b191-5f0036796de7","resolution":{"observed_at":"2026-07-07T13:23:47.429438Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-07-11T07:09:39.972776Z","title":"GenAI-Bench: Evaluating and improving compositional text-to-visual generation.arXiv preprint arXiv:2406.13743, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05382","last_updated":"2026-07-24T20:32:35Z","snapshot_observed_at":"2026-08-21T06:11:55.881049Z","submitted_at":"2026-07-06T17:56:12Z","title":"Search Beyond What Can Be Taught: Evolving the Knowledge Boundary in Agentic Visual Generation","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T07:09:39.972776Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2607.05382"},"observation_digest":"sha256:873fb68db195577ef1f22a58bdecd1da12475b18c87b0bfa581296c6ecedb8ae","observation_id":"e0e78e7b-7a1f-4c7a-9805-803dd4e3f3dd","resolution":{"observed_at":"2026-07-11T07:09:39.972776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-02T04:57:34.799559Z","title":"arXiv preprint arXiv:2406.13743 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13527","last_updated":"2026-07-15T07:26:05Z","snapshot_observed_at":"2026-08-20T14:17:53.213771Z","submitted_at":"2026-07-15T07:26:05Z","title":"VGIF-Score: Interpretable and Diagnostic Evaluation of Spatio-Temporal Instruction Following in Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T04:57:34.799559Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2607.13527"},"observation_digest":"sha256:d39975d3d048a4c1e94665a81ff3231d67ab7d36405874e59a3ef42b6067c4a5","observation_id":"978a0430-c666-4568-b00c-89b57bb9aab0","resolution":{"observed_at":"2026-08-02T04:57:34.799559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-01T08:39:38.560857Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation.arXiv preprint arXiv:2406.13743,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21072","last_updated":"2026-07-23T09:04:48Z","snapshot_observed_at":"2026-08-19T14:09:20.412548Z","submitted_at":"2026-07-23T09:04:48Z","title":"Show, Don't Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T08:39:38.560857Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2607.21072"},"observation_digest":"sha256:3ea3c85a156db5154e12773512ddba0bd6e79f070bad03567f30b45c3e951b83","observation_id":"61260bf7-9534-4614-98bc-bd70f4d3562e","resolution":{"observed_at":"2026-08-01T08:39:38.560857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-01T04:06:00.179125Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation.arXiv preprint arXiv:2406.13743, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22959","last_updated":"2026-07-25T00:02:37Z","snapshot_observed_at":"2026-08-18T09:34:19.137314Z","submitted_at":"2026-07-25T00:02:37Z","title":"HALLELUAI: A Hallucination-Aware AI System for Ultra-Realistic Image-to-Video Generation at Scale","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T04:06:00.179125Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2607.22959"},"observation_digest":"sha256:8c2d947ae227079626b4d86fd0557fdccd337fe9214439f80fb0967bfa08f68e","observation_id":"2754443a-4a4a-4a44-964a-a8ae94568356","resolution":{"observed_at":"2026-08-01T04:06:00.179125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-05T05:39:05.547200Z","title":"GenAI-Bench: Evaluating and improv- ing compositional text-to-visual generation.arXiv preprint arXiv:2406.13743,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03929","last_updated":"2026-08-14T15:48:59Z","snapshot_observed_at":"2026-08-19T23:10:53.494603Z","submitted_at":"2026-08-04T17:00:52Z","title":"Latent Reward Registers for Diffusion Preference Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T05:39:05.547200Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2608.03929"},"observation_digest":"sha256:5e1cdf2dfc6671b087a0039363332abe56e5fd1d4873b3d6b5abdb139d6dd2bb","observation_id":"12c620fe-5572-4908-bec4-40a4bd5cc03a","resolution":{"observed_at":"2026-08-05T05:39:05.547200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-08T00:41:15.241468Z","title":"GenAI-Bench: Evaluating and improv- ing compositional text-to-visual generation.arXiv preprint arXiv:2406.13743,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03929","last_updated":"2026-08-14T15:48:59Z","snapshot_observed_at":"2026-08-19T23:10:53.494603Z","submitted_at":"2026-08-04T17:00:52Z","title":"Latent Reward Registers for Diffusion Preference Alignment","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T00:41:15.241468Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2608.03929"},"observation_digest":"sha256:bfa54503d2c580ba11da9a0bcea72e1195ab03a1ffe07cbf13fc17e206e2268a","observation_id":"a90f5d99-d73b-4f90-bc75-21e879e8384e","resolution":{"observed_at":"2026-08-08T00:41:15.241468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-11T05:13:22.316438Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09873","last_updated":"2026-08-10T17:27:32Z","snapshot_observed_at":"2026-08-19T22:53:22.714666Z","submitted_at":"2026-08-10T17:27:32Z","title":"Sci-VBench: Evaluating Knowledge- and Reasoning-Intensive Video Generation in Science Domains","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T05:13:22.316438Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2608.09873"},"observation_digest":"sha256:c645ceb7c274687464235b52826acdf7e67ee5f7e21ef4f676689b976bd48118","observation_id":"646c45fc-7f83-48dc-8b61-75e135b1c6d2","resolution":{"observed_at":"2026-08-11T05:13:22.316438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-15T14:17:50.700719Z","title":"Li, J.; Li, D.; Xiong, C.; and Hoi, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11452","last_updated":"2026-08-11T21:30:53Z","snapshot_observed_at":"2026-08-19T21:34:01.075987Z","submitted_at":"2026-08-11T21:30:53Z","title":"TangPoetryBench: A Multi-Dimensional Benchmark and Rubric-Conditioned Evaluator for Poetry-to-Image Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:50.700719Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2608.11452"},"observation_digest":"sha256:6b2cc393eb790aaa1ce7eab9924898e2e43d0c9a2982f8930be139f4a9893616","observation_id":"c022f01b-7d78-42ed-9a41-f369b05b03fe","resolution":{"observed_at":"2026-08-15T14:17:50.700719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.13743/citation-record","integrity":"/paper/2406.13743/integrity","json":"/paper/2406.13743/citation-record.json","paper":"/paper/2406.13743"},"outbound":[],"paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T03:21:35.557463Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 59 inbound Pith citation observations for arXiv:2406.13743."}