{"as_of":"2026-08-07T09:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:da4ac8347f08be5e1dbd89a2e4e8265014cf2c77049137286eb3afe65acf0332","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:50:45.594128Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.08039/citation-record","integrity":"/paper/2507.08039/integrity","json":"/paper/2507.08039/citation-record.json","paper":"/paper/2507.08039"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.483254Z","title":"Spice: Semantic propositional image caption evaluation","venue":null,"work_id":"5ac42c24-2244-4af3-9cf3-e0c768d5a203","year":2016},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:41.446861Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:920b31ea245f13348db32580a8871c789f5a8d720663feefc07f8fe5b1363bfa","observation_id":"672c7f4d-1925-4abf-a807-390d7efa6e58","resolution":{"observed_at":"2026-08-06T18:50:52.487689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.467989Z","title":"dSprites: Disentanglement testing Sprites dataset","venue":null,"work_id":"fe4337ef-ba5c-4076-b8a1-30e15399d70b","year":2017},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:41.494522Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:4928825fe8a543649451c3a84278175fca304ab05865d83f51fa98381040b6d7","observation_id":"c00e4941-7380-4c81-8eba-cf3779dbc247","resolution":{"observed_at":"2026-08-06T18:50:52.473313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.453078Z","title":"Isolating sources of disentanglement in variational autoencoders","venue":null,"work_id":"daff37c4-9a37-4cd4-a252-22a77aac7d72","year":2018},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:41.572035Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:53176e7fd100b9680dfba70119434938411b78fb9252eaae87249b087efce6e3","observation_id":"a93b1c8d-090b-4cb2-84a3-efe09fd1fbfb","resolution":{"observed_at":"2026-08-06T18:50:52.457959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-07-06T08:19:12.871715Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.02050","snapshot_observed_at":"2026-08-06T18:50:41.661086Z","title":"Tiger: Text-to-image grounding for image caption evaluation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:41.661086Z"},"links":{"cited_paper":"/paper/1909.02050","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:b43c8ccb16e92a54d0a705e768d4dabe15752bdecccbf286687d6eaff4e470fb","observation_id":"7fb06671-0a1b-477d-bda8-0ac32e8ce279","resolution":{"observed_at":"2026-08-06T18:50:41.661086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.438099Z","title":"Semantic object accuracy for generative text-to-image synthesis","venue":null,"work_id":"b32db5f3-89df-4e9f-ade6-9ca1f3d81cc6","year":2020},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:41.729627Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:6ca9f406d8c8e44facfb958baeb94031038d15ac1e9c6674fe013b9383927f30","observation_id":"1ba19939-2dbf-431d-b028-02ae1ea49f82","resolution":{"observed_at":"2026-08-06T18:50:52.443429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.423722Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"c8d041bf-bfb6-4c7d-9e0a-0751b5ee2a9c","year":2020},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:41.827759Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:5ab0245262ea1f0f8c4e41a3d6bfa33c381ac899fd5a9baf041fed1ee3216779","observation_id":"681aa94f-acc3-4a0b-a444-172793f98672","resolution":{"observed_at":"2026-08-06T18:50:52.428413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.eval4nlp-1.4","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.804695Z","title":"ViLBERTScore: Evaluating Image Caption Using Vision-and-Language BERT","venue":null,"work_id":"8a347472-78e9-4994-9d0e-a56525619e95","year":2020},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:41.899434Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:dabea6432f273c4035cacc8350a172d9ecf6efa2e0c2b364e33e1cf52a9b506c","observation_id":"1ea7b5c3-bd6d-4031-afef-154a0f47db66","resolution":{"observed_at":"2026-08-06T18:50:46.004721Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-06T18:50:41.946784Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:41.946784Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:9a34141b4afcc20d85e963849c3fbaa4a7b8d82f4aad2f00043a22511f2c8757","observation_id":"dd713fea-710f-46ca-8b9c-cec7c1b94c2f","resolution":{"observed_at":"2026-08-06T18:50:41.946784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.409395Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"17a861fa-0a73-4ef5-86e2-1c3b0320ab5c","year":2021},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.013204Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:c6dc0f7a8fe6ff5b4683f592d8bab13c0638b04cffd09552020e3fe91e544b95","observation_id":"c5000945-6628-4af2-8ae1-72e6092eb04e","resolution":{"observed_at":"2026-08-06T18:50:52.414019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06794","last_updated":"2023-06-05T17:55:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-14T17:24:07Z","title":"PaLI: A Jointly-Scaled Multilingual Language-Image Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.06794","snapshot_observed_at":"2026-08-06T18:50:42.106867Z","title":"Pali: A jointly-scaled multilingual language-image model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.106867Z"},"links":{"cited_paper":"/paper/2209.06794","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:6de14f7ecb6a5200cc97dcac0640a6bfa5e671eb0e4e22bd237cbfd3c1b2e626","observation_id":"2b9bdbef-36a3-4397-ac66-b608920edf93","resolution":{"observed_at":"2026-08-06T18:50:42.106867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-06T18:50:42.191365Z","title":"Scaling Instruction-Finetuned Language Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.191365Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:a95b4255f6d082c259cd969d36e6295caf1902653ce21b09f174154ef1f95ded","observation_id":"e317251a-75bf-45a4-b535-0d4b1142d8a5","resolution":{"observed_at":"2026-08-06T18:50:42.191365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.393343Z","title":"Tise: Bag of metrics for text-to-image synthesis evaluation","venue":null,"work_id":"64ccff00-ec48-4648-b155-908759b03578","year":2022},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.260634Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:30e2f7370d0008aa418995ceeaef63a0fdbb32d9339d84c1c722d0680e3b26e2","observation_id":"84be4a5d-8577-4083-b372-4ffde6fa0697","resolution":{"observed_at":"2026-08-06T18:50:52.398152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10015","last_updated":"2023-10-27T17:24:04Z","snapshot_observed_at":"2026-07-06T14:32:48.360720Z","submitted_at":"2022-12-20T06:03:51Z","title":"Benchmarking Spatial Relationships in Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10015","snapshot_observed_at":"2026-08-06T18:50:42.353509Z","title":"Benchmarking spatial relationships in text-to-image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.353509Z"},"links":{"cited_paper":"/paper/2212.10015","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:45420029a7c6e837e099b72e69d8cdb054ebe39df7950864c47320dfb103c883","observation_id":"8dda9b9c-2267-4826-8203-8d08ffa3620f","resolution":{"observed_at":"2026-08-06T18:50:42.353509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.378479Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"b6c63b80-3dee-4c60-a19b-dc1bfb8d0e4f","year":2022},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.422468Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:30d7521d0a8914d2674f2f8c9db1fbcf10c90b3abb34db8a6e7a6507c21f808e","observation_id":"f5696f26-b643-4c17-9c4c-b3c19da2503a","resolution":{"observed_at":"2026-08-06T18:50:52.382755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.362412Z","title":"Perceptual artifacts localization for inpainting","venue":null,"work_id":"4383791c-db98-4051-8663-1a42f98a9651","year":2022},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.498879Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:e7dccf0a32bb079bddffe51358468419cd7d59f50eb24a1067baecd9d239abe8","observation_id":"8233d4d1-31ee-4b32-8aa7-b03ac57eae2d","resolution":{"observed_at":"2026-08-06T18:50:52.367902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10843","last_updated":"2023-05-26T02:01:54Z","snapshot_observed_at":"2026-07-06T15:29:08.848146Z","submitted_at":"2023-05-18T09:56:44Z","title":"X-IQE: eXplainable Image Quality Evaluation for Text-to-Image Generation with Visual Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10843","snapshot_observed_at":"2026-08-06T18:50:42.560008Z","title":"X-IQE: eXplainable Image Quality Evaluation for Text-to-Image Generation with Visual Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.560008Z"},"links":{"cited_paper":"/paper/2305.10843","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:3832e3f7a2a5ea54211856daa7a66758484a2f095803e9a6a87d18f02e072441","observation_id":"998fbf6b-b72d-4629-984e-d5b1ca5e6bc5","resolution":{"observed_at":"2026-08-06T18:50:42.560008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-06T18:50:42.666253Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answer- ing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.666253Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:4972d2e3daac1f1cf79d88a1a4a62bb690e03e00a8c9bbf467f30521fd4d75cd","observation_id":"676ddf00-af40-400e-bdb1-fad7f263a898","resolution":{"observed_at":"2026-08-06T18:50:42.666253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06350","last_updated":"2025-03-08T14:57:45Z","snapshot_observed_at":"2026-07-06T15:53:23.361639Z","submitted_at":"2023-07-12T17:59:42Z","title":"T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06350","snapshot_observed_at":"2026-08-06T18:50:42.784210Z","title":"T2I-CompBench: A Comprehensive Benchmark for Open-world Compositional Text-to- image Generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.784210Z"},"links":{"cited_paper":"/paper/2307.06350","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:acdb5996a472b320c06516782ee3ce4d01823f30cd81e16420d8cde0e79b7fa6","observation_id":"f2d2c8f5-04bc-4a5e-9d42-b0b4da157f9b","resolution":{"observed_at":"2026-08-06T18:50:42.784210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04749","last_updated":"2023-12-06T00:45:08Z","snapshot_observed_at":"2026-07-06T15:52:17.512993Z","submitted_at":"2023-07-10T17:54:57Z","title":"Divide, Evaluate, and Refine: Evaluating and Improving Text-to-Image Alignment with Iterative VQA Feedback","version":2},"cited_work":{"arxiv_id":"2307.04749","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.04749","snapshot_observed_at":"2026-08-06T18:50:46.802164Z","title":"Divide, Evaluate, and Refine: Evaluating and Improving Text-to-Image Alignment with Iterative VQA Feedback","venue":"cs.CV","work_id":"41162f67-9190-4f19-9178-1f48d319305a","year":2023},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.902586Z"},"links":{"cited_paper":"/paper/2307.04749","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:72a82ddbcb12a0112eadb94fccab77f4076855273ff749ad61f05d7feafc189b","observation_id":"019e1658-9345-48f1-8552-808eddfac566","resolution":{"observed_at":"2026-08-06T18:50:46.953840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.347103Z","title":"Stable Diffusion 3.5 Release","venue":null,"work_id":"934920ed-9671-47ac-8e32-af8e07a7e872","year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.014646Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:6851da1006dca8dd90b024497bf9e5670ac3371ea4ed3fd4f98328c351a9b121","observation_id":"cf8ca66f-62fa-4285-91bf-09d37e6896eb","resolution":{"observed_at":"2026-08-06T18:50:52.351497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.331815Z","title":"Explaining Latent Representations Of Generative Models With Large Multimodal Models","venue":null,"work_id":"623255a2-d171-483c-9074-de20f40b3486","year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.102948Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:5bfce7f91512ff5cac9727a22ee526475d4de834709a32462088897bdfee04ed","observation_id":"32290e6c-ed28-4b46-8815-448c07ba2594","resolution":{"observed_at":"2026-08-06T18:50:52.336640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:43.311742Z","title":"LatentExplainer: Explaining Latent Representations in Deep Generative Models with Multi-modal Foundation Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.311742Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:ce6e475946a54a86229a3d8d5a43ccaad9af14ad438652efc06fc246808d5507","observation_id":"3a63ed36-7107-409a-b665-ff62e7683487","resolution":{"observed_at":"2026-08-06T18:50:43.311742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.314837Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"cc4abefb-bbb1-4165-bb0c-0b5650bb8814","year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.373329Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:ed8f7bbdd4d0b5562ad3d77c3c77101bdbbfb88cec58d043e6a9cf07afb18d05","observation_id":"56212e30-dab5-48d4-b203-b1913a1e247b","resolution":{"observed_at":"2026-08-06T18:50:52.321235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.300031Z","title":"TIAM-A metric for evaluating alignment in Text-to-Image generation","venue":null,"work_id":"8e58de08-86f9-4ace-aeb9-a7614632676d","year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.424443Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:d1b9b6f63dbfa792e1d2612170da7b3ef89eee83a3ece6e46b071c944584a159","observation_id":"898d5781-1378-49ca-af78-e68bfea7f82d","resolution":{"observed_at":"2026-08-06T18:50:52.304616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11821","last_updated":"2025-01-29T08:48:10Z","snapshot_observed_at":"2026-07-06T17:46:20.935124Z","submitted_at":"2024-03-18T14:24:20Z","title":"A Survey on Quality Metrics for Text-to-Image Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11821","snapshot_observed_at":"2026-08-06T18:50:43.464173Z","title":"Evaluating Text to Image Synthesis: Survey and Taxonomy of Image Quality Metrics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.464173Z"},"links":{"cited_paper":"/paper/2403.11821","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:ba0eb9663a0d9f1bfe362ee0320087a17a2d0c98aa0668d395415ee78ed6b52b","observation_id":"ccd545f9-dcf6-4caf-af88-b1ac7bd2c4ce","resolution":{"observed_at":"2026-08-06T18:50:43.464173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14062","last_updated":"2025-03-08T10:27:55Z","snapshot_observed_at":"2026-08-03T22:44:01.266874Z","submitted_at":"2024-11-21T12:16:16Z","title":"MMGenBench: Fully Automatically Evaluating LMMs from the Text-to-Image Generation Perspective","version":2},"cited_work":{"arxiv_id":"2411.14062","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.14062","snapshot_observed_at":"2026-08-06T18:50:46.335683Z","title":"MMGenBench: Fully Automatically Evaluating LMMs from the Text-to-Image Generation Perspective","venue":"cs.CV","work_id":"31f30fcb-d213-4845-9e98-f6853d086120","year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.512312Z"},"links":{"cited_paper":"/paper/2411.14062","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:020fb343e73692f6799b1e2ecea9934e6cb145f972f6eee156e81cf2b6e7c3f6","observation_id":"17068afa-0c71-4cec-9951-a0b0225303ec","resolution":{"observed_at":"2026-08-06T18:50:46.486732Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01291","last_updated":"2024-06-18T07:09:55Z","snapshot_observed_at":"2026-07-06T17:54:07.815827Z","submitted_at":"2024-04-01T17:58:06Z","title":"Evaluating Text-to-Visual Generation with Image-to-Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01291","snapshot_observed_at":"2026-08-06T18:50:43.571364Z","title":"Evaluating Text-to-Visual Generation with Image-to-Text Generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.571364Z"},"links":{"cited_paper":"/paper/2404.01291","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:324c6ec6dc1c68adcf6c3b009783ca4bda9fb828c7981874d464ff95fa805b3c","observation_id":"df232a2a-1dff-4718-8067-9a7be0277a95","resolution":{"observed_at":"2026-08-06T18:50:43.571364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10695","last_updated":"2024-10-21T20:01:13Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T19:52:24Z","title":"Playground v3: Improving Text-to-Image Alignment with Deep-Fusion Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10695","snapshot_observed_at":"2026-08-06T18:50:43.618673Z","title":"Playground v3: Improving text-to-image alignment with deep-fusion large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.618673Z"},"links":{"cited_paper":"/paper/2409.10695","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:da473c5bd0d9811d3d7ca38955c21debd8049284029ee2bb9e9890fb7c55ca51","observation_id":"d8ca69b2-8667-48f6-b93e-685d041ce13e","resolution":{"observed_at":"2026-08-06T18:50:43.618673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07975","last_updated":"2025-03-24T08:33:32Z","snapshot_observed_at":"2026-07-06T19:49:17.129421Z","submitted_at":"2024-11-12T17:55:10Z","title":"JanusFlow: Harmonizing Autoregression and Rectified Flow for Unified Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07975","snapshot_observed_at":"2026-08-06T18:50:43.661487Z","title":"Janusflow: Harmonizing autoregression and rectified flow for unified multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.661487Z"},"links":{"cited_paper":"/paper/2411.07975","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:5028187343199ffd5c1599dd8f4e99a7e7193043e6ee1755e707780db08df961","observation_id":"ac84cb03-daeb-452c-8ef4-90f1026200c3","resolution":{"observed_at":"2026-08-06T18:50:43.661487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.284576Z","title":"What you see is what you read? improving text-image alignment evaluation","venue":null,"work_id":"7ae4a224-02c9-466b-9bf4-85acb8f29146","year":2024},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.732929Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:81349ad29de33178f3b1bdaaa61e1979f830c8db3cbe2fa6f1d04d65c70c63a7","observation_id":"a01a5c3e-6d90-4cbe-b2e6-c35df090a50e","resolution":{"observed_at":"2026-08-06T18:50:52.289862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-06T18:50:43.776828Z","title":"Janus-pro: Unified multimodal understanding and generation with data and model scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.776828Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:b1129ae365b10e003979a0b77fad05ab3ec2b57167f85a30ddef1e3796a6a1cb","observation_id":"d51e7695-4371-42a6-8ddc-0fdd422f370e","resolution":{"observed_at":"2026-08-06T18:50:43.776828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.256911Z","title":"square\" at 64x64 resolution 12 Stable Diffusion 3 Medium Stable Diffusion 3.5 Large Stable Diffusion 3.5 Large Turbo Figure 8: Sample images for prompt","venue":null,"work_id":"cc50fcc2-1764-42e8-89d4-d9c60082be24","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.847269Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:6138321e0e6578fa11ac44ea4bdda5c0f126c22a2c492f348a66646a187ed026","observation_id":"d2ea47be-36dd-4290-9286-85e2f144e528","resolution":{"observed_at":"2026-08-06T18:50:52.273418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.985262Z","title":null,"venue":null,"work_id":"e11093df-af29-4cc3-8956-cc11885b2e82","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.904018Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:adb57bd05d295bb3f4045fa57d465a548db5e4d656ea94f5acb704d62e1fc935","observation_id":"f372715f-f591-4c92-99fc-fbfe60bc8327","resolution":{"observed_at":"2026-08-06T18:50:52.098409Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.767775Z","title":null,"venue":null,"work_id":"7c12280d-452e-4c5c-8843-ca15fb9db57d","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:43.963764Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:91579cb831b6fa964552ba327651993abc69179b5dd5ad15235e8e720ed92a43","observation_id":"159eaed3-964b-40d6-ad39-2b64a04c1d76","resolution":{"observed_at":"2026-08-06T18:50:51.859541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.542038Z","title":"9.2 Hardware The section describes the hardware requirements to conduct our experiments successfully","venue":null,"work_id":"f5aee943-cc16-4548-9c2b-7b6cdf1013f4","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.021869Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:24138aaa990f4b685589bb80c1637de8d40daa85c56a2cfaf18f618a1607b6b5","observation_id":"7eb99f63-ce60-4f9b-97a2-cc39031e9a35","resolution":{"observed_at":"2026-08-06T18:50:51.650410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.257182Z","title":null,"venue":null,"work_id":"688f5226-b4b0-4df7-bbb0-c408297e208e","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.078741Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:5d5af9c41b07414e781ba7a7fa9a44a546eca93b6a076aa035c8a36e9b20760c","observation_id":"1ab43ab4-bece-437e-8527-b6f0123d0acd","resolution":{"observed_at":"2026-08-06T18:50:51.427835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.973714Z","title":null,"venue":null,"work_id":"73c9480c-6eb4-4f5e-ad86-70df843dcbba","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.127871Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:d3ad150500cab13449c05cc101c7a422e24f1805f3264eb75131fe44ba2918fd","observation_id":"58a01e06-5fb3-4a72-8499-3c4e583f69f4","resolution":{"observed_at":"2026-08-06T18:50:51.085143Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.892366Z","title":null,"venue":null,"work_id":"b942d62a-6be9-45a0-a8d5-5b549679db5c","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.169670Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:7535d9fff0e2cd3f647d03d37e5e7943f1088f041c6d4c66b2352db9d27a4af9","observation_id":"e1b63579-b05e-4156-b671-9155dbda718d","resolution":{"observed_at":"2026-08-06T18:50:50.959980Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.746089Z","title":null,"venue":null,"work_id":"8e09d6b2-1e83-4c45-8577-1a77c81f281c","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.243174Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:9c42062a796432f786dab3270e35b26fabef192daf2e9c59825527d3b0f1c5d3","observation_id":"21c320da-da5b-432b-81b5-9a9b984df03d","resolution":{"observed_at":"2026-08-06T18:50:50.799968Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.566802Z","title":"A combination of these 6 factors can completely define each image","venue":null,"work_id":"594301f3-23b2-438e-b548-54f9100e584f","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.297151Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:18a8d66f86fc210bb7d4479c3c05534b1098583d30d934bede5f3b365f3f7441","observation_id":"fa4f7a73-6f08-4dfa-a3cc-b80cc1ebcc5f","resolution":{"observed_at":"2026-08-06T18:50:50.626810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.441154Z","title":null,"venue":null,"work_id":"4f59e82e-78f7-4fe6-a0d7-00291d313976","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.347341Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:835bfe13c7155dab90f73c639a91b4436e64e55c01bb3edc43ddec142409fbe6","observation_id":"83e1251f-d8ed-4bbb-882c-9cb0b3e63d50","resolution":{"observed_at":"2026-08-06T18:50:50.492276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.286656Z","title":"Each value represents the exact pixel value in the 256 x 256 image","venue":null,"work_id":"985c8147-1bc8-4ef5-8066-15e695e6fb1f","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.412953Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:68f0ed56170998dce51cd26803fc9c08458208f9e54ce748a219be0f46b7993d","observation_id":"ae3a10da-3379-4387-9691-998329de0ac3","resolution":{"observed_at":"2026-08-06T18:50:50.349146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.107778Z","title":null,"venue":null,"work_id":"275312aa-6dd2-4f50-878c-5af64f3748a4","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.462339Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:e9fa8d24e0093966d353d6b774e8cfe667038fbb41979aca3255db740201b243","observation_id":"0c357dda-1450-4fd4-83cb-47874c593db3","resolution":{"observed_at":"2026-08-06T18:50:50.191504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.977962Z","title":"White shape on a black background","venue":null,"work_id":"365e7b26-507b-492f-acf4-f88fbb29ca80","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.530998Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:84feb1970f264ad6a9051ae1eefdf553ee2209f0899b78b6ecb37d04d0b31f84","observation_id":"fe8be106-ed5e-4ab6-8528-610db3593d3c","resolution":{"observed_at":"2026-08-06T18:50:50.036294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.844136Z","title":"Every possible combination of these factors lead to a 9216 image test dataset","venue":null,"work_id":"91ba3eff-9029-4397-8f9c-6a1a2258993d","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.585132Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:633a8c220dc38cd92db098b11e58c72fdd28a7f1e1a2b02165f3495e2e902977","observation_id":"e5d232f3-5cf4-4a52-9894-1cedc6d28509","resolution":{"observed_at":"2026-08-06T18:50:49.905328Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.673507Z","title":null,"venue":null,"work_id":"534f4ea0-e1dc-48d5-b40b-9093f31e6488","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.662733Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:b27827982644360c9409c29497f58757c3c84f43e066dd3301de9be63e70f445","observation_id":"ba770d24-3586-4a76-b96a-f2d93355af79","resolution":{"observed_at":"2026-08-06T18:50:49.754631Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.538160Z","title":null,"venue":null,"work_id":"b3ddbfd5-3484-48e5-a174-fba1b57efcae","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.758561Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:8555d1803b6b0cd88f2de022d396026e564f29ca04c6b415ca6a2cdd283e506f","observation_id":"ab485a05-204e-475f-bb9a-dc62f09e620e","resolution":{"observed_at":"2026-08-06T18:50:49.608706Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.364843Z","title":"This can be readily accomplished with statistical tests","venue":null,"work_id":"c901679d-fe16-4830-864b-259948195cf7","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.851356Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:6cbe3938705f8827230021abe88a182fcd9c95f77bf19a88714a53d825e9da84","observation_id":"1fca8a02-10e8-44c6-8d7d-c8cd64b56b1f","resolution":{"observed_at":"2026-08-06T18:50:49.442859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.201972Z","title":"Anderson statistic","venue":null,"work_id":"e43de05c-11f8-4200-8690-271d0aa60453","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.949996Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:52b4cb7ad2f0cd6f21f7236188108a916c2720457f84611ba52fde4920fa4c9b","observation_id":"bc4782f5-666d-4768-800d-92ad1873d470","resolution":{"observed_at":"2026-08-06T18:50:49.301215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.052613Z","title":"Dimensions belonging to this category do not capture anything meaningful in image generation","venue":null,"work_id":"157ddf24-4516-41d3-8e16-944e9bb093ad","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.039803Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:dfd7ad8569d80fcaabb916ef43143e6b769acf0637900f0faf10d2a07bcbe0f5","observation_id":"ed84aa50-44c8-43b9-b167-e7923b1f94de","resolution":{"observed_at":"2026-08-06T18:50:49.127512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.906331Z","title":"We observe only 1 factor of variation with change in values","venue":null,"work_id":"b5daed2d-9e53-4f9b-ab62-343b9932b0ed","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.119852Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:a2df442c6b86430e72ce4e947bef57b83ea4115832d7fdd35de93a3039b98279","observation_id":"2120bf3e-b459-496c-aa47-9ce0dd4ca11b","resolution":{"observed_at":"2026-08-06T18:50:48.979058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.608832Z","title":"Dimensions in this category form sub-groups which encode a particular factor of variation","venue":null,"work_id":"08604ccf-de9d-4956-ab3d-b355dda78a42","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.187630Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:4cd79c81cec23cbcf4b146da6c03f8c749ae602c54ac6c00b736790214731a56","observation_id":"5642f838-8d75-484d-a0cc-1f14c3e00d40","resolution":{"observed_at":"2026-08-06T18:50:48.833603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.303384Z","title":null,"venue":null,"work_id":"1ac0e9c5-ada7-42ed-a063-697eca2e9315","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.249575Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:b7365233515c4fca92ed7f8925e2ce2c0e0e37762dfd81258abf211421dc4705","observation_id":"79f68f74-6d42-4a2f-b5be-bff055d0084a","resolution":{"observed_at":"2026-08-06T18:50:48.447749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:47.957971Z","title":null,"venue":null,"work_id":"371683f5-edc8-4cd1-ae46-56421cf86eb8","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.359666Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:ea8cd647d27a298702e971b118ee75f3f9ae96275aeff6fd529eb8a4db6a8112","observation_id":"dc8ab3a8-4dcd-4afd-8977-28c7f2d136dd","resolution":{"observed_at":"2026-08-06T18:50:48.122984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:47.579961Z","title":null,"venue":null,"work_id":"0a5b7dce-76f5-4d13-bee7-83648f5f8267","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.468239Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:026396f586a35cd25d0e931ee744cb7a4282a99cfa932e507bf76e84ca304522","observation_id":"fb6c837b-fc9f-4748-b142-c6f5dc58dae1","resolution":{"observed_at":"2026-08-06T18:50:47.741670Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:47.231656Z","title":null,"venue":null,"work_id":"0666eeeb-fd72-4f4f-835a-49a19e145368","year":null},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.594128Z"},"links":{"citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:2e193d2b3aa790ad79872f20550c021148cbec2a41b4a9ed6825270d38b5c348","observation_id":"045238bb-7c81-437f-b487-9a1f1e63dac8","resolution":{"observed_at":"2026-08-06T18:50:47.381865Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T23:13:48.925047Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":5,"unresolved":22,"verified_exact":3,"verified_fuzzy":24},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2507.08039."}