{"as_of":"2026-08-20T11:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f926b6e73949c07e19f4b49fe22e5a513110c312d716591ca66caec706a1278","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:58:55.228513Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:25:47.143343Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:39:58.231227Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11178","snapshot_observed_at":"2026-08-03T15:25:47.143343Z","title":"Wan and K.-W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.20666","last_updated":"2026-07-22T05:36:55Z","snapshot_observed_at":"2026-08-18T03:17:23.320110Z","submitted_at":"2025-12-19T06:36:15Z","title":"Dominant vs. Dominated: Concept-Level Generative Collapse in Diffusion Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T15:25:47.143343Z"},"links":{"cited_paper":"/paper/2505.11178","citing_paper":"/paper/2512.20666"},"observation_digest":"sha256:54a1c91d05ab50d73bc278e661fbf12842f05d664613a32e483c0b5b705a806a","observation_id":"6e99ae5c-0e72-41d3-884b-67a1b3040050","resolution":{"observed_at":"2026-08-03T15:25:47.143343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"cited_work":{"arxiv_id":"2505.11178","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.11178","snapshot_observed_at":"2026-07-04T16:39:58.231227Z","title":"Compalign: Improving compositional text-to-image generation with a complex benchmark and fine-grained feedback","venue":null,"work_id":"5bb64836-a2b4-4bf4-af6e-a79bd50dc724","year":2025},"citing_paper":{"arxiv_id":"2605.06170","last_updated":"2026-05-07T12:53:51Z","snapshot_observed_at":"2026-08-13T06:55:23.841654Z","submitted_at":"2026-05-07T12:53:51Z","title":"DynT2I-Eval: A Dynamic Evaluation Framework for Text-to-Image Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T13:54:00.141439Z"},"links":{"cited_paper":"/paper/2505.11178","citing_paper":"/paper/2605.06170"},"observation_digest":"sha256:894699483a18e8445a00dd75da3db5a6681e22b36b6aa2761f94d445e9ac656f","observation_id":"34acc6ba-c81e-47fa-a7fb-90aec2cf5058","resolution":{"observed_at":"2026-05-11T18:46:10.510116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"cited_work":{"arxiv_id":"2505.11178","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.11178","snapshot_observed_at":"2026-07-04T16:39:58.231227Z","title":"Compalign: Improving compositional text-to-image generation with a complex benchmark and fine-grained feedback","venue":null,"work_id":"5bb64836-a2b4-4bf4-af6e-a79bd50dc724","year":2025},"citing_paper":{"arxiv_id":"2606.24849","last_updated":"2026-06-23T17:28:00Z","snapshot_observed_at":"2026-08-12T23:14:12.939313Z","submitted_at":"2026-06-23T17:28:00Z","title":"IV-CoT: Implicit Visual Chain-of-Thought for Structure-Aware Text-to-Image Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-26T00:19:49.071495Z"},"links":{"cited_paper":"/paper/2505.11178","citing_paper":"/paper/2606.24849"},"observation_digest":"sha256:80d991014feb8845c450ef2697f8138c3f37a6e44e373d905b31d98c243345f1","observation_id":"ef7e1fb5-acf3-421b-bf63-c2a07b491e44","resolution":{"observed_at":"2026-07-04T16:39:58.232554Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.11178/citation-record","integrity":"/paper/2505.11178/integrity","json":"/paper/2505.11178/citation-record.json","paper":"/paper/2505.11178"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.681348Z","title":"Black, M","venue":null,"work_id":"52e09e88-fd30-478c-a47e-8eb255ff3dff","year":null},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.095866Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:fdc992b30a0a0f2cb9e62ab3604726dbdfea3a2a30ea0300bd33b23b19434048","observation_id":"c387bd3e-5c12-45e8-98e1-a8345de53db0","resolution":{"observed_at":"2026-08-15T20:58:55.686644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.663667Z","title":"Chefer, Y","venue":null,"work_id":"b82213db-f764-4041-9457-6ccdd91d9033","year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.103036Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:820654b022a9e6182139153ab0898c0e7b85bf9a006d0e880cf69a74fec23db1","observation_id":"d6355c0e-800d-4820-acc2-13e2431b5340","resolution":{"observed_at":"2026-08-15T20:58:55.669835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.646814Z","title":null,"venue":null,"work_id":"bf8e66ad-129c-4bfc-b2a6-9bbe751183ec","year":2024},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.108624Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:2e336156928403a2786f6a3b9a26ae4bc4c6e8244e89c40265ffee1b679425dc","observation_id":"285ce245-acd6-4960-a939-c474ef7f2a9e","resolution":{"observed_at":"2026-08-15T20:58:55.652280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.628868Z","title":"Clark, P","venue":null,"work_id":"3c6c12b6-b409-4595-8b26-c43deb95d144","year":null},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.114022Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:a8ef45a997857b43586f7e625cbbe32765eb5801c3dc7e3e4e541d9fa15f8087","observation_id":"659e4fd6-c24f-4c85-9508-034d850494df","resolution":{"observed_at":"2026-08-15T20:58:55.635001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.119744Z","title":"Esser, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.119744Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:cb83a720fc489ac737c41e6537cc99de1eb96876130b49a69254dc85cdce029f","observation_id":"bdceabe9-5df0-4d8c-b273-e637195a5763","resolution":{"observed_at":"2026-08-15T20:58:55.119744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-08-17T15:29:47.883677Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-15T20:58:55.125073Z","title":"Ethayarajh, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.125073Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:9f67dbd30e574a3a0856e642964489ea1d59d53d0772993ad24f293010970f4f","observation_id":"c8664370-7d3e-4cc4-9197-c71080dfb8b6","resolution":{"observed_at":"2026-08-15T20:58:55.125073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.597739Z","title":"Fan and K","venue":null,"work_id":"80d929f1-120b-4a58-b210-c10efe086efe","year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.131091Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:68a83e7b15076394264c327a8ba2c6c1856d114589b7dae3465491e3c0bb6ed6","observation_id":"4f0a18bc-dde4-49cc-a41e-776e3917d7e5","resolution":{"observed_at":"2026-08-15T20:58:55.603560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.136184Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.136184Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:10a02a24e76c7bd6127dbd1f82d4bfeb7b8c304ab4290bf08ce3f39d827b86b0","observation_id":"cb351313-32dc-423d-a657-e6a5368ce5c1","resolution":{"observed_at":"2026-08-15T20:58:55.136184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05032","last_updated":"2023-02-28T23:46:24Z","snapshot_observed_at":"2026-08-18T16:04:10.548936Z","submitted_at":"2022-12-09T18:30:24Z","title":"Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05032","snapshot_observed_at":"2026-08-15T20:58:55.141862Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.141862Z"},"links":{"cited_paper":"/paper/2212.05032","citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:4c461c543e7597c601ad5180f16b209f7869159edb788314ef88a2d6346c93cf","observation_id":"cf7d2473-643d-4853-8a52-9809e2fe9b3b","resolution":{"observed_at":"2026-08-15T20:58:55.141862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.567904Z","title":null,"venue":null,"work_id":"3efdb031-557f-4bd9-a8e6-dca6eecada96","year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.146790Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:746b4671c612faea0f522bc1bfaa598195a2431c8bfd9c71fd628aea799e79bf","observation_id":"b4602c76-926e-427d-8cb1-3ded24642510","resolution":{"observed_at":"2026-08-15T20:58:55.574009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.548786Z","title":null,"venue":null,"work_id":"cb6a12e9-a579-4c8d-8671-b7c5a8dc05cf","year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.151494Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:f433202e43c8e36b6f5d8eeb94fd4523195264e2982bdd8f96bc80965aa3d87a","observation_id":"356bd096-21bb-4615-a312-58b9409df784","resolution":{"observed_at":"2026-08-15T20:58:55.554209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.156760Z","title":"Huang, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.156760Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:2a503504842a696f3926734878584e38a87abdc286087ab77a40f435cd8c1306","observation_id":"20b0b1fe-8e9b-42ac-8f90-72fa4d4f1d36","resolution":{"observed_at":"2026-08-15T20:58:55.156760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.162072Z","title":"Huang, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.162072Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:d173b55b08592b36eab11004c7da10dafb827eb6d027f4327a6684ac5af80054","observation_id":"802332b1-f3ce-41f5-a932-5b264a09d57c","resolution":{"observed_at":"2026-08-15T20:58:55.162072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.167802Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.167802Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:c18bdf716aa219d0171d038aa4f97f1c074bf8967e800db05bfc1d2a36572c93","observation_id":"c6a5ba32-ef9f-4213-bf39-ee3bece461fc","resolution":{"observed_at":"2026-08-15T20:58:55.167802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-08-20T08:43:12.373190Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-15T20:58:55.173122Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.173122Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:afd200b0935922a0c608bb83fd69427ca1aaccb22c930105f836324ddb941d2d","observation_id":"9befa6ac-11e6-49b3-9c87-7944f8708f5c","resolution":{"observed_at":"2026-08-15T20:58:55.173122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.505700Z","title":null,"venue":null,"work_id":"5ecadf2f-0a47-4304-a4b8-cf7e78e4a0d0","year":null},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.178376Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:7799118cb9c286156b00e3e072358addcae547da57a7bc7f6dc55eff97091292","observation_id":"4fb28cff-ee1d-4ff4-b7cd-8f1084182cd0","resolution":{"observed_at":"2026-08-15T20:58:55.511151Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13655","last_updated":"2024-03-04T18:43:49Z","snapshot_observed_at":"2026-08-16T15:30:49.729694Z","submitted_at":"2023-05-23T03:59:06Z","title":"LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13655","snapshot_observed_at":"2026-08-15T20:58:55.184993Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.184993Z"},"links":{"cited_paper":"/paper/2305.13655","citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:ebbeb9dd03b422d7f92adb599cbda8924896886608bc7182618c90a8fbda3d38","observation_id":"276c8d96-3759-467e-afe8-3a37be7631d6","resolution":{"observed_at":"2026-08-15T20:58:55.184993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.484692Z","title":"Dall ·e 3 system card, Oct 2023","venue":null,"work_id":"50b90b1a-51a4-4639-a0ab-52439d459881","year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.190693Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:958a7fdefb737cefccef2f7d9f7cd572a76555e63d53c80c6930ec9f918fcd0f","observation_id":"063ac0e3-3eb5-48e5-a867-40b1c27fbcb2","resolution":{"observed_at":"2026-08-15T20:58:55.493177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.467660Z","title":null,"venue":null,"work_id":"250ccbd0-b501-4ac4-931e-c6cf90a47e1d","year":2021},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.196314Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:57774574bf9efcf930321b57162f68b8fcbf4b60b1a76dca2ca3a88a69c8cbe2","observation_id":"8b4e6dfa-0b1c-4fe8-901e-c253f1338966","resolution":{"observed_at":"2026-08-15T20:58:55.473338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.449656Z","title":"Prabhudesai, A","venue":null,"work_id":"dc1100d1-de35-4375-98ba-445f7bf690b6","year":null},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.202468Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:b328f94d5529ebdf0f72b6ce1af97c451054615716fa3d2354df3bcecab21e1b","observation_id":"064859cd-98e8-4603-9c7c-c36098dee6d9","resolution":{"observed_at":"2026-08-15T20:58:55.455095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.208372Z","title":"Rombach, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.208372Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:31d430b5b7a819e5e93a64b675f6b698e56b48ace03972e2ad671a089eca2187","observation_id":"82150b5d-da81-4afe-a2a7-fe3f264a913f","resolution":{"observed_at":"2026-08-15T20:58:55.208372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17946","last_updated":"2023-11-29T03:42:16Z","snapshot_observed_at":"2026-08-20T09:02:01.882789Z","submitted_at":"2023-11-29T03:42:16Z","title":"DreamSync: Aligning Text-to-Image Generation with Image Understanding Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17946","snapshot_observed_at":"2026-08-15T20:58:55.213235Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.213235Z"},"links":{"cited_paper":"/paper/2311.17946","citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:13c4e539aab2c923f6c9eadb42d6d6740a4f7aa205a20a50436c896a15cb7b7b","observation_id":"45289d92-3fe6-4195-bbaa-8346132cb789","resolution":{"observed_at":"2026-08-15T20:58:55.213235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-15T20:58:55.218640Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.218640Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:fd56e97d737f8d51f2f43056bd645682e414cabc26d7567996cb9dcda432b3a5","observation_id":"d1173a2d-55ac-45b2-901c-216e5707d35b","resolution":{"observed_at":"2026-08-15T20:58:55.218640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.419974Z","title":null,"venue":null,"work_id":"bae29214-17af-41d5-b4d7-3572d2af979e","year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.223572Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:3be06049428252215598a8ffe2ea8735aa8e53b286e295840a8e38a664fc9b0c","observation_id":"d343031c-4cf8-4b69-8d39-08b3f9eb0f1b","resolution":{"observed_at":"2026-08-15T20:58:55.425395Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:55.397994Z","title":"a blue cherry","venue":null,"work_id":"788a3263-b087-473e-9f3b-7f7be1976deb","year":2023},"citing_paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:55.228513Z"},"links":{"citing_paper":"/paper/2505.11178"},"observation_digest":"sha256:e91ce85f55af23b82a1be527b73d2852f9831777dde722c7b30c5ece36922a5c","observation_id":"128ac871-2826-41a5-ad2a-e140c64f0f18","resolution":{"observed_at":"2026-08-15T20:58:55.405346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.11178","last_updated":"2025-05-16T12:23:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T20:27:07.431900Z","submitted_at":"2025-05-16T12:23:58Z","title":"CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 3 inbound Pith citation observations for arXiv:2505.11178."}