{"as_of":"2026-08-19T14:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5bd6cb9803f079c2a296e1190df35e303e003d64836bbd338979db1af6549486","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:41:22.884291Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.00122/citation-record","integrity":"/paper/2412.00122/integrity","json":"/paper/2412.00122/citation-record.json","paper":"/paper/2412.00122"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.648862Z","title":null,"venue":null,"work_id":"409555ef-c9ab-4463-8489-a45214c9900e","year":null},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.661211Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:a43cf624c3965fadd767a674814250a4210714815c2be59c41f475644c73201f","observation_id":"ccd8d2f9-66a1-41e0-84bf-2044df0d7590","resolution":{"observed_at":"2026-08-12T10:41:23.653599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.633062Z","title":"Universal guidance for diffusion models","venue":null,"work_id":"3da8e98a-6116-418c-96fb-a0fe803f17dd","year":2024},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.666809Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:75f12c2cd9b1a35c300623e1c2d99b54d1e9a29b45e6c8ad71fa4afc6c9a3b91","observation_id":"59978b53-ec4f-453c-b220-08f29431203c","resolution":{"observed_at":"2026-08-12T10:41:23.638050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.617839Z","title":"Attend-and-excite: Attention-based se- mantic guidance for text-to-image diffusion models","venue":null,"work_id":"9d1db02c-c99d-4151-bb07-ea8c276d4dbc","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.671787Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:4aff5197c465bd9489ad41242849a02bc1af1cd9c56e837587a3438329e1d25e","observation_id":"9041d17c-df2d-4d9a-8b88-0309e2a07941","resolution":{"observed_at":"2026-08-12T10:41:23.622844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.602101Z","title":"Training-free layout control with cross-attention guidance","venue":null,"work_id":"9b5666ff-8525-4659-9bc3-9ac06e726b6e","year":2024},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.676525Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:f25753bead50086de31854a68710a27265da9c582d1c4d4a1f6f693e89f52133","observation_id":"071fa376-ee3d-4658-830c-4578f20779a2","resolution":{"observed_at":"2026-08-12T10:41:23.607256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.586263Z","title":null,"venue":null,"work_id":"0426718b-3563-4ab9-9567-547c63253c06","year":2024},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.681634Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:d62e9463952bba2b09f904dc3c5fcd1e3b1dda2e0cbd1cf9379709782fe27966","observation_id":"a57c8644-770f-4ded-b3d4-b8ca43ac6060","resolution":{"observed_at":"2026-08-12T10:41:23.591146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.570337Z","title":"RAFT: reward ranked finetuning for generative foundation model alignment.Trans","venue":null,"work_id":"c67605c0-6fdd-4b49-8627-5e1bb96beda9","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.686634Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:d2ea840747dd73a155f796411fdae5c85bfb22d3c6b5e3a05517280db71ce268","observation_id":"bdb8bece-cc94-4320-879a-92c2d2fd5404","resolution":{"observed_at":"2026-08-12T10:41:23.575370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.553944Z","title":"Optimizing DDPM sampling with shortcut fine-tuning","venue":null,"work_id":"73abe652-8dfe-4254-bd4a-db5265d9cbac","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.692264Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:5d7f4669c24423747e1ad933d0d6e788725d4e3d5a5bcd5b08c5a36cd1e0babe","observation_id":"a0e9eb0f-19de-4637-8b3d-a1dd8a6c39ba","resolution":{"observed_at":"2026-08-12T10:41:23.559901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16381","last_updated":"2023-11-01T04:48:26Z","snapshot_observed_at":"2026-08-16T15:29:37.331753Z","submitted_at":"2023-05-25T17:35:38Z","title":"DPOK: Reinforcement Learning for Fine-tuning Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16381","snapshot_observed_at":"2026-08-12T10:41:22.698059Z","title":"DPOK: reinforcement learning for fine-tuning text-to-image diffu- sion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.698059Z"},"links":{"cited_paper":"/paper/2305.16381","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:b93b8b5186feb4469f1fb20fea772a881c1dea5785361b5dd86b1bd2ae916ca0","observation_id":"96b34492-18c9-42d2-9df6-2f116b14dd29","resolution":{"observed_at":"2026-08-12T10:41:22.698059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.538089Z","title":"You only look at one sequence: Rethinking transformer in vision through object detection","venue":null,"work_id":"fee2bec3-d3a8-46f5-9c38-d1e02fe1ec35","year":null},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.703368Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:918313da4acfd9ff982217d58dd3014cf892faf50cce9bc2699c8a7345a9baba","observation_id":"e431c957-cf7e-42cc-9d4c-47c5cc71d490","resolution":{"observed_at":"2026-08-12T10:41:23.543220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.522465Z","title":"Akula, Pradyumna Narayana, Sugato Basu, Xin Eric Wang, and William Yang Wang","venue":null,"work_id":"249c6bb5-48d9-4a00-a2a9-f576a7dcc18e","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.708950Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:6a8fe22ce252ee26b880d289c432c6b7b418d90f5e57259efff66a00d598e225","observation_id":"dc7bad55-899d-45f5-a594-a9cad49b85e6","resolution":{"observed_at":"2026-08-12T10:41:23.527388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10015","last_updated":"2023-10-27T17:24:04Z","snapshot_observed_at":"2026-08-16T16:07:26.772862Z","submitted_at":"2022-12-20T06:03:51Z","title":"Benchmarking Spatial Relationships in Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10015","snapshot_observed_at":"2026-08-12T10:41:22.713676Z","title":"Benchmarking spatial relationships in text-to-image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.713676Z"},"links":{"cited_paper":"/paper/2212.10015","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:0c7f82e7849d10b6722f89294a5c142ab34a161afad9201f4642dd35a5c36f0e","observation_id":"3f705913-c013-44f7-99e3-65d965c5f320","resolution":{"observed_at":"2026-08-12T10:41:22.713676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.506149Z","title":"Optimizing prompts for text-to-image generation","venue":null,"work_id":"992f13a3-f5f2-4b6d-aefa-eb660cccf4c1","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.718810Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:a815ce83a2483804e6064ee9c7bc1a40fed4a9ef344175181eed77bb751d2901","observation_id":"86f3d7e3-0639-481e-bc11-2dad4519df83","resolution":{"observed_at":"2026-08-12T10:41:23.511266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.489940Z","title":"Clipscore: A reference-free evaluation met- ric for image captioning","venue":null,"work_id":"b2de2083-64c6-4a6a-8aee-3b82f7b642bb","year":2021},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.723747Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:8f671c7a3354636d977d5ba020519c9b58312faa5a909ffe925d489fdd07f52c","observation_id":"9d90323e-813d-44ac-a3fb-125b8f0902eb","resolution":{"observed_at":"2026-08-12T10:41:23.495089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.474125Z","title":"spaCy 2: Natural lan- guage understanding with Bloom embeddings, convolutional neural networks and incremental parsing","venue":null,"work_id":"d091e1ab-87c7-44aa-8f8b-91d14207402a","year":2018},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.729355Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:8aa70230bfbe2ad46515734c038bbf3c57f1fa0a15b2a70d584b51c0407a2c43","observation_id":"63df46ab-c699-4a40-8d42-6f25acd1a896","resolution":{"observed_at":"2026-08-12T10:41:23.479228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.458376Z","title":null,"venue":null,"work_id":"d9dc1b2c-c517-46c7-befc-8b1e08d5a39b","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.734008Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:27144c1272128db1e38b1b44f9d6a8e742593c0afbcc1320d5fb24ccfaf2716b","observation_id":"26485d1e-c83a-4a6f-bf1b-b7680348b2e5","resolution":{"observed_at":"2026-08-12T10:41:23.463227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.442751Z","title":"T2i-compbench: A comprehensive benchmark for open-world compositional text-to-image generation","venue":null,"work_id":"13069bb2-8889-4cd8-8bfa-7334dade5225","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.738780Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:ecaab2065984a21b51ad0e47f0f59f8eb122b4a9c6ab8e21ecabe57031c5e181","observation_id":"0324b0f6-8216-4330-977e-9353e5679c5f","resolution":{"observed_at":"2026-08-12T10:41:23.447717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03653","last_updated":"2024-11-27T09:55:41Z","snapshot_observed_at":"2026-08-16T14:03:32.636664Z","submitted_at":"2024-04-04T17:59:46Z","title":"CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03653","snapshot_observed_at":"2026-08-12T10:41:22.744257Z","title":"Comat: Aligning text-to-image diffusion model with image- to-text concept matching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.744257Z"},"links":{"cited_paper":"/paper/2404.03653","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:d410e1319905f8163a3359170e0ae787017b30f85637a52c7b96064645b8b8a1","observation_id":"3654a510-96de-49f9-9453-066f010d7601","resolution":{"observed_at":"2026-08-12T10:41:22.744257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19599","last_updated":"2024-10-24T03:14:22Z","snapshot_observed_at":"2026-08-17T15:15:23.993164Z","submitted_at":"2023-05-31T06:59:21Z","title":"RealignDiff: Boosting Text-to-Image Diffusion Model with Coarse-to-fine Semantic Re-alignment","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19599","snapshot_observed_at":"2026-08-12T10:41:22.749240Z","title":"Realigndiff: Boosting text-to-image diffusion model with coarse-to-fine semantic re-alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.749240Z"},"links":{"cited_paper":"/paper/2305.19599","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:36b50469ad1efdca85edfe12650d4985395f2853e115f9307cd0fb6a9ce91fc3","observation_id":"21e8ff2c-8788-4225-9322-9fd5b27a64ee","resolution":{"observed_at":"2026-08-12T10:41:22.749240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.426471Z","title":"Dif- fusionclip: Text-guided diffusion models for robust image manipulation","venue":null,"work_id":"4bdee757-1d8f-4de3-8384-2c474d599d54","year":2022},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.754224Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:80a49c4943c93b3e08e0cc690f4a9f53e0ce7413e42125730df1b970cdff93ae","observation_id":"b2e00c8e-d4e9-4d33-969b-300b5fe3259b","resolution":{"observed_at":"2026-08-12T10:41:23.431807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.410280Z","title":"Dense text-to-image generation with attention modulation","venue":null,"work_id":"7a0a0715-6125-459c-82a7-191896922780","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.759075Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:727a91cfe3cf09aae7708ed2dc0e4f6afb05ceeedadf6e53fe6a2d9ee47a1f8a","observation_id":"7a43d818-a623-4946-8db7-fab4cf806b67","resolution":{"observed_at":"2026-08-12T10:41:23.415537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.394017Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"6542cc93-0928-4993-b228-a990d4c57974","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.764068Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:b0a8c03a03c71d636740159653471d94cd2ba70de39928b3ea51b9eaf624a4e7","observation_id":"eb93f159-7ab7-4966-a76a-11dbf5483723","resolution":{"observed_at":"2026-08-12T10:41:23.399310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.377697Z","title":"Maskgan: Towards diverse and interactive facial image ma- nipulation","venue":null,"work_id":"488afbe8-7609-42f5-9c77-f8eb89095eb0","year":2020},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.768773Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:27724c6244db96194feac57560b12183e2ed694d3a2e57fdcf382a023776b209","observation_id":"7d9bd878-39f9-437a-bef3-7b7898122a12","resolution":{"observed_at":"2026-08-12T10:41:23.382786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-08-19T01:47:45.494420Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-12T10:41:22.773303Z","title":"Align- ing text-to-image models using human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.773303Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:f8ec7abc3e02c6bd62fd1458ee597b8513aba6b245eebaf2990c60c0e75fffc5","observation_id":"4c3070d2-2008-40fb-99ff-dc93356b068f","resolution":{"observed_at":"2026-08-12T10:41:22.773303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.361479Z","title":null,"venue":null,"work_id":"07282794-bdde-4b5d-8e45-1946b8c85f9b","year":2022},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.778079Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:f8713c4f0ad2688b3c665f8122e1361a374a5c823bbf22ad1309dcf7d1e707b9","observation_id":"b245bfa6-a057-47d1-9c58-b4506e39d4a6","resolution":{"observed_at":"2026-08-12T10:41:23.366530Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.344470Z","title":null,"venue":null,"work_id":"f684db45-b87a-43d5-911d-d2340a67b1a5","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.782752Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:e32512af3cf6cdb92c2aa15fa78e2cfe1562abe9f51b0804a9ad278cf7086950","observation_id":"0cda8ce0-078f-414d-86d4-f045a22348a7","resolution":{"observed_at":"2026-08-12T10:41:23.350067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.327322Z","title":"GLIGEN: open-set grounded text-to-image generation","venue":null,"work_id":"d407a9e3-8f26-4b7c-b9d1-08cbb96cea70","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.787474Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:70934c7a21f8085ff2f66e764fcbb8a8e166e6edd6dbd96046f83a02d194cb1d","observation_id":"c4aac319-df79-4d8c-8bda-94248fb801be","resolution":{"observed_at":"2026-08-12T10:41:23.332358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.310703Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Doll ´ar, and C","venue":null,"work_id":"ac394ead-65bb-4571-9f67-087d360c76f9","year":2014},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.791976Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:a8e7d130d9a4c9d404f84ca3dd25abcc97c58a9000c05e94bc8bfe40488e1e34","observation_id":"dab8e63a-3632-452e-a61b-ef30e514813b","resolution":{"observed_at":"2026-08-12T10:41:23.315666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.294236Z","title":"Training diffusion models towards diverse image generation with reinforcement learning","venue":null,"work_id":"03e35657-23ce-4dc9-9e23-a05c3f42bb12","year":2024},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.796508Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:50d6436842b357addf986bb5a03c62535324c1d25a5e5f80ca7673e2b29d3a64","observation_id":"4da6e446-f8ca-426d-b9ad-54947ccc51b2","resolution":{"observed_at":"2026-08-12T10:41:23.299561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-12T10:41:22.801316Z","title":"Hierarchical text-conditional image gener- ation with CLIP latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.801316Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:97efd8ba74a521dfe0336c5ec34d80f5ae6ee61be8d72d9853120aba25a3eca2","observation_id":"228aa5e7-8b43-44f5-b293-40d3fe83ecaf","resolution":{"observed_at":"2026-08-12T10:41:22.801316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.278173Z","title":"Linguistic bind- ing in diffusion models: Enhancing attribute correspondence through attention map alignment","venue":null,"work_id":"62c9a704-e351-44c9-9857-950527f4d1ab","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.806362Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:be6f00f71d1c29d17c6a2f90619631afe697070975b17267053a5913f5837c76","observation_id":"3d1a1bb0-2bd9-4ff2-b762-64379d70b714","resolution":{"observed_at":"2026-08-12T10:41:23.283479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.262115Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"26841d82-f442-4d4d-bcfe-72c06a01010c","year":2022},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.811163Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:f66e12acd03ac142ed45e864627d6d19d98a7b18313620c1cbbaf1b2acfe504d","observation_id":"15e5d1eb-4a9b-4910-abb3-7d2d728eeb2c","resolution":{"observed_at":"2026-08-12T10:41:23.267149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:22.815853Z","title":"Denton, Seyed Kamyar Seyed Ghasemipour, Raphael Gontijo Lopes, Burcu Karagol Ayan, Tim Salimans, Jonathan Ho, David J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.815853Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:3d51ed5307ff8c27a642f93cdfffcd858a2bd3b8115f12a26097033d1465c1e5","observation_id":"ec434c24-0dd6-4b7b-a03c-606ea6d0f08b","resolution":{"observed_at":"2026-08-12T10:41:22.815853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-12T10:41:22.821555Z","title":"LAION- 400M: open dataset of clip-filtered 400 million image-text pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.821555Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:26f12bc67b6369fc4d845e5d4f97da50960cb551bdff7fbaadc5a535cbecdd11","observation_id":"e3564690-d072-4ad5-9466-310ea6957c5a","resolution":{"observed_at":"2026-08-12T10:41:22.821555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.235484Z","title":"LAION-5B: an open large-scale dataset for training next generation image-text models","venue":null,"work_id":"15cfb6e5-d9d6-4aae-966b-3f795960bba0","year":2022},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.826378Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:215035a60e618d52803fe54f3d50c823b66c0bd6b67111370720de086f2f4964","observation_id":"3d4697ec-a8a9-4131-8fa2-eaa302258286","resolution":{"observed_at":"2026-08-12T10:41:23.240361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17946","last_updated":"2023-11-29T03:42:16Z","snapshot_observed_at":"2026-08-16T14:39:24.678267Z","submitted_at":"2023-11-29T03:42:16Z","title":"DreamSync: Aligning Text-to-Image Generation with Image Understanding Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17946","snapshot_observed_at":"2026-08-12T10:41:22.831353Z","title":"Dream- sync: Aligning text-to-image generation with image under- standing feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.831353Z"},"links":{"cited_paper":"/paper/2311.17946","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:3fec96e38e6e82e24fa541f0184e34285577d607882cd6ccbeff5234e313d4cb","observation_id":"41dcfde7-92a2-4a9a-8669-0810f5c04f82","resolution":{"observed_at":"2026-08-12T10:41:22.831353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.219605Z","title":"Tokencompose: Text-to-image diffusion with token-level supervision","venue":null,"work_id":"9a605288-5951-4217-b9bf-2da94750e4a2","year":null},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.836127Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:8ee64dd3e39277d740d32c261cb6047026be4628143f79df396b2f7c672952a5","observation_id":"9689d823-f7cc-49d5-8fb7-fd39dc3b72f9","resolution":{"observed_at":"2026-08-12T10:41:23.224703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.202942Z","title":"Gonzalez, Boyi Li, and Trevor Darrell","venue":null,"work_id":"8facb6a8-6596-46f8-b42e-648b52c0647d","year":2024},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.841314Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:64a6d5dd46c0381bbc1f46eb215bcc4e976d4113c22cdc182eb9c68de0018cf8","observation_id":"1ca07cec-27a8-4cbe-923c-a64f10c4c836","resolution":{"observed_at":"2026-08-12T10:41:23.208807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-14T02:46:25.655503Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-12T10:41:22.845986Z","title":"Human preference score v2: A solid benchmark for evaluating human preferences of text-to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.845986Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:72236054c194b1ae52a4b7016e14ac917145ee2f9ee97c879ba32c43abc66ca0","observation_id":"05e75a90-d04d-48ec-8f54-8298c7625348","resolution":{"observed_at":"2026-08-12T10:41:22.845986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.186879Z","title":"Human preference score: Better aligning text-to- image models with human preference","venue":null,"work_id":"ff603364-a2dd-40f0-9918-26f61a061f6c","year":null},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.851302Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:8f4351a0f972fbb5ee276e28dfc8c032b1e855fa4b73542d630e26ad5f4d34dd","observation_id":"3d4bf2f6-5443-4e61-bab8-9dc4b49c8331","resolution":{"observed_at":"2026-08-12T10:41:23.191891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00760","last_updated":"2024-05-01T15:26:14Z","snapshot_observed_at":"2026-08-16T13:56:15.807160Z","submitted_at":"2024-05-01T15:26:14Z","title":"Deep Reward Supervisions for Tuning Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00760","snapshot_observed_at":"2026-08-12T10:41:22.855912Z","title":"Deep reward supervisions for tuning text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.855912Z"},"links":{"cited_paper":"/paper/2405.00760","citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:76afdf67bc6e411380c90be9f86fa982a657a373eb9172afc63b7e2e4d3f7461","observation_id":"ba6ce854-926d-4d51-908e-f55e50f9d0b6","resolution":{"observed_at":"2026-08-12T10:41:22.855912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.169801Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion","venue":null,"work_id":"ee5e94c7-5e51-470c-8e0c-b2c856f1afd5","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.860835Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:7711cd0b49047ab19c50657c36035d5dda9ba3d3321215f0ca56c5b42bdc6990","observation_id":"424c2e83-e082-40f4-91b7-2831abce7b13","resolution":{"observed_at":"2026-08-12T10:41:23.175165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.151845Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":"c1adb96f-df63-4a92-a56d-81afefa3a09c","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.865526Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:4f821ff015d27fcd34da741c280fb179522d5921495942b7430f36d5e2c5e8cc","observation_id":"e78c2f37-09e6-421b-a157-8015001e4b29","resolution":{"observed_at":"2026-08-12T10:41:23.156952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.135751Z","title":"Mastering text-to-image diffu- sion: Recaptioning, planning, and generating with multi- modal llms","venue":null,"work_id":"a90c591b-aa51-4aa1-b479-aea4894ea118","year":2024},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.870203Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:e1742ea35a8f608d134ec0438311f911b10d64d4f5d2bec657d22736c67ade11","observation_id":"11a18690-e9f9-4842-b39d-5c72898e4bc2","resolution":{"observed_at":"2026-08-12T10:41:23.140834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.119235Z","title":"A dense reward view on aligning text-to-image diffusion with prefer- ence","venue":null,"work_id":"bfe20853-697d-4609-bbd8-66d208c94796","year":2024},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.874951Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:1ff0a6a8801a9169a3bfcf13770d78029f24b5436ebaa506f144e4f8725d4f96","observation_id":"1356b476-c0f9-4c58-a0af-20a52ca6b00d","resolution":{"observed_at":"2026-08-12T10:41:23.124021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.103081Z","title":"Freedom: Training-free energy-guided condi- tional diffusion model","venue":null,"work_id":"76c72f78-b13c-4e5e-8a22-71246b02920e","year":null},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.879760Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:ac7adbcca04f7d905ca1ad984076d9a1e0b1a1b4e0c778d269f6d67e45737f93","observation_id":"46c769ad-a8ff-4b22-b68b-d5b5b464a9ce","resolution":{"observed_at":"2026-08-12T10:41:23.108199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:41:23.085310Z","title":"Fixed Category & Incremental Quantity","venue":null,"work_id":"d28914fa-9ad9-4f7c-8573-9cc98780d0b5","year":2023},"citing_paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T10:41:22.884291Z"},"links":{"citing_paper":"/paper/2412.00122"},"observation_digest":"sha256:33d949c230111f747d54cbad2790c3675ddd5397f4a9d0d0288249d5514d14af","observation_id":"3edc5e74-684d-49ba-875f-2e2635808369","resolution":{"observed_at":"2026-08-12T10:41:23.091979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.00122","last_updated":"2024-11-28T09:56:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T12:17:46.527479Z","submitted_at":"2024-11-28T09:56:28Z","title":"Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":30},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2412.00122."}