{"as_of":"2026-08-16T01:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:670fd962f6408f5e4a16a0620a82a05ecb8822d2915aabc4aacf0b1f6f05986d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":45,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:41:41.793962Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:59:43.031755Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T20:16:30.840184Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2305.13301"},"observation_digest":"sha256:724023c98d7cfb015b026692c6873e005c220b40f9904d1ce0c1a339bcea49b3","observation_id":"2060de4d-2b71-496b-8c5a-66635b10bfae","resolution":{"observed_at":"2026-05-11T20:16:31.221696Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-12T19:54:42.516786Z","title":"Imagereward: Learning and evaluating human preferences for text-to- image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10183","last_updated":"2024-11-15T13:32:23Z","snapshot_observed_at":"2026-08-15T02:18:24.493062Z","submitted_at":"2024-11-15T13:32:23Z","title":"Visual question answering based evaluation metrics for text-to-image generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T19:54:42.516786Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2411.10183"},"observation_digest":"sha256:341ab43199c3a5d1f9837f0f96056791c331cb5abd2153414328ff1aa07c78e9","observation_id":"6a16cdf1-f185-4c77-9d59-042e2ea74df1","resolution":{"observed_at":"2026-08-12T19:54:42.516786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-12T12:28:59.306484Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17176","last_updated":"2024-11-26T07:31:12Z","snapshot_observed_at":"2026-08-14T12:13:18.207544Z","submitted_at":"2024-11-26T07:31:12Z","title":"ChatGen: Automatic Text-to-Image Generation From FreeStyle Chatting","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T12:28:59.306484Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2411.17176"},"observation_digest":"sha256:bb18da45647884e7f0def0c575192394e0d5b6e64b8cf280f188f1b58af04757","observation_id":"eb044a20-b516-4b5e-be77-857c879380f9","resolution":{"observed_at":"2026-08-12T12:28:59.306484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-12T12:27:41.812497Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17221","last_updated":"2024-11-26T08:43:15Z","snapshot_observed_at":"2026-08-14T11:06:10.978458Z","submitted_at":"2024-11-26T08:43:15Z","title":"AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T12:27:41.812497Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2411.17221"},"observation_digest":"sha256:e5b5b8085d1ca6a41c39b4057055e9ac82fb2f931b61eb6f0b3d689d04bc48ab","observation_id":"7ff92102-fabe-4070-be70-b0a21c3b52ba","resolution":{"observed_at":"2026-08-12T12:27:41.812497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-11T23:06:20.142615Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02834","last_updated":"2024-12-03T20:56:47Z","snapshot_observed_at":"2026-08-12T14:36:25.285678Z","submitted_at":"2024-12-03T20:56:47Z","title":"Artificial Intelligence Policy Framework for Institutions","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:06:20.142615Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2412.02834"},"observation_digest":"sha256:a8b9de7b3405603b3e1d243ac1ee8438b70ef82aedcd7e1ceeab226639764de4","observation_id":"10ae49b2-4c2b-415c-8bbf-c07c67e92563","resolution":{"observed_at":"2026-08-11T23:06:20.142615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-08T21:03:24.015825Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04923","last_updated":"2025-02-07T13:41:51Z","snapshot_observed_at":"2026-08-10T06:10:52.406971Z","submitted_at":"2025-02-07T13:41:51Z","title":"Cached Multi-Lora Composition for Multi-Concept Image Generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T21:03:24.015825Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2502.04923"},"observation_digest":"sha256:4f139fce3e67d4485090f65f59924eff136bba30ebcdb4a2bde93cb87b39a9bb","observation_id":"5e533c71-cb8b-44ea-a8a9-5be80b27b81b","resolution":{"observed_at":"2026-08-08T21:03:24.015825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-08T19:32:32.042993Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05415","last_updated":"2025-05-18T14:59:21Z","snapshot_observed_at":"2026-08-14T12:34:45.995028Z","submitted_at":"2025-02-08T02:52:25Z","title":"UniCMs: A Unified Consistency Model For Efficient Multimodal Generation and Understanding","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T19:32:32.042993Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2502.05415"},"observation_digest":"sha256:71526d7ac15f85522c4686c3fd8d0e8ab5c79f05a675b0050d49d0b319368114","observation_id":"5b85435b-31ba-42f6-9292-a343ba9f3741","resolution":{"observed_at":"2026-08-08T19:32:32.042993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T15:03:42.406631Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16425","last_updated":"2025-05-22T09:10:09Z","snapshot_observed_at":"2026-08-09T16:14:10.026741Z","submitted_at":"2025-05-22T09:10:09Z","title":"$I^2G$: Generating Instructional Illustrations via Text-Conditioned Diffusion","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:03:42.406631Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2505.16425"},"observation_digest":"sha256:dc984a70157e4c1ad068895492c805bfebcc78a04f4c35652fcfee3f7612949b","observation_id":"6c57587c-f0ce-4322-b7dc-6e32063275de","resolution":{"observed_at":"2026-08-07T15:03:42.406631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T14:06:52.820142Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20053","last_updated":"2025-05-26T14:42:35Z","snapshot_observed_at":"2026-08-13T09:07:16.568614Z","submitted_at":"2025-05-26T14:42:35Z","title":"Multimodal LLM-Guided Semantic Correction in Text-to-Image Diffusion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:52.820142Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2505.20053"},"observation_digest":"sha256:888b6cba6f8583f4ebaa598e000cfff8c84917191d10d5f50ec77abae3b504cf","observation_id":"ac61415e-7d8c-4bbf-82ff-03c186bd7891","resolution":{"observed_at":"2026-08-07T14:06:52.820142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T13:23:12.222530Z","title":"Xu, M., Yu, L., Song, Y ., Shi, C., Ermon, S., and Tang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-14T21:07:46.569293Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.222530Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:c415eec6cb222024f7f246ab3fbcf42f1cf3b9af650bf812e5b6333bc8353da0","observation_id":"3060bb09-27e8-46ce-9a32-a562f8df7118","resolution":{"observed_at":"2026-08-07T13:23:12.222530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T13:09:41.984003Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22569","last_updated":"2025-05-28T16:45:07Z","snapshot_observed_at":"2026-08-07T22:08:43.402119Z","submitted_at":"2025-05-28T16:45:07Z","title":"ImageReFL: Balancing Quality and Diversity in Human-Aligned Diffusion Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:09:41.984003Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2505.22569"},"observation_digest":"sha256:89b2e24c0feb930683707a4682a3a85ad7a618b926a75a71efe6a822a1a26c03","observation_id":"238656fc-7690-47d6-9f9e-1a3064e5cf7a","resolution":{"observed_at":"2026-08-07T13:09:41.984003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T13:04:55.265097Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22792","last_updated":"2025-08-09T10:28:46Z","snapshot_observed_at":"2026-08-15T00:31:01.982220Z","submitted_at":"2025-05-28T19:03:37Z","title":"Rhetorical Text-to-Image Generation via Two-layer Diffusion Policy Optimization","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T13:04:55.265097Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2505.22792"},"observation_digest":"sha256:d97323c013788f8863405af91eb41497a475887a085b03ae735c6c7329125fc5","observation_id":"facc9132-d18c-4bb0-b990-5d005bb1ba01","resolution":{"observed_at":"2026-08-07T13:04:55.265097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T11:26:58.523053Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation.ArXiv, abs/2304.05977,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02698","last_updated":"2025-06-06T03:14:26Z","snapshot_observed_at":"2026-08-13T20:26:31.746413Z","submitted_at":"2025-06-03T09:47:22Z","title":"Smoothed Preference Optimization via ReNoise Inversion for Aligning Diffusion Models with Varied Human Preferences","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:58.523053Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2506.02698"},"observation_digest":"sha256:49e22c629bbaad33d966ef74ae57c887b742929d4f38f4cf3017462e0b83e01b","observation_id":"627bc115-f076-497a-ad7a-46e8ea664e20","resolution":{"observed_at":"2026-08-07T11:26:58.523053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T14:28:48.162565Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03164","last_updated":"2025-09-06T17:12:52Z","snapshot_observed_at":"2026-08-13T18:03:43.856919Z","submitted_at":"2025-05-24T19:13:29Z","title":"Test-Time Scaling of Diffusion Models via Noise Trajectory Search","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:28:48.162565Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2506.03164"},"observation_digest":"sha256:fee559f399f2d824669a42985e9f5d17660b87d4720f0e93ec76a9fc08c0d836","observation_id":"394a91b1-7783-45cf-9829-a0618875b7b0","resolution":{"observed_at":"2026-08-07T14:28:48.162565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T00:16:05.938273Z","title":"Imagereward: Open-source visual reward models for image generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14903","last_updated":"2025-06-17T18:17:35Z","snapshot_observed_at":"2026-08-11T01:17:30.896503Z","submitted_at":"2025-06-17T18:17:35Z","title":"DETONATE: A Benchmark for Text-to-Image Alignment and Kernelized Direct Preference Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:16:05.938273Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2506.14903"},"observation_digest":"sha256:0992deb9274b22903cb3cb7accbc65dc33d0acca1bd4bce8deb3e8117859331f","observation_id":"556f13e8-9469-43f3-945e-1d32b22b24da","resolution":{"observed_at":"2026-08-07T00:16:05.938273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-15T18:41:41.793962Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19103","last_updated":"2025-06-23T20:34:43Z","snapshot_observed_at":"2026-08-15T23:52:18.222434Z","submitted_at":"2025-06-23T20:34:43Z","title":"Inverse-and-Edit: Effective and Fast Image Editing by Cycle Consistency Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T18:41:41.793962Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2506.19103"},"observation_digest":"sha256:5a938699111f449535aec1d2268f7ac1a6625b2a83aa51c089fc6911315ff854","observation_id":"5935be3f-65c4-4317-bff3-49de89c49b58","resolution":{"observed_at":"2026-08-15T18:41:41.793962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2506.22832","last_updated":"2026-04-09T11:44:23Z","snapshot_observed_at":"2026-08-11T11:02:07.819535Z","submitted_at":"2025-06-28T09:53:17Z","title":"Listener-Rewarded Thinking in VLMs for Image Preferences","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T07:38:52.273903Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2506.22832"},"observation_digest":"sha256:a62c87321efdff32561cb93e0f65a50ae16407e9c0a0dd1a526a7fc212936fbc","observation_id":"6018959f-dc40-494e-bfc4-5fcb92bb1684","resolution":{"observed_at":"2026-05-19T07:42:09.202725Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-06T21:46:29.880049Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23589","last_updated":"2025-06-30T07:51:58Z","snapshot_observed_at":"2026-08-11T16:25:47.851476Z","submitted_at":"2025-06-30T07:51:58Z","title":"Transition Matching: Scalable and Flexible Generative Modeling","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T21:46:29.880049Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2506.23589"},"observation_digest":"sha256:520e1f84bd7a8b8f8038d19e602f7ad4c93d6bc62e4571d485cb715eb884c4ea","observation_id":"b7223c85-c7ba-469f-9112-374f65e3e10c","resolution":{"observed_at":"2026-08-06T21:46:29.880049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-05T17:31:13.090698Z","title":"Yang, Z.; Jiang, H.; Hong, W.; Teng, J.; Zheng, W.; Dong, Y .; Ding, M.; and Tang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.16211","last_updated":"2025-08-22T08:34:03Z","snapshot_observed_at":"2026-08-14T04:54:25.719741Z","submitted_at":"2025-08-22T08:34:03Z","title":"Forecast then Calibrate: Feature Caching as ODE for Efficient Diffusion Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T17:31:13.090698Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2508.16211"},"observation_digest":"sha256:442ab0bec6d5f1ca47c4483543d4b34692d7ba899f7cc11ba5834d833c268f81","observation_id":"daa0ffd2-6861-4203-9c19-0f6db8c57089","resolution":{"observed_at":"2026-08-05T17:31:13.090698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-05T16:51:04.871975Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17718","last_updated":"2025-08-25T06:51:15Z","snapshot_observed_at":"2026-08-10T14:17:17.888963Z","submitted_at":"2025-08-25T06:51:15Z","title":"Instant Preference Alignment for Text-to-Image Diffusion Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T16:51:04.871975Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2508.17718"},"observation_digest":"sha256:36d6229331a58382180fde2aed45c187ddc1a3a245c5f3104ee5166d39f95105","observation_id":"ea52816b-2971-4602-8c7f-16d373a43fdc","resolution":{"observed_at":"2026-08-05T16:51:04.871975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-03T16:21:03.611426Z","title":"Tianze Yang, Yucheng Shi, Mengnan Du, Xuansheng Wu, Qiaoyu Tan, Jin Sun, and Ninghao Liu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14096","last_updated":"2026-06-10T16:47:57Z","snapshot_observed_at":"2026-08-12T08:47:39.932288Z","submitted_at":"2025-12-16T05:11:54Z","title":"RSTR: Reducing SpatioTemporal Redundancy in Diffusion Transformers","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T16:21:03.611426Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2512.14096"},"observation_digest":"sha256:184dc107fb9c83d5191f864b2f82d83a9e9d81d1f612c2bd8ef14a95e354f95a","observation_id":"2d5ba3b5-64ac-4ed0-88eb-1a4d88341b30","resolution":{"observed_at":"2026-08-03T16:21:03.611426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.06779","last_updated":"2026-05-12T01:06:55Z","snapshot_observed_at":"2026-08-06T03:10:19.369100Z","submitted_at":"2026-04-08T07:50:00Z","title":"VASR: Variance-Aware Systematic Resampling for Reward-Guided Diffusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T18:08:03.771557Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.06779"},"observation_digest":"sha256:a1d97de94e73e8aaaa35bda49b365107f7109d0c6084da14d5799475cfb99070","observation_id":"1800a835-487c-4486-816d-1da1c6aa05b1","resolution":{"observed_at":"2026-05-11T05:26:00.356533Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.06779","last_updated":"2026-05-12T01:06:55Z","snapshot_observed_at":"2026-08-06T03:10:19.369100Z","submitted_at":"2026-04-08T07:50:00Z","title":"VASR: Variance-Aware Systematic Resampling for Reward-Guided Diffusion","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T01:08:01.321456Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.06779"},"observation_digest":"sha256:567681595b25ba6df354bf5d7007a1fa1d05cd3c0f8fca14a59a32f04ebc9c2f","observation_id":"64df5ba0-bd64-45ad-a7af-e2e5ca0bcdf2","resolution":{"observed_at":"2026-05-13T01:52:06.611246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:2f93c5cbe2e493130eb8757b3cec601bc1fc651ed823d4ca50386f279728fcba","observation_id":"1abba70d-0279-4911-8d03-f199056eeed9","resolution":{"observed_at":"2026-05-10T06:11:20.043771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.23536","last_updated":"2026-04-26T05:16:54Z","snapshot_observed_at":"2026-08-13T03:39:46.544091Z","submitted_at":"2026-04-26T05:16:54Z","title":"$Z^2$-Sampling: Zero-Cost Zigzag Trajectories for Semantic Alignment in Diffusion Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T06:41:04.597012Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.23536"},"observation_digest":"sha256:560cadbe357a76713ddba6793791c1b79038704ef4d79299eab4160dfe8d32da","observation_id":"eb2e13a8-cb6d-42c0-9201-68c8cbf25caf","resolution":{"observed_at":"2026-05-11T21:06:15.209157Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.23540","last_updated":"2026-04-26T05:32:26Z","snapshot_observed_at":"2026-08-12T18:51:31.849899Z","submitted_at":"2026-04-26T05:32:26Z","title":"Oracle Noise: Faster Semantic Spherical Alignment for Interpretable Latent Optimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-08T06:58:09.085573Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.23540"},"observation_digest":"sha256:c06d6c138c200f7c82373c76670bab11514254f3b455dbe63149485e910e25a9","observation_id":"3f289424-6dcf-446d-86f9-9fb23dbd3458","resolution":{"observed_at":"2026-05-11T21:06:12.029802Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.26503","last_updated":"2026-04-29T10:08:08Z","snapshot_observed_at":"2026-08-15T19:27:52.761635Z","submitted_at":"2026-04-29T10:08:08Z","title":"Delta Score Matters! Spatial Adaptive Multi Guidance in Diffusion Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T11:08:23.853123Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.26503"},"observation_digest":"sha256:b931067b24f301d82a7f8e6bf6d58bb34ca6c39c23bc2d59ed184c47d93681db","observation_id":"8efce8fc-1186-4da8-9179-edcad76635b3","resolution":{"observed_at":"2026-05-12T09:26:25.080504Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.27147","last_updated":"2026-06-02T08:50:59Z","snapshot_observed_at":"2026-08-02T17:45:20.844823Z","submitted_at":"2026-04-29T19:56:53Z","title":"How to Guide Your Flow: Few-Step Alignment via Flow Map Reward Guidance","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-07T09:24:42.020782Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.27147"},"observation_digest":"sha256:f110e57a26e8bf263100f7442c9a9220b7f1b998880f13b315594ecb99b3495d","observation_id":"4a4ec9df-6e1e-49f7-aea3-775bf2f2b487","resolution":{"observed_at":"2026-05-12T09:46:26.716586Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.27147","last_updated":"2026-06-02T08:50:59Z","snapshot_observed_at":"2026-08-02T17:45:20.844823Z","submitted_at":"2026-04-29T19:56:53Z","title":"How to Guide Your Flow: Few-Step Alignment via Flow Map Reward Guidance","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-21T09:25:19.439423Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.27147"},"observation_digest":"sha256:826155c7e91b7f5ea6c3835a6a2551c114cfd209fd00bc6637f2a3653b8e987f","observation_id":"fed94833-c49a-46c7-bbcd-5aadc2355169","resolution":{"observed_at":"2026-05-21T09:29:57.086631Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.27147","last_updated":"2026-06-02T08:50:59Z","snapshot_observed_at":"2026-08-02T17:45:20.844823Z","submitted_at":"2026-04-29T19:56:53Z","title":"How to Guide Your Flow: Few-Step Alignment via Flow Map Reward Guidance","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-01T08:19:37.044714Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.27147"},"observation_digest":"sha256:0603f15c84c4dadecdb904fbc67779a356503237d3d73f08c2c84d02e8501fdb","observation_id":"284ac173-7a76-4305-ae66-32c021f21e94","resolution":{"observed_at":"2026-07-01T08:25:33.233812Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2605.16951","last_updated":"2026-05-16T12:05:39Z","snapshot_observed_at":"2026-08-02T16:28:04.937142Z","submitted_at":"2026-05-16T12:05:39Z","title":"Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T20:44:54.356658Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2605.16951"},"observation_digest":"sha256:3fedbb982f2b7a0563f7cdfa8d19a111f2396c743d58417d4881a308bc37bf98","observation_id":"22f432ac-4368-49d3-83ea-cfcdfbe884fc","resolution":{"observed_at":"2026-05-19T20:47:45.886596Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2605.28615","last_updated":"2026-05-27T15:27:13Z","snapshot_observed_at":"2026-08-11T23:33:03.733557Z","submitted_at":"2026-05-27T15:27:13Z","title":"Compositional Text-to-Image Generation Via Region-aware Bimodal Direct Preference Optimization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-29T13:15:24.299457Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2605.28615"},"observation_digest":"sha256:6f6295239e65ef3cf61c127e137f467305e4dbd99c729d3ade3c3902ebfbb99b","observation_id":"e5da4431-8128-489a-8fe0-2c0fdf5f475a","resolution":{"observed_at":"2026-06-29T13:23:28.301718Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2606.00583","last_updated":"2026-05-30T07:21:40Z","snapshot_observed_at":"2026-08-06T21:04:24.758200Z","submitted_at":"2026-05-30T07:21:40Z","title":"Improving Visual Representation Alignment Generation with GRPO","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T19:24:09.597127Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2606.00583"},"observation_digest":"sha256:29a095beaec38fbd679f95e2a6283385a0a5d7ce85b25280280b1e4a4c4be121","observation_id":"cedbf30a-2a9e-4f45-bece-f2a4ebe91d87","resolution":{"observed_at":"2026-06-28T19:32:35.119408Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2606.22394","last_updated":"2026-07-18T17:41:38Z","snapshot_observed_at":"2026-08-14T18:58:05.494746Z","submitted_at":"2026-06-21T08:49:50Z","title":"Curvature-Adaptive Consistency Flow Matching: Autonomous Trajectory Optimization via Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-26T10:40:22.767129Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2606.22394"},"observation_digest":"sha256:30667ba0d88cd76f93759be875d711ec7524c814a5b2fda46c737a7711ec70dd","observation_id":"7e3afb54-4f5a-47b9-87ed-dd6e1d533cef","resolution":{"observed_at":"2026-07-04T08:59:43.033175Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-02T10:36:55.278253Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22394","last_updated":"2026-07-18T17:41:38Z","snapshot_observed_at":"2026-08-14T18:58:05.494746Z","submitted_at":"2026-06-21T08:49:50Z","title":"Curvature-Adaptive Consistency Flow Matching: Autonomous Trajectory Optimization via Reinforcement Learning","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T10:36:55.278253Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2606.22394"},"observation_digest":"sha256:c92fbf28fa20bd81c4e334479a57e64292cf9822cf9ca960ce40a5ecff48766b","observation_id":"8c79120d-a24c-4583-95c8-df4c7ccbb1b5","resolution":{"observed_at":"2026-08-02T10:36:55.278253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2606.29059","last_updated":"2026-07-15T20:54:13Z","snapshot_observed_at":"2026-08-13T02:51:16.467245Z","submitted_at":"2026-06-27T19:35:27Z","title":"Flow Matching in Feature Space for Stochastic World Modeling","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-30T09:31:11.525648Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2606.29059"},"observation_digest":"sha256:a677f366d572656ac222ad84dbc198238b1ba332a5d18054e24eb0bb233b8c28","observation_id":"553d7926-965d-4d7e-9f22-505ee3ff04f8","resolution":{"observed_at":"2026-06-30T09:34:34.558476Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2607.01803","last_updated":"2026-07-04T06:58:16Z","snapshot_observed_at":"2026-08-02T02:22:21.215897Z","submitted_at":"2026-07-02T07:18:37Z","title":"PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-03T16:13:41.928049Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2607.01803"},"observation_digest":"sha256:8244087b4fc21318c31474c78343d57f8b373b196b587dbfb824477d83b12357","observation_id":"3c5b1a9e-2ea3-4254-a910-7083ece39728","resolution":{"observed_at":"2026-07-03T16:18:37.399767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-12T08:36:06.846852Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.01803","last_updated":"2026-07-04T06:58:16Z","snapshot_observed_at":"2026-08-02T02:22:21.215897Z","submitted_at":"2026-07-02T07:18:37Z","title":"PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-12T08:36:06.846852Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2607.01803"},"observation_digest":"sha256:4452642acf2fc9eccd8be3f0c158673ec2da4121fbf6b13f45bdc4ca2ed18c4b","observation_id":"6b712c79-44cc-48e3-bf8d-77a50ec83bed","resolution":{"observed_at":"2026-07-12T08:36:06.846852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-01T15:42:56.203684Z","title":"ImageReward: Learning and evaluating human preferences for text-to-image generation.arXiv preprint arXiv:2304.05977, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18237","last_updated":"2026-07-20T17:59:51Z","snapshot_observed_at":"2026-08-13T23:59:54.707894Z","submitted_at":"2026-07-20T17:59:51Z","title":"The Many Senses of Visual Similarity: A Text-Prompted Image Perceptual Metric","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T15:42:56.203684Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2607.18237"},"observation_digest":"sha256:3076d16e90d192d1e3818273b5fa74c87e4cff631fe340a063a1d82c24d0aaea","observation_id":"f08eb537-a75e-4a2e-9991-5f319e2cbc72","resolution":{"observed_at":"2026-08-01T15:42:56.203684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-01T13:39:00.645797Z","title":"ImageReward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-15T16:32:39.157631Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T13:39:00.645797Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:95156e5f95aa9986dd8ed82f5ba49203698f4ae5df2d53d4a7201de055e08828","observation_id":"3fc4c5fe-f406-4084-a671-33dbcfab3280","resolution":{"observed_at":"2026-08-01T13:39:00.645797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-01T03:30:26.281566Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23159","last_updated":"2026-07-30T17:05:25Z","snapshot_observed_at":"2026-08-08T03:43:48.617203Z","submitted_at":"2026-07-25T11:30:59Z","title":"CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T03:30:26.281566Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2607.23159"},"observation_digest":"sha256:aa818fa92fd579428c0a73643cdffbd268dd7ce82ac272f45c147f002b022fc8","observation_id":"c17b7af1-2549-4270-b035-5a24bb788250","resolution":{"observed_at":"2026-08-01T03:30:26.281566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-30T21:02:13.350950Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23488","last_updated":"2026-07-26T06:29:48Z","snapshot_observed_at":"2026-08-08T07:35:57.574796Z","submitted_at":"2026-07-26T06:29:48Z","title":"Learning Sampling Parameters for Diffusion Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-30T21:02:13.350950Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2607.23488"},"observation_digest":"sha256:435fd06ad64e5045d61bf96be47eee1dbc457e3c52f59437db1e10e1e2822541","observation_id":"d733514f-41f3-4d89-9203-2a377616be3a","resolution":{"observed_at":"2026-07-30T21:02:13.350950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-05T05:39:06.111959Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03929","last_updated":"2026-08-05T03:09:27Z","snapshot_observed_at":"2026-08-15T13:47:43.821264Z","submitted_at":"2026-08-04T17:00:52Z","title":"Latent Reward Registers for Diffusion Preference Alignment","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T05:39:06.111959Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2608.03929"},"observation_digest":"sha256:e15311eee3f8c90bb60e109976c65dac0578140bb2912ac35aa3ab0d60ed7554","observation_id":"dcfb9715-1f30-485f-be5f-349834084304","resolution":{"observed_at":"2026-08-05T05:39:06.111959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-08T00:41:15.257657Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03929","last_updated":"2026-08-05T03:09:27Z","snapshot_observed_at":"2026-08-15T13:47:43.821264Z","submitted_at":"2026-08-04T17:00:52Z","title":"Latent Reward Registers for Diffusion Preference Alignment","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T00:41:15.257657Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2608.03929"},"observation_digest":"sha256:fa496b7cf97e218ba1864a82220d061710dd768f1ac6e6eeab15e95dbebfcccd","observation_id":"21468456-c7ab-4914-808a-0e0927b6ec2c","resolution":{"observed_at":"2026-08-08T00:41:15.257657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T14:30:30.456120Z","title":"2023 , doi =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06125","last_updated":"2026-08-06T14:55:42Z","snapshot_observed_at":"2026-08-15T03:50:38.211687Z","submitted_at":"2026-08-06T14:55:42Z","title":"Sample-Adaptive Latent Rewards for Uncertainty-Guided Diffusion Post-Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:30:30.456120Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2608.06125"},"observation_digest":"sha256:d0ffb3bb3ed59b6e16bfd0b2b528a0eb2e9daf15662e90d4d16f45c8fe425e3b","observation_id":"65f546c9-842e-4788-bb9b-85b27b0205dc","resolution":{"observed_at":"2026-08-07T14:30:30.456120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2304.05977/citation-record","integrity":"/paper/2304.05977/integrity","json":"/paper/2304.05977/citation-record.json","paper":"/paper/2304.05977"},"outbound":[],"paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T12:04:07.414191Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 45 inbound Pith citation observations for arXiv:2304.05977."}