{"as_of":"2026-08-08T16:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5829652168a4c735fd392bf9eff52e7f93bd8bc3921a8fb8327e6a3ab752a5e1","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:23:13.232281Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:32:13.061231Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T00:14:04.763204Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22002","snapshot_observed_at":"2026-08-05T12:32:13.061231Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.01535","last_updated":"2025-09-09T04:01:50Z","snapshot_observed_at":"2026-08-05T12:32:10.656133Z","submitted_at":"2025-09-01T15:13:15Z","title":"CAT: Causal Attention Tuning For Injecting Fine-grained Causal Knowledge into Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T12:32:13.061231Z"},"links":{"cited_paper":"/paper/2505.22002","citing_paper":"/paper/2509.01535"},"observation_digest":"sha256:2e4a5434a9129a345b8194d908311bd6b30b01e08288a5b92be0ce974ae1db37","observation_id":"677826cb-de02-4929-9679-b1925de96318","resolution":{"observed_at":"2026-08-05T12:32:13.061231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"cited_work":{"arxiv_id":"2505.22002","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22002","snapshot_observed_at":"2026-06-30T00:14:04.763204Z","title":"D-fusion: Direct preference optimization for aligning diffusion mod- els with visually consistent samples","venue":null,"work_id":"78f9834f-5a48-444b-ba59-130b74831a93","year":2025},"citing_paper":{"arxiv_id":"2604.19406","last_updated":"2026-04-21T12:29:50Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T12:29:50Z","title":"HP-Edit: A Human-Preference Post-Training Framework for Image Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T03:26:15.525307Z"},"links":{"cited_paper":"/paper/2505.22002","citing_paper":"/paper/2604.19406"},"observation_digest":"sha256:1fa3333a7b12bc73ced747f52fc8f30cf8751033fbea89aa6f485777b151915e","observation_id":"b9fe8573-fd92-4b3f-8bb4-0b2a1dbdbda2","resolution":{"observed_at":"2026-05-10T03:29:21.991785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"cited_work":{"arxiv_id":"2505.22002","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22002","snapshot_observed_at":"2026-06-30T00:14:04.763204Z","title":"D-fusion: Direct preference optimization for aligning diffusion mod- els with visually consistent samples","venue":null,"work_id":"78f9834f-5a48-444b-ba59-130b74831a93","year":2025},"citing_paper":{"arxiv_id":"2604.26341","last_updated":"2026-04-29T06:46:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T06:46:59Z","title":"SpatialFusion: Endowing Unified Image Generation with Intrinsic 3D Geometric Awareness","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-07T13:45:53.346402Z"},"links":{"cited_paper":"/paper/2505.22002","citing_paper":"/paper/2604.26341"},"observation_digest":"sha256:6a4d7cae5af5be2fe7484a9e53fca8e96293315b5c881e72a0e4fa781d1352dc","observation_id":"23dd579a-9728-4b0b-b4c2-918929da3a5a","resolution":{"observed_at":"2026-05-12T08:46:26.784659Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"cited_work":{"arxiv_id":"2505.22002","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22002","snapshot_observed_at":"2026-06-30T00:14:04.763204Z","title":"D-fusion: Direct preference optimization for aligning diffusion mod- els with visually consistent samples","venue":null,"work_id":"78f9834f-5a48-444b-ba59-130b74831a93","year":2025},"citing_paper":{"arxiv_id":"2605.25759","last_updated":"2026-05-25T12:10:23Z","snapshot_observed_at":"2026-07-06T23:35:41.527169Z","submitted_at":"2026-05-25T12:10:23Z","title":"Towards Anatomically Plausible Human Image Generation via Synthetic Localized Preferences","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T22:55:02.514189Z"},"links":{"cited_paper":"/paper/2505.22002","citing_paper":"/paper/2605.25759"},"observation_digest":"sha256:3b182ab3f4fca8a87ff1a30b6386ea44f4d3be220091a64e384aceba8f3ca68e","observation_id":"ef9aca14-7908-42ed-aaf8-dbb5884d17c5","resolution":{"observed_at":"2026-06-30T00:14:04.764679Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22002/citation-record","integrity":"/paper/2505.22002/integrity","json":"/paper/2505.22002/citation-record.json","paper":"/paper/2505.22002"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:15.239769Z","title":"a cat playing chess","venue":null,"work_id":"18acea10-04af-498e-9dfb-146c8edf6d8a","year":2022},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:13.076365Z"},"links":{"citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:4b23b3861959c7ff57c3f1f073b27f4e309c3c94d6ad1ff4cf4c6f0e542212e6","observation_id":"555c8067-fad8-46a3-a03e-ee56fb3339ac","resolution":{"observed_at":"2026-08-07T13:23:15.369378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:15.097795Z","title":null,"venue":null,"work_id":"0234647b-dab7-4cd2-b953-e9c940db4b48","year":2023},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:13.232281Z"},"links":{"citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:f6848158ccad6e55275293c9dbd8a79b0b9435e8782be8792720915b57308f6c","observation_id":"65feb258-915e-4f25-925e-efff7574de75","resolution":{"observed_at":"2026-08-07T13:23:15.148362Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08465","last_updated":"2023-04-17T17:42:19Z","snapshot_observed_at":"2026-07-06T15:16:38.500909Z","submitted_at":"2023-04-17T17:42:19Z","title":"MasaCtrl: Tuning-Free Mutual Self-Attention Control for Consistent Image Synthesis and Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08465","snapshot_observed_at":"2026-08-07T13:23:01.535445Z","title":"Cao, P., Zhou, F., Song, Q., and Yang, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:01.535445Z"},"links":{"cited_paper":"/paper/2304.08465","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:99447c06c0cea3b276135d9ebeeb7f84598d21bb243105134f37a067347c9b52","observation_id":"25782779-e3d9-4e4a-a606-4aa42e6df935","resolution":{"observed_at":"2026-08-07T13:23:01.535445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04137","last_updated":"2024-03-14T04:36:31Z","snapshot_observed_at":"2026-08-03T00:02:57.373313Z","submitted_at":"2023-03-07T18:50:03Z","title":"Diffusion Policy: Visuomotor Policy Learning via Action Diffusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04137","snapshot_observed_at":"2026-08-07T13:23:01.681084Z","title":"Clark, K., Vicol, P., Swersky, K., and Fleet, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:01.681084Z"},"links":{"cited_paper":"/paper/2303.04137","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:b20c187da9a7e5a11d5cfc912721a003c54586211c678ab0d651b822e558ecfd","observation_id":"3a8cff3d-d226-4972-ad8c-cd17f12c0b71","resolution":{"observed_at":"2026-08-07T13:23:01.681084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17400","last_updated":"2024-06-21T16:45:11Z","snapshot_observed_at":"2026-08-06T10:08:54.816113Z","submitted_at":"2023-09-29T17:01:02Z","title":"Directly Fine-Tuning Diffusion Models on Differentiable Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17400","snapshot_observed_at":"2026-08-07T13:23:01.857245Z","title":"Dhariwal, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:01.857245Z"},"links":{"cited_paper":"/paper/2309.17400","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:77235cd05c6c3e753e5c21fc4150a6025650fa60139d551f5b98fa64fb17c040","observation_id":"cab5368b-98e2-4836-adbe-30abf0c65cf7","resolution":{"observed_at":"2026-08-07T13:23:01.857245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T13:23:02.243017Z","title":"Fan, Y ., Watkins, O., Du, Y ., Liu, H., Ryu, M., Boutilier, C., Abbeel, P., Ghavamzadeh, M., Lee, K., and Lee, K","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:02.243017Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:3b3257f1e70b5feed824544737cc11310b5a0ef9340608e4c02c9f1b6fd0d151","observation_id":"5ecb4595-6c47-4649-8996-0a1dfef93ef1","resolution":{"observed_at":"2026-08-07T13:23:02.243017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16381","last_updated":"2023-11-01T04:48:26Z","snapshot_observed_at":"2026-07-06T15:33:34.832607Z","submitted_at":"2023-05-25T17:35:38Z","title":"DPOK: Reinforcement Learning for Fine-tuning Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16381","snapshot_observed_at":"2026-08-07T13:23:02.418961Z","title":"org/abs/2305.16381","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:02.418961Z"},"links":{"cited_paper":"/paper/2305.16381","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:95b4241a02ddbbd7ff441e9df2ad78be92be9417affa26c22e34a6c96d086d49","observation_id":"bfadfe4b-fe21-42a6-a158-e37ddc665651","resolution":{"observed_at":"2026-08-07T13:23:02.418961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T13:23:02.599283Z","title":"Hessel, J., Holtzman, A., Forbes, M., Bras, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:02.599283Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:dd849b3ccc0d5fba42f601b2f998f80bc004aab2b8e17a843090924bf4f928b6","observation_id":"eb3fc34d-7ebe-4f2a-a66d-134fd9f89aa2","resolution":{"observed_at":"2026-08-07T13:23:02.599283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-07T13:23:02.807042Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:02.807042Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:cf0567ce7563890db1ef3cdd47171b33ac380d1e2c8d6637d01bae3b9e82876d","observation_id":"2ff9c380-b6e0-4d01-9d5e-d3f75dc064f0","resolution":{"observed_at":"2026-08-07T13:23:02.807042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T13:23:02.952670Z","title":"Ho, J., Jain, A., and Abbeel, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:02.952670Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:f3faea3c015aa89b3dd164d4a41264bf77fad7b75f0f2021f082419286a3d92d","observation_id":"055f8554-e976-4e3a-89e4-d991cee6599f","resolution":{"observed_at":"2026-08-07T13:23:02.952670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T13:23:03.292947Z","title":"org/abs/2106.09685","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:03.292947Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:b6f52d87a8eea1ac4959b5ddbf2258068693f28af130d0a36d93d68a8654df13","observation_id":"d9ec8f4e-18d2-40a3-ba0c-ce9d6d23c0b7","resolution":{"observed_at":"2026-08-07T13:23:03.292947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:03.630103Z","title":"doi: 10.1145/3703155","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:03.630103Z"},"links":{"citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:6ff0b90b4173cfa4cec45fb8083ff9dd75725e95bfcd8e7b0c8e97702c96f51e","observation_id":"a414adea-0be0-4f8e-8f7a-dc34d30893c4","resolution":{"observed_at":"2026-08-07T13:23:03.630103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03653","last_updated":"2024-11-27T09:55:41Z","snapshot_observed_at":"2026-07-06T17:55:49.302964Z","submitted_at":"2024-04-04T17:59:46Z","title":"CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03653","snapshot_observed_at":"2026-08-07T13:23:03.828401Z","title":"Kawar, B., Zada, S., Lang, O., Tov, O., Chang, H., Dekel, T., Mosseri, I., and Irani, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:03.828401Z"},"links":{"cited_paper":"/paper/2404.03653","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:143bbfa9aa18134b0884987dea7ff0fb549be18c3fd286ab463adf18025951fd","observation_id":"e7ae4da1-4a0c-4d71-853f-c81917c6b9bb","resolution":{"observed_at":"2026-08-07T13:23:03.828401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09276","last_updated":"2023-03-20T15:58:50Z","snapshot_observed_at":"2026-07-06T14:06:48.707061Z","submitted_at":"2022-10-17T17:27:32Z","title":"Imagic: Text-Based Real Image Editing with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09276","snapshot_observed_at":"2026-08-07T13:23:03.995514Z","title":"Kong, A., Ma, W., Zhao, S., Li, Y ., Wu, Y ., Wang, K., Liu, X., Li, Q., Qin, Y ., and Huang, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:03.995514Z"},"links":{"cited_paper":"/paper/2210.09276","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:5277316ff2dbad5f80e5dc8957060c8f61d43edbabd2febe9a69b73fc62a985f","observation_id":"8254a454-61fc-4f23-810f-42734a3871a0","resolution":{"observed_at":"2026-08-07T13:23:03.995514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01821","last_updated":"2025-02-27T05:42:17Z","snapshot_observed_at":"2026-07-06T20:16:13.411201Z","submitted_at":"2025-01-03T14:09:46Z","title":"SDPO: Segment-Level Direct Preference Optimization for Social Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01821","snapshot_observed_at":"2026-08-07T13:23:04.117228Z","title":"Lee, K., Liu, H., Ryu, M., Watkins, O., Du, Y ., Boutilier, C., Abbeel, P., Ghavamzadeh, M., and Gu, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.117228Z"},"links":{"cited_paper":"/paper/2501.01821","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:a5558e8384992ead56afe27b3ca9f77b35f0cd914a27f4d41616b7a36cd9416b","observation_id":"1c346a8e-77b2-476e-a1e4-e65f339be3a7","resolution":{"observed_at":"2026-08-07T13:23:04.117228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-07T13:23:04.252641Z","title":"Liu, Y ., Yao, Y ., Ton, J.-F., Zhang, X., Guo, R., Cheng, H., Klochkov, Y ., Taufiq, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.252641Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:37c948080e296f73b8204b8096fe21ed29e592b73d407964a39aab8780723108","observation_id":"1e1734a6-acea-491d-8039-6c7dd6a19905","resolution":{"observed_at":"2026-08-07T13:23:04.252641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-07T13:23:04.358322Z","title":"Lu, C., Krishna, R., Bernstein, M., and Fei-Fei, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.358322Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:99b6bace860136c8ad02843b2681c0f92252906bcd907779c9af795ded160747","observation_id":"b462b511-c8d5-45d8-b1b3-5ee1f1631a3a","resolution":{"observed_at":"2026-08-07T13:23:04.358322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09794","last_updated":"2022-11-17T18:58:14Z","snapshot_observed_at":"2026-08-04T20:45:04.370492Z","submitted_at":"2022-11-17T18:58:14Z","title":"Null-text Inversion for Editing Real Images using Guided Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09794","snapshot_observed_at":"2026-08-07T13:23:04.667462Z","title":"org/abs/2211.09794","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.667462Z"},"links":{"cited_paper":"/paper/2211.09794","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:db8f727a33cfed8c7618c2f90221c41bbf752611239d4633ecb4ca94d7adf529","observation_id":"75c08bd0-bfac-4552-af51-3094f9366dc1","resolution":{"observed_at":"2026-08-07T13:23:04.667462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08639","last_updated":"2024-12-11T18:58:41Z","snapshot_observed_at":"2026-07-06T20:05:28.003434Z","submitted_at":"2024-12-11T18:58:41Z","title":"Fast Prompt Alignment for Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":"2412.08639","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.08639","snapshot_observed_at":"2026-08-07T13:23:13.963618Z","title":"Fast Prompt Alignment for Text-to-Image Generation","venue":"cs.CL","work_id":"bb7be8d8-d216-4d98-8634-21d0a6bb599c","year":2024},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.804389Z"},"links":{"cited_paper":"/paper/2412.08639","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:791091937f262aaacf6849f86775da8b3e9cb126c2b75762dd5cd3ceab890c2f","observation_id":"4233c6f0-a7fb-49ef-8a49-d276128fed8e","resolution":{"observed_at":"2026-08-07T13:23:14.130121Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-07T13:23:05.343879Z","title":"Peebles, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:05.343879Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:1f6e8f1ddea0d8a9d238a4a946471bcef217a37dd8c2a7eb652b27ef3c06c74f","observation_id":"b20144f8-927e-42f5-9f2a-04f10f3efd2a","resolution":{"observed_at":"2026-08-07T13:23:05.343879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-07-06T14:32:37.317828Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-07T13:23:07.321643Z","title":"Poole, B., Jain, A., Barron, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:07.321643Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:b603e39f295aa15701578f5ca17e9c2e7006c01f5aafec125fb6f1da7b894ca6","observation_id":"b8f4a08b-dbe4-4c3b-bc45-18239e48d035","resolution":{"observed_at":"2026-08-07T13:23:07.321643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-07T13:23:07.456286Z","title":"Preechakul, K., Chatthee, N., Wizadwongsa, S., and Suwa- janakorn, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:07.456286Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:6a7585f486d1451cfa65cb30a6ba875c8071a75adbe256dd4914dfaa3cd6fc94","observation_id":"e10309dc-8029-45d0-88bd-1aefc24c8ca9","resolution":{"observed_at":"2026-08-07T13:23:07.456286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.15640","last_updated":"2022-03-10T00:32:40Z","snapshot_observed_at":"2026-08-07T16:39:05.398735Z","submitted_at":"2021-11-30T18:24:04Z","title":"Diffusion Autoencoders: Toward a Meaningful and Decodable Representation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.15640","snapshot_observed_at":"2026-08-07T13:23:07.623938Z","title":"Radford, A., Kim, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:07.623938Z"},"links":{"cited_paper":"/paper/2111.15640","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:8a335f750ff82684f09ba7c777a3188876635f0040d3988975efacbe66f8da5a","observation_id":"bbb02988-905c-4a91-a752-c27ffe2b99b0","resolution":{"observed_at":"2026-08-07T13:23:07.623938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T13:23:08.111582Z","title":"Rafailov, R., Sharma, A., Mitchell, E., Ermon, S., Manning, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:08.111582Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:f2cc3f337e3e5e37603ef850137e9a8eb41f93f3ad7aeed25793372abf5342de","observation_id":"8bb66da3-0afc-4d37-824e-6ae84e45fd9d","resolution":{"observed_at":"2026-08-07T13:23:08.111582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-07T13:23:09.937975Z","title":"Rombach, R., Blattmann, A., Lorenz, D., Esser, P., and Ommer, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:09.937975Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:49844c674064397c075038e7545af5a2c9dd89507a41e61fa12243e614759cd5","observation_id":"720f7d71-1a73-46b3-a8a9-4c93d02750ad","resolution":{"observed_at":"2026-08-07T13:23:09.937975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-07T13:23:10.048591Z","title":"Ronneberger, O., Fischer, P., and Brox, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.048591Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:76909d3b838c24f74f6e0ece57e66dbb6ccdabebf74aaf316627f87f6c58b89c","observation_id":"095c8792-5f6a-4fc5-ad5f-b4aefe4509f1","resolution":{"observed_at":"2026-08-07T13:23:10.048591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14435","last_updated":"2024-04-07T18:04:04Z","snapshot_observed_at":"2026-08-03T12:28:52.482674Z","submitted_at":"2023-06-26T06:04:09Z","title":"DragDiffusion: Harnessing Diffusion Models for Interactive Point-based Image Editing","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14435","snapshot_observed_at":"2026-08-07T13:23:10.427239Z","title":"Sohl-Dickstein, J., Weiss, E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.427239Z"},"links":{"cited_paper":"/paper/2306.14435","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:089b4f804894c7b0d8ea4b02bb11c725cede94fcee931bdd6bae80f092660980","observation_id":"9f173aeb-507a-483f-937d-b3c8f7d7073f","resolution":{"observed_at":"2026-08-07T13:23:10.427239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.03585","last_updated":"2015-11-18T21:50:51Z","snapshot_observed_at":"2026-07-06T04:11:47.439779Z","submitted_at":"2015-03-12T04:51:37Z","title":"Deep Unsupervised Learning using Nonequilibrium Thermodynamics","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.03585","snapshot_observed_at":"2026-08-07T13:23:10.578152Z","title":"Song, J., Meng, C., and Ermon, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.578152Z"},"links":{"cited_paper":"/paper/1503.03585","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:5c8e4ba0f772be26274882822d59cac86a75a0e90cd2f5ede1fe38f0b38226fa","observation_id":"d0401a6a-68df-461d-8c5e-40b135bef54c","resolution":{"observed_at":"2026-08-07T13:23:10.578152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T13:23:10.730864Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.730864Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:e98f6163cee725e614685797afda12fec50f503d305a829b2369010672a606d9","observation_id":"cb9426ff-2214-4f9a-8080-116c14c56d80","resolution":{"observed_at":"2026-08-07T13:23:10.730864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09011","last_updated":"2020-10-23T19:37:51Z","snapshot_observed_at":"2026-08-06T20:31:52.636592Z","submitted_at":"2020-06-16T09:17:17Z","title":"Improved Techniques for Training Score-Based Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09011","snapshot_observed_at":"2026-08-07T13:23:10.901070Z","title":"Tong, Y ., Yuan, J., Zhang, M., Zhu, D., Zhang, K., Wu, F., and Kuang, K","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.901070Z"},"links":{"cited_paper":"/paper/2006.09011","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:826c8a265359df5aeb6fa296549b5831bdbcab4e60cccba5e2441874a62601ef","observation_id":"797b8c62-23d6-4688-8e36-80a60f2f74d9","resolution":{"observed_at":"2026-08-07T13:23:10.901070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:11.090175Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.090175Z"},"links":{"citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:815f519bf59c6019ee88fb5b2b7e284bb901ff6681baf749049b998cc09d6551","observation_id":"e6f651d2-0b8c-43b9-b898-1407a1a25645","resolution":{"observed_at":"2026-08-07T13:23:11.090175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16101","last_updated":"2023-11-27T18:59:42Z","snapshot_observed_at":"2026-08-08T00:07:32.122707Z","submitted_at":"2023-11-27T18:59:42Z","title":"How Many Unicorns Are in This Image? A Safety Evaluation Benchmark for Vision LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16101","snapshot_observed_at":"2026-08-07T13:23:11.230813Z","title":"Tumanyan, N., Geyer, M., Bagon, S., and Dekel, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.230813Z"},"links":{"cited_paper":"/paper/2311.16101","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:5fe1acaa969fca458147abef3bcb8be21ee2b940c7550b99c58bc47de3093073","observation_id":"1567cb64-eba7-4cfd-a546-41f62aa51bc2","resolution":{"observed_at":"2026-08-07T13:23:11.230813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12572","last_updated":"2022-11-22T20:39:18Z","snapshot_observed_at":"2026-07-06T14:21:56.867696Z","submitted_at":"2022-11-22T20:39:18Z","title":"Plug-and-Play Diffusion Features for Text-Driven Image-to-Image Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12572","snapshot_observed_at":"2026-08-07T13:23:11.429291Z","title":"Vaswani, A., Shazeer, N., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.429291Z"},"links":{"cited_paper":"/paper/2211.12572","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:dad0b7d2091647423005c10dbdd7ac6edc548e14aa98a3933f0d742524d1db85","observation_id":"a340ab0d-fd6b-4896-8517-6484cb316afc","resolution":{"observed_at":"2026-08-07T13:23:11.429291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-07T13:23:11.567660Z","title":"Wallace, B., Dang, M., Rafailov, R., Zhou, L., Lou, A., Pu- rushwalkam, S., Ermon, S., Xiong, C., Joty, S., and Naik, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.567660Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:7771ddb3d49222eb9205206b94a5e7ccbee24cb47bfa0c04c29bc6f4b13a676a","observation_id":"ae06d4f7-f05e-4e6c-a785-ccc839ac2678","resolution":{"observed_at":"2026-08-07T13:23:11.567660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12908","last_updated":"2023-11-21T15:24:05Z","snapshot_observed_at":"2026-07-06T16:50:46.608196Z","submitted_at":"2023-11-21T15:24:05Z","title":"Diffusion Model Alignment Using Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12908","snapshot_observed_at":"2026-08-07T13:23:11.682372Z","title":"Wang, S., Saharia, C., Montgomery, C., Pont-Tuset, J., Noy, S., Pellegrini, S., Onoe, Y ., Laszlo, S., Fleet, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.682372Z"},"links":{"cited_paper":"/paper/2311.12908","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:ed005088650f222d72db9f0861919d410f2621725a308a1d50f915a68838aac3","observation_id":"ebb1aaea-ca66-4040-b019-22d9a329bd5b","resolution":{"observed_at":"2026-08-07T13:23:11.682372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06909","last_updated":"2023-04-12T22:42:08Z","snapshot_observed_at":"2026-07-06T14:30:16.328946Z","submitted_at":"2022-12-13T21:25:11Z","title":"Imagen Editor and EditBench: Advancing and Evaluating Text-Guided Image Inpainting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06909","snapshot_observed_at":"2026-08-07T13:23:11.844136Z","title":"Wang, Z., Tu, H., Mei, J., Zhao, B., Wang, Y ., and Xie, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.844136Z"},"links":{"cited_paper":"/paper/2212.06909","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:226caaac19b22f340efe4be7769ad7d638c0a60747fd089f4ce8d8c3ccf12f4f","observation_id":"422a07d5-0ade-481a-93e5-3e6f3d5c923b","resolution":{"observed_at":"2026-08-07T13:23:11.844136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09040","last_updated":"2024-10-11T17:55:09Z","snapshot_observed_at":"2026-08-06T15:07:20.898794Z","submitted_at":"2024-10-11T17:55:09Z","title":"AttnGCG: Enhancing Jailbreaking Attacks on LLMs with Attention Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09040","snapshot_observed_at":"2026-08-07T13:23:11.956259Z","title":"org/abs/2410.09040","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.956259Z"},"links":{"cited_paper":"/paper/2410.09040","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:33e075b2c076ce515f1fce93ae336e769f31b0da53c67be22f2a5a582748b1b9","observation_id":"a3456976-8d19-41d6-8adf-41f159710c7c","resolution":{"observed_at":"2026-08-07T13:23:11.956259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01693","last_updated":"2023-10-30T06:34:35Z","snapshot_observed_at":"2026-08-06T03:14:05.180330Z","submitted_at":"2023-06-02T17:11:37Z","title":"Fine-Grained Human Feedback Gives Better Rewards for Language Model Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01693","snapshot_observed_at":"2026-08-07T13:23:12.103502Z","title":"Xu, J., Liu, X., Wu, Y ., Tong, Y ., Li, Q., Ding, M., Tang, J., and Dong, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.103502Z"},"links":{"cited_paper":"/paper/2306.01693","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:3afcda0ee50865c29ce5e78bc60b9ffc62a387813698d837bee3343dd22c864a","observation_id":"098b5ba6-712a-4421-b688-ae65ff339045","resolution":{"observed_at":"2026-08-07T13:23:12.103502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-07-06T15:14:55.628493Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-08-07T13:23:12.222530Z","title":"Xu, M., Yu, L., Song, Y ., Shi, C., Ermon, S., and Tang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.222530Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:0500f72fbcc0d27e2761496f13dc598b19427e605196c85d6442f63b14779eaa","observation_id":"3060bb09-27e8-46ce-9a32-a562f8df7118","resolution":{"observed_at":"2026-08-07T13:23:12.222530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02923","last_updated":"2022-03-06T09:47:01Z","snapshot_observed_at":"2026-07-06T12:44:48.852327Z","submitted_at":"2022-03-06T09:47:01Z","title":"GeoDiff: a Geometric Diffusion Model for Molecular Conformation Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02923","snapshot_observed_at":"2026-08-07T13:23:12.395474Z","title":"org/abs/2203.02923","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.395474Z"},"links":{"cited_paper":"/paper/2203.02923","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:bec0eb712cf952fd25222c6111b213247464ba296e5ba25bfb542eb1c9762d80","observation_id":"7e8e2fb8-3024-4f03-9424-203a8b96e992","resolution":{"observed_at":"2026-08-07T13:23:12.395474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13231","last_updated":"2024-03-23T05:23:00Z","snapshot_observed_at":"2026-07-06T16:50:58.750467Z","submitted_at":"2023-11-22T08:42:46Z","title":"Using Human Feedback to Fine-tune Diffusion Models without Any Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13231","snapshot_observed_at":"2026-08-07T13:23:12.498356Z","title":"Using human feedback to fine-tune diffusion models without any reward model, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.498356Z"},"links":{"cited_paper":"/paper/2311.13231","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:e2ff6cd50986dbb1cbf7dbcbf758550ea8023f4ecf083901804da0355a1ff982","observation_id":"c479fbc2-c7c6-46ba-9dd9-7a2e670d54f1","resolution":{"observed_at":"2026-08-07T13:23:12.498356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11504","last_updated":"2023-06-20T12:50:49Z","snapshot_observed_at":"2026-07-06T15:44:35.147343Z","submitted_at":"2023-06-20T12:50:49Z","title":"Align, Adapt and Inject: Sound-guided Unified Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11504","snapshot_observed_at":"2026-08-07T13:23:12.619974Z","title":"Yu, T., Yao, Y ., Zhang, H., He, T., Han, Y ., Cui, G., Hu, J., Liu, Z., Zheng, H.-T., Sun, M., and Chua, T.-S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.619974Z"},"links":{"cited_paper":"/paper/2306.11504","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:c2385308e2fa625a9004340365a93b3faedb944e0e26ab827983bb5e361022ca","observation_id":"d30fad13-688f-472a-8fa6-10ece99ac71b","resolution":{"observed_at":"2026-08-07T13:23:12.619974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00849","last_updated":"2024-03-08T06:42:37Z","snapshot_observed_at":"2026-08-08T10:06:17.828993Z","submitted_at":"2023-12-01T11:36:08Z","title":"RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correctional Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00849","snapshot_observed_at":"2026-08-07T13:23:12.812692Z","title":"Zheng, G., Zhou, X., Li, X., Qi, Z., Shan, Y ., and Li, X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.812692Z"},"links":{"cited_paper":"/paper/2312.00849","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:b039364949b1cf5ddf0ad4684f55987be9b12213a407126fa25d1a8da7a3e4d2","observation_id":"ec1ab486-8a66-4f9a-95ce-5a0ed0c2bd63","resolution":{"observed_at":"2026-08-07T13:23:12.812692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17189","last_updated":"2024-03-12T13:15:24Z","snapshot_observed_at":"2026-08-04T23:51:21.430350Z","submitted_at":"2023-03-30T06:56:12Z","title":"LayoutDiffusion: Controllable Diffusion Model for Layout-to-image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17189","snapshot_observed_at":"2026-08-07T13:23:12.923543Z","title":"org/abs/2303.17189","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.923543Z"},"links":{"cited_paper":"/paper/2303.17189","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:4d991c6b56697b1b1b4d3152cce08246b7a625f4aa76d47a5a05168025157800","observation_id":"c60dde6b-f476-4227-9157-f03b5e4afb38","resolution":{"observed_at":"2026-08-07T13:23:12.923543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-06T11:05:16.105361Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-07T13:23:10.190412Z","title":"Schulman, J., Wolski, F., Dhariwal, P., Radford, A., and Klimov, O","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.190412Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:f21b28950996236a7bccd6366ad5ed058204ac40f8e9735e636e9bb1cf1807fa","observation_id":"9a63898a-fc7d-4874-9a3a-2b1d974c3e6c","resolution":{"observed_at":"2026-08-07T13:23:10.190412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.00187","last_updated":"2016-07-31T05:54:13Z","snapshot_observed_at":"2026-07-06T05:05:29.114427Z","submitted_at":"2016-07-31T05:54:13Z","title":"Visual Relationship Detection with Language Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.00187","snapshot_observed_at":"2026-08-07T13:23:04.486714Z","title":"Mokady, R., Hertz, A., Aberman, K., Pritch, Y ., and Cohen- Or, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.486714Z"},"links":{"cited_paper":"/paper/1608.00187","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:01a2a542774fe8a21d97644a8d98af520f535fa34ee8f795eeac8ce857efb470","observation_id":"9f8acd2c-8092-41aa-b313-5aca31293763","resolution":{"observed_at":"2026-08-07T13:23:04.486714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:23:10.300156Z","title":"Shi, Y ., Xue, C., Liew, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.300156Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:3016c10d278d230e997f85b4d4104e2642299421b3cb471faeba756f573b9898","observation_id":"479aa011-f2ea-48ec-9687-b7d731dee3bc","resolution":{"observed_at":"2026-08-07T13:23:10.300156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-07-06T09:30:47.469703Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-07T13:23:03.152344Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:03.152344Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:0b7cdd4bdf69c8103c713347d1fa4ebd29b7c71df5853cab838530af8fad08e5","observation_id":"eae8015b-9296-4197-9adc-90384ab2461f","resolution":{"observed_at":"2026-08-07T13:23:03.152344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.05233","last_updated":"2021-06-01T17:49:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-11T17:50:24Z","title":"Diffusion Models Beat GANs on Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.05233","snapshot_observed_at":"2026-08-07T13:23:02.095620Z","title":"Dosovitskiy, A., Beyer, L., Kolesnikov, A., Weissenborn, D., Zhai, X., Unterthiner, T., Dehghani, M., Minderer, M., Heigold, G., Gelly, S., Uszkoreit, J., and Houlsby, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:02.095620Z"},"links":{"cited_paper":"/paper/2105.05233","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:84d9c13e0c2a64d74438371a3f3d92d32be9ee5224a4083e348eb4a53203fb7a","observation_id":"36f45c74-5c15-436e-bd58-a2168113b18a","resolution":{"observed_at":"2026-08-07T13:23:02.095620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T13:23:01.130908Z","title":"Bai, Z., Wang, P., Xiao, T., He, T., Han, Z., Zhang, Z., and Shou, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:01.130908Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:513649dc6c86f04f8c19df3390a5aacddd570cb7f8ff69bec5c6c9b20813894e","observation_id":"2f329f97-1758-46c0-bbff-d99d17cf7c00","resolution":{"observed_at":"2026-08-07T13:23:01.130908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T13:23:01.364254Z","title":"Cao, M., Wang, X., Qi, Z., Shan, Y ., Qie, X., and Zheng, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:01.364254Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:b7b793234b21ed357403eaf1b3996f54e05fbedbee80e7fb7c9fa3b17f7b2d27","observation_id":"fdc78d5b-3e9c-4473-89d0-cfb761724a05","resolution":{"observed_at":"2026-08-07T13:23:01.364254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-07T13:23:01.206270Z","title":"org/abs/2404.18930","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:01.206270Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:7633e99b65947e39bcffe5eb0d0398b37cb7be57be6ff1df2a24618cf7853752","observation_id":"4a9d209e-8ca3-4856-b047-2a39ba38dc7d","resolution":{"observed_at":"2026-08-07T13:23:01.206270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11240","last_updated":"2025-03-27T02:34:59Z","snapshot_observed_at":"2026-08-07T17:04:30.550213Z","submitted_at":"2025-03-14T09:45:19Z","title":"Towards Better Alignment: Training Diffusion Models with Reinforcement Learning Against Sparse Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11240","snapshot_observed_at":"2026-08-07T13:23:03.425660Z","title":"org/abs/2503.11240","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:03.425660Z"},"links":{"cited_paper":"/paper/2503.11240","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:556169d7a28fc08e616ed090d46b4d8c12c1e741903c5f8a80eb01a0614b5480","observation_id":"2c0a9f22-4a7e-4eab-b5c2-0342d3b9d6c4","resolution":{"observed_at":"2026-08-07T13:23:03.425660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 4 inbound Pith citation observations for arXiv:2505.22002."}