{"as_of":"2026-08-21T14:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fdf9d656dc182478e5e3e484dab53652863e89f8d8300278b6bbc8de8d4d8a68","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:49:17.836268Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T15:33:30.182150Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T16:17:08.893198Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2504.14534","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14534","snapshot_observed_at":"2026-07-02T16:17:08.893198Z","title":"Sudo: Enhancing text-to- image diffusion models with self-supervised direct preference optimization.arXiv preprint arXiv:2504.14534,","venue":null,"work_id":"00bcface-886e-4c20-af4b-4c416407ac01","year":2025},"citing_paper":{"arxiv_id":"2606.01636","last_updated":"2026-08-10T02:45:13Z","snapshot_observed_at":"2026-08-19T09:37:10.688079Z","submitted_at":"2026-06-01T03:41:04Z","title":"Pave-GRPO: Beyond Instantaneous Guidance through Principled Average Velocity Decomposition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T15:33:30.182150Z"},"links":{"cited_paper":"/paper/2504.14534","citing_paper":"/paper/2606.01636"},"observation_digest":"sha256:915bdd1a95555624950811b9c53b81dcd33126fe0d45290b4112ac70e1ad92f9","observation_id":"4ed4080b-a214-47bd-8b81-fd68de43048b","resolution":{"observed_at":"2026-07-01T22:16:16.544113Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2504.14534","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14534","snapshot_observed_at":"2026-07-02T16:17:08.893198Z","title":"Sudo: Enhancing text-to- image diffusion models with self-supervised direct preference optimization.arXiv preprint arXiv:2504.14534,","venue":null,"work_id":"00bcface-886e-4c20-af4b-4c416407ac01","year":2025},"citing_paper":{"arxiv_id":"2606.06828","last_updated":"2026-06-05T02:07:08Z","snapshot_observed_at":"2026-08-13T23:19:53.451225Z","submitted_at":"2026-06-05T02:07:08Z","title":"AdaGRPO: A Capability-Aware Adaptive Enhancement for Flow-based GRPO","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T22:54:21.740892Z"},"links":{"cited_paper":"/paper/2504.14534","citing_paper":"/paper/2606.06828"},"observation_digest":"sha256:5b6f10fe62753aa13850ac79e5eb531a6aa61e59d1904dcbb07cf034ac9ce731","observation_id":"99142947-ccbf-4b5b-8010-40c559cb63eb","resolution":{"observed_at":"2026-07-02T16:17:08.894690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.14534/citation-record","integrity":"/paper/2504.14534/integrity","json":"/paper/2504.14534/citation-record.json","paper":"/paper/2504.14534"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-16T11:49:17.691851Z","title":"Con- stitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.691851Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:d1fe60a332750f3492b975a715242f83c2e01a79d1a260cecbd3e179e0e6757a","observation_id":"bedb5f25-8b30-4b8c-9efd-72604fc4661b","resolution":{"observed_at":"2026-08-16T11:49:17.691851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.696683Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.696683Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:8a6ab3eafba7fed713e3d16bbbfff8052474c3466cf60f0847b9939dae63a569","observation_id":"d31038ad-834b-43eb-b703-febd17a498fa","resolution":{"observed_at":"2026-08-16T11:49:17.696683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-16T11:49:17.700298Z","title":"Training diffusion models with reinforce- ment learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.700298Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:db14641bd1f26f8fb40963daa8d8e5a7e66839d9c859f852834e0913f8a1ca6c","observation_id":"b20899e1-48bb-43b5-aa58-070af1403e98","resolution":{"observed_at":"2026-08-16T11:49:17.700298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.704537Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.704537Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:00367961e2a418901d7705ad7601537b4fd7195741fb0e661220248068ecfd47","observation_id":"246fe53b-4057-4289-8486-ffdd4e61f49f","resolution":{"observed_at":"2026-08-16T11:49:17.704537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-16T11:49:17.707990Z","title":"Pixart- alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.707990Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:54efe7b7116e5baf7481cad09d7391b5a95453504a3cdb001c7edc5f27bc99d2","observation_id":"9ee8baa3-cf67-4f76-87cf-3225f2daa3c4","resolution":{"observed_at":"2026-08-16T11:49:17.707990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.711609Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.711609Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:d9279e8ad39de3f9401e9366d3e22859496b2954a80bb76da21901d6529f8ab3","observation_id":"8110c9af-5564-4e70-81a6-9f307e21745a","resolution":{"observed_at":"2026-08-16T11:49:17.711609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17400","last_updated":"2024-06-21T16:45:11Z","snapshot_observed_at":"2026-08-06T10:08:54.816113Z","submitted_at":"2023-09-29T17:01:02Z","title":"Directly Fine-Tuning Diffusion Models on Differentiable Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17400","snapshot_observed_at":"2026-08-16T11:49:17.714948Z","title":"Directly fine-tuning diffusion models on differentiable re- wards","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.714948Z"},"links":{"cited_paper":"/paper/2309.17400","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:55dab45b4b3feaa3a5a8450d12427cdc87003bdde5ba306b2c3109895578478a","observation_id":"4db91052-95c3-490e-9ae0-ab81c91df7ac","resolution":{"observed_at":"2026-08-16T11:49:17.714948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15807","last_updated":"2023-09-27T17:30:19Z","snapshot_observed_at":"2026-08-16T14:57:07.361681Z","submitted_at":"2023-09-27T17:30:19Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15807","snapshot_observed_at":"2026-08-16T11:49:17.718896Z","title":"Emu: Enhanc- ing image generation models using photogenic needles in a haystack","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.718896Z"},"links":{"cited_paper":"/paper/2309.15807","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:c3bda1e51a23d842232c3dacd97994a144e70c91c10107f5ab122e47b38e42ec","observation_id":"72777574-9efd-4b56-9607-c61123d309de","resolution":{"observed_at":"2026-08-16T11:49:17.718896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.722677Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.722677Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:b691f353b9f7fce8f846751afd71bdfc7d7b759ef8a508cf20c88abb1a913fbd","observation_id":"256549e1-8840-47aa-9f16-9c62118e0eed","resolution":{"observed_at":"2026-08-16T11:49:17.722677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-16T11:49:17.726094Z","title":"Raft: Reward ranked finetuning for generative foundation model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.726094Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:e799da053754802a823c49563fbd6983a837228b564d10126a870d6e8cd8a8a2","observation_id":"ba98dd4e-f648-48fb-85f0-0baf940824cc","resolution":{"observed_at":"2026-08-16T11:49:17.726094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.251496Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":"8d214122-a8b2-4c23-9fa3-c6a65d31ec2e","year":null},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.729703Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:bf4062c81fea19eaa9e29807ff4e4544a13cc59d84bd684479f03380779d40cf","observation_id":"f3298e6c-85c2-4b41-800e-919aba529e65","resolution":{"observed_at":"2026-08-16T11:49:18.254965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.241419Z","title":"Re- inforcement learning for fine-tuning text-to-image diffusion models","venue":null,"work_id":"ca074945-4668-4a3e-bb03-4394443dc3d1","year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.733281Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:51969e6cf0aa6da78540ac628bb9760886dc466aea926c25a5497b5893ab6caa","observation_id":"d66e9b05-f61a-4667-af02-7c26c7cf411f","resolution":{"observed_at":"2026-08-16T11:49:18.244729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.736484Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.736484Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:6d8cf836d6c8ec0048752d05a5d072c0a1a2e3fa70f25ed3548774e941ea7891","observation_id":"350e9082-44e1-453f-b98d-821169662491","resolution":{"observed_at":"2026-08-16T11:49:17.736484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.224086Z","title":"Optimizing prompts for text-to-image generation","venue":null,"work_id":"7879c495-98da-40e0-bf70-f8a5603b24db","year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.739547Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:4a3abd53007f8fbf7cd513a77f3b8ea07db074af57456e2450a1d0c90a56f8f5","observation_id":"a8278d76-6217-4c5d-9086-4993f5407753","resolution":{"observed_at":"2026-08-16T11:49:18.227551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.742653Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.742653Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:100f88db74d2424c18e275dd34e15d3d7fe1dad665e214ad7fc24da907baf8bb","observation_id":"fa584a57-cffb-445e-8901-9fe000d8cf57","resolution":{"observed_at":"2026-08-16T11:49:17.742653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.745634Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.745634Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:32a43236b5aab61f9268e9f65780010e354025a3171944be007731bfad1aa0bc","observation_id":"10950062-8500-4826-b737-fb9e9cbeb35a","resolution":{"observed_at":"2026-08-16T11:49:17.745634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.748614Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.748614Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:b82b2b3c1b2080a46ca3ce9933334384f95a383bc13317d7edfdba1b0c6d5986","observation_id":"6eb58a61-844f-4cbb-902d-31dcfa1c9044","resolution":{"observed_at":"2026-08-16T11:49:17.748614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.751639Z","title":"Auto-encoding vari- ational bayes, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.751639Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:612145cc0cacdab8a585967a77a38faf707fa094a0620dae8ac1276acb118368","observation_id":"5dad04c7-0881-4041-954c-6d48aa26ce9d","resolution":{"observed_at":"2026-08-16T11:49:17.751639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.185639Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"b66a92ee-334b-4b75-9cff-bd9a6fd8d0dd","year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.754786Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:a9e99c513e0ba0648702fe6a6f414fc14339fc88d3a0a3d062a8028967882184","observation_id":"aaed7431-8fac-4d18-9af8-180138ef45c6","resolution":{"observed_at":"2026-08-16T11:49:18.189421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.174934Z","title":"Flux, 2024","venue":null,"work_id":"58648bf3-2e92-44c0-bded-d079ced105dc","year":2024},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.757991Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:b54250904920d50600e87f2e45a54443a348894ee962e2efa6c63193b868f5b2","observation_id":"21faa188-ecdf-4e11-97ab-e4a14da736a2","resolution":{"observed_at":"2026-08-16T11:49:18.178401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-08-20T08:43:12.373190Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-16T11:49:17.760836Z","title":"Aligning text- to-image models using human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.760836Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:dc3c3acd2037abd6985e406acb028b58d1cb860dff0adcb1cae0bee1e007d361","observation_id":"131a6738-2a61-4947-afd5-d07ebf712d75","resolution":{"observed_at":"2026-08-16T11:49:17.760836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.164201Z","title":"Aligning diffusion mod- els by optimizing human utility","venue":null,"work_id":"0a56ee99-4a4b-4844-ae58-89777b80a99f","year":2025},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.764070Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:633021e1c585baa14c0432133096438b19c16f09f6d3656b849a5d2f710c768f","observation_id":"4e411cb4-8bac-4caa-984f-7b58682d7061","resolution":{"observed_at":"2026-08-16T11:49:18.167684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08748","last_updated":"2024-05-14T16:33:25Z","snapshot_observed_at":"2026-07-06T18:14:16.386835Z","submitted_at":"2024-05-14T16:33:25Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08748","snapshot_observed_at":"2026-08-16T11:49:17.767084Z","title":"Hunyuan-dit: A powerful multi-resolution diffusion transformer with fine-grained chi- nese understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.767084Z"},"links":{"cited_paper":"/paper/2405.08748","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:8ed17ecb3d27ad845f90ec73f1f5516f5616379b7d22d03a198588bb3724b071","observation_id":"19f56009-acaa-4905-9dd4-7fb6034a54fe","resolution":{"observed_at":"2026-08-16T11:49:17.767084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-16T11:49:17.770355Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.770355Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:30ab88b23671e35f728e5ced0c468f5490a5b37928682ad68b4f786869456645","observation_id":"a6d0f2d1-98cd-4ad7-b7f0-2763708c1625","resolution":{"observed_at":"2026-08-16T11:49:17.770355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-16T11:49:17.773564Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.773564Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:28996a40120a6dbdc38e04e811667fd58f13c0306707a655ae57ee404af4e4ae","observation_id":"77cbd6de-d074-4b37-9bd1-294658eef2c5","resolution":{"observed_at":"2026-08-16T11:49:17.773564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.776867Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.776867Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:e1dd040a1711e9650c10e301a957594bb90064eb983748e856429648c3329a61","observation_id":"e2150bb7-ff5a-43e1-b56b-a1ec606eeea4","resolution":{"observed_at":"2026-08-16T11:49:17.776867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.780529Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.780529Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:81b1fd499847c599fe88391ef44171828537c34971e502acd00dd442808f3632","observation_id":"2b54a22e-64ca-461d-80a7-47101da596c4","resolution":{"observed_at":"2026-08-16T11:49:17.780529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-16T11:49:17.783907Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.783907Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:1674c8b1aa5162fa94a3d85cf865f52a7055ed2c58afa49da3b8451c046b2a8a","observation_id":"381f9b8e-8f54-47a1-bbef-71b50887efd3","resolution":{"observed_at":"2026-08-16T11:49:17.783907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.139236Z","title":"Aligning text-to-image diffusion models with reward backpropagation","venue":null,"work_id":"f424539c-4b15-46c4-93cb-1aa6300955a7","year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.787134Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:420780e62ba6a60a5faebd1e84ece4dcf8cc16ddaa68518f2a9729e7f4130781","observation_id":"36b221cd-f462-4a37-9940-6598570a4054","resolution":{"observed_at":"2026-08-16T11:49:18.142745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.790402Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.790402Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:2cfbdb2d23023c0cffc48ff8059f3ff13eec3efffc835f7bee2baba7e91b8ebb","observation_id":"da1bc8e8-d953-458f-aa04-ff02a54aa51f","resolution":{"observed_at":"2026-08-16T11:49:17.790402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.120231Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"2de4ca73-b7bd-42e0-a872-99c03defc0ab","year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.793862Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:836c7d79a4da59582b91d6b733608c25855324c67278f7d3ac8d3a894c528335","observation_id":"fdc108c0-a933-49db-ba13-2bf2cb94f691","resolution":{"observed_at":"2026-08-16T11:49:18.124051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.108752Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"1e9d0010-d0b3-4bb3-a4b0-7c10226ad1b4","year":2022},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.797347Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:062d4dd2e1d928cbb341972153011613c7247117fab6f3077465aca9d922d801","observation_id":"8118be9d-8d55-4b5b-8a5a-064ba076fc3c","resolution":{"observed_at":"2026-08-16T11:49:18.112520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.800413Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.800413Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:38a3406e4d13083a4b819e6966db6a5b93ab809187520d17920bf68d4dd677ab","observation_id":"c80de105-ce5c-4d73-b2bb-a6333b94bc24","resolution":{"observed_at":"2026-08-16T11:49:17.800413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.090216Z","title":"Laion-aesthetics","venue":null,"work_id":"8b1e0a77-6d6a-4fc9-831d-5646f548d83f","year":2022},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.803600Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:ee1d4a3f700c87dfaacb70b89ab71d58e2bf611ffdf3d466afc468e432089983","observation_id":"cb87d6fb-a8d3-4045-8acf-52d28988c944","resolution":{"observed_at":"2026-08-16T11:49:18.093835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.806615Z","title":"Adafactor: Adaptive learning rates with sublinear memory cost","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.806615Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:4b9b7a8f1ebd6ea193699873a8ddb2ce90d4be2505e1e062c893528c0ae2219a","observation_id":"1b2e92e8-4826-41f4-8c9f-177263c72d96","resolution":{"observed_at":"2026-08-16T11:49:17.806615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.810026Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.810026Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:3a78fa037fe6ae1c37de66f0f9f4e46ffc894cba42ff7156548a44ee47fc87e2","observation_id":"1d214a64-4d5a-41d5-a86c-0740fa9ea7cb","resolution":{"observed_at":"2026-08-16T11:49:17.810026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.063670Z","title":"Diffusion model align- ment using direct preference optimization","venue":null,"work_id":"1934a98a-e629-4b1a-9967-5b1179767618","year":2024},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.812952Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:1dd7a2df92bccdc2ef791fcc27bc77346b0057100de6d33cb15bcf66c839bcde","observation_id":"33c46571-7a16-4e2b-9dc6-c3a19a4e6526","resolution":{"observed_at":"2026-08-16T11:49:18.067545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-14T02:46:25.655503Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-16T11:49:17.816031Z","title":"Human preference score v2: A solid benchmark for evaluating human preferences of text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.816031Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:0cb99be9f0bad9d0f4c4851415d107ac9373cda655a8f5d10c1829612a83cbbb","observation_id":"1a72071d-5138-43d7-ada9-b7c87d1eafbb","resolution":{"observed_at":"2026-08-16T11:49:17.816031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-08-20T10:31:24.549119Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-16T11:49:17.819446Z","title":"Sana: Efficient high-resolution image syn- thesis with linear diffusion transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.819446Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:731d7b419490baf0f94b3bf62ab104dc8237c1115c3945eddd64eb7d8d390715","observation_id":"4f6bcd4b-e963-4f7c-8442-3b3dfd725670","resolution":{"observed_at":"2026-08-16T11:49:17.819446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.823108Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.823108Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:ad4150399d3407d5e7de1f4663409002ac96794b83d3ce4720800993920226f0","observation_id":"adeb5111-c4a8-41ef-84b5-35b298151291","resolution":{"observed_at":"2026-08-16T11:49:17.823108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.044864Z","title":"Using human feedback to fine-tune diffusion models without any reward model","venue":null,"work_id":"5f8d34b3-0069-4fa6-920c-c0c407418609","year":2024},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.826065Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:e54b29145e4bb134af0beac950a050f736019653f3a76d279bc33ac0aae475ca","observation_id":"cdddc589-eaeb-4cf2-9a0c-3b49097d8173","resolution":{"observed_at":"2026-08-16T11:49:18.048655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-08-18T22:18:02.034966Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-16T11:49:17.829127Z","title":"Scaling autoregres- sive models for content-rich text-to-image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.829127Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:b19826f0d4334aeebd632161367399cdc118adda652cfba838d519f01629ede2","observation_id":"a76e917d-1a40-4532-a85b-547aa287b871","resolution":{"observed_at":"2026-08-16T11:49:17.829127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:17.832595Z","title":"Self-play fine-tuning of diffusion models for text-to-image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.832595Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:3acee6fccd3e24ed0f037c545da35fabc6e0e0c9d0ebb283b3795ff743900e7f","observation_id":"977e2350-9bf4-495d-8114-12e24167279a","resolution":{"observed_at":"2026-08-16T11:49:17.832595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:49:18.022452Z","title":"Dspo: Direct score preference optimization for diffusion model alignment","venue":null,"work_id":"d6ac4d41-e0bf-430d-8bd8-90849cca3a99","year":null},"citing_paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:49:17.836268Z"},"links":{"citing_paper":"/paper/2504.14534"},"observation_digest":"sha256:4ad0d9398b458d91f8aa812081961dbb5834d474bd64c8b571455e7dc8aa337c","observation_id":"b43f506d-ed5a-47e8-9186-337d8dd4c5f4","resolution":{"observed_at":"2026-08-16T11:49:18.027836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.14534","last_updated":"2025-04-20T08:18:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-21T10:47:30.919902Z","submitted_at":"2025-04-20T08:18:27Z","title":"SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2504.14534."}