{"as_of":"2026-08-04T18:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d7787f6133ab449e20c2d7204612f23ef222e0a1114a4017a3c82f9fffe59096","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T14:16:55.945455Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.06070/citation-record","integrity":"/paper/2605.06070/integrity","json":"/paper/2605.06070/citation-record.json","paper":"/paper/2605.06070"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":"6dc8c4d6-bf1c-4797-93c0-a17234e4a9d0","year":2024},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:e3379039df48e1fbb6d6b01a4ecf7c972bbcc55a34a93b0058c62334ae68683c","observation_id":"5f5b3b81-1e4c-4364-b325-10d6827dc961","resolution":{"observed_at":"2026-05-26T11:42:15.412722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:24:01.744380Z","title":"Improving image generation with better captions","venue":null,"work_id":"aa4e9e1a-4c37-468d-bdb4-412819771b5e","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:2dbec5940a8b8577744141b9b7c1db2ecf0f5b2581916a99c758fb7699bd99d2","observation_id":"ec1b893c-abd4-4653-afb9-bb44f553707b","resolution":{"observed_at":"2026-05-26T11:42:15.388935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:49.784463Z","title":"Flux.https://github.com/black-forest-labs/flux","venue":null,"work_id":"ff476bd7-afa4-451d-b45d-54207aeb1545","year":2024},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:4e76d08294bb3ea912827a9bea1ad4524398a62c963f0650bee4cd71cbb6c137","observation_id":"5521c809-cbdb-445d-b464-69a977195e03","resolution":{"observed_at":"2026-05-26T11:42:15.404342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:44:43.389356Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":"7c92dc1c-5c6b-42d3-a3a8-1b5b19d220da","year":1952},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:d88367b8bc2b5380b65f301e409b5c69d796c0a2aeaf3deffde35414b265eb42","observation_id":"68e4d14d-be81-419d-bead-e515744f43c5","resolution":{"observed_at":"2026-05-26T11:42:15.397283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Getting it right: Improving spatial consistency in text-to-image models","venue":null,"work_id":"f075c6bb-07ba-4111-b99b-a05c30f77e73","year":2024},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:b93631ec3dfc4cf5ff4aa0a3c5571c057b494c037d3b8bbe8a37f545f3411192","observation_id":"d04aa348-0a63-4502-83fd-894967313d06","resolution":{"observed_at":"2026-05-26T11:42:15.384728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":"2310.00426","doi":"10.48550/arxiv.2310.00426","metadata_source":"pith","pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","venue":"cs.CV","work_id":"77157568-e4be-4041-bb20-388177fc59d0","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:03f7127f720f3147e319cc37d4719d7fa7ac0b6e0d2d56b12946a9c22bc0e0a5","observation_id":"dc56eb4a-9228-4224-9c1e-971487087908","resolution":{"observed_at":"2026-05-12T20:38:53.511834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T17:35:10.040609Z","title":"Deep reinforcement learning from human preferences.Advances in neural information processing systems, 30","venue":null,"work_id":"a63ca98b-8916-47bd-bd9b-d0c693024f4c","year":2017},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:69a7e50a32eaac881f64dbed2e0af4d508fcf711365b8c33f6b5aa5f50de873e","observation_id":"db8749f2-ac0a-4512-807f-ed314c8112d1","resolution":{"observed_at":"2026-05-26T11:42:15.393260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion models in vision: A survey.IEEE transactions on pattern analysis and machine intelligence, 45 (9):10850–10869","venue":null,"work_id":"5847da28-9474-4599-824a-58f0cf2f0d0a","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:deef9d25882f30764b2e7965c14a071c44c0a519edbe6a22560a1f15654d27d8","observation_id":"ebb6822d-9445-4050-9fdd-4ba2ef133b2e","resolution":{"observed_at":"2026-05-26T11:42:15.400942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.03317","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion-sdpo: Safeguarded direct preference optimization for diffusion models","venue":null,"work_id":"0d161187-db76-4462-99ff-6a044eaa2221","year":2025},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:944489a2c23758b551bdcff5062e4d004e5cb65b0de5e35bd5fc2fe5894daab5","observation_id":"4a33e5ab-48d6-4ad1-bb9e-295e63f2edaf","resolution":{"observed_at":"2026-05-11T18:41:12.215672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:37:16.225324Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851","venue":null,"work_id":"82ba805b-3e59-43c6-b37f-3aa1940eea68","year":2020},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:b7d784f7647c24225edf28a46e485b01054afc1fef5f4fe7b2640ff4a69a5d5f","observation_id":"d3f91091-249c-4662-8fd7-2456a092b47e","resolution":{"observed_at":"2026-05-26T11:42:15.409142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Margin- aware preference optimization for aligning diffusion models without reference","venue":null,"work_id":"a0846c3c-b662-4d71-a5a4-db806391ee3d","year":2024},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:5b9fcbbc1168d578d47a85d6f917f918d39f0b3a1fa3f7818fbd920ff84f2d86","observation_id":"f72747d1-10f4-4996-ba31-33669d44ee40","resolution":{"observed_at":"2026-05-26T11:42:15.455564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"John wiley & sons","venue":null,"work_id":"b53c2449-ce78-49ec-8fec-9b2181a385b4","year":1995},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:fdcec18c4ed976f87163024230d5146582f55b0ae05194011bee2a0b07e527fe","observation_id":"6bc1ae61-9448-40f4-8d10-7239fdf29003","resolution":{"observed_at":"2026-05-26T11:42:15.451822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:26:43.305610Z","title":"Elucidating the design space of diffusion-based generative models.Advances in neural information processing systems, 35: 26565–26577","venue":null,"work_id":"aac83182-5bfd-4c0b-86b9-5c61758a8c90","year":2022},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:cdd947c75dcc305381e9b860c6ea3b27b256e276a3f53f1b0297ddd0936c3a72","observation_id":"0be4d1ea-602b-409a-8ebe-8040a316057c","resolution":{"observed_at":"2026-05-26T11:42:15.433742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable ranked preference optimization for text-to-image generation","venue":null,"work_id":"97b59b73-32cb-4577-88df-71dccb6a6bea","year":2025},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:228e181d8f2b519c3ebc505c1ba347e3ecf5a9e4b4c09a35a3db79906e410f0a","observation_id":"4658ae27-2910-4f83-9f5e-2b30728b10c7","resolution":{"observed_at":"2026-05-26T11:42:15.444833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:05:55.757899Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation.Advances in neural information processing systems, 36:36652–36663","venue":null,"work_id":"00e2bd13-9259-4c19-8ac6-cfe745a0da17","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:a04fb99f937ea14bd34da824b6640093c2ec57f22b26456b1deacfa86d610de1","observation_id":"39b3ad83-2438-436b-a699-e9e4574be719","resolution":{"observed_at":"2026-05-26T11:42:15.469390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.07510","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:43:54.806176Z","title":"arXiv preprint arXiv:2507.07510 , year=","venue":null,"work_id":"2440b95b-ef2d-45ea-82cd-ece85021386d","year":2025},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:f4d0d7695868434ff158c4ac084615b0e73cd9dc53bac92ae48d8d14ebec951b","observation_id":"8a743779-e94e-4605-96c6-ffd7498d8458","resolution":{"observed_at":"2026-05-11T18:41:12.151668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Align- ing diffusion models by optimizing human utility.Advances in Neural Information Processing Systems, 37:24897–24925","venue":null,"work_id":"ad12a030-1e55-440d-b863-6c9a98f0736e","year":2024},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:77e700616f529d6cbd91bb88b633333090e8460d10bd2d144eb70f09d5e8cca2","observation_id":"74d5a422-4e92-474a-9d2a-3b536359e33b","resolution":{"observed_at":"2026-05-26T11:42:15.462985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"K-sort eval: Efficient preference evaluation for visual genera- tion via corrected vlm-as-a-judge","venue":null,"work_id":"01d247f5-f9e1-4720-ba73-bfdd4fca3150","year":null},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:e9dcc83da3a71b987b7bdcf228172fe9a3331e10269f956d18e3678b84e1870c","observation_id":"cc9bc20c-2e28-4861-a575-c6b2e3f79480","resolution":{"observed_at":"2026-05-26T11:42:15.466264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"K-sort arena: Efficient and reliable benchmarking for generative models via k-wise human preferences","venue":null,"work_id":"2e0247d9-9c48-48d8-87f1-0194f6a58ea0","year":2025},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:d3cf46206180e4c0d84f3983a81cc365cc5b5cdac58d30e58f726dd132b3b00d","observation_id":"c5726001-85b7-48c0-ae9c-d61204f8121d","resolution":{"observed_at":"2026-05-26T11:42:15.440740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:1f7057f0ceaef1b8ed7d56ce9fcfaaf70d83563a977c1f42877043d1e8463c95","observation_id":"42836f56-de22-4aab-a351-6116e3089ba9","resolution":{"observed_at":"2026-05-11T18:41:12.145120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":"2209.03003","doi":"10.48550/arxiv.2209.03003","metadata_source":"pith","pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-07-10T17:37:26.212817Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","venue":"cs.LG","work_id":"a1989e1b-d66d-4533-be3a-fb9c5fd62290","year":2022},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:699d972216374904e390f2895386dd35b9faaa04c23df338786972150e17bfa2","observation_id":"6054ba67-3f2f-4386-b8aa-7c3393b94121","resolution":{"observed_at":"2026-05-11T18:41:12.158173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T13:13:50.609285Z","title":"Hpsv3: Towards wide-spectrum hu- man preference score","venue":null,"work_id":"7f1f4d17-3402-496d-a645-5ef5bc5cd4fa","year":2025},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:61dc5eadc46b5f49ecca46cd51c9ef8008f8a3487824b8e9043c1091ba856fd2","observation_id":"dfb3a2a3-8f6f-478a-8baa-fc43ffc0d84f","resolution":{"observed_at":"2026-05-26T11:42:15.437527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:53.186413Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"0c67bec8-6388-449f-9600-64c8ea9bc79f","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:adb3e564b8c9aaf5e1a181786bf1cd8263df2ff52fc52f420e0eaf829ff7d77c","observation_id":"3a5b050b-1d52-4000-a131-5b81e3e749ee","resolution":{"observed_at":"2026-05-26T11:42:15.459345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:fd9a646d0eac32427aa8641d646328e795bdd9c006e53c9dc04748a0be0c4aed","observation_id":"fd4e28b6-614d-4349-8cb6-605d89cdb507","resolution":{"observed_at":"2026-05-11T18:41:12.191002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T07:16:04.687562Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"ad3e05b3-af3a-4fa2-ab30-c45f9f403277","year":2021},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:6ac4c87504766981316e9876fa8594f647dee6061610e55c9dc9426253412f8a","observation_id":"45aa5059-00e1-4323-896d-c3d1d789cbb4","resolution":{"observed_at":"2026-05-26T11:42:15.430478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:54:50.108470Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"5d2e1082-e73f-4c1b-a18c-bf0ba1772c23","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:33ea434e70223da61c2629e732ce8c3d4a6c8591c94bb7495feda370ab0c2fda","observation_id":"d98c7217-949e-41a8-bce8-9e51dcca37a5","resolution":{"observed_at":"2026-05-26T11:42:15.419907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:52.409989Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":"5427867b-47ba-4d43-a415-2912684a2d41","year":2022},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:128ded426254327076ded7caa67541ac007da43bfded53edfdb90dc9434bc40f","observation_id":"a05ffff9-9e02-43a7-9423-35f9a95a0df3","resolution":{"observed_at":"2026-05-26T11:42:15.423678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LAION-Aesthetics: Predicting the aesthetic quality of images.https://laion.ai/blog/laion-aesthetics/","venue":null,"work_id":"6dc522ad-f28a-4856-bfce-0ff3a0501a59","year":2022},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:fbd44cc47da996176c27a52f9c43674be518cbb21f5df15a7c2e8b93a3a17e74","observation_id":"d6c7e423-e72c-48c7-8f23-cc9bd4ec895d","resolution":{"observed_at":"2026-05-26T11:42:15.426900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:bf1a95bd1490042b572325639bddbbf6a70f49bebb37bc596f2ebd20cf31860b","observation_id":"94d33e79-16fb-4d24-bfa0-aa38d920690c","resolution":{"observed_at":"2026-05-11T18:41:12.196535Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Freeu: Free lunch in diffusion u-net","venue":null,"work_id":"dc157381-884e-407b-9c4a-366872471ff5","year":2024},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:934d242703ea2d891c809a28579f75c92174d18f08c1e1e02b15331655bfc535","observation_id":"3410b3e5-293f-4f09-a933-a54a2c7cf25c","resolution":{"observed_at":"2026-05-26T11:42:15.472677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T23:44:22.299949Z","title":"Generative modeling by estimating gradients of the data distribution.Advances in neural information processing systems, 32","venue":null,"work_id":"cb7b227d-a7e2-4087-a77d-5839d223ab4e","year":2019},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:97150050a067ff3c05a83823cc263cd67c3bf76fa085cdf11a1b9c27bdac4bd8","observation_id":"659d5408-c724-4187-8d8c-83cf3ac29f6a","resolution":{"observed_at":"2026-05-26T11:42:15.476268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":"2011.13456","doi":"10.1088/1748-9326/aae98d","metadata_source":"pith","pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","venue":"cs.LG","work_id":"d9110e53-a5d4-4794-a4c5-a575e91c31ad","year":2020},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:2408ddefb7356977fe18fd27d10c79e2342ecb838ad5b680fa652ee376b971e5","observation_id":"25e42aa1-2447-4e5c-875c-58a9fa9b1a3f","resolution":{"observed_at":"2026-05-11T18:41:12.207170Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:58:00.812405+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:58:00.812405+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:41:38.611381Z","title":"Learning to summarize with human feedback","venue":null,"work_id":"1b254f56-8ed9-4f5e-bfe2-fc2e3892d61b","year":2020},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:a39eb1c6dd850abb0ad4e9e455bdfa10612657749bd9230716200f36657ef3d1","observation_id":"9f65322f-d660-4a04-91f1-483c959e1e97","resolution":{"observed_at":"2026-05-26T11:42:15.481687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A law of comparative judgment.Psychological Review, 34(4):273–286","venue":null,"work_id":"d828cccd-9267-4b13-8e50-64fab89e8c8a","year":1927},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:c188de794bfc52942b2f37ac197e1d4fceaef0cbb1de15dcc4445bb34283c68c","observation_id":"e4309012-79f7-4679-90f5-52099cccacdd","resolution":{"observed_at":"2026-05-26T11:42:15.484837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.614833Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":"a8c7901c-d939-4b88-9e70-2af38e4aed5f","year":2024},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:4787a09fb48ec252602d88cb7991f12b5e88ce4725a10678532c69e1a859efa9","observation_id":"4d361d38-9bcc-4b4a-8c77-e76f6b6034e8","resolution":{"observed_at":"2026-05-26T11:42:15.491791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-07-06T15:43:07.989730Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2306.09341","doi":"10.48550/arxiv.2306.09341","metadata_source":"pith","pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-07-11T01:57:49.722825Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","venue":"cs.CV","work_id":"40702548-f094-4c67-a5db-a62f426f852e","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:72630461ba24b7530b1af9c0533cc32d1d061acda1070e812d07771be9409012","observation_id":"1ed71ad3-e810-46f1-be42-3f64e689b482","resolution":{"observed_at":"2026-05-11T18:41:12.201925Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.618368Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"5c5c3eee-061e-4af7-b5f2-2e03489973ae","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:480afa3bea1859c08ab57d839ee26995b1fd1150cad46745d6d6caaf9a56cc22","observation_id":"308c885c-0c13-4f08-9fd2-76e43774f0ad","resolution":{"observed_at":"2026-05-26T11:42:15.495686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-07-31T14:51:03.625964Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":"2505.07818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-07-09T03:05:55.316091Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","venue":"cs.CV","work_id":"7404dd36-8f9c-478f-b089-ef9f8189c711","year":2025},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:6220c4ead38ddf83d012d01f75ec2281af5ffd94346f1aac8bf0cba7c15d80f5","observation_id":"619d2178-fad2-404c-a8d8-26456627a8a4","resolution":{"observed_at":"2026-05-11T22:28:29.121023Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:45:05.455307Z","title":"Diffusion models: A comprehensive survey of methods and applications.ACM computing surveys, 56(4):1–39","venue":null,"work_id":"2789f59b-a09c-41a6-900d-67bfecdcbc04","year":2023},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:dc5fb06ee54e9fca870a80da116418e9cdfebb6885aae4ce7461f971c634ccba","observation_id":"7c1b180c-1c1b-4319-b3a8-56410e42991d","resolution":{"observed_at":"2026-05-26T11:42:15.448740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":"2206.10789","doi":"10.48550/arxiv.2206.10789","metadata_source":"pith","pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","venue":"cs.CV","work_id":"0a105815-ff2e-43ce-8566-966cdcae1af4","year":2022},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:0110954b12003a023bf441b70e11afb46f26ccc4d5ace620938ea086d9660fe8","observation_id":"ad1800b5-4116-404a-88ee-ffe54c02184d","resolution":{"observed_at":"2026-05-12T04:49:31.747550Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-rewarding language models","venue":null,"work_id":"7a361202-e978-463c-a211-05dbfeeae1a8","year":2024},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:6e63c7f8302916c951a7288f2fc25d103ebeb190213bed9a1d7898dda53af465","observation_id":"a5238165-3f2e-4b53-8f5b-47f134f229a0","resolution":{"observed_at":"2026-05-26T11:42:15.416137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dspo: Direct score preference optimization for diffusion model alignment","venue":null,"work_id":"7e7d6fd1-4809-476a-8229-98f139445fc6","year":2025},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:e6f19eaf32cda6a5d6265ba4a9a880782101437d05caacb8361ba3f7295ff511","observation_id":"ce1a2567-d07c-4980-970c-b64a3f6ad9ef","resolution":{"observed_at":"2026-05-26T11:42:15.487958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5560.7621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"we did not observe stable improvement when training from public implementations on Pick-a-Pic","venue":null,"work_id":"b8e927e7-5b09-4881-a7fb-a326bf201cf7","year":2088},"citing_paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T14:16:55.945455Z"},"links":{"citing_paper":"/paper/2605.06070"},"observation_digest":"sha256:33e4a7ec0cc42a68560a05a11c811974711c51fef0fdd783adfbf8dfc2e72e05","observation_id":"5e79b816-d7ec-4ae6-bdf2-2448f1997217","resolution":{"observed_at":"2026-05-11T18:41:12.167678Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.06070","last_updated":"2026-05-07T11:56:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T22:55:59.306670Z","submitted_at":"2026-05-07T11:56:26Z","title":"Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":12,"verified_fuzzy":31},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2605.06070."}