{"as_of":"2026-08-08T20:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c490222660023d70df0fe354972eeca30a90e4cbcfc07dd68628c5ce80222f5","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T00:41:12.605274Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.14962/citation-record","integrity":"/paper/2607.14962/integrity","json":"/paper/2607.14962/citation-record.json","paper":"/paper/2607.14962"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.10429","last_updated":"2024-06-14T22:14:11Z","snapshot_observed_at":"2026-07-06T18:31:17.512404Z","submitted_at":"2024-06-14T22:14:11Z","title":"Consistency-diversity-realism Pareto fronts of conditional image generative models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10429","snapshot_observed_at":"2026-08-02T00:41:12.330364Z","title":"Consistency-diversity-realism pareto fronts of conditional image generative models.arXiv preprint arXiv:2406.10429, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.330364Z"},"links":{"cited_paper":"/paper/2406.10429","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:dd7cffa15302d2c6f6906ab47ff3c335e75003f62c8698c97bade20d4b2c74c3","observation_id":"569ee3a7-2bf9-46e0-b837-c33b7b552229","resolution":{"observed_at":"2026-08-02T00:41:12.330364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.396092Z","title":"The best of N worlds: Aligning reinforcement learning with best-of-N sampling via max@k optimisation.arXiv preprint arXiv:2510.23393, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.396092Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:7be9e46fcd634ae6f574e7c3d37cfb2602ff70afd2eabda5521180318a5a8234","observation_id":"7d26e924-7fdd-4fd7-946e-d04ebfb37e24","resolution":{"observed_at":"2026-08-02T00:41:12.396092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.22817","last_updated":"2026-05-21T17:59:26Z","snapshot_observed_at":"2026-08-03T22:38:52.410175Z","submitted_at":"2026-05-21T17:59:26Z","title":"Vector Policy Optimization: Training for Diversity Improves Test-Time Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.22817","snapshot_observed_at":"2026-08-02T00:41:12.402933Z","title":"Vector policy optimization: Training for diversity improves test-time search.arXiv preprint arXiv:2605.22817, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.402933Z"},"links":{"cited_paper":"/paper/2605.22817","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:fca2d51f3f7d9e2bf8aa41aef713fe1ea17ba0ab19e73d7d04bfe6f93cb996d4","observation_id":"6dbbaf3f-abfe-4fd6-8cd8-dd72242ce49b","resolution":{"observed_at":"2026-08-02T00:41:12.402933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T00:41:12.436642Z","title":"Qwen2.5-VL technical report.arXiv preprint arXiv:2502.13923, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.436642Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:10a0841e24ddda99b36718664cf50909df25dc94436838053f983e2f28a42449","observation_id":"b7311ce4-cb29-4b31-8e50-63955e6b841a","resolution":{"observed_at":"2026-08-02T00:41:12.436642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.451300Z","title":"Easily accessible text-to-image generation amplifies demographic stereotypes at large scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.451300Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:1da74f96af494e1195605fbafbedcbd7ef97eef5d0218c10499fd1e77e3277ca","observation_id":"badcd5a8-bc19-48dd-9688-7b7344c73393","resolution":{"observed_at":"2026-08-02T00:41:12.451300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.465729Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.465729Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:7a4468632b0fd518de6d7add10f4b37c88bf20b0d7215c8a43a09e4d0a34a4d8","observation_id":"62f855ec-16f5-4735-a3ce-57e646de96c9","resolution":{"observed_at":"2026-08-02T00:41:12.465729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.468740Z","title":"SEGA: Instructing text-to-image models using semantic guidance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.468740Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:04e8dcd253a22bba78a1148b0c49b2b286f25fa980dc1b39b69f7cdd557a27db","observation_id":"0c20ee32-9ca1-490f-8f1b-0322f29db8f7","resolution":{"observed_at":"2026-08-02T00:41:12.468740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.24687","last_updated":"2026-05-23T17:52:07Z","snapshot_observed_at":"2026-07-06T23:34:43.210149Z","submitted_at":"2026-05-23T17:52:07Z","title":"HoloFair: Unified T2I Fairness Evaluation and Fair-GRPO Debiasing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24687","snapshot_observed_at":"2026-08-02T00:41:12.471192Z","title":"HoloFair: Unified T2I fairness evaluation and Fair-GRPO debiasing.arXiv preprint arXiv:2605.24687, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.471192Z"},"links":{"cited_paper":"/paper/2605.24687","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:8338afff8d3596ede744831d6dc23698042dd8f4a34fcc399142344e8544efc9","observation_id":"3cbf7845-bfda-463a-9ac2-a873e4e1218e","resolution":{"observed_at":"2026-08-02T00:41:12.471192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.473944Z","title":"TIBET: Identifying and evaluating biases in text-to-image generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.473944Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:81456ce0f785c820f4cd26b800509d508eef6563ddd36ea78ce2b0f73ce6a96f","observation_id":"eed9be49-730e-4f4f-8e26-a1da0f51c7d8","resolution":{"observed_at":"2026-08-02T00:41:12.473944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.476286Z","title":"Inference-aware fine-tuning for best-of-n sampling in large language models.arXiv preprint arXiv:2412.15287, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.476286Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:68187fed19eddfaaefbb0317ba2bad325da86e6e91a7a654c278f0167ae2d942","observation_id":"fd0cc5f1-d2aa-4b60-a01b-b2eb0b9f9444","resolution":{"observed_at":"2026-08-02T00:41:12.476286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00070","last_updated":"2023-05-15T07:51:14Z","snapshot_observed_at":"2026-07-06T14:46:48.605674Z","submitted_at":"2023-01-31T20:09:33Z","title":"Debiasing Vision-Language Models via Biased Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00070","snapshot_observed_at":"2026-08-02T00:41:12.478856Z","title":"Debiasing vision-language models via biased prompts.arXiv preprint arXiv:2302.00070, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.478856Z"},"links":{"cited_paper":"/paper/2302.00070","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:b427f31fdb4e31e991779482979bb002050b7fd0bf4198ab7f2afce1735c0d80","observation_id":"c7165b64-9106-4070-9251-e8a30c3b829e","resolution":{"observed_at":"2026-08-02T00:41:12.478856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.481670Z","title":"OpenBias: Open-set bias detection in text-to-image generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.481670Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:a7c5fcfeeca99e5d5000dfb5c95ae6201efbb7b7089729b46321158ba1d2539f","observation_id":"38b569cd-0078-44c2-a6e6-4a6d8abe8474","resolution":{"observed_at":"2026-08-02T00:41:12.481670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.483879Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.483879Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:ba3c32c8862f39961c85761a8b0223b141821b795bcaa529bf1b3842d25e2c32","observation_id":"90c5914b-b939-4393-bd7c-e4b684633e51","resolution":{"observed_at":"2026-08-02T00:41:12.483879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.486268Z","title":"DPOK: Reinforcement learning for fine-tuning text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.486268Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:d654d713e535abbf1b29ca94843f106f811ab72e1f87bd7698ce1fc7b04c17a8","observation_id":"ddb27611-5b72-4a2b-bac2-897d4009c88d","resolution":{"observed_at":"2026-08-02T00:41:12.486268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10893","last_updated":"2023-07-17T12:13:46Z","snapshot_observed_at":"2026-07-06T14:54:19.013733Z","submitted_at":"2023-02-07T18:25:28Z","title":"Fair Diffusion: Instructing Text-to-Image Generation Models on Fairness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10893","snapshot_observed_at":"2026-08-02T00:41:12.488625Z","title":"Fair diffusion: Instructing text-to-image generation models on fairness","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.488625Z"},"links":{"cited_paper":"/paper/2302.10893","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:bf4d91c89c4eba798792811323853ba896b43cb9afea772cb1f6d80158c2fd20","observation_id":"3c9651ac-24b0-4253-bc3a-94c29f1f306b","resolution":{"observed_at":"2026-08-02T00:41:12.488625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.491290Z","title":"FairImagen: Post- processing for bias mitigation in text-to-image models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.491290Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:29dff0bcbb4a968b0c7ae840d9e7818ac2107798c09d9a11c72ba634937e5264","observation_id":"da91c3c7-2659-4af8-91f4-b6c97dc0cf8b","resolution":{"observed_at":"2026-08-02T00:41:12.491290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02617","last_updated":"2026-04-17T21:00:45Z","snapshot_observed_at":"2026-07-30T10:05:05.279382Z","submitted_at":"2024-12-03T17:44:23Z","title":"Improving Dynamic Object Interactions in Text-to-Video Generation with AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02617","snapshot_observed_at":"2026-08-02T00:41:12.493826Z","title":"Improving dynamic object interactions in text-to-video generation with AI feedback.arXiv preprint arXiv:2412.02617, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.493826Z"},"links":{"cited_paper":"/paper/2412.02617","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:a86c2ba7cbfec93003d35335a15c9a0de81d03425a480e797ede6498ee909c45","observation_id":"f7b880c9-7001-4b37-bcca-39b6c3193b86","resolution":{"observed_at":"2026-08-02T00:41:12.493826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.496320Z","title":"Unified concept editing in diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.496320Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:203ecf399c4c87ccccf021d0368608584885e6bae85d1291f212f311cda57b70","observation_id":"3149b138-104b-4a52-b9f1-cbb0718bc99b","resolution":{"observed_at":"2026-08-02T00:41:12.496320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.03962","last_updated":"2026-06-02T17:50:14Z","snapshot_observed_at":"2026-07-06T23:44:09.692359Z","submitted_at":"2026-06-02T17:50:14Z","title":"Using Reward Uncertainty to Induce Diverse Behaviour in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.03962","snapshot_observed_at":"2026-08-02T00:41:12.498785Z","title":"Using reward uncertainty to induce diverse behaviour in reinforcement learning.arXiv preprint arXiv:2606.03962, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.498785Z"},"links":{"cited_paper":"/paper/2606.03962","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:a8c48425483cd4c47ad528e4b5aaf902b9f483f6d96e1fb32aea4705c068f187","observation_id":"f00ee3cd-ecd5-47ae-b844-71a294de6562","resolution":{"observed_at":"2026-08-02T00:41:12.498785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.501274Z","title":"Polychromic objectives for reinforcement learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.501274Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:8bfaf1f52597fb2bfcdb565f6d4cd1df3808719101f306d7d1a3b333428e57e6","observation_id":"020db60b-35ba-45bd-9967-7daf77b9f646","resolution":{"observed_at":"2026-08-02T00:41:12.501274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04324","last_updated":"2025-10-15T06:35:29Z","snapshot_observed_at":"2026-07-06T22:08:40.965707Z","submitted_at":"2025-08-06T11:10:39Z","title":"TempFlow-GRPO: When Timing Matters for GRPO in Flow Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04324","snapshot_observed_at":"2026-08-02T00:41:12.503578Z","title":"TempFlow-GRPO: When timing matters for GRPO in flow models.arXiv preprint arXiv:2508.04324, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.503578Z"},"links":{"cited_paper":"/paper/2508.04324","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:8d0d07c1fb31db0b8fe7652112ae3f7a047044a59d66620ea66f800761d35e77","observation_id":"5aa290b9-9b70-42dd-8d0d-7e8220f21cef","resolution":{"observed_at":"2026-08-02T00:41:12.503578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12536","last_updated":"2025-03-16T15:02:52Z","snapshot_observed_at":"2026-08-07T17:00:29.300741Z","submitted_at":"2025-03-16T15:02:52Z","title":"Debiasing Diffusion Model: Enhancing Fairness through Latent Representation Learning in Stable Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12536","snapshot_observed_at":"2026-08-02T00:41:12.506040Z","title":"Debiasing diffusion model: Enhancing fairness through latent representation learning in stable diffusion model.arXiv preprint arXiv:2503.12536, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.506040Z"},"links":{"cited_paper":"/paper/2503.12536","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:93d4b1b2adecd79a6fdea16dd81c0df5ff87910ef50747f33b447b3ae00d7ae0","observation_id":"49fafe22-6b62-49ed-a2cc-2da025729424","resolution":{"observed_at":"2026-08-02T00:41:12.506040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.508514Z","title":"FairGen: Enhancing fairness in text-to-image diffusion models via self-discovering latent directions.arXiv preprint arXiv:2412.18810, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.508514Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:c2d4ba0ada09a1f4f72c04c85bd58330c6122c2af5a7143c86b91cd33078e3f8","observation_id":"1e78e774-80aa-4405-836c-8059598e90bd","resolution":{"observed_at":"2026-08-02T00:41:12.508514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.510955Z","title":"FairFace: Face attribute dataset for balanced race, gender, and age for bias measurement and mitigation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.510955Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:423801145c441f3b5872464e90679a9b63bbd03007c8361260855fb6f74bb695","observation_id":"78838bea-cd1e-4f7d-aa32-9eb7400ea55b","resolution":{"observed_at":"2026-08-02T00:41:12.510955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.513219Z","title":"Rethinking training for de-biasing text-to-image generation: Unlocking the potential of stable diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.513219Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:e71fd1b17112d48d66d78843601f0d12abdc79f1c9797adeb99552d5db39119c","observation_id":"1b98a6db-d775-4a7b-b363-37f8757dd418","resolution":{"observed_at":"2026-08-02T00:41:12.513219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.515488Z","title":"Pick-a-Pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.515488Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:112f41acc622abd54ca95d0d5118b3d702a67fa28a5779856eea6a0a09594f23","observation_id":"ecae609f-eeff-4e44-98df-fb10d3eaec18","resolution":{"observed_at":"2026-08-02T00:41:12.515488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.517916Z","title":"Emergence of exploration in policy gradient reinforcement learning via resetting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.517916Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:606343e9bd0991de04d8be95b82677e62fa223c3721c5691cf305ea88e952ed9","observation_id":"95189d68-7248-40db-8a92-200f1f05fc54","resolution":{"observed_at":"2026-08-02T00:41:12.517916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.520460Z","title":"Improved precision and recall metric for assessing generative models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.520460Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:be5caadf53ad368da20d6f2005713bfdfeb26f595b6d821be70e0b52e167adfb","observation_id":"5e72bcb7-1640-4ad8-a53a-87498f3da14f","resolution":{"observed_at":"2026-08-02T00:41:12.520460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.522754Z","title":"Holistic evaluation of text-to-image models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.522754Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:36054140bcac60de74c12752d605fea4210ec2c2c2ae41aee2195ce1f1e878a1","observation_id":"1ab7d50b-32f1-4b0f-8792-8d377c397003","resolution":{"observed_at":"2026-08-02T00:41:12.522754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.525144Z","title":"SetPO: Set-level policy optimization for diversity-preserving LLM reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.525144Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:a7df7cca7a58dd8fb31445cc2f96ca7019a54a920aacb13304f7e6a604fdce8a","observation_id":"d410701a-f8da-4728-aa45-a184037b381a","resolution":{"observed_at":"2026-08-02T00:41:12.525144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.527336Z","title":"Fair text-to-image diffusion via fair mapping","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.527336Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:b87d7959df63a38211949e86e53c42abcf69fa3d9250e604b1e8c525bdd2d88b","observation_id":"4b7add92-3928-48b7-890d-161f66c19520","resolution":{"observed_at":"2026-08-02T00:41:12.527336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.529558Z","title":"DiverseGRPO: Mitigating mode collapse in image generation via diversity-aware GRPO.arXiv preprint arXiv:2512.21514, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.529558Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:3b9df4ff4e011ca5e9cedcae2f51a6979cd0f5a74fa3e0197d810e34d9f1e9de","observation_id":"a964ee23-6e0a-4e5b-be4b-63a9f1fa8859","resolution":{"observed_at":"2026-08-02T00:41:12.529558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.531859Z","title":"Flow-GRPO: Training flow matching models via online RL","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.531859Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:abc623c601fc78f3aa8f0896eec71b81b7bc8b3b587d38423228f56c04a7b1bb","observation_id":"8b575eda-5613-4e9b-9eb6-c45d16613aca","resolution":{"observed_at":"2026-08-02T00:41:12.531859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.534200Z","title":"Improving video generation with human feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.534200Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:aec63a2cde7e9459062c8dcb38660642fc7be4c1e6137427021ece70311bf5b7","observation_id":"c4d889dd-e52b-4b4e-82db-d6bc56dbf0f7","resolution":{"observed_at":"2026-08-02T00:41:12.534200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.536646Z","title":"Beyond the Dirac Delta: Mitigating diversity collapse in reinforcement fine-tuning for versatile image generation.arXiv preprint arXiv:2601.12401, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.536646Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:3cc329e50661d956863d415d7a2ce0d661b3104645291e4dde6c46f1e6870496","observation_id":"b613b1bf-43e1-47fc-92aa-7b2f4673c058","resolution":{"observed_at":"2026-08-02T00:41:12.536646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.538932Z","title":"Stable bias: Evaluating societal representations in diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.538932Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:cc77b3449540ad4c61794e2508aed6380ed51ab0c2da6416ae0e3d8381afa5a0","observation_id":"8c8ec63c-b297-425d-a09e-59593ac35a11","resolution":{"observed_at":"2026-08-02T00:41:12.538932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.541267Z","title":"Training diffusion models towards diverse image generation with reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.541267Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:ccad5b696b3de2b393fea6d9c435703e4d7d437fc62956695d514887de68bfe3","observation_id":"5628b4ff-29c0-46f2-a9ea-7e830cefaa8b","resolution":{"observed_at":"2026-08-02T00:41:12.541267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.543666Z","title":"Reliable fidelity and diversity metrics for generative models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.543666Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:49806264243a4c4368dc078b6e015f4a312d16d545a0527a2c98f1936cca502d","observation_id":"956c240d-ac93-40ca-9bfb-6c9d3bcb2811","resolution":{"observed_at":"2026-08-02T00:41:12.543666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-07-06T23:45:47.161248Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.05888","snapshot_observed_at":"2026-08-02T00:41:12.545963Z","title":"Retry policy gradients in continuous action spaces.arXiv preprint arXiv:2606.05888, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.545963Z"},"links":{"cited_paper":"/paper/2606.05888","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:8de0116f9789ef3041f92bb62d873b6fbdbb1c2626e48a44df2ec501f3a381f2","observation_id":"98fbfd37-543b-4703-916f-ca483b3488e8","resolution":{"observed_at":"2026-08-02T00:41:12.545963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.00151","last_updated":"2026-05-29T03:35:13Z","snapshot_observed_at":"2026-07-06T23:40:51.363776Z","submitted_at":"2026-05-29T03:35:13Z","title":"Emergence of Exploration in Policy Gradient Reinforcement Learning via Retrying","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.00151","snapshot_observed_at":"2026-08-02T00:41:12.548554Z","title":"Emergence of exploration in policy gradient reinforcement learning via retrying.arXiv preprint arXiv:2606.00151, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.548554Z"},"links":{"cited_paper":"/paper/2606.00151","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:740fc8bdcd8df50f807c7a1c599070142458a35ffbc0fb4d6114c55c60dc4cc6","observation_id":"3f06b6f3-348d-4473-9602-e638dd50a9ab","resolution":{"observed_at":"2026-08-02T00:41:12.548554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.551264Z","title":"Diversity-aware max@k optimization for improving best-of-N performance in image generation with diffusion models (in Japanese)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.551264Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:d497a2af9533813c05649b92763f11d9f272aafaa7fdd947eeb253958716bba8","observation_id":"ce1d8d97-b08d-4084-b613-8308d7161789","resolution":{"observed_at":"2026-08-02T00:41:12.551264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.553646Z","title":"Inference-time text-to-video alignment with diffusion latent beam search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.553646Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:5fecdf5744cf56ede48d504ac88bf0f248802c7ce46b78fba6301c1b10e92ab4","observation_id":"bd6a6272-880d-4332-a414-dc436b678a0d","resolution":{"observed_at":"2026-08-02T00:41:12.553646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.556171Z","title":"MultiBanana: A challenging benchmark for multi-reference text-to-image generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.556171Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:fdf2706ddabe799d6e1f51a5747be8f3de2cbd88ed53a16613f480ca7ba7b5f2","observation_id":"52efdac7-f5e6-4d8e-aa48-766f4ba67354","resolution":{"observed_at":"2026-08-02T00:41:12.556171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.558556Z","title":"Balancing act: Distribution-guided debiasing in diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.558556Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:5120a5b51eb6569ae8ef090080576d9b568c4b15fc5b53fdf66d3427ee10dbe2","observation_id":"5596e674-6524-4b44-8d7b-15cc3fd2caea","resolution":{"observed_at":"2026-08-02T00:41:12.558556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.06096","last_updated":"2026-06-04T12:34:15Z","snapshot_observed_at":"2026-07-06T23:46:01.165261Z","submitted_at":"2026-06-04T12:34:15Z","title":"OrderGrad: Optimizing Beyond the Mean with Order-Statistic Policy Gradient Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.06096","snapshot_observed_at":"2026-08-02T00:41:12.561057Z","title":"OrderGrad: Optimizing beyond the mean with order-statistic policy gradient estimation.arXiv preprint arXiv:2606.06096, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.561057Z"},"links":{"cited_paper":"/paper/2606.06096","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:98d9387987e67710544a8b893daa1c08200e7c02067643ad63c508f72044be56","observation_id":"61c207e2-3e47-44ae-a1b7-dae906663094","resolution":{"observed_at":"2026-08-02T00:41:12.561057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.563557Z","title":"Escaping the mode: Multi-answer reinforcement learning in LMs","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.563557Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:7b16e907a4273ad69040962d20e887187cd003278bf935a1f0b954e655394b26","observation_id":"2ee8dd5a-d3e2-41e9-9c6d-493c763a4fd0","resolution":{"observed_at":"2026-08-02T00:41:12.563557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.565970Z","title":"From scale to speed: Adaptive test-time scaling for image editing","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.565970Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:6fe57b00a227d84b7e80bc867c99c1e364141aa34c31df9c0c6bc29ec8f3cd2e","observation_id":"a407128f-6f22-4bdb-9148-3ceeb21bc320","resolution":{"observed_at":"2026-08-02T00:41:12.565970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.568234Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.568234Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:64184dc72dfb3017177078547ef75341980d54a3f04fb4c499d146a9286ee3f7","observation_id":"29f0f96d-26a1-4413-840b-acc6c83eb4ff","resolution":{"observed_at":"2026-08-02T00:41:12.568234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.570492Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.570492Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:c67d8fa1ed455fd347031278fdbd5d800818f76787f9dfa758f82acbd0f885a4","observation_id":"21b08dd3-e390-4521-b26c-6613d2fe8f62","resolution":{"observed_at":"2026-08-02T00:41:12.570492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.572904Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.572904Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:0ce4a23be7930bbba369a1dc21fd7243280c41abf0f86eeb180d328bf7ba652b","observation_id":"9b3a6574-b01c-40cc-8c6b-79122fbcf827","resolution":{"observed_at":"2026-08-02T00:41:12.572904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.575402Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.575402Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:fb8411ec6887aa643bc638353c835e5481cc514dd0d7d1e681f70eda81dd3cfc","observation_id":"9f10100a-1356-40e4-9979-57777235438c","resolution":{"observed_at":"2026-08-02T00:41:12.575402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.577708Z","title":"LAION-5B: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.577708Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:24dd623008d16eea6b9b4bbcadaaca5ec3532f710ec00a416220074490c1bb1c","observation_id":"f4a61204-a395-43f6-9f89-da15f0ea4b5f","resolution":{"observed_at":"2026-08-02T00:41:12.577708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.579983Z","title":"Finetuning text-to-image diffusion models for fairness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.579983Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:984824ae2e5ce0cf1be185c69fa07680081267984c5d8043f27c7de2507c9bcd","observation_id":"16d91b2e-c927-4d36-8ddc-dc6809a22eff","resolution":{"observed_at":"2026-08-02T00:41:12.579983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.06080","last_updated":"2026-06-04T12:16:39Z","snapshot_observed_at":"2026-07-06T23:45:56.266116Z","submitted_at":"2026-06-04T12:16:39Z","title":"On Advantage Estimates for Max@K Policy Gradients","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.06080","snapshot_observed_at":"2026-08-02T00:41:12.582293Z","title":"On advantage estimates for Max@K policy gradients.arXiv preprint arXiv:2606.06080, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.582293Z"},"links":{"cited_paper":"/paper/2606.06080","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:0e6d049fa57d917c06aa9492f9ed43fc41c57f52902106bed1c4dd957765c028","observation_id":"d3a013a1-75d5-4f88-a672-5f78cae46762","resolution":{"observed_at":"2026-08-02T00:41:12.582293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20854","last_updated":"2026-05-30T15:59:38Z","snapshot_observed_at":"2026-07-06T23:31:23.407780Z","submitted_at":"2026-05-20T07:44:43Z","title":"Finite-Time Regret Analysis of Retry-Aware Bandits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.20854","snapshot_observed_at":"2026-08-02T00:41:12.584759Z","title":"Finite-time regret analysis of retry-aware bandits.arXiv preprint arXiv:2605.20854, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.584759Z"},"links":{"cited_paper":"/paper/2605.20854","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:76eeaae661118f78ea388e022f90fa24c5e85ecad88baeb6f3cb8f209656e471","observation_id":"90ddcec2-26b5-47db-b4da-ea82bb118978","resolution":{"observed_at":"2026-08-02T00:41:12.584759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.587281Z","title":"Beyond the prompt: Gender bias in text-to-image models, with a case study on hospital professions.arXiv preprint arXiv:2510.00045, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.587281Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:0add74d535fb4d3a750abe30c20714f8bf10d32a4ffdb3019825615b47801923","observation_id":"18167a3c-1c8f-4e50-9ed5-81008fded9d4","resolution":{"observed_at":"2026-08-02T00:41:12.587281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15201","last_updated":"2026-06-10T06:51:36Z","snapshot_observed_at":"2026-08-07T15:20:22.627728Z","submitted_at":"2025-05-21T07:26:36Z","title":"Pass@K Policy Optimization: Solving Harder Reinforcement Learning Problems","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15201","snapshot_observed_at":"2026-08-02T00:41:12.589526Z","title":"Pass@K policy optimization: Solving harder reinforcement learning problems.arXiv preprint arXiv:2505.15201, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.589526Z"},"links":{"cited_paper":"/paper/2505.15201","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:d961e5ab5135161346c6bfd1883e2632dfab88bee3d5ec4ce5aa9663fb452309","observation_id":"1a402d90-111e-4717-95c6-8f29f4a440f4","resolution":{"observed_at":"2026-08-02T00:41:12.589526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.591916Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.591916Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:95504b111a68195026fab865a37cbced76592902f8c8564e2040454a6afb60e6","observation_id":"39af284b-761a-4af8-84d1-f12370095706","resolution":{"observed_at":"2026-08-02T00:41:12.591916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-08-02T00:41:12.594851Z","title":"RewardDance: Reward scaling in visual generation.arXiv preprint arXiv:2509.08826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.594851Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:e6eee774833d1a9946b3231d880355ec7b130da11ba83bb13684f403f1e1f925","observation_id":"99a15030-df7d-4c09-b32d-139e4a24111f","resolution":{"observed_at":"2026-08-02T00:41:12.594851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.597785Z","title":"ImageReward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.597785Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:97fa43c347fe486290cda31f1e8d3026087f4b34718622e2bd8aa1208aebe6c3","observation_id":"e68a2686-f2c6-4ee4-b14c-b9d9d13acff1","resolution":{"observed_at":"2026-08-02T00:41:12.597785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-07-31T14:51:03.625964Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-08-02T00:41:12.600146Z","title":"DanceGRPO: Unleashing GRPO on visual generation.arXiv preprint arXiv:2505.07818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.600146Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:7bd2ac684e27c0a5a62850093f7a764bb1883d8d2c527d7cf6c69566ad398ec2","observation_id":"7a91fd58-a628-4ebf-ba52-da95886e125f","resolution":{"observed_at":"2026-08-02T00:41:12.600146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.602630Z","title":"ITI-GEN: Inclusive text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.602630Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:e7dbbab13928ee0d2c44d3b68a55a91a2e4a543cbcdaf7764557f02c773286f6","observation_id":"1391ca56-142d-400f-a972-89dd5b4d7b44","resolution":{"observed_at":"2026-08-02T00:41:12.602630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T00:41:12.605274Z","title":"a photo of the face of a person","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.605274Z"},"links":{"citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:0056b551eb265ab79c927643ced2477f3d4ae0efe5865b422597a9e7c06366e8","observation_id":"08f4c5d8-6bb3-4181-94f6-4d654eb75c57","resolution":{"observed_at":"2026-08-02T00:41:12.605274Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T07:47:02.003608Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2607.14962."}