{"as_of":"2026-08-07T22:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a30dbdf7ae82602da43b5a59999ce8c1999ddef1c6b293f7086656aa48768403","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:49:08.313317Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T05:13:42.934115Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T05:15:54.348264Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.17540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17540","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reprompt: Reasoning-augmented reprompting for text-to-image generation via reinforcement learning","venue":null,"work_id":"945c2260-5f9c-4e65-85f7-290443e58495","year":2025},"citing_paper":{"arxiv_id":"2510.20206","last_updated":"2026-05-14T08:53:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-23T04:45:09Z","title":"RAPO++: Cross-Stage Prompt Optimization for Text-to-Video Generation via Data Alignment and Test-Time Scaling","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T05:13:42.934115Z"},"links":{"cited_paper":"/paper/2505.17540","citing_paper":"/paper/2510.20206"},"observation_digest":"sha256:8063db62eb4005149d3629565498c34f82c3c65787944e77f2305f6badebf8e7","observation_id":"dcda053b-3db9-47d6-9614-6f5ec6395dcc","resolution":{"observed_at":"2026-05-18T05:15:54.350941Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.17540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17540","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reprompt: Reasoning-augmented reprompting for text-to-image generation via reinforcement learning","venue":null,"work_id":"945c2260-5f9c-4e65-85f7-290443e58495","year":2025},"citing_paper":{"arxiv_id":"2604.25427","last_updated":"2026-04-28T09:34:51Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T09:34:51Z","title":"A Systematic Post-Train Framework for Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T16:58:33.014401Z"},"links":{"cited_paper":"/paper/2505.17540","citing_paper":"/paper/2604.25427"},"observation_digest":"sha256:50efd59e287eed166987b1340a9e8d6b868cf0b4224bf6375e6fb8146bcb7066","observation_id":"cb3317d0-c110-49a5-9976-de4a07b49920","resolution":{"observed_at":"2026-05-11T23:26:21.417103Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17540/citation-record","integrity":"/paper/2505.17540/integrity","json":"/paper/2505.17540/citation-record.json","paper":"/paper/2505.17540"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:49:01.837447Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:01.837447Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:34e9af020885a788a9bc5c9a9c73a0171497fb757334db137cec2b3975d3f5df","observation_id":"2a237e53-70eb-4d21-acf4-6ab9f50f2106","resolution":{"observed_at":"2026-08-07T14:49:01.837447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:01.917329Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:01.917329Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:7f023859bfc1525ae246d3e0e8a3c9c3389d86f6839647685fc8a55f39c3f2a5","observation_id":"b0e3d67d-b7fb-43de-9f14-a6bb56885238","resolution":{"observed_at":"2026-08-07T14:49:01.917329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-01T15:43:51.739518Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-07T14:49:02.074364Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.074364Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:b2c4d2a6eb6256c98ec9fad9050d188c5514eaef4da7c67bb728d918a7b6b839","observation_id":"a90988b7-628c-4705-a937-36d702fec898","resolution":{"observed_at":"2026-08-07T14:49:02.074364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06752","last_updated":"2023-11-12T06:39:00Z","snapshot_observed_at":"2026-08-07T20:36:45.921908Z","submitted_at":"2023-11-12T06:39:00Z","title":"BeautifulPrompt: Towards Automatic Prompt Engineering for Text-to-Image Synthesis","version":1},"cited_work":{"arxiv_id":"2311.06752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.06752","snapshot_observed_at":"2026-08-07T14:49:09.565295Z","title":"BeautifulPrompt: Towards Automatic Prompt Engineering for Text-to-Image Synthesis","venue":"cs.CL","work_id":"374c20f1-34df-4522-a1eb-b141c9fc75b2","year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.193944Z"},"links":{"cited_paper":"/paper/2311.06752","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:46f72ff1e725440f958866d862eea634665d0721c108d8ec81130101be114bb3","observation_id":"5f503239-41b8-4818-8b80-9e3eec994d17","resolution":{"observed_at":"2026-08-07T14:49:09.678792Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02395","last_updated":"2024-11-04T18:59:05Z","snapshot_observed_at":"2026-07-06T19:45:00.034364Z","submitted_at":"2024-11-04T18:59:05Z","title":"Training-free Regional Prompting for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02395","snapshot_observed_at":"2026-08-07T14:49:02.298652Z","title":"Training-free regional prompting for diffusion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.298652Z"},"links":{"cited_paper":"/paper/2411.02395","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:a245da4cf5499c8531eafd13d3cb059e9c63f8e199bfac7c0c4d6daa4388de00","observation_id":"c7d13886-23d5-49a9-bdf1-470abd134858","resolution":{"observed_at":"2026-08-07T14:49:02.298652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:02.417696Z","title":"Pixart- σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.417696Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:a450db49ecb34c4614a1df6f845b6aee3191b5fc2d95b187175f4dd202722acb","observation_id":"f1beb165-4cd6-467f-8366-e2183308954a","resolution":{"observed_at":"2026-08-07T14:49:02.417696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-07T14:49:02.511529Z","title":"Janus-pro: Unified multimodal understanding and generation with data and model scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.511529Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:5a4f278b75ea550c64b2a6e3c756085442bf0de982b93f791b259bbc2b86e39e","observation_id":"1bd9abf5-2e31-4fa1-b3e6-414c3f330de4","resolution":{"observed_at":"2026-08-07T14:49:02.511529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:02.578086Z","title":"Scaling rectified flow trans- formers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.578086Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:900897ca1f6f5c759869cbff19319580cf52109ad75c4645222da2f373864ca8","observation_id":"0e337797-abd4-473d-9d18-3f649e88ccb2","resolution":{"observed_at":"2026-08-07T14:49:02.578086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21776","last_updated":"2025-10-22T16:42:24Z","snapshot_observed_at":"2026-08-05T07:15:29.998948Z","submitted_at":"2025-03-27T17:59:51Z","title":"Video-R1: Reinforcing Video Reasoning in MLLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21776","snapshot_observed_at":"2026-08-07T14:49:02.659124Z","title":"Video-r1: Reinforcing video reasoning in mllms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.659124Z"},"links":{"cited_paper":"/paper/2503.21776","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:0324471e0ce5e8dd562759d3d019348ab743ccee068deb80d710e3e803d63d49","observation_id":"4a9c9932-7e71-461e-ba8b-098fefaff345","resolution":{"observed_at":"2026-08-07T14:49:02.659124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:02.758559Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.758559Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:dbd023a9e709aad92a74f91bce453526ce8f69fdbf6a080dc45827a92d785b16","observation_id":"d095863d-ec7e-4611-bcdc-7744fe5767fd","resolution":{"observed_at":"2026-08-07T14:49:02.758559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:49:02.820798Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.820798Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:df0777e539eb26360c93346d17d26f9b6c21ae18831a79e918febc0cfd525dd6","observation_id":"1d684b91-246c-474c-ae73-8e3bb940a83e","resolution":{"observed_at":"2026-08-07T14:49:02.820798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18493","last_updated":"2024-03-27T12:08:41Z","snapshot_observed_at":"2026-08-02T03:31:27.987895Z","submitted_at":"2024-03-27T12:08:41Z","title":"VersaT2I: Improving Text-to-Image Models with Versatile Reward","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18493","snapshot_observed_at":"2026-08-07T14:49:02.905061Z","title":"Versat2i: Improving text-to-image models with versatile reward","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:02.905061Z"},"links":{"cited_paper":"/paper/2403.18493","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:2397e3fed895475c7b31f7e06a395252abaad808108df1f634e80f6043199593","observation_id":"68985570-cf22-4c64-a81b-df78e17297cc","resolution":{"observed_at":"2026-08-07T14:49:02.905061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13926","last_updated":"2025-07-23T16:09:10Z","snapshot_observed_at":"2026-07-06T20:25:08.527025Z","submitted_at":"2025-01-23T18:59:43Z","title":"Can We Generate Images with CoT? Let's Verify and Reinforce Image Generation Step by Step","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13926","snapshot_observed_at":"2026-08-07T14:49:03.001071Z","title":"Can we generate images with cot? let’s verify and reinforce image generation step by step","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:03.001071Z"},"links":{"cited_paper":"/paper/2501.13926","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:6a489b0810edd16a0d2fd7939cef76954ef64cd8beb05f456515719eabf1ac99","observation_id":"d2ea6fd7-5eff-4b53-b889-422edfe5faf5","resolution":{"observed_at":"2026-08-07T14:49:03.001071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:03.111538Z","title":"A simple and effective reinforcement learning method for text-to-image diffusion fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:03.111538Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:4b35a5624daba81898312114b950a6ba7dcacbcc4c381894c3a138b284ea38ce","observation_id":"b545ffe2-00e7-4534-a532-0b48f2ba55d1","resolution":{"observed_at":"2026-08-07T14:49:03.111538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:11.353020Z","title":"Optimizing prompts for text-to-image generation","venue":null,"work_id":"abbc9d8c-6c57-4538-8e0f-8856c361ab1c","year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:03.241841Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:ae67c09f4e1468f2645c382b9ff7eb191a5502b1ac4a75309e672828c449a41c","observation_id":"e7f967d9-bfc1-4578-b2d6-e2ecd55d571d","resolution":{"observed_at":"2026-08-07T14:49:11.406579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:11.100358Z","title":"T2i-compbench: A compre- hensive benchmark for open-world compositional text-to-image generation","venue":null,"work_id":"b0dd16af-44f0-45f1-91d0-cf03612a4d46","year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:03.344646Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:7293f46da0d72f685e2da2de4939d8ede8aa8b2eee9831b9b59590f3f80bd9b7","observation_id":"fdc1ef76-50d7-44c3-ba88-4d5d7ed4ccc1","resolution":{"observed_at":"2026-08-07T14:49:11.204732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-08-07T14:49:03.494449Z","title":"Boosting mllm reasoning with text-debiased hint-grpo.arXiv preprint arXiv:2503.23905, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:03.494449Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:1224e0fab1461f83674485bc916f52a49fad64ffdefa9fd0c35eefeba384c81f","observation_id":"efb91d72-2bd2-4ef7-9da4-e9e7d1f49cac","resolution":{"observed_at":"2026-08-07T14:49:03.494449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T14:49:03.656408Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:03.656408Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:6331d737dd835b951c27bcf48262d74b61aebfcad7416ed4a9a10ec0aa100c3a","observation_id":"546980d3-7fa9-4def-a44c-bb5048126620","resolution":{"observed_at":"2026-08-07T14:49:03.656408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T14:49:03.753170Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:03.753170Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:7ed09d0e333f14a459fdccc652d8fa8eed3e09821ab5ce8cfbe556cec869b2c1","observation_id":"86004940-c933-4699-aa4e-dbe24a3520fc","resolution":{"observed_at":"2026-08-07T14:49:03.753170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00703","last_updated":"2025-07-01T11:46:57Z","snapshot_observed_at":"2026-08-07T20:35:00.460457Z","submitted_at":"2025-05-01T17:59:46Z","title":"T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00703","snapshot_observed_at":"2026-08-07T14:49:03.893674Z","title":"T2i-r1: Reinforcing image generation with collaborative semantic-level and token-level cot","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:03.893674Z"},"links":{"cited_paper":"/paper/2505.00703","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:8cf84bbec3984abf16ebe706dfa78c50d2e287bc41fe865385aa6d63e1faa232","observation_id":"7ee20ec3-bc98-4ba6-beea-86807f72809f","resolution":{"observed_at":"2026-08-07T14:49:03.893674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:04.002901Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:04.002901Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:78779913626127e5e88afd33d0356718c798b0c41ce725e7de63846017409ee3","observation_id":"5a4467ca-7c90-4c8d-8e12-ff6f8406d14e","resolution":{"observed_at":"2026-08-07T14:49:04.002901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:04.114737Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:04.114737Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:80a4223d2a9084b6950568b450f3bd44e62f798f3ef61f703fa3f906763a4c44","observation_id":"dfd53082-325b-45ab-95bf-ddc8aec15881","resolution":{"observed_at":"2026-08-07T14:49:04.114737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-07T14:49:04.234638Z","title":"Aligning text-to-image models using human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:04.234638Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:be3e869af284c499fd26e9e89771f552f0a40e240eda7685a89ab1f6085aaeb4","observation_id":"5315e9e0-89e8-46bc-a49a-4f8df1aeef1a","resolution":{"observed_at":"2026-08-07T14:49:04.234638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:04.355793Z","title":"Parrot: Pareto-optimal multi-reward reinforcement learning framework for text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:04.355793Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:2235a015470bdda82ccb1ae76eace3069dbc75268f9e58391d72ae12bde3b680","observation_id":"b91ce33d-a12b-4f34-81bf-72b7637961d7","resolution":{"observed_at":"2026-08-07T14:49:04.355793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06958","last_updated":"2025-11-11T08:30:00Z","snapshot_observed_at":"2026-08-02T02:31:33.589341Z","submitted_at":"2025-04-09T15:09:27Z","title":"VideoChat-R1: Enhancing Spatio-Temporal Perception via Reinforcement Fine-Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06958","snapshot_observed_at":"2026-08-07T14:49:04.492737Z","title":"Videochat-r1: Enhancing spatio-temporal perception via reinforce- ment fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:04.492737Z"},"links":{"cited_paper":"/paper/2504.06958","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:9b2317f32dd3fa3af84da23548e1c8c019183f4f63a60197baf70b236b5a5a49","observation_id":"cda6905f-c5b1-4793-87b6-7c120fbe169d","resolution":{"observed_at":"2026-08-07T14:49:04.492737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:10.816821Z","title":"Rich human feedback for text-to-image generation","venue":null,"work_id":"3f62c5c5-80a2-4a20-bfc7-676bec19e8b2","year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:04.616829Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:3c0ccf648db906e60fabdb917fb67030ceea454c7552783299a11f310b107302","observation_id":"0ed0ac74-e055-4076-b538-1f802b9a5f00","resolution":{"observed_at":"2026-08-07T14:49:10.935339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10695","last_updated":"2024-10-21T20:01:13Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T19:52:24Z","title":"Playground v3: Improving Text-to-Image Alignment with Deep-Fusion Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10695","snapshot_observed_at":"2026-08-07T14:49:04.771360Z","title":"Playground v3: Im- proving text-to-image alignment with deep-fusion large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:04.771360Z"},"links":{"cited_paper":"/paper/2409.10695","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:ae9a69c06629fb1ee98367e9633bbaec5aff4008781c32e82a4bd25398918620","observation_id":"5b7f518a-5f1d-4917-824d-cf9e5d79b6bf","resolution":{"observed_at":"2026-08-07T14:49:04.771360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21620","last_updated":"2025-05-24T08:46:08Z","snapshot_observed_at":"2026-08-01T20:06:59.931737Z","submitted_at":"2025-03-27T15:39:30Z","title":"UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21620","snapshot_observed_at":"2026-08-07T14:49:04.878809Z","title":"Ui-r1: Enhancing action prediction of gui agents by reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:04.878809Z"},"links":{"cited_paper":"/paper/2503.21620","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:676156b2578a67a622bdab565ce6dde2953255326eeca88406b151f824850b3d","observation_id":"8e1dd84c-fab1-43d0-9340-31f6ef219a45","resolution":{"observed_at":"2026-08-07T14:49:04.878809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-07-06T20:22:04.328179Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09732","snapshot_observed_at":"2026-08-07T14:49:04.986986Z","title":"Inference-time scaling for diffusion models beyond scaling denoising steps","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:04.986986Z"},"links":{"cited_paper":"/paper/2501.09732","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:52fd50ff1ac0f219d5864b17cb30c0c0dbd1d476a031aeb8366142cf29b73a5d","observation_id":"aaa4947c-353b-441b-96d5-ec5513b83962","resolution":{"observed_at":"2026-08-07T14:49:04.986986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:05.118052Z","title":"Deepperception: Advancing r1-like cognitive visual perception in mllms for knowledge-intensive visual grounding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:05.118052Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:c19999744f7b5289e05bc013222a05590c06cce5de6331ce45332d9be153c20b","observation_id":"fa0ade0d-1170-4d39-a89b-fd0e2150e4a1","resolution":{"observed_at":"2026-08-07T14:49:05.118052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17804","last_updated":"2024-03-26T15:42:01Z","snapshot_observed_at":"2026-08-05T08:40:05.671575Z","submitted_at":"2024-03-26T15:42:01Z","title":"Improving Text-to-Image Consistency via Automatic Prompt Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17804","snapshot_observed_at":"2026-08-07T14:49:05.244513Z","title":"Improving text-to-image consistency via automatic prompt optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:05.244513Z"},"links":{"cited_paper":"/paper/2403.17804","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:6495ef94c21ebb93d02be8a9734f9ccc4fb2cde63b664a489c09d9005174797e","observation_id":"d1cf3905-27a2-4b85-b117-a4f7c8cd9960","resolution":{"observed_at":"2026-08-07T14:49:05.244513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:10.612639Z","title":"Dynamic prompt optimizing for text-to-image generation","venue":null,"work_id":"8d2fb6e8-cb56-4509-b140-92f58d18d74d","year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:05.399264Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:eaafa0d52472e6e34d6214244b80eb7d4f9ab17816fe4679e9818dde210cffd5","observation_id":"ef35f0ff-7164-4f28-8241-11009701c900","resolution":{"observed_at":"2026-08-07T14:49:10.705624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10419","last_updated":"2025-05-28T16:35:37Z","snapshot_observed_at":"2026-08-05T15:30:16.091540Z","submitted_at":"2024-12-10T01:47:40Z","title":"Preference Adaptive and Sequential Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10419","snapshot_observed_at":"2026-08-07T14:49:05.508199Z","title":"Personalized and sequential text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:05.508199Z"},"links":{"cited_paper":"/paper/2412.10419","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:c45a0c6e47d7ccdec6d66aabd8f045b0b84ddde56be059e3f9ff1c1f827481ee","observation_id":"eceddefc-29c9-4928-8e43-ebd1b33057a8","resolution":{"observed_at":"2026-08-07T14:49:05.508199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T14:49:05.605645Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:05.605645Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:53e0112ea988c06246ad48b0f5bf19884df348abc9e75b9de5bf2e13a63e4e02","observation_id":"4424fbae-01e6-47ba-a757-3d834ac3d637","resolution":{"observed_at":"2026-08-07T14:49:05.605645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:05.678066Z","title":"Diffusiongpt: Llm-driven text-to-image generation system","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:05.678066Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:11e3dfc2aa105ee732160fd08006a96234d12bab3c3b3ecf2d0c6240d3f4211e","observation_id":"6f66e5d7-2e63-4922-892d-d6e88607e9e7","resolution":{"observed_at":"2026-08-07T14:49:05.678066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:05.783083Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:05.783083Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:2a5e1e3b58cf6c5efee91210c6026ec5852678d5652dedcddf1045557def6c1a","observation_id":"917512dd-4ce3-414b-abc4-897d38cb3bca","resolution":{"observed_at":"2026-08-07T14:49:05.783083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:05.849176Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:05.849176Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:7ab7e6afbc7854babb9e45d7cbf83ffcfcd3403b8dc32d87e25cc6b101857043","observation_id":"85c5a8ad-419a-4a28-80c0-5850a818c3fc","resolution":{"observed_at":"2026-08-07T14:49:05.849176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09070","last_updated":"2025-09-12T19:20:38Z","snapshot_observed_at":"2026-07-06T18:30:15.196556Z","submitted_at":"2024-06-13T12:55:10Z","title":"FairCoT: Enhancing Fairness in Text-to-Image Generation via Chain of Thought Reasoning with Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09070","snapshot_observed_at":"2026-08-07T14:49:05.928871Z","title":"Faircot: Enhancing fairness in diffu- sion models via chain of thought reasoning of multimodal language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:05.928871Z"},"links":{"cited_paper":"/paper/2406.09070","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:8a5e14f5ea9d75ddc72ea1b34b0f688a8b93396749b33d2936bf46189115403a","observation_id":"61c0ab3d-4406-45d7-89e3-fdbba3079fde","resolution":{"observed_at":"2026-08-07T14:49:05.928871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-07T14:49:06.046543Z","title":"Vlm-r1: A stable and generalizable r1-style large vision-language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.046543Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:4c59f44db88c3defe6b69e7524304bd5ceb27aaab4572d91d39b2a59d8b8f690","observation_id":"fb7847d3-d40f-446d-96c8-2222cc23b10a","resolution":{"observed_at":"2026-08-07T14:49:06.046543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T14:49:06.145848Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.145848Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:875edcc66551fb9666983ce6c0f404100a84229396aa2cc80b2e3a0237ef80f4","observation_id":"20e3a568-51e3-47ce-a953-bb8eb8dae86f","resolution":{"observed_at":"2026-08-07T14:49:06.145848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:10.361896Z","title":"Reft: Reason- ing with reinforced fine-tuning","venue":null,"work_id":"67de2279-b232-4a42-b84f-c0071bfac5a0","year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.222540Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:c6c294e61eb57bc74f2f66956b6ef940c59f8e4994426a7368b2d1219c5a8bbf","observation_id":"07f4aa66-f7c1-4cd8-babb-e82b3a5475b0","resolution":{"observed_at":"2026-08-07T14:49:10.473898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:06.282736Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.282736Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:25bf4c553c71c77ae66b2edc1279f3fca68de8ef5f82d00778d740b1d5fa8237","observation_id":"d72d288b-ab7e-4198-9fbd-b109f3043ea1","resolution":{"observed_at":"2026-08-07T14:49:06.282736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11455","last_updated":"2025-04-15T17:59:46Z","snapshot_observed_at":"2026-08-07T16:02:04.272189Z","submitted_at":"2025-04-15T17:59:46Z","title":"SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11455","snapshot_observed_at":"2026-08-07T14:49:06.404856Z","title":"Simplear: Pushing the frontier of autoregressive visual generation through pretraining, sft, and rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.404856Z"},"links":{"cited_paper":"/paper/2504.11455","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:4b6062dfb44701a0914639ff99799c2c2f7d48276978615f4fff32d00328f579","observation_id":"8354ca32-de60-4a27-815f-afb0b02f0c36","resolution":{"observed_at":"2026-08-07T14:49:06.404856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:06.461069Z","title":"Mint: Multi-modal chain of thought in unified generative models for enhanced image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.461069Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:acb2c100919fa1418757543e9522af54c3a8fcb6104f9206da0e2fb1f06c3a25","observation_id":"3f6b87a9-df61-4eab-95f2-9149e0a580e8","resolution":{"observed_at":"2026-08-07T14:49:06.461069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:06.590652Z","title":"Genartist: Multimodal llm as an agent for unified image generation and editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.590652Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:e8de2437ede717604a59acd63a1e3c16e4642a9f7d928a0cbfa80c4309cca576","observation_id":"b0e7fb15-ba11-491a-aefc-2f068c793b79","resolution":{"observed_at":"2026-08-07T14:49:06.590652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:06.695683Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.695683Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:d8c22a41e8aa3b758493e2a3ae5b373b148d80e466a347ef1282cd9b506da53d","observation_id":"23281936-61ec-463e-a03f-4de7b5244e6f","resolution":{"observed_at":"2026-08-07T14:49:06.695683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:10.057356Z","title":"Self-correcting llm-controlled diffusion models","venue":null,"work_id":"fff78ef6-d4d4-4649-8389-21aff6ac11ac","year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.840329Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:c34533aaf967260448c9ebf9c36cde2f7fccb321167a1f8f4d485125d1dc9ce7","observation_id":"5b1c4e98-ff2d-4f58-9808-0ee440b83591","resolution":{"observed_at":"2026-08-07T14:49:10.202580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18427","last_updated":"2025-05-17T13:26:31Z","snapshot_observed_at":"2026-08-06T13:34:35.279373Z","submitted_at":"2025-01-30T15:31:48Z","title":"SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18427","snapshot_observed_at":"2026-08-07T14:49:06.921433Z","title":"Sana 1.5: Efficient scaling of training-time and inference-time compute in linear diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:06.921433Z"},"links":{"cited_paper":"/paper/2501.18427","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:20b3a7ce0a8f7ec6798f7346981ce6d6277a354ea1f13e621f85a9d239849347","observation_id":"24c293dc-da51-4b7a-9485-9148647fb7a2","resolution":{"observed_at":"2026-08-07T14:49:06.921433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-07T14:49:07.003942Z","title":"Show-o: One single trans- former to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.003942Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:905591dfd79a9d3706e227088b974017a84e5e416fce12fb8981253b0b4c10c6","observation_id":"9ea9f249-8fbf-4f1a-8828-0a09e7ebae22","resolution":{"observed_at":"2026-08-07T14:49:07.003942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:07.081695Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.081695Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:f79aa3b80949604a2bcc482d375482a7029f1597e2168a033cff752d392cf89e","observation_id":"a9790556-0bfd-4fc9-ad41-d1583cf49b71","resolution":{"observed_at":"2026-08-07T14:49:07.081695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-07-31T14:51:03.625964Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-08-07T14:49:07.170807Z","title":"Dancegrpo: Unleashing grpo on visual generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.170807Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:fc6af69f54bfaaa1a99004c2018df63ab0e2ffd78c511d9c01675a07d0e6c6d1","observation_id":"ba061631-dbb1-4e8d-88ce-825f77bf570f","resolution":{"observed_at":"2026-08-07T14:49:07.170807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:49:07.247590Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.247590Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:29e45f46e1e9c08797dc37576c15f68ccca8a53c744c7e3a312a286c02d796de","observation_id":"e6a25805-b53e-4bcc-b613-19fabd885838","resolution":{"observed_at":"2026-08-07T14:49:07.247590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:07.305264Z","title":"Mastering text-to-image diffusion: Recaptioning, planning, and generating with multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.305264Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:3b5d1868f33bc69ac6db3f61b1d9405bc0d2078f60b5c000cf0ab4fa2e5a6a21","observation_id":"b0a09c41-c0aa-4579-9cd9-a805a73c02ff","resolution":{"observed_at":"2026-08-07T14:49:07.305264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08265","last_updated":"2024-05-12T21:02:59Z","snapshot_observed_at":"2026-08-03T17:53:31.825440Z","submitted_at":"2024-02-13T07:37:24Z","title":"A Dense Reward View on Aligning Text-to-Image Diffusion with Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08265","snapshot_observed_at":"2026-08-07T14:49:07.407728Z","title":"A dense reward view on aligning text-to- image diffusion with preference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.407728Z"},"links":{"cited_paper":"/paper/2402.08265","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:8b749aaa91120f223997cd5896f9f077c48a99b6782a28d41ba22f161c0dd091","observation_id":"cc0e0cbb-c811-422f-a6c2-66f66137d865","resolution":{"observed_at":"2026-08-07T14:49:07.407728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-07T14:49:07.511716Z","title":"R1-onevision: Advancing generalized multimodal reasoning through cross-modal formalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.511716Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:e9328b37b6360696658e66ad759f8eab14ba96414f4eda6a1e3df2ed741835e1","observation_id":"67869d98-7605-42e3-8156-6b6374ba421f","resolution":{"observed_at":"2026-08-07T14:49:07.511716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:09.792956Z","title":"Idea2img: Iterative self-refinement with gpt-4v for automatic image design and generation","venue":null,"work_id":"7a71b97c-70da-448c-8947-8b831fa9c41f","year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.616883Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:cc6fb12d7379476b202f5e53cd8208957f039f89f388a21873e51ddb42486522","observation_id":"0120178c-f175-421a-a517-dc5473fad00b","resolution":{"observed_at":"2026-08-07T14:49:09.904568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.08127","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:08.784112Z","title":"Tipo: Text to image with text presampling for prompt optimization","venue":null,"work_id":"b225b40a-1915-44f6-9d45-9a475da18b7c","year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.691290Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:afeea91607627ebc99809e4098d101340f955f5cc97f5e278589f317b41ba67b","observation_id":"e3298c3e-744e-4c1d-8de9-4682084dd23d","resolution":{"observed_at":"2026-08-07T14:49:08.889862Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-07T16:06:45.172290Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T14:49:07.789675Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.789675Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:fdc7a3cfeaf55e191901e7b3a0df4b45df9ad93bc25500856de57450f5720c0a","observation_id":"131b1d12-7e74-488f-9639-5a66260a5684","resolution":{"observed_at":"2026-08-07T14:49:07.789675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11477","last_updated":"2025-02-17T06:28:53Z","snapshot_observed_at":"2026-08-07T18:13:36.085393Z","submitted_at":"2025-02-17T06:28:53Z","title":"Learning to Sample Effective and Diverse Prompts for Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":"2502.11477","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.11477","snapshot_observed_at":"2026-08-07T14:49:08.572490Z","title":"Learning to Sample Effective and Diverse Prompts for Text-to-Image Generation","venue":"cs.CV","work_id":"37708cc8-e778-4997-981b-33be8c13430e","year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.892684Z"},"links":{"cited_paper":"/paper/2502.11477","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:91c3db5a43eb0d266bf6b3402575f3c97cf26b835fbf66b73bff2272bfcd8560","observation_id":"6dbcd73b-01e5-41dd-a884-60c1e51580d2","resolution":{"observed_at":"2026-08-07T14:49:08.623995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-06T21:34:54.534751Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-08-07T14:49:08.000931Z","title":"R1-vl: Learning to reason with multimodal large language models via step-wise group relative policy optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:08.000931Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:faa44a8cfc2f0851635127a2423c3df498eae5c6576a35887130f8f976ff22a9","observation_id":"1740fecb-eff9-4db1-8641-235519ede143","resolution":{"observed_at":"2026-08-07T14:49:08.000931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07171","last_updated":"2025-02-05T14:02:19Z","snapshot_observed_at":"2026-08-07T12:32:22.610081Z","submitted_at":"2024-10-09T17:59:13Z","title":"IterComp: Iterative Composition-Aware Feedback Learning from Model Gallery for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07171","snapshot_observed_at":"2026-08-07T14:49:08.072338Z","title":"Itercomp: Iterative composition-aware feedback learning from model gallery for text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:08.072338Z"},"links":{"cited_paper":"/paper/2410.07171","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:d652ff5d2c2cd388f341662732c2150b564de759e91f8a93ba3f70e78e5b7d8f","observation_id":"8a3e481c-55bb-4e0e-ae96-8a598fe009f5","resolution":{"observed_at":"2026-08-07T14:49:08.072338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:49:08.176819Z","title":"Layercraft: Enhancing text-to-image generation with cot reasoning and layered object integration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:08.176819Z"},"links":{"citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:bd8f9aae5be88da81b5ead8192fb6bb467d9a76978aacfd4df855b45bfc724df","observation_id":"7cee6f8d-aeec-459c-90c2-f47d0a55674b","resolution":{"observed_at":"2026-08-07T14:49:08.176819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08400","last_updated":"2024-09-12T21:12:21Z","snapshot_observed_at":"2026-07-06T19:14:37.951588Z","submitted_at":"2024-09-12T21:12:21Z","title":"Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08400","snapshot_observed_at":"2026-08-07T14:49:08.313317Z","title":"Colors\" (from 0.83 to 0.87) and","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:08.313317Z"},"links":{"cited_paper":"/paper/2409.08400","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:65331fe4c852ee7824c114293de75f8e9c7e794ba1b2c99e0187f53052865d64","observation_id":"672d72ac-72a6-4fa0-99a9-2a968adf0d0a","resolution":{"observed_at":"2026-08-07T14:49:08.313317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":3,"verified_fuzzy":7},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 2 inbound Pith citation observations for arXiv:2505.17540."}