{"as_of":"2026-08-03T17:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eec1bcc9b68d471394fc1d92b3ffa9d1c5ab888ec073dce244833cd2bc3c8615","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T16:44:23.162726Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:46:26.361155Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25477","snapshot_observed_at":"2026-08-01T12:46:26.361155Z","title":"Ye, J.; Jiang, D.; Wang, Z.; Zhu, L.; Hu, Z.; Huang, Z.; He, J.; Yan, Z.; Yu, J.; Li, H.; et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19341","last_updated":"2026-07-21T17:59:02Z","snapshot_observed_at":"2026-08-01T12:46:23.774907Z","submitted_at":"2026-07-21T17:59:02Z","title":"ExpertVerse: A General-Purpose Benchmark for Expert-Level Reasoning in Knowledge-Intensive Visual Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T12:46:26.361155Z"},"links":{"cited_paper":"/paper/2604.25477","citing_paper":"/paper/2607.19341"},"observation_digest":"sha256:ebcbf94f09166f587842b9a3f755cacc25aa910cb815bbc1c720634e7751cda0","observation_id":"7986f710-a863-4c66-abf6-9f4786b1f9fa","resolution":{"observed_at":"2026-08-01T12:46:26.361155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.25477/citation-record","integrity":"/paper/2604.25477/integrity","json":"/paper/2604.25477/citation-record.json","paper":"/paper/2604.25477"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen-image technical report","venue":null,"work_id":"4e82ee61-2863-4513-89c7-bd90376785be","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:ec3559fb2f3c3b122d6f2caa6545d209ce89409adc28969ae12757692e32ae3e","observation_id":"73740e02-0d96-42af-b0d1-c863b672fd23","resolution":{"observed_at":"2026-05-27T01:53:22.760044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flux.1: Text-to-image synthesis via flow matching","venue":null,"work_id":"e4a127b5-eebc-4b38-bdd7-e14339a783f0","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:b9cbca92af7f2ddfcec9182abca6b8a119a8b8f451336754f0ffac8f5dc0a7e9","observation_id":"da4a5169-94a5-481b-8ab0-f078f695bc58","resolution":{"observed_at":"2026-05-27T01:53:22.773716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07584","last_updated":"2025-12-08T14:26:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-08T14:26:40Z","title":"LongCat-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2512.07584","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.07584","snapshot_observed_at":"2026-07-04T16:09:57.573753Z","title":"LongCat-Image Technical Report","venue":"cs.CV","work_id":"648d9514-ca31-4ba0-983a-1aba1057a97e","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2512.07584","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:8c4432da9ce5ed1ceaf8f03ba581e5209e6c29fd8c35ae9b402136c4ad773570","observation_id":"e6407dff-9705-4b86-afee-73f05f1833de","resolution":{"observed_at":"2026-05-16T08:04:13.097348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.05233","last_updated":"2021-06-01T17:49:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-11T17:50:24Z","title":"Diffusion Models Beat GANs on Image Synthesis","version":4},"cited_work":{"arxiv_id":"2105.05233","doi":"10.48550/arxiv.2105.05233","metadata_source":"pith","pith_arxiv_id":"2105.05233","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Diffusion Models Beat GANs on Image Synthesis","venue":"cs.LG","work_id":"2eb944bb-93ba-462c-8111-4e8c915dd873","year":2021},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2105.05233","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:32b051681f91fe9364a90537761a2c5cc82741c43a62ec3fa1851115fe1a6eea","observation_id":"cf2b0ef5-1e57-459e-b41a-f72aca7847a8","resolution":{"observed_at":"2026-05-13T11:16:28.664120Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:30.424112+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:30.424112+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":"4bfd39df-a698-4224-8bd9-fe40f5df81a4","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:0129eefc64e83010e6b87e1e22c51f74aa71ef8f7efffaf970516a264f10cfa7","observation_id":"29e42942-a3e1-4ebd-8478-6575cafff5a9","resolution":{"observed_at":"2026-05-27T01:53:22.770111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion model-based image editing: A survey","venue":null,"work_id":"db76edaa-ea42-46fb-a7cd-abee8abae7d6","year":null},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:08fd2324d0a5822665376628e7c975bc6bcb73e6df551599e2cf992b56301479","observation_id":"9f34a434-2d96-44b6-ab1d-403f338e664d","resolution":{"observed_at":"2026-05-27T01:53:22.752553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Available: https://doi.org/10.1109/TPAMI.2025.3541625","venue":null,"work_id":"61215446-970c-4179-a738-60252b351b8c","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:7707ed1094bdbfc15fbc0f082dec2586c5e91da8051f283d368e5d8eda313ad9","observation_id":"cabc0059-27d7-411b-9ee9-83a62f687b16","resolution":{"observed_at":"2026-05-09T01:54:33.528913Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2025.3636582","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:15:00.875560Z","title":"Freeedit: Mask-free reference-based image editing with multi-modal instruction","venue":null,"work_id":"3850b5ce-2d2f-4978-b360-761018517aa1","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:702fa709a25e704289ed0ab8dd0f691a007078f5123f1932993cf0f60a1f4a4b","observation_id":"f72f2bd4-68eb-4927-84df-9deef36d0aba","resolution":{"observed_at":"2026-05-09T01:54:33.337125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"1d32bb17-e146-4ca8-abcf-ec2f8a71cf87","year":2023},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:f024cb6188266ccc45c3a6e8c9caf04733e3c859463ba7e0eaf38938829d9e0f","observation_id":"ad58f7de-10e7-4ba9-8171-728d7b61b5c1","resolution":{"observed_at":"2026-05-27T01:53:22.725917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2025.3597936","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:15:00.875560Z","title":"Opencir: Conditional image repainting with open condition mixture","venue":null,"work_id":"c1058fae-600c-4a54-9c09-811c23bdf2c2","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:a23d9657aa6dbf412d69a5f07cc4907121460fbc311ce4a9ba672502f0d827bc","observation_id":"bb741fb7-3229-4ecf-a488-0edd62e06dc6","resolution":{"observed_at":"2026-05-09T01:54:33.440860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":"2504.17761","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-07-10T01:46:41.223286Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","venue":"cs.CV","work_id":"3392f2c8-a1cb-4d6c-8c82-2cdccffa33f9","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:a7045f4071cbf6945aec93332d37c6ed7d21fa4005e91cc2b63435cf4bd551b6","observation_id":"9a8624f9-312b-4bea-a374-182e61e83d85","resolution":{"observed_at":"2026-05-11T23:36:15.161347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19312","last_updated":"2025-03-25T03:18:46Z","snapshot_observed_at":"2026-07-06T20:58:10.509344Z","submitted_at":"2025-03-25T03:18:46Z","title":"ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":"2503.19312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19312","snapshot_observed_at":"2026-06-30T06:54:20.724189Z","title":"Imagegen- cot: Enhancing text-to-image in-context learning with chain-of-thought reasoning","venue":null,"work_id":"a63b0f16-d213-4a68-acaf-873d8cdcf1b1","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2503.19312","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:d27f2edc60b9a9bdd91189bca204144386fcc5bdb7ff21430eddab1c9157fdeb","observation_id":"828ea5b4-6b90-4c8a-a609-701280c1e461","resolution":{"observed_at":"2026-05-11T23:36:14.891845Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"T2i- compbench++: An enhanced and comprehensive benchmark for compositional text-to-image generation","venue":null,"work_id":"53b25587-9cc8-487c-b8a2-64e46fc645ba","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:8db4af8dfdb6c56ff49e3f9c49f01d799893af9bb2c60b173499a0daed0358a3","observation_id":"3736c31e-088e-43c5-9a0d-6b294d69ec5a","resolution":{"observed_at":"2026-05-09T01:54:33.360355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13655","last_updated":"2024-03-04T18:43:49Z","snapshot_observed_at":"2026-08-01T21:33:07.884113Z","submitted_at":"2023-05-23T03:59:06Z","title":"LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.13655","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13655","snapshot_observed_at":"2026-07-04T16:39:58.233736Z","title":"LLM-grounded diffusion: Enhancing prompt understanding of text-to-image diffusion models with large language models","venue":null,"work_id":"5c6b2f10-7c7a-4f99-9895-3524faeea08d","year":2023},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2305.13655","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:3166c50dc7db727f463b77b80410a3cf42121d9d271183263f1e063fbaa9f8f2","observation_id":"3afb7641-7d3e-4996-8de2-cc175bde9563","resolution":{"observed_at":"2026-05-11T23:36:14.439069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Editthinker: Unlocking iterative reasoning for any image editor","venue":null,"work_id":"39076d9d-451e-4e58-a956-7c9ce6d96c1f","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:693e7d5f50c648d6059236dcd0a3efac6a30597890579f7a6a568df7cabc211d","observation_id":"04fc640f-7be7-417c-995c-3be27584dd79","resolution":{"observed_at":"2026-05-27T01:53:22.742542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.22228","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialreward: Verifiable spatial re- ward modeling for fine-grained spatial consistency in text-to- image generation","venue":null,"work_id":"2bc76e96-a9d0-4e83-a2d3-9bd60d7d634a","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:6a97b329b425912f1211f9ca9211e890d57c764914a03ad89fb24629b927317f","observation_id":"16a7fbc1-2d8c-48ad-8c84-ba5171ba6826","resolution":{"observed_at":"2026-05-11T23:36:14.468761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating compositional text-to-image generation: A benchmark and analysis","venue":null,"work_id":"d4703196-5c48-479f-8525-aa73fc316405","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:a4a7aa92d9ca72ab082fce93c433e9628683d18ce6bedf61fe6784e9d8fdef3f","observation_id":"899c43b0-7284-45d5-8a66-1a0a484e91e6","resolution":{"observed_at":"2026-05-27T01:53:22.732948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02826","last_updated":"2025-05-27T15:54:58Z","snapshot_observed_at":"2026-07-06T21:03:50.078667Z","submitted_at":"2025-04-03T17:59:56Z","title":"Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing","version":4},"cited_work":{"arxiv_id":"2504.02826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.02826","snapshot_observed_at":"2026-07-04T13:19:50.681869Z","title":"Envisioning beyond the pixels: Benchmarking reasoning-informed visual editing","venue":null,"work_id":"e46f260d-7abe-40b5-9905-5115e6088591","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2504.02826","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:ac98c4cb70bd8871515da814aa3b2f017aa86da05d078db31d91365222c15511","observation_id":"b303e3d6-e2f8-47f2-ac89-4f9147c95d6b","resolution":{"observed_at":"2026-05-11T23:36:14.352173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03127","last_updated":"2026-04-03T14:36:47Z","snapshot_observed_at":"2026-07-06T22:40:51.136169Z","submitted_at":"2026-01-06T15:59:33Z","title":"Unified Thinker: A General Reasoning Modular Core for Image Generation","version":2},"cited_work":{"arxiv_id":"2601.03127","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.03127","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unified Thinker: A General Reasoning Modular Core for Image Generation","venue":"cs.CV","work_id":"f100446e-4c27-4057-8f7a-a5581ea46f76","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2601.03127","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:036ab661ba57faf56b9283dce2834140fafe85f4cba192f01a1b65b5d955167b","observation_id":"27ecd09a-cb02-4b5f-8f12-068f456b3d98","resolution":{"observed_at":"2026-05-11T23:36:14.310359Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.03467","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:09:50.785943Z","title":"ThinkRL-Edit: Thinking in reinforcement learning for reasoning-centric image editing","venue":null,"work_id":"ec758740-6125-46f6-9ab5-9b012131883f","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:470343c1011d78bc047312bb96874a915635af051678c24f5d47c4a5ed18733d","observation_id":"fc5f3209-64c3-4ef7-ae61-48c2e210d57c","resolution":{"observed_at":"2026-05-11T23:36:14.406277Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.23568","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:09:50.812115Z","title":"Thinkgen: Generalized thinking for visual generation","venue":null,"work_id":"e7b9510c-c818-4bbc-9fcd-2a330175af26","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:b338d56dfb4e29d69154e6b260f4f875de27feceb29279bc63b2bd78718b4d61","observation_id":"11f8678b-52ee-46bb-a237-a2a095868069","resolution":{"observed_at":"2026-05-11T23:36:14.616239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasonedit: Towards reasoning-enhanced image editing models","venue":null,"work_id":"2a9cd1b2-59ca-41bc-8893-507943c0ae84","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:f4629b852c935cc5a1e6b130e51b6ca132801a6320565014e87389db92025a2f","observation_id":"0b79ee05-19de-4b75-9059-95910782387a","resolution":{"observed_at":"2026-05-27T01:53:22.710775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":"2505.05470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-07-09T02:25:55.898592Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","venue":"cs.CV","work_id":"bf1e8e81-ff31-401a-a5dc-d9c49df168ab","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:072b77e0ac3daae3169f2a3fb80d13d41ca4ef5b1860f5aee280373569b2b611","observation_id":"b3c75896-eef1-4f10-a2cf-0c9328b07adc","resolution":{"observed_at":"2026-05-11T23:36:14.265384Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-07-31T14:51:03.625964Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":"2505.07818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-07-09T03:05:55.316091Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","venue":"cs.CV","work_id":"7404dd36-8f9c-478f-b089-ef9f8189c711","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:d126fef79765223f242ddb710bd074c63be87387814d3e1724be6f6ef26510e1","observation_id":"c25d9c85-cabc-4024-a324-d784b274e793","resolution":{"observed_at":"2026-05-11T23:36:14.547536Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2021.3085339","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:15:00.875560Z","title":"Text-guided human image manipulation via image-text shared space","venue":null,"work_id":"ab7240a6-b179-4036-82f6-0d2dbcac055f","year":2022},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:7e11e209ceebddfecc29d73732d9870a622dc6d56518289e1dc1b9551c552450","observation_id":"64613d6a-9da2-4229-81cf-77bb937a4c28","resolution":{"observed_at":"2026-05-09T01:54:33.476823Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Consistent image layout editing with diffusion models","venue":null,"work_id":"dcc69eb9-78a6-4658-ae44-85368ff64b85","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:77db2751d898658f7263f2db569b8f321182cbbe86f6fc5f9f10e7b7493737ec","observation_id":"6a5a6188-b894-4023-9c52-5bf9bb7e0c77","resolution":{"observed_at":"2026-05-27T01:53:22.729744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instruction-driven multi-weather image translation based on a large-scale image editing model","venue":null,"work_id":"dd44551b-208e-4206-ad57-46a97c99c326","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:2a1e3bf46795bd5ef2752120d8de2c6b42f11abf889a1a57a65bb0547acad34d","observation_id":"b1e52f75-d346-4692-ae33-8a7dc5409961","resolution":{"observed_at":"2026-05-27T01:53:22.777501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spherical patch generative adversarial net for unconditional panoramic image generation","venue":null,"work_id":"76b4a2de-7ace-4ba7-91fc-40f8897cd9b7","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:66e13ea8568b4f40a53523f9df660cf915b5e987c41c48e5170df55db1b48593","observation_id":"df5b1cae-7ac9-4b93-85a4-596b0a45b8ec","resolution":{"observed_at":"2026-05-27T01:53:22.766814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2023.3347299","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:15:00.875560Z","title":"Talk-to-edit: Fine-grained 2d and 3d facial editing via dialog","venue":null,"work_id":"cf716b4d-ea03-4787-b5da-1964ccc4805f","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:437ac1ed7d6cfee9bc9ab28b57743fc95cf56cd70278adf22504efa1517d5fd9","observation_id":"e2488ebd-e723-465e-a624-17eb706f3741","resolution":{"observed_at":"2026-05-09T01:54:33.540347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixel-inconsistency modeling for image manipulation localization","venue":null,"work_id":"3c166248-d9c6-41ac-aa36-ab8f690a68ec","year":null},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:cdba909abc9dc00585ebd09517023d769e678cc73dee2be671b03edfa77a78aa","observation_id":"c55d235e-5357-4cbf-b99f-4d7a887201ad","resolution":{"observed_at":"2026-05-27T01:53:22.703325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tpami.2025.3541028","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:15:00.875560Z","title":"Available: https://doi.org/10.1109/TPAMI.2025.3541028","venue":null,"work_id":"c2a3341a-840d-45a5-9b0a-e1b4dfc9a78b","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:d0a4bf33f057758348c4e7ebb7e06dfe3c7130dc6bdda5a7db6fd7cff41cb9d2","observation_id":"1c32b0bc-f36b-4399-bb2c-308a63bd4c8c","resolution":{"observed_at":"2026-05-09T01:54:33.324518Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12205","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T15:48:35.099664Z","title":"DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing","venue":null,"work_id":"a7e01e40-db36-42cf-bdd6-6e8b65a1ed0c","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:4e271ff6647764219211a66738fc21f2c944fc446accc772a0a0aeccdf3f2750","observation_id":"6b8c1c3e-7906-4516-854c-c5d66461ae70","resolution":{"observed_at":"2026-05-11T23:36:14.501643Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12279","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unit: Unified multimodal chain-of-thought test-time scaling","venue":null,"work_id":"654e3b6b-57f8-4961-9c9e-d9bb56962b98","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:40bfa069fb3f36a865a987fc0e777e50564b30d32708d2043d4671724ca9201b","observation_id":"d8a0129d-69c8-44e9-8535-45921df8aa5c","resolution":{"observed_at":"2026-05-11T23:36:14.991572Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.12252","last_updated":"2026-06-18T07:56:55Z","snapshot_observed_at":"2026-07-14T22:25:02.474086Z","submitted_at":"2026-03-12T17:58:48Z","title":"EndoCoT: Scaling Endogenous Chain-of-Thought Reasoning in Diffusion Models","version":4},"cited_work":{"arxiv_id":"2603.12252","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.12252","snapshot_observed_at":"2026-07-04T00:19:13.713508Z","title":"Endocot: Scaling endogenous chain-of-thought reasoning in diffusion models","venue":"cs.CV","work_id":"08ee73e4-1472-42c3-abac-1c18e9b0a642","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2603.12252","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:69955c45212b972f4924e9bc067a985f2282f148ca364c1cd71cb3db4d0dcbd8","observation_id":"fcd9db07-65e3-46c4-ad55-35d2c64da4f8","resolution":{"observed_at":"2026-06-19T17:11:33.200899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.01382","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:19:49.606655Z","title":"Promptrl: Prompt matters in rl for flow-based image generation","venue":null,"work_id":"4762b3e3-3543-475a-abb8-366e9d2e78bc","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:0ac9957176401744601aadd0a0a57d71cfd6d37322d3cccbc7a77ad88800a7cf","observation_id":"b8c0d12c-b40a-44b2-b485-9237c2a35a49","resolution":{"observed_at":"2026-05-11T23:36:14.423005Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tip.2024.3364074","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:15:00.875560Z","title":"Consensus- agent deep reinforcement learning for face aging","venue":null,"work_id":"a8ebc433-4a29-4f7a-955e-e193cff95aeb","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:7a9a653d07f861f0c8f0f768ad6e246c816fc86caa747d440c9cf4d35a49ce42","observation_id":"5069e3b1-03fb-4cd7-ac4c-5045a2fe31c9","resolution":{"observed_at":"2026-05-09T01:54:33.505730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16864","last_updated":"2026-07-16T08:30:12Z","snapshot_observed_at":"2026-08-03T15:27:46.072047Z","submitted_at":"2025-12-18T18:34:23Z","title":"RePlan: Reasoning-guided Region Planning for Complex Instruction-based Image Editing","version":2},"cited_work":{"arxiv_id":"2512.16864","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.16864","snapshot_observed_at":"2026-07-17T02:20:37.504540Z","title":"Replan: Reasoning-guided region planning for complex instruction-based image editing","venue":null,"work_id":"2ccea1c4-a4f0-41e0-bae9-07e0242e02e9","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2512.16864","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:b79405cc77066bb2e804d3a2084401340c515cfe3b4ad1b0aa01ac2759a0daed","observation_id":"867a5b1b-9c61-49c5-b085-af5d8f4e8a46","resolution":{"observed_at":"2026-07-17T02:20:37.504540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.02437","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T08:47:50.510363Z","title":"Unireason 1.0: A unified reasoning framework for world knowledge aligned image generation and editing","venue":null,"work_id":"78173501-4b1d-416b-bfcc-e61d472fcc3e","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:ecf24677400064ca727f2607ae0b85507e215f1f1a7556b60484fcee043e65bf","observation_id":"3013bbfc-e023-45e3-bcf8-905ad6be7cf9","resolution":{"observed_at":"2026-05-11T23:36:14.295984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.10332","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:43:13.974516Z","title":"Think-then-generate: Reasoning-aware text-to-image diffusion with llm encoders","venue":null,"work_id":"7925fa6e-0d2a-4f77-b7d8-9ee2e9009b7f","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:94da755db849bdeb91d002287003caf85252e76ef6c5ca2d7829ebc54c360e4f","observation_id":"a554675a-cfa5-4429-b558-f0de6edad0a5","resolution":{"observed_at":"2026-05-11T23:36:14.509617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Edit-r1: Unleashing reasoning-based reinforcement learning for image editing","venue":null,"work_id":"b2eed57f-b0bb-42bb-8879-475c3fac09c8","year":null},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:2d92ee31590aefaef0fae634af86679dc921a4d1759df96cf94fd046d137862c","observation_id":"e21c94ba-54da-47bc-b5b6-1dc291e982b4","resolution":{"observed_at":"2026-05-27T01:53:22.714241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07265","last_updated":"2026-06-02T17:11:50Z","snapshot_observed_at":"2026-07-06T20:49:51.505079Z","submitted_at":"2025-03-10T12:47:53Z","title":"WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2503.07265","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.07265","snapshot_observed_at":"2026-07-04T13:19:50.710913Z","title":"WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation","venue":"cs.CV","work_id":"604c1ae0-368d-49bf-8117-d688ac59f305","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2503.07265","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:befc66f3076118cdf358253f876a7731944002cb933856c2eedc4d4a3eba1c18","observation_id":"60500e0a-e98e-4cdb-bab1-659564550e67","resolution":{"observed_at":"2026-05-15T16:24:27.819650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialclip: Learning 3d-aware image representations from spatially discriminative language","venue":null,"work_id":"1a8d2c5a-b208-40f7-aab0-f9de8412f013","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:f2e1c563cdc54cea5d733d4200b31b52e31828bf061f6ac071d272a6948c72d9","observation_id":"9cb1fd09-c8e8-422d-a062-c3282912cde1","resolution":{"observed_at":"2026-05-27T01:53:22.739413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.21066","last_updated":"2025-08-28T17:59:46Z","snapshot_observed_at":"2026-07-06T22:20:16.962764Z","submitted_at":"2025-08-28T17:59:46Z","title":"OneReward: Unified Mask-Guided Image Generation via Multi-Task Human Preference Learning","version":1},"cited_work":{"arxiv_id":"2508.21066","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21066","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Onereward: Unified mask-guided image generation via multi-task human preference learning","venue":null,"work_id":"ae97244c-ffbd-4c00-82ee-89f3fdece7f4","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2508.21066","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:50f3852f8c5d50f8e2c75563b5aee794ef2c6290d0c917ecd2cf9b4a1fa0e189","observation_id":"dd654700-f1a2-4a2c-8b0c-cde4dba1cc01","resolution":{"observed_at":"2026-05-11T23:36:14.767670Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tip.2023.3268001","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:15:00.875560Z","title":"Describe, spot and explain: Interpretable representation learning for discriminative visual reasoning","venue":null,"work_id":"3094cb0a-3f9e-4f32-b20f-497c853cb4f2","year":2023},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:79e4b29b39126d44a38aa64c9430b345f1f659364d6785f138b0f6ce2834d2a0","observation_id":"b31ef99a-4856-4ea1-9156-853034934313","resolution":{"observed_at":"2026-05-09T01:54:33.518102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23909","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.733583Z","title":"Editscore: Unlocking online rl for image editing via high-fidelity reward modeling","venue":null,"work_id":"478d04d3-d99b-4a09-b3b5-cc62c6528bf7","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:2b85ea73448fb561e2896ef53b3708c730930c1944642c0f7ef0cfae3dc18891","observation_id":"70a50361-b532-424a-bf54-9d9835b922f9","resolution":{"observed_at":"2026-05-11T23:36:14.389149Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.26346","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.698229Z","title":"Editreward: A human- aligned reward model for instruction-guided image editing","venue":null,"work_id":"44f2e6b9-ba11-41a2-9c4f-aee7a3bc1178","year":2026},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:6c0836b0c608ce6ae3f85712c2f984dfe88fa131eb124b254ca0e9b03de7017f","observation_id":"3868c4d7-7de3-46c5-9218-3dfcd9f085f1","resolution":{"observed_at":"2026-05-11T23:36:14.458415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decompose and compare consistency: Measuring vlms’ answer reliability via task-decomposition consistency comparison","venue":null,"work_id":"0814c2d4-e341-4156-988b-0ec83ed62d00","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:675e82e9fb5798782ac071b7cd6aef0930afd1be4a30267ec7ab8a888435a037","observation_id":"e9f2bb27-9ede-4220-9e40-7ad7c4d29650","resolution":{"observed_at":"2026-05-27T01:53:22.717723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A minimalist approach to llm reasoning: from rejection sampling to reinforce","venue":null,"work_id":"c27210b4-01a1-431a-82d2-45889f0a4666","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:a74fef0c9f3ec6b682b2e7d835cfedb8f8d53cb58394a454c968b7a46b250b94","observation_id":"8cc3be6f-688a-4af2-a6da-c2c03df58f84","resolution":{"observed_at":"2026-05-27T01:53:22.745853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Star-ds: Step-level uncertainty-aware reasoning data selection in reinforcement learning for llm multi-step reasoning","venue":null,"work_id":"42fc31f9-55f6-4a37-899f-12cd2a573151","year":null},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:16e450a3946f240df8067446634e279c1177569103abc5fc4a22fa82c1876869","observation_id":"13fbd3b2-276d-40d2-a930-0b52616a2d80","resolution":{"observed_at":"2026-05-27T01:53:22.706888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":"6ec92951-d157-4d42-a138-ac6e09e7509c","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:764bd63878a43046aa987298fac12c15fc3eb84e65b7998d1a5cc26fc9d6f3ad","observation_id":"ba05cc04-9a67-48db-bad7-3ebdac4a083f","resolution":{"observed_at":"2026-05-27T01:53:22.721277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative multimodal models are in-context learners","venue":null,"work_id":"04c28a82-8f82-43e0-bfc3-171b9f324d13","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:2fd803c6ab8cca7945c7068f11207d106ed672b6d68afe2430d5c49d05b3200d","observation_id":"df859c47-4841-44d5-bc39-21db35dd212c","resolution":{"observed_at":"2026-05-27T01:53:22.735789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnigen: Unified image generation","venue":null,"work_id":"1728e796-5294-4f8d-a4dc-d74e28b5d779","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:d7e60dff14f25f5647f7be9da7e0557a09275646d03cfede91e268a34533cc37","observation_id":"e2e9b417-bf7c-4baa-88d4-7b6fc997eee4","resolution":{"observed_at":"2026-05-27T01:53:22.749137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20797","last_updated":"2024-06-17T17:51:50Z","snapshot_observed_at":"2026-07-06T18:23:15.098065Z","submitted_at":"2024-05-31T13:59:18Z","title":"Ovis: Structural Embedding Alignment for Multimodal Large Language Model","version":2},"cited_work":{"arxiv_id":"2405.20797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20797","snapshot_observed_at":"2026-07-04T19:50:10.268440Z","title":"Ovis: Structural embedding alignment for multimodal large language model","venue":null,"work_id":"6f4025f6-a13c-4549-b0dc-8f2bb5a5a954","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2405.20797","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:c6c7410f65c529e48097e55d9c92dbdba211fb37587d51d70acfbb28d137f6da","observation_id":"a6b4084a-6e5c-4be7-b4d8-b60f0d7ccc78","resolution":{"observed_at":"2026-05-11T23:36:14.874224Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":"2505.14683","doi":"10.48550/arxiv.2505.14683","metadata_source":"pith","pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-07-10T13:37:06.841769Z","title":"Emerging Properties in Unified Multimodal Pretraining","venue":"cs.CV","work_id":"e0cfd82c-f5d4-44fd-b531-ec73ab0a805b","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:9241ebc41290d40c139518440e5c276ec5dd37b008c95104085a82c56045d49d","observation_id":"6aca301e-b303-4904-b415-24b450a7d9eb","resolution":{"observed_at":"2026-05-11T23:36:14.448393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.05606","doi":"10.48550/arxiv.2508.05606","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Uni-cot: Towards unified chain-of-thought reasoning across text and vision.arXiv preprint arXiv:2508.05606","venue":null,"work_id":"2d7c3351-90a7-45ce-a374-890c71fbea6e","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:86335be9ebdcf8b406eaa57b8532da4d24bbb5c123960b51b28814ab7877e82f","observation_id":"af292168-a3a3-45c9-870e-4093f538a5f4","resolution":{"observed_at":"2026-05-11T23:36:14.339354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magicbrush: A manually annotated dataset for instruction-guided image editing","venue":null,"work_id":"1dcacaad-c802-4572-9fdd-bf47346505de","year":2024},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:f096340e274da0a55eee2904a02efe84bef34cc11699886ef1832ca48efc4e51","observation_id":"fbbc63a1-53f6-4066-b9cd-f6e3dd5593ea","resolution":{"observed_at":"2026-05-27T01:53:22.756741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anyedit: Mastering unified high-quality image editing for any idea","venue":null,"work_id":"2acfbdd6-92cb-4eb3-9e49-46b8eb6e7637","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:192487bcd7142845da257d297bedf8e77644219c4de4774f9630ba67b92c4064","observation_id":"a4a839c6-1044-4bb1-a390-b194736c4edc","resolution":{"observed_at":"2026-05-27T01:53:22.763254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22705","last_updated":"2025-05-28T17:59:15Z","snapshot_observed_at":"2026-07-30T00:45:52.058972Z","submitted_at":"2025-05-28T17:59:15Z","title":"HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer","version":1},"cited_work":{"arxiv_id":"2505.22705","doi":"10.48550/arxiv.2505.22705","metadata_source":"pith","pith_arxiv_id":"2505.22705","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer","venue":"cs.CV","work_id":"68d4c0f7-3dfd-438d-a823-6a93fd0a835d","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.22705","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:21b1fd80678bb33c2cf9493c0732101c4ce059f5149aab0df302d9a629083d5f","observation_id":"555a3239-68b4-41bd-8c0e-c1a7bc3856e1","resolution":{"observed_at":"2026-05-16T17:13:39.137651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03107","last_updated":"2025-06-11T06:11:36Z","snapshot_observed_at":"2026-07-06T21:35:56.582332Z","submitted_at":"2025-06-03T17:39:47Z","title":"ByteMorph: Benchmarking Instruction-Guided Image Editing with Non-Rigid Motions","version":2},"cited_work":{"arxiv_id":"2506.03107","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03107","snapshot_observed_at":"2026-07-04T00:09:13.963661Z","title":"Bytemorph: Benchmarking instruction- guided image editing with non-rigid motions.ArXiv, abs/2506.03107","venue":null,"work_id":"8729a5f7-a8aa-43f1-8724-d77948f05226","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2506.03107","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:20ffdd029112a7f40756414736c0a48c58a96b2614d664eff2aa82b3f363dbdb","observation_id":"cc3ba391-0e60-4e04-8d7c-82b41e592fad","resolution":{"observed_at":"2026-05-11T23:36:14.376218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18871","last_updated":"2026-04-21T17:32:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-23T17:38:54Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","version":4},"cited_work":{"arxiv_id":"2506.18871","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18871","snapshot_observed_at":"2026-07-10T01:46:41.215139Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","venue":"cs.CV","work_id":"d3153e5f-b6e2-4ab3-9f41-e24e24d64496","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2506.18871","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:3d916848a8210edb91735669db057595f1496e657a54e1b966dd49057690df09","observation_id":"ee52f3b7-b9ad-4781-99ba-833876aff080","resolution":{"observed_at":"2026-05-11T23:36:15.095575Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03147","last_updated":"2025-06-18T18:00:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-03T17:59:33Z","title":"UniWorld-V1: High-Resolution Semantic Encoders for Unified Visual Understanding and Generation","version":4},"cited_work":{"arxiv_id":"2506.03147","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03147","snapshot_observed_at":"2026-07-05T16:51:14.197597Z","title":"UniWorld-V1: High-Resolution Semantic Encoders for Unified Visual Understanding and Generation","venue":"cs.CV","work_id":"488a273e-95d8-46f1-87c7-2244068d00d0","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2506.03147","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:45328f4e4ccc82c9c041f81a67a65327844b7a795fa02bba9dd4725d78c38a3b","observation_id":"903d680e-eb14-4211-995c-f28a796fab80","resolution":{"observed_at":"2026-05-12T17:34:27.304691Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen3-vl technical report","venue":null,"work_id":"c32ad150-c66e-4c44-8ced-f7760469274c","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:2151778cea37e3232d33c4a60693c241b869555b012bd70b30988c12f06d2b11","observation_id":"3cd9d8c5-c127-464c-8674-8b05fbce0139","resolution":{"observed_at":"2026-05-27T01:53:22.781074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-07-06T21:28:33.821060Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:679474900c1b2659fcfff11a983d0a32cbb601da48bb43cbf63083d695326878","observation_id":"985954a5-013f-4361-bb59-b5aa280e606d","resolution":{"observed_at":"2026-05-11T23:36:14.561125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":40,"verified_fuzzy":23},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 3 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2604.25477."}