{"as_of":"2026-08-08T08:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9fb9930ec689f1af171e075f7da146ea38b4e786b81e759a08f42d2484a25c59","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:46:39.681727Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T21:17:04.368521Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:19:13.598382Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"cited_work":{"arxiv_id":"2505.17768","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17768","snapshot_observed_at":"2026-07-04T00:19:13.598382Z","title":"R-genie: Reasoning-guided gener- ative image editing.arXiv preprint arXiv:2505.17768","venue":null,"work_id":"c42d6499-6b5b-4518-935d-0f120847353f","year":2025},"citing_paper":{"arxiv_id":"2510.01186","last_updated":"2026-04-14T16:17:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-01T17:59:56Z","title":"ASTRA: Let Arbitrary Subjects Transform in Video Editing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T10:13:10.141426Z"},"links":{"cited_paper":"/paper/2505.17768","citing_paper":"/paper/2510.01186"},"observation_digest":"sha256:190efd6deb3b1e9e0db535e1875f042bb46e0b04cc3254ac46cb5e0cfd09562d","observation_id":"7363a002-f8f5-4e45-8f99-ee6d57bd8526","resolution":{"observed_at":"2026-05-18T10:16:14.314804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"cited_work":{"arxiv_id":"2505.17768","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17768","snapshot_observed_at":"2026-07-04T00:19:13.598382Z","title":"R-genie: Reasoning-guided gener- ative image editing.arXiv preprint arXiv:2505.17768","venue":null,"work_id":"c42d6499-6b5b-4518-935d-0f120847353f","year":2025},"citing_paper":{"arxiv_id":"2606.19103","last_updated":"2026-06-17T14:16:47Z","snapshot_observed_at":"2026-08-08T06:10:02.208503Z","submitted_at":"2026-06-17T14:16:47Z","title":"ProductConsistency: Improving Product Identity Preservation in Instruction-Based Image Editing via SFT and RL","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-26T21:17:04.368521Z"},"links":{"cited_paper":"/paper/2505.17768","citing_paper":"/paper/2606.19103"},"observation_digest":"sha256:d11b53339ffae383a71a52fec0b21afbf4f6ac931742e1bfc5d711a10490de00","observation_id":"847748c4-8358-48af-8c51-90af5092ed71","resolution":{"observed_at":"2026-07-04T00:19:13.600228Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17768/citation-record","integrity":"/paper/2505.17768/integrity","json":"/paper/2505.17768/citation-record.json","paper":"/paper/2505.17768"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:46:34.237102Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:34.237102Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:9c7ea2500ce925a5e546b70d12e9a6a9210c0cdbfacbf299c04cfcf7ffd3fb56","observation_id":"6e49fde3-c98f-42c9-adc3-28511d6d7a2d","resolution":{"observed_at":"2026-08-07T14:46:34.237102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:34.293706Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:34.293706Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:65bee1789f435392ce44aae7fb0ba252bb2c25bde1c8b4bf92f01a6e75f5d70e","observation_id":"c7170823-5090-4293-a498-4f0b8a3d8b03","resolution":{"observed_at":"2026-08-07T14:46:34.293706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03665","last_updated":"2024-12-04T19:01:06Z","snapshot_observed_at":"2026-08-07T14:02:24.188094Z","submitted_at":"2024-12-04T19:01:06Z","title":"Personalizing Multimodal Large Language Models for Image Captioning: An Experimental Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03665","snapshot_observed_at":"2026-08-07T14:46:34.401485Z","title":"Personalizing multimodal large language models for image captioning: an experimental analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:34.401485Z"},"links":{"cited_paper":"/paper/2412.03665","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:d6a7cabf53a7fa8fbff85bee2d5f1e181ae07e10671cfb92b24587b8d0a31f28","observation_id":"cf8fdaf7-4fae-4a8c-bbdb-27597834ea0e","resolution":{"observed_at":"2026-08-07T14:46:34.401485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:34.488330Z","title":"The revolution of multimodal large language models: a survey.arXiv preprint arXiv:2402.12451, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:34.488330Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:46583a3c5a92059d051c945cdce809e041626cffb214c6a914723fa4eb379759","observation_id":"0d226bed-734c-4ee3-b098-aae642972e61","resolution":{"observed_at":"2026-08-07T14:46:34.488330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04226","last_updated":"2023-03-07T20:36:13Z","snapshot_observed_at":"2026-07-06T14:59:53.901528Z","submitted_at":"2023-03-07T20:36:13Z","title":"A Comprehensive Survey of AI-Generated Content (AIGC): A History of Generative AI from GAN to ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04226","snapshot_observed_at":"2026-08-07T14:46:34.591816Z","title":"A comprehensive survey of ai-generated content (aigc): A history of generative ai from gan to chatgpt.arXiv preprint arXiv:2303.04226, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:34.591816Z"},"links":{"cited_paper":"/paper/2303.04226","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:504df40b8fe3e8ee63c204b0d848dfafe5111af0c9dcc2d4996a33cd36e77b54","observation_id":"b2158e25-d588-4187-81aa-6ce1386dbc29","resolution":{"observed_at":"2026-08-07T14:46:34.591816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:34.742882Z","title":"Diffusion models in vision: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(9):10850–10869, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:34.742882Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:d86bb69a20dc2fd9b4f299e21d0a8e491832486b7773001e1305fa8ce642f486","observation_id":"977c83a1-fbaa-4502-b6d9-7d1d5c7197f3","resolution":{"observed_at":"2026-08-07T14:46:34.742882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10639","last_updated":"2025-03-13T17:59:59Z","snapshot_observed_at":"2026-08-07T17:06:06.948584Z","submitted_at":"2025-03-13T17:59:59Z","title":"GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10639","snapshot_observed_at":"2026-08-07T14:46:34.827824Z","title":"Got: Unleashing reasoning capability of multimodal large language model for visual generation and editing.arXiv preprint arXiv:2503.10639, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:34.827824Z"},"links":{"cited_paper":"/paper/2503.10639","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:7aef4b7787414b4b860a3b51184aa31191ae0c9a7a86e804cf3fedd64848187e","observation_id":"be32fd37-cc73-4585-8623-2b3b7073afb3","resolution":{"observed_at":"2026-08-07T14:46:34.827824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17102","last_updated":"2024-02-05T05:04:53Z","snapshot_observed_at":"2026-07-06T16:25:25.534843Z","submitted_at":"2023-09-29T10:01:50Z","title":"Guiding Instruction-based Image Editing via Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17102","snapshot_observed_at":"2026-08-07T14:46:34.920045Z","title":"Guid- ing instruction-based image editing via multimodal large language models.arXiv preprint arXiv:2309.17102, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:34.920045Z"},"links":{"cited_paper":"/paper/2309.17102","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:8aa48be2705342cd129675ab5c3da0fec74841b450c65c3290b6452ed76da6a3","observation_id":"cf3dccb2-5a83-4a76-98ec-f6d6d703cb7f","resolution":{"observed_at":"2026-08-07T14:46:34.920045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:35.011707Z","title":"Blink: Multimodal large language models can see but not perceive","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.011707Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:3ddffce53b564b08ab45a28740a6b0f7d90757141e6e4b6da3d587694548c06d","observation_id":"b4afb409-feb4-4b0d-a8df-5cf72c265488","resolution":{"observed_at":"2026-08-07T14:46:35.011707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:43.971361Z","title":"Exploiting clip self-consistency to automate image augmentation for safety critical scenarios","venue":null,"work_id":"8d20d6ca-1615-4947-a50d-e5d423c04f16","year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.110852Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:fb99b9393bc3c4271f37a4c707a62ed51a8d44bd5a2d46907c92201e631dc9d1","observation_id":"ff78ff11-3867-42da-a0fb-0097c1696894","resolution":{"observed_at":"2026-08-07T14:46:44.073402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:35.203450Z","title":"Image style transfer using convolutional neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.203450Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:b6d716d43b03da858f21cf67f7b94c9eb4c86fcc91c25bd88323df2442b43c8a","observation_id":"15b2ccd7-63dd-4da4-a229-9687a5561ce0","resolution":{"observed_at":"2026-08-07T14:46:35.203450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14396","last_updated":"2025-03-02T07:53:44Z","snapshot_observed_at":"2026-07-06T18:03:51.687441Z","submitted_at":"2024-04-22T17:56:09Z","title":"SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14396","snapshot_observed_at":"2026-08-07T14:46:35.306595Z","title":"Seed-x: Multimodal models with unified multi-granularity comprehension and generation.arXiv preprint arXiv:2404.14396, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.306595Z"},"links":{"cited_paper":"/paper/2404.14396","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:7f9ebf23ac680b7bd48c80d81f5bb2e317c124e69d38582c05fcd598b5a3d46f","observation_id":"d75c3803-9d2b-445d-8e6f-fc17c60aa1e1","resolution":{"observed_at":"2026-08-07T14:46:35.306595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:35.392031Z","title":"Instructdiffusion: A generalist modeling interface for vision tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.392031Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:326d5ca7ed2863bb75e935d52ec90106dffc89cca55d80f148e7c32ff7bbca62","observation_id":"c51a1187-448f-44f3-9fc8-075f158e1007","resolution":{"observed_at":"2026-08-07T14:46:35.392031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:43.816652Z","title":"Artificial general intelligence: concept, state of the art, and future prospects","venue":null,"work_id":"469c33aa-b460-41f2-b841-234b15c6a5cb","year":2014},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.491457Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:421193b52253fd341f47dfae8a2015edc869c41feb05834dd7ee07ec080db4a7","observation_id":"e455fd12-1278-4f08-b577-670c702786a6","resolution":{"observed_at":"2026-08-07T14:46:43.884110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:43.650416Z","title":"Diffusion models in low-level vision: A survey","venue":null,"work_id":"b73645a6-b441-4fd9-9cdb-56c7c2de237f","year":2025},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.585365Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:2f27e843566845fbde4e7b7e25009cab22caf7612af64f02d796d636e3defa0b","observation_id":"2ac678eb-afe3-46e9-bae6-b78988a74608","resolution":{"observed_at":"2026-08-07T14:46:43.736396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T14:46:35.684189Z","title":"Prompt-to-prompt image editing with cross attention control.arXiv preprint arXiv:2208.01626, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.684189Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:a2c01d5b0feb576a577284db340362fd21b4955a1d504bd3687a43552ce4f97b","observation_id":"3c97427e-f89d-430a-b3f8-3ba0007d5ea4","resolution":{"observed_at":"2026-08-07T14:46:35.684189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:35.753105Z","title":"Smartedit: Exploring complex instruction- based image editing with multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.753105Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:34a622e16162f8cade954166069314c060b7db9751935c8cc4afb40c077bc5b8","observation_id":"5c16cacb-53c3-41a1-9127-d693984b9095","resolution":{"observed_at":"2026-08-07T14:46:35.753105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:35.845993Z","title":"Image-to-image translation with conditional adversarial networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.845993Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:5d785a9537ced51121f55253f7720871885d248a60297e3348097f7b93960b86","observation_id":"1b3064e8-3f9c-4ffa-9e35-eb2a98b81c08","resolution":{"observed_at":"2026-08-07T14:46:35.845993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04423","last_updated":"2025-04-06T09:20:49Z","snapshot_observed_at":"2026-08-07T16:08:15.150652Z","submitted_at":"2025-04-06T09:20:49Z","title":"UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04423","snapshot_observed_at":"2026-08-07T14:46:35.925099Z","title":"Unitoken: Harmonizing multimodal understanding and generation through unified visual encoding.arXiv preprint arXiv:2504.04423, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.925099Z"},"links":{"cited_paper":"/paper/2504.04423","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:65f1af85ca5951ab4cd061ee6bd013a0f0ce6db7cfe85cf39390b777bb86a0e5","observation_id":"4fb701a8-a7fa-4fd5-adfd-b33b36b63ab6","resolution":{"observed_at":"2026-08-07T14:46:35.925099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:35.992923Z","title":"A style-based generator architecture for generative adversarial networks, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:35.992923Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:1976f19ad4390649aa5f1ff7c3ebde31798e0321a473a4d02d6fc0063ec1ce8d","observation_id":"32b68690-cada-4a52-9224-4df1407d3dd2","resolution":{"observed_at":"2026-08-07T14:46:35.992923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:36.094232Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:36.094232Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:15557122fe00994fbf6592437b7556828d4fd6b3de3654a16cac871cebb6beee","observation_id":"460a7837-d519-4da3-af38-7a93203fac1b","resolution":{"observed_at":"2026-08-07T14:46:36.094232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:36.194091Z","title":"Referitgame: Referring to objects in photographs of natural scenes","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:36.194091Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:a8a48e246330df41ba22e06d900221df71e3ae4549fed70d20960a22b3a4ec1e","observation_id":"22507636-45af-4598-92d5-cb1de7016103","resolution":{"observed_at":"2026-08-07T14:46:36.194091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:36.300104Z","title":"Lisa: Reasoning segmentation via large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:36.300104Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:225cd46b3b2b6a7ca3c7660685f629863c92d7181032f35bd3ed55bf3fe8a5cc","observation_id":"42958a15-5507-41a5-b6e9-be6b67421afb","resolution":{"observed_at":"2026-08-07T14:46:36.300104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08360","last_updated":"2024-02-13T10:40:53Z","snapshot_observed_at":"2026-08-01T17:34:31.493112Z","submitted_at":"2024-02-13T10:40:53Z","title":"Visual Question Answering Instruction: Unlocking Multimodal Large Language Model To Domain-Specific Visual Multitasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08360","snapshot_observed_at":"2026-08-07T14:46:36.393741Z","title":"Visual question answering instruction: Unlocking multimodal large language model to domain-specific visual multitasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:36.393741Z"},"links":{"cited_paper":"/paper/2402.08360","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:7f880e9abfff1b08563f4032d854575b63d9dbe3726035d64dcd338044dc4f15","observation_id":"7d436560-1fad-4610-b587-a7041d49c8f4","resolution":{"observed_at":"2026-08-07T14:46:36.393741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-07T14:46:36.491967Z","title":"Mini-gemini: Mining the potential of multi-modality vision language models.arXiv preprint arXiv:2403.18814, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:36.491967Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:6c40b133bb0177f59fc68cac36df306e1a2d99a85718efbcb62bf2579ddda364","observation_id":"d79587cf-fdb0-434e-b252-53dae09a525f","resolution":{"observed_at":"2026-08-07T14:46:36.491967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-07T14:46:36.613898Z","title":"Textbooks are all you need ii: phi-1.5 technical report.arXiv preprint arXiv:2309.05463, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:36.613898Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:c1faf3c9480fe47d096cc2a47f90d053d69161c823456de82ebbba7da80a19a6","observation_id":"43e0ad56-47b0-41eb-a547-704a6601ec3b","resolution":{"observed_at":"2026-08-07T14:46:36.613898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:36.712924Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:36.712924Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:4e282dbb4a9c2f3cddb9cc62e16cdc5015d25d81e166ec66bad762929de66cf9","observation_id":"4985be64-915d-436d-b285-27fdc134fecc","resolution":{"observed_at":"2026-08-07T14:46:36.712924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:36.841001Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:36.841001Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:5bf6fe49296e41934be79a03c9a6e7ec236a2cb9be119dca766f56124b5011f5","observation_id":"a9ff9498-5718-4a7e-b70b-46fd765e5f77","resolution":{"observed_at":"2026-08-07T14:46:36.841001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T14:46:36.939976Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:36.939976Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:965c2be7060545b99e0ccd52eeab90eab2501cf514c44037090f2041cb37c3ca","observation_id":"c9305ab5-734a-45ac-a432-87e72263a1d1","resolution":{"observed_at":"2026-08-07T14:46:36.939976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:43.351309Z","title":"Adapedit: Spatio-temporal guided adaptive edit- ing algorithm for text-based continuity-sensitive image editing","venue":null,"work_id":"9be313a0-02b1-4030-808a-fb59adb31aaf","year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.034702Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:edc46b73af187bc46defe42113fa260099356f363f618ea3a3f7ee8c7ca86f3d","observation_id":"86194af1-dce4-4632-822e-cf70268ff6a0","resolution":{"observed_at":"2026-08-07T14:46:43.467782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:43.130083Z","title":"Hd-painter: High-resolution and prompt-faithful text-guided image in- painting with diffusion models","venue":null,"work_id":"fcbe1e63-f4cc-41a1-9280-affe6c6de401","year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.168546Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:8c1461b46dc9530fe6adc36e112d01b8e65f9a1e7446d37b98b734f20a06e32c","observation_id":"70e3498a-ca8b-46c5-874b-7a91e9805c8f","resolution":{"observed_at":"2026-08-07T14:46:43.197517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:42.991003Z","title":"Toward verifiable and reproducible human evaluation for text- to-image generation","venue":null,"work_id":"1b03d905-6980-4455-9b0e-d55e3805023c","year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.293505Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:4163a688ccdf2716f3c07d368cafc77bbd8e1c25b8ab9f73c57bf870b252c553","observation_id":"38069fa0-33f8-4dd1-8217-5f39252bb6ef","resolution":{"observed_at":"2026-08-07T14:46:43.064661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:42.806886Z","title":"State of the art on diffusion models for visual computing","venue":null,"work_id":"70b6c7c8-75d5-4995-831f-7e4280d5605f","year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.381702Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:3cd81c32b3e756199113bc745dc91208f3f87760a7257ca949226bf3a8e3f19c","observation_id":"1b8b0ad5-1da0-41be-97c5-cd0e7ca57bdd","resolution":{"observed_at":"2026-08-07T14:46:42.910819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T14:46:37.468840Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.468840Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:3155c22c026a655172a432a700e42e39cf18172547251278aa5376b78a790c2c","observation_id":"5cd6a7fa-891c-406f-a07e-9c06bd783107","resolution":{"observed_at":"2026-08-07T14:46:37.468840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:37.532693Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.532693Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:3321821c0e7eef72062f97dd38a6b1e0430b1a375246ed4ca2e95ed04b75bf0a","observation_id":"d9baa1b4-04bc-4cf8-9107-e0d08b3bee61","resolution":{"observed_at":"2026-08-07T14:46:37.532693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:37.617434Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.617434Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:bed3b3a8be53efc5daef59739164548907ca1a95f6315613ee400605830adb08","observation_id":"b898e07b-5ab6-422a-8318-be7f4687578d","resolution":{"observed_at":"2026-08-07T14:46:37.617434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:37.684125Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural information processing systems, 35:36479–36494, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.684125Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:cc3a12e8b9b4aefc93f8e71a501f4f953f454993b9e3e5fd4eb6ea81811fbbe6","observation_id":"b4d59a39-b2c1-4378-b9de-9a6658a2243a","resolution":{"observed_at":"2026-08-07T14:46:37.684125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:37.751701Z","title":"Laion- 5b: An open large-scale dataset for training next generation image-text models.Advances in neural information processing systems, 35:25278–25294, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.751701Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:fc4c09c08a690a2abc807340b1f1033fdbf4a6d6c6a5b84505fcba750b891603","observation_id":"c9915cba-c2d2-4b06-b156-7260feb27a4b","resolution":{"observed_at":"2026-08-07T14:46:37.751701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:42.594624Z","title":"Imagdressing-v1: Customizable virtual dressing","venue":null,"work_id":"6406895c-72a3-4402-a06a-dabea6ea03b3","year":2025},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.815535Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:e6ad5487403340ee019cd410f374330eec7b6d8a2a94eefba2f52e1af48ec8dd","observation_id":"2f5098da-430d-43f3-a364-3a9caccbfbe2","resolution":{"observed_at":"2026-08-07T14:46:42.714990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:42.431103Z","title":"Imagpose: A unified conditional framework for pose-guided person generation.Advances in neural information processing systems, 37:6246–6266, 2024","venue":null,"work_id":"31c0e279-fc7b-46f6-99d9-d54e55ded201","year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.849871Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:6046bee03e31ecfedee3d021e4d4a35c4d096a6e9b0355267d0e6f07cadb96de","observation_id":"419e9b11-f379-40ac-9f57-57a65fe94717","resolution":{"observed_at":"2026-08-07T14:46:42.515874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13176","last_updated":"2025-09-08T12:05:58Z","snapshot_observed_at":"2026-08-07T16:01:20.626786Z","submitted_at":"2025-04-17T17:59:47Z","title":"IMAGGarment: Fine-Grained Garment Generation for Controllable Fashion Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13176","snapshot_observed_at":"2026-08-07T14:46:37.926613Z","title":"Imaggarment-1: Fine- grained garment generation for controllable fashion design.arXiv preprint arXiv:2504.13176, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.926613Z"},"links":{"cited_paper":"/paper/2504.13176","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:1f065965582d1d88717c0af7da1683350794a4170f5cad1c90a8f52fd163e922","observation_id":"b7595ff7-0276-4a9c-886d-bf90c2dca095","resolution":{"observed_at":"2026-08-07T14:46:37.926613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:42.184904Z","title":"Learning by planning: Language-guided global image editing","venue":null,"work_id":"c495b91c-ca8d-4c29-81e2-8e225a3982bd","year":2021},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:37.994473Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:f546080602f646beb97a0709595278079c11f2f1b77fa292e64eef4dc828269b","observation_id":"6acb34f7-d88b-4490-a42f-01f0586fc529","resolution":{"observed_at":"2026-08-07T14:46:42.335156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-07T22:11:30.869700Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-07T14:46:38.045323Z","title":"Chameleon: Mixed-modal early-fusion foundation models.arXiv preprint arXiv:2405.09818, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.045323Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:ccca74efeea38621fa179aba6f106faa47b599c20c89f355a10f4d404675a01b","observation_id":"cc0374c5-1128-41a2-bad8-4d4286421a60","resolution":{"observed_at":"2026-08-07T14:46:38.045323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14164","last_updated":"2024-12-18T18:58:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T18:58:50Z","title":"MetaMorph: Multimodal Understanding and Generation via Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14164","snapshot_observed_at":"2026-08-07T14:46:38.112559Z","title":"Metamorph: Multimodal under- standing and generation via instruction tuning.arXiv preprint arXiv:2412.14164, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.112559Z"},"links":{"cited_paper":"/paper/2412.14164","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:ec65a2937eae71e5a8369fa6293abb4e816cc4b52e794845bbfe313dce3017e2","observation_id":"1b059a4c-f89d-47ba-9326-617b3c2a808f","resolution":{"observed_at":"2026-08-07T14:46:38.112559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-07T14:46:38.186434Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.186434Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:bdceca174b2f3a7f9bf5f68cd72f6cfbe8d468c8fc251e74eca76438b1c72888","observation_id":"e760d758-4fd0-4e17-a9a7-09e5309e7dc5","resolution":{"observed_at":"2026-08-07T14:46:38.186434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:41.992654Z","title":"Gpt4video: A unified multimodal large language model for lnstruction-followed understanding and safety-aware generation","venue":null,"work_id":"f7779e5c-fd83-4446-87fc-eb4420a1f2ce","year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.282879Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:f50d2e03eb3749ae0f289fa880309fe10ba2c0f84c4b7bc9e4dfcb83a38add36","observation_id":"3dd118ec-a2ff-429b-9674-0d4c83321c4e","resolution":{"observed_at":"2026-08-07T14:46:42.109004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-07T14:46:38.353174Z","title":"Janus: Decoupling visual encoding for unified multimodal understanding and generation.arXiv preprint arXiv:2410.13848, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.353174Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:d478ecf1d227bcb907d7b9f2cac34a0c7a2ac7fe190a3709fb690e8bc191c588","observation_id":"e8a3a7c3-cc0f-4f3e-9171-1d975eb88dbe","resolution":{"observed_at":"2026-08-07T14:46:38.353174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:38.429401Z","title":"Next-gpt: Any-to-any multimodal llm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.429401Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:0db3d4647be5ebe01f0bb3dc51e15f2d4328a694947f702f9688e8c064bbc8a4","observation_id":"a4b8daa1-7e9f-4be8-a68e-7a2be09186f1","resolution":{"observed_at":"2026-08-07T14:46:38.429401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:41.702029Z","title":"Multimodal large language models make text-to-image generative models align better.Advances in Neural Information Processing Systems, 37:81287–81323, 2024","venue":null,"work_id":"974dfb3a-678d-47ae-a725-079e8adb88ca","year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.504431Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:fee70e33ba389fa60380a39204bf8c076c2854d429d527afb7b893bc5ade80d1","observation_id":"150bdce3-bef3-4d05-8836-e2e2562762bf","resolution":{"observed_at":"2026-08-07T14:46:41.812068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-07T14:46:38.577390Z","title":"Vila-u: a unified foundation model integrating visual understanding and generation.arXiv preprint arXiv:2409.04429, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.577390Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:1184c42294d02dc915216559a44a28ba0b9fd39346c2ff5eb7448f09fe23f557","observation_id":"f7e366e3-c78a-4304-b641-8e4daf21fe8e","resolution":{"observed_at":"2026-08-07T14:46:38.577390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:38.672977Z","title":"Omnigen: Unified image generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.672977Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:1c00d55b3160c802eccee3a8bd93f8ff4ae13e3da25964d254d2f15e29584a17","observation_id":"92923d8f-0a4a-44d5-91a3-6886fe48aca4","resolution":{"observed_at":"2026-08-07T14:46:38.672977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-07T14:46:38.745637Z","title":"Show-o: One single trans- former to unify multimodal understanding and generation.arXiv preprint arXiv:2408.12528, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.745637Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:4ac0fe8a776ccbe7417c47e477421696c153dcdb5f332b8d3f69509538dcb1a7","observation_id":"e6e38987-118a-4238-a13a-c2ec7d61fce6","resolution":{"observed_at":"2026-08-07T14:46:38.745637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:41.375988Z","title":"Smartbrush: Text and shape guided object inpainting with diffusion model","venue":null,"work_id":"5334b16d-b84e-49f6-8b61-aa0b9d51662b","year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.819025Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:c649925aadfd9620921ae6e7c13541ce817ae83e3b08979686dd62ae83378bb7","observation_id":"d8119d7f-4d20-4d14-a2f9-776d8f273181","resolution":{"observed_at":"2026-08-07T14:46:41.547686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:38.878723Z","title":"A survey on video diffusion models.ACM Computing Surveys, 57(2):1–42, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.878723Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:59ce339c7a3b17ef7fd3c3488bc334ff60a79186226069a5dd26229b89c71717","observation_id":"0b3c697b-ac14-4018-9871-1329f287f494","resolution":{"observed_at":"2026-08-07T14:46:38.878723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:41.216473Z","title":"Progressive instance-aware feature learning for compositional action recognition.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(8):10317–10330, 2023","venue":null,"work_id":"d05d530d-b3d4-46c1-aaac-623d270b06a1","year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.971508Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:4612463e780b5a626de1badb09331c5133d912bebbb144824b9a3cc0c1797d46","observation_id":"0e16215f-03e4-4b49-b64e-f0983e3f2e6c","resolution":{"observed_at":"2026-08-07T14:46:41.306913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:40.966666Z","title":"Higcin: Hierarchical graph-based cross inference network for group activity recognition.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(6):6955–6968, 2020","venue":null,"work_id":"5e832827-6d07-44f2-bede-03105e95ba80","year":2020},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.976681Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:2595611b22d43631c0e41b954f0b7fe1335c5d388c59cea1d964848f470612c5","observation_id":"505c5eb0-70e6-448d-9fd8-011f92aaa11a","resolution":{"observed_at":"2026-08-07T14:46:41.071809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:40.672138Z","title":"Mmginpainting: Multi-modality guided image inpainting based on diffusion models.IEEE Transactions on Multimedia, 2024","venue":null,"work_id":"cdec06a6-7d30-4710-985a-8a61ace544cd","year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:38.980292Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:0d139767cc3b50af1bbd9749cce1de99a5d4a3a8e7fd0033089e51cab718ea61","observation_id":"03c58007-bb48-455c-a611-874a8cbf01c7","resolution":{"observed_at":"2026-08-07T14:46:40.826518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13601","last_updated":"2024-05-28T05:36:23Z","snapshot_observed_at":"2026-07-06T17:20:00.101661Z","submitted_at":"2024-01-24T17:10:45Z","title":"MM-LLMs: Recent Advances in MultiModal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13601","snapshot_observed_at":"2026-08-07T14:46:39.040135Z","title":"Mm- llms: Recent advances in multimodal large language models.arXiv preprint arXiv:2401.13601, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:39.040135Z"},"links":{"cited_paper":"/paper/2401.13601","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:cc73e0f7de7d7b9f54f684abc03b1ecb15c7f3cabf812e92de2e47a05f6eff6e","observation_id":"c5a12dd0-34ab-4ec3-b017-c0bec96a2688","resolution":{"observed_at":"2026-08-07T14:46:39.040135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:39.182063Z","title":"Magicbrush: A manually annotated dataset for instruction-guided image editing.Advances in Neural Information Processing Systems, 36:31428–31449, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:39.182063Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:7f6388cc6d089d789116afd8b51dba7c2faa4b7f11a36b8f64d8f099b04e174f","observation_id":"04e15a43-4534-4a46-aa4a-0ae9a0120d08","resolution":{"observed_at":"2026-08-07T14:46:39.182063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02826","last_updated":"2025-05-27T15:54:58Z","snapshot_observed_at":"2026-08-07T22:15:46.080591Z","submitted_at":"2025-04-03T17:59:56Z","title":"Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02826","snapshot_observed_at":"2026-08-07T14:46:39.293055Z","title":"Envisioning beyond the pixels: Benchmarking reasoning-informed visual editing.arXiv preprint arXiv:2504.02826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:39.293055Z"},"links":{"cited_paper":"/paper/2504.02826","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:2d2e41b3b0f8a8a0ae3022ea1883ec05dbb6175921c9d56513a4ba90b5fa6b28","observation_id":"744f85c0-e23a-432b-b543-091f43e88fd0","resolution":{"observed_at":"2026-08-07T14:46:39.293055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-07T14:46:39.426759Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model.arXiv preprint arXiv:2408.11039, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:39.426759Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:800048dd7b9270075f972757a04d19ad5926590895a952ba7fc9b785f6269293","observation_id":"e97933a5-dccf-44e7-b652-638c0c3e53c5","resolution":{"observed_at":"2026-08-07T14:46:39.426759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:40.326181Z","title":"Unpaired image-to-image translation using cycle-consistent adversarial networks","venue":null,"work_id":"9c61135f-2c9c-4159-aa46-e88e24f05c59","year":2017},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:39.554364Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:bb438e9a993e89dee66264decb2af7f84d5bc7186a926c5590be9a76f04142a7","observation_id":"a28de295-3447-4a9d-933b-e887f09de757","resolution":{"observed_at":"2026-08-07T14:46:40.499769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:40.101039Z","title":null,"venue":null,"work_id":"596fe0df-69f6-44b9-b819-4c515e3d4474","year":null},"citing_paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:39.681727Z"},"links":{"citing_paper":"/paper/2505.17768"},"observation_digest":"sha256:3855ebcc8720c32a26936706110f91a1016922efb69d680b21a99f707b7431aa","observation_id":"8c12e8ab-acc2-421e-b714-4bd3c6ea149b","resolution":{"observed_at":"2026-08-07T14:46:40.170631Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17768","last_updated":"2025-07-20T01:08:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:16:16.984171Z","submitted_at":"2025-05-23T11:41:26Z","title":"R-Genie: Reasoning-Guided Generative Image Editing"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 2 inbound Pith citation observations for arXiv:2505.17768."}