{"as_of":"2026-08-08T01:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9a3b61d62fe40febd680a51f58789d3f14b50c6da031ebdf25c8e1986bfcb2dd","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:40:37.973647Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09988/citation-record","integrity":"/paper/2506.09988/integrity","json":"/paper/2506.09988/citation-record.json","paper":"/paper/2506.09988"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.138334Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.138334Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:bdb63df7e3b17aa47ee0a1c049d5a550f078579ba68df237ea9c9cab8f51e49b","observation_id":"3e1d97b2-b715-41ce-b46e-e1d3816ba8ef","resolution":{"observed_at":"2026-08-07T04:40:36.138334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.188523Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.188523Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:555a1cf138f3249c98ba726e0e153855af125260efd72b34aec8b89d634bf8a5","observation_id":"7ee59052-602d-4fd3-ba39-3328bf584222","resolution":{"observed_at":"2026-08-07T04:40:36.188523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.236414Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.236414Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:1a8df043761ab04e82bf0e316ed0dd89baa4b38aec35292f229cce3b5d575d78","observation_id":"b859706a-0fe1-4ee7-9cd4-83f48d4fb185","resolution":{"observed_at":"2026-08-07T04:40:36.236414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T04:40:36.291478Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.291478Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:149ba9b22c68635f1813862c88b6086fa0e40ee3a792ad5fd95e5fab452bbfb7","observation_id":"8605bac7-b7d5-425b-a549-07ee6216f9ee","resolution":{"observed_at":"2026-08-07T04:40:36.291478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02426","last_updated":"2023-10-03T20:46:10Z","snapshot_observed_at":"2026-08-05T11:19:53.500641Z","submitted_at":"2023-10-03T20:46:10Z","title":"EditVal: Benchmarking Diffusion Based Text-Guided Image Editing Methods","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02426","snapshot_observed_at":"2026-08-07T04:40:36.344868Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.344868Z"},"links":{"cited_paper":"/paper/2310.02426","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:bfe3abd2802434808b8708295b3f21d66335d3329aa1111110768474728e432a","observation_id":"18134387-2862-434a-bc5f-db5aa6cce4ff","resolution":{"observed_at":"2026-08-07T04:40:36.344868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T04:40:36.403646Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.403646Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:38aeb3200ef04b3e97c80bbd670e2ceb226f9f8dc2c1c54a7335699f51c767ed","observation_id":"61af728a-1a10-497a-ac43-c29e965d6ebf","resolution":{"observed_at":"2026-08-07T04:40:36.403646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11427","last_updated":"2022-10-20T17:16:37Z","snapshot_observed_at":"2026-08-01T15:07:11.635426Z","submitted_at":"2022-10-20T17:16:37Z","title":"DiffEdit: Diffusion-based semantic image editing with mask guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11427","snapshot_observed_at":"2026-08-07T04:40:36.467826Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.467826Z"},"links":{"cited_paper":"/paper/2210.11427","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:2998838ba3562d3c2f7d77acefbf531e537b85c746ab2a2cc8f341b9e888a964","observation_id":"1d714b29-9e29-4713-aa31-b344666d58a2","resolution":{"observed_at":"2026-08-07T04:40:36.467826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11108","last_updated":"2023-10-16T04:04:12Z","snapshot_observed_at":"2026-07-06T15:05:42.338051Z","submitted_at":"2023-03-20T13:45:58Z","title":"CHATEDIT: Towards Multi-turn Interactive Facial Image Editing via Dialogue","version":3},"cited_work":{"arxiv_id":"2303.11108","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.11108","snapshot_observed_at":"2026-08-07T04:40:38.453517Z","title":"CHATEDIT: Towards Multi-turn Interactive Facial Image Editing via Dialogue","venue":"cs.CV","work_id":"625476ee-f50b-444b-a7e9-3587572a9bde","year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.536293Z"},"links":{"cited_paper":"/paper/2303.11108","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:0a3bf6d1cda59b61d10b37a8c1ef94ba3805694dce6758c31272bb51ef74e170","observation_id":"0c158b58-4969-4e0d-8e33-96d794525968","resolution":{"observed_at":"2026-08-07T04:40:38.559809Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.595306Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.595306Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:1a0feb59c093f3e8105520517c592bbc95a9ddb75363eaae6d9b276a6b03ab3f","observation_id":"db434464-43b8-4729-b958-d15bc22b3c0a","resolution":{"observed_at":"2026-08-07T04:40:36.595306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T04:40:36.651893Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.651893Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:5bd0ecade1f2417da20a8d7cafd50e26daf73c4fe68dcf3aafdd64deacd4cc2c","observation_id":"b509110a-9e1b-466d-93f7-26b72ed25f0c","resolution":{"observed_at":"2026-08-07T04:40:36.651893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T04:40:36.709289Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.709289Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:d6765430068d3565b8ed3ecb45c97ba6521c34a89da35394233f784aeed054f9","observation_id":"a3fe6ec4-4652-4e5c-9249-1546e6afa0c2","resolution":{"observed_at":"2026-08-07T04:40:36.709289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19334","last_updated":"2024-06-09T11:34:12Z","snapshot_observed_at":"2026-07-06T18:22:10.094519Z","submitted_at":"2024-05-29T17:59:20Z","title":"LLMs Meet Multimodal Generation and Editing: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19334","snapshot_observed_at":"2026-08-07T04:40:36.763160Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.763160Z"},"links":{"cited_paper":"/paper/2405.19334","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:d2bacdb377e2d35bde03968ece6c4d96b938925d052b3a7819dd6a7449be5c91","observation_id":"ed497e15-0553-4336-9518-bc04bf44e1e7","resolution":{"observed_at":"2026-08-07T04:40:36.763160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.848081Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.848081Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:0b1a9c88bcb8a42d3b5cdedb0ef520fe99881bf3cc5cf17ae59b3888ab99194c","observation_id":"12e1d00b-b839-4fa2-8e39-b9ba179c9d70","resolution":{"observed_at":"2026-08-07T04:40:36.848081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09276","last_updated":"2023-03-20T15:58:50Z","snapshot_observed_at":"2026-07-06T14:06:48.707061Z","submitted_at":"2022-10-17T17:27:32Z","title":"Imagic: Text-Based Real Image Editing with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09276","snapshot_observed_at":"2026-08-07T04:40:36.916051Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.916051Z"},"links":{"cited_paper":"/paper/2210.09276","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:dc364a16a1cca4f8fe8439b85956105eb7776d4b0b9537f69d1a6c2a209b46fe","observation_id":"18dbf3cc-2448-4ba1-aa82-5ad5ff4972cb","resolution":{"observed_at":"2026-08-07T04:40:36.916051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-07T04:40:36.984061Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.984061Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:1ac4cb5baaf44f758d4139c64c1c8a52e62b75af438b2c46a622be36ab6273d5","observation_id":"6ce3690c-5f3c-41bd-be9b-49485eee1a10","resolution":{"observed_at":"2026-08-07T04:40:36.984061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-07T04:40:37.049491Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.049491Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:bf2fc6154d7f485229aebd9c85e75fe0c3d68a36649118fce61c9c84b43493e6","observation_id":"49d65a61-4785-48ec-99e5-413ef9f311ee","resolution":{"observed_at":"2026-08-07T04:40:37.049491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:40:37.103379Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.103379Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:702eefd26ca1c4914c18ea043593ca588266372cd3d1da1f5d53250b0cc48e18","observation_id":"02a726b7-26d4-4d5c-a3e9-9a4f192ed3b2","resolution":{"observed_at":"2026-08-07T04:40:37.103379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T04:40:37.179139Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.179139Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:01d2f3c5a669d73395c426fdcb9c7bea28b46d26537972e119f55dcc71c33862","observation_id":"94f3a194-f9b3-42a6-80f1-6f5b6fb672e3","resolution":{"observed_at":"2026-08-07T04:40:37.179139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10089","last_updated":"2023-11-16T18:55:58Z","snapshot_observed_at":"2026-08-07T16:25:59.525118Z","submitted_at":"2023-11-16T18:55:58Z","title":"Emu Edit: Precise Image Editing via Recognition and Generation Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10089","snapshot_observed_at":"2026-08-07T04:40:37.247150Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.247150Z"},"links":{"cited_paper":"/paper/2311.10089","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:02c7da4eeb8bb2ef3425c91fef5680c2581f361b179815c54531494f8b804439","observation_id":"92eabd86-680a-4131-a34f-7eeb66e23142","resolution":{"observed_at":"2026-08-07T04:40:37.247150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06909","last_updated":"2023-04-12T22:42:08Z","snapshot_observed_at":"2026-07-06T14:30:16.328946Z","submitted_at":"2022-12-13T21:25:11Z","title":"Imagen Editor and EditBench: Advancing and Evaluating Text-Guided Image Inpainting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06909","snapshot_observed_at":"2026-08-07T04:40:37.308816Z","title":"Fleet, Radu Soricut, Jason Baldridge, Mohammad Norouzi, Peter Anderson, and William Chan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.308816Z"},"links":{"cited_paper":"/paper/2212.06909","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:b1f2dae74c315963a11ce8db9ec13ffb13a7fa0ab71acc3e7083284e10a18b36","observation_id":"2c511d84-b11d-49e7-8b24-1ea421f7825a","resolution":{"observed_at":"2026-08-07T04:40:37.308816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-07-06T15:00:13.368355Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-07T04:40:37.395334Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.395334Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:c93f41536b1edc633b8f5998c5017d38f4917457482e6cc0dfadf01793919b52","observation_id":"ac025846-1e27-466b-9ecf-9450d9575b00","resolution":{"observed_at":"2026-08-07T04:40:37.395334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16090","last_updated":"2023-11-27T18:56:37Z","snapshot_observed_at":"2026-08-02T13:23:26.517255Z","submitted_at":"2023-11-27T18:56:37Z","title":"Self-correcting LLM-controlled Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16090","snapshot_observed_at":"2026-08-07T04:40:37.479013Z","title":"Gonzalez, Boyi Li, and Trevor Darrell","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.479013Z"},"links":{"cited_paper":"/paper/2311.16090","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:e14c4697932226651623a8875a17896de683bbab736e20bc9f84563fc602efa1","observation_id":"3d37046c-bd9e-4ee1-8e95-c36fa7696a76","resolution":{"observed_at":"2026-08-07T04:40:37.479013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10012","last_updated":"2024-05-15T18:20:28Z","snapshot_observed_at":"2026-07-06T15:43:35.260552Z","submitted_at":"2023-06-16T17:58:58Z","title":"MagicBrush: A Manually Annotated Dataset for Instruction-Guided Image Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10012","snapshot_observed_at":"2026-08-07T04:40:37.578576Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.578576Z"},"links":{"cited_paper":"/paper/2306.10012","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:6c17304419f29e83e724e011cd968c50be2343940643f77791233f3ec872115a","observation_id":"8d5fdc72-a2a8-490f-b404-e83618a986cf","resolution":{"observed_at":"2026-08-07T04:40:37.578576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09618","last_updated":"2024-03-26T22:59:52Z","snapshot_observed_at":"2026-08-06T19:34:05.074079Z","submitted_at":"2023-03-16T19:47:41Z","title":"HIVE: Harnessing Human Feedback for Instructional Visual Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09618","snapshot_observed_at":"2026-08-07T04:40:37.653444Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.653444Z"},"links":{"cited_paper":"/paper/2303.09618","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:b97c5a3e55ed58d83330c24946c479b66145b12966b7dee0345edcdf4b454f96","observation_id":"aba2c807-275f-48eb-bf96-55131e044f21","resolution":{"observed_at":"2026-08-07T04:40:37.653444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04489","last_updated":"2025-03-30T23:04:15Z","snapshot_observed_at":"2026-07-06T14:28:29.365366Z","submitted_at":"2022-12-08T18:57:13Z","title":"SINE: SINgle Image Editing with Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04489","snapshot_observed_at":"2026-08-07T04:40:37.770784Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.770784Z"},"links":{"cited_paper":"/paper/2212.04489","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:3f5aebcc8bfed8301136074bab6bd910a9ca23f75e12de4213ee028145b84744","observation_id":"35fa1e13-2d5d-4c4c-babb-ae89ee9a4942","resolution":{"observed_at":"2026-08-07T04:40:37.770784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05282","last_updated":"2024-12-19T04:42:41Z","snapshot_observed_at":"2026-07-06T18:42:30.828375Z","submitted_at":"2024-07-07T06:50:22Z","title":"UltraEdit: Instruction-based Fine-Grained Image Editing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05282","snapshot_observed_at":"2026-08-07T04:40:37.858619Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.858619Z"},"links":{"cited_paper":"/paper/2407.05282","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:b59541634e7f3bd90f801cfd806338bb8fb56a0f91532e98d50ed62dab245c35","observation_id":"31feec64-0e31-4abc-a55f-6b00ca7b7300","resolution":{"observed_at":"2026-08-07T04:40:37.858619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:38.802695Z","title":"a henb \\","venue":null,"work_id":"b1ac3d17-4046-40a6-9743-e40884c5d534","year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.945790Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:929d4c24b3e2d19877f7646a873a698400473a871389bdee6fb02903c70f49ef","observation_id":"61301723-de03-42fd-8292-dd9e63b18e53","resolution":{"observed_at":"2026-08-07T04:40:38.879853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-07T04:40:37.973647Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.973647Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:23ce2e3b33a77d41648a5c4e6889c43cb2ffab53be177641e04f376f46dfcf82","observation_id":"34043248-d0ab-47ce-a149-911caeab7419","resolution":{"observed_at":"2026-08-07T04:40:37.973647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:29:28.003632Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2506.09988."}