{"as_of":"2026-08-10T03:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4cdce197c2c3ed7ae5ae93570da96e0dc4cdbc6ea1536da834131419c9eb9a7a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:29:16.408545Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T12:59:52.750964Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2406.03520","last_updated":"2024-10-03T17:24:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T17:53:55Z","title":"VideoPhy: Evaluating Physical Commonsense for Video Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-20T11:34:37.599691Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2406.03520"},"observation_digest":"sha256:fd07bd9cb22a95f5410bc8922aee253a84eaae87d41893864629c83aedb54e05","observation_id":"a2c2b204-02f5-46ff-9b8f-feecd4f956e6","resolution":{"observed_at":"2026-05-20T11:34:37.805267Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-08T07:13:29.035650Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:ad622cc8cf02e8d8c2703f9848d2015bb3e3c8fd2816dedf2e1a51942e2f7315","observation_id":"e61fc56c-1aac-4393-9111-0fc58d5d9837","resolution":{"observed_at":"2026-05-23T08:02:43.325540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T14:36:41.467429Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2504.17761"},"observation_digest":"sha256:a0eb3d5aebc95527853ad2e169f4d144ae55f214b0a0bb00c8e5c930d1da877a","observation_id":"67f98038-984a-4cae-804d-c04f74b6cff3","resolution":{"observed_at":"2026-05-11T14:36:41.668122Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2504.20690","last_updated":"2025-09-23T02:34:36Z","snapshot_observed_at":"2026-08-05T06:11:45.068217Z","submitted_at":"2025-04-29T12:14:47Z","title":"In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T16:07:53.054355Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2504.20690"},"observation_digest":"sha256:624f645cabe8839aa4594d3f4004cdcc1e5e2146704868742267352c11d0141c","observation_id":"f3732ed8-7007-4827-86dc-cf4d00058154","resolution":{"observed_at":"2026-05-16T16:07:53.134117Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-08-07T14:29:16.408545Z","title":"Viescore: Towards explainable metrics for conditional image synthesis evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18730","last_updated":"2025-05-24T14:56:09Z","snapshot_observed_at":"2026-08-07T17:06:29.055596Z","submitted_at":"2025-05-24T14:56:09Z","title":"Align Beyond Prompts: Evaluating World Knowledge Alignment in Text-to-Image Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:16.408545Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2505.18730"},"observation_digest":"sha256:c5e47ce67244eb2e3b25937f0e69991a8dd669d79df247f881a13527b1186120","observation_id":"1e5abc39-9021-49d6-8b63-15ce95ed4fee","resolution":{"observed_at":"2026-08-07T14:29:16.408545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2505.20275","last_updated":"2025-05-26T17:53:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-26T17:53:33Z","title":"ImgEdit: A Unified Image Editing Dataset and Benchmark","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T18:17:45.123690Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2505.20275"},"observation_digest":"sha256:3f4ed53f62ee2611415de541d4db4a10fbe86a687d0aacfe09a6d166167918d8","observation_id":"9d4ebb82-c564-4ef3-968e-ea2e5158af25","resolution":{"observed_at":"2026-05-12T18:17:45.259977Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-08-07T12:48:52.532034Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23493","last_updated":"2025-05-29T14:43:46Z","snapshot_observed_at":"2026-08-07T20:36:09.670028Z","submitted_at":"2025-05-29T14:43:46Z","title":"R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:48:52.532034Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2505.23493"},"observation_digest":"sha256:a1a2edc9d52dcb5ae2d7da3cbb4ccea4ab8b18547b3681f14c6636a2751cd7d4","observation_id":"ad65a177-2452-4707-8dac-e53ac9c1a002","resolution":{"observed_at":"2026-08-07T12:48:52.532034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-08-07T10:17:46.739032Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10019","last_updated":"2025-06-06T11:09:46Z","snapshot_observed_at":"2026-08-08T16:55:23.964977Z","submitted_at":"2025-06-06T11:09:46Z","title":"A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations","version":1},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:46.739032Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2506.10019"},"observation_digest":"sha256:fc40dd00b8fd5af015b9bdcef3dbe904d282d24891184421422af340a5cdfedc","observation_id":"080b9fb2-f8da-4dbb-87e7-17dcb316a9b4","resolution":{"observed_at":"2026-08-07T10:17:46.739032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-08-07T00:43:14.231201Z","title":"Li, J., Li, H., Erfani, S., Feng, L., Bailey, J., and Liu, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.13827","last_updated":"2025-06-15T17:12:57Z","snapshot_observed_at":"2026-08-09T13:25:40.475672Z","submitted_at":"2025-06-15T17:12:57Z","title":"Balancing Preservation and Modification: A Region and Semantic Aware Metric for Instruction-Based Image Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:43:14.231201Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2506.13827"},"observation_digest":"sha256:db5ff8b03d59147014d481152000cfbe57f50d3d6e4f7ac691937ea123bdec34","observation_id":"b2226db6-c3d0-4fa5-80af-3cf959513b83","resolution":{"observed_at":"2026-08-07T00:43:14.231201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-08-06T21:03:01.313709Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01255","last_updated":"2025-07-02T00:20:06Z","snapshot_observed_at":"2026-08-08T11:19:06.223993Z","submitted_at":"2025-07-02T00:20:06Z","title":"AIGVE-MACS: Unified Multi-Aspect Commenting and Scoring Model for AI-Generated Video Evaluation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T21:03:01.313709Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2507.01255"},"observation_digest":"sha256:69831adcd1f8fc6cbcef68a23e9917f7f16a2e58a489cbb7a7e32fdf9c07dd3f","observation_id":"ef2fe87d-4d27-4650-80b5-8d47954eb964","resolution":{"observed_at":"2026-08-06T21:03:01.313709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-08-06T18:48:40.925409Z","title":"Viescore: Towards explainable metrics for conditional image synthesis evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07317","last_updated":"2025-07-28T17:21:56Z","snapshot_observed_at":"2026-08-09T23:43:22.969472Z","submitted_at":"2025-07-09T22:29:47Z","title":"ADIEE: Automatic Dataset Creation and Scorer for Instruction-Guided Image Editing Evaluation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:40.925409Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2507.07317"},"observation_digest":"sha256:4a252b8883c9ef32e20363013db5c5747c55c6ea12e6b75b5ce759f9aad83ebb","observation_id":"a3bd7ea0-470b-434b-9038-2b132119e827","resolution":{"observed_at":"2026-08-06T18:48:40.925409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-08-06T12:54:34.950914Z","title":"Viescore: Towards explainable metrics for conditional image synthesis evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21391","last_updated":"2025-07-30T04:49:38Z","snapshot_observed_at":"2026-08-09T18:53:55.200265Z","submitted_at":"2025-07-28T23:52:53Z","title":"Multimodal LLMs as Customized Reward Models for Text-to-Image Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T12:54:34.950914Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2507.21391"},"observation_digest":"sha256:1ebed96be937bbfbe83783f936e2ae7aa254fcaf75fc3721e51a5e54d73d92d0","observation_id":"4bf251e1-f89a-4031-8745-a2ac7ded0574","resolution":{"observed_at":"2026-08-06T12:54:34.950914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-08-02T19:14:07.671722Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03143","last_updated":"2026-06-28T07:21:56Z","snapshot_observed_at":"2026-08-07T08:56:16.763487Z","submitted_at":"2026-03-03T16:31:10Z","title":"Edit in 2D, Verify in 3D: Reinforcement Learning for Multi-view Consistent Scene Editing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T19:14:07.671722Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2603.03143"},"observation_digest":"sha256:a66cff411654bd07c85da05337ed1ba47ca47db18817b2aab2adcb8fa681afb6","observation_id":"17025fd9-d7d8-4042-afa8-5a8b61467602","resolution":{"observed_at":"2026-08-02T19:14:07.671722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2604.24625","last_updated":"2026-04-27T15:52:48Z","snapshot_observed_at":"2026-07-06T23:10:38.548416Z","submitted_at":"2026-04-27T15:52:48Z","title":"Meta-CoT: Enhancing Granularity and Generalization in Image Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T04:30:28.636915Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2604.24625"},"observation_digest":"sha256:0901388a0befa2dce349ba242bb48ad87bb9b592585289cfc0144d4f3264f736","observation_id":"d48f321e-3acf-45a1-943f-faf5e2b1b736","resolution":{"observed_at":"2026-05-11T21:41:19.200450Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2605.20278","last_updated":"2026-05-24T12:22:09Z","snapshot_observed_at":"2026-07-06T23:30:53.900592Z","submitted_at":"2026-05-19T04:39:28Z","title":"ClaimDiff-RL: Fine-Grained Caption Reinforcement Learning through Visual Claim Comparison","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T08:36:27.676888Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2605.20278"},"observation_digest":"sha256:33df610d8a042cf92d86dbe478f481a9225a9ca1ba10f2fae1b899fcd42084c6","observation_id":"70bc142b-cbb0-4b3b-946a-33184d4f70d9","resolution":{"observed_at":"2026-05-21T08:39:53.770233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2605.20278","last_updated":"2026-05-24T12:22:09Z","snapshot_observed_at":"2026-07-06T23:30:53.900592Z","submitted_at":"2026-05-19T04:39:28Z","title":"ClaimDiff-RL: Fine-Grained Caption Reinforcement Learning through Visual Claim Comparison","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T17:57:47.409741Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2605.20278"},"observation_digest":"sha256:4643de3581dfe9425c328099138ac6aa975b3de3836d9de7e40f1196c59d0267","observation_id":"1d5ead44-912d-415a-9ff1-b58cfc52d902","resolution":{"observed_at":"2026-06-30T18:04:58.344776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2606.01022","last_updated":"2026-05-31T05:25:14Z","snapshot_observed_at":"2026-07-06T23:41:39.172310Z","submitted_at":"2026-05-31T05:25:14Z","title":"ProductWebGen: Benchmarking Multimodal Product Webpage Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T17:26:44.297446Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2606.01022"},"observation_digest":"sha256:6f5fafcfecd2fe7808fa6cd8512dbdb8f354dd1cdc8861a2c28de3bba8299502","observation_id":"eef3ef19-e9b8-46ed-9519-061dc413ac1e","resolution":{"observed_at":"2026-07-01T21:06:14.716074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2606.01985","last_updated":"2026-06-01T09:46:10Z","snapshot_observed_at":"2026-08-05T13:43:57.622962Z","submitted_at":"2026-06-01T09:46:10Z","title":"MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T15:07:29.897089Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2606.01985"},"observation_digest":"sha256:9f6f3ac26aedd5c45c0b76dfaf288e27f9008e7a4eacbb38c12468156d9cb6ca","observation_id":"d1942f95-0450-444b-8a74-468e590a48e0","resolution":{"observed_at":"2026-07-01T22:46:18.517174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2606.26872","last_updated":"2026-06-26T15:03:59Z","snapshot_observed_at":"2026-08-02T19:28:00.118985Z","submitted_at":"2026-06-25T10:58:25Z","title":"SpatialFlow-GRPO: Where Spatial Credit Drives Image Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T05:37:23.569942Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2606.26872"},"observation_digest":"sha256:c0d160eac0b77c4bcef85a73fd13c24e347278b031dcefc20d4871778b7b5419","observation_id":"eaf774bd-b86d-43b4-ad0e-8fe17f5fe678","resolution":{"observed_at":"2026-07-04T12:59:52.752437Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation","version":2},"cited_work":{"arxiv_id":"2312.14867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14867","snapshot_observed_at":"2026-07-04T12:59:52.750964Z","title":"Ku, Dongfu Jiang, Cong Wei, Xiang Yue, and Wenhu Chen","venue":null,"work_id":"938da770-47a0-42c7-9360-ee368ef1de59","year":2024},"citing_paper":{"arxiv_id":"2606.26872","last_updated":"2026-06-26T15:03:59Z","snapshot_observed_at":"2026-08-02T19:28:00.118985Z","submitted_at":"2026-06-25T10:58:25Z","title":"SpatialFlow-GRPO: Where Spatial Credit Drives Image Editing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T05:03:56.872939Z"},"links":{"cited_paper":"/paper/2312.14867","citing_paper":"/paper/2606.26872"},"observation_digest":"sha256:da49e65bf8bd8ff5ccc43441d1215194fb0511bd00d9cb744b5cfadbca53e0f3","observation_id":"bd3aabfe-71db-4b69-8496-acb03859ecd1","resolution":{"observed_at":"2026-06-29T18:33:51.270522Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2312.14867/citation-record","integrity":"/paper/2312.14867/integrity","json":"/paper/2312.14867/citation-record.json","paper":"/paper/2312.14867"},"outbound":[],"paper":{"arxiv_id":"2312.14867","last_updated":"2024-06-03T16:59:20Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:45:19Z","title":"VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2312.14867."}