{"as_of":"2026-08-08T02:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:28102f8cae2c6487e3c2706d302bc0c473e95ab129aaa44f692f9047fc4d095c","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:48:55.145079Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T19:51:45.257204Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07045","snapshot_observed_at":"2026-07-13T19:51:45.257204Z","title":"Interpretable and reliable detection of ai-generated images via grounded rea- soning in mllms.arXiv preprint arXiv:2506.07045, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.23115","last_updated":"2026-07-03T11:05:22Z","snapshot_observed_at":"2026-08-05T11:59:18.464008Z","submitted_at":"2026-03-24T12:10:21Z","title":"AgentFoX: LLM Agent-Guided Fusion with eXplainability for AI-Generated Image Detection","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T19:51:45.257204Z"},"links":{"cited_paper":"/paper/2506.07045","citing_paper":"/paper/2603.23115"},"observation_digest":"sha256:b2cfbd37665d00052aafe4489198ba88bfb9f84e9dbf2046cea736ede8f9dd12","observation_id":"58107120-92a3-49ae-9527-a2a7309da508","resolution":{"observed_at":"2026-07-13T19:51:45.257204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07045","snapshot_observed_at":"2026-07-12T01:35:43.979206Z","title":"Interpretable and reliable detection of ai-generated images via grounded reasoning in mllms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03562","last_updated":"2026-07-03T18:52:42Z","snapshot_observed_at":"2026-08-07T06:14:13.409347Z","submitted_at":"2026-07-03T18:52:42Z","title":"XPlainVerse: A Million-Scale Benchmark for Explainable Deepfake Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T01:35:43.979206Z"},"links":{"cited_paper":"/paper/2506.07045","citing_paper":"/paper/2607.03562"},"observation_digest":"sha256:4df6589bbf1d9de293c5b3a0b7f67ab42d710738c5b64800e8fd7c4f18cfc860","observation_id":"a3c20b4e-4204-443f-9e34-d6ec153f28b3","resolution":{"observed_at":"2026-07-12T01:35:43.979206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07045/citation-record","integrity":"/paper/2506.07045/integrity","json":"/paper/2506.07045/citation-record.json","paper":"/paper/2506.07045"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:49:01.071700Z","title":null,"venue":null,"work_id":"b22d6146-b6b6-4ec5-a9e3-7737dbd3000b","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:46.896334Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:3ee97b6ff0d8a8c7b3684cb1ee2b610aad6c11d8478f08f9de9c5466717640f2","observation_id":"0e7f8d76-f94f-4b44-a366-0d0f1e6f9a30","resolution":{"observed_at":"2026-08-07T05:49:01.237310Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:49:00.822458Z","title":"Large scale gan training for high fidelity natural image synthesis","venue":null,"work_id":"5c796c73-7947-482a-92c7-d7667fd97f46","year":2018},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:46.976297Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:78698c6a6dd7bab6e67136df798f007273c0b734b53183a55e4b90bcaf4fc015","observation_id":"803ed133-5c58-4336-8a44-e4218c5fc407","resolution":{"observed_at":"2026-08-07T05:49:00.923211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.082915Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.082915Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7d3661513fbe5874e8ffed45b943adf6abeb23d759ada4b513a826e1251e91a1","observation_id":"4501467c-2486-4752-84fd-d6f2756acb2c","resolution":{"observed_at":"2026-08-07T05:48:47.082915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17419","last_updated":"2024-08-21T07:42:02Z","snapshot_observed_at":"2026-08-07T20:34:56.788333Z","submitted_at":"2023-10-26T14:23:45Z","title":"AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17419","snapshot_observed_at":"2026-08-07T05:48:47.230080Z","title":"Antifakeprompt: Prompt-tuned vision-language models are fake image detectors.arXiv preprint arXiv:2310.17419, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.230080Z"},"links":{"cited_paper":"/paper/2310.17419","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:91ab6bea5e05a016395ab3daf48d2305d73556238157d62c2338274d1e67b148","observation_id":"3ac597b2-829e-4ef9-8e22-aced466b0b71","resolution":{"observed_at":"2026-08-07T05:48:47.230080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.309056Z","title":"Pixart- σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.309056Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:dd2488c17902632b83519bfcf3f8acbbe17220110ab27b437a4fd3a9a710cbb5","observation_id":"db06f4aa-8502-47bb-bccb-3ebffdae7e1d","resolution":{"observed_at":"2026-08-07T05:48:47.309056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05252","last_updated":"2024-01-10T16:27:38Z","snapshot_observed_at":"2026-08-07T04:04:46.527670Z","submitted_at":"2024-01-10T16:27:38Z","title":"PIXART-{\\delta}: Fast and Controllable Image Generation with Latent Consistency Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05252","snapshot_observed_at":"2026-08-07T05:48:47.478787Z","title":"Pixart- δ: Fast and controllable image generation with latent consistency models.arXiv preprint arXiv:2401.05252, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.478787Z"},"links":{"cited_paper":"/paper/2401.05252","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:068c318379a21a5239cfaca7ebedd7eddd6f3d89e7d581208a34b8495ca797eb","observation_id":"7176906a-fefb-496f-9ea7-56624645777b","resolution":{"observed_at":"2026-08-07T05:48:47.478787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-07T05:48:47.617304Z","title":"Pixart- α: Fast training of diffusion transformer for photorealistic text-to-image synthesis.arXiv preprint arXiv:2310.00426, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.617304Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:ae7e429e1f2ff1af757dfa8cff3fdb6308cc62ff4d790197be06a9b930151780","observation_id":"95014658-ac33-4506-81cf-a8d27fed04e4","resolution":{"observed_at":"2026-08-07T05:48:47.617304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.708166Z","title":"R1-v: Reinforcing super generaliza- tion ability in vision-language models with less than $3.https://github.com/Deep-Agent/ R1-V, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.708166Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7aa9ce30afca12054992e3d178516480ec7e14f9d22e3efc012850eb2ba02755","observation_id":"d4efb5d2-1349-4dee-8bcb-eae3e34bd7bb","resolution":{"observed_at":"2026-08-07T05:48:47.708166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.823145Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.823145Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:309089aeb15f9b0f29de608c1d2e4804be30cc6589eb1c37bb15264347e0e7a6","observation_id":"95898ec4-0fc4-433d-9510-367969ddd549","resolution":{"observed_at":"2026-08-07T05:48:47.823145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.965152Z","title":"On the detection of synthetic images generated by diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.965152Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:ff188921322b3077467fe1d486d3ba8b9d810a31797ab92b3bbce03eaf63f1db","observation_id":"f1e7c8f3-2bb6-4ed3-84f8-a8b4e4684b7c","resolution":{"observed_at":"2026-08-07T05:48:47.965152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:48.112032Z","title":"Li, and Li Fei-Fei","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.112032Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:6ad4183f3c0d659bb630bdf7315a8a8033c7cce584cc06791389f62e6dc11091","observation_id":"8fda4d6e-c16c-42f2-99a3-19ef0403c29d","resolution":{"observed_at":"2026-08-07T05:48:48.112032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:49:00.480276Z","title":"Witherden","venue":null,"work_id":"76f6364b-7584-4724-9060-efd8964bece6","year":2020},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.191309Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:82950347179bc3664137d7e8c9c8a5e1f8563269ee433fc0c95bdbfc9ae45b5e","observation_id":"39713f27-1e7a-4841-83ad-08f4a3c2e7dd","resolution":{"observed_at":"2026-08-07T05:49:00.592051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:48.307060Z","title":"Scaling rectified flow transformers for high-resolution image synthesis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.307060Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b79c01fa3f14eedb3d03fba216dcf0d6aa299b3b3a2458aec7ceafb48b616561","observation_id":"ae43a7da-127d-48e9-a3ab-9f95a0978857","resolution":{"observed_at":"2026-08-07T05:48:48.307060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:49:00.222794Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"c8011073-424b-4b33-9f7d-b9e984a60bee","year":2021},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.425709Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:34f7ed1266893265a7219841c3b5e961abd5b9276379a4e5fd524f8f998beacb","observation_id":"e38691b6-2ff7-4c8a-8a32-70639c23e7ab","resolution":{"observed_at":"2026-08-07T05:49:00.341701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:48.576729Z","title":"Leveraging frequency analysis for deep fake image recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.576729Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:dbc20f9951d2003db36230f77dcc5a7ccc73bfb777204c6e53f85a0695d9275f","observation_id":"0d0e1d5f-32ed-498b-b680-09cbeb5cfaee","resolution":{"observed_at":"2026-08-07T05:48:48.576729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:59.912553Z","title":null,"venue":null,"work_id":"88288739-3cfd-472e-b334-ca5489742b38","year":2014},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.666386Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:1c2e61c1a267479e0121b942454cf585ec7a120f7ae6b7bc7519e67a4326090f","observation_id":"b4a016f9-8ab7-43d4-b2a1-5199f50c0867","resolution":{"observed_at":"2026-08-07T05:49:00.038427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17608","last_updated":"2024-03-28T15:24:16Z","snapshot_observed_at":"2026-08-07T20:37:57.699159Z","submitted_at":"2024-03-26T11:39:00Z","title":"Fake or JPEG? Revealing Common Biases in Generated Image Detection Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17608","snapshot_observed_at":"2026-08-07T05:48:48.823747Z","title":"Fake or jpeg? revealing common biases in generated image detection datasets.ArXiv, abs/2403.17608, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.823747Z"},"links":{"cited_paper":"/paper/2403.17608","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7898d85c8310c4abc7771c16feabaa286e107dfb10f11aaf543c8ad4692a8ae2","observation_id":"c627ae84-6a6d-4690-a634-6068160aae11","resolution":{"observed_at":"2026-08-07T05:48:48.823747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:59.624252Z","title":"Vector quantized diffusion model for text-to-image synthesis","venue":null,"work_id":"0f8a4309-28d7-4dfc-b2b9-85a139040f07","year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.939780Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:4514698add879d93824ca0449018da2efea3602e8e37a401f588a19834fc581b","observation_id":"c5733705-d799-4d65-94d4-5917ff8b4c85","resolution":{"observed_at":"2026-08-07T05:48:59.744518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T05:48:49.090609Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.090609Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:6d396cc9fe1f083ae37064a52b0b137d10efaba9b398c074b93f3473a407551d","observation_id":"772af3bd-20b0-4bc5-9b4e-17ffa5d60199","resolution":{"observed_at":"2026-08-07T05:48:49.090609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-07T20:34:58.400387Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-07T05:48:49.163590Z","title":"Infinity: Scaling bitwise autoregressive modeling for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.163590Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:574f54589a0803e1de93aa2fc5e23d069ab889935ce57cffed431ae31dbd17ac","observation_id":"b9dd8cd8-0564-4a0f-a727-4bedf20e389b","resolution":{"observed_at":"2026-08-07T05:48:49.163590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-07-06T09:30:47.469703Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-07T05:48:49.310253Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.310253Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:8e7f657ae0e7c6e2ac778b9f755e3b235d687ef9e34a8472d7bd0419cbb14377","observation_id":"3331b2a9-7ba8-484e-aa06-82f4db5dc329","resolution":{"observed_at":"2026-08-07T05:48:49.310253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T05:48:49.400643Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models.arXiv preprint arXiv:2503.06749, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.400643Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b618890921e45f473443d0800ba23376e863bbd54b47172f4832658359ff8986","observation_id":"48441d9a-76fc-44e2-a92a-af8794007c85","resolution":{"observed_at":"2026-08-07T05:48:49.400643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T05:48:49.500083Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.500083Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:e689cc83048eed69c8a7559ebaa610c7ddb5abf69343940d66fab68e3fdc8c3f","observation_id":"8746c636-0c81-4f9d-a86c-4920d717200c","resolution":{"observed_at":"2026-08-07T05:48:49.500083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00703","last_updated":"2025-07-01T11:46:57Z","snapshot_observed_at":"2026-08-07T20:35:00.460457Z","submitted_at":"2025-05-01T17:59:46Z","title":"T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00703","snapshot_observed_at":"2026-08-07T05:48:49.635302Z","title":"T2i-r1: Reinforcing image generation with collaborative semantic-level and token-level cot.arXiv preprint arXiv:2505.00703, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.635302Z"},"links":{"cited_paper":"/paper/2505.00703","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b0266334dcf825d4f50cd2232723bf518326d9cab3e28d6efefd639f3477c0b3","observation_id":"f8cfe678-9952-47c6-8012-f97e01aa4c3f","resolution":{"observed_at":"2026-08-07T05:48:49.635302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:59.328318Z","title":"A style-based generator architecture for generative adversarial networks.2019 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 4396–4405, 2018","venue":null,"work_id":"17e0dcbd-3be9-4672-bd47-f723f27e4154","year":2019},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.780433Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7445ac40048e5babc7a65b2203ad8a410c8041eb78471be22a2d0be59591329f","observation_id":"2c20a2d8-01bc-4ab9-86a4-ea0b8fc6d9ee","resolution":{"observed_at":"2026-08-07T05:48:59.482972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:49.885343Z","title":"Flux.https://github.com/black-forest-labs/flux, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.885343Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:cf01bada7025018c743ed8e37723a7dc4346eb2e005d5c10ca2bb840b47948f9","observation_id":"7d6f2faa-3b59-4dfc-808a-3e105841c2b3","resolution":{"observed_at":"2026-08-07T05:48:49.885343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13306","last_updated":"2024-09-08T12:07:52Z","snapshot_observed_at":"2026-08-07T20:34:56.945035Z","submitted_at":"2024-04-20T07:28:55Z","title":"FakeBench: Probing Explainable Fake Image Detection via Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13306","snapshot_observed_at":"2026-08-07T05:48:50.004906Z","title":"Fakebench: Uncover the achilles’ heels of fake images with large multimodal models.ArXiv, abs/2404.13306, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.004906Z"},"links":{"cited_paper":"/paper/2404.13306","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:bf5e279692a1bbb4be4595bd115382de9d06c12d51967b1ccd64a97c48cd7b04","observation_id":"581d1329-37cd-4107-8be0-da8572df8ebf","resolution":{"observed_at":"2026-08-07T05:48:50.004906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:58.971554Z","title":null,"venue":null,"work_id":"1070aaec-a6b2-4358-a1fb-a43252a9138a","year":2020},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.144099Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b5e2048d321d930b099c6a99eede97031719d3521f0f81802ab1f81b69e04de6","observation_id":"fe6721fe-3541-4b89-b4cd-deacd7399960","resolution":{"observed_at":"2026-08-07T05:48:59.146228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:58.678798Z","title":null,"venue":null,"work_id":"885ea03d-5d11-4ba1-a00d-77b36048137c","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.230279Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:412f04225accd44bebdc6ce53217c673e8e3f4ed9a6d0233d2d9e2b91170d1bc","observation_id":"c28363fa-ba59-4d2b-8d3c-a040c7f15fc3","resolution":{"observed_at":"2026-08-07T05:48:58.817762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:58.402758Z","title":"Midjourney, 2023","venue":null,"work_id":"48a6b894-f27e-4530-a04f-dd7cda0bed98","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.337405Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:278955a6de1c9c8b93f768fdb3414382d10bb101bac2e5a39ffce62a040d6473","observation_id":"cb7e5213-8ff5-4313-9378-fdbe5e3da131","resolution":{"observed_at":"2026-08-07T05:48:58.490226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-07T05:48:50.449342Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.449342Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:f3409eaf569a5b03a62aca92feb93bb09eaae9935048ddccc5778d247e24b95e","observation_id":"11a71384-23b1-4a1c-8cc7-25c3ce55430c","resolution":{"observed_at":"2026-08-07T05:48:50.449342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:58.128270Z","title":"Towards universal fake image detectors that generalize across generative models.2023 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 24480–24489, 2023","venue":null,"work_id":"01a660f1-fc61-4986-a551-81e873ef6e64","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.585700Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:189a61f692ae080b5ac84e8e4693779234789e2d58cdc928f334e7b03db7af5d","observation_id":"6d49cb2a-fd81-4305-a838-a30531a11118","resolution":{"observed_at":"2026-08-07T05:48:58.279120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:57.929531Z","title":"Dall·e 3 system card, 2023","venue":null,"work_id":"cd9fd00c-9af3-4967-85e1-28bfeeeb5a52","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.690226Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:afa7d3081b022967d7cc7e5cf65a8eeb6d31a28b68abffb935fe63745650ae49","observation_id":"70fd46fc-2543-4fe2-b18a-c314c456dd73","resolution":{"observed_at":"2026-08-07T05:48:58.014290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:57.662571Z","title":"Introducing 4o image generation, Mar 2025","venue":null,"work_id":"d41b423f-005d-4848-b108-0bf958a09135","year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.819887Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:8f112ff46fa555bf76c4bf91e6c89510d6484d9062b0596b3f3a8acffff9667f","observation_id":"6244c030-da6a-4d4c-83b2-81c53d7c81f3","resolution":{"observed_at":"2026-08-07T05:48:57.840329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:50.955102Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.955102Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:6e0e28bbc1bb807ecef2c42029cfaa876bee7d76566c51aff013a6b602304fed","observation_id":"8f5a04ac-0987-46c5-80d8-e87cd012a2e5","resolution":{"observed_at":"2026-08-07T05:48:50.955102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-07T20:37:56.716831Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-07T05:48:51.106955Z","title":"Medvlm-r1: Incentivizing medical reasoning capability of vision-language models (vlms) via reinforcement learning.arXiv preprint arXiv:2502.19634, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.106955Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:3b916eb2f42727e7a19392f7999c88ddf61c37961a9979b24fa4003094cfeacc","observation_id":"04b3b00c-b072-4a79-9734-767ad16a5a2c","resolution":{"observed_at":"2026-08-07T05:48:51.106955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:57.447290Z","title":"Community forensics: Using thousands of generators to train fake image detectors, 2024","venue":null,"work_id":"6b6b45c7-a275-4822-adca-65635f48c5b0","year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.249174Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:048518dc3735f953b407e41fd3c65efae6cda72f4631a67228aa920e7ae58309","observation_id":"41ab725f-d6d2-4d24-bdf7-07f5f05ca2f1","resolution":{"observed_at":"2026-08-07T05:48:57.547665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:51.373781Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.373781Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:76f8c3ef4ac9a995c24e14780665a91fc16282bc39df3d11605a58e0db11517e","observation_id":"0567dd4b-b0e8-429a-b921-f4c965670d52","resolution":{"observed_at":"2026-08-07T05:48:51.373781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T05:48:51.514329Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl.arXiv preprint arXiv:2503.07536, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.514329Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:c175cff034634a132ba69605a02e7974aab4df1803c569916b29d9a084fd0e65","observation_id":"ea4d3ae2-260f-47cd-a298-c91581a5d099","resolution":{"observed_at":"2026-08-07T05:48:51.514329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:51.636135Z","title":"Qwen2.5-vl, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.636135Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:66a064daa217292e30db75145ee91dc5994bd42cacec866679f001ab5c8dcb68","observation_id":"036a4fa0-38bc-4bcd-a2e1-03361296afbc","resolution":{"observed_at":"2026-08-07T05:48:51.636135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T05:48:51.752372Z","title":"Hierarchical text-conditional image generation with clip latents.arXiv preprint arXiv:2204.06125, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.752372Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:356afe58f0a55d18b6f7340bdd16ff63f3f779263633ce4b903c12629e225ddd","observation_id":"3bee05a3-5f7a-4c42-a890-a080ce2b6ce4","resolution":{"observed_at":"2026-08-07T05:48:51.752372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:57.147256Z","title":"Rapidata openai 4o preference, Mar 2025","venue":null,"work_id":"f580302d-3287-42f2-98be-709fa9768fc7","year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.867586Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:a9b378ef566c488a7fae770a45a1eba67d2e2a3f31ed970ec0b5b06f8a3fcfe8","observation_id":"5a4cfdbc-4fa5-4024-8de3-304dc0f17d93","resolution":{"observed_at":"2026-08-07T05:48:57.262378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.911277Z","title":null,"venue":null,"work_id":"7bae343b-78d2-4e23-ba85-4ecbb7e80105","year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.996273Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:4582da8cdf8cfa9dd868bb48f3b9a8f64beb99ba2a521fd241d325df0aa536c1","observation_id":"9069a64d-d0b9-422c-8785-73cfac203fcb","resolution":{"observed_at":"2026-08-07T05:48:57.019915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:52.246543Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.246543Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:887bdf9a4ff51dcdb4cd7904906c943177688c4eed57c02732278451404567d5","observation_id":"8e3322b7-803e-4288-87c0-52a0c6746e25","resolution":{"observed_at":"2026-08-07T05:48:52.246543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.637876Z","title":"FaceForensics++: Learning to detect manipulated facial images","venue":null,"work_id":"dd514773-5339-42b4-b4a6-b4e899719dc5","year":2019},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.364865Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7dd577b90bc65a91484ce28135eecc103e4f2e38cbd07e1f9221888c8e8f1ad4","observation_id":"b42a3a56-990c-49bd-96c5-c26fab66c890","resolution":{"observed_at":"2026-08-07T05:48:56.739978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:52.519229Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advances in Neural Information Processing Systems, 35:36479–36494, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.519229Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:f9d03e890b138014c6ef7cf70826de8d3c13cb472487cfcbf9f3b2ab2e22d9a0","observation_id":"b4bdfadc-0be5-48c3-a2b4-d9ffefec4e29","resolution":{"observed_at":"2026-08-07T05:48:52.519229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.418426Z","title":"Selvaraju, Michael Cogswell, Abhishek Das, Ramakrishna Vedantam, Devi Parikh, and Dhruv Batra","venue":null,"work_id":"b0a4fde7-dc6b-4258-ab16-3c631c557ce8","year":2017},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.635706Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:0eb5025a7dfd6322702db73c8e1c68f3fc7712b88a6f4ae1827aa78688575ace","observation_id":"50934704-7f11-4a33-a645-7069c477362b","resolution":{"observed_at":"2026-08-07T05:48:56.529751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T05:48:52.739165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.739165Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:74929d038dfe334694b5d9968a6698dac075a7e736b6789083d5be3a377472ae","observation_id":"ef605562-9d20-4cea-adc2-958f60edb5f4","resolution":{"observed_at":"2026-08-07T05:48:52.739165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-07T05:48:52.835129Z","title":"Vlm-r1: A stable and generalizable r1-style large vision-language model.arXiv preprint arXiv:2504.07615, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.835129Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:eca522e8c55ae74c7bb7f911d57bbd91837dc9f11d464bcc40f0aed3bfcbd24b","observation_id":"7f41f5c8-a783-4870-a1a8-35f6ea756aff","resolution":{"observed_at":"2026-08-07T05:48:52.835129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6034","last_updated":"2014-04-19T11:54:52Z","snapshot_observed_at":"2026-07-06T03:31:30.452356Z","submitted_at":"2013-12-20T16:45:54Z","title":"Deep Inside Convolutional Networks: Visualising Image Classification Models and Saliency Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6034","snapshot_observed_at":"2026-08-07T05:48:52.935967Z","title":"Deep inside convolutional networks: Visualising image classification models and saliency maps.CoRR, abs/1312.6034, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.935967Z"},"links":{"cited_paper":"/paper/1312.6034","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b34293721a73e864e54e085b7689d825a399319bfe2faeee965323b3d956e263","observation_id":"3fdfd517-3cf0-4e12-98c9-dd7271710d31","resolution":{"observed_at":"2026-08-07T05:48:52.935967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T05:48:53.041425Z","title":"Denoising diffusion implicit models.ArXiv, abs/2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.041425Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:231ff6e0630a026f097441e88070556c2e0f25c2a654bdbb904b7225c6ede1ac","observation_id":"f02bd0a1-16bb-487d-b07c-803ca65569e4","resolution":{"observed_at":"2026-08-07T05:48:53.041425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T05:48:53.184151Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation.arXiv preprint arXiv:2406.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.184151Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:5221cff70c8e70dd2d047496af295b335cbd76891616674cf4498bfbaf8ec245","observation_id":"cf0e2900-bde2-45ff-ba06-6eb85915a682","resolution":{"observed_at":"2026-08-07T05:48:53.184151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.249874Z","title":"Axiomatic attribution for deep networks","venue":null,"work_id":"d70c0186-b9a1-4f1b-90f4-a8629e0e35b0","year":2017},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.324987Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:d1be6ae3984532183a3accf9905c635d654d95a79b50dd404b7f5b45f2fd600a","observation_id":"35060b25-8ffb-42d1-a720-756a33f7dab4","resolution":{"observed_at":"2026-08-07T05:48:56.308422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11946","last_updated":"2020-09-11T05:08:01Z","snapshot_observed_at":"2026-08-06T22:36:56.473526Z","submitted_at":"2019-05-28T17:05:32Z","title":"EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.11946","snapshot_observed_at":"2026-08-07T05:48:53.454345Z","title":null,"venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.454345Z"},"links":{"cited_paper":"/paper/1905.11946","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:58edf691481ac463bea1a915f21a190bad35f2372a00ba10ec342f354a777c2f","observation_id":"8a093ee3-ee65-4fdf-8528-ce90f5a08efe","resolution":{"observed_at":"2026-08-07T05:48:53.454345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.088369Z","title":"Galip: Generative adversarial clips for text-to-image synthesis","venue":null,"work_id":"ac28f6af-faac-42f4-9525-350d2225e7a9","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.588159Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:4efa49bc6d505634df38b16295160a24cc84246c561abfa052e90c7514c99af7","observation_id":"cb0e83bd-2e69-4a4b-8dc3-4db9c942bfc2","resolution":{"observed_at":"2026-08-07T05:48:56.142569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:53.682291Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction.Advances in neural information processing systems, 37:84839–84865, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.682291Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:270acca56cdfce500dc7e417d18e36973017529a60863c5c38e3a4a729f50665","observation_id":"27ab6bfe-108a-474e-af38-98c75799394e","resolution":{"observed_at":"2026-08-07T05:48:53.682291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:53.797233Z","title":"Neural discrete representation learning.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.797233Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:c9b97c99f43173eaf78e6d65caa39ae2790371172a421a5a1b8a2008554fe86d","observation_id":"9165d7d7-7170-488d-aabb-8e0ba2ffba10","resolution":{"observed_at":"2026-08-07T05:48:53.797233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08837","last_updated":"2025-05-08T06:35:06Z","snapshot_observed_at":"2026-07-06T21:08:05.749656Z","submitted_at":"2025-04-10T17:41:56Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08837","snapshot_observed_at":"2026-08-07T05:48:53.929107Z","title":"Vl- rethinker: Incentivizing self-reflection of vision-language models with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.929107Z"},"links":{"cited_paper":"/paper/2504.08837","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:ab8c1b828a416087b7850e4152b35f66ce2990317c42164cbb4b309c9b291302","observation_id":"e5ef4c12-43f8-4160-9034-7a2fe3057d22","resolution":{"observed_at":"2026-08-07T05:48:53.929107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:55.946138Z","title":"Objectformer for image manipulation detection and localization","venue":null,"work_id":"5df71e8c-1cb1-40d2-9281-266926bf0bce","year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.057267Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:2a74ffb7b9252b6d18c22f259681d99c364c3a3ebc51087315c931c1d6f365b5","observation_id":"b9c2cce1-18f5-4bcd-bbaa-83f297ab0191","resolution":{"observed_at":"2026-08-07T05:48:55.996473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T05:48:54.134553Z","title":"Qwen2-vl: Enhancing vision- language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.134553Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:ca4a871d37b0cce7bd3c303dd70715d487e1ce7132c4622b903acce24c91a2a6","observation_id":"721ae601-ec48-4c43-8434-5c0e0d0e68a1","resolution":{"observed_at":"2026-08-07T05:48:54.134553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:54.203270Z","title":"Cnn- generated images are surprisingly easy to spot","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.203270Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b57a86380c81b0876071f45b062de90d777eedbe9baeb6e72f50dc3121e833b3","observation_id":"b4dc13ff-6422-4a7c-b142-6dcdabbf60b4","resolution":{"observed_at":"2026-08-07T05:48:54.203270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:54.348033Z","title":"Dire for diffusion-generated image detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.348033Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:2e9976027484b92eae82a3b844fc68a491ec9e1aeadc11571318ad8c33d573bc","observation_id":"67d4c699-1623-44f4-b2b0-3a5e4d881b44","resolution":{"observed_at":"2026-08-07T05:48:54.348033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:54.453592Z","title":"Fast-slow thinking for large vision-language model reasoning.arXiv preprint arXiv:2504.18458, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.453592Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:93235f78d738c5638dff3f49a8e313b0703e3ee989a503bdb50abb0acc7cbd6c","observation_id":"3f8897c8-3c31-4f32-8a2d-e0cc3e02ea8b","resolution":{"observed_at":"2026-08-07T05:48:54.453592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:55.723662Z","title":"Segformer: Simple and efficient design for semantic segmentation with transformers","venue":null,"work_id":"be5689aa-114a-4f89-901f-9b1219d08a02","year":2021},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.590355Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:214a2e3f0916f7e10b202979315d90c50598a37f3ab195a7229e96066777dfd5","observation_id":"3b06c47f-d3be-4171-951b-60878842d293","resolution":{"observed_at":"2026-08-07T05:48:55.814632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-07T05:48:54.733441Z","title":"R1-onevision: Advancing generalized multimodal reasoning through cross-modal formalization.arXiv preprint arXiv:2503.10615, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.733441Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7f921caf2386c3ba0b52d592f24db16d108bf021c14f156d0b557ce3e543dfb4","observation_id":"a8bfaf4e-1672-4d46-b297-4a163a4f8466","resolution":{"observed_at":"2026-08-07T05:48:54.733441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03070","last_updated":"2025-02-07T04:20:54Z","snapshot_observed_at":"2026-07-06T18:25:44.620682Z","submitted_at":"2024-06-05T08:55:02Z","title":"A-Bench: Are LMMs Masters at Evaluating AI-generated Images?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03070","snapshot_observed_at":"2026-08-07T05:48:54.850810Z","title":"A-bench: Are lmms masters at evaluating ai-generated images?arXiv preprint arXiv:2406.03070, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.850810Z"},"links":{"cited_paper":"/paper/2406.03070","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:26c471fcc31175596246d927af9a94ad107301bd657eeb342959b309b52253ca","observation_id":"354205a5-d3e9-423a-9aeb-e0e6f77dfbc6","resolution":{"observed_at":"2026-08-07T05:48:54.850810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:55.023878Z","title":"Swift: a scalable lightweight infrastructure for fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:55.023878Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:5806bd54667500967a987b18457e5cb9616c9b907ebf7a272da1ea2d2fa1e97d","observation_id":"cf516f23-fc17-4eb7-a91a-500d0b8a3847","resolution":{"observed_at":"2026-08-07T05:48:55.023878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05132","last_updated":"2025-03-10T01:52:08Z","snapshot_observed_at":"2026-07-06T20:48:18.268075Z","submitted_at":"2025-03-07T04:21:47Z","title":"R1-Zero's \"Aha Moment\" in Visual Reasoning on a 2B Non-SFT Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05132","snapshot_observed_at":"2026-08-07T05:48:55.145079Z","title":"aha moment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:55.145079Z"},"links":{"cited_paper":"/paper/2503.05132","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:c3d42a49852b6654cb3d48f5c2ea99377bddc52f38700fa9531b87dcf9598493","observation_id":"dafa2d1b-efdb-4b0b-a124-67545590b87d","resolution":{"observed_at":"2026-08-07T05:48:55.145079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:40:59.833234Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 2 inbound Pith citation observations for arXiv:2506.07045."}