{"as_of":"2026-08-13T13:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf35bfdbd0234dd84d735030c623ecdcad2e2b6f3f897c9f9073d52839fdf37f","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:41:19.315411Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.09449/citation-record","integrity":"/paper/2411.09449/integrity","json":"/paper/2411.09449/citation-record.json","paper":"/paper/2411.09449"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.134391Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.134391Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:ab36a917d57eae53a96059d21d5b5b8bdb7fe7f4960e4ab265b34ea3e1f063ea","observation_id":"c4c9c0e7-e293-41c2-baf4-cafa202c9484","resolution":{"observed_at":"2026-08-12T20:41:19.134391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.139511Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.139511Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:559f20837f88f8e6b868e19adb3ab34de081be431165f5c34f7aa0ae3135e1dc","observation_id":"94037c2d-34e5-4de3-beac-6b13f2f17b41","resolution":{"observed_at":"2026-08-12T20:41:19.139511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-12T20:41:19.144337Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.144337Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:ab0e9871df13d9f72037eb716477a3183511267656e2bfc8f6b0833974ffe8ab","observation_id":"ed5d2ad3-fcac-4d06-be1e-d10d007bf57c","resolution":{"observed_at":"2026-08-12T20:41:19.144337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16797","snapshot_observed_at":"2026-08-12T20:41:19.148990Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.148990Z"},"links":{"cited_paper":"/paper/2309.16797","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:eb2f3f2855ec02dd90b9fa24b3e5c384fffc6df8a2a0a971d32842268ab731fd","observation_id":"e8293111-bf34-4eec-97ac-94f23be1c0b9","resolution":{"observed_at":"2026-08-12T20:41:19.148990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-12T20:41:19.153568Z","title":"H.; Chechik, G.; and Cohen-Or, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.153568Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:22484ab674d9aceaf46b5cf36039376ff560446ae33950c319a8b33e4042e4d0","observation_id":"93046a19-b317-4e81-b4a2-4d580c3aed53","resolution":{"observed_at":"2026-08-12T20:41:19.153568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08500","last_updated":"2018-01-12T14:05:44Z","snapshot_observed_at":"2026-07-06T05:48:30.254634Z","submitted_at":"2017-06-26T17:45:23Z","title":"GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08500","snapshot_observed_at":"2026-08-12T20:41:19.158049Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.158049Z"},"links":{"cited_paper":"/paper/1706.08500","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:e66d21a070e19acb8370b3f6aed8d3121de5d647100ce2e4d4396dec25515571","observation_id":"1f9c0539-392f-4a87-b868-db907c2b906b","resolution":{"observed_at":"2026-08-12T20:41:19.158049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06350","last_updated":"2025-03-08T14:57:45Z","snapshot_observed_at":"2026-08-13T10:57:18.918263Z","submitted_at":"2023-07-12T17:59:42Z","title":"T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06350","snapshot_observed_at":"2026-08-12T20:41:19.162672Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.162672Z"},"links":{"cited_paper":"/paper/2307.06350","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:bbcb12df76531f50705d703a5b408915c3bc6295dbca7f67645f1c69d9ddc253","observation_id":"616afc72-c3de-412e-b451-2e3c143df788","resolution":{"observed_at":"2026-08-12T20:41:19.162672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.809948Z","title":null,"venue":null,"work_id":"9cb25488-134e-400e-8542-e9a491aed9fe","year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.166678Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:a1dbf4de3caec7cb0b2f6065896031f52defef35adb38417392052e1832305f4","observation_id":"21861527-bafd-410a-b204-2cc9780c3be6","resolution":{"observed_at":"2026-08-12T20:41:19.813708Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13439","last_updated":"2023-03-23T17:01:59Z","snapshot_observed_at":"2026-08-13T12:18:15.824424Z","submitted_at":"2023-03-23T17:01:59Z","title":"Text2Video-Zero: Text-to-Image Diffusion Models are Zero-Shot Video Generators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13439","snapshot_observed_at":"2026-08-12T20:41:19.174345Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.174345Z"},"links":{"cited_paper":"/paper/2303.13439","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:d44523fe99cc01b9dd778ae3f6e2c39dc977fb7f58dad725744a0184aa7b957b","observation_id":"07e74307-3b8f-48d8-bd6e-01b33d8f5f20","resolution":{"observed_at":"2026-08-12T20:41:19.174345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-13T05:54:24.242465Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-12T20:41:19.179151Z","title":"S.; Reid, M.; Matsuo, Y.; and Iwasawa, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.179151Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:d1be989f2766981bc0094c4d31093d4fd75cfa68f3b4ad6bd49692049fca1c99","observation_id":"f7f41c92-3cb3-4574-85e1-386ac50b5d43","resolution":{"observed_at":"2026-08-12T20:41:19.179151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01596","last_updated":"2024-03-10T21:41:51Z","snapshot_observed_at":"2026-08-13T05:58:56.702773Z","submitted_at":"2023-10-02T19:41:42Z","title":"ImagenHub: Standardizing the evaluation of conditional image generation models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01596","snapshot_observed_at":"2026-08-12T20:41:19.183110Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.183110Z"},"links":{"cited_paper":"/paper/2310.01596","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:285d2bb60d2d7fe408a1f1bd6db577b3d7c6c898754d78a9129b1837e936d73d","observation_id":"fc7cca6a-6ad3-4f99-b363-3618485cd0b4","resolution":{"observed_at":"2026-08-12T20:41:19.183110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-12T20:41:19.187147Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.187147Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:19706cd5334d000b1610ec2b88faed1807a2fdff924d83b5816162c603ed170f","observation_id":"65877162-76e5-46c1-b719-2c4fe8e560d6","resolution":{"observed_at":"2026-08-12T20:41:19.187147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-09T08:39:37.884261Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-12T20:41:19.191871Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.191871Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:92f541b7bf94dd680591fc6f1c3a84904a6fb030233b74fa045a00573836261e","observation_id":"9770d1f3-3e38-4f90-88bf-3591b6badb29","resolution":{"observed_at":"2026-08-12T20:41:19.191871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-12T20:41:19.197131Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.197131Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:737ccb264c21374663d88ff7970b7668bf3e771858e6743d9b87b5ab3575cb36","observation_id":"f71e0ff6-2e7f-4073-bb40-dfe381a49112","resolution":{"observed_at":"2026-08-12T20:41:19.197131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.798473Z","title":"P.; Nicholson, A","venue":null,"work_id":"e8009b03-3cf1-4971-8520-bfb14a35db4e","year":2021},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.201170Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:3acf04427eb484c778738cb154e222a3293457aacbbe4951d30b50e369a768f0","observation_id":"90ec79a4-1548-42a8-a6df-091661f8fbe3","resolution":{"observed_at":"2026-08-12T20:41:19.802435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T20:41:19.204729Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.204729Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:9ee35019f187212afa60d40c36ddb6948cfda6ed7e2cd01e401cb011d33933ef","observation_id":"fe31e094-20d7-4070-b152-dee1b687a508","resolution":{"observed_at":"2026-08-12T20:41:19.204729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-12T20:41:19.209154Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.209154Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:176f745beb88663544ecff372c9f20182e30c7c8e043b99fa0261ac84ae4d131","observation_id":"5285bdb2-a2f9-4d66-aa7d-dc4fd6503f04","resolution":{"observed_at":"2026-08-12T20:41:19.209154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-12T20:41:19.212903Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.212903Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:ae0b28802571178d03a99d879087a678471ce60970cfbec9f5d9b0e285a8f0da","observation_id":"211b83cf-2841-413d-b55c-418610ff0092","resolution":{"observed_at":"2026-08-12T20:41:19.212903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-12T20:41:19.216815Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.216815Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:a3e8e3324011f9997a6f9927f0a290a37c94cd62c2affb5d9bd08819443520a0","observation_id":"0a60e03d-71fa-423d-acb5-47750365dec6","resolution":{"observed_at":"2026-08-12T20:41:19.216815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-12T20:41:19.220687Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; Krueger, G.; and Sutskever, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.220687Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:895078087a69377b165eabd2f593f69141da7ed24bb79a8fc197683d245c4875","observation_id":"70e8da8c-b719-448a-aff2-87b1b817265e","resolution":{"observed_at":"2026-08-12T20:41:19.220687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-12T20:41:19.224639Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.224639Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:d4e987ac7e22a2fef8381f45b83874bb16230f0c0887eee79ea04ab9d974c820","observation_id":"1aa00423-c90a-44cc-a4fc-da70fb6785b8","resolution":{"observed_at":"2026-08-12T20:41:19.224639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-12T20:41:19.228861Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.228861Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:20a0608fc1bda252609b4713f0ea0dabdf29fbc14c6f95cd7b130d4d59c4be85","observation_id":"04ba4d19-b4f3-4dd4-83f9-9d8bbbdef6d3","resolution":{"observed_at":"2026-08-12T20:41:19.228861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.232781Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.232781Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:f9c0e061dff278475dcead6b9d9b47875dd9731c8bc18c287cc3a01def0fb2e9","observation_id":"b1a93819-e5db-4c54-98a5-e7eaea2fd835","resolution":{"observed_at":"2026-08-12T20:41:19.232781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-07-06T13:45:31.237782Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-08-12T20:41:19.236439Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.236439Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:5b53afa5ee0f12322e845097af61f859c864573ed0b6f97690793bb5f68c4110","observation_id":"471bb97e-58ff-43fb-b974-1c6256447220","resolution":{"observed_at":"2026-08-12T20:41:19.236439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06949","last_updated":"2024-10-16T23:55:27Z","snapshot_observed_at":"2026-08-13T10:55:57.064533Z","submitted_at":"2023-07-13T17:59:47Z","title":"HyperDreamBooth: HyperNetworks for Fast Personalization of Text-to-Image Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06949","snapshot_observed_at":"2026-08-12T20:41:19.240611Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.240611Z"},"links":{"cited_paper":"/paper/2307.06949","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:5ab6f78c9f50bf536678f5f5db821748a416d8e3baae3e4ff0a89c627120d171","observation_id":"09687994-558a-4ab6-9a0f-6ad57bb7f9ef","resolution":{"observed_at":"2026-08-12T20:41:19.240611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-08-12T12:48:35.419134Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11487","snapshot_observed_at":"2026-08-12T20:41:19.244659Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.244659Z"},"links":{"cited_paper":"/paper/2205.11487","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:bb4d93d1d0878b4a4817960d2670a78c4f9fac688faa330edf9bd15a777a1f27","observation_id":"51931010-45a7-4aef-957b-36d9127dafa8","resolution":{"observed_at":"2026-08-12T20:41:19.244659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.03498","last_updated":"2016-06-10T22:53:35Z","snapshot_observed_at":"2026-07-06T04:59:35.089671Z","submitted_at":"2016-06-10T22:53:35Z","title":"Improved Techniques for Training GANs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.03498","snapshot_observed_at":"2026-08-12T20:41:19.248895Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.248895Z"},"links":{"cited_paper":"/paper/1606.03498","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:dd37e6c02c2b7c671b32c60932e6e17f7c09370f868416710713342dfe7a6f36","observation_id":"0b7fe409-8e14-4e3a-9620-4ffafab3c6a5","resolution":{"observed_at":"2026-08-12T20:41:19.248895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-12T20:41:19.253194Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.253194Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:199f5a9c1ebeb2afc474eae861ecfb1a3593f3567ec4e747044bdc2691f31640","observation_id":"79eebabb-e67f-40b4-8ab4-e37f07ef8371","resolution":{"observed_at":"2026-08-12T20:41:19.253194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17580","last_updated":"2023-12-03T18:17:21Z","snapshot_observed_at":"2026-08-12T12:50:51.005571Z","submitted_at":"2023-03-30T17:48:28Z","title":"HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17580","snapshot_observed_at":"2026-08-12T20:41:19.257262Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.257262Z"},"links":{"cited_paper":"/paper/2303.17580","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:55e8092d3292481aa11662128ac1b3344e2b7d5b1b1b5c8067af6b549b6f83f1","observation_id":"c014e2f6-c039-4247-8237-833f6af53b30","resolution":{"observed_at":"2026-08-12T20:41:19.257262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T20:41:19.262298Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.262298Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:d19db6256b2f34218b2e4c29983dcdee3904347ebaff0e468abbd69ecbc46a6d","observation_id":"682f50e6-b5eb-4e71-a537-a97753b472f3","resolution":{"observed_at":"2026-08-12T20:41:19.262298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12908","last_updated":"2023-11-21T15:24:05Z","snapshot_observed_at":"2026-08-13T05:20:21.767335Z","submitted_at":"2023-11-21T15:24:05Z","title":"Diffusion Model Alignment Using Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12908","snapshot_observed_at":"2026-08-12T20:41:19.266339Z","title":"R.; and Naik, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.266339Z"},"links":{"cited_paper":"/paper/2311.12908","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:d6d42be60fa010dfffc7eb585df073bd4b4f96cd4dcd84de81a83c1a215a12ec","observation_id":"80e654d5-f6e1-46c4-b034-5d2ef97c307b","resolution":{"observed_at":"2026-08-12T20:41:19.266339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07863","last_updated":"2023-08-15T16:30:49Z","snapshot_observed_at":"2026-08-13T10:34:12.235917Z","submitted_at":"2023-08-15T16:30:49Z","title":"StyleDiffusion: Controllable Disentangled Style Transfer via Diffusion Models","version":1},"cited_work":{"arxiv_id":"2308.07863","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07863","snapshot_observed_at":"2026-08-12T20:41:19.513421Z","title":"StyleDiffusion: Controllable Disentangled Style Transfer via Diffusion Models","venue":"cs.CV","work_id":"d8701f57-4d00-435b-843f-6bafd07d7be4","year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.271053Z"},"links":{"cited_paper":"/paper/2308.07863","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:8c7f9a26c6045455e5debfaa465dc7f9aeb56596cc0de037ba5b6a952e253052","observation_id":"cfe27f9c-2c64-4c52-950a-cef99073b722","resolution":{"observed_at":"2026-08-12T20:41:19.519705Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14896","last_updated":"2023-07-06T11:53:19Z","snapshot_observed_at":"2026-08-13T06:19:55.111321Z","submitted_at":"2022-10-26T17:54:20Z","title":"DiffusionDB: A Large-scale Prompt Gallery Dataset for Text-to-Image Generative Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14896","snapshot_observed_at":"2026-08-12T20:41:19.275983Z","title":"J.; Montoya, E.; Munechika, D.; Yang, H.; Hoover, B.; and Chau, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.275983Z"},"links":{"cited_paper":"/paper/2210.14896","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:46c633a7f62f483ea50fd7bd89629aa7713be5c862d868273cb826fe6d1f6313","observation_id":"d5cb9888-5680-42fc-b2ce-aba082946ff2","resolution":{"observed_at":"2026-08-12T20:41:19.275983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-12T20:41:19.281057Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.281057Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:e004676ee56035bf87b8b15b7eda65811d2c338476c0de044bdb07e8b518b7b9","observation_id":"30eeac13-b70d-4d32-a547-b5ed131c07e3","resolution":{"observed_at":"2026-08-12T20:41:19.281057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-07-06T15:00:13.368355Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-12T20:41:19.285932Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.285932Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:d0bb12461c202368e5441e3f46a7d4abf9df66b606e9a997b15447033f988510","observation_id":"9876382c-a8c0-4363-9d2e-9b85f19b21af","resolution":{"observed_at":"2026-08-12T20:41:19.285932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11708","last_updated":"2024-05-05T04:50:54Z","snapshot_observed_at":"2026-08-13T10:47:54.326171Z","submitted_at":"2024-01-22T06:16:29Z","title":"Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11708","snapshot_observed_at":"2026-08-12T20:41:19.290640Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.290640Z"},"links":{"cited_paper":"/paper/2401.11708","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:942feb911e7f3ee204d98cce60097fe0469f3e6f0a79f973b25138e022d8a5e0","observation_id":"d01e336e-499e-4ebe-9ab8-1faeee6f2db4","resolution":{"observed_at":"2026-08-12T20:41:19.290640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.294654Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.294654Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:02bf8a8fd5231bc62af2051375ac5ec646c380024355594bbd198ac71370cb2b","observation_id":"60f123c2-a84f-4f6f-8ed5-f5535af93906","resolution":{"observed_at":"2026-08-12T20:41:19.294654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17421","last_updated":"2023-10-11T05:07:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:34:51Z","title":"The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17421","snapshot_observed_at":"2026-08-12T20:41:19.298465Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.298465Z"},"links":{"cited_paper":"/paper/2309.17421","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:b5830abd9e3e1dc7747fea0041ed5ee5c70f2d7b5b11f98242e63911e094876e","observation_id":"1c99a116-7907-4279-ba57-de038f0e3585","resolution":{"observed_at":"2026-08-12T20:41:19.298465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08541","last_updated":"2024-08-14T17:43:25Z","snapshot_observed_at":"2026-08-13T05:50:25.753823Z","submitted_at":"2023-10-12T17:34:20Z","title":"Idea2Img: Iterative Self-Refinement with GPT-4V(ision) for Automatic Image Design and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08541","snapshot_observed_at":"2026-08-12T20:41:19.302523Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.302523Z"},"links":{"cited_paper":"/paper/2310.08541","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:423a161b3317ac8ba66feadcade70faeafcada267b064765c19c5d664058d43d","observation_id":"9f62f01a-deae-407b-a7a7-ae44ce54e319","resolution":{"observed_at":"2026-08-12T20:41:19.302523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-08-13T13:45:12.888881Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-12T20:41:19.307112Z","title":"Y.; Luong, T.; Baid, G.; Wang, Z.; Vasudevan, V.; Ku, A.; Yang, Y.; Ayan, B","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.307112Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:b922ce31e36b4d0caa2ee59b025ace605d37063d30010cd3d2e985cb2b5cb464","observation_id":"aedc2a37-d4a1-4de1-963c-2a64662bd8fb","resolution":{"observed_at":"2026-08-12T20:41:19.307112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13203","last_updated":"2023-03-20T14:32:01Z","snapshot_observed_at":"2026-08-13T13:35:47.196261Z","submitted_at":"2022-11-23T18:44:25Z","title":"Inversion-Based Style Transfer with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13203","snapshot_observed_at":"2026-08-12T20:41:19.311532Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.311532Z"},"links":{"cited_paper":"/paper/2211.13203","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:1940229ba974545c86d87ee8f411bc57da65008b3a638713e2153e0de686ff06","observation_id":"2206b7ca-7081-4d66-a07f-bf07d0856936","resolution":{"observed_at":"2026-08-12T20:41:19.311532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-12T20:41:19.315411Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.315411Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:6798fa60523952792b48aaed24b7816a1fdc645eff0afd5cfd317fcd1c9a718b","observation_id":"0044b981-4a0d-48bd-8717-870ce648a51e","resolution":{"observed_at":"2026-08-12T20:41:19.315411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T03:20:54.989096Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2411.09449."}