{"as_of":"2026-08-07T11:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b61e5ada264092ac1dd2a91161dfa355d6b5494a0215fcbfa94f2417921c29c6","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:31:38.440967Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04750/citation-record","integrity":"/paper/2608.04750/integrity","json":"/paper/2608.04750/citation-record.json","paper":"/paper/2608.04750"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-06T17:31:32.955187Z","title":"Hewett, Mojan Javaheripi, Piero Kauff- mann, James R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:32.955187Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:b6b804650f98b19188b0bd9005ad25d581946c1e4d3d39b38c3083f4a49df523","observation_id":"3e3c451b-5434-4b37-8096-452e71d73f5d","resolution":{"observed_at":"2026-08-06T17:31:32.955187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09898","last_updated":"2023-06-02T04:01:00Z","snapshot_observed_at":"2026-08-07T06:46:21.655507Z","submitted_at":"2022-12-19T22:41:46Z","title":"MetaCLUE: Towards Comprehensive Visual Metaphors Research","version":3},"cited_work":{"arxiv_id":"2212.09898","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.09898","snapshot_observed_at":"2026-08-06T17:31:40.164942Z","title":"MetaCLUE: Towards Comprehensive Visual Metaphors Research","venue":"cs.CV","work_id":"6dbedcb8-55bc-4bb3-88d3-1046b96f6c76","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.070050Z"},"links":{"cited_paper":"/paper/2212.09898","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:71af7480840401b258c0a7b76cbf27e27c4c7ee9362099f4ba9286418b6cd905","observation_id":"885cef89-86e2-42f8-b3b4-a66d9ef95fbb","resolution":{"observed_at":"2026-08-06T17:31:40.175533Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.586615Z","title":null,"venue":null,"work_id":"52b050a9-bee7-4082-92c0-f45e9c3306fa","year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.227622Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:141b09bcead901a5d335c3959549718b4d87811783037f9eb61391c8e97438be","observation_id":"fe3f5532-dde5-4872-849a-4de6087321d5","resolution":{"observed_at":"2026-08-06T17:31:40.593156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.566010Z","title":null,"venue":null,"work_id":"535516bf-93a1-42d2-be06-3718961f73c4","year":2006},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.311842Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:5305b4f205536b3e0604813751ae1fa450102eb86842a738bee7fcc806a41b3d","observation_id":"8ccbb689-ad33-4681-883b-4e9c35d6e1a5","resolution":{"observed_at":"2026-08-06T17:31:40.572219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:33.390098Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.390098Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:dfc274ea4c4f7141cbba64b378cb2b70e570028d28e8e8ec81cb695052d11053","observation_id":"566305ba-3db7-47dd-9fe0-b5aed6143e1a","resolution":{"observed_at":"2026-08-06T17:31:33.390098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:33.473819Z","title":"Bowman and George Dahl","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.473819Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:15e897a8596ddbeb02ea232978157970a6bb287e89627d1c16d14f784aa8964d","observation_id":"ed99ce08-5b1f-4fa0-a167-15cc25a4bed6","resolution":{"observed_at":"2026-08-06T17:31:33.473819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:33.717544Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.717544Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:001faa388ee027847d35cfdbc917415c7e369745c0a813ba5c03e0b47dd30166","observation_id":"dc9ca7ea-08cd-449a-8463-0540a2515ddf","resolution":{"observed_at":"2026-08-06T17:31:33.717544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-06T17:31:33.800704Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.800704Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:e5edc35bd2bb0c1fea248c4c963163442a51e5dd25e72775d31bd64d90807203","observation_id":"90289543-37f3-42d6-baa1-29919d9ce7c5","resolution":{"observed_at":"2026-08-06T17:31:33.800704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-long.404","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:39.415735Z","title":null,"venue":null,"work_id":"beb84f6a-3906-4cad-855c-f90e3911e27a","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:33.916651Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:a6783ce55d65eea2738e95d2b32c85c590e662ecf5d5c1cedfed083b7cffe79c","observation_id":"fd2ed102-c9d2-44a5-ac19-5edc7091025f","resolution":{"observed_at":"2026-08-06T17:31:39.421049Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:34.016572Z","title":"DiStefano, John D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.016572Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:3c6c1b2b517651341fcaaa803a8ad0da41fb47c731b827d2605a3b298b15562a","observation_id":"a49129b9-851b-4b71-a221-4c74246b0d59","resolution":{"observed_at":"2026-08-06T17:31:34.016572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-06T17:31:34.100732Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.100732Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:1d12e3efeba5faeaf924c2dc2702fcf7ef2271d8fd092d21672e06f82b8a079b","observation_id":"7432559b-1fe3-4016-92c6-a97c95438051","resolution":{"observed_at":"2026-08-06T17:31:34.100732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:34.182300Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.182300Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:1f83b38212bb98eb5b9a760039003155ba547ac6fc08cd5a88d5efccaf806d7b","observation_id":"c6981fc7-4e3a-4b1d-9070-7dbba5e2df55","resolution":{"observed_at":"2026-08-06T17:31:34.182300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:34.264571Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.264571Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:7361a681ac64f80c538879ebea9ed547c830a7f9e83d8cb53ba23466b1070d98","observation_id":"fad343eb-b91a-446a-b149-1da214e9cba6","resolution":{"observed_at":"2026-08-06T17:31:34.264571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11513","last_updated":"2023-10-17T18:20:03Z","snapshot_observed_at":"2026-07-06T16:34:42.650324Z","submitted_at":"2023-10-17T18:20:03Z","title":"GenEval: An Object-Focused Framework for Evaluating Text-to-Image Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11513","snapshot_observed_at":"2026-08-06T17:31:34.346158Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.346158Z"},"links":{"cited_paper":"/paper/2310.11513","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:3c65a23d565f12cf7589d464f93f26677c13b1ca7132ac60a3ba12c9afb4022d","observation_id":"a6232f5e-e57b-4e22-8067-7ce4b08deea4","resolution":{"observed_at":"2026-08-06T17:31:34.346158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T17:31:34.429179Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.429179Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:0447f16e4e387c1f819ab60c417432f73f77d08ba2eecf4ad72e1d79025b61c0","observation_id":"cc6c57cd-d536-42e5-aa4c-c4684ada7e3b","resolution":{"observed_at":"2026-08-06T17:31:34.429179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-06T17:31:34.514689Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.514689Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:5c4f4bc0586de40a35cb13c915f9d673bad1f379357c974d806f1d1ca6218473","observation_id":"99a54691-e904-436a-a7f1-86f6b5d41fd6","resolution":{"observed_at":"2026-08-06T17:31:34.514689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:34.591907Z","title":"Hamilton, Jure Leskovec, and Dan Jurafsky","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.591907Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:0c0814a09838ef70c7d75b3e186ada8f140492001d2eb87433201f772dd2757e","observation_id":"61e59509-d644-459f-b5bd-d17d7069c394","resolution":{"observed_at":"2026-08-06T17:31:34.591907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-long.543","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:39.347325Z","title":null,"venue":null,"work_id":"c8424009-c0e3-4b0b-be81-091268e4d988","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.673071Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:7c889ca436fe05e2f32e676e917771200c05a70cfa5b94f3153ef5116303ea89","observation_id":"684e6410-5a1e-4fa9-9204-96212da2d80d","resolution":{"observed_at":"2026-08-06T17:31:39.354098Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06350","last_updated":"2025-03-08T14:57:45Z","snapshot_observed_at":"2026-07-06T15:53:23.361639Z","submitted_at":"2023-07-12T17:59:42Z","title":"T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06350","snapshot_observed_at":"2026-08-06T17:31:34.759041Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.759041Z"},"links":{"cited_paper":"/paper/2307.06350","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:2b246fb8a31f71b2b3f4edd9094a23565d1320914864a8fe91445e25efda75c6","observation_id":"9663b61d-8c42-451b-b1a5-acbf264ea2d5","resolution":{"observed_at":"2026-08-06T17:31:34.759041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01497","last_updated":"2024-01-16T19:00:56Z","snapshot_observed_at":"2026-07-06T16:01:54.124499Z","submitted_at":"2023-08-03T01:46:27Z","title":"Large Language Model Displays Emergent Ability to Interpret Novel Literary Metaphors","version":3},"cited_work":{"arxiv_id":"2308.01497","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.01497","snapshot_observed_at":"2026-08-06T17:31:39.878966Z","title":"Large Language Model Displays Emergent Ability to Interpret Novel Literary Metaphors","venue":"cs.CL","work_id":"300d0322-3d1c-494e-8f2b-8c2bb4722bf3","year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.840851Z"},"links":{"cited_paper":"/paper/2308.01497","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:6f1f6f98b8d2e27e7e26f65b62b9c710f888fcaec28aad7d00a188794e129bcf","observation_id":"bb24b995-1828-4c5f-b1aa-6ad532618554","resolution":{"observed_at":"2026-08-06T17:31:39.885197Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T17:31:34.919903Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.919903Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:db1e0f31b022d838c8cd3852caea3a16ac486f13bd794977b6fe811449330416","observation_id":"ab6c11f3-17d7-432a-bef1-fb778d04168c","resolution":{"observed_at":"2026-08-06T17:31:34.919903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.518672Z","title":null,"venue":null,"work_id":"d2f71745-b249-4780-bcf6-2b998b3b1bd8","year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:34.981072Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:8dcd28edfd9c837a031326c6a58462e41312548c7061d5e14fb621ba3c40a390","observation_id":"3993af14-b5fb-4359-887d-288ad06658a8","resolution":{"observed_at":"2026-08-06T17:31:40.523932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.500943Z","title":null,"venue":null,"work_id":"75382eee-fbb3-45ec-8090-f54968068f9b","year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.041653Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:acf187d5b57a29dd66979a0c48eb202fb3b25ea365275909264ae9036ccd1fa0","observation_id":"268d08d3-6707-4dae-8b85-1b6530e3acd3","resolution":{"observed_at":"2026-08-06T17:31:40.506351Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18569","last_updated":"2025-08-26T00:04:01Z","snapshot_observed_at":"2026-08-05T16:21:07.111934Z","submitted_at":"2025-08-26T00:04:01Z","title":"The Mind's Eye: A Multi-Faceted Reward Framework for Guiding Visual Metaphor Generation","version":1},"cited_work":{"arxiv_id":"2508.18569","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.18569","snapshot_observed_at":"2026-08-06T17:31:39.786437Z","title":"The Mind's Eye: A Multi-Faceted Reward Framework for Guiding Visual Metaphor Generation","venue":"cs.CL","work_id":"ba1cfb11-eb1c-4392-b5f2-e6d3ad22d892","year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.181178Z"},"links":{"cited_paper":"/paper/2508.18569","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:4e66dbce25b26a9007c4c698cbe0892ec582cd6fa1601ac33664ee626435ef47","observation_id":"c46e877d-ac7b-4a80-bf63-77e5c04c2fa2","resolution":{"observed_at":"2026-08-06T17:31:39.793756Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:35.343364Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.343364Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:88396de55699ee44b8b6eb906aa5c68433c4337f32f769ff12cc15f3378a9bce","observation_id":"8e2d87b0-9af3-4dce-88ce-ad8fdd636554","resolution":{"observed_at":"2026-08-06T17:31:35.343364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.468560Z","title":"1980.Metaphors we live by","venue":null,"work_id":"eb70df4f-2a8a-4a18-a00c-ff06abd2400b","year":1980},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.412528Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:12466710da8ae31240cc641a44b5c6e6cfb409cad5c7a17a152aa83b54793c8c","observation_id":"f88db841-16df-4fd2-a3cc-4f2d644ace78","resolution":{"observed_at":"2026-08-06T17:31:40.474508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d18-1183","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:39.323704Z","title":null,"venue":null,"work_id":"65db012d-8e1a-4f99-80cc-422a39afb2b2","year":2018},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.500192Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:b99b2e494d5dc6604d5f3c3ea94ff445780ff91ed1ccce6e6448d61080645fac","observation_id":"c63ba13f-31f4-48a4-925a-19eead8c9ef3","resolution":{"observed_at":"2026-08-06T17:31:39.329794Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.451850Z","title":null,"venue":null,"work_id":"b2612eb1-ff58-45e8-821d-4549cf734219","year":2018},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.567268Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:07e231b75685f7d7fe263e3c5c56432088dfdfcf8b573b05de5f4cf9bb69ee77","observation_id":"6b276f82-2d4a-44c2-8e72-5879b568fde9","resolution":{"observed_at":"2026-08-06T17:31:40.456946Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18269","last_updated":"2026-04-18T01:27:45Z","snapshot_observed_at":"2026-07-31T09:20:56.277495Z","submitted_at":"2025-04-25T11:27:44Z","title":"TextTIGER: Text-based Intelligent Generation with Entity Prompt Refinement for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18269","snapshot_observed_at":"2026-08-06T17:31:35.642989Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.642989Z"},"links":{"cited_paper":"/paper/2504.18269","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:08b432a3d56fff3ac53ff59b2229a0fde64bfae51ad142f567d10d125ee97d68","observation_id":"456d995e-668b-4951-890f-ee7055ad6e94","resolution":{"observed_at":"2026-08-06T17:31:35.642989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.431476Z","title":null,"venue":null,"work_id":"7323b883-73d0-4f0d-8611-2d0209dc468c","year":2004},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.757919Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:bee12a0ba2c6988a711012fb25641a2542aef32f57a1f9cdfcd781646bb70772","observation_id":"7d31f9b5-4213-4ea1-aa53-3b29dd0746d2","resolution":{"observed_at":"2026-08-06T17:31:40.437987Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:35.975942Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.975942Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:bb8cfb7a3e0c90fc4902b9782bf7ea3ada8d7a8fbd62d0d1c460e1731a5fa8d2","observation_id":"1540a356-4c63-420e-9293-5e1b683aff36","resolution":{"observed_at":"2026-08-06T17:31:35.975942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.396079Z","title":null,"venue":null,"work_id":"78d42a63-73f6-49e9-a646-53ff6bfd6337","year":2020},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.163381Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:dba35070ec61b81c6c6c5ca4d381e5d857f3a8977a0498602260e283adc9e983","observation_id":"35c8556e-4a2c-4e61-b329-810663fac3a6","resolution":{"observed_at":"2026-08-06T17:31:40.403026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.372771Z","title":null,"venue":null,"work_id":"a74958f5-0d54-4b1f-85e4-9c3f93151fbf","year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.254120Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:67ada4a2b6314e5e6de605b5cab2e4ca694ce53e2ae4805a5286bc3da1b1df87","observation_id":"f3375d08-6b06-4f26-966e-1daca7127117","resolution":{"observed_at":"2026-08-06T17:31:40.380132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-06T17:31:36.388863Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.388863Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:b07bb5f1808f21c5617b970503e009056305680f67ce64a913f8041190067ce1","observation_id":"82a34f17-8ba6-42a9-b3eb-e1a5b99055d4","resolution":{"observed_at":"2026-08-06T17:31:36.388863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.346601Z","title":null,"venue":null,"work_id":"2e72905e-885f-4610-a9ea-769010cf76c1","year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.491343Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:1c8216ce899672faac386908126f8841d3103ae2da9843f9725322892cbf8851","observation_id":"c4db93e8-e5e8-4e93-88f5-d69288c55a21","resolution":{"observed_at":"2026-08-06T17:31:40.355008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:36.666373Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.666373Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:3cae71dc69ce7d55af373645719807d9e94edaa389c0d2c04649b97772ac6d52","observation_id":"a183f4bb-60e6-489c-b7fa-b1e1dfebd484","resolution":{"observed_at":"2026-08-06T17:31:36.666373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.314898Z","title":null,"venue":null,"work_id":"7c356a13-b5fb-4aac-b78b-93ef271501c9","year":2010},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.774378Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:40a78fa140ff94bcd8af6504111da92525b8f22eca7b3a31faa3dcf9c8cea35d","observation_id":"43b9448b-4ac8-4491-88e8-c79160ed355c","resolution":{"observed_at":"2026-08-06T17:31:40.322694Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.conll-1.26","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:39.244568Z","title":null,"venue":null,"work_id":"4d1ba0c1-6968-4339-91ff-cc75c7618a32","year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.869720Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:ae4b99ff159d2e646251148e6212f606d6c2b997972d84383a947dfc726aa6eb","observation_id":"2ef80b43-7217-4b7d-a193-ad5250fbefad","resolution":{"observed_at":"2026-08-06T17:31:39.250149Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:36.966020Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.966020Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:d39d406cd4d7ae2923e8cbf9524515da3132c8d6899d40c0d0a7ea83bf5c6305","observation_id":"13a086f2-d097-4c83-95d1-05127b2b74a6","resolution":{"observed_at":"2026-08-06T17:31:36.966020Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11063-024-11609-w","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:39.189767Z","title":null,"venue":null,"work_id":"97e5440d-5aab-4f6b-b225-829f6bf7d014","year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.158721Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:a0c5f237b8a9fab583ba08dd6a55f25b3e9d5d55d785684dd862640bcc9f6ae5","observation_id":"c549d93e-df66-47f0-89e8-89e76f11d851","resolution":{"observed_at":"2026-08-06T17:31:39.222406Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17472","last_updated":"2025-08-24T17:59:38Z","snapshot_observed_at":"2026-08-05T16:56:27.362307Z","submitted_at":"2025-08-24T17:59:38Z","title":"T2I-ReasonBench: Benchmarking Reasoning-Informed Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17472","snapshot_observed_at":"2026-08-06T17:31:37.253594Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.253594Z"},"links":{"cited_paper":"/paper/2508.17472","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:0d61ad292e20a90db48594b2b8c3d47fa0bab101e6172ebca1045a86e2cded47","observation_id":"4cd0bbe0-3280-465c-82b0-20797e72b0d9","resolution":{"observed_at":"2026-08-06T17:31:37.253594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-06T17:31:37.323714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.323714Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:1fc56e887e8746049afec401916fa2755bd56c0805f468320854119a661d1722","observation_id":"c237de48-395b-425c-bf44-dc17822a38ec","resolution":{"observed_at":"2026-08-06T17:31:37.323714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.286675Z","title":null,"venue":null,"work_id":"0e779cac-841b-4249-b58a-082905568649","year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.401925Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:acc297947327dd2e9d972e8e0f4be036777531feb3dbb995e0a34b7484675e1e","observation_id":"71d522d7-8479-474f-bc5b-fed186ba23b5","resolution":{"observed_at":"2026-08-06T17:31:40.294473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.265520Z","title":null,"venue":null,"work_id":"ed197e17-4cf0-4666-9e4c-2b0c87b13f73","year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.589884Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:752e9165dd64f4b5f256469fa9f2d5700ef3f0b68da6d62f87c70cbce849391b","observation_id":"c655b54e-16cd-409b-ad92-caeeebb69fdc","resolution":{"observed_at":"2026-08-06T17:31:40.272074Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.naacl-main.372","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.243930Z","title":null,"venue":null,"work_id":"1fd55779-5455-4472-8933-0c7a0c7580dd","year":2021},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.797508Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:f5e0903130ddfe5464038c0cecd374950ee76b8562974481c2a928bc29eec784","observation_id":"941867f8-c1a5-4269-82df-350cea27247c","resolution":{"observed_at":"2026-08-06T17:31:40.249514Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.findings-emnlp.236","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:38.687996Z","title":null,"venue":null,"work_id":"95488098-f16c-4706-a7f3-07721a625ecc","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.896531Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:506bb80f1219aecab21d7c87e5d4c2c70ad36c8a7cdd2c8ac058c3568cee8943","observation_id":"8f6327c5-46fc-4dee-9672-1fef576f2c0d","resolution":{"observed_at":"2026-08-06T17:31:38.897206Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:38.009217Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.009217Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:56c87b23093fc1aea252bc6cfa377cc8c2e31f72c37e46b7986389db9e10a167","observation_id":"0d50bccd-528f-4eea-ab02-a192bd6233a5","resolution":{"observed_at":"2026-08-06T17:31:38.009217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-06T17:31:38.056722Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.056722Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:021fd9c11be6380e74065252a68fba099e94360de776bf395be5f6a118547a37","observation_id":"67b9d605-b279-4c09-b5eb-8f526ae3b25f","resolution":{"observed_at":"2026-08-06T17:31:38.056722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:38.135700Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.135700Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:8f3d8a579674c2c5e09062f9dd06082430915b19f2aca1e61905cc84d45b2842","observation_id":"c4dd0ddc-5408-44ae-a5e3-b14e071fe0bd","resolution":{"observed_at":"2026-08-06T17:31:38.135700Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:38.261105Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.261105Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:6c2f2d5fe17b7996ee9f4c899ede8ab654a5e7600d5ae4b58ba59c1c54f2b92c","observation_id":"25d4b3b5-b210-4d8b-a8e7-cf1c08c93b6c","resolution":{"observed_at":"2026-08-06T17:31:38.261105Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:40.221043Z","title":"{template_phrase}","venue":null,"work_id":"0c650c06-a9df-498b-963d-717d8d920293","year":2023},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:38.440967Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:07a8e537c6623d3650f3cbdda8cba9f738a7d51cedad6f4b94ea7ffe2ec0c412","observation_id":"932b65d7-12c3-4312-a38e-2a570d7ea0f2","resolution":{"observed_at":"2026-08-06T17:31:40.227980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/1470593104044089","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:39.294848Z","title":null,"venue":null,"work_id":"ba1d5225-33c4-46b2-8170-cf0179117f58","year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":136,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.881739Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:c346a380e08634ad8bbaed5f4b8c5c6ee94a7d69c5a82aa82e054bb9b392baa7","observation_id":"3a968c5c-8a4f-49af-afc6-3ef0980b2c35","resolution":{"observed_at":"2026-08-06T17:31:39.301899Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-06T17:31:36.073835Z","title":"arXiv:2103.00020 [cs.CV] https://arxiv.org/abs/2103.00020","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:36.073835Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:cc6df38c75ceeaa8330dad58a345b1520be5f5dc29b2b7e0c1bb7b59b98adf21","observation_id":"9fff1ed8-cdf7-457a-8368-30cbf4fd95c8","resolution":{"observed_at":"2026-08-06T17:31:36.073835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10578","last_updated":"2022-10-19T14:20:05Z","snapshot_observed_at":"2026-08-06T08:47:54.764418Z","submitted_at":"2022-10-19T14:20:05Z","title":"Language Does More Than Describe: On The Lack Of Figurative Speech in Text-To-Image Models","version":1},"cited_work":{"arxiv_id":"2210.10578","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.10578","snapshot_observed_at":"2026-08-06T17:31:39.821169Z","title":"Language Does More Than Describe: On The Lack Of Figurative Speech in Text-To-Image Models","venue":"cs.CL","work_id":"ffa501b7-3cc5-4cc7-8a33-914982f26ef4","year":2022},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:35.097565Z"},"links":{"cited_paper":"/paper/2210.10578","citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:339c0e6621d94a5274cc24d03f470503cf7ba1c0de8fce7a455743ad56268646","observation_id":"8af9640a-1555-4c62-ab41-fea98f66265c","resolution":{"observed_at":"2026-08-06T17:31:39.827577Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:37.495549Z","title":"InProceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), Lun-Wei Ku, Andre Martins, and Vivek Srikumar (Eds.)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.495549Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:de238890f8be16487ec8d5eeaa69c2fda57de7a135e959681da8eb8e40ff2390","observation_id":"cb21c4f9-16b5-44e1-ad1f-1a18409cf072","resolution":{"observed_at":"2026-08-06T17:31:37.495549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:31:37.685731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework","version":1},"reference_index":3536,"source":"pdf_text","source_observed_at":"2026-08-06T17:31:37.685731Z"},"links":{"citing_paper":"/paper/2608.04750"},"observation_digest":"sha256:f2253e236eeb5ce7a478d6a29fb7737d75002001114ab2ba7e3604878607ed50","observation_id":"12190968-a8a2-4bfc-b633-fb3fcaae6066","resolution":{"observed_at":"2026-08-06T17:31:37.685731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04750","last_updated":"2026-08-05T12:18:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:51:43.445160Z","submitted_at":"2026-08-05T12:18:28Z","title":"Simile Understanding in Text-to-Image Models: An Evaluation Framework"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":4,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":38,"verified_exact":9,"verified_fuzzy":2},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2608.04750."}