{"as_of":"2026-08-22T19:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0b6f5b96398d5b9a8fa2a264dda9b78c95c56a5476dc7f7deb00c3b61da2ba4e","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:59:47.049130Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03357/citation-record","integrity":"/paper/2608.03357/integrity","json":"/paper/2608.03357/citation-record.json","paper":"/paper/2608.03357"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.535783Z","title":", title =","venue":null,"work_id":"d7b1a345-ddc3-4173-8473-362614fcfdf0","year":2003},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.818216Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:129573a2f50ba29389ebccf451b9b2242856dd954fa50d98c67003d447c1fcdb","observation_id":"875c6086-26c9-40d6-bec1-0e2053540338","resolution":{"observed_at":"2026-08-15T14:59:48.540524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.523949Z","title":"2022 , eprint =","venue":null,"work_id":"75c2ad32-39a7-469c-9ed5-d32291cb8c75","year":2022},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.824451Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:0b5547a6ac18091cb2377303f1f490cc8da744f4e64688796f01d12d1dab9eca","observation_id":"8bf0ded3-e2af-47a8-b67c-f486ba586085","resolution":{"observed_at":"2026-08-15T14:59:48.527691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.512026Z","title":"2025 , eprint =","venue":null,"work_id":"adaf5262-aabf-499b-8ae1-761163133800","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.829792Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:1cb90484fe1c434062af45bd731b792d211a8e5a3eb9ec0bf14767de00c464f0","observation_id":"ca80fbc3-ab38-423b-b29c-2c19eee402a9","resolution":{"observed_at":"2026-08-15T14:59:48.516176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.500703Z","title":"2023 , eprint =","venue":null,"work_id":"ee00ec36-f385-4469-9806-802b53c89a60","year":2023},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.833912Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:8d0a65314695df6e01a7e19c4b9bedc028a75e3ee7dce70fe6bee95aebc679a7","observation_id":"478eff66-8e3b-446d-b2d0-963b1ed49cd5","resolution":{"observed_at":"2026-08-15T14:59:48.504604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.488063Z","title":"2025 , eprint =","venue":null,"work_id":"a72d6415-5f2f-4863-96f3-884a3e613c94","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.838681Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:3b8da919b5aab22da1088049bb239ba592183d9b31d433e348266420e03e6455","observation_id":"da601432-8faa-4d0e-bb99-406619b55d74","resolution":{"observed_at":"2026-08-15T14:59:48.492937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.414319Z","title":"2025 , eprint =","venue":null,"work_id":"561d02c8-7fad-4593-a49b-64ef5d5b0948","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.842386Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:8f7bcefa9df665c0d0fe95d43b6284e2f0a18bc25e7356951ec5337695fd4749","observation_id":"481b3d95-1739-43f8-9088-81eb980666c3","resolution":{"observed_at":"2026-08-15T14:59:48.466217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.370041Z","title":"2025 , eprint =","venue":null,"work_id":"d17c1a5e-45c5-4293-8bc4-5c870665f9c0","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.846242Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:b5905f98f848877700efaa14b4a800f11f8f65232ddecb66a166f0e5b8de1125","observation_id":"1f6ba868-7675-4754-8c30-4cfa2c61e1bc","resolution":{"observed_at":"2026-08-15T14:59:48.375033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.355555Z","title":"2026 , eprint =","venue":null,"work_id":"109bc08d-47d0-492f-b651-8c45c8286655","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.849860Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:92f9aa35ad8f7a91cb6cee818c441dd79f34a74cf8545d34471be027ece48d3b","observation_id":"2300256a-3e8e-46a8-938c-947a1a03bf2b","resolution":{"observed_at":"2026-08-15T14:59:48.359623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.343578Z","title":"2026 , eprint =","venue":null,"work_id":"40bc3425-436b-461a-937c-d84701498298","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.854852Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:87e55ffe9dabed2f4f1a29f1199c3ec8b01cb760ca107f2400273f1fa224e2c3","observation_id":"1e7c2800-9b95-4437-950e-33a8a869f88e","resolution":{"observed_at":"2026-08-15T14:59:48.347551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.308927Z","title":"2026 , eprint =","venue":null,"work_id":"b8b858b9-8a21-48ec-8624-ae187f0b9494","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.859759Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:ae61808dbdfbaab76d60d4cf9bb123cabcd83df72c6c02528f3441afdacc1181","observation_id":"1e667782-ab2f-4585-982b-583c47b4def6","resolution":{"observed_at":"2026-08-15T14:59:48.333887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.221127Z","title":"2025 , eprint =","venue":null,"work_id":"9079fa30-dbc7-4ba9-b6ae-9616168422c7","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.863686Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:7a5c1397a5007c22884758df89615bb5e45022ae5a942de22e1fe13927dbb49f","observation_id":"73c35beb-257e-44f5-a80a-078a80bcebb4","resolution":{"observed_at":"2026-08-15T14:59:48.250392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:46.867269Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.867269Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:017564c471dde685b8e00a6805f6e516649fe829f8253175b697aecd6420d40b","observation_id":"f9c0ba15-5b95-4963-a04e-08c301e93d5c","resolution":{"observed_at":"2026-08-15T14:59:46.867269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.196919Z","title":"2025 , eprint =","venue":null,"work_id":"763a5132-61dc-4476-8fc0-b79dfed1a604","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.870580Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:49ab94cc9821cc530ff486c742b0463ef786479b5b1c068515bb86e2a85121ab","observation_id":"df429500-c685-47fa-b4df-8ab0ad421656","resolution":{"observed_at":"2026-08-15T14:59:48.202412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.184663Z","title":"2026 , eprint =","venue":null,"work_id":"132dbedb-fbfa-41fa-ba7b-d7c432f63ca1","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.875225Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:c0b4fb2512a7a0e01780bfcf2450f02ac8ae593de203abf3129d547ef75ccf3c","observation_id":"55b1bb2e-4ed2-423d-8812-c12fdf5b063e","resolution":{"observed_at":"2026-08-15T14:59:48.188961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.113004Z","title":"2026 , eprint =","venue":null,"work_id":"edceeaca-9f00-4469-b5ac-2225abc0cdc0","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.879521Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:9a42734a0bb8f85e580c424531427c0d98ed1128c5435f4bc3b0106ae2850b88","observation_id":"5d292e3d-e4da-4881-911b-75f832023f55","resolution":{"observed_at":"2026-08-15T14:59:48.162398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.047907Z","title":"2025 , eprint =","venue":null,"work_id":"07b282c1-cec2-41e2-b0f3-f960e174152b","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.883083Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:c5792b946a0a707848440a2b93b964f7bb13c8ba5638e4fb20e4824248ced5b5","observation_id":"41f2c077-6051-4960-867f-054aee5267ad","resolution":{"observed_at":"2026-08-15T14:59:48.074089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:46.886137Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.886137Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:f1d84b916c324d55b7416501f4dfc36d7e566feab8a0b3fa62a21de071e0014e","observation_id":"de989a5d-e27c-42eb-be69-069520cb283d","resolution":{"observed_at":"2026-08-15T14:59:46.886137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:48.004975Z","title":"A Survey of Text-to-Image Diffusion Models in Generative AI , year=","venue":null,"work_id":"7acd19fa-6d24-4b9a-ae10-7d8f56c77d22","year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.889562Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:0cb5ed966c058bd46de37da8ca3bec3a1b6df4574b869010021d3195f696982b","observation_id":"3fe61bc4-c2c7-4ab6-8dde-33703c48bd64","resolution":{"observed_at":"2026-08-15T14:59:48.008550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.992989Z","title":"2026 , eprint=","venue":null,"work_id":"f3b96037-d1ba-4733-adfe-dd96982131a2","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.894203Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:4271b287770cae0e887341bf2c124f78ecd1776e0598a721df0c4b784e62c6ee","observation_id":"cad3ed74-aad6-4f66-bd7d-14dc1c399abd","resolution":{"observed_at":"2026-08-15T14:59:47.997050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:46.897872Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.897872Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:4b7013122b79ceed17bee9adfbe08b8a49a7f8fb2b5535ae670ad7ce0ea190be","observation_id":"314b6a19-6a60-4f53-addb-380ac9898897","resolution":{"observed_at":"2026-08-15T14:59:46.897872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.972628Z","title":"International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":"f43fa985-7daa-4f93-a68b-d4f3372001bc","year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.900992Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:eab6692876884b64aea5ec4f6e576afdd08ee122b34fcca8e095252e3291838d","observation_id":"d0b61b35-e25a-4c16-b5e6-a177852d2652","resolution":{"observed_at":"2026-08-15T14:59:47.977815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.960606Z","title":"2025 , eprint =","venue":null,"work_id":"52adfa1f-830b-4e67-bd3d-5df4a110dc55","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.904269Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:7132784d5086fe31546f6a506d403e3a1fca4ea8c6b59f42f0005c9119a50ab5","observation_id":"303350ee-b83d-4338-8e7e-6fa788c841c0","resolution":{"observed_at":"2026-08-15T14:59:47.964991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.948482Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , year=","venue":null,"work_id":"ecbcea50-6abb-4c5c-bf50-03d9677a5109","year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.907440Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:ca036374f1a651940b652e80b03b6fd1dd1036c20c7d27e84cfa28732d932c57","observation_id":"8042b404-93d3-4150-84c5-9a4fd9d16a5f","resolution":{"observed_at":"2026-08-15T14:59:47.953268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.936912Z","title":"ICLR , year =","venue":null,"work_id":"a421a413-be4e-4070-b7bc-f25a16678593","year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.911678Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:77bc550b8225ccf9e2cf1f2f67aacb60ffff81b6494bcf1dfb7d683caf9914ad","observation_id":"9e37fb53-fdfa-42cc-9ff3-1e1233cda4be","resolution":{"observed_at":"2026-08-15T14:59:47.940660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-08-16T15:46:31.920890Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-15T14:59:46.915311Z","title":"arXiv preprint arXiv:2303.11897 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.915311Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:0578374075979f68c6bdad51ca9ab92b9e1b80b02495cce2a4055a37e5bffe96","observation_id":"b279b81b-e9aa-4d95-8231-9e132b100059","resolution":{"observed_at":"2026-08-15T14:59:46.915311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.925747Z","title":"2025 , howpublished =","venue":null,"work_id":"4796e1fb-0a98-4ad8-9a1c-ac1dcf51e39f","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.920777Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:6a94c97f1eb9d22e7a0a0ed5c3278360c205602c1d89b8bd5430945f5f5b7e03","observation_id":"74547092-81da-4be8-b719-38f2c59ae64a","resolution":{"observed_at":"2026-08-15T14:59:47.929374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.838842Z","title":"2026 , eprint=","venue":null,"work_id":"b89f2037-3209-4969-815c-f14aa1ca3dbb","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.924617Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:04dc5bd4c90cdc13e054217b7839e0e4cc56d2d59f4f08741589d10c452ac939","observation_id":"14fbebda-ef21-47b8-ab98-862a1bc9c938","resolution":{"observed_at":"2026-08-15T14:59:47.876284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07977","last_updated":"2025-06-26T15:47:09Z","snapshot_observed_at":"2026-08-16T19:31:18.122184Z","submitted_at":"2025-06-09T17:50:21Z","title":"OneIG-Bench: Omni-dimensional Nuanced Evaluation for Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07977","snapshot_observed_at":"2026-08-15T14:59:46.927837Z","title":"arXiv preprint arxiv:2506.07977 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.927837Z"},"links":{"cited_paper":"/paper/2506.07977","citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:1f2cd57c7a2063863772f503cc1d5eb1fa1aa817686cca17cbc171d7118c13b7","observation_id":"e2f263a4-bb43-4cb8-86d2-22a1fde6549b","resolution":{"observed_at":"2026-08-15T14:59:46.927837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-08-15T23:16:19.228206Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-15T14:59:46.932348Z","title":"arXiv preprint arXiv:2511.10647 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.932348Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:8a9659d3f5f55a4543590a118959cac3f34fc3ddf95154f8183d51362c4eb5a1","observation_id":"645395af-387b-43e6-90c2-0fcb5bf36d1e","resolution":{"observed_at":"2026-08-15T14:59:46.932348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.808034Z","title":"2026 , eprint =","venue":null,"work_id":"18885e08-7629-4951-90ee-e0fa0a6f6b33","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.936296Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:880346bf46aee08a24eec61e6e883d8882b25276e166c18c3e6f4ed0a0d0fb69","observation_id":"5a9ddb48-9941-43bc-b3ce-1a20f0659f11","resolution":{"observed_at":"2026-08-15T14:59:47.812911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.795216Z","title":"2026 , howpublished =","venue":null,"work_id":"4328a678-9da2-4a5d-8e86-34ff301a0c31","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.939776Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:a07310c5b2241cb3e1ad004cec12a57d1974175c3513d6eafc9cc9730dd84a02","observation_id":"5f734a7b-f45c-4425-bffc-b1cbcf34644b","resolution":{"observed_at":"2026-08-15T14:59:47.799459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.783039Z","title":"2025 , howpublished =","venue":null,"work_id":"94adcdab-6b3d-4b00-8c2c-adc3a13ddbcf","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.943575Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:5df7167fabd6c2d6a1abffaa195cf276a0c71b159bd549014fbdb7324ef710bb","observation_id":"5cec458e-f99f-4059-8187-337256c0cc2b","resolution":{"observed_at":"2026-08-15T14:59:47.787394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.770177Z","title":"2026 , howpublished =","venue":null,"work_id":"a9286028-d05b-4be6-b34a-f988a4f1ed15","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.947339Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:7189b91f7a48b32dc71a3961d19b35ac402c115fca90043d86c58ba4f67f736f","observation_id":"0680cfbb-1b8d-433e-b3fa-36a99c9b349f","resolution":{"observed_at":"2026-08-15T14:59:47.774733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.712761Z","title":"2025 , howpublished =","venue":null,"work_id":"a90e7324-5286-4fe3-a598-9f9c74578dbe","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.950983Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:e4b94e1c89411aa4c0c05df5b9a5a5d8f8011608f9dd0afcf0687c1b8e0bf590","observation_id":"cfd06b6c-dfcb-485a-a912-831438a15e67","resolution":{"observed_at":"2026-08-15T14:59:47.753130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.629661Z","title":"2025 , howpublished =","venue":null,"work_id":"3ef4378c-bf9b-4edd-9cb8-e978b44d9094","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.954227Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:f602b7c3e8d7621680f92ad82fd749b47b275e60cfaab16e06c04c7832570675","observation_id":"2ea51a58-45d1-4db4-b2c2-b5538a2047a6","resolution":{"observed_at":"2026-08-15T14:59:47.664841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.592185Z","title":"2026 , howpublished =","venue":null,"work_id":"00b46185-4b30-43d5-a915-104f63d3a802","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.958138Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:7378a60202c04e17cda14e5933d22f896be64e4f84e9c79b07707499ea06f63d","observation_id":"69d32d2e-e4b4-4884-b788-cf91bb995956","resolution":{"observed_at":"2026-08-15T14:59:47.599894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20427","last_updated":"2025-12-10T16:37:54Z","snapshot_observed_at":"2026-08-17T20:41:31.115657Z","submitted_at":"2025-09-24T17:59:04Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.20427","snapshot_observed_at":"2026-08-15T14:59:46.961479Z","title":"arXiv preprint arXiv:2509.20427 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.961479Z"},"links":{"cited_paper":"/paper/2509.20427","citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:e2caa12cb585b27fe15c1d3f77bc7e8ea8c6f196316fcbc32333ae3d7e034991","observation_id":"6b459b7f-d118-4ceb-89cf-166d4ff9dd42","resolution":{"observed_at":"2026-08-15T14:59:46.961479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.577807Z","title":"2025 , eprint =","venue":null,"work_id":"57610f3c-f45c-4e2e-baf9-03fb05997c55","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.966130Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:55b6c59762cf9bd2e2ed984d21f7456435a8757985ba66ea5651a849c82be030","observation_id":"2d4fe5d5-839e-4e53-802b-411c39bf9ea8","resolution":{"observed_at":"2026-08-15T14:59:47.583790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.565716Z","title":"2026 , howpublished =","venue":null,"work_id":"398946a9-ac04-4379-8bcc-def28761014f","year":2026},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.970036Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:97df03825e0ff626204a9766fb42cbfa08c13f3b169209d15e2d96688e68e893","observation_id":"ec39b8ce-03e1-423b-b997-a2225daf545f","resolution":{"observed_at":"2026-08-15T14:59:47.569935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.551867Z","title":"2025 , eprint =","venue":null,"work_id":"02b53de0-cf7a-4b32-afaa-c54affc8b74b","year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.973677Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:fe1b5072e2f6b049ebfe7ab60ba3e7af57a627e576275f4c5560418e30cb8ade","observation_id":"8f35dead-58be-45b5-83d8-68d5acd9342f","resolution":{"observed_at":"2026-08-15T14:59:47.556023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:46.977193Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.977193Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:2cdf73cb41ccaa494c348aeb15da40ef96668f885305a62ab3d483310bff98e2","observation_id":"02e67de4-4abc-4ee0-8b58-5454c7db46ed","resolution":{"observed_at":"2026-08-15T14:59:46.977193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-08-21T20:37:42.923128Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-15T14:59:46.981021Z","title":"arXiv preprint arXiv:2501.17811 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.981021Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:514dc24de67cc6abe59f22466013b2480cf07be592c43ff2c046c326fce7b7e3","observation_id":"dc116ff5-adf9-40b6-a095-f56e4ad47283","resolution":{"observed_at":"2026-08-15T14:59:46.981021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-08-18T17:34:44.890427Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-15T14:59:46.985265Z","title":"arXiv preprint arXiv:2408.12528 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.985265Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:add9ee8cfdca60cd8661c0b14551b865680b974e13f6964612b6d32440922ee6","observation_id":"17cf01d3-dbe2-4544-a86f-4b85ff2ffd3a","resolution":{"observed_at":"2026-08-15T14:59:46.985265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.470179Z","title":"2024 , eprint =","venue":null,"work_id":"4e24cc88-711d-4ddd-b588-f34366e98326","year":2024},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.989325Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:05806d56642cdc5d4430e8f24a97a01c2157b0e727be36df239030c67bca3162","observation_id":"df640ccd-b187-48ee-b9f5-87fe9b1b5c11","resolution":{"observed_at":"2026-08-15T14:59:47.512996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:46.992608Z","title":"2014 , eprint=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.992608Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:4145fb44fab0e82997c010ee6c655d3996b0aa27eb4133ac463b8a4cf886abfa","observation_id":"566386ad-c09a-4369-9fcd-b577b2626f81","resolution":{"observed_at":"2026-08-15T14:59:46.992608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:46.995923Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:46.995923Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:d70263f4c07a3b97071abd630e3e0b8642640f7e0cdc0251ef86a2dc16e0507a","observation_id":"e3ca223b-a69b-4ed4-bd29-24a5d95fb7fb","resolution":{"observed_at":"2026-08-15T14:59:46.995923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.000410Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.000410Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:775f65057581eb059434e43a7b41143b32c260862efd9650ade647431ee7369c","observation_id":"fb2b620b-d541-4a2f-bee4-d8f87c500f09","resolution":{"observed_at":"2026-08-15T14:59:47.000410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.388565Z","title":"Journal of Memory and Language , volume =","venue":null,"work_id":"ab48af03-061a-4e8c-91bb-92d6bad06082","year":1996},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.004261Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:dea6f2bf8f9e6116cd35c745cc95277098314c225393ebdd5011ca10f4739dc5","observation_id":"3118d32f-5624-4897-a178-1c379e87f5c3","resolution":{"observed_at":"2026-08-15T14:59:47.396292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.375384Z","title":"Journal of Pragmatics , volume =","venue":null,"work_id":"b4044f94-5f39-4c3b-b5dc-47aa1905fdd8","year":2011},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.008239Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:ce537de1f98aaaac24ba7814da7e422b065a3d51326e91e518490d7a40b44a94","observation_id":"483ea1c7-2ae1-4bb8-b448-dfb23d003880","resolution":{"observed_at":"2026-08-15T14:59:47.380191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.362313Z","title":"Journal of Memory and Language , volume =","venue":null,"work_id":"0d69b9a5-1fa9-4bf4-b8cf-2ffb2221b9b4","year":1997},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.012132Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:d2c82f20bbc2c7e1480730370d0cf9ab690126cf5e250e531ddee76f0c1a3c03","observation_id":"3accaa66-b023-4a8f-a4bf-2b6ea14d83bc","resolution":{"observed_at":"2026-08-15T14:59:47.367000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.347260Z","title":"2023 , eprint =","venue":null,"work_id":"d4cf5eb6-1807-4adb-97cf-d969dca6a9c6","year":2023},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.015396Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:e0e01e348e7a85affb08f592051231e30ba3f9dfef81a9536fb84a72696a8b89","observation_id":"9080c09e-f1c8-477a-a7e6-038ee2bf2bdc","resolution":{"observed_at":"2026-08-15T14:59:47.351980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.288619Z","title":"ACM Computing Surveys , volume =","venue":null,"work_id":"0fc94ead-397c-4d50-9ab9-47ae85b6e2d8","year":2023},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.018615Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:7b4507ca094f56837c1484f36b44522aa9c57406a445b86e0c5e3e4aa4d9cb8b","observation_id":"84ce8f30-85d2-4c1b-98ab-25f406c79e26","resolution":{"observed_at":"2026-08-15T14:59:47.326154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.235109Z","title":"2024 , eprint =","venue":null,"work_id":"2227eb0c-79a0-4e90-aa1c-b2079824f254","year":2024},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.022037Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:f94c35176c1f97193934fe28c49a9736394de49966e8e8791dafa79c0cf9009d","observation_id":"229d3e3d-7141-4a66-9c50-c2380352163e","resolution":{"observed_at":"2026-08-15T14:59:47.239290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.220866Z","title":"International Journal of Computer Vision , year =","venue":null,"work_id":"bd949aa5-66dc-46c6-88bf-ce520884b95b","year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.025323Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:9dcea6f520dc4b79dff1a055ec06642936927e1dcad8753c92b158041f9263ad","observation_id":"9f8efa02-c8ed-4a29-ad08-378864c7f975","resolution":{"observed_at":"2026-08-15T14:59:47.226123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.206500Z","title":"ACM Computing Surveys , volume =","venue":null,"work_id":"005501a3-6246-4590-bbb1-f41f447b66cb","year":null},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.028917Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:89ea20634c5d21926a00644580c724fcb01af05f4ef1bd60635b698f74aadc83","observation_id":"bbfb7aac-737c-4a51-abc7-c2d4a45b3526","resolution":{"observed_at":"2026-08-15T14:59:47.211950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.032269Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.032269Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:f02319642f7dfa4821a46974bae73df06faab198b4f171ddb34272a109f23a3c","observation_id":"2b672cc1-f1ec-4c83-8a8a-f90880b52f91","resolution":{"observed_at":"2026-08-15T14:59:47.032269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:59:47.049130Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T14:59:47.049130Z"},"links":{"citing_paper":"/paper/2608.03357"},"observation_digest":"sha256:395d2c53ee45113aa101a57e22dae5d80c84dc6c156675fc666426d7527ab2b9","observation_id":"59c681c4-4ed9-4d3d-84b4-fe48513f75c3","resolution":{"observed_at":"2026-08-15T14:59:47.049130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03357","last_updated":"2026-08-04T09:05:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T05:26:05.326795Z","submitted_at":"2026-08-04T09:05:35Z","title":"Can Text-to-Image Models Draw from the Right Frame of Reference?"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":42},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2608.03357."}