{"as_of":"2026-08-11T11:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f75b1d39130101cb2340a3ae73a7f06c365cb7969d692157983b0f61f99dcd30","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:11:18.166439Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T06:38:04.459129Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T10:16:28.900795Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"cited_work":{"arxiv_id":"2501.05892","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.05892","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minxing Luo, Zixun Xia, Liaojun Chen, Zhenhang Li, Weichao Zeng, Jianye Wang, Wentao Cheng, Yaxing Wang, Yu ZHOU, and Jian Yang","venue":null,"work_id":"854b828d-89e1-4886-a090-ea2ca9a52386","year":null},"citing_paper":{"arxiv_id":"2604.28185","last_updated":"2026-04-30T17:59:02Z","snapshot_observed_at":"2026-08-10T07:23:48.304270Z","submitted_at":"2026-04-30T17:59:02Z","title":"Visual Generation in the New Era: An Evolution from Atomic Mapping to Agentic World Modeling","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-07T06:38:04.459129Z"},"links":{"cited_paper":"/paper/2501.05892","citing_paper":"/paper/2604.28185"},"observation_digest":"sha256:867c90ff19fc91cb40a71e0f3634c5d06c38b265dde06b9831cf5d70ce527faa","observation_id":"b8f0bf8d-4b90-4ec6-9ae1-bb888d1edd4d","resolution":{"observed_at":"2026-05-12T10:16:28.902953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.05892/citation-record","integrity":"/paper/2501.05892/integrity","json":"/paper/2501.05892/citation-record.json","paper":"/paper/2501.05892"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-10T21:11:17.823153Z","title":"ediff-i: Text-to-image diffusion models with ensemble of expert denoisers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.823153Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:fae0e1053d5385e2b2c9c1dfee9ba47b5ecce68bc03772b5b118265545823fe7","observation_id":"61224dee-824b-40c0-b724-de38f61286f8","resolution":{"observed_at":"2026-08-10T21:11:17.823153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:17.834208Z","title":"Text2live: Text-driven layered image and video editing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.834208Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:045146307df87e0c370c1870d03cef3351197dc70740fff43d9589b9ddca8dd5","observation_id":"4402eb00-5d8b-482c-a00e-445d1ed9956f","resolution":{"observed_at":"2026-08-10T21:11:17.834208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:19.053519Z","title":"Deep residual network for steganalysis of digital images","venue":null,"work_id":"83dad70b-1832-49b5-8c81-e6a236b08ca6","year":2019},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.842982Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:ef8292e34f781bfea32357d511792bdab7a090e17725c864b332b1b387ccacae","observation_id":"0a044e38-edaf-4bc6-b19b-d4391e88e433","resolution":{"observed_at":"2026-08-10T21:11:19.058415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:19.034472Z","title":"Freeman, Michael Ru- binstein, Yuanzhen Li, and Dilip Krishnan","venue":null,"work_id":"5a826335-bd1e-42d3-9252-352bb141f9d7","year":2023},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.855299Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:3399cc5721592cf9836567f89c81447e86aa447d45ac4513156b28e890639ad2","observation_id":"a2170505-6150-4f08-9eed-f640a332e252","resolution":{"observed_at":"2026-08-10T21:11:19.039908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:19.018200Z","title":"Textdiffuser-2: Unleashing the power of language models for text rendering","venue":null,"work_id":"2971594e-9b07-43b7-b848-8d2fb20f8296","year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.868171Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:a76366b099b914a8dfb0db13ab31a71993690fde53d89bfa3a832f577b7e9200","observation_id":"a106fa5f-bba8-4bc0-a9e8-747d8ac6493a","resolution":{"observed_at":"2026-08-10T21:11:19.023486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:19.002356Z","title":"Textdiffuser: Diffusion models as text painters","venue":null,"work_id":"c372985e-f57b-4164-8e13-b55129ad265a","year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.875395Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:77e223825d5eb3d491ece95500b8a98bc0b7a5cd0f0e3ea74442cf1ccf019b91","observation_id":"5d6bb89a-7d47-4f0d-b773-41f31f7eaa54","resolution":{"observed_at":"2026-08-10T21:11:19.007312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.987491Z","title":"Icdar2019 robust reading challenge on arbitrary-shaped text-rrc-art","venue":null,"work_id":"d4ab129a-831f-4bc0-9f94-02c71d8e6643","year":2019},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.889132Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:430f7313107c0a2d8125ec801ef03520246fbdb5803e7c29d718dc0160f3aaaa","observation_id":"c6129c61-0c11-4528-ba63-e516e24f2ee1","resolution":{"observed_at":"2026-08-10T21:11:18.991906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:17.907480Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.907480Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:63bb988e39e29950edacd30ded7933e1922d1df8386427e5b10639abea800e88","observation_id":"203b4ef0-23bd-4b25-a2fd-67c730400f9c","resolution":{"observed_at":"2026-08-10T21:11:17.907480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.957233Z","title":"Synthetic data for text localisation in natural images","venue":null,"work_id":"2975ab59-e0f7-4012-9177-77ed251392bd","year":2016},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.914353Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:bdd70b9eb142e8a9e429bcc0770740391bbc002dc914408d0484a771e8265cb5","observation_id":"851df6ef-1bf9-423f-a181-804cc3d33725","resolution":{"observed_at":"2026-08-10T21:11:18.963410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08184","last_updated":"2024-08-15T14:42:02Z","snapshot_observed_at":"2026-07-06T19:01:10.268051Z","submitted_at":"2024-08-15T14:42:02Z","title":"Not Every Image is Worth a Thousand Words: Quantifying Originality in Stable Diffusion","version":1},"cited_work":{"arxiv_id":"2408.08184","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.08184","snapshot_observed_at":"2026-08-10T21:11:18.460016Z","title":"Not Every Image is Worth a Thousand Words: Quantifying Originality in Stable Diffusion","venue":"cs.CV","work_id":"016fee8c-e9b9-499f-a50f-35600d51b4e9","year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.927258Z"},"links":{"cited_paper":"/paper/2408.08184","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:aefc5b51ae4108ce1b946a9815cc5a92f94ad3228f4d84d62dba7659bb8c1a8e","observation_id":"416a1b3c-25e4-48a2-bb3b-c42c9d38ba70","resolution":{"observed_at":"2026-08-10T21:11:18.475739Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.937557Z","title":"Clipscore: A reference-free evaluation met- ric for image captioning","venue":null,"work_id":"c004b67b-c460-4e4a-a0c6-16ff36b19fb7","year":2021},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.934877Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:6e901bb2238eae4c348f51d8e50ef921c69903b90213b206f08bbee9fc80440a","observation_id":"bea47058-20c5-4ca7-8426-86cdab3b7392","resolution":{"observed_at":"2026-08-10T21:11:18.942963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.904378Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"c652c5ac-3e12-4fd8-9512-db13b25c9c0c","year":2020},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.941427Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:676ea0499b069203f7bbfdfbc2c7bd64a20c9845b8a103cab33b7f031cd571bb","observation_id":"2fdf5444-e134-4a93-ac71-7f56fc8217b6","resolution":{"observed_at":"2026-08-10T21:11:18.917186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:17.946803Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.946803Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:2570b0ea0b39c8c8876b47a9adffe450616be3c20159d543a9b2665b4f6ef462","observation_id":"64ee57be-c622-4ce1-afef-d292910b48bb","resolution":{"observed_at":"2026-08-10T21:11:17.946803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.870081Z","title":"Kingma and Max Welling","venue":null,"work_id":"989efac6-392d-46f5-bbb4-a470717ecde6","year":2014},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.953485Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:035b4e8d1c976608aa7438d15586ae128317ee205676778fd36279675cc38dfc","observation_id":"7634cda3-8b92-416e-a767-6b1160916106","resolution":{"observed_at":"2026-08-10T21:11:18.875394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.851961Z","title":"Textstylebrush: transfer of text aes- thetics from a single example","venue":null,"work_id":"025dd387-19e4-483c-a73d-3460cc6197be","year":2023},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.961993Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:959f9d5cc2cb8f45e2b38e45ae45c38157f6c025bf3fdef2d280f52d355579bc","observation_id":"fc12963f-5704-4fd7-a87f-2db582c6068f","resolution":{"observed_at":"2026-08-10T21:11:18.857001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.833584Z","title":"Imagenet classification with deep convolutional neural net- works","venue":null,"work_id":"24b88a75-acea-4a07-a5ba-4701a4841ff0","year":2012},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.969131Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:928cda279208984d0fc198c8e86b732c75494e737516c81557f3b28f72233218","observation_id":"66525582-f2cc-4ae3-9c27-9b6e64060195","resolution":{"observed_at":"2026-08-10T21:11:18.839531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10562","last_updated":"2023-05-03T16:36:38Z","snapshot_observed_at":"2026-08-10T22:26:01.663367Z","submitted_at":"2022-12-20T18:59:23Z","title":"Character-Aware Models Improve Visual Text Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10562","snapshot_observed_at":"2026-08-10T21:11:17.976636Z","title":"Character-aware models improve visual text rendering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.976636Z"},"links":{"cited_paper":"/paper/2212.10562","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:e32e0e70e3a144bc365eaf00864c81538c5f8167c7e26c042bc28d33e7f7084f","observation_id":"4affcd15-f9ee-415e-9802-a7212f3c855a","resolution":{"observed_at":"2026-08-10T21:11:17.976636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.815145Z","title":"Character-aware models improve visual text rendering","venue":null,"work_id":"dfb20f8e-7aca-4051-a25d-2d112a0c650f","year":null},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.982995Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:15d31b659fa057f0f4c95a036121d89d0459f686a777a1cf723552519215990c","observation_id":"ac81119e-0271-421e-8eec-fa2e035ad798","resolution":{"observed_at":"2026-08-10T21:11:18.821910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09622","last_updated":"2024-07-12T16:39:31Z","snapshot_observed_at":"2026-07-06T17:44:45.924645Z","submitted_at":"2024-03-14T17:55:33Z","title":"Glyph-ByT5: A Customized Text Encoder for Accurate Visual Text Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09622","snapshot_observed_at":"2026-08-10T21:11:17.988407Z","title":"Glyph-byt5: A customized text encoder for accurate visual text rendering.arXiv preprint arXiv:2403.09622, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.988407Z"},"links":{"cited_paper":"/paper/2403.09622","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:13808c6aacf99f0d71ddcbf1ca8beedd2e89afc1297222d02d7ced00859c7831","observation_id":"b1c2c6bb-e44a-4fc5-950d-8c1abf87ee4a","resolution":{"observed_at":"2026-08-10T21:11:17.988407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10208","last_updated":"2024-07-12T16:26:40Z","snapshot_observed_at":"2026-08-08T01:13:28.144737Z","submitted_at":"2024-06-14T17:44:09Z","title":"Glyph-ByT5-v2: A Strong Aesthetic Baseline for Accurate Multilingual Visual Text Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10208","snapshot_observed_at":"2026-08-10T21:11:17.995810Z","title":"Glyph-byt5-v2: A strong aesthetic base- line for accurate multilingual visual text rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:17.995810Z"},"links":{"cited_paper":"/paper/2406.10208","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:76e8dc56e610e88b01dfe81ccbbe8291770872ba9b057008ecfe869800f9a07c","observation_id":"91295d7e-aaf2-44bd-85fb-caab9687ce22","resolution":{"observed_at":"2026-08-10T21:11:17.995810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17870","last_updated":"2023-05-23T04:07:00Z","snapshot_observed_at":"2026-08-10T12:28:15.079045Z","submitted_at":"2023-03-31T08:06:33Z","title":"GlyphDraw: Seamlessly Rendering Text with Intricate Spatial Structures in Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17870","snapshot_observed_at":"2026-08-10T21:11:18.001987Z","title":"Glyphdraw: Seamlessly ren- dering text with intricate spatial structures in text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.001987Z"},"links":{"cited_paper":"/paper/2303.17870","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:8f839482525d51362afeeae72c9506705ce9c562eeb33033ac65bb61bf497632","observation_id":"e4399a34-47c4-4e9b-83fc-faf7accc340c","resolution":{"observed_at":"2026-08-10T21:11:18.001987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01366","last_updated":"2024-10-02T09:28:21Z","snapshot_observed_at":"2026-07-06T19:25:48.444990Z","submitted_at":"2024-10-02T09:28:21Z","title":"Harnessing the Latent Diffusion Model for Training-Free Image Style Transfer","version":1},"cited_work":{"arxiv_id":"2410.01366","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.01366","snapshot_observed_at":"2026-08-10T21:11:18.338808Z","title":"Harnessing the Latent Diffusion Model for Training-Free Image Style Transfer","venue":"cs.CV","work_id":"ac98b272-741d-454b-b640-1e2476227b9e","year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.008143Z"},"links":{"cited_paper":"/paper/2410.01366","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:9039b084e67e2be01c41b74f54a9c8dd1c98fbc4c3da7ff69c3a87c13182e95e","observation_id":"770a3642-4b50-4d1a-b5a5-f316313e74dc","resolution":{"observed_at":"2026-08-10T21:11:18.353995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.013779Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.013779Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:e0c538d00f1702fc2c451e3c000578060d5e1637d06e4c7496476d68bade28c0","observation_id":"00eeee0c-1bbb-47c8-9547-489f3af8eb95","resolution":{"observed_at":"2026-08-10T21:11:18.013779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11432","last_updated":"2024-06-17T11:37:48Z","snapshot_observed_at":"2026-08-09T17:46:32.953063Z","submitted_at":"2024-06-17T11:37:48Z","title":"AnyTrans: Translate AnyText in the Image with Large Scale Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11432","snapshot_observed_at":"2026-08-10T21:11:18.021098Z","title":"Any- trans: Translate anytext in the image with large scale models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.021098Z"},"links":{"cited_paper":"/paper/2406.11432","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:98e9727ee11979d15d2afd5751e67882887d962960ef20932cf0ee81c47e2268","observation_id":"9e716a7d-17d9-4491-a2ba-39e86caf8b6c","resolution":{"observed_at":"2026-08-10T21:11:18.021098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.770803Z","title":"Exploring stroke-level mod- ifications for scene text editing","venue":null,"work_id":"1608ec09-f211-44bd-b3f9-f8f0ba98c0ce","year":2023},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.027828Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:c5b1a59f60fc0adce2611754bfbda381e0c6db8eb10d4c191e5da0b5b6ba827f","observation_id":"d145bef1-1740-4064-853d-324c3b25c2e9","resolution":{"observed_at":"2026-08-10T21:11:18.780333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.033246Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.033246Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:de6c8d292913016dfecfd3d91f34ee20ff968946daee88ce5e316d5e4c33ba3c","observation_id":"61d6d7fd-aba7-445a-94ce-35cee7e27ef6","resolution":{"observed_at":"2026-08-10T21:11:18.033246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.039126Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.039126Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:69f96cd0ebe18f440cf74bd0cecc10a8a181ca7bd845518609b4941bd10c2b36","observation_id":"8a7c93df-23f3-48b3-ae28-115c19fa33b2","resolution":{"observed_at":"2026-08-10T21:11:18.039126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.045092Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.045092Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:c66d6bfb7b4d800b169387d37a679a1b8fa9744e776ba62a301b540475bb8018","observation_id":"e98478b9-50dc-4f6f-8d84-3772bcdc678d","resolution":{"observed_at":"2026-08-10T21:11:18.045092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-10T21:11:18.050484Z","title":"Hierarchical text-conditional image gen- eration with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.050484Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:e61f88bb9de5418423b726ef4d89112841820aa65b26d729d233ff9bdbc73c24","observation_id":"b48ce467-ae2c-472f-b888-a5bc95ad074a","resolution":{"observed_at":"2026-08-10T21:11:18.050484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.055906Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.055906Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:3a3cdb7da8ddc20d6fbafd6c67757c7bb48d27f47a054c90cf2ed441070d4c6b","observation_id":"a37823f5-276e-4cee-8b89-c2642271cb2f","resolution":{"observed_at":"2026-08-10T21:11:18.055906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.065715Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.065715Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:17a5e9fcfbf43dcde511e7a832d682b5f80ed97c0f4da090a78c7b9d466fd2b7","observation_id":"462d16f2-af60-415a-8b88-df8d73956c3b","resolution":{"observed_at":"2026-08-10T21:11:18.065715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.689263Z","title":"Norm-guided latent space exploration for text-to-image generation","venue":null,"work_id":"7e841ad4-65f9-4a96-874f-4099edfbb548","year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.071905Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:2eaa55d5bc4fb02ccaf645bbef7d2a3b5da165b81117bc684c4808c8c459fc0c","observation_id":"991e92ed-fcd5-4b8c-a61a-415483802973","resolution":{"observed_at":"2026-08-10T21:11:18.695781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-10T21:11:18.077584Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.077584Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:309b19e7939bfb160b9d203d67dd00ce2fd0ada610c266a2f6c035b69f210494","observation_id":"83977572-990c-4634-9f61-5e66a738bd80","resolution":{"observed_at":"2026-08-10T21:11:18.077584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.083651Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.083651Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:f796f234686ce7e3cca643e95530c9f3b45de483fbeaa56cea3c66ea26eb21da","observation_id":"a02d2e02-e3be-4450-b176-c317370a48e2","resolution":{"observed_at":"2026-08-10T21:11:18.083651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.657737Z","title":"Strive: Scene text re- placement in videos","venue":null,"work_id":"92b76ddf-faa8-4467-9ad0-ce5d606c85b7","year":2021},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.089550Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:aa40ab1f09a92faef0cb26558edf0b71fabcd953c91f500d680e30637be4d3b5","observation_id":"c172b4dd-29e9-4802-93b8-c618aae8b693","resolution":{"observed_at":"2026-08-10T21:11:18.663230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.633187Z","title":"Anytext: Multilingual visual text genera- tion and editing","venue":null,"work_id":"51cca2c7-ba3c-475b-9752-0ae38b8336b8","year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.095296Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:cd460061758b0f1591f2c1cebe21bd4f4f3c469bf6b58b37f27c57a14525eabb","observation_id":"06df9dd6-cd23-48a2-bcb8-5c4909a4c3c9","resolution":{"observed_at":"2026-08-10T21:11:18.637915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.614680Z","title":"Swaptext: Image based texts transfer in scenes","venue":null,"work_id":"39f2d7ad-e9cf-4dfb-bb86-7483d588d290","year":2020},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.101785Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:5737c7cad288b649b9e97edaa6d0d861792d51f1f840fc304705ff48b459e61a","observation_id":"5a4aa84c-9e8c-48ff-9c25-cbcac6b7187b","resolution":{"observed_at":"2026-08-10T21:11:18.620060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.595151Z","title":"Glyphcontrol: Glyph conditional control for visual text generation","venue":null,"work_id":"f03da69f-1b84-4b87-99cb-5479fe815a75","year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.109293Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:a54a010db3accf6d9c6e6c7f44a4d9d978e281b6a7dea7908e9bb08df57f753c","observation_id":"39ad6146-6d4d-4307-a068-7a13d9b384c0","resolution":{"observed_at":"2026-08-10T21:11:18.600951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11502","last_updated":"2024-07-21T08:22:18Z","snapshot_observed_at":"2026-08-09T17:39:24.592940Z","submitted_at":"2024-07-16T08:40:21Z","title":"How Control Information Influences Multilingual Text Image Generation and Editing?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11502","snapshot_observed_at":"2026-08-10T21:11:18.114418Z","title":"How control information influences multilingual text image generation and editing? arXiv preprint arXiv:2407.11502 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.114418Z"},"links":{"cited_paper":"/paper/2407.11502","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:02280ffe651f3860b81d2f9de193e10b9c8be91c135292a8184108338f4dd8dc","observation_id":"4924917b-7719-4020-8c73-dee73df4e099","resolution":{"observed_at":"2026-08-10T21:11:18.114418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.136890Z","title":"Adding conditional control to text-to-image diffusion models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.136890Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:3e37b63edbb0f8b4206ce3243304d4db4e61f4cdbb8e8627715be6335030831b","observation_id":"821d20b5-11ff-4b1d-9966-c8d552b4a857","resolution":{"observed_at":"2026-08-10T21:11:18.136890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.540448Z","title":"Brush your text: Synthesize any scene text on im- ages via diffusion model","venue":null,"work_id":"3dcea4b1-f6a3-4037-8c98-29ef98873d1c","year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.145292Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:57faf74261ec6e88236dec9fbc54851121a5cc6bb514a01f138292ae997ef078","observation_id":"3461ae20-5a5e-4d43-962e-a1f429909ce2","resolution":{"observed_at":"2026-08-10T21:11:18.557015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:11:18.519666Z","title":"Harmonizing visual text comprehension and gen- eration","venue":null,"work_id":"c1aba83d-d961-4a31-93ee-3d84bab72029","year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.154472Z"},"links":{"citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:4b0d7d32ff8dd26ef8af73a80006e6201bff6bfb16d8f1f02aca1eac0111e5f6","observation_id":"f4b7c466-ab35-40b7-86f4-3bd223b8474f","resolution":{"observed_at":"2026-08-10T21:11:18.525343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14138","last_updated":"2024-11-03T08:12:57Z","snapshot_observed_at":"2026-08-11T09:19:02.579077Z","submitted_at":"2024-07-19T09:08:20Z","title":"Visual Text Generation in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14138","snapshot_observed_at":"2026-08-10T21:11:18.166439Z","title":"Visual text generation in the wild","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T21:11:18.166439Z"},"links":{"cited_paper":"/paper/2407.14138","citing_paper":"/paper/2501.05892"},"observation_digest":"sha256:48cb2471b4a81bac4ddb0a526285638e7bf65d59482fffeae62d181c8e023c6c","observation_id":"07fd8397-1fae-426e-b2e0-6c2c97a885fd","resolution":{"observed_at":"2026-08-10T21:11:18.166439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.05892","last_updated":"2025-03-22T14:01:54Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T21:04:01.431790Z","submitted_at":"2025-01-10T11:44:59Z","title":"Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":2,"verified_fuzzy":20},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2501.05892."}