{"as_of":"2026-08-21T12:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f0d9c8e72ae0991196c49e9074e32d3a72758b32406cf541f42e31829ad9bfed","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:23:11.383961Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.04915/citation-record","integrity":"/paper/2505.04915/integrity","json":"/paper/2505.04915/citation-record.json","paper":"/paper/2505.04915"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:12.059127Z","title":"Diffute: Universal text editing diffusion model","venue":null,"work_id":"3447aaf2-0351-439f-913e-4590ec490ba2","year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.237434Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:7d24fe2f41e14d82e77e4873ca4329890958431a15d9b17d5d349b1b64291614","observation_id":"0e3dc75b-d359-4a4b-99ac-6c66535622e8","resolution":{"observed_at":"2026-08-15T23:23:12.063612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:12.044815Z","title":"Textdiffuser: Diffusion models as text painters","venue":null,"work_id":"77000a62-c6c9-4343-8632-752b461c34e4","year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.242417Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:43522752265240c4bf772a1df43e8c0f8a346b076cbc7c837fb6695b5dff70f3","observation_id":"5abfa989-41c8-4547-a782-fc69b4ba6ab1","resolution":{"observed_at":"2026-08-15T23:23:12.048976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:12.030084Z","title":"Goodfellow, Jean Pouget-Abadie, Mehdi Mirza, Bing Xu, David Warde-Farley, Sherjil Ozair, Aaron C","venue":null,"work_id":"1473499c-cf0a-42d8-bcd2-f96d3fdb4ed7","year":2014},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.247287Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:257eb62c320857f4e777054c36c711088e4810789799751e6bfc7669b3e996ce","observation_id":"76f5b745-6559-4af9-b0f9-489b2a82e690","resolution":{"observed_at":"2026-08-15T23:23:12.034894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:12.013543Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"808759e1-14df-4ec5-9ad3-ba9964e986cc","year":2020},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.252053Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:0c35e92dd3ad4714e2eae8bca61e5ce2f95d31b0b3254fdcc4713e3c0ae23fa1","observation_id":"1b383709-2e2a-4679-b9aa-0ef99a7c7040","resolution":{"observed_at":"2026-08-15T23:23:12.019579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.09649","last_updated":"2022-07-20T04:42:47Z","snapshot_observed_at":"2026-08-21T07:53:18.288820Z","submitted_at":"2022-07-20T04:42:47Z","title":"GenText: Unsupervised Artistic Text Generation via Decoupled Font and Texture Manipulation","version":1},"cited_work":{"arxiv_id":"2207.09649","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.09649","snapshot_observed_at":"2026-08-15T23:23:11.536976Z","title":"GenText: Unsupervised Artistic Text Generation via Decoupled Font and Texture Manipulation","venue":"cs.CV","work_id":"9bd62891-19b6-47cb-be0e-9a035d1ad61e","year":2022},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.256901Z"},"links":{"cited_paper":"/paper/2207.09649","citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:8e5c232c3babefbde3dd0a1af52c7ad25d1373570d6c9064124f11367db24368","observation_id":"3784257f-34e0-47bc-91f5-1f573ab2d8cd","resolution":{"observed_at":"2026-08-15T23:23:11.542066Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05568","last_updated":"2023-04-12T02:08:34Z","snapshot_observed_at":"2026-08-18T18:26:59.716238Z","submitted_at":"2023-04-12T02:08:34Z","title":"Improving Diffusion Models for Scene Text Editing with Dual Encoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05568","snapshot_observed_at":"2026-08-15T23:23:11.262141Z","title":"Improving diffusion models for scene text editing with dual encoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.262141Z"},"links":{"cited_paper":"/paper/2304.05568","citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:a2d87bc1bbec31e9f33c66757b895a6db91cdabeaa9a3bfb28fa1cf6a62717fc","observation_id":"5a3cd16d-0977-4246-b2ee-55547c357884","resolution":{"observed_at":"2026-08-15T23:23:11.262141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.267820Z","title":"Kingma and Max Welling","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.267820Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:c0d50b1eb2f0171e7eb5b6d6738642b30d8350728e47adb0d03274e81d5b8c0b","observation_id":"6e954775-8386-4a14-9fe4-e6d75b629930","resolution":{"observed_at":"2026-08-15T23:23:11.267820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.11041","last_updated":"2022-05-02T11:30:26Z","snapshot_observed_at":"2026-08-18T18:26:02.590333Z","submitted_at":"2021-07-23T06:32:58Z","title":"RewriteNet: Reliable Scene Text Editing with Implicit Decomposition of Text Contents and Styles","version":2},"cited_work":{"arxiv_id":"2107.11041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2107.11041","snapshot_observed_at":"2026-08-15T23:23:11.489599Z","title":"RewriteNet: Reliable Scene Text Editing with Implicit Decomposition of Text Contents and Styles","venue":"cs.CV","work_id":"35cfc999-c763-46d8-9c51-dab4d39444d2","year":2021},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.273184Z"},"links":{"cited_paper":"/paper/2107.11041","citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:89b32370ef5de6dc1ffae41efff8eae51475a6cf8213d9a8d679a6f9d250f2b5","observation_id":"98f6e1e0-5131-4951-a95f-cbef3cd6eda2","resolution":{"observed_at":"2026-08-15T23:23:11.497349Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.987639Z","title":null,"venue":null,"work_id":"59f25b89-23f9-470c-ab42-a6c8442ad478","year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.278190Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:1d3df18e87edf60a293dee535f16ec2fa13f4d3eeccd45eda5035c3ef093949d","observation_id":"94fc53aa-326e-4094-b3c0-ea04d21892ea","resolution":{"observed_at":"2026-08-15T23:23:11.992060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.971341Z","title":"Girshick, Kaiming He, Bharath Hariharan, and Serge J","venue":null,"work_id":"85781418-f6eb-4947-91da-9e272aae75a8","year":2017},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.282345Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:606fb5e957172482b4b5b8deef8bc75855b2715ae5799ec2d5863c13da5c41e1","observation_id":"69875f64-679f-436f-abb7-0d320e9595e8","resolution":{"observed_at":"2026-08-15T23:23:11.977062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17870","last_updated":"2023-05-23T04:07:00Z","snapshot_observed_at":"2026-08-18T18:23:41.968310Z","submitted_at":"2023-03-31T08:06:33Z","title":"GlyphDraw: Seamlessly Rendering Text with Intricate Spatial Structures in Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17870","snapshot_observed_at":"2026-08-15T23:23:11.286512Z","title":"Glyphdraw: Learning to draw chinese characters in image synthesis models coher- ently.CoRR, abs/2303.17870, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.286512Z"},"links":{"cited_paper":"/paper/2303.17870","citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:a711ae47d4148c9d1cf1524c2908f48c2a98ce734627860207784166ebb79a28","observation_id":"aec91b42-8f6e-42ca-aebe-0595284d1858","resolution":{"observed_at":"2026-08-15T23:23:11.286512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.955249Z","title":"PP-OCRv4.https://github.com/ PaddlePaddle/PaddleOCR/blob/release/2.7/ doc/doc_ch/PP-OCRv4_introduction.md, 2023","venue":null,"work_id":"03305edd-9abb-41b8-bee6-18e59b377fc0","year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.290956Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:757000d126b9e778c40b4cd6b603ba23e67c93fb2795bd740b6feea5de795e2e","observation_id":"50bf340d-46f8-44a4-8faf-9bedc47c6b3e","resolution":{"observed_at":"2026-08-15T23:23:11.960469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.939649Z","title":"Exploring stroke-level modifi- cations for scene text editing","venue":null,"work_id":"70676df8-5952-45ee-a8ff-6c29341b44af","year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.295277Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:4592d1f7b51c1528a247535dffdf09c311f03417c5c76e305200a614e59262e8","observation_id":"9b046cae-df6e-4393-ae3a-9593d58e6a8f","resolution":{"observed_at":"2026-08-15T23:23:11.944742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.299187Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.299187Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:5c331179c1b8aa72a8d69ceeeb3384d13beeb824b5f94cd76fd1bf1cd6f06d82","observation_id":"80996bdf-9a5a-4fe8-95cb-b6f3a49f98ec","resolution":{"observed_at":"2026-08-15T23:23:11.299187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.913055Z","title":null,"venue":null,"work_id":"31af9db0-91e6-45af-a289-c94ecd1df837","year":2020},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.303190Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:357fc7a93bcc0abe909d91b28d10cb7ae6adad4ca44cffa3f3d9226212171336","observation_id":"253f8d9a-481f-472d-84e7-2de2ff73f51c","resolution":{"observed_at":"2026-08-15T23:23:11.918387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.896613Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"8a6c52e0-7993-40a1-8ae9-cfbe5ab99676","year":2022},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.307242Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:5404cb1965e204e7bd54d3ddcfe5dc20b77cb8dd3f4be7aa66a3351a9d6aa0ff","observation_id":"c8df7d87-268e-48fd-b2c0-f973e802a361","resolution":{"observed_at":"2026-08-15T23:23:11.902263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.311063Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.311063Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:59bdf7b71b2010b7a4f3f094711a25035f503c7f1eb6f60d6ee9a5545707802e","observation_id":"ec1f6557-f284-408b-a097-f9422d875a77","resolution":{"observed_at":"2026-08-15T23:23:11.311063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.870067Z","title":"STEFANN: scene text editor using font adap- tive neural network","venue":null,"work_id":"157167e4-482d-4d9f-a5d9-da9f6c2d3a03","year":2020},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.315009Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:3efb513b288cbe0f21296c0778b2dd66de1398bfd614866aa38c63e497bbd4cd","observation_id":"58142579-018d-46da-9093-5e15be34c534","resolution":{"observed_at":"2026-08-15T23:23:11.875985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.318880Z","title":"pytorch-fid: FID Score for PyTorch","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.318880Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:8d214422bf8407efe99a1895c7bd778a3ca015b4363c65d84668e7ab575e4bcd","observation_id":"abe11e36-865e-4c30-80d6-943d873788c0","resolution":{"observed_at":"2026-08-15T23:23:11.318880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.04108","last_updated":"2022-04-12T14:31:47Z","snapshot_observed_at":"2026-08-14T16:07:32.699184Z","submitted_at":"2019-07-09T12:17:03Z","title":"Scaling Limit of Neural Networks with the Xavier Initialization and Convergence to a Global Minimum","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.04108","snapshot_observed_at":"2026-08-15T23:23:11.322748Z","title":"Sirignano and Konstantinos Spiliopoulos","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.322748Z"},"links":{"cited_paper":"/paper/1907.04108","citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:69a2cc6d36aee7b0e9140d9a1702a52d6d5e496cd01894aae976a45b5b476efd","observation_id":"5f781628-15fd-402a-a363-be4b156c1025","resolution":{"observed_at":"2026-08-15T23:23:11.322748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.843674Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":"5fa1a8ff-53c9-4d7a-98cd-f50e6ec323d6","year":2021},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.327132Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:361eb260c8012dfbbc74d793ba1fb9e7aea782dccbb5eb7197c34673823e8557","observation_id":"310e7418-6ee8-44d5-a10a-ea96509f17d9","resolution":{"observed_at":"2026-08-15T23:23:11.849042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-17T06:56:20.644738Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-15T23:23:11.331006Z","title":"Roformer: Enhanced transformer with rotary position embedding.CoRR, abs/2104.09864, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.331006Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:54f46aacb3e653a7304cc723109351daf304f6f75e61e68d41143dc1632e0e41","observation_id":"0c57bd37-2eee-4f2d-9f15-0c010f1ae783","resolution":{"observed_at":"2026-08-15T23:23:11.331006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.825343Z","title":"Resolution-robust large mask inpainting with fourier convolutions","venue":null,"work_id":"074dad4b-f35c-4db6-8fe0-b99cfc3243b1","year":2022},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.335203Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:45e8cf677a9418f98fa2c00b1d2c04460875195b2210dd58580d5d85e66f27d0","observation_id":"75c9b389-1fce-4c5a-9d38-34d02d2f76f0","resolution":{"observed_at":"2026-08-15T23:23:11.831798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03054","last_updated":"2024-02-21T07:12:45Z","snapshot_observed_at":"2026-08-18T18:25:23.717451Z","submitted_at":"2023-11-06T12:10:43Z","title":"AnyText: Multilingual Visual Text Generation And Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03054","snapshot_observed_at":"2026-08-15T23:23:11.339291Z","title":"Anytext: Multilingual visual text gen- eration and editing.CoRR, abs/2311.03054, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.339291Z"},"links":{"cited_paper":"/paper/2311.03054","citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:7164e9feb77a00551e332b59a09aff64a74ddae641dab5d07d7bf045df7c2fd6","observation_id":"830a5235-cc5e-4aaf-839e-f94c4be5d1a0","resolution":{"observed_at":"2026-08-15T23:23:11.339291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.808811Z","title":"Anytext: Multilingual visual text genera- tion and editing","venue":null,"work_id":"e63a1cd0-e77c-4934-b107-94251b3dff00","year":2024},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.343189Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:d9fe12674bbd1a7a7f3605165fe543f876dc876520ef4d5ef813be032abddd35","observation_id":"b0c9fa13-c653-414d-9b13-aa25b976466f","resolution":{"observed_at":"2026-08-15T23:23:11.813723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.794004Z","title":"Editing text in the wild","venue":null,"work_id":"c248944d-788c-4617-a027-d33b33cc5ee7","year":2019},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.346895Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:11debe5cc04d8b9219ec0c8b256a28c7c41f0b6c3c64e6815951f2c6033e17cb","observation_id":"84569056-b5c3-4e07-af6a-fba5c29aeb75","resolution":{"observed_at":"2026-08-15T23:23:11.798499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.778970Z","title":"Swaptext: Image based texts transfer in scenes","venue":null,"work_id":"d44456fc-6136-4243-a899-30ef0ca46644","year":2020},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.350594Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:4b1eb5bf079dc6862748fdebafd2af51ab01f098cb3b5c268bcd0444553580e4","observation_id":"66face7b-8424-4621-aba3-3cd471e1dae5","resolution":{"observed_at":"2026-08-15T23:23:11.783868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.764519Z","title":"Glyphcontrol: Glyph conditional control for visual text generation","venue":null,"work_id":"6763fc3b-1a8c-447b-8bdc-21d279461b66","year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.355020Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:98669853e158952e0395f9f2314285ea46f00f3225f623443befe6e904c3373d","observation_id":"16f40e47-d28c-4e25-b53f-692a3a466d4e","resolution":{"observed_at":"2026-08-15T23:23:11.769170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.748006Z","title":"Textctrl: Diffusion-based scene text editing with prior guidance control","venue":null,"work_id":"3ef9ef34-ca17-4726-82f9-bfa264454ec4","year":2024},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.360166Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:0fc92606a9805e3462cadafe2eb5ab055852c8c316888cc563ce4020e470f21f","observation_id":"b0bf9f46-fcd6-4b52-98ee-87b0ad335e8c","resolution":{"observed_at":"2026-08-15T23:23:11.753742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.365002Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.365002Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:129a456fe3bafff7d67402bb17fad3f95def11daa777cc536ed2ffff4ac5f415","observation_id":"49cc4e3e-af36-4e76-9535-c3bfd3444640","resolution":{"observed_at":"2026-08-15T23:23:11.365002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.721402Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"f59e542f-9689-46fd-8daf-6639355005df","year":2018},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.369626Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:9dcf0e3043e7c68ceb65dbca7246902b70eb2e8f7d1ae34a89bcf8f1bb78d165","observation_id":"3cd61570-73aa-4523-98be-a50258ac0bca","resolution":{"observed_at":"2026-08-15T23:23:11.726524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.705300Z","title":null,"venue":null,"work_id":"f40b4253-2710-4860-bf20-42e44e80aa52","year":null},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.374290Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:23fe32b640c1f355f58a5b148e19caa0cdd1e94f95e01e42346dad1b671d8271","observation_id":"7cadd911-bd90-4821-963b-187761d9585c","resolution":{"observed_at":"2026-08-15T23:23:11.710481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.687660Z","title":"In such scenarios, the model struggles to maintain coherent text generation, resulting in irregu- larly sized characters and occasional repetition patterns in the output","venue":null,"work_id":"1dca0522-e043-45b5-b248-996161f76f60","year":null},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.379490Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:2cf47f24848eeed293cb0da1b5bd2bf470f9f3952509f37475fb813f2f750109","observation_id":"6b780010-dd29-4407-b7d4-1c44a38cdb6f","resolution":{"observed_at":"2026-08-15T23:23:11.693085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:23:11.672503Z","title":"Learning","venue":null,"work_id":"7a1d8869-27bd-41dd-b263-b43fffc27d17","year":null},"citing_paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:23:11.383961Z"},"links":{"citing_paper":"/paper/2505.04915"},"observation_digest":"sha256:651c4eb2b20b42dc394783a0cfeba7addb38e752cf64054f66c50cb013bc7885","observation_id":"2e19879f-d9fa-488e-814f-6c0609489df7","resolution":{"observed_at":"2026-08-15T23:23:11.677087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.04915","last_updated":"2025-05-08T03:11:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T18:24:53.840867Z","submitted_at":"2025-05-08T03:11:58Z","title":"GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":19},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2505.04915."}