{"as_of":"2026-08-08T20:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cdce15d17775a4f18ee735079d0b7194b77a2a940c7bf2ea0c61ccc3d8f9dbe4","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:34:31.078496Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.18479/citation-record","integrity":"/paper/2505.18479/integrity","json":"/paper/2505.18479/citation-record.json","paper":"/paper/2505.18479"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:32.057218Z","title":"Textdiffuser: Diffusion models as text painters","venue":null,"work_id":"30a5f99e-317d-4dbb-b288-df506396fa5e","year":2023},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:28.968359Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:c8dbb9b438ace38d239ab89fac97a2943eb8658f59f17f737b24ff21909b64c1","observation_id":"3e739bc4-839c-4a69-a928-e320a4952987","resolution":{"observed_at":"2026-08-07T14:34:32.062054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:32.043054Z","title":"Textdiffuser-2: Unleashing the power of language models for text rendering","venue":null,"work_id":"9defa14b-625e-4bc5-8428-1cf3f048c07b","year":2024},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:29.075318Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:f0703b9f464daace6208697dae27eefd9004bbfa8973182491f8ec9222239219","observation_id":"1ea36686-6ded-4be0-9fda-b385dd96ef3a","resolution":{"observed_at":"2026-08-07T14:34:32.047690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:32.026798Z","title":"Total-text: Towards orientation robustness in scene text detection","venue":null,"work_id":"336c26e1-f80f-4b0f-99ed-1ae5bcefe887","year":2020},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:29.179771Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:4989c7721c7133955fa674f133874c82194b9a4717b4c7f799db444e2d601b1c","observation_id":"78c10954-5d61-4a57-b308-3f1e224ff993","resolution":{"observed_at":"2026-08-07T14:34:32.032356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:32.014178Z","title":"Synthetic data for text localisation in natural images","venue":null,"work_id":"697f6324-f895-40a8-8094-b002251aa8bd","year":2016},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:29.319157Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:ec213e0534044359a910e23a640319ce62a1a9a21fe45f07ec822233240dff5f","observation_id":"d5e868c1-378d-4f6a-800c-1f9bd33c9dae","resolution":{"observed_at":"2026-08-07T14:34:32.018238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.997935Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"121749f0-dd44-411a-a1f4-f196d2b371dd","year":2017},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:29.427173Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:7edd53a3aefb4fa8c1e22db30b8479b4beb53901eb87e99b72a53988013ddaa2","observation_id":"d1df7d68-4974-45a6-b603-ea88d8ec5013","resolution":{"observed_at":"2026-08-07T14:34:32.002633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.979848Z","title":"Reading text in the wild with convo- lutional neural networks","venue":null,"work_id":"0ad87663-d257-44b6-8500-f08bb44ab793","year":2016},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:29.505762Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:4526ce62764fdc3e5a1b4aa594fa5aaaaa6d0aba59083df9bd814ea06d246d6b","observation_id":"148c9b46-90c6-4f2e-84f0-40bddeba422d","resolution":{"observed_at":"2026-08-07T14:34:31.984826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.964555Z","title":"Icdar 2013 robust reading competition","venue":null,"work_id":"93289960-637e-406b-9a98-26c17e637134","year":2013},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:29.639621Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:96b5f774b87e999f3055274d71d35b5a784e778c787a32f067f839a23dcd4d66","observation_id":"f9f4ba6b-6943-4de3-b7df-716bb9e3db07","resolution":{"observed_at":"2026-08-07T14:34:31.969906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10168","last_updated":"2024-10-14T05:23:43Z","snapshot_observed_at":"2026-07-06T19:32:51.287674Z","submitted_at":"2024-10-14T05:23:43Z","title":"First Creating Backgrounds Then Rendering Texts: A New Paradigm for Visual Text Blending","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10168","snapshot_observed_at":"2026-08-07T14:34:29.759283Z","title":"First creating backgrounds then rendering texts: A new paradigm for visual text blending","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:29.759283Z"},"links":{"cited_paper":"/paper/2410.10168","citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:9666e09979f8b1e79c2d794d147107dcbce8cb565ac2ab365a2667ac49c084f5","observation_id":"3dd92ce7-ffa1-4995-8a10-e7cbf894daee","resolution":{"observed_at":"2026-08-07T14:34:29.759283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.944247Z","title":"Synthtext3d: synthesizing scene text images from 3d virtual worlds","venue":null,"work_id":"8b8dbaf1-667e-4320-833f-d16ed98b4cb5","year":2020},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:29.888346Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:8e9737802460e1fa63113e62c5ab9be45b33695cda901d2c5ad9625650b7c926","observation_id":"3ad540e2-bd67-4a4f-a961-8662ff68ae7d","resolution":{"observed_at":"2026-08-07T14:34:31.948875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.928708Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"6240370c-228c-40af-a5c3-44e1f9e93c97","year":2014},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:29.992661Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:c25eb8c007fdab5c7a5d83c3352a32825514e25cb49ba133d5bd7e564b14d1cf","observation_id":"e8bd3642-92e1-4173-b8ae-17258fd5a26a","resolution":{"observed_at":"2026-08-07T14:34:31.933584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.913576Z","title":"Icdar 2023 competition on hierarchical text detec- tion and recognition","venue":null,"work_id":"99a2c136-c1dd-4fe6-a2d2-fa01b41b65fb","year":2023},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:30.096989Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:fba6e7c322320a6eb8ae152682988d7ea8ae6cec7af0b8f6a20f227ffb005adb","observation_id":"538675bd-2dcf-42c9-8406-5466b4832ee5","resolution":{"observed_at":"2026-08-07T14:34:31.919721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17870","last_updated":"2023-05-23T04:07:00Z","snapshot_observed_at":"2026-08-07T22:11:51.398507Z","submitted_at":"2023-03-31T08:06:33Z","title":"GlyphDraw: Seamlessly Rendering Text with Intricate Spatial Structures in Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17870","snapshot_observed_at":"2026-08-07T14:34:30.208414Z","title":"Glyph- draw: Seamlessly rendering text with intricate spatial structures in text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:30.208414Z"},"links":{"cited_paper":"/paper/2303.17870","citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:43ff5e1f5ee26b2dec98a5df20e6a7a7f3c410fee37a7511b17345f4ef7b5c02","observation_id":"c6be3231-355f-405c-8e75-faa5129c60f4","resolution":{"observed_at":"2026-08-07T14:34:30.208414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.898536Z","title":"Icdar2017 robust reading challenge on multi-lingual scene text de- tection and script identification-rrc-mlt","venue":null,"work_id":"602c6cf7-64cd-4076-af83-3bc907383e1b","year":2017},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:30.320131Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:0e0f252757f43b576d1615c81588023cae92cc268729293485a0875f701e0ec5","observation_id":"951f436b-b784-4ded-99a5-8d2937bfbb56","resolution":{"observed_at":"2026-08-07T14:34:31.904021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.885364Z","title":"Exploring stroke- level modifications for scene text editing","venue":null,"work_id":"337ad737-92f0-429b-88b6-ccefc7dd641c","year":2023},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:30.430470Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:38448aace7c022b16024fd36e0d3cf2dc86b8205bea9b6273b0e809e35c042e4","observation_id":"f46c7f87-4c40-414c-ab38-b622f535c9a0","resolution":{"observed_at":"2026-08-07T14:34:31.889387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.801063Z","title":"A robust arbitrary text detection system for natural scene images","venue":null,"work_id":"97d03054-335a-4a0c-afb5-f1f1a9aa5ea1","year":2014},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:30.539477Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:1d6396675fab3f4a035e93b6f217b0c40b415c36920111dab35dc6f6db469605","observation_id":"89309ca0-9000-49de-960e-fcafaaf0a955","resolution":{"observed_at":"2026-08-07T14:34:31.876099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03054","last_updated":"2024-02-21T07:12:45Z","snapshot_observed_at":"2026-08-07T22:13:54.617491Z","submitted_at":"2023-11-06T12:10:43Z","title":"AnyText: Multilingual Visual Text Generation And Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03054","snapshot_observed_at":"2026-08-07T14:34:30.696631Z","title":"Anytext: Multilingual visual text generation and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:30.696631Z"},"links":{"cited_paper":"/paper/2311.03054","citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:f3164e6688d087d10ad554de9664b425593ad3f6024f3d05ce9d7c3c5b04de9f","observation_id":"93dc07a0-d9dd-46a4-9138-0a2133ca29da","resolution":{"observed_at":"2026-08-07T14:34:30.696631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.608739Z","title":"Editing text in the wild","venue":null,"work_id":"95e4ea75-6c85-41ff-b075-2861008d94e0","year":2019},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:30.797206Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:6577fc707b798c4da6e49621047958b1c122d89deb6944ee52e58a78fae3bdb7","observation_id":"50958012-fa74-4be7-ace9-d7a4569b3d45","resolution":{"observed_at":"2026-08-07T14:34:31.787137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.409315Z","title":"Synthtiger: Synthetic text image generator towards better text recognition models, 2021","venue":null,"work_id":"4c3bde0c-ff48-4fb5-a3f4-ce5fe555869c","year":2021},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:30.966962Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:e50d8cb33a7e59933b5ace3e6edb38df8d6ab5a4213607d0914b733e98026313","observation_id":"7ccd3501-a063-4718-baad-4c32579a53bd","resolution":{"observed_at":"2026-08-07T14:34:31.494412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:31.262367Z","title":"Textctrl: Diffusion-based scene text edit- ing with prior guidance control","venue":null,"work_id":"fbf24d18-0a9d-49a7-b98e-21fb71dea197","year":null},"citing_paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:31.078496Z"},"links":{"citing_paper":"/paper/2505.18479"},"observation_digest":"sha256:fddbd873523db773855449293f68d2858f8cd5950a22b1d881d21f73f288aec4","observation_id":"c62f5192-56b1-4bf8-8d6b-8474440bafd6","resolution":{"observed_at":"2026-08-07T14:34:31.360901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.18479","last_updated":"2025-05-24T02:53:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:13:37.622716Z","submitted_at":"2025-05-24T02:53:24Z","title":"Syn3DTxt: Embedding 3D Cues for Scene Text Generation"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2505.18479."}