{"as_of":"2026-08-08T02:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f36478a9312656a3157275974f515620dd94dd10464bbb46d805f6ad9dbc4c17","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:56:41.253021Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:56:41.122138Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T05:56:41.345995Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"cited_work":{"arxiv_id":"2508.01153","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.01153","snapshot_observed_at":"2026-08-06T05:56:41.345995Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","venue":"cs.CV","work_id":"f79e593e-e94d-4de9-ac25-375bb97b90e7","year":2025},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.122138Z"},"links":{"cited_paper":"/paper/2508.01153","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:514e95594e8ec986a4d87068f6fd1f23fb0cafb58df87c54a00c6e9ded2acfc7","observation_id":"cd745181-dfb5-40a2-8335-77cf557c5fac","resolution":{"observed_at":"2026-08-06T05:56:41.349208Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.01153/citation-record","integrity":"/paper/2508.01153/integrity","json":"/paper/2508.01153/citation-record.json","paper":"/paper/2508.01153"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"cited_work":{"arxiv_id":"2508.01153","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.01153","snapshot_observed_at":"2026-08-06T05:56:41.345995Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","venue":"cs.CV","work_id":"f79e593e-e94d-4de9-ac25-375bb97b90e7","year":2025},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.122138Z"},"links":{"cited_paper":"/paper/2508.01153","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:514e95594e8ec986a4d87068f6fd1f23fb0cafb58df87c54a00c6e9ded2acfc7","observation_id":"cd745181-dfb5-40a2-8335-77cf557c5fac","resolution":{"observed_at":"2026-08-06T05:56:41.349208Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.699002Z","title":"TYPO” as “TYPE","venue":null,"work_id":"9bd6f6b1-140d-4165-b33e-8834945d275d","year":null},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.125795Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:4bcf1aa4263382a934e354dccecd512bb4a4e0f70643833b997a0e96921f8ec8","observation_id":"d5ce172f-2b91-4a28-846e-7af377334295","resolution":{"observed_at":"2026-08-06T05:56:41.701912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.691239Z","title":"This simulates a curriculum-style learn- ing process where the model first relies on explicit textual supervision, then gradually learns to infer based purely on visual cues","venue":null,"work_id":"4b57ac17-7801-4515-a68f-aef80a1a63bd","year":null},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.128679Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:e8f813a0332606cb59cdfc4a2d3359b355788ac0360c84f1bc1e390380989d78","observation_id":"292fc4eb-4f49-4ae3-bbcc-c8d1e576976a","resolution":{"observed_at":"2026-08-06T05:56:41.694116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.683534Z","title":"Experiments Setup Following standard practice in scene text recognition (STR) [19, 5], we adopt both synthetic and real-world datasets for train- ing and evaluation","venue":null,"work_id":"ab876917-1071-41b8-9a75-911e33ffc021","year":2013},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.131786Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:d14b5147704648472e66e421dba21eb65cd5f26b048cbe0bdcfcc05c44e251d5","observation_id":"8a7af6e6-22a6-469f-accc-429d0d8a9773","resolution":{"observed_at":"2026-08-06T05:56:41.686345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.675045Z","title":"TEACH injects ground-truth labels into the input sequence during training and gradually masks them based on model performance","venue":null,"work_id":"4fc26fc1-60ae-4cbe-b21c-b0464938ca5e","year":null},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.135049Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:8fe33cc2de11cb07d44aac583e22c46b3a8cb154dacdc66dc5a464000f3bdb11","observation_id":"49f8ccb7-9ed8-477f-a8d1-e70d36a6ab48","resolution":{"observed_at":"2026-08-06T05:56:41.678182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.666640Z","title":"An end-to- end trainable neural network for image-based sequence recognition and its application to scene text recogni- tion,","venue":null,"work_id":"10c3e8d8-197e-4634-a5b4-3c8f07cc5269","year":2016},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.137774Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:e14c78eef931477664b8fe97aae1dfbfe50592a9c52152cac9ee33c6c745bdd3","observation_id":"866dd3d2-5787-4b5c-94be-dc8ed44be43b","resolution":{"observed_at":"2026-08-06T05:56:41.669688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.659099Z","title":"Attention is all you need,","venue":null,"work_id":"d56318e1-8bc4-4516-81d1-20e20eddc219","year":2017},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.140817Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:5804387b285b6c6beff970ad0be137d82cc24323412fb1608984c3010cd513b6","observation_id":"b4aad906-99d0-4465-9341-a0c11395ad8d","resolution":{"observed_at":"2026-08-06T05:56:41.661681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T05:56:41.143738Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.143738Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:4b1d4000d7ec6570059f2d2db53e56c4c249e82f5029d0e3d7b4a6a1936d2628","observation_id":"83c17716-e2f0-4d0a-a5a2-3fd9c2036dc6","resolution":{"observed_at":"2026-08-06T05:56:41.143738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.651193Z","title":"Vision transformer for fast and effi- cient scene text recognition,","venue":null,"work_id":"2a4ffe95-c195-4d32-8b2f-45f994bcc026","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.147094Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:f8f005097c5e15c059734f0bee3de404fbf9603c66f392e58f8326db257bf755","observation_id":"fb62505b-2a96-4900-9acb-5ef88da518c9","resolution":{"observed_at":"2026-08-06T05:56:41.654116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.643497Z","title":"Scene text recog- nition with permuted autoregressive sequence models,","venue":null,"work_id":"d9d3bbd6-9c24-481c-87c5-e23ae7f932d8","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.149952Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:4e69ffe9dbc2d7c6a95f960589f4bc1b800445aef736ae602bcf66b1e2b85363","observation_id":"db7db82c-b011-416c-b564-f9983409e74d","resolution":{"observed_at":"2026-08-06T05:56:41.646306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.636071Z","title":"Trocr: Transformer-based optical character recognition with pre-trained models,","venue":null,"work_id":"eae0bf0c-529a-4f87-ac50-b46999fab93b","year":2023},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.152545Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:8a8204cce5e75c885be960083c2f1411595c466e4a256d4ee6334e280e28e856","observation_id":"6ea76566-e1ee-493b-a4f5-b1498ce49c1a","resolution":{"observed_at":"2026-08-06T05:56:41.638911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.628054Z","title":"Read like humans: Au- tonomous, bidirectional and iterative language model- ing for scene text recognition,","venue":null,"work_id":"d73ab52b-1970-4288-baa9-c06934f3b22b","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.155151Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:7636a724f01e4fa888ba240da307734c2a27171cce778fab93d923f94c9c147f","observation_id":"7433f445-219d-41f7-8bd5-d6efdcf2a863","resolution":{"observed_at":"2026-08-06T05:56:41.631076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.619983Z","title":"Dtrocr: Decoder-only transformer for optical character recognition,","venue":null,"work_id":"e08cb3c5-e662-4276-837a-d29bb031d5ee","year":2024},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.157562Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:99307d671d96632c2e6308936e7ddefa1bf35ce78cd030f020b1ff31ea41417d","observation_id":"8b79305c-6450-41ec-894c-444f578b2aeb","resolution":{"observed_at":"2026-08-06T05:56:41.622744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14014","last_updated":"2024-12-24T04:27:37Z","snapshot_observed_at":"2026-07-06T15:31:23.076745Z","submitted_at":"2023-05-23T12:51:20Z","title":"CLIP4STR: A Simple Baseline for Scene Text Recognition with Pre-trained Vision-Language Model","version":4},"cited_work":{"arxiv_id":"2305.14014","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14014","snapshot_observed_at":"2026-08-06T05:56:41.326008Z","title":"CLIP4STR: A Simple Baseline for Scene Text Recognition with Pre-trained Vision-Language Model","venue":"cs.CV","work_id":"bed28817-269f-4a10-a04e-61032793aa13","year":2023},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.159898Z"},"links":{"cited_paper":"/paper/2305.14014","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:897a756ec9cf167d29c0eff6d572b07100cb8958a197d12b98b101354ba893e6","observation_id":"3cfee4c0-c6bb-4305-b7ef-1bc7fcb16e67","resolution":{"observed_at":"2026-08-06T05:56:41.329345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.612253Z","title":"Curriculum learning,","venue":null,"work_id":"e61f826e-d0d5-4c2d-acb8-e4824c2a24ab","year":2009},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.162636Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:27952ed121cca93bb4b97798e58c5f94cc22460452062c10938a0ab5b2c7bc3c","observation_id":"431e6e46-96a5-4140-8050-cb169142a56d","resolution":{"observed_at":"2026-08-06T05:56:41.614732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.604301Z","title":"Self-paced learning for latent variable models,","venue":null,"work_id":"d3274201-c675-4d06-81e6-d7cf1bebbca9","year":2010},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.165243Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:832e7d78d4b43aecbe2b16f27b42f09495501903a1a32715c60f37ce8e6a3d70","observation_id":"81ffe997-be6d-423e-8505-0fe86aafa02e","resolution":{"observed_at":"2026-08-06T05:56:41.607143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.596128Z","title":"Recursive recurrent nets with attention modeling for ocr in the wild,","venue":null,"work_id":"15ca8a89-7e80-41f8-aea0-55d17cfdecdf","year":2016},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.167543Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:b8bb94aa8dad609c0160e5db26e40017d1fc41fb2d9b3f87fde686f1d2b9409c","observation_id":"fbb9c16b-2da1-4b16-8424-14179310d93c","resolution":{"observed_at":"2026-08-06T05:56:41.599020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.587044Z","title":"Gcrnn: graph convolutional recurrent neural network for compound–protein interaction prediction,","venue":null,"work_id":"e4c4c094-d453-43bd-ada3-dd4c0911c9b6","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.169729Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:ddcdc9ee07b29b9291fdb5f9d6a7b5e4be4873c0fd55ec1b5d18a34511949569","observation_id":"ee5d6b56-b745-4199-a82d-8bde7d34fcaf","resolution":{"observed_at":"2026-08-06T05:56:41.590118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.578922Z","title":"Ma-crnn: a multi-scale attention crnn for chinese text line recognition in natural scenes,","venue":null,"work_id":"eed611a2-5cb0-44fe-83ae-bc91500c9574","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.172193Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:9f69cf9b4366ac0f869932352081b57fff07ffaf6a219f9745ce8ea2a4ce145b","observation_id":"36358303-1a7f-4493-bba4-367cf2d62828","resolution":{"observed_at":"2026-08-06T05:56:41.581721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.570082Z","title":"Aster: An attentional scene text recognizer with flexible rectifica- tion,","venue":null,"work_id":"7c20ae0a-7a4d-4414-b457-a112e2ed1d87","year":2018},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.174787Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:a2d7f095aa6659d31f3b9de5b499d12c2e0403b932f0c1d6c719fd2e54b45c09","observation_id":"2da14f76-b0d2-417c-a6be-9249e5b4ca54","resolution":{"observed_at":"2026-08-06T05:56:41.573680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.561575Z","title":"Towards accu- rate scene text recognition with semantic reasoning net- works,","venue":null,"work_id":"d8172385-43b5-4305-a787-8547350618ca","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.177284Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:766ea7bd84ec8fbf8b7b2a215f6e7cc9846596152078d05e6eaa6fe24b8248f4","observation_id":"5128fea0-45dd-4636-b7d8-93699b6b3827","resolution":{"observed_at":"2026-08-06T05:56:41.564840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.552517Z","title":"Textscanner: Reading characters in or- der for robust scene text recognition,","venue":null,"work_id":"39d2a8ea-2a82-4377-885c-1e04e90ccdc9","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.179740Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:89b4b1ec1da637be889fd18e821fa6bc9863e4c55a7f54bbceed14599e3ddbc6","observation_id":"c7f95006-80e0-44af-8676-9c3deb29e4ca","resolution":{"observed_at":"2026-08-06T05:56:41.555491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.543828Z","title":"Seed: Semantics enhanced encoder- decoder framework for scene text recognition,","venue":null,"work_id":"651eb458-89aa-459f-ad38-59294fb04a28","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.182394Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:80245ed3da4c5a218ae097ac227cbaf0000c567d5321fa283c1ec21a5eccc6d1","observation_id":"bd670fda-50b1-4c54-93a5-84572050cc7a","resolution":{"observed_at":"2026-08-06T05:56:41.546548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.536407Z","title":"What if we only use real datasets for scene text recogni- tion? toward scene text recognition with fewer labels,","venue":null,"work_id":"727000a4-413a-4c76-8858-559e1242a9d5","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.184782Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:188ad23a5ed220a0bbf0e2533c4803cd349093d3bbf86ce04f757f986a16196e","observation_id":"edf2af91-4d35-4d78-8b41-3eb6b56b1239","resolution":{"observed_at":"2026-08-06T05:56:41.539027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.528727Z","title":"From two to one: A new scene text recognizer with visual language modeling network,","venue":null,"work_id":"f6200186-7236-4401-89f9-9b0828f0f0ea","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.187381Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:e9ed514c2b39882aca46ad09582f958b30a00e0337cf7b9569544c4869f548a2","observation_id":"caf2e00c-982b-489e-8b25-0532e0238a77","resolution":{"observed_at":"2026-08-06T05:56:41.531493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.520887Z","title":"Levenshtein ocr,","venue":null,"work_id":"9b972ce5-f9a0-4c8d-8e6c-66c65a062599","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.189910Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:cc48f0a5870f69f5065bae567f8cfdea6bab71e0af33efb3cc55297a059908d3","observation_id":"ebe6257d-81e9-4002-9b47-c03bff590f14","resolution":{"observed_at":"2026-08-06T05:56:41.523491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.513222Z","title":"Multi- modal text recognition networks: Interactive enhance- ments between visual and semantic features,","venue":null,"work_id":"471b6919-206d-4e06-9014-aada2c913b26","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.192287Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:89109578cc79e2df671212b22490e753c9bd3035e8ea515edcdcec5a3565a035","observation_id":"d663d731-d07e-4532-b312-131a1f2373af","resolution":{"observed_at":"2026-08-06T05:56:41.515872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.505307Z","title":"Petr: Rethinking the capability of transformer-based language model in scene text recognition,","venue":null,"work_id":"d074ea4b-745b-442c-ba52-1454d1373e2f","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.195041Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:b6de104fd91640105f93bc9d3b97ff0dcf19a285e5a58c065e5b4b15ab7515fb","observation_id":"b918f897-6743-4020-9daa-4513c60e2d08","resolution":{"observed_at":"2026-08-06T05:56:41.508282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.497223Z","title":"Reading and writing: Discriminative and generative modeling for self-supervised text recognition,","venue":null,"work_id":"4f78953c-b99e-4568-a051-cfac64939a04","year":2022},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.197536Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:7241d7438e0b537976680afa7456e11a84f86faeeeb673afb58d1a68b93c2deb","observation_id":"785504fa-1901-4dca-a23e-b08b344036ae","resolution":{"observed_at":"2026-08-06T05:56:41.500346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.07464","last_updated":"2023-07-23T13:51:34Z","snapshot_observed_at":"2026-07-06T14:42:22.813296Z","submitted_at":"2023-01-18T12:16:19Z","title":"CLIPTER: Looking at the Bigger Picture in Scene Text Recognition","version":2},"cited_work":{"arxiv_id":"2301.07464","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.07464","snapshot_observed_at":"2026-08-06T05:56:41.313849Z","title":"CLIPTER: Looking at the Bigger Picture in Scene Text Recognition","venue":"cs.CV","work_id":"d0f2389b-973d-4d2e-92b1-e09bbd1a6295","year":2023},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.200024Z"},"links":{"cited_paper":"/paper/2301.07464","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:c6905d268f3679a2fabb51e4732548d304746299752388092e98d4d248cc36e1","observation_id":"5d0664c4-a4ab-48fa-bfe5-9bbe4c58565b","resolution":{"observed_at":"2026-08-06T05:56:41.317059Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.488932Z","title":"Revisiting scene text recognition: A data perspective,","venue":null,"work_id":"af5fa58f-8ff4-48cf-962d-8b84f19eb40f","year":2023},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.203143Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:65957bd4de9479d8a77edfc9dd3f4b4831fd59e604ef3e1d1a2ceeea8eb926f8","observation_id":"22151698-419a-49b1-a4c8-3489ab67a936","resolution":{"observed_at":"2026-08-06T05:56:41.491965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2227","last_updated":"2014-12-09T11:22:59Z","snapshot_observed_at":"2026-07-06T03:45:51.255195Z","submitted_at":"2014-06-09T15:53:33Z","title":"Synthetic Data and Artificial Neural Networks for Natural Scene Text Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2227","snapshot_observed_at":"2026-08-06T05:56:41.205591Z","title":"Synthetic data and artificial neu- ral networks for natural scene text recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.205591Z"},"links":{"cited_paper":"/paper/1406.2227","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:812293ffb33064ff0dd94ba868c9df7816ccaf521f93eaede12f37776946819f","observation_id":"7cba1d46-04f0-406c-a7fc-3cd932d476dc","resolution":{"observed_at":"2026-08-06T05:56:41.205591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.480999Z","title":"Synthetic data for text localisation in natural images,","venue":null,"work_id":"ca973190-b15f-4c72-83a5-fdc51243637b","year":2016},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.208568Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:fab1964fbe716939c193df6410cbe8dacad894d28b03dc6000bc2f77de654b65","observation_id":"d32f5683-f545-42a2-8e2c-1b69978c25e6","resolution":{"observed_at":"2026-08-06T05:56:41.483864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1601.07140","last_updated":"2016-06-19T23:52:14Z","snapshot_observed_at":"2026-07-06T04:44:09.937735Z","submitted_at":"2016-01-26T19:30:34Z","title":"COCO-Text: Dataset and Benchmark for Text Detection and Recognition in Natural Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1601.07140","snapshot_observed_at":"2026-08-06T05:56:41.210900Z","title":"Coco-text: Dataset and benchmark for text detection and recognition in natural images,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.210900Z"},"links":{"cited_paper":"/paper/1601.07140","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:2e4ecc0de0548dd4ebd2c4f10b66c78767a85449cc43a443fdf2209e6db63889","observation_id":"97908528-2ae1-4860-b546-9b39ae56d97e","resolution":{"observed_at":"2026-08-06T05:56:41.210900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.472852Z","title":"Icdar2017 competition on reading chi- nese text in the wild (rctw-17),","venue":null,"work_id":"97f5cde4-cc0f-42b7-aab1-351eecdf3dcb","year":2017},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.213632Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:7837953132c78d3561aa8f57a23482051957463d96f89e2dfbed6e5b4ded32dc","observation_id":"1b790f71-7115-480f-8921-53c9787c0dfb","resolution":{"observed_at":"2026-08-06T05:56:41.475837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.464545Z","title":"Uber-text: A large-scale dataset for optical character recognition from street-level imagery,","venue":null,"work_id":"2c0651a5-e494-4c7f-96f5-add443f30f90","year":2017},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.216633Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:153fd233eae14f9ce25ed190c6f677dc4ef254e5161edcbc31099f2ffa8ddf6c","observation_id":"b0385723-bbb8-4cb9-ad3f-4ca4679b886a","resolution":{"observed_at":"2026-08-06T05:56:41.467554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.455745Z","title":"Icdar2019 robust reading challenge on arbitrary-shaped text-rrc-art,","venue":null,"work_id":"712ba4bf-9b14-4158-a40d-0a052e1de97c","year":2019},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.219047Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:408ba9ecbf2142e708945feaf5318cb2df4266a71a1f0058ff69ce97f97e8118","observation_id":"63ff275e-2044-4bf5-93fa-7a27c3c2f0d5","resolution":{"observed_at":"2026-08-06T05:56:41.458562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.447530Z","title":"Icdar 2019 competition on large-scale street view text with partial labeling-rrc-lsvt,","venue":null,"work_id":"18e2555e-1ba1-4058-843e-58869be5d82a","year":2019},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.221487Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:a5d19486f8db02ca4be5e171833cbe5c17a25deb58ce1de3a01550ffa5fc09c0","observation_id":"83e2dc8c-60ae-4d5a-8d65-cd9492a25d1a","resolution":{"observed_at":"2026-08-06T05:56:41.450320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.439566Z","title":"Icdar2019 robust reading challenge on multi-lingual scene text detection and recognition—rrc- mlt-2019,","venue":null,"work_id":"ac8965db-2678-4c66-9c80-eef50c7e3cf8","year":2019},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.224444Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:5ecc94ea62f8c118f5ddc09bf8da983ea2dbc5801d9dc90b1177e8f933558a33","observation_id":"e7dd2d8e-901f-46ee-a5bb-00f8fd99b84b","resolution":{"observed_at":"2026-08-06T05:56:41.442518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.431960Z","title":"Icdar 2019 robust read- ing challenge on reading chinese text on signboard,","venue":null,"work_id":"4d5a01f3-73bd-4eef-80de-a4f672861bd1","year":2019},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.226914Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:1275d279fe909625d6132f00db3c0cd2b6e7641430262eaaebba875035f379e6","observation_id":"cf9aec72-ef34-4805-aa3c-ca57508164b1","resolution":{"observed_at":"2026-08-06T05:56:41.434739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.424063Z","title":"Openimages: A public dataset for large-scale multi- label and multi-class image classification,","venue":null,"work_id":"80e9ea86-0fa7-4564-bb54-6914dda2cbd0","year":2017},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.229359Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:e4555501c9909e354b61a5b53d60e4b47facf7b715faaabf56a36a1b20b1586f","observation_id":"15cd3df4-595c-43bf-91b1-3c7866b89703","resolution":{"observed_at":"2026-08-06T05:56:41.426903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.416080Z","title":"Textocr: Towards large-scale end-to-end reasoning for arbitrary-shaped scene text,","venue":null,"work_id":"ba93bb12-8460-433f-8925-190f3810eeac","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.231908Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:ab45db02322a36a6053ef6befc36ca7d806e2762fbe457674ab7c6495624a639","observation_id":"7cc440e8-c9d4-42ff-96f1-5472f55ca997","resolution":{"observed_at":"2026-08-06T05:56:41.418791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.408479Z","title":"Open images v5 text annotation and yet another mask text spotter,","venue":null,"work_id":"717fa794-9677-4659-939b-62c8019040c7","year":2021},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.234552Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:dc78be87ddaa526524fb36ffd8149343984f6c66f1c6b8077fe2021baecb7dc9","observation_id":"96c5f507-eebd-4020-9e06-1d6c79ca2e61","resolution":{"observed_at":"2026-08-06T05:56:41.411123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.400089Z","title":"Scene text recognition using higher order language priors,","venue":null,"work_id":"8b0281bb-c144-41ac-a711-bfa35af2decc","year":2012},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.237225Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:25f6677e782958597d69e28a6fce5e4ccd4ce5adae7fbe23f502a35c69fc63c4","observation_id":"32dbf2e8-11c7-4552-9957-4ee1c3b0da16","resolution":{"observed_at":"2026-08-06T05:56:41.403041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.391337Z","title":"End- to-end scene text recognition,","venue":null,"work_id":"d4252522-02bc-4e70-8487-88d323c15453","year":2011},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.239841Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:95ee966e0efdc10ceb47e364693e192ceabf2c5975170acd0af3f8fe0ddc3265","observation_id":"34271599-3a74-4ca1-b0d0-e38aaef8d98a","resolution":{"observed_at":"2026-08-06T05:56:41.394098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.382569Z","title":"Recognizing text with perspective distortion in natural scenes,","venue":null,"work_id":"1502c921-d5ed-4a45-b361-8c3728a92b84","year":2013},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.242418Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:0ff15128e83cb956f482167c3cdaa81282ffd8bbbab4a417632e482145ac47db","observation_id":"b8b59d2f-5030-456a-947a-05969c890320","resolution":{"observed_at":"2026-08-06T05:56:41.385534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.374098Z","title":"Icdar 2013 robust reading competition,","venue":null,"work_id":"e8bfae4e-a038-4858-b6b8-3263ea0f4e3c","year":2013},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.245113Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:23c27fd965eb2f28d9974fd353473402fb956b4f8cdbc09d99c15131ae5f1651","observation_id":"514da1c9-264d-4c22-8f87-67b867de0b27","resolution":{"observed_at":"2026-08-06T05:56:41.377265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.364685Z","title":"Icdar 2015 competition on robust reading,","venue":null,"work_id":"9dd0091d-e42d-4f0e-8def-6a5cdd76710d","year":2015},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.247747Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:92e23af7c9d6e296cd5822aa96f1a603da80f872214391ed491b7f60d1d3ff31","observation_id":"15b92baa-60db-4161-893f-4dc2d29fed03","resolution":{"observed_at":"2026-08-06T05:56:41.368103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:56:41.355654Z","title":"A robust arbi- trary text detection system for natural scene images,","venue":null,"work_id":"a0cd623d-7dd1-4bb1-b12b-1ff96f9a0a07","year":2014},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.250473Z"},"links":{"citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:bef08781a09f56e48436b8380bf69fccbb701b2d2eccb2566e400b49071523ff","observation_id":"edecc5ce-36f4-42ce-9d6d-50088b9035c7","resolution":{"observed_at":"2026-08-06T05:56:41.358734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10608","last_updated":"2020-08-18T01:06:39Z","snapshot_observed_at":"2026-08-07T12:19:15.262782Z","submitted_at":"2020-03-24T01:37:42Z","title":"UnrealText: Synthesizing Realistic Scene Text Images from the Unreal World","version":6},"cited_work":{"arxiv_id":"2003.10608","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.10608","snapshot_observed_at":"2026-08-06T05:56:41.280845Z","title":"UnrealText: Synthesizing Realistic Scene Text Images from the Unreal World","venue":"cs.CV","work_id":"d23ecee4-a401-4568-ab4e-590686559bda","year":2020},"citing_paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:41.253021Z"},"links":{"cited_paper":"/paper/2003.10608","citing_paper":"/paper/2508.01153"},"observation_digest":"sha256:77f80c78b50c17a87d98e0319ec619ec394b088ca56feff1fb42753fbc122c96","observation_id":"fe543078-6c11-439e-8378-f543fd0131c0","resolution":{"observed_at":"2026-08-06T05:56:41.286196Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.01153","last_updated":"2025-08-02T02:28:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T05:56:40.324075Z","submitted_at":"2025-08-02T02:28:09Z","title":"TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":3,"verified_fuzzy":43},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 1 inbound Pith citation observation for arXiv:2508.01153."}