{"as_of":"2026-08-22T14:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a796dff35dec54d0470aa18cbecf9c26dc5a8530a082078393b190f1082c21ab","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:52:02.046857Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:07:21.545731Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:07:23.137025Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"cited_work":{"arxiv_id":"2411.15858","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15858","snapshot_observed_at":"2026-08-06T17:07:23.137025Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","venue":"cs.CV","work_id":"b69858c3-998c-4af2-9aab-4186466802f6","year":2024},"citing_paper":{"arxiv_id":"2507.11730","last_updated":"2025-07-15T20:58:24Z","snapshot_observed_at":"2026-08-19T13:32:21.412653Z","submitted_at":"2025-07-15T20:58:24Z","title":"Seeing the Signs: A Survey of Edge-Deployable OCR Models for Billboard Visibility Analysis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:21.545731Z"},"links":{"cited_paper":"/paper/2411.15858","citing_paper":"/paper/2507.11730"},"observation_digest":"sha256:2e576a017e29ab16b34b7f833e093b07774536e059efe591962b6719c1cec407","observation_id":"59504417-69f4-4fd9-8379-a85cbbf898e5","resolution":{"observed_at":"2026-08-06T17:07:23.266977Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15858","snapshot_observed_at":"2026-08-04T19:27:40.637221Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09254","last_updated":"2025-09-11T08:39:08Z","snapshot_observed_at":"2026-08-21T11:18:26.373218Z","submitted_at":"2025-09-11T08:39:08Z","title":"Towards Better Dental AI: A Multimodal Benchmark and Instruction Dataset for Panoramic X-ray Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T19:27:40.637221Z"},"links":{"cited_paper":"/paper/2411.15858","citing_paper":"/paper/2509.09254"},"observation_digest":"sha256:4072cc33e60ed590fc7312c3f292537c14804508fa39fc312902a194ec8d8cec","observation_id":"49e5492b-d1aa-4d78-8c0e-dbc10116c40d","resolution":{"observed_at":"2026-08-04T19:27:40.637221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.15858/citation-record","integrity":"/paper/2411.15858/integrity","json":"/paper/2411.15858/citation-record.json","paper":"/paper/2411.15858"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.937733Z","title":"Anhar, S","venue":null,"work_id":"08fe4c33-93d8-4948-af3c-993e0b923480","year":2014},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.747070Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:84acb0cc522887806597f71dec6a73beebb18f47db09889f54b92123aa2cf9a3","observation_id":"7147fa12-da43-4746-9614-54306a6527a5","resolution":{"observed_at":"2026-08-12T13:52:02.941133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.927392Z","title":null,"venue":null,"work_id":"9f3133ce-5e92-450b-9b9f-482e5bbee178","year":2019},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.751714Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:1d8d1961d4d694412712740a8e586d2d03497ee904bf0883131aad430856552f","observation_id":"ab28f49f-746f-4058-a1c6-73cc2859c091","resolution":{"observed_at":"2026-08-12T13:52:02.930937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.917021Z","title":null,"venue":null,"work_id":"54dcfe83-4a0e-4d80-af77-3815eb0c3e3e","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.755693Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:ca32c3c8efb835e19efc7f2d11edb66337d9695092e33eb02558a5e3c78bc35a","observation_id":"993fcaff-ac0c-4758-83e5-c1b5fccd2b5c","resolution":{"observed_at":"2026-08-12T13:52:02.920554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.906937Z","title":"Bautista and R.l Atienza","venue":null,"work_id":"3e08629f-4ce8-4207-b508-ff2770061475","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.759860Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:c002a44e22e99893be15c79afb843f7378fafd1d4a148f76751d3bf8fb797865","observation_id":"30639e22-6074-4681-aa2b-462d1734bf6a","resolution":{"observed_at":"2026-08-12T13:52:02.910481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.895993Z","title":null,"venue":null,"work_id":"ca3f4388-82a1-4a74-b172-25b927b68609","year":2021},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.763770Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:661655b7f384947c0c320eae13f569542ed57d48e276f5be848b73eccd3ff4df","observation_id":"458e0966-b4ad-40f9-a18f-0f7442fdc761","resolution":{"observed_at":"2026-08-12T13:52:02.899433Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.15093","last_updated":"2022-11-25T12:03:17Z","snapshot_observed_at":"2026-08-16T17:31:07.940615Z","submitted_at":"2021-12-30T15:30:52Z","title":"Benchmarking Chinese Text Recognition: Datasets, Baselines, and an Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.15093","snapshot_observed_at":"2026-08-12T13:52:01.767817Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.767817Z"},"links":{"cited_paper":"/paper/2112.15093","citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:90fae23d299e9cb57ff081efc51e405248c465897172c5ccf0bfbf9d9b3e97d0","observation_id":"239cd894-8e76-411a-b485-f9834ff1fe70","resolution":{"observed_at":"2026-08-12T13:52:01.767817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.886089Z","title":null,"venue":null,"work_id":"1ae15360-def9-4803-8ea7-722bb7662266","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.772477Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:62b86561ab95e53104d4d1e441f8378a52b529e614b65cd784b477e3d3899eaf","observation_id":"9bfb0b04-ca87-473b-88a0-28ba019f9ecc","resolution":{"observed_at":"2026-08-12T13:52:02.889711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.875497Z","title":"Cheng, P","venue":null,"work_id":"5f809adb-6a3e-47e8-a9e9-b39426e5051b","year":2023},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.776339Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:38e497e804017a926de4a939592848291249aa71059e7a9b8edd870de15dadbf","observation_id":"c1d3532a-da54-44de-9a90-3f611f2a879d","resolution":{"observed_at":"2026-08-12T13:52:02.879214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.865182Z","title":null,"venue":null,"work_id":"2f0e6732-41b6-44b8-9cef-541f30a4cf50","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.780133Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:3588d2a959b56e7ff2b4b25f9cd56854fb9f3f586d4c68808ebc4c906c136a32","observation_id":"ee0dd785-e444-45a3-becc-15ded6a3963e","resolution":{"observed_at":"2026-08-12T13:52:02.868799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.854657Z","title":"Dosovitskiy, L","venue":null,"work_id":"c2985d64-d954-4f2d-9bb6-c859a815d7ce","year":2021},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.783665Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:f336f426d926aa0e062083209446cf50cc1258bf9ce94b8b08971c1fc7a4a79b","observation_id":"a981c074-6232-4be0-909a-e864716ca528","resolution":{"observed_at":"2026-08-12T13:52:02.858137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.843566Z","title":null,"venue":null,"work_id":"9c67e966-a891-48e8-8671-551be27bf771","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.787063Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:c87504bc2d1fbe19857c1c6ff33fa02429929b14ba2172f1db86c5bc3bd4e733","observation_id":"7e3c62d5-6987-4cd6-8255-fe152b73dbbe","resolution":{"observed_at":"2026-08-12T13:52:02.847319Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.833138Z","title":null,"venue":null,"work_id":"b6d1f573-de4e-436f-8374-1351217f2ceb","year":2025},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.790663Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:f42aca1d370056908268d6b9e0263c00cec49c7def7e4b54dec53477321db294","observation_id":"6909b844-f1e9-480c-b695-3d4cebd62768","resolution":{"observed_at":"2026-08-12T13:52:02.836790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.821891Z","title":null,"venue":null,"work_id":"3e901c9e-a807-4fc0-8c41-d4968c862af2","year":2025},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.794853Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:9fc3fb97ca510a2ddff550f5de245a9fce61683287d0298f106fa5d3b0fa7375","observation_id":"1d1be64b-1026-4bcc-8654-d3b17aff6792","resolution":{"observed_at":"2026-08-12T13:52:02.825875Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.810714Z","title":null,"venue":null,"work_id":"fd3f546b-98b3-46a7-a01a-e0462eb7daef","year":2025},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.798572Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:787d876925e8ac573c52ee6d1248ede1efb48d6c30bbaf72e81d39540d88f90b","observation_id":"4033e497-840f-4771-8926-2303e9f8221c","resolution":{"observed_at":"2026-08-12T13:52:02.814286Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.799251Z","title":null,"venue":null,"work_id":"e5d08dfb-0c61-4a0c-a792-e3669eacd917","year":2021},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.802261Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:418b186d79c5fd459a6f137a17784f2a928296ce573aa330e86d096318b995c0","observation_id":"4a21dfa0-0be6-4def-9473-cf1402a6c368","resolution":{"observed_at":"2026-08-12T13:52:02.802792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.787897Z","title":"ABINet++: Autonomous, bidirectional and iterative language modeling for scene text spotting","venue":null,"work_id":"3662d683-a324-4f9f-83c3-ba56cc9823ad","year":2023},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.805851Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:b04830e0926895c9c4284ae952de6a8d58a98c0ad728aa82ebd3d20357a8811c","observation_id":"bffa0f0e-1824-46bb-9f8a-27c765790caf","resolution":{"observed_at":"2026-08-12T13:52:02.791881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.776183Z","title":"Graves, S","venue":null,"work_id":"aa183eab-dfb9-4df7-864c-43ce9866cd1b","year":2006},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.809726Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:12430cabc7704f2118042ba7fa67ffd7a17249ff9e2663035e60d38e9c78ebc7","observation_id":"4b595866-85f1-496d-9609-4272123f6763","resolution":{"observed_at":"2026-08-12T13:52:02.780159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.765773Z","title":null,"venue":null,"work_id":"a143d472-89ea-4f2d-839c-dca7614e00e8","year":2023},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.813307Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:1a1812d9a7b2df6be3502625743a7aa0d953366e5cb36173fbf6240574b42343","observation_id":"3d835918-cdec-4aeb-bae5-7d8e90d9fe8f","resolution":{"observed_at":"2026-08-12T13:52:02.769325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.754603Z","title":null,"venue":null,"work_id":"7ab0e276-66ae-4e12-a88e-f2cf216e03c2","year":2023},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.817108Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:fdc4efa1239ea780fe121a938a77aa91f54db3708b92a38859c5e0f590769635","observation_id":"6cab5241-b0a4-4751-a67b-d0d6ec31601f","resolution":{"observed_at":"2026-08-12T13:52:02.758345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.743799Z","title":"Gupta, A","venue":null,"work_id":"90411db9-777e-41bf-90b9-2137f7c16324","year":2016},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.820693Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:7aa1f5dd43d7b9f40b3d97d358ff2580e8b780433e4113e28140281be8403702","observation_id":"a3f6a01f-42b5-4000-afee-9215b4e262b4","resolution":{"observed_at":"2026-08-12T13:52:02.747608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.732915Z","title":null,"venue":null,"work_id":"2306a6d9-46ec-4139-b844-6489558ce6db","year":2016},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.824673Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:792c2965f1f159104f61d3a6e20d571eabab7f62f27da62e14fb08025f17223f","observation_id":"962480ec-c5e4-48ba-a7e6-63949d17c5da","resolution":{"observed_at":"2026-08-12T13:52:02.736571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.721545Z","title":null,"venue":null,"work_id":"a336536e-f7b6-44cb-8ba7-e046e836fd3f","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.828292Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:3f86ef03dc3c926aa4b0d53fad41d93d2fe7a0170eaf665e58c060b215e20dcb","observation_id":"9a011713-98c9-4404-af75-f81741b713c8","resolution":{"observed_at":"2026-08-12T13:52:02.725503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.709816Z","title":null,"venue":null,"work_id":"7993dd07-2943-487f-af38-4c769493537b","year":2020},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.831868Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:19cb81869231f96ae58b46bf51da68995efeb4808fd8e470c9cb7329c8cd9748","observation_id":"44297828-a467-4181-9d79-91101ca5fe14","resolution":{"observed_at":"2026-08-12T13:52:02.714578Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2227","last_updated":"2014-12-09T11:22:59Z","snapshot_observed_at":"2026-08-20T16:25:52.077979Z","submitted_at":"2014-06-09T15:53:33Z","title":"Synthetic Data and Artificial Neural Networks for Natural Scene Text Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2227","snapshot_observed_at":"2026-08-12T13:52:01.835691Z","title":"Jaderberg, K","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.835691Z"},"links":{"cited_paper":"/paper/1406.2227","citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:66c634ed4b1dfdaf58909c388a8309e64765595b99ae881471a0327a90d08fbc","observation_id":"2306e892-b801-4d58-a096-81fd2358cd1e","resolution":{"observed_at":"2026-08-12T13:52:01.835691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.698253Z","title":"Jiang, J","venue":null,"work_id":"8c166c06-aca6-44dc-a1cf-3645571e0469","year":2023},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.840278Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:86527d95726e6e39f98940762af75c7872b649555791f7378b1fef0d2888c939","observation_id":"9da13577-3b4d-4bfc-b894-60073bc43d76","resolution":{"observed_at":"2026-08-12T13:52:02.702131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.686990Z","title":"Karatzas, L","venue":null,"work_id":"a0abb7a5-ee0e-4ecd-8252-74042e0b7fdc","year":2015},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.844261Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:ea7105b9ae69780b36a0d4dfa6ebf07de88c7cbc8c4da20c9702f7082bd6102c","observation_id":"69d06ea6-1a2d-4dba-9986-deb6b4a67040","resolution":{"observed_at":"2026-08-12T13:52:02.690533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.676167Z","title":"KaratzasAU, F","venue":null,"work_id":"2f4c3b80-8839-45c1-bd6d-ff306b0a7cb5","year":2013},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.847773Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:3c212377d0cb83a45f9d5cad02b0fd1d3262bff6498fcb5a68c3bc832b932d11","observation_id":"1f2e4201-a8d0-4a36-9f03-a23f215edac8","resolution":{"observed_at":"2026-08-12T13:52:02.679822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.03001","last_updated":"2022-06-14T12:00:10Z","snapshot_observed_at":"2026-08-19T13:30:52.002013Z","submitted_at":"2022-06-07T04:33:50Z","title":"PP-OCRv3: More Attempts for the Improvement of Ultra Lightweight OCR System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.03001","snapshot_observed_at":"2026-08-12T13:52:01.851414Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.851414Z"},"links":{"cited_paper":"/paper/2206.03001","citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:c4f5c347a71fd32a6215a95177d7d0d64daa75e81185583c9b9bd56db9a1e2d8","observation_id":"d2d9cf41-3404-4aee-8d99-efd0e0db0ea8","resolution":{"observed_at":"2026-08-12T13:52:01.851414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.664889Z","title":null,"venue":null,"work_id":"126d4dd7-253e-4606-b870-abe0c337653f","year":2019},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.855569Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:0ab67387344bbb28545cfe261a345c0f0bcf293fc5150c4de9679c394dc9f3e3","observation_id":"30b92f37-f9ad-4e08-be86-84aee6b4b8ab","resolution":{"observed_at":"2026-08-12T13:52:02.668849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.653921Z","title":"Loshchilov and F","venue":null,"work_id":"b5795682-e31a-434e-a7c9-82aa0ac4e60d","year":2019},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.859145Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:9426c0318257944228710564ead9c939fcb1b12480dafd7190bd937ed711bd9d","observation_id":"2b39a6e1-33c1-47a2-981c-eb1d256d22e4","resolution":{"observed_at":"2026-08-12T13:52:02.657555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.643254Z","title":null,"venue":null,"work_id":"f988ea5c-dad7-424b-9397-8425405f45b1","year":2021},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.862697Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:d10d9b0be00a348f269baaf74f1495ba39aa6a743a8da0c0753528b514438f01","observation_id":"ce312657-bf63-4b7a-937a-bac0479bab36","resolution":{"observed_at":"2026-08-12T13:52:02.646722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.632649Z","title":null,"venue":null,"work_id":"30c20c92-ee59-4d35-9992-a31a26ae7d64","year":2019},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.866220Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:5325b64799ed664af07b7218fe3c922d64963d291785dd8347af04fafb24dd37","observation_id":"6c65d697-fced-4297-9b16-8189a9d983ec","resolution":{"observed_at":"2026-08-12T13:52:02.636111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.622256Z","title":"Mishra, A","venue":null,"work_id":"bc3c8d93-6eb9-4db7-9985-7e490a916892","year":2012},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.870005Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:a0d1923fcdcef1a1aa24b2f4d10080a34c1fc5648ec7dd4c381adacd69ecb01a","observation_id":"09c4b0fd-3292-4488-be61-b73ad5e37f8c","resolution":{"observed_at":"2026-08-12T13:52:02.625736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.611267Z","title":null,"venue":null,"work_id":"532241f9-b6e4-4b11-af79-02fb28f97a23","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.873527Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:a64ab21a15a4048e4f89e7bdb4e8b3128f94f72cd3567bc52fa9cc954f6a2945","observation_id":"8a390795-7fbd-461a-90fb-ba85925a66f2","resolution":{"observed_at":"2026-08-12T13:52:02.614964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.600413Z","title":null,"venue":null,"work_id":"6344e9be-f459-44f2-ae77-24a1537bcf0f","year":2013},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.877293Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:48b2c64470abb2b116eea4eefbef25462f54b01200d15c80b9954fc6c1669c1d","observation_id":"cb1c3056-a2ad-4e01-af7e-db8a30fe477e","resolution":{"observed_at":"2026-08-12T13:52:02.604208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.590093Z","title":null,"venue":null,"work_id":"eb47a78e-9005-47c6-89a3-de4765638876","year":2020},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.880781Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:f69c94360eaaa6ce9dab37df8347dbd93948fcb738005c9fb20a10c74b627b03","observation_id":"2d9cbea9-e4b5-4dc4-8b5b-a197c3af2b90","resolution":{"observed_at":"2026-08-12T13:52:02.593456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.578731Z","title":null,"venue":null,"work_id":"556899db-d44c-4d09-8aa9-773094e72cdb","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.884401Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:81f8c7a9e202de63072c4bb9a95d10f5764b907d395ae56b08a21b481361f5ce","observation_id":"ab6df135-e5ef-479d-92fa-49faa47d16ac","resolution":{"observed_at":"2026-08-12T13:52:02.582585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.567387Z","title":"Sheng, Z","venue":null,"work_id":"b869184b-9804-4963-9526-1390ea52c1b7","year":2019},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.888817Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:abc608c52f4bc600d2b0fab0a5538b82dabf5e270822c7a2c82b5d5a0bb77ec0","observation_id":"2c9b0a2e-99f2-4f9b-9b28-975cea9343c5","resolution":{"observed_at":"2026-08-12T13:52:02.571078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.556526Z","title":null,"venue":null,"work_id":"ced86719-8013-436d-b545-f643754a95a8","year":2017},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.892899Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:9c475c9671910b7731ab97b9510ac76ab750de138d6113f08e4038099b90382c","observation_id":"9d1fe14c-fd05-4a02-b4be-d19b2ab26150","resolution":{"observed_at":"2026-08-12T13:52:02.560236Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.545482Z","title":null,"venue":null,"work_id":"2ca82f3d-dee7-455b-bd31-3d0d8aa29cfe","year":2019},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.897018Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:d754e1fe9855d6b1b2b1ddfd1fb20ad91229bcbc8e8569c04a6be25472fcbb17","observation_id":"07c873f7-7f05-46be-a557-2459d8a6bbcc","resolution":{"observed_at":"2026-08-12T13:52:02.549213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.534460Z","title":"Vaswani, N","venue":null,"work_id":"2381bda2-b67d-48e4-bf62-5cd93e9437d5","year":2017},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.901509Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:b987ba535125a1586d6671251e0cfca92febc5cdcac71d052a12e62f5770d66e","observation_id":"1e7d259d-40e7-441a-bf79-ea1b67eed6a9","resolution":{"observed_at":"2026-08-12T13:52:02.538023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.523211Z","title":"Loshchilov and F","venue":null,"work_id":"420df6c7-0ff2-4745-8b43-58466d4335a9","year":2017},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.905038Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:6fe186a7ae22c190c7b1fa43e721e560455b8bccb9ce1fe334a413b75791dbf5","observation_id":"183b50a0-7f45-4fcd-b1da-a2bea14c65a6","resolution":{"observed_at":"2026-08-12T13:52:02.527082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.09705","last_updated":"2019-07-23T05:55:28Z","snapshot_observed_at":"2026-08-19T18:09:58.424931Z","submitted_at":"2019-07-23T05:55:28Z","title":"2D-CTC for Scene Text Recognition","version":1},"cited_work":{"arxiv_id":"1907.09705","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.09705","snapshot_observed_at":"2026-08-12T13:52:02.079668Z","title":"2D-CTC for Scene Text Recognition","venue":"cs.CV","work_id":"c7d71f3b-c81c-46dc-9ef2-5a2ca2fd03ce","year":2019},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.908696Z"},"links":{"cited_paper":"/paper/1907.09705","citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:60a475cfd2ab67cef4189b219b7079cbfe143ecf5501b7eb156d3fa7866a15c6","observation_id":"7d57d2c1-88bc-457b-93db-c2dc0a54b662","resolution":{"observed_at":"2026-08-12T13:52:02.084587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.511470Z","title":null,"venue":null,"work_id":"1f0fe476-43b2-49c7-865a-a4c251fd6832","year":2011},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.913130Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:2f43b6d4c226a42002f393cd5e22dea9b6a340be942fbfe523fe274ef898eb95","observation_id":"1b78215e-ad8e-4e52-a375-58b82889c114","resolution":{"observed_at":"2026-08-12T13:52:02.515557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.500377Z","title":null,"venue":null,"work_id":"957fbebc-db25-43d1-9406-7a21bc1ddeb9","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.916564Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:b2723f8bdf584bc2a3dd47b7b332cd470d25d87d09f038793ddfd650807a3091","observation_id":"175351b6-9912-4b7c-b05f-4492a4b5c7a2","resolution":{"observed_at":"2026-08-12T13:52:02.504237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.488570Z","title":null,"venue":null,"work_id":"ad08b162-e81e-4c56-8fa5-3c58103518f1","year":2020},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.920044Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:cc3b78583d884fce8df581499d2bf62df04e609dec0cf6768e1c3a2246c2a533","observation_id":"7840f7d7-48e6-4da0-aa05-39ebb658e361","resolution":{"observed_at":"2026-08-12T13:52:02.492209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.478166Z","title":null,"venue":null,"work_id":"32161188-5521-4928-aa72-ddd5a2fd8d52","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.923789Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:0db9a26791bc718d516598575a28f0f2f82b662605ba0b0bd9dfd40020e30567","observation_id":"afe2c037-2822-4d30-a3d1-18d4f3e362ec","resolution":{"observed_at":"2026-08-12T13:52:02.481733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.467519Z","title":null,"venue":null,"work_id":"1a900f65-5424-4fb8-86eb-b91382c59928","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.927575Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:1fe975d92d5c798eabf3cd95b608b32422170ea89f50ea5bf78825634387af29","observation_id":"f63c88eb-03d0-4982-b190-8c3bedb292fc","resolution":{"observed_at":"2026-08-12T13:52:02.471005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.456801Z","title":null,"venue":null,"work_id":"c3247c99-e23c-4064-bc4a-b57397ab20de","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.931201Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:ef638de2b0fce57fa9475b5d6bce176de80aa6aa20d2aa266892f52af4ff6faf","observation_id":"9dae3267-a08e-4cd5-84e8-75757a0763d4","resolution":{"observed_at":"2026-08-12T13:52:02.460457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.446204Z","title":null,"venue":null,"work_id":"3c0dbc9e-53d4-4955-8d61-45754814fedc","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.934996Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:24aa0aab48c8c97371321563051b27e86e966f5201f4c439cff3442ad1aad549","observation_id":"7cf1211f-0014-485e-8570-d25dffcf18e0","resolution":{"observed_at":"2026-08-12T13:52:02.450028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.434851Z","title":null,"venue":null,"work_id":"41495d18-4be0-4a54-8493-ba3da5033584","year":2022},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.938730Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:a92676970ad44d3d32d7087c24d6a69d7544cc0bb4e67d623cfb8768e5519890","observation_id":"3f1d54d6-bb18-40a7-958d-ac97aaedbab9","resolution":{"observed_at":"2026-08-12T13:52:02.438848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.424542Z","title":null,"venue":null,"work_id":"3f5e082b-1839-4e86-ad31-6bcb26ec244e","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.942368Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:23cec8e34f674ca4aa6faaa1c342cd6feb2d3d2a4ac0d6d23235d974e3e7f01f","observation_id":"b78debd1-b4a4-491c-843d-dd67bd6df146","resolution":{"observed_at":"2026-08-12T13:52:02.428062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.412819Z","title":"Focal modulation networks","venue":null,"work_id":"37400b49-5122-4e5d-87c0-549888fc101c","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.945959Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:f7e37b2c3c68d70a6306309a5616abc321e0de0b64bce4f46840e103bba0b3f7","observation_id":"93701c40-8fc3-42ba-83d7-d0c3d6f8f58c","resolution":{"observed_at":"2026-08-12T13:52:02.416529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.402068Z","title":null,"venue":null,"work_id":"cdec097f-9026-4856-8a1d-65dec3b1c3a4","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.949700Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:a82223051f231e4db42cc0bbe9222eb3c575f9f08f34c92a584274fd2cbf15b1","observation_id":"186c6d98-0832-433a-a055-87088b28dd54","resolution":{"observed_at":"2026-08-12T13:52:02.405632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.392108Z","title":null,"venue":null,"work_id":"5db2af4f-7a59-44fa-a55f-26d7ca0b16f9","year":2020},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.952997Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:343e335635525a560276f1a48d0c548836392cd731ff16bb6039def3ac7f64a2","observation_id":"2c9af23a-5862-4f29-8076-296ad00a2bea","resolution":{"observed_at":"2026-08-12T13:52:02.395560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.381789Z","title":null,"venue":null,"work_id":"a2fd21f3-9ef9-415c-b53f-0ab8d3bcd427","year":2023},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.956963Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:a2b125e74270b3adf4e7b234aa9269091e38d3bdf74899fc93ed33e881ca713b","observation_id":"c1eae602-55f9-41c1-9bd2-1ccc2b613456","resolution":{"observed_at":"2026-08-12T13:52:02.385419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.370752Z","title":null,"venue":null,"work_id":"ca8587c0-5a81-4117-b50f-1a6c94de4866","year":2020},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.960510Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:5833bf41f815dd1fd4a78f41c47578f0fc6a7ebc4fcb967bf5369d5717346a4f","observation_id":"e7a2fa38-5666-4d17-9b50-794c055b7be6","resolution":{"observed_at":"2026-08-12T13:52:02.374194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.360333Z","title":"Zhang, H","venue":null,"work_id":"da18a621-b4a9-471d-82f2-54b2dd183c6a","year":2023},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.964070Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:2045c192a5840db19055aa5d7d196e8afea33d2e0a39bc11b9490b0880c61dfb","observation_id":"a173fdea-0cca-416c-8992-09bacad61b03","resolution":{"observed_at":"2026-08-12T13:52:02.363957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.350048Z","title":"Zhang, Q","venue":null,"work_id":"12b25551-6958-4e31-b223-6704058ca150","year":2020},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.967728Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:e2e5748ff3b863218aa288d5008288478fbc3e05b1252482d288f35bbf90ecf5","observation_id":"8138ba96-6143-499b-aaa4-862b93d653cb","resolution":{"observed_at":"2026-08-12T13:52:02.353810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.339959Z","title":"Zhang, N","venue":null,"work_id":"b6a6ef8d-2894-4102-8f9c-d692eaf0947f","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.971474Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:696e808864dab599bcf20ae5428b96bd95e899c9658fa7da006cb1ec481c68cc","observation_id":"f84f32ac-aa80-4def-b33d-c2f00e5f50cd","resolution":{"observed_at":"2026-08-12T13:52:02.343331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.329856Z","title":null,"venue":null,"work_id":"b179b538-a327-470d-a41b-e63a5ad7ee23","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.974967Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:9591dd54aa351a32b0d5f8efb3558c9c67dba80298c9c0b33f77c8b2c5afabef","observation_id":"2b1454dd-97f5-48ca-a68b-4496d3c9269a","resolution":{"observed_at":"2026-08-12T13:52:02.333260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.319832Z","title":null,"venue":null,"work_id":"a79c2459-8850-477b-9d24-419aa74a52eb","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.978543Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:66d1b388b43833e94026ab1338a940012d885d9152362b52bbd2afa561185e20","observation_id":"f29c44d3-8fd1-400b-9fc3-5aa4c8d0e6ee","resolution":{"observed_at":"2026-08-12T13:52:02.323322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.309969Z","title":null,"venue":null,"work_id":"aa084c73-1983-47f8-9195-22af09552e2a","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.982195Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:7d36b2047a4be8aa9c9a05343f0179526bce36e1951bfb896c80e9669b886dbd","observation_id":"0fef15b4-c1c1-47cd-9e46-114499501b37","resolution":{"observed_at":"2026-08-12T13:52:02.313494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.300236Z","title":"Zheng, Z","venue":null,"work_id":"a189ae48-abab-404e-972a-bb06b9590799","year":2023},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.985831Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:3c5115ddb7a1988408e97f54f37c05553baa9ace40538ec91abdf8de8b02fbd7","observation_id":"a7d98d71-b083-4648-b29d-17fa2ec6fe4c","resolution":{"observed_at":"2026-08-12T13:52:02.303643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.289924Z","title":"Zheng, Z","venue":null,"work_id":"8b64973c-bcd6-4f2c-a5ad-8cb5df9ddfd0","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.989562Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:0efb2f3d8fbb000fb00d9fbbda71517461a6584afe6f08bf66b98e118012125b","observation_id":"b03ef36c-5ba4-41ef-becf-8e766a46f62b","resolution":{"observed_at":"2026-08-12T13:52:02.293402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.279898Z","title":"Zhong, Z","venue":null,"work_id":"8e5a58ca-b003-46df-a478-49dfd8072ab9","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.993029Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:646d7a5fd96e134d3b1d9a7c3b8f649f6cea39e01052ba92544c1576bddc226c","observation_id":"c62406a0-315f-4f61-af7b-da06ac9b7f0b","resolution":{"observed_at":"2026-08-12T13:52:02.283397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.269502Z","title":null,"venue":null,"work_id":"5d252d80-b4c3-44b1-b2f7-d5072a601b82","year":2024},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:01.996763Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:7ca72c4d5c046befa6054f35b49730657099fe094fa048ce3141c8572e73d322","observation_id":"6058e508-5406-4c3b-8ec9-ae5dc4dce09d","resolution":{"observed_at":"2026-08-12T13:52:02.273523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.259009Z","title":"The key advancements and their impact are de- tailed as follows: Removal of the rectification Module and introduction of MSR and FRM","venue":null,"work_id":"99fe9e0b-bb4e-49ca-8b73-77b5fcef592e","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.000876Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:27e27a8d95763dd58284e819be16829a1ceab9ecd455227b7f1111a4d9abf9e7","observation_id":"644d4faf-91f8-4eb4-817c-9add2ffb44cf","resolution":{"observed_at":"2026-08-12T13:52:02.262873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.247275Z","title":null,"venue":null,"work_id":"b8b4abe6-bf24-406e-a783-adbca844e04a","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.005403Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:74794227ab87aef1f53629a240157675c1e888da27f2280e603b63a1dbe69733","observation_id":"a42e754e-3257-4d5a-8a32-ca7aba305dfc","resolution":{"observed_at":"2026-08-12T13:52:02.250933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.236444Z","title":"This confirms its limitations in bal- ancing different recognition tasks","venue":null,"work_id":"2b842105-e120-41c4-b1b5-2995d9ab7623","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.009133Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:53aee04a1dab6cefa3714ce2764fc0216f4994f3835c7217e826478a2d97c83c","observation_id":"ec4fa9f7-ee3f-4122-bc8d-14c7445e4278","resolution":{"observed_at":"2026-08-12T13:52:02.240299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.226006Z","title":null,"venue":null,"work_id":"3d8d231c-4c4b-492d-a5f1-d53cef06b772","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.013056Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:5afaffe3f12c81bdf53c5af6f410c6be5891c64b5f3488faee0bcfa3ded2101f","observation_id":"d11e7c02-4b9c-4d16-87cd-c4975e8e0ff3","resolution":{"observed_at":"2026-08-12T13:52:02.229530Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.215057Z","title":null,"venue":null,"work_id":"bc048e71-64d0-4236-9056-d008c1a2b72f","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.016534Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:dbe87ff994bed981b3ed41abbbd54893481d704490f4b93a5194c7c3515b2139","observation_id":"db402a54-02b5-4589-85b9-14b0146b4de8","resolution":{"observed_at":"2026-08-12T13:52:02.219158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.205028Z","title":null,"venue":null,"work_id":"41461941-04c0-4350-be11-ffe379b7186f","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.020312Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:d7cd03a363c4e8f580090454510bc6eeb0880dd70ea870e3b7aa05714a5dca1c","observation_id":"9adbb478-b10f-4c13-ab1a-6e1d7cd2a878","resolution":{"observed_at":"2026-08-12T13:52:02.208369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.194826Z","title":null,"venue":null,"work_id":"4abaeead-d8c7-4ad4-8027-fbf2f90bd4b0","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.023853Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:e920b4b07440fb9eadf732c74d62292cfafb9e51f541b1da9384a8d6d1a68f77","observation_id":"7163ad71-8e88-4a9a-aeb6-8e7072446be9","resolution":{"observed_at":"2026-08-12T13:52:02.198535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.183575Z","title":"By varying them, SVTRv2 architectures with different capacities could be obtained and we construct three typical ones, i.e., SVTRv2-T (Tiny), SVTRv2-S (Small), SVTRv2- B (Base)","venue":null,"work_id":"bc730fbb-1342-4aee-a7b7-2c5b2dfc5c59","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.027339Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:957b424d4eb4886d22d4b54264eb6dc4cbab7d6e9fb7465ed8ced854a1a2a7b5","observation_id":"ab604afe-4876-4932-bd02-9f4d8af08a24","resolution":{"observed_at":"2026-08-12T13:52:02.187761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.171741Z","title":"There are three large-scale real- world training sets, i.e., the Real dataset [4], REBU-Syn [37], and Union14M-L (U14M-Train) [25]","venue":null,"work_id":"46159a0e-a852-4f2d-8ccc-fb7ead7e270b","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.032490Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:08308d9fe01071cabde07a88089845a91fe7e82118d382c128b71f44dfaecd65","observation_id":"d091e104-4629-4483-a89b-8b1736cfa8bb","resolution":{"observed_at":"2026-08-12T13:52:02.175818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.159952Z","title":"We first mea- sure the inference time for 3,000 images with a batch size of 1, calculating the average inference time for each text length","venue":null,"work_id":"7896d49f-5a41-4de2-89e5-d6ae6d6e608a","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.036090Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:0a9c19b08b795dae166a9508b1f81ca46c8250fb161a5393375e599664341ce9","observation_id":"04a657e7-4fa3-4aec-a624-ca60e7f167dc","resolution":{"observed_at":"2026-08-12T13:52:02.164112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.148403Z","title":"Following this protocol, we also train SVTRv2 and other models on synthetic datasets","venue":null,"work_id":"edff56e6-a487-42ea-acd0-40e4f3543278","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.039630Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:d0a2b56f4ef147340c5b7dd7a02cf990d16154d1c9da87dd2d3a73df5a6d734b","observation_id":"9f8539bf-cc19-459b-aac4-04fea25834e8","resolution":{"observed_at":"2026-08-12T13:52:02.152492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.137316Z","title":null,"venue":null,"work_id":"7f09bf65-edfb-437f-b565-17c1a211cd44","year":null},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.043222Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:c4fb7ec6d5e0e35e418e3dc36bcdd1ffc43944a5e136499e8342b364ab795cb5","observation_id":"2d643c90-9c44-451b-8b19-fbcdde44f180","resolution":{"observed_at":"2026-08-12T13:52:02.141076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:52:02.124952Z","title":"However, key factors such as training epochs, data augmentations, input size, and evaluation protocols significantly influence model accuracy","venue":null,"work_id":"50d6cd6b-fbd1-431c-be99-ac46e43c3fcb","year":2019},"citing_paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T13:52:02.046857Z"},"links":{"citing_paper":"/paper/2411.15858"},"observation_digest":"sha256:123c3bba97f55cbb23ddb75a9702d0428b9b8faff14653c64eed8a25e109ce95","observation_id":"30798436-cf19-44cb-a3b0-0fa423966382","resolution":{"observed_at":"2026-08-12T13:52:02.129433Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15858","last_updated":"2025-07-15T09:49:40Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T13:31:31.893922Z","submitted_at":"2024-11-24T14:21:35Z","title":"SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 2 inbound Pith citation observations for arXiv:2411.15858."}