{"as_of":"2026-08-08T16:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bd002821b3c1eb4aff6230a48c02e669737efedb06d0761664d1f344303242ad","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:47:10.727414Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20188/citation-record","integrity":"/paper/2507.20188/integrity","json":"/paper/2507.20188/citation-record.json","paper":"/paper/2507.20188"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:15.474964Z","title":"In: Proc","venue":null,"work_id":"d120c49a-aa20-464d-a0ae-726005fbd5ea","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.537282Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:5e61d6208718943e5565eb6dfa477cb3aa1325f09b25bf0dd0faea9ad081603b","observation_id":"c57d9411-0cac-4a2a-a7bc-811f7f503239","resolution":{"observed_at":"2026-08-06T13:47:15.540113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:15.312654Z","title":"IET Image Processing16(10), 1234–1245 (2022)","venue":null,"work_id":"d4babbde-f67e-4388-85cb-52f0190f796a","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.586509Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:e54b13fa4e6fe61a7a01ab8050fb8537d54f669dafd1ffb10b1f581a55ad0f61","observation_id":"306be282-979b-4dfe-b983-c0f2106f8fe6","resolution":{"observed_at":"2026-08-06T13:47:15.370256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:15.173070Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"c6733dc3-391f-4d2e-92ea-8980d6e8a25a","year":2024},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.669536Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:198c2de8d648d05df619b96a7e3405a828c6cadcb932c23f1e71b7efa34bc699","observation_id":"07bccdc9-4d53-47a0-9922-ae3c50f72276","resolution":{"observed_at":"2026-08-06T13:47:15.215141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01315","last_updated":"2018-01-04T11:48:21Z","snapshot_observed_at":"2026-07-06T06:17:08.751807Z","submitted_at":"2018-01-04T11:48:21Z","title":"PixelLink: Detecting Scene Text via Instance Segmentation","version":1},"cited_work":{"arxiv_id":"1801.01315","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.01315","snapshot_observed_at":"2026-08-06T13:47:11.077158Z","title":"PixelLink: Detecting Scene Text via Instance Segmentation","venue":"cs.CV","work_id":"90d07cb3-b3c4-4a6c-85e4-c34c38194746","year":2018},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.754650Z"},"links":{"cited_paper":"/paper/1801.01315","citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:b44358bd0a5581dd2ffb4b5d3056918f0c230870ac543009aebb793ac986c9ee","observation_id":"1ae43810-97ae-4dc1-ba28-62323628aec2","resolution":{"observed_at":"2026-08-06T13:47:11.159332Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:15.026328Z","title":"In: 2013 12th ICDAR","venue":null,"work_id":"08d9c474-9f00-4322-aa72-03f4cf5d18ef","year":2013},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.841656Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:b69f35ebf8ed1b3f3f786155a2618dd19f8b43d3e6194aa7b53483f50f0801a1","observation_id":"f88bec71-f3b8-4820-87e3-cc04ef3a5a7e","resolution":{"observed_at":"2026-08-06T13:47:15.075814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.886158Z","title":"https://github.com/facebookresearch/xformers (2022)","venue":null,"work_id":"46317a85-4b1c-4005-afc0-6dcf170055c3","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:08.996694Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:373adc9bdc7985a13006f14d11189d8f4ffe36d88679f9e4129a79268e91e27c","observation_id":"ae291186-8e32-4257-95c2-8f5902b4b34c","resolution":{"observed_at":"2026-08-06T13:47:14.950417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.733081Z","title":"TPAMI45(1), 919–931 (2022)","venue":null,"work_id":"7e91c662-0955-4a2c-b818-1639d6f73642","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.110028Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:7d55a4f81c6a327d9130d5d5ac4e0a15996dbbbc69df05e5bae0290c3155e356","observation_id":"ada7d837-fed6-4256-8480-d5c99d609325","resolution":{"observed_at":"2026-08-06T13:47:14.809984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.522225Z","title":"Pattern Recognition90 (2019)","venue":null,"work_id":"223dd1e8-272f-4c25-b379-9b083a24928c","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.245532Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:2dce8b057ffab4b13073db556096956c7e942f675119152cfd108750e8bc8934","observation_id":"98910794-76ac-4efc-afa5-44e20e051b25","resolution":{"observed_at":"2026-08-06T13:47:14.607434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.371052Z","title":"In: ECCV","venue":null,"work_id":"ab912d49-a7dd-4db6-b951-2aa385bf685a","year":2018},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.343565Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:ffdae5eb340100bad820f2cfba9392a4869b10512c61153745c1f5ca0ffa34bb","observation_id":"decc613e-c993-4b46-91dc-687223baa135","resolution":{"observed_at":"2026-08-06T13:47:14.431124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.188126Z","title":"In: ICDAR","venue":null,"work_id":"95c7792d-72c0-445e-926e-6b3252ebdc6c","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.420916Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:0a64456618d16cf9bc37f10ca2ac7babdb0a92d289f6f74ffa152b6a7ca074fe","observation_id":"b986e709-bf03-4212-94e3-97675c8ac78a","resolution":{"observed_at":"2026-08-06T13:47:14.289538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:14.006894Z","title":"In: ICCV (2021)","venue":null,"work_id":"25307178-4bc8-44fc-b8b8-693aa3b2fc26","year":2021},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.516304Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:8f4663b1f7e39f51af17f935b3f9437beebe0e5e0bf828c2656c673db6863a40","observation_id":"f4275bd7-2e1c-4060-ab5a-7104ccb5578a","resolution":{"observed_at":"2026-08-06T13:47:14.072984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.860722Z","title":"In: ICML 2021","venue":null,"work_id":"334e807b-fc10-46d4-837f-c08846849320","year":2021},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.579923Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:f0a480bee8a7494a245b47992c3a69ca7cfcd6e603d8c528ed5c9d231c7c61d5","observation_id":"7b9b2e63-6d1d-456b-8b0b-3e71683b5738","resolution":{"observed_at":"2026-08-06T13:47:13.931089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04305","last_updated":"2020-06-30T22:23:08Z","snapshot_observed_at":"2026-07-06T09:26:49.619674Z","submitted_at":"2020-06-08T01:08:04Z","title":"Text Detection and Recognition in the Wild: A Review","version":2},"cited_work":{"arxiv_id":"2006.04305","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.04305","snapshot_observed_at":"2026-08-06T13:47:10.920054Z","title":"Text Detection and Recognition in the Wild: A Review","venue":"cs.CV","work_id":"c4726d8c-414b-476c-9b7a-ebcea253ba7e","year":2020},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.664923Z"},"links":{"cited_paper":"/paper/2006.04305","citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:23ffc4a6ea09d8b35843f7a6afe7316fcc10fa25b9e52aa0e8f017e19ba3166b","observation_id":"f47364d0-b4c3-452d-b0f5-8efc22c0399e","resolution":{"observed_at":"2026-08-06T13:47:10.975700Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.717903Z","title":"In: CVPR","venue":null,"work_id":"ea6594c1-9279-4736-9a34-e81bb60669ff","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.737879Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:1ccfd1ca6e46ec8a686a6c63a242c449c07199c00095a565d448d627262a83c5","observation_id":"e58c4d3c-25c2-4b50-bb4d-30291eba0fff","resolution":{"observed_at":"2026-08-06T13:47:13.784811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.595958Z","title":"In: CVPR","venue":null,"work_id":"967a5c82-69b1-474b-9752-573bc9722d7d","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.819805Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:ad2011c32835301c598e8504dd094fe289800c7136410663a1f25c46e90cea99","observation_id":"ecc96fa7-9beb-47ad-879d-ff6c6b6f78de","resolution":{"observed_at":"2026-08-06T13:47:13.626990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.430354Z","title":"In: CVPR","venue":null,"work_id":"6b9cf38a-e92d-4aac-a95a-1c089cd967f6","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.870888Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:e8be6ee4efccfed8f3076800e130d36582f0e96e689a24c967f07cf52179bc22","observation_id":"6ac3739b-1c17-41a8-9784-cde8bd878605","resolution":{"observed_at":"2026-08-06T13:47:13.508790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:13.200191Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"e2c773c6-98be-4b88-abf1-1ad1e87d0497","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:09.971766Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:fef8e55377135a12abc9f891c42c7138bd83da03569d9403d205f2f91e5fabd0","observation_id":"7353e8f9-fe1f-41bc-9b7f-8748991620bd","resolution":{"observed_at":"2026-08-06T13:47:13.328071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.988150Z","title":"In: 2023 IEEE International Conference on Systems, Man, and Cybernetics (SMC)","venue":null,"work_id":"54a9bacf-5e92-470e-be24-2b84ca5c3f7c","year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.085167Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:2fe16b48c98a10311482413a4996bfd6eee9de3d852940ea4c17b5e03bc6e52a","observation_id":"d79fd054-d737-42fa-9e39-1008cd7ef223","resolution":{"observed_at":"2026-08-06T13:47:13.086408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.711784Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"29366a3d-4df1-4694-87c9-226075d4cc08","year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.164342Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:b845a0b6c8f67bdcecbe742cb1e886066a05e4cd83eb6ad0655c2c737f19f936","observation_id":"48879f16-c295-40ee-a399-27136a76c958","resolution":{"observed_at":"2026-08-06T13:47:12.831053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.535227Z","title":null,"venue":null,"work_id":"193e799a-656f-4b8c-b40e-b995a018693f","year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.241498Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:28c4e7dd31591725e85038b579fe65c3df7792a4b9c8056f18c6eb7d4fa24da6","observation_id":"679c82f6-1755-4b80-82ea-9bb328ec5b5e","resolution":{"observed_at":"2026-08-06T13:47:12.594547Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.381507Z","title":"In: CVPR","venue":null,"work_id":"537541e8-3f1c-4cd1-a743-552c4b81276c","year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.284553Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:cbc5365355aada1a4058839f03c2a271b6acbe2b7ee85713bdfa82480e1a6146","observation_id":"e3715f1d-3c93-4e41-bfec-16f1e98d25be","resolution":{"observed_at":"2026-08-06T13:47:12.466048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12817","last_updated":"2023-08-28T01:45:09Z","snapshot_observed_at":"2026-07-06T16:09:59.750388Z","submitted_at":"2023-08-23T05:13:00Z","title":"MixNet: Toward Accurate Detection of Challenging Scene Text in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12817","snapshot_observed_at":"2026-08-06T13:47:10.364933Z","title":"arXiv preprint arXiv:2308.12817 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.364933Z"},"links":{"cited_paper":"/paper/2308.12817","citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:06b187f20cdde55fd61b699b98734784f0d187534759a23ccffc747e1bd813bd","observation_id":"a0395102-8868-41d7-b161-4d7d0e53d2b7","resolution":{"observed_at":"2026-08-06T13:47:10.364933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:12.104087Z","title":"In: CVPR (2019)","venue":null,"work_id":"398203ca-3fb7-4ae9-9cdd-b66b5a4eb148","year":2019},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.446923Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:70f0ed96754782ccc43cae1f1f9a0c7d6feab4eedbca680f5622654f5a29ce83","observation_id":"bd1ee3b9-5583-4c96-ae80-128b5d4cccaa","resolution":{"observed_at":"2026-08-06T13:47:12.196956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:11.873604Z","title":"In: Proc","venue":null,"work_id":"11182bee-cbed-4d84-921b-590e1daa6944","year":2022},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.528446Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:8a4548bdfc244cadc75c859ab63f0a3cde8746ea8b9d05e617bbc84c41021f02","observation_id":"080edae3-2e6f-437d-9111-fe491de9b620","resolution":{"observed_at":"2026-08-06T13:47:11.977921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:11.526343Z","title":"In: CVPR","venue":null,"work_id":"3267f6f4-b05b-49d3-b9ac-920d8fb4edb3","year":2017},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.626417Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:f48d0b3ccb00ecf8f61bea092616a80654782b763c571f77685418122364c4a6","observation_id":"4886380d-ba07-4308-b306-cd360dd3550e","resolution":{"observed_at":"2026-08-06T13:47:11.669834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:11.266954Z","title":"In: CVPR","venue":null,"work_id":"52e523d8-5bc0-4530-94d6-b5b86ebf017e","year":2021},"citing_paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:10.727414Z"},"links":{"citing_paper":"/paper/2507.20188"},"observation_digest":"sha256:8c97add0fc9f80e928756263d8263cc1ea1dd8689b4c4808de62984ef53b1ab6","observation_id":"188ec16a-4f0e-433f-b013-4144cb4e4944","resolution":{"observed_at":"2026-08-06T13:47:11.396061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20188","last_updated":"2025-07-27T09:16:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T13:47:07.992296Z","submitted_at":"2025-07-27T09:16:39Z","title":"SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2507.20188."}