{"as_of":"2026-08-07T12:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fb083c160dc2342111dfde18538fd1736dbd974db64059bfe9a8035167a9c7c2","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:01:15.212230Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:17:04.427228Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T10:17:04.757643Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"cited_work":{"arxiv_id":"2506.03799","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03799","snapshot_observed_at":"2026-08-06T10:17:04.757643Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","venue":"cs.CV","work_id":"5ee023d9-c9e3-43de-a87b-79ece14b85ae","year":2025},"citing_paper":{"arxiv_id":"2508.00395","last_updated":"2025-08-01T07:46:00Z","snapshot_observed_at":"2026-08-06T21:35:44.147502Z","submitted_at":"2025-08-01T07:46:00Z","title":"Decouple before Align: Visual Disentanglement Enhances Prompt Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T10:17:04.427228Z"},"links":{"cited_paper":"/paper/2506.03799","citing_paper":"/paper/2508.00395"},"observation_digest":"sha256:b7d8d8d4682a64c80d06abbaa9b7143437a0ee484c6f98c26bc57b479da2183b","observation_id":"67d5aa8e-f874-4373-bc2a-3b5bcc26b4d2","resolution":{"observed_at":"2026-08-06T10:17:04.762107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03799/citation-record","integrity":"/paper/2506.03799/integrity","json":"/paper/2506.03799/citation-record.json","paper":"/paper/2506.03799"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.15661","last_updated":"2023-05-17T21:08:32Z","snapshot_observed_at":"2026-07-06T14:24:05.948664Z","submitted_at":"2022-11-28T18:59:51Z","title":"What learning algorithm is in-context learning? Investigations with linear models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15661","snapshot_observed_at":"2026-08-07T11:01:07.438206Z","title":"What learning algorithm is in-context learning? investigations with linear models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.438206Z"},"links":{"cited_paper":"/paper/2211.15661","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:5b859dc112d5febba034f771e17072298efe32a7438cd8c1e67acc8a35e31668","observation_id":"fbfc7dd0-2c91-48fe-a745-75f02d3103a0","resolution":{"observed_at":"2026-08-07T11:01:07.438206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.511443Z","title":"L., Darrell, T., Malik, J., and Efros, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.511443Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:df33f3ac25edc2af871f8de354dd7e870c1aac320a5d73dd2a7d7457a3198ae5","observation_id":"eefa5975-0c1d-45d7-b7aa-1ac9c1122abd","resolution":{"observed_at":"2026-08-07T11:01:07.511443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.586827Z","title":"Visual prompting via image inpainting","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.586827Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:8f9b4f7c706fe1473c7cb83ac50dd104c0cec9049304313f84226468c2d9f443","observation_id":"052ed2e7-3983-46a5-9f76-362e18b6a7ef","resolution":{"observed_at":"2026-08-07T11:01:07.586827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.637027Z","title":"Scene text removal via cascaded text stroke detection and erasing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.637027Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:27c1e7c32121852a5add17016e688ee8c081ae3d4519f0aa3d01474da8141147","observation_id":"424b35ec-2f1a-488e-ae94-15d0f14cb661","resolution":{"observed_at":"2026-08-07T11:01:07.637027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.724685Z","title":"Coco\\_ts dataset: pixel--level annotations based on weak supervision for scene text segmentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.724685Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:e6220c555147a3a237dfc32cd8152ee120ab5274a753c634edcfcf4336d0b879","observation_id":"a17ef9f7-5dca-4a3b-a292-ca95186173f7","resolution":{"observed_at":"2026-08-07T11:01:07.724685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.810203Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.810203Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:98f998887dca805fe2a810c662a540a37c8585affb2557d5fb5d04a4f285f23c","observation_id":"de8370df-e35f-49a9-a638-e035285bd185","resolution":{"observed_at":"2026-08-07T11:01:07.810203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.892136Z","title":"Textdiffuser: Diffusion models as text painters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.892136Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:5c42602e7d41203f901362321104e4c47ee14d53a3cf9d2d7183af741d2d9939","observation_id":"8003483c-f748-4978-a8bb-f8a3edb53b96","resolution":{"observed_at":"2026-08-07T11:01:07.892136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.938275Z","title":"Encoder-decoder with atrous separable convolution for semantic image segmentation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.938275Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:f0259fe8e4f98e19632b8563871805ee63efba8f61479951cab48124a4912ef7","observation_id":"7cc66195-3df5-4d4d-8429-e9373ea7a7f7","resolution":{"observed_at":"2026-08-07T11:01:07.938275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.043288Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.043288Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:4327cd09205a38621a329bcb2b416217aa4bf0a327cd56e9706b68e339d5990b","observation_id":"40c8c6d2-a591-4183-921a-2b950d8e924c","resolution":{"observed_at":"2026-08-07T11:01:08.043288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.117319Z","title":"and Chen, P.-I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.117319Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:a71d0f2fa3b9e0998b7e934bbb6a1dcedecaa5019095aa39dffd0b2cfff38281","observation_id":"296a61ec-7b63-4b5a-9ac7-d2e50ddb49c2","resolution":{"observed_at":"2026-08-07T11:01:08.117319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10559","last_updated":"2023-05-15T11:45:12Z","snapshot_observed_at":"2026-08-04T19:53:52.631474Z","submitted_at":"2022-12-20T18:58:48Z","title":"Why Can GPT Learn In-Context? Language Models Implicitly Perform Gradient Descent as Meta-Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10559","snapshot_observed_at":"2026-08-07T11:01:08.177043Z","title":"Why can gpt learn in-context? language models implicitly perform gradient descent as meta-optimizers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.177043Z"},"links":{"cited_paper":"/paper/2212.10559","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:38fe99006d167eb254a54c888c5bcee09bbab9a0b3cec0bd07c69b02e8e40e1f","observation_id":"bc3b31fb-3efc-45a2-9ef0-166de5dcd8aa","resolution":{"observed_at":"2026-08-07T11:01:08.177043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-07T11:01:08.241028Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.241028Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:af224804b842153cf0b11b3e7ade18466d931c895ae9b2e9d9bfc37d0424afc1","observation_id":"fdcfb62e-104a-4945-bde3-a71c4a30fb11","resolution":{"observed_at":"2026-08-07T11:01:08.241028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T11:01:08.301690Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.301690Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:f24783fc1486a6518e3a5affb5ee4b78e9bee97dc544fe02c722d7d3bcd905c6","observation_id":"77a1d93e-c52c-4cf7-93a3-fb7685058b85","resolution":{"observed_at":"2026-08-07T11:01:08.301690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.374802Z","title":"Modeling stroke mask for end-to-end text erasing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.374802Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:472def4d7039a0c7f2ba1967eb539ed0cc67a536cfd0a5ee92735ce4326e5fa1","observation_id":"191929ef-e3ee-4f29-819a-cdc37ff00c3d","resolution":{"observed_at":"2026-08-07T11:01:08.374802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.438526Z","title":"Progressive scene text erasing with self-supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.438526Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:674ba2e280c3bd737b3cd2155453c468001bd10824eae8d993b81d66626f48f0","observation_id":"34fe5e37-130e-4d70-9ce9-754c02d65df8","resolution":{"observed_at":"2026-08-07T11:01:08.438526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.502534Z","title":"Progressive scene text erasing with self-supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.502534Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:2a17ac874e74ba38258a927d47d40ade88555cf0066251dbda5e22097b8f2f06","observation_id":"f57efffc-cc56-4f0a-a6ef-e02a7a999e98","resolution":{"observed_at":"2026-08-07T11:01:08.502534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.571502Z","title":"M., Loy, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.571502Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:e8339d9162c4ee1a6668190c4c677bacb2ee63693f36d1c95c859958a1a87788","observation_id":"3b5d5732-05d1-4d05-afc4-54e35e4f76ca","resolution":{"observed_at":"2026-08-07T11:01:08.571502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.629731Z","title":"S., and Valiant, G","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.629731Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:ce782a15962951cc0e1fea952a43dfebf601d08f4d7058363ca11c54c816c9d9","observation_id":"07bf1aee-7a7c-4dd1-a35a-ba6399344be5","resolution":{"observed_at":"2026-08-07T11:01:08.629731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.697679Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.697679Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:c6b042256a191890706dbee263ce3a3cc3c25c243bfd8f61d742d768851b77fc","observation_id":"a12fb2ec-e77d-4149-a054-3ab773d2fe10","resolution":{"observed_at":"2026-08-07T11:01:08.697679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.760612Z","title":"J., and Wang, Z","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.760612Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:a813fd582a22a2a4c2a07c91c009ff01a25ecda6fc727e144092402d93351d77","observation_id":"9cd4d61a-20de-4e3e-9175-e1100c254dac","resolution":{"observed_at":"2026-08-07T11:01:08.760612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.845077Z","title":"Self-supervised text erasing with controllable image synthesis","venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.845077Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:1b43be209341069e506f28b69d35be9ffadaa4bee0d24e1832a43b10caa84225","observation_id":"73a8556a-1506-429d-ae0a-1a7f50cf9f74","resolution":{"observed_at":"2026-08-07T11:01:08.845077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.498361Z","title":"C., and Gevers, T","venue":null,"work_id":"012adf39-0580-4d1d-8903-1951c5855d35","year":2012},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.897571Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:fef171aa4567a2816d1b0e9f605fed6ebcdcacc83c51e5ce4946a081f2886a35","observation_id":"ee96fb5c-51a6-4d56-bd55-32d824867d2f","resolution":{"observed_at":"2026-08-07T11:01:16.502705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.484533Z","title":"G., Mestre, S","venue":null,"work_id":"47953686-939d-4731-b11b-83cb6e358932","year":2013},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.967265Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:d087bd88965facc1ce490e74e4f378f58be2ed4f672499758755b8a713994fe1","observation_id":"3483ff39-1f82-48e0-8bcc-3c8511a9663f","resolution":{"observed_at":"2026-08-07T11:01:16.488622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.018900Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.018900Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:81234721b904bca3ff0e9fa9447af84dac5fe57ed9bff055a932ac908b3d447f","observation_id":"56747e1e-645a-4343-8212-9655b6f646d6","resolution":{"observed_at":"2026-08-07T11:01:09.018900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-07-06T15:12:37.953383Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-07T11:01:09.090304Z","title":"C., Lo, W.-Y., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.090304Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:1fcbe882e5da35ea71b2490e4513c51d6adc1c18b7a29aa8d3c1c8966bc8a38e","observation_id":"893be5e1-032c-4e13-865c-953e35a68c45","resolution":{"observed_at":"2026-08-07T11:01:09.090304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.150392Z","title":"Crafting papers on machine learning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.150392Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:fc79757369d2532bf52a10387febeff229c4ca4269bf2629481ffe3986ce0213","observation_id":"34f3e907-1c2c-4ebc-b09b-74e9697d2c07","resolution":{"observed_at":"2026-08-07T11:01:09.150392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.450727Z","title":"and Choi, C","venue":null,"work_id":"03f07d53-6f58-4710-bf4f-00e3f0eac192","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.210813Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:ebb7f85c2b1de9527eeef0487feec2d5cccc5bb20b4b93095e6ddfeb9bf8e4e8","observation_id":"20b55225-958b-4bbb-aa3e-0f5b72066ce4","resolution":{"observed_at":"2026-08-07T11:01:16.454990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.435607Z","title":"Monte carlo linear clustering with single-point supervision is enough for infrared small target detection","venue":null,"work_id":"a59f69a0-00a3-4a4c-94cd-dd065abba613","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.271167Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:470f36808b8602b201c078caf294f70b89c79829af13c67480827c36b2b271c4","observation_id":"a455c9a9-f80b-49cf-8996-279edac122b5","resolution":{"observed_at":"2026-08-07T11:01:16.440318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.420965Z","title":"Ddaug: Differentiable data augmentation for weakly supervised semantic segmentation","venue":null,"work_id":"cd06bf2d-b657-425b-862d-ef655ce7fdf4","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.354080Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6bb8b4446d7ba2e896a749c4e6913b329593a749e593da101dd2091f1c9ca2bc","observation_id":"d11afdba-80b7-450e-87f2-7f6366d0e1dc","resolution":{"observed_at":"2026-08-07T11:01:16.425551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13276","last_updated":"2023-04-26T04:33:41Z","snapshot_observed_at":"2026-08-07T10:06:04.747785Z","submitted_at":"2023-04-26T04:33:41Z","title":"The Closeness of In-Context Learning and Weight Shifting for Softmax Regression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13276","snapshot_observed_at":"2026-08-07T11:01:09.423620Z","title":"The closeness of in-context learning and weight shifting for softmax regression","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.423620Z"},"links":{"cited_paper":"/paper/2304.13276","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:fec460b3d45605343e4e31b604bde5f5c0955a34272c936d8c1ac6acb92f2f05","observation_id":"0c1eef5f-07d5-48cb-95aa-adf43fed8f2b","resolution":{"observed_at":"2026-08-07T11:01:09.423620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.407012Z","title":"and Qiu, X","venue":null,"work_id":"2349f671-2d7c-48b2-85a0-34afbcf8abfd","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.492583Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:f693ce7e6059c9c856822d397b8a74eddde2c41db27bb3a041c0e918bb6915c1","observation_id":"5d9b6aa9-8e6b-4bbf-9a27-3848dafa8f6b","resolution":{"observed_at":"2026-08-07T11:01:16.411345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.391561Z","title":"Erasenet: End-to-end text removal in the wild","venue":null,"work_id":"dedcecd9-4bb0-4ef6-9efb-14927ace34a9","year":2020},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.561270Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6fc5abd918ce819f4d1610cfa26b6c5b88c03389f7783ed61cc11cb3896e8ab9","observation_id":"00aed386-7f3a-4578-8ca5-bcd4af8eaeab","resolution":{"observed_at":"2026-08-07T11:01:16.396348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.376232Z","title":"Don’t forget me: accurate background recovery for text removal via modeling local-global context","venue":null,"work_id":"114c6f52-b052-4da5-ab06-95a13539f473","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.638255Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:313b2b7905b8723b301cdac1e389aefaaefdee26a9caae67e3fb1497b3d0d59d","observation_id":"becf9f31-f948-4a4b-a7db-a51bfe537e19","resolution":{"observed_at":"2026-08-07T11:01:16.381114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.361519Z","title":"Don’t forget me: accurate background recovery for text removal via modeling local-global context","venue":null,"work_id":"d57d0b45-a8a4-44f5-8031-6e8bd546906a","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.726890Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:cdc28e3ab32b0731b7011110c8554d420665e16f6ac57e3f2996bd831e86bfb8","observation_id":"e9540eb1-c80a-4d77-9659-1f7a2f94155a","resolution":{"observed_at":"2026-08-07T11:01:16.366256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.347811Z","title":"Audio-visual segmentation via unlabeled frame exploitation","venue":null,"work_id":"3d848dc0-3c76-4e32-a49c-a1ff5371acbe","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.807256Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:2ff01f270fa9a3197ca17080ebcb8efcafd622a9890a24ae9aae99c9ff225d1c","observation_id":"370574e2-ebe3-41f9-b7a9-b23c7f1a53e6","resolution":{"observed_at":"2026-08-07T11:01:16.352035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06668","last_updated":"2024-02-13T22:37:39Z","snapshot_observed_at":"2026-07-06T16:46:06.801011Z","submitted_at":"2023-11-11T21:19:44Z","title":"In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06668","snapshot_observed_at":"2026-08-07T11:01:09.872864Z","title":"In-context vectors: Making in context learning more effective and controllable through latent space steering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.872864Z"},"links":{"cited_paper":"/paper/2311.06668","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:9777a901379a9b12f4c9221cddbeaa544c3b4dc6dd88cc757944a6c980c7694b","observation_id":"c8c7bd07-5992-4538-bec5-e34a6126e830","resolution":{"observed_at":"2026-08-07T11:01:09.872864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.334398Z","title":"Wdnet: Watermark-decomposition network for visible watermark removal","venue":null,"work_id":"900ece7e-40bf-4e30-90e0-b20d48e2162a","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.954199Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:e9b2a4c7789ce775a7248ecd9978ab72294a08a71f5b53047fb9d03a7162321d","observation_id":"0d5491be-b30c-4e9b-abc1-5fabc0aa216b","resolution":{"observed_at":"2026-08-07T11:01:16.338507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.319445Z","title":"Towards end-to-end unified scene text detection and layout analysis","venue":null,"work_id":"c80b73b7-ad48-49e5-a4f2-95ea52d5c4df","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.041487Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:df709653ad1a2c4700c182a1f39b8a7cade541f598483e3f28734639257b1f6d","observation_id":"2362b71d-5e5e-4265-b6a1-806153e50149","resolution":{"observed_at":"2026-08-07T11:01:16.323559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.304571Z","title":"and Zhu, A","venue":null,"work_id":"37aec42a-719c-4842-bbd7-2d68e795446f","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.132480Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:580faa2464e61f523658a9f9f1f0b63382bcd3f5e18353321264331298265752","observation_id":"05171fee-5010-45db-8980-e1b403e762be","resolution":{"observed_at":"2026-08-07T11:01:16.308819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.290033Z","title":null,"venue":null,"work_id":"804a3a7d-e72b-43b5-b92a-8cdbe75df417","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.222219Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:facae7ed5de1797128cb2fe17d85a69c88e0adec617aab6961c6a142b196349f","observation_id":"7e1baaa5-c0cb-4815-8572-b6fda6997e4e","resolution":{"observed_at":"2026-08-07T11:01:16.294716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09813","last_updated":"2023-03-17T07:47:55Z","snapshot_observed_at":"2026-07-06T15:04:49.291968Z","submitted_at":"2023-03-17T07:47:55Z","title":"DiffusionSeg: Adapting Diffusion Towards Unsupervised Object Discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09813","snapshot_observed_at":"2026-08-07T11:01:10.316282Z","title":"Diffusionseg: Adapting diffusion towards unsupervised object discovery","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.316282Z"},"links":{"cited_paper":"/paper/2303.09813","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0e138f047107da94148148ead127103aaf63198414d4c061d04e1d012667a794","observation_id":"f0c25978-acc9-480c-a66a-5a0f132e5c69","resolution":{"observed_at":"2026-08-07T11:01:10.316282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20046","last_updated":"2023-10-30T22:03:55Z","snapshot_observed_at":"2026-07-06T16:40:51.343918Z","submitted_at":"2023-10-30T22:03:55Z","title":"Which Examples to Annotate for In-Context Learning? Towards Effective and Efficient Selection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20046","snapshot_observed_at":"2026-08-07T11:01:10.410137Z","title":"Which examples to annotate for in-context learning? towards effective and efficient selection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.410137Z"},"links":{"cited_paper":"/paper/2310.20046","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:ff2a351d6b710b3be5bc8cb017576e2a0409bac130008bc9fe9d41d7b8ab4bb9","observation_id":"613b6460-f770-489b-8606-f5d9a1378942","resolution":{"observed_at":"2026-08-07T11:01:10.410137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12837","last_updated":"2022-10-20T14:04:10Z","snapshot_observed_at":"2026-08-01T15:23:39.998892Z","submitted_at":"2022-02-25T17:25:19Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12837","snapshot_observed_at":"2026-08-07T11:01:10.548624Z","title":"Rethinking the role of demonstrations: What makes in-context learning work? arXiv preprint arXiv:2202.12837, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.548624Z"},"links":{"cited_paper":"/paper/2202.12837","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0dcb9029510f045cbac9e9a2275be1c8e5d213f90cf5bb61deda6bf88dd13d48","observation_id":"85090e53-1aee-410c-b3fc-1d2c4257f306","resolution":{"observed_at":"2026-08-07T11:01:10.548624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-07T11:01:10.631471Z","title":"Conditional generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.631471Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:daf50999abaf354594a3b05a2c2b229ac99a3fdebec9db2e93c4ad50e4fa14f5","observation_id":"7ab24d9c-34db-4c14-a5db-ead6a59cfc6c","resolution":{"observed_at":"2026-08-07T11:01:10.631471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.275826Z","title":"Scene text eraser","venue":null,"work_id":"a28e94a3-4fa7-4f53-9a45-0c0ccaf6db01","year":2017},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.731217Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0aec0fb0cdabec4f33224165db92009605f28d3a12fff613de5f9fa9aab9bc02","observation_id":"fd81f4ef-31af-4555-8b3d-9a6efe447b8f","resolution":{"observed_at":"2026-08-07T11:01:16.280211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.261468Z","title":"Fine-grained visible watermark removal","venue":null,"work_id":"424a3a2a-5769-4a26-976c-71883a9cdb22","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.815303Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:b759ecd47663813e60db6dc417d4c79643c3847c8ac7c83657f551b269ee8668","observation_id":"ff04886a-8bbd-498f-ade0-8d27f59dc56e","resolution":{"observed_at":"2026-08-07T11:01:16.265827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.240354Z","title":null,"venue":null,"work_id":"44d85ab2-0f14-4a35-8f98-5e2937908bf3","year":1975},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.891770Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:9071888a3ac86d0ad8fd7a0338516efe7d4f8f26feb07f318eeeb656e19c84d9","observation_id":"c149eaec-477e-4c87-b999-9b5a6e5b1018","resolution":{"observed_at":"2026-08-07T11:01:16.245895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.225042Z","title":"What in-context learning “learns” in-context: Disentangling task recognition and task learning","venue":null,"work_id":"5184ffea-fdf8-4bb6-8a26-d0f8830032d9","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.975165Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:3f7238a308f9c8809093380fdec1158780238d5aa889f78ce58ea2a07c3af318","observation_id":"decb7db4-470f-420c-97f5-29e108ef6049","resolution":{"observed_at":"2026-08-07T11:01:16.229611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.210383Z","title":"Viteraser: Harnessing the power of vision transformers for scene text removal with segmim pretraining","venue":null,"work_id":"8168f04d-70e1-47be-aaa6-6dabf787f42a","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.054051Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:05d29356089267e052cf6be35b5336f725ec87d54622b7efa1f188787454bb30","observation_id":"9bf0247d-7892-4a4b-91b8-512030d5a3f5","resolution":{"observed_at":"2026-08-07T11:01:16.214609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.195882Z","title":"Upocr: Towards unified pixel-level ocr interface","venue":null,"work_id":"6f1e3071-441a-484a-ac81-65a418b3b7ab","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.151984Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:ff454b3042b337390f13e349e683a5872d22ec2d4921fee5eecd2e84cf660f9c","observation_id":"81457810-b5e9-404d-98a6-9b25fe1a3bff","resolution":{"observed_at":"2026-08-07T11:01:16.200335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.181569Z","title":"Image-to-image translation with conditional adversarial networks","venue":null,"work_id":"1c43c69b-a914-472f-a32c-b0598c8a9f7e","year":2017},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.226058Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:d44b954c88a0652200895922d8ba03526d0f9978c6d4c00d5d6c4261552b8e5b","observation_id":"29276b0a-dbd8-4268-a5fd-36f54e66a673","resolution":{"observed_at":"2026-08-07T11:01:16.186079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.167190Z","title":"Looking from a higher-level perspective: Attention and recognition enhanced multi-scale scene text segmentation","venue":null,"work_id":"f6e74cd7-ec44-4f44-baaf-8c09167a66d1","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.307853Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:c1ba2ed6b37d0bc085c9f29aabfdad2161c7f793ebeaca8baec6c02c9e0465ec","observation_id":"a7c15c8e-209e-4b53-b615-2ddc29203972","resolution":{"observed_at":"2026-08-07T11:01:16.171592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.388857Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.388857Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:4d5e66ddbe39805a397149cf9d0db8faeec8243caf95cdeae5b874232f11a186","observation_id":"ca54d6eb-0efe-4d72-a119-fca34db1f86e","resolution":{"observed_at":"2026-08-07T11:01:11.388857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.08633","last_updated":"2022-05-08T05:17:15Z","snapshot_observed_at":"2026-08-07T07:00:59.716646Z","submitted_at":"2021-12-16T05:17:56Z","title":"Learning To Retrieve Prompts for In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.08633","snapshot_observed_at":"2026-08-07T11:01:11.480737Z","title":"Learning to retrieve prompts for in-context learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.480737Z"},"links":{"cited_paper":"/paper/2112.08633","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:8df5bf6a036e13025cc75613d109b853f2e3b6a4d7fb354129193712fddb3fb5","observation_id":"d76af8e4-aafd-4869-9b31-541310841d09","resolution":{"observed_at":"2026-08-07T11:01:11.480737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.142635Z","title":"and Coustaty, M","venue":null,"work_id":"e5ec34e0-e308-49df-b875-ff6ef7e175e7","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.565647Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6bfa00529e28e3ee67ff83545c04bd585373cce916f92082df6a301c3f0f43af","observation_id":"41f5c624-14e0-4ce8-ab92-14d5503480e4","resolution":{"observed_at":"2026-08-07T11:01:16.146919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06712","last_updated":"2023-08-18T05:49:47Z","snapshot_observed_at":"2026-07-06T15:15:26.125395Z","submitted_at":"2023-04-13T17:58:08Z","title":"What does CLIP know about a red circle? Visual prompt engineering for VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06712","snapshot_observed_at":"2026-08-07T11:01:11.648041Z","title":"What does clip know about a red circle? visual prompt engineering for vlms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.648041Z"},"links":{"cited_paper":"/paper/2304.06712","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:b119af01903c96cf6fc27315819735dd7af62c84233e02334319729cd9affae1","observation_id":"28371d84-9f29-4461-852d-8375f006c0d9","resolution":{"observed_at":"2026-08-07T11:01:11.648041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.10064","last_updated":"2022-06-13T11:22:21Z","snapshot_observed_at":"2026-08-04T14:33:09.162450Z","submitted_at":"2021-07-21T13:18:21Z","title":"Few Shots Are All You Need: A Progressive Few Shot Learning Approach for Low Resource Handwritten Text Recognition","version":3},"cited_work":{"arxiv_id":"2107.10064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2107.10064","snapshot_observed_at":"2026-08-07T11:01:15.543730Z","title":"Few Shots Are All You Need: A Progressive Few Shot Learning Approach for Low Resource Handwritten Text Recognition","venue":"cs.CV","work_id":"90998a51-a1d4-4f83-9e5b-5a41960a0f4e","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.727496Z"},"links":{"cited_paper":"/paper/2107.10064","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0b629088e910acbae859b2c6b61904154859c5759f4f0373c053ef9091230d45","observation_id":"b4f268b6-1591-41d8-b67b-8a6919d4a76f","resolution":{"observed_at":"2026-08-07T11:01:15.548348Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.01975","last_updated":"2022-09-05T14:01:15Z","snapshot_observed_at":"2026-07-06T13:49:00.465047Z","submitted_at":"2022-09-05T14:01:15Z","title":"Selective Annotation Makes Language Models Better Few-Shot Learners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.01975","snapshot_observed_at":"2026-08-07T11:01:11.803292Z","title":"H., Shi, W., Wang, T., Xin, J., Zhang, R., Ostendorf, M., Zettlemoyer, L., Smith, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.803292Z"},"links":{"cited_paper":"/paper/2209.01975","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:c1461f58d51530ca864fafec60a183ec6b37cb80e8bedfa152530de47ad50d59","observation_id":"2c2a308e-755a-48a6-b842-81e0f867e04e","resolution":{"observed_at":"2026-08-07T11:01:11.803292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.880006Z","title":"Exploring effective factors for improving visual in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.880006Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:9511c45ef43d70c5d2b5f5b806a7a5c78ee6288b83083ad14ecd43c43f6dc80b","observation_id":"8c28182a-6523-4648-81d8-81dd1a7ab6c0","resolution":{"observed_at":"2026-08-07T11:01:11.880006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.127237Z","title":"Stroke-based scene text erasing using synthetic data for training","venue":null,"work_id":"6c4b936c-71b7-474c-ae6b-a4f0b40bbda8","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.978013Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:08b1cef69498f2984fd487be1c0c5c22bebfbd4fcf4ff29ab0d08194e222a634","observation_id":"e73ac5fc-b29b-474e-bb8b-76910379fc4d","resolution":{"observed_at":"2026-08-07T11:01:16.132097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T11:01:12.057003Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.057003Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:169d3bcaa9e20e56fc7060dc32e1ba159df6ab2e269bfb9bf3b292d7e90bc211","observation_id":"9e330387-f44d-4a03-8199-8497f1084f88","resolution":{"observed_at":"2026-08-07T11:01:12.057003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.112530Z","title":"Mtrnet++: One-stage mask-based scene text eraser","venue":null,"work_id":"f36e1e9b-9749-4839-905f-10cf46236c3c","year":2020},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.156517Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:88cc1f81b19b586c966f6197ebf1633bf5b805f14d52c8f753d692b65e89ec3d","observation_id":"4b7c4cc1-a110-4736-b776-24b0427403d6","resolution":{"observed_at":"2026-08-07T11:01:16.116920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.098423Z","title":"N., Kim, S","venue":null,"work_id":"ec44127d-e3fb-4dab-868b-56912d78648f","year":2018},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.231422Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:e7c3069220174529a0cc4def29bfcf5222e41b92a71ec9091d78f7a5bda42014","observation_id":"8d29505e-c3b9-4d3b-a09d-f438a7fc3428","resolution":{"observed_at":"2026-08-07T11:01:16.102695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:12.307578Z","title":"Transformers learn in-context by gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.307578Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:c1f252e8a75dad01928786a471321d52e357d643b613e3f870fcbe75f91f8cef","observation_id":"3f36432b-c7b4-4344-ae3a-a3d14784ed45","resolution":{"observed_at":"2026-08-07T11:01:12.307578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.072444Z","title":"Deep high-resolution representation learning for visual recognition","venue":null,"work_id":"6d77a5bf-7ef4-45d4-bcdc-0d1be16eed97","year":2020},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.408624Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:408c90b090feab75cad7d6db9652dd946cffe7efb107e02c5343e722ccd89e0b","observation_id":"3990a1fb-f6fe-4c81-a60f-da53eadcb03f","resolution":{"observed_at":"2026-08-07T11:01:16.077494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14160","last_updated":"2023-12-19T15:13:52Z","snapshot_observed_at":"2026-08-04T17:03:48.643939Z","submitted_at":"2023-05-23T15:26:20Z","title":"Label Words are Anchors: An Information Flow Perspective for Understanding In-Context Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14160","snapshot_observed_at":"2026-08-07T11:01:12.487239Z","title":"Label words are anchors: An information flow perspective for understanding in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.487239Z"},"links":{"cited_paper":"/paper/2305.14160","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:b41cefce8e5181146a42cbdcb57ab82c394a58da464046fd44ca4780097cb718","observation_id":"7c086cfc-74b3-45d2-9d1b-60353a67b8ae","resolution":{"observed_at":"2026-08-07T11:01:12.487239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10200","last_updated":"2024-05-23T20:53:59Z","snapshot_observed_at":"2026-07-06T17:30:47.845775Z","submitted_at":"2024-02-15T18:55:41Z","title":"Chain-of-Thought Reasoning Without Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10200","snapshot_observed_at":"2026-08-07T11:01:12.585825Z","title":"and Zhou, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.585825Z"},"links":{"cited_paper":"/paper/2402.10200","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:43262d51d874d912578002b56d37334b3df9c1a6e54a7f65957e413372e1e394","observation_id":"2364f9f8-3fe6-4956-8ab4-8931e7f692b1","resolution":{"observed_at":"2026-08-07T11:01:12.585825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.057168Z","title":"Images speak in images: A generalist painter for in-context visual learning","venue":null,"work_id":"f8f0aef7-0906-4760-9e2d-c53270bbaf8a","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.693695Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6a1caa1a93bfc31904ca1b6c566351a5182d0b1efbf2dbc12337380bfcb453b8","observation_id":"f7862466-fa67-4f3c-9a34-c4c2afb0ad7e","resolution":{"observed_at":"2026-08-07T11:01:16.061394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.042159Z","title":"Textformer: component-aware text segmentation with transformer","venue":null,"work_id":"05654140-a08f-4e39-ba3a-c393a1d2c9ef","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.770125Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:e4473c057dca13239fa6de9022480584a89f3a63e01933736735c1e06d802832","observation_id":"87e79fcf-7812-4f42-ac2f-69c277c68de9","resolution":{"observed_at":"2026-08-07T11:01:16.046564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03284","last_updated":"2023-04-06T17:59:57Z","snapshot_observed_at":"2026-08-06T11:42:00.456001Z","submitted_at":"2023-04-06T17:59:57Z","title":"SegGPT: Segmenting Everything In Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03284","snapshot_observed_at":"2026-08-07T11:01:12.851868Z","title":"Seggpt: Segmenting everything in context","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.851868Z"},"links":{"cited_paper":"/paper/2304.03284","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:1d79695332281e0f7e6e602c3f44f1b9e1d7cd099e2827bbee5624a4b4a35870","observation_id":"1038fe8b-c7cd-44f3-8436-a5b918634933","resolution":{"observed_at":"2026-08-07T11:01:12.851868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.026723Z","title":"Skeleton-in-context: Unified skeleton sequence modeling with in-context learning","venue":null,"work_id":"c85ba9e4-f253-4eae-b659-7ec7f090a34e","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.949212Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:413a652439e69edeb9d581e1b15547047815901231af5f1d6e53ec957473458c","observation_id":"46d37b7e-2c34-4dfb-96ab-ff29129c7173","resolution":{"observed_at":"2026-08-07T11:01:16.031264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.012164Z","title":"What is the real need for scene text removal? exploring the background integrity and erasure exhaustivity properties","venue":null,"work_id":"538bbbb6-3596-4630-9c27-f39c174d716e","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.036641Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:3e51a353b23f4852a916cfc1e269210764293442d2093545f308209521a82118","observation_id":"04db03b1-f2d5-46aa-a672-37782a66dee2","resolution":{"observed_at":"2026-08-07T11:01:16.016877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.997572Z","title":"In-context learning unlocked for diffusion models","venue":null,"work_id":"38410cba-8728-48dd-b05c-b1bc1552d6ec","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.148545Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:19d66d1d7e089395a5c15c430ba62ab0a47a6afcb65b1ebb63bbf757e7192a15","observation_id":"c30a8386-9b14-40a6-b31f-432896db86a7","resolution":{"observed_at":"2026-08-07T11:01:16.002086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:13.234361Z","title":"V., Zhou, D., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.234361Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:475208cf7d49746e11864e716516ec338998f3949ee8aea729706ceb5e86a8db","observation_id":"c71371b7-5122-4a45-b8ba-4d87b3af7f1c","resolution":{"observed_at":"2026-08-07T11:01:13.234361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:13.300492Z","title":"The learnability of in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.300492Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:ec44088e728cda8b60c73a8ec58bc003522d9bc7d0ae87889761ca30be943dc2","observation_id":"23be2a94-05bc-4577-93a9-c4c09e7b445d","resolution":{"observed_at":"2026-08-07T11:01:13.300492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.963600Z","title":"M., and Luo, P","venue":null,"work_id":"39729660-0fa6-4f76-818b-771f104a26c3","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.343275Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:064570b8a6b90933d06dea4c9871506261ecf37223de567af3ec42d01be8a945","observation_id":"782be91a-a712-444e-962a-a39e46b10467","resolution":{"observed_at":"2026-08-07T11:01:15.967977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02080","last_updated":"2022-07-21T07:44:13Z","snapshot_observed_at":"2026-07-30T03:45:35.558793Z","submitted_at":"2021-11-03T09:12:33Z","title":"An Explanation of In-context Learning as Implicit Bayesian Inference","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02080","snapshot_observed_at":"2026-08-07T11:01:13.408248Z","title":"M., Raghunathan, A., Liang, P., and Ma, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.408248Z"},"links":{"cited_paper":"/paper/2111.02080","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:408eb3423eb820e6bfbd4bdfcd3afee5350cede0127e88d286db73cdb62c8f61","observation_id":"a97127ab-8317-47c4-8eec-ba132b312267","resolution":{"observed_at":"2026-08-07T11:01:13.408248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.949073Z","title":"Rethinking text segmentation: A novel dataset and a text-specific refinement approach","venue":null,"work_id":"552547de-5087-4179-b47a-1cc55d0ac2c0","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.485688Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:7a9a229b1ec7a6faf0bd45b1a1559cfec24d1acc8ce88b9a79553066553e90dd","observation_id":"61b1ea9a-f27a-4742-961a-13d216a17e28","resolution":{"observed_at":"2026-08-07T11:01:15.953919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.935225Z","title":"Bts: a bi-lingual benchmark for text segmentation in the wild","venue":null,"work_id":"cc622319-ca56-4c75-afe2-4a1daa8ec3b9","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.585296Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:3953b0ad9902e34d9f282d32cb5f409c36d5708ce3bfb23507b90796dbb2e3ac","observation_id":"d237d668-76fd-4d6c-ad9b-d7c1f271e80a","resolution":{"observed_at":"2026-08-07T11:01:15.939438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-07T11:01:13.646565Z","title":"Set-of-mark prompting unleashes extraordinary visual grounding in gpt-4v","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.646565Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:d32a0abbc8ccf3974e761a9cd2950543924bb0fa2791db259ca93cc1c68bb4e4","observation_id":"7bdbc804-e51e-4b96-b563-656f0ac3c8b1","resolution":{"observed_at":"2026-08-07T11:01:13.646565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.920451Z","title":"Multi-modal prototypes for open-world semantic segmentation","venue":null,"work_id":"39702433-4882-4af8-8986-374bd1819489","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.757322Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:8dea70471c8022ef5c0021d50db5785f5f6403e1ba47a5f25893deff0adb2e2f","observation_id":"f0a3c0cd-0590-4bf7-8965-4c41978770b8","resolution":{"observed_at":"2026-08-07T11:01:15.925027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17904","last_updated":"2024-11-08T10:45:12Z","snapshot_observed_at":"2026-07-06T17:23:10.017122Z","submitted_at":"2024-01-31T15:10:29Z","title":"Hi-SAM: Marrying Segment Anything Model for Hierarchical Text Segmentation","version":2},"cited_work":{"arxiv_id":"2401.17904","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.17904","snapshot_observed_at":"2026-08-07T11:01:15.324347Z","title":"Hi-SAM: Marrying Segment Anything Model for Hierarchical Text Segmentation","venue":"cs.CV","work_id":"2e9f273a-197f-45c3-bda3-0163c1ab11c5","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.802547Z"},"links":{"cited_paper":"/paper/2401.17904","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:9020b41a29e5ae15f71a4554c231a70ce76ae7eed71d8c60b40583d343bb8ae6","observation_id":"e1ba47f6-40a8-4491-aa84-6737154ac828","resolution":{"observed_at":"2026-08-07T11:01:15.329321Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.905372Z","title":"Scene text segmentation with text-focused transformers","venue":null,"work_id":"3581b485-f84a-4ed4-87ba-311519f914be","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.945254Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:e8334a3c41d08b58b5d0275024271556fc244327befedfba9d11f4d50706fc68","observation_id":"8cb2c129-a8dd-4043-98bc-cb68cb97f5eb","resolution":{"observed_at":"2026-08-07T11:01:15.910258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.890990Z","title":"Scene text segmentation with text-focused transformers","venue":null,"work_id":"933920d3-9864-4fe7-b4a2-cf490474eb32","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.032155Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:717e915affb92ddb710e64fbc1c53e8fe5e6aff9143693eb907060e6cef8b437","observation_id":"bd3baa7c-4b68-407c-b2bc-9145c35fe2ac","resolution":{"observed_at":"2026-08-07T11:01:15.895534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.876535Z","title":"Eaformer: Scene text segmentation with edge-aware transformers","venue":null,"work_id":"32531c2b-3e78-4f07-99b1-d6e05952e510","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.140172Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:460ab08e21c070b4be47adc1637a110cf708dfcd0f6676ddc07a71e35e82733f","observation_id":"9a4f3461-6596-456c-9a4b-06ded375817e","resolution":{"observed_at":"2026-08-07T11:01:15.881014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02872","last_updated":"2024-09-24T20:27:53Z","snapshot_observed_at":"2026-07-06T17:25:22.551344Z","submitted_at":"2024-02-05T10:39:32Z","title":"How do Large Language Models Learn In-Context? Query and Key Matrices of In-Context Heads are Two Towers for Metric Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02872","snapshot_observed_at":"2026-08-07T11:01:14.267944Z","title":"and Ananiadou, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.267944Z"},"links":{"cited_paper":"/paper/2402.02872","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:1bf7356ed1e9949fa17ece4a71e5b043c54dde3d78fa578224549c1a860ccbfe","observation_id":"2c2f1d6f-4611-49f7-8053-f79997112fb2","resolution":{"observed_at":"2026-08-07T11:01:14.267944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.862819Z","title":"and Nakayama, H","venue":null,"work_id":"41b7b6f1-a3df-4fc1-b38e-c91f5545e003","year":2020},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.394659Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:726eb50776262ba0d61a5ee3260b27c9156a1e623a79ac4a9e3153b974ade80e","observation_id":"09ccf479-cb01-4785-a599-4603fccf417c","resolution":{"observed_at":"2026-08-07T11:01:15.866863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.847407Z","title":"Choose what you need: Disentangled representation learning for scene text recognition removal and editing","venue":null,"work_id":"f0aa4cf3-6742-4f79-81a7-2baa1f9425ce","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.490424Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:ad9a170861b850a7e7b7b4482c25daa50cd943fa34a897dff7e4cbb70aaac8f7","observation_id":"953148b6-e5ca-455c-9fc0-e1f2e4b02b76","resolution":{"observed_at":"2026-08-07T11:01:15.852329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.832438Z","title":"Complementary patch for weakly supervised semantic segmentation","venue":null,"work_id":"22ea1add-0eb3-4640-8682-b028ec2abd4e","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.578427Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:488d7268aa605ecfd17574d9f45f45e1c0ca0e64e94bb0b0990a8a7a6046a43a","observation_id":"b86683cd-20cd-47e2-bdcc-367acf1601a4","resolution":{"observed_at":"2026-08-07T11:01:15.836737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.818067Z","title":"Uncovering prototypical knowledge for weakly open-vocabulary semantic segmentation","venue":null,"work_id":"b8ed4c89-4a92-41c7-8e1b-02a9e56ef187","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.735536Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:05e5385cf3c7d05c72ae4fa0d6a750ab644852672b2e659279edcea85c660235","observation_id":"d19b2e62-f8d9-44ed-b851-c9d34bd69755","resolution":{"observed_at":"2026-08-07T11:01:15.822487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.803349Z","title":"Instruct me more! random prompting for visual in-context learning","venue":null,"work_id":"3dd8884d-e6cc-4702-a9cc-7ca519656647","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.805412Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:821320d648590f0ac5c4981f7da1ecd6d5b283b77a5eb567a764c6a85d4735a7","observation_id":"9521e2e5-3ca9-4a17-a126-fd798aa376f8","resolution":{"observed_at":"2026-08-07T11:01:15.808030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.787881Z","title":"Ensnet: Ensconce text in the wild","venue":null,"work_id":"40c0555b-997e-4126-bc7d-b4e9570b36f2","year":2019},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.924630Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:90db066ef0f19548b24775912ad7aeca5a009c153d6844cb6773b31f783e4651","observation_id":"e7999922-d830-4833-bb74-c1a9c96c0794","resolution":{"observed_at":"2026-08-07T11:01:15.792756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01539","last_updated":"2025-06-02T11:05:28Z","snapshot_observed_at":"2026-08-07T11:36:38.810470Z","submitted_at":"2025-06-02T11:05:28Z","title":"G4Seg: Generation for Inexact Segmentation Refinement with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01539","snapshot_observed_at":"2026-08-07T11:01:15.034294Z","title":"G4seg: Generation for inexact segmentation refinement with diffusion models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.034294Z"},"links":{"cited_paper":"/paper/2506.01539","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:f0b25acaf03e7527281c28112f888e35c589fa2987c93528a1522720563f62b6","observation_id":"4a1323c7-e37a-4752-986f-cc94580c628e","resolution":{"observed_at":"2026-08-07T11:01:15.034294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.773328Z","title":"What makes good examples for visual in-context learning? Advances in Neural Information Processing Systems, 36: 0 17773--17794, 2023 b","venue":null,"work_id":"677d1793-0de2-4123-ac56-296d72e07505","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.163038Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:9be88b3a3f6b26becb4cc367a02c39ffdb7395390b74e875f37703be586b9e0a","observation_id":"1ade145f-f96b-414a-bcac-94e3b24066f8","resolution":{"observed_at":"2026-08-07T11:01:15.777844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12957","last_updated":"2024-11-27T09:54:05Z","snapshot_observed_at":"2026-08-05T03:56:09.380039Z","submitted_at":"2024-08-23T10:07:59Z","title":"Image Segmentation in Foundation Model Era: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12957","snapshot_observed_at":"2026-08-07T11:01:15.203110Z","title":"Image segmentation in foundation model era: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.203110Z"},"links":{"cited_paper":"/paper/2408.12957","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6e0f523c09136aa437a59f28dce28e430c78d962078f5fcd1977e8bf4802f684","observation_id":"08daf8ea-02e6-4406-bd0b-ec8d4f7b4ba3","resolution":{"observed_at":"2026-08-07T11:01:15.203110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14138","last_updated":"2024-11-03T08:12:57Z","snapshot_observed_at":"2026-07-06T18:48:53.833921Z","submitted_at":"2024-07-19T09:08:20Z","title":"Visual Text Generation in the Wild","version":2},"cited_work":{"arxiv_id":"2407.14138","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14138","snapshot_observed_at":"2026-08-07T11:01:15.254060Z","title":"Visual Text Generation in the Wild","venue":"cs.CV","work_id":"295b430a-b6e3-4078-a2be-69741bccd023","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.207893Z"},"links":{"cited_paper":"/paper/2407.14138","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:1c48444d7192e9db4a26ac36d0307ab6ac0c4603e66c327f441a8c5de83285e6","observation_id":"4c31ef1c-ef25-419a-a80d-509da9640fd0","resolution":{"observed_at":"2026-08-07T11:01:15.260251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.212230Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.212230Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:021964adfc0416824fa2dcc14a9e52cdec97c75753f8db3068d8ec32b3101c4c","observation_id":"a3c5911a-dcd5-4d27-8396-390902c27cde","resolution":{"observed_at":"2026-08-07T11:01:15.212230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:52:49.668352Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":50,"verified_exact":2,"verified_fuzzy":44},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 1 inbound Pith citation observation for arXiv:2506.03799."}