{"as_of":"2026-08-19T15:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39f6cb7d41842a2fc3822b279d83d2439d82fc3950ea32716f5ab68c32106e6a","coverage":[{"denominator":85,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":85,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:17:54.062818Z","state":"measured"},{"denominator":85,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":85,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.22032/citation-record","integrity":"/paper/2506.22032/integrity","json":"/paper/2506.22032/citation-record.json","paper":"/paper/2506.22032"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.231907Z","title":"Fully convolu- tional networks for semantic segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.231907Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:959206baca3a861d4d329473b0598d1e0e7b9e0071ddb33dfc874e655d385133","observation_id":"00d54f01-a89a-4299-9870-930f2858c8fe","resolution":{"observed_at":"2026-08-06T22:17:53.231907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.294122Z","title":"Cpal: Cross- prompting adapter with loras for rgb+ x semantic seg- mentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.294122Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:04bcc939609fb455fd2f745b5920bbaa18f1127a635f1b466307cd9106fad7d6","observation_id":"961dedd0-0839-4c5e-a523-da7b54497b97","resolution":{"observed_at":"2026-08-06T22:17:53.294122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.481326Z","title":"Frozen is better than learning: A new design of prototype- based classifier for semantic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.481326Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:bf99eb25f2e457ba5d6e22f0ea4961caa0ce03a5e42e03225aa532d21080d504","observation_id":"89d74679-d60b-4598-9872-923cc3a31c11","resolution":{"observed_at":"2026-08-06T22:17:53.481326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.535044Z","title":"Both style and distortion matter: Dual-path unsupervised domain adaptation for panoramic semantic segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.535044Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:4ae5f36bc328bfb079c297267ad29d4c6bebf94b0b5abb0c33464ac28c9ab02f","observation_id":"b5f7e53f-996b-4234-8a3c-be9f6eec5ad6","resolution":{"observed_at":"2026-08-06T22:17:53.535044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17141","last_updated":"2025-05-15T18:54:21Z","snapshot_observed_at":"2026-08-12T12:25:58.124112Z","submitted_at":"2024-11-26T06:15:27Z","title":"Learning Robust Anymodal Segmentor with Unimodal and Cross-modal Distillation","version":2},"cited_work":{"arxiv_id":"2411.17141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.17141","snapshot_observed_at":"2026-08-06T22:17:54.890616Z","title":"Learning Robust Anymodal Segmentor with Unimodal and Cross-modal Distillation","venue":"cs.CV","work_id":"bc9aa170-af74-476b-94d5-c41a28b1d6c6","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.586414Z"},"links":{"cited_paper":"/paper/2411.17141","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:3fdb058020f231446b03ac5766c74e9da8c038eb7cbc5cbf722522f3054133c9","observation_id":"de2a37fa-ebb5-4d43-97be-c10566395a0a","resolution":{"observed_at":"2026-08-06T22:17:54.928596Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.616998Z","title":"Distilling efficient vision transformers from cnns for semantic segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.616998Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:a4b1077c4424c55d05be44aa11a209dfab098eb5f68eb98507306534b40b50d7","observation_id":"77f8b6da-ac1a-4758-99f9-ec2215b9726f","resolution":{"observed_at":"2026-08-06T22:17:53.616998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:03.991866Z","title":"Deep residual learn- ing for image recognition,","venue":null,"work_id":"f296b9a5-f9aa-48db-a9b9-49ad3693022c","year":2016},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.623643Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:86db4d9af935ca8bdc8153d2a73bfbe3e40b31e2a1f28e8b83b46b783d8f7b03","observation_id":"8af2e439-8e9e-49c4-9667-56df0a6dfc9a","resolution":{"observed_at":"2026-08-06T22:18:04.051119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.632280Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.632280Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:efc3f2a703cc5a80a8ff1279e7f31d3af2c5e96d10ef54a276c7b3f96dd4ddf4","observation_id":"a4341ad9-4d86-4ea2-bd4b-b712b0a5d976","resolution":{"observed_at":"2026-08-06T22:17:53.632280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:03.792538Z","title":"Sign: Spatial-information incorporated generative network for generalized zero-shot semantic segmentation,","venue":null,"work_id":"d74fbc6b-5e13-4a5e-8988-3a850c76c04e","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.637822Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:d8dd545b6029c74b1e2a0fb07651ece4601289830acbfdef5526b62b9d8a09f7","observation_id":"9b150596-a29b-4cd3-8e2e-b9ab181facb4","resolution":{"observed_at":"2026-08-06T22:18:03.901561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:03.667810Z","title":"Zero-shot semantic segmentation,","venue":null,"work_id":"4f7b40b9-1933-4665-859d-4fbb55f5b4ef","year":2019},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.643573Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:aa5c3bd8e47c2daac819fd7f007dfc3b5208244b8bd62731da18e4434704e911","observation_id":"956fbbf4-33b9-44c3-ae56-1963cac9f7c9","resolution":{"observed_at":"2026-08-06T22:18:03.727601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:03.493118Z","title":"Context- aware feature generation for zero-shot semantic segmen- tation,","venue":null,"work_id":"030a0078-f509-42c6-a581-16896ad09b90","year":2020},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.648322Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:b4e583e1cad3f93e6065554ede309300009f5ad43dd60eb9aeafdd8e6a722939","observation_id":"32d42c23-2a55-40a1-99af-0b4264627ab4","resolution":{"observed_at":"2026-08-06T22:18:03.570250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:03.332376Z","title":"Semantic projection network for zero-and few-label semantic segmentation,","venue":null,"work_id":"58625a28-6199-4865-9928-a353a01e25fb","year":2019},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.653594Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:fa06d29435a72a84f542271a48c9fc4a5b20da586a13d8efcf7dc234c935d625","observation_id":"d730324e-dd53-45ba-89f9-e9af4360fe88","resolution":{"observed_at":"2026-08-06T22:18:03.414502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:03.194945Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"b50a8da6-ac2d-4aa1-a30d-77fba07b17af","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.658133Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:cc058e5cb705276b322008f5468933626af3a09e259fbc3b173ac5b358022fa7","observation_id":"7775a045-782e-46ec-ab36-22ebb42f7fae","resolution":{"observed_at":"2026-08-06T22:18:03.259091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:03.039979Z","title":"Segment anything,","venue":null,"work_id":"be66b09a-d395-4597-8f36-8cdcb9c85a68","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.663334Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:0e6ae42315319777c565df3d3ad2983b14fa34ba00d4448f05014b478f7ba9fe","observation_id":"1aeca0f8-6a16-4169-82b5-3257e73ee3c4","resolution":{"observed_at":"2026-08-06T22:18:03.123993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:02.880857Z","title":"Language-driven semantic segmentation,","venue":null,"work_id":"9b2eeeac-e6ed-4b2c-b7c5-980c27c361f3","year":2022},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.673642Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:49308bdeca9745e2da243180800756208d09ab538b30213e03ff7241435f9582","observation_id":"eb37aca6-1bbb-41b4-800b-550149e2de59","resolution":{"observed_at":"2026-08-06T22:18:02.949025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:02.751406Z","title":"Scaling open- vocabulary image segmentation with image-level labels,","venue":null,"work_id":"b1f04cb1-fe29-4c9f-a7f7-a34aedb71951","year":2022},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.679054Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:593800fdf2f44d924ab3a67e9194000111120480acc987647cba142f22b2b1c3","observation_id":"bb0592bc-a8a3-4c15-b326-d9daf3a30a56","resolution":{"observed_at":"2026-08-06T22:18:02.809826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:02.613910Z","title":"Zegclip: Towards adapting clip for zero-shot semantic segmen- tation,","venue":null,"work_id":"629c420e-300f-4e01-b100-fb7fc6423aea","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.684167Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:0c32bf36129a67ee215773058b3597f944affc0cd513be6387737e257374797a","observation_id":"3366cb06-d663-44a6-b62f-a5121e6cb74b","resolution":{"observed_at":"2026-08-06T22:18:02.675875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:02.453278Z","title":"Convolutions die hard: Open-vocabulary segmentation with single frozen convolutional clip,","venue":null,"work_id":"57d6b622-89a5-4dd7-9253-fad537decf70","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.690305Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:ffd69b920bfba45133bbd3594c38a206827e5451c8c1c2591bdfe045606f9bc3","observation_id":"aaaefa3a-2f47-4b3d-8420-298ec6f0472c","resolution":{"observed_at":"2026-08-06T22:18:02.542189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:02.309943Z","title":"Global knowl- edge calibration for fast open-vocabulary segmentation,","venue":null,"work_id":"6261aa05-d4c7-4da7-8738-74c63c78e826","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.696181Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:a742b3caf172d94d5d09b8879c1ded8570c4c15b4a4eac4b1df2e2cc380f404a","observation_id":"e859b7fa-0759-4b11-beef-fe35dda0875f","resolution":{"observed_at":"2026-08-06T22:18:02.364099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:02.137207Z","title":"Open-vocabulary panoptic segmentation with text-to-image diffusion models,","venue":null,"work_id":"5e68ccf7-145c-4e2d-8221-c2880d28e79f","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.703738Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:1ddeb500f9f2c0e94dfb0c2392280313071f567ac115dc5691718779ce59384b","observation_id":"7f2f0399-f6a6-4bac-9fc1-7ec4b8363b48","resolution":{"observed_at":"2026-08-06T22:18:02.227430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11797","last_updated":"2024-03-31T11:53:55Z","snapshot_observed_at":"2026-08-18T03:21:27.251226Z","submitted_at":"2023-03-21T12:28:21Z","title":"CAT-Seg: Cost Aggregation for Open-Vocabulary Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11797","snapshot_observed_at":"2026-08-06T22:17:53.709550Z","title":"Cat-seg: Cost aggregation for open-vocabulary semantic segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.709550Z"},"links":{"cited_paper":"/paper/2303.11797","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:1eb76f0ecd95e801149df558bab0ee22a853283f8f4e62ca202dc5cb75743856","observation_id":"557f49bd-7402-4ca3-a8a2-3c03a9b7d31a","resolution":{"observed_at":"2026-08-06T22:17:53.709550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:01.943772Z","title":"Extract free dense labels from clip,","venue":null,"work_id":"5ee1bd71-4db0-4228-b91c-44ad4c067c81","year":2022},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.715215Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:3631f7f6a0cc53748468d92fff6755b9670570a2de22b56189ad8229330a32de","observation_id":"1640e186-f6a8-43df-8bd2-1406814eba3c","resolution":{"observed_at":"2026-08-06T22:18:02.042827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:01.802396Z","title":"Sclip: Rethinking self- attention for dense vision-language inference,","venue":null,"work_id":"35c0b91e-8a00-4213-a66a-9bd49ec47ca6","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.721332Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:ea99c84a96c05052c08ae47bb82143021cd7919c276fe1321b22874b81262131","observation_id":"3cc6b57e-4926-4b35-a24d-af1ddf47d151","resolution":{"observed_at":"2026-08-06T22:18:01.862484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:01.649551Z","title":"Open- vocabulary semantic segmentation with decoupled one- pass network,","venue":null,"work_id":"11e92d81-5818-4f83-a55d-75d04a2a56dd","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.726292Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:47bb5fc14df9a8deda558e8ab0129ce583bab376d45dafcc1fdc74891054e841","observation_id":"686ba4bc-039a-4dfc-b692-9ec19c6bda68","resolution":{"observed_at":"2026-08-06T22:18:01.732698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00240","last_updated":"2023-09-30T03:27:31Z","snapshot_observed_at":"2026-08-19T05:18:28.729560Z","submitted_at":"2023-09-30T03:27:31Z","title":"Learning Mask-aware CLIP Representations for Zero-Shot Segmentation","version":1},"cited_work":{"arxiv_id":"2310.00240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.00240","snapshot_observed_at":"2026-08-06T22:17:54.722822Z","title":"Learning Mask-aware CLIP Representations for Zero-Shot Segmentation","venue":"cs.CV","work_id":"7b6e99bc-c621-4112-87b5-404c8532bbaa","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.731152Z"},"links":{"cited_paper":"/paper/2310.00240","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:1091ec81597d6963a983302ee4dfcfab9ce151e09f95611a0fd7e3bc2fe760f1","observation_id":"303bffe8-50fe-49d8-9086-aa38a639c99c","resolution":{"observed_at":"2026-08-06T22:17:54.765023Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:01.436993Z","title":"A simple baseline for open-vocabulary semantic segmentation with pre-trained vision-language model,","venue":null,"work_id":"aaccbdf8-43a9-40f7-b6a2-0ccad497ac6a","year":2022},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.737630Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:ed506f2cfc4291fd83c9a88608f6a0cb09258316f4010a4c72161f358a672864","observation_id":"6aecd422-fc1e-43b6-8844-fc4ee91feedf","resolution":{"observed_at":"2026-08-06T22:18:01.539593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.742155Z","title":"Masked-attention mask transformer for universal image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.742155Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:4e766ffc70a033a69da149aee0dd1aa0c9c387579245d8a963a008021070172d","observation_id":"7754982f-6748-4600-85ae-375026fbfe93","resolution":{"observed_at":"2026-08-06T22:17:53.742155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:01.205896Z","title":"Per-pixel classi- fication is not all you need for semantic segmentation,","venue":null,"work_id":"9654109d-9119-4d41-b527-ad9bf8493a75","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.746936Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:2187280431225cafe4eafa6e8e9aa97854c440afc2b57428cccf4eea6848413c","observation_id":"79adfb4f-d1c2-40a5-b273-fe012651ed8a","resolution":{"observed_at":"2026-08-06T22:18:01.302220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:01.032962Z","title":"CLIP-to-seg distillation for inductive zero- shot semantic segmentation,","venue":null,"work_id":"c24c7f9d-35cf-497f-85be-e0a14daeb103","year":2025},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.752093Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:92f8c59d457f92a5af1a512a4a9fb8b6570556c537b79583864f5f0eb84d2c55","observation_id":"242f59d3-3e99-453e-a17b-c9b33bf80062","resolution":{"observed_at":"2026-08-06T22:18:01.121312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13697","last_updated":"2024-02-21T10:57:21Z","snapshot_observed_at":"2026-08-18T10:56:05.262098Z","submitted_at":"2024-02-21T10:57:21Z","title":"Generalizable Semantic Vision Query Generation for Zero-shot Panoptic and Semantic Segmentation","version":1},"cited_work":{"arxiv_id":"2402.13697","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.13697","snapshot_observed_at":"2026-08-06T22:17:54.613971Z","title":"Generalizable Semantic Vision Query Generation for Zero-shot Panoptic and Semantic Segmentation","venue":"cs.CV","work_id":"ac23c2fd-e43a-4517-baa1-755712ccede2","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.757324Z"},"links":{"cited_paper":"/paper/2402.13697","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:50f75270b775875649ab968175ea5317ef6202fabf2101dcbb679c29f7ff10ff","observation_id":"86923bbf-ccf5-4c5b-a9e5-e96c9124305b","resolution":{"observed_at":"2026-08-06T22:17:54.650153Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.05023","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:54.523422Z","title":"Split matching for inductive zero-shot semantic segmentation,","venue":null,"work_id":"0ae3cf0b-7dce-41c1-8854-f67a20152b91","year":2025},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.762345Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:061b054b53046e4e44c2c7e9722b4396ad8a0f3b491341ae57d2f00ab51b4ecf","observation_id":"c701391f-9fbd-45c0-a3dd-6e9987843ad0","resolution":{"observed_at":"2026-08-06T22:17:54.577479Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06635","last_updated":"2025-05-10T12:58:15Z","snapshot_observed_at":"2026-08-18T18:24:21.117910Z","submitted_at":"2025-05-10T12:58:15Z","title":"Reducing Unimodal Bias in Multi-Modal Semantic Segmentation with Multi-Scale Functional Entropy Regularization","version":1},"cited_work":{"arxiv_id":"2505.06635","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.06635","snapshot_observed_at":"2026-08-06T22:17:54.418808Z","title":"Reducing Unimodal Bias in Multi-Modal Semantic Segmentation with Multi-Scale Functional Entropy Regularization","venue":"cs.CV","work_id":"6abcd058-a006-4c14-a089-f3ae8a201718","year":2025},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.768146Z"},"links":{"cited_paper":"/paper/2505.06635","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:a7b4081a32dcb271d6eda6be08fcb563466c2b23957f300e958569e965727dd2","observation_id":"8e1c273b-7338-45da-88d4-416ccc4dbf91","resolution":{"observed_at":"2026-08-06T22:17:54.427094Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:00.846172Z","title":"360sfuda++: Towards source-free uda for panoramic segmentation by learning reliable category prototypes,","venue":null,"work_id":"adc3839f-8ce6-48d0-918f-45a576f19fe5","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.773383Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:f447e2a60a17d8f688ad7b84d369bc022a7716bbfd33b3d4a31c776126718301","observation_id":"e85a14e3-892f-46ec-826b-2a52df9c91ee","resolution":{"observed_at":"2026-08-06T22:18:00.935245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:00.669546Z","title":"Adversarial co-training for semantic segmen- tation over medical images,","venue":null,"work_id":"d9d0b9cc-f7b2-477f-b02e-5219285ea0f5","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.778013Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:564e203bf4db3d69e035afaf2e9f1bbd71732a2c7bb2e3c206de326f6d9a28b9","observation_id":"415ab412-d058-461a-bf9d-3055f6c29e3b","resolution":{"observed_at":"2026-08-06T22:18:00.751310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:00.508417Z","title":"Look at the neighbor: Distortion-aware unsupervised domain adaptation for panoramic semantic segmentation,","venue":null,"work_id":"5cfb558a-0feb-4ebe-b09e-52c4fcbcd14f","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.784099Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:d2df7bd41c323876fc486fa85e342531dd40f052bb204f7eb2eed37f1dfd53ef","observation_id":"6f6695e2-a76d-4efc-a73a-7046fd90f7e5","resolution":{"observed_at":"2026-08-06T22:18:00.571934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:00.362756Z","title":"Encoder-decoder with atrous separable convo- lution for semantic image segmentation,","venue":null,"work_id":"acb5d6c2-d50b-4ce7-a673-792aea467585","year":2018},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.789218Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:36d819304c3a2c37f71ce0e5547905705eb06544d98bf1a606191e9a8611209a","observation_id":"ff455d1c-bf64-4572-be01-6faf5495432c","resolution":{"observed_at":"2026-08-06T22:18:00.444048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:00.221549Z","title":"Semantic matters: A constrained approach for zero-shot video action recognition,","venue":null,"work_id":"a7715a17-2846-4843-9f3c-beef22487585","year":2025},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.794076Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:a47873bce0863989637f04dc6badd0eb596ef7e84e26be9f6a87c06d08ad7d1c","observation_id":"93c33dd1-5d6b-4b59-994f-809ae4ed2cff","resolution":{"observed_at":"2026-08-06T22:18:00.316962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:18:00.053050Z","title":"Segformer: Simple and efficient design for semantic segmentation with transformers,","venue":null,"work_id":"46ffb794-298b-4426-b38c-57650351508d","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.798751Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:f920d812a7bf3de03e3c741cc0c7d10e0b100c61c9b17a7f895db86ae17a1b53","observation_id":"8381aa8d-f5c9-4ac9-b872-06633abc560e","resolution":{"observed_at":"2026-08-06T22:18:00.136005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:59.777420Z","title":"Rethinking semantic segmentation from a sequence-to-sequence perspective with transformers,","venue":null,"work_id":"43849418-42e9-4e8b-b2df-18ff9157a4d7","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.803118Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:97b17ca644eda340151034afe4737676641240d07bfa89dd85c6a381c2d6ebb8","observation_id":"cb78cee3-1aa4-4750-8b8a-681246f9bc37","resolution":{"observed_at":"2026-08-06T22:17:59.907802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:59.613086Z","title":"Unified perceptual parsing for scene understanding,","venue":null,"work_id":"662272e2-d543-470d-9e70-0fb2baafc440","year":2018},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.809500Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:4d627ef9f3ead4bff1b58c78ea7e6867b159150284f45fd6b7aa5fac109af8b4","observation_id":"6ec91391-e855-46b1-98c6-ee382036decd","resolution":{"observed_at":"2026-08-06T22:17:59.692806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:59.459990Z","title":"Uncertainty teacher with dense focal loss for semi- supervised medical image segmentation,","venue":null,"work_id":"0b6f7eba-7654-4b41-bb44-00a575bb2fe5","year":2022},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.814318Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:16653b39da0d5d7fb508c2f8e389bcda4e2676671b7bcee6375ea4e9eaa79125","observation_id":"2ba8f280-0d1a-4dbb-ba56-d30f218d391b","resolution":{"observed_at":"2026-08-06T22:17:59.532301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:59.261461Z","title":"A good student is cooperative and reliable: Cnn-transformer collaborative learning for semantic segmentation,","venue":null,"work_id":"7d2bcee2-886d-4a20-b40b-296f687d93cd","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.820381Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:6f52d63fd85fe1c5dec2d444fbe6d3948d9224895984e42067f7e2d61b167a72","observation_id":"d54dbfce-6363-4401-9ba9-bb641a10bb20","resolution":{"observed_at":"2026-08-06T22:17:59.354123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:59.075633Z","title":"Semantics distortion and style matter: Towards source- free uda for panoramic segmentation,","venue":null,"work_id":"1cd7b4c6-d613-4703-8c03-069213d447d0","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.825863Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:4784fc843fac8cce72f3fb660cb52f831704021ca808f5ff7ea6e7537e88ec4c","observation_id":"34d46e9a-aebe-4f2e-8b12-ebfd923f0a5f","resolution":{"observed_at":"2026-08-06T22:17:59.175122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:58.925638Z","title":"Transformer-cnn cohort: Semi-supervised semantic seg- mentation by the best of both students,","venue":null,"work_id":"acc46baf-db30-42bb-b908-8bdcc69202db","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.831644Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:20b73c180737de6a78ab5026473bc0079c808464abbe860920eacc765571f5f0","observation_id":"553203b0-aa43-46ea-bc7a-e430fc23c5d1","resolution":{"observed_at":"2026-08-06T22:17:59.010928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:58.799965Z","title":"Centering the value of every modality: Towards efficient and resilient modality-agnostic semantic segmentation,","venue":null,"work_id":"467d7359-39ab-4eb2-951a-ad452bdb89d4","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.838575Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:bc1e38dc975fb873c3436943c6ba3fdcf39989592e6f09c916bab871da2eb282","observation_id":"9fbcb22c-a268-44e2-9192-ab65d2e6b950","resolution":{"observed_at":"2026-08-06T22:17:58.866201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16370","last_updated":"2024-03-25T02:30:32Z","snapshot_observed_at":"2026-08-19T09:13:52.742478Z","submitted_at":"2024-03-25T02:30:32Z","title":"GoodSAM: Bridging Domain and Capacity Gaps via Segment Anything Model for Distortion-aware Panoramic Semantic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16370","snapshot_observed_at":"2026-08-06T22:17:53.844634Z","title":"Goodsam: Bridging domain and capacity gaps via segment anything model for distortion-aware panoramic semantic segmen- tation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.844634Z"},"links":{"cited_paper":"/paper/2403.16370","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:095c31c5f770e525c3ce1a611cae5e51b13b5d436525e0ca3552131dedc7a943","observation_id":"985dcbcf-4171-43ef-ab43-8c19d9be16cf","resolution":{"observed_at":"2026-08-06T22:17:53.844634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04220","last_updated":"2024-12-05T14:54:31Z","snapshot_observed_at":"2026-08-17T23:29:24.004954Z","submitted_at":"2024-12-05T14:54:31Z","title":"Customize Segment Anything Model for Multi-Modal Semantic Segmentation with Mixture of LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04220","snapshot_observed_at":"2026-08-06T22:17:53.851392Z","title":"Cus- tomize segment anything model for multi-modal semantic segmentation with mixture of lora experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.851392Z"},"links":{"cited_paper":"/paper/2412.04220","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:881befc833f3dd785fa3133ac065aa34ad689dc9a83f02ff1ddfaa470fac49fe","observation_id":"161b15ad-a21e-4522-b611-8a90091cb26e","resolution":{"observed_at":"2026-08-06T22:17:53.851392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.856546Z","title":"Omnisam: Omnidirectional seg- ment anything model for uda in panoramic semantic segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.856546Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:39ed1c68a0a13a2fde3f21d543ca70f84cb0ae888cd6572239cf693fd13601b3","observation_id":"0da8220a-4036-45b8-a42a-2760bd49ef5b","resolution":{"observed_at":"2026-08-06T22:17:53.856546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16876","last_updated":"2024-12-22T06:12:03Z","snapshot_observed_at":"2026-08-15T05:47:29.055177Z","submitted_at":"2024-12-22T06:12:03Z","title":"MAGIC++: Efficient and Resilient Modality-Agnostic Semantic Segmentation via Hierarchical Modality Selection","version":1},"cited_work":{"arxiv_id":"2412.16876","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.16876","snapshot_observed_at":"2026-08-06T22:17:54.221571Z","title":"MAGIC++: Efficient and Resilient Modality-Agnostic Semantic Segmentation via Hierarchical Modality Selection","venue":"cs.CV","work_id":"aa9893ac-667d-4511-aa56-2641a874e137","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.861543Z"},"links":{"cited_paper":"/paper/2412.16876","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:e29d1c9d4be2ee4addfdbfca4de778fd3e6103586124de21a97219c713bef64d","observation_id":"17a961f8-717d-4a6a-b18e-501c475a9528","resolution":{"observed_at":"2026-08-06T22:17:54.229252Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18445","last_updated":"2025-04-10T08:56:52Z","snapshot_observed_at":"2026-08-19T11:03:12.175578Z","submitted_at":"2025-03-24T08:46:52Z","title":"Benchmarking Multi-modal Semantic Segmentation under Sensor Failures: Missing and Noisy Modality Robustness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18445","snapshot_observed_at":"2026-08-06T22:17:53.866959Z","title":"Benchmarking multi-modal semantic segmentation under sensor failures: Missing and noisy modality robustness,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.866959Z"},"links":{"cited_paper":"/paper/2503.18445","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:4a3941b6e3dd7c51bc8687c37c1d18293701c12a91f463af39ef5dc603267441","observation_id":"caa46ea0-98c8-4465-bb53-e0b51437e06c","resolution":{"observed_at":"2026-08-06T22:17:53.866959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02581","last_updated":"2025-07-22T13:20:58Z","snapshot_observed_at":"2026-08-18T08:58:31.049671Z","submitted_at":"2025-03-04T13:04:46Z","title":"Unveiling the Potential of Segment Anything Model 2 for RGB-Thermal Semantic Segmentation with Language Guidance","version":2},"cited_work":{"arxiv_id":"2503.02581","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.02581","snapshot_observed_at":"2026-08-06T22:17:54.162887Z","title":"Unveiling the Potential of Segment Anything Model 2 for RGB-Thermal Semantic Segmentation with Language Guidance","venue":"cs.CV","work_id":"9b458075-c18d-4667-86b1-00251f8d1699","year":2025},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.873542Z"},"links":{"cited_paper":"/paper/2503.02581","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:203d4438c82877a08718bd596ede072e1bad0c3a96cf232cc518a02306c34c67","observation_id":"0523980e-47e1-4ab9-847e-56598d3eed4c","resolution":{"observed_at":"2026-08-06T22:17:54.171444Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:58.602263Z","title":"Non-local neural networks,","venue":null,"work_id":"e0820492-d61e-4070-811d-991fdfa44f43","year":2018},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.880607Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:581145747bd6fea3f7fdd1cd01e6e9bcf1d663cab41ad4c67aa0433258643eb4","observation_id":"b7366fbf-1f2c-4990-802e-5f6e0796ad7f","resolution":{"observed_at":"2026-08-06T22:17:58.723246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T22:17:53.887876Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.887876Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:1842111b5fdbab9ec4203e27c38b063c6161249d0441fa9c85cc62cbe844eb5e","observation_id":"87d42d82-5f6a-46e5-8560-55c6c7d39617","resolution":{"observed_at":"2026-08-06T22:17:53.887876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:58.416308Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":"fa079df9-0b1c-458e-b907-aa6894f34927","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.893214Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:5d5f69aa5e358e9f2a7fec2f9733e75b47ae898680d0fb775c246eab34e4568f","observation_id":"25c80cad-d9a7-4fea-9149-df2aa4c4794b","resolution":{"observed_at":"2026-08-06T22:17:58.533682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:58.227745Z","title":"A good student is cooperative and reliable: Cnn-transformer JOURNAL OF LATEX CLASS FILES, VOL. 18, NO. 9, SEPTEMBER 2020 13 collaborative learning for semantic segmentation,","venue":null,"work_id":"9d7eff41-e5be-4fe8-8b4c-5df11363d275","year":2020},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.898010Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:25d695532b0346a2aaa14abd24644c4bbcde80bf9dc161fe56f43ee15d663c93","observation_id":"1a8ca1de-e5d1-4b5f-9b45-fe1ef648d6a3","resolution":{"observed_at":"2026-08-06T22:17:58.355430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.903092Z","title":"Language-driven visual consensus for zero-shot semantic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.903092Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:21f58c264003323b85cff990a478aaa023bb7137646bc2c15f29eaa95c04abef","observation_id":"5ce1be30-8175-4d69-8c3f-bb7b692075aa","resolution":{"observed_at":"2026-08-06T22:17:53.903092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:58.052790Z","title":"Zero-shot learning with semantic output codes,","venue":null,"work_id":"3268d5b3-1947-42e5-bbf7-440bd585e14e","year":2009},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.908050Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:83dd8ea1319ddc5e30e94f47651a87e6f5aca8a26ac3f8e3b29407d2434493a9","observation_id":"2ae4fef4-e8c3-4902-b837-645c105d896a","resolution":{"observed_at":"2026-08-06T22:17:58.151041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:53.912789Z","title":"Decoupling zero-shot semantic segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.912789Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:82a6da9bae999b3afe7ed99dc268840fc08f8f68ed0ca8313e2b48139be2bb36","observation_id":"82a177f0-1c2f-49df-86ee-15306df34a49","resolution":{"observed_at":"2026-08-06T22:17:53.912789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:57.840949Z","title":"A closer look at self-training for zero- label semantic segmentation,","venue":null,"work_id":"f5b394eb-f2e6-4f5e-ade9-66686f03e507","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.918379Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:c5f5ebfecaf082b9ce2b73e13f81d125b1535a9cace9775e96a985d77df0269e","observation_id":"b0bbd6b2-9eec-4d19-b71a-a36868fa589a","resolution":{"observed_at":"2026-08-06T22:17:57.951972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:57.696128Z","title":"Towards open vocabulary learning: A survey,","venue":null,"work_id":"38ee9b78-ea9d-462a-a06e-3bb1043819c9","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.924284Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:aca869c2ebc19ada1864e1bf04c6d57ce3ef49a095f648a4a3964533ea5d17b9","observation_id":"a4c8465f-c04a-4290-8c84-6767f117c72f","resolution":{"observed_at":"2026-08-06T22:17:57.795801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:57.525743Z","title":"Segment and recognize anything at any granularity,","venue":null,"work_id":"6810c023-9946-488a-91eb-667357a0281a","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.929277Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:d07ce20c6400eac64d2179a5fa22b9cbfc27ef61be4439a43cbc0051e00272ab","observation_id":"fabba1e3-4d76-4977-9ccb-b88eb4caa266","resolution":{"observed_at":"2026-08-06T22:17:57.603422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:57.387724Z","title":"Dst-det: Simple dynamic self-training for open- vocabulary object detection,","venue":null,"work_id":"fc34d2cf-a0aa-4db4-99bb-f60a4525ef68","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.934639Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:f3ced7ffee4b35166f69d25095e1edcd5007f8d3e56f6fc8fbd1e2b2c03a8545","observation_id":"150c84fd-125c-4529-9ee8-7dd9a28e3eb9","resolution":{"observed_at":"2026-08-06T22:17:57.416368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:57.216027Z","title":"Coco-stuff: Thing and stuff classes in context,","venue":null,"work_id":"f19ce051-c2ac-43e2-9852-75ee8db8f4fc","year":2018},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.939959Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:61c17f489e36fe0ea47db2727c5188afee27261878c30938418baa0aeac3e2c8","observation_id":"af804dc5-09ef-42bc-b407-df8d7be170b1","resolution":{"observed_at":"2026-08-06T22:17:57.265759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:57.059529Z","title":"Scene parsing through ade20k dataset,","venue":null,"work_id":"0190d1ab-134a-401c-a7f2-d2ef5a3f5af5","year":2017},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.944770Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:ce8ed12f7487c4d4a3ba2eb6de56067d6f00b8749b8eea9cd0c1daf144a7095a","observation_id":"c991e381-ebb6-4530-bb64-b3dda450d881","resolution":{"observed_at":"2026-08-06T22:17:57.102462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:56.914756Z","title":"Knowledge distillation and student-teacher learning for visual intelligence: A review and new outlooks,","venue":null,"work_id":"121eb069-2e39-4ce8-b3cb-e282a245744a","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.949902Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:474248209f98861e5430c23ecd76ed9acc1ef910639883f782c12cf3473506f2","observation_id":"f1599898-7666-4247-bec5-d3691d1c624b","resolution":{"observed_at":"2026-08-06T22:17:56.981164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-06T22:17:53.956180Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.956180Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:ba7a03c18c1bb35c7a10d97482be404767d5dd809885591e8a81ba6615d0324c","observation_id":"03970648-f086-4acf-82f1-3cfb53a9b160","resolution":{"observed_at":"2026-08-06T22:17:53.956180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:56.789791Z","title":"Mawkdn: A multimodal fusion wavelet knowledge distillation approach based on cross-view attention for action recognition,","venue":null,"work_id":"de6a72ae-6b51-4458-b887-dd07703dc493","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.962040Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:c00fc7d65823b4ee4a62331175811f430739e3958be35d2935b15f16ba949ed3","observation_id":"25bc4745-3600-4bf8-8517-165df4d0d971","resolution":{"observed_at":"2026-08-06T22:17:56.863961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:56.721273Z","title":"Exploring open-vocabulary semantic segmentation from clip vision encoder distillation only,","venue":null,"work_id":"6573d0c0-de69-415e-8e34-bef4e223b064","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.968197Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:eaa5280c4b205ec31693149954ea69d6778cce04305e35ba4c77d1c642295e0d","observation_id":"3c6fe268-79ee-4d59-ac16-91e71d2c236f","resolution":{"observed_at":"2026-08-06T22:17:56.749112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:56.591175Z","title":"Distilling detr with visual-linguistic knowledge for open-vocabulary object detection,","venue":null,"work_id":"7027e67e-2e2c-4d07-9831-b86f4beca07e","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.973715Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:19545491699530460d5abd4b50a68d40b3e9f03e91d1422328cfe9608f6b3d07","observation_id":"f720f9ee-c565-4229-b7d4-c6d086529dfc","resolution":{"observed_at":"2026-08-06T22:17:56.654982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:56.469139Z","title":"Self pseudo entropy knowledge distillation for semi-supervised semantic segmentation,","venue":null,"work_id":"9f129f2c-1200-411a-9cd3-57c0cc9c090b","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.978866Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:738b28bd8d63d126b7e34863aa1f99409d658a264b242117511db2df06a8d524","observation_id":"54ec7f5a-90c2-4170-ab9f-f3be00924fd6","resolution":{"observed_at":"2026-08-06T22:17:56.525070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:56.344802Z","title":"CLIPSelf: Vision transformer distills itself for open-vocabulary dense prediction,","venue":null,"work_id":"09d6dbe7-84d8-483d-b320-133e018cf0fe","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.984780Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:0a127c3fc38528c603f687f41ad8c846e39bdbde43d28312e22277fcbbb7d934","observation_id":"dbecdd89-5552-48a2-9d22-d07bfbf0c891","resolution":{"observed_at":"2026-08-06T22:17:56.374021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:56.221810Z","title":"Open-vocabulary object detection via vision and language knowledge distillation,","venue":null,"work_id":"733a5d04-4b5f-4c01-8ee1-cf51418fdbb0","year":2022},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.992318Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:d1130797984bb6ba6e25dad25cb1e18c3d3c674348a16482c045512e096fc12b","observation_id":"a492142d-fd47-42f7-849a-3898ff3de535","resolution":{"observed_at":"2026-08-06T22:17:56.273060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:56.108523Z","title":"Primitive generation and semantic-related alignment for universal zero-shot seg- mentation,","venue":null,"work_id":"e612908b-f163-4f9e-a4af-59799c3a5f16","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:53.997995Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:6a87947b5012dbfe12d982b649b39386f00ed69bcfbccbf5fb6bb7d944924b58","observation_id":"c56292a7-55b5-4542-8f2d-f7c6a66af207","resolution":{"observed_at":"2026-08-06T22:17:56.167735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:56.009210Z","title":"Open-vocabulary one-stage detection with hierarchical visual-language knowledge distillation,","venue":null,"work_id":"5362de15-e088-4fed-afbf-b90a8a07bb90","year":2022},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.003590Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:d86e23a1d60f97c71bfb7c9b351c3bef7111fc28ee5a0129c8094a711188c27d","observation_id":"99e6eb73-8a35-4b8e-910a-74ba337c1dab","resolution":{"observed_at":"2026-08-06T22:17:56.055744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:55.911965Z","title":"FROSTER: Frozen CLIP is a strong teacher for open-vocabulary ac- tion recognition,","venue":null,"work_id":"142fd63d-9083-4fbf-9675-4d2582480682","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.009960Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:c79869958eed40deac2ca02fdf7f3b8997869f70d0c5484cffa211bf24ef0da3","observation_id":"95999976-8674-49ba-8564-6efa08ed5aa3","resolution":{"observed_at":"2026-08-06T22:17:55.935194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:54.015374Z","title":"Focal loss for dense object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.015374Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:adc716c01ae8c9f179804ddfa90cca03be209d1eafd93624185a1e6ff97ebbb6","observation_id":"e68cb473-2de7-48e7-b6f3-962e468909a4","resolution":{"observed_at":"2026-08-06T22:17:54.015374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:55.786665Z","title":"Exploiting a joint embedding space for generalized zero-shot semantic seg- mentation,","venue":null,"work_id":"f3a0d7fd-734a-4dfb-9e6a-64d7662f2dab","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.021302Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:15ebf4ee59ff65e84b0a2c5735fcc1b7caf513b596d09ab5781c4f7fcbbd3999","observation_id":"d0b88ed8-e1e5-48f0-863b-a69576cce9aa","resolution":{"observed_at":"2026-08-06T22:17:55.831638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:55.705202Z","title":"Ex- ploring regional clues in clip for zero-shot semantic seg- mentation,","venue":null,"work_id":"d72e8f00-1d22-4c47-9eaa-99cc8861a0ce","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.027432Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:931c0065f70ccd10314ea245704b85cf33454a18e1bbf14426ca70425a65cb7e","observation_id":"90b94c64-b5b2-47d0-9311-3c466da49105","resolution":{"observed_at":"2026-08-06T22:17:55.749777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:55.562877Z","title":"Otseg: Multi-prompt sinkhorn attention for zero-shot semantic segmentation,","venue":null,"work_id":"d57fba05-88b0-4590-b1e6-12b30f3b770d","year":2024},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.033008Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:b8d18a2870d678df147a7d58671db85bfdf60f7faa430c9c3024737b7870e083","observation_id":"b8329002-6ea4-4674-9470-9532cbbfc93e","resolution":{"observed_at":"2026-08-06T22:17:55.623317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:55.467912Z","title":"Freeseg: Unified, universal and open-vocabulary image segmentation,","venue":null,"work_id":"a1232b2a-7987-43d1-8189-9f28c875c38e","year":2023},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.038026Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:d5ad0fe9eaa9e2405015f1781ff6dd239be19129e2d5dd31b4ef35242ea7310e","observation_id":"d8af515d-cc35-4c35-866f-7fafdf7f5f9f","resolution":{"observed_at":"2026-08-06T22:17:55.494113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:55.351640Z","title":"The role of context for object detection and semantic segmentation in the wild,","venue":null,"work_id":"5c0567b1-0d76-4642-8a48-1ef6ba0f958e","year":2014},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.042931Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:d52e901ac1b3cd687a9651cd4337e049c9f78bce8bdd926ab3ccd7b34a68c9d4","observation_id":"81d6b29c-529e-4fed-be35-c4583ff1a7d9","resolution":{"observed_at":"2026-08-06T22:17:55.398287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:55.245783Z","title":"Mmsegmentation: Openmmlab seman- tic segmentation toolbox and benchmark,","venue":null,"work_id":"7930a595-0301-4fe0-b241-6a4eb4f98156","year":2020},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.047906Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:4beced9b71252b8c8514d0c21ce87c69ab12b8f9c046109383d2f0671f03ad05","observation_id":"679ba8b4-2f31-4784-9786-2e73fedf49a5","resolution":{"observed_at":"2026-08-06T22:17:55.299943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:54.053119Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.053119Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:72a5c763acb744e86ce2decb8fad8c709f5ebf23c72422e4a2b4dd4014c16974","observation_id":"25985df0-95d3-43de-9aa8-cc2391b00c03","resolution":{"observed_at":"2026-08-06T22:17:54.053119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:55.133370Z","title":"Do vision transformers see like convolu- tional neural networks?","venue":null,"work_id":"580e11cf-1dac-47be-96e9-a07a2add7e25","year":2021},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.058101Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:d5a4f00cb94bddc4cbd8429a66e0fa464a49555ab9e62915733de1098cecdbeb","observation_id":"d5f78d8d-b065-4a74-96b4-852807f8f5b3","resolution":{"observed_at":"2026-08-06T22:17:55.189488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:17:55.017216Z","title":"Similarity of neural network representations revisited,","venue":null,"work_id":"347785ec-033d-46e9-876b-4876d96f7f4f","year":2019},"citing_paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T22:17:54.062818Z"},"links":{"citing_paper":"/paper/2506.22032"},"observation_digest":"sha256:1b58a56578c13ca1399a4c53343d1253bf3fff67a60a5137b8d3000283ac4771","observation_id":"e20c55d6-6255-4897-831d-9c5a8873a28f","resolution":{"observed_at":"2026-08-06T22:17:55.065498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.22032","last_updated":"2025-06-27T09:26:50Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T05:48:13.868935Z","submitted_at":"2025-06-27T09:26:50Z","title":"Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation"},"reference_resolution":{"displayed":85,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":7,"verified_fuzzy":60},"total_outbound_references":85},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 85 of 85 outbound references and 0 inbound Pith citation observations for arXiv:2506.22032."}