{"as_of":"2026-08-10T21:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c5b003332eea2ef299580502bed233a04ce95d56d84f99934c505d0ea270851a","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:28:41.980645Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.08570/citation-record","integrity":"/paper/2509.08570/integrity","json":"/paper/2509.08570/citation-record.json","paper":"/paper/2509.08570"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.083292Z","title":"A survey of unsupervised deep domain adaptation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.083292Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:aeeaac0cad264cf9cdcdd1ecbff4a618f7a2e771fa812d76a5710313de91a1c4","observation_id":"fb92747d-1b98-4324-90db-40f3a5774590","resolution":{"observed_at":"2026-08-04T20:28:37.083292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.210212Z","title":"A comprehensive survey on source-free domain adaptation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.210212Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:0a9100bce2a75c256d0e24a6d92a68d88accdb295d14a096627ddfed6dd5dd77","observation_id":"ea9e7f68-f401-4e59-bd1d-7118b4f85780","resolution":{"observed_at":"2026-08-04T20:28:37.210212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.372868Z","title":"Domaingeneralizationthroughmeta- learning: a survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.372868Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:8cd5fb2505b430d15e260208692373526cd8be5bb415748b8be9e16fddebc3ce","observation_id":"e8f67e55-6bf0-43e9-ad81-48a61b95e5c9","resolution":{"observed_at":"2026-08-04T20:28:37.372868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.553730Z","title":"Open domain gen- eralization with domain-augmented meta-learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.553730Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:5f1683d966845c2a8701c555b61994950695cd478fb7f4f04aa22751492ac3a9","observation_id":"d6355fa5-4b16-4f59-b13e-d32356a4d589","resolution":{"observed_at":"2026-08-04T20:28:37.553730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.702825Z","title":"Reducing domain gap in frequency and spatial domain for cross-modality domain adaptation on medical image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.702825Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:9edac8da66f1aa39de6dee66fee97d17eae3b3e85943c427fd83e67b383a2a29","observation_id":"6ea44e3f-17de-4d10-9c59-d08bfd9cea35","resolution":{"observed_at":"2026-08-04T20:28:37.702825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.865345Z","title":"Domain generaliza- tion: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.865345Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:a0768d83c2845fc1337e000638aa97e046820df4ae17c611ed23888dd975ae37","observation_id":"c945286a-b291-4f9b-a1b2-b4b26acd75c0","resolution":{"observed_at":"2026-08-04T20:28:37.865345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.978374Z","title":"Adversarial consistency for single domain generalization in medical image segmentation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.978374Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:860fb445ca6b3fc2c8eeb9e1c3e83ca4db6b35469ee66176b02f43a8738505e7","observation_id":"3f265cb4-f254-4acf-ac9d-e5bce079727e","resolution":{"observed_at":"2026-08-04T20:28:37.978374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.051036Z","title":"Structure-aware single-source gen- eralization with pixel-level disentanglement for joint optic disc and cup segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.051036Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:c974946747b1abf184c54a1662f917644de6b930e89d0e52e40e528928742ba9","observation_id":"193d9b5b-5bc5-468d-a211-7f0f1271bec6","resolution":{"observed_at":"2026-08-04T20:28:38.051036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.191160Z","title":"Multi- receptive field feature disentanglement with distance-aware gaussian brightness augmentation for single-source domain generalization in med- ical image segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.191160Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:955a42e37a0756d6512f55fb6113d55ccb5215aae3a7567cb74366ac211da8ee","observation_id":"421ecc57-2976-471d-a8d5-75b51d2d512f","resolution":{"observed_at":"2026-08-04T20:28:38.191160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.346341Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.346341Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:2af2a7f95c032b100feced8cb5c7194a298834896b876edb6603a8dd1c1a8694","observation_id":"ea60081a-a117-4230-98f2-ad1fb3f3df83","resolution":{"observed_at":"2026-08-04T20:28:38.346341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.530750Z","title":"Learningtransferablevisualmodelsfromnaturallanguagesupervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.530750Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:fa95693aabe6bf498385bb1ece84ad5ea589859038c32b5a898d651571ec90e0","observation_id":"9e51322c-0d8a-4cda-a2dd-1bd893f7c85a","resolution":{"observed_at":"2026-08-04T20:28:38.530750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.662209Z","title":"Textual query-driven mask transformer for domain generalized segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.662209Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:b5a05c2c10753004921eafa296f2a349f0d1a04d2ad18838cb24af42395afece","observation_id":"95996811-11b0-40c6-98a1-7ea00403bbf4","resolution":{"observed_at":"2026-08-04T20:28:38.662209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.733526Z","title":"Uni- fied contrastive learning in image-text-label space,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.733526Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:8d3e68b7c32d3e6e0c0d8478269a53005f6f15dbf687844d20820993b8c67fef","observation_id":"90db9ef3-2e6c-422b-b98e-981035eefd2a","resolution":{"observed_at":"2026-08-04T20:28:38.733526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.821093Z","title":"Pyramidclip: Hierarchical feature alignment for vision-language model pretraining,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.821093Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:44f447d92b9b7b938add6fe66b01c8e39eee3f615b23e3d4604b4bb290212443","observation_id":"ec64f166-ba97-4a8a-b3fb-41722f76a2df","resolution":{"observed_at":"2026-08-04T20:28:38.821093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.920314Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.920314Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:f304d5da12414bb57cb1c9fe717d810da7cfebc7a2e230573136476a3d7d0abc","observation_id":"111e920a-6b8c-4df4-a2bb-609ada3094c2","resolution":{"observed_at":"2026-08-04T20:28:38.920314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.018536Z","title":"Stronger fewer & superior: Harnessing vision foundation models for domain generalized semantic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.018536Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:7ad39010a03cb397c9094a5f230b19f9943cf49096da539152f1c170d490f0b6","observation_id":"195c45ec-0f79-4eb7-8654-bac8d07a1d69","resolution":{"observed_at":"2026-08-04T20:28:39.018536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.152082Z","title":"Causality-inspired single-source domain generalization for medical im- age segmentation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.152082Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:b0b099fcac209e1b8be93d5d8efbeb9bca0cb3c7c7c6ed1a1477f83a2053c30c","observation_id":"cebbf11e-1774-43b1-8f9f-dcb8a834a362","resolution":{"observed_at":"2026-08-04T20:28:39.152082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.240659Z","title":"Devil is in channels: Contrastive single domain generalization for medical image segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.240659Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:c00637e9648dfb6a698a4a28df8cca97bf2b16aacceccbe0c363bc4a1a48f6d7","observation_id":"78559ec5-8764-4a23-8bc6-3433b1d1877e","resolution":{"observed_at":"2026-08-04T20:28:39.240659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.325984Z","title":"Single domain generalization for multimodal cross-cancer prognosis via dirac rebalancer and distribution entanglement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.325984Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:7b7278ac6c1d12800c2c9f7c5ee615917e1a898ebe754e1bfb9ed5887b99c3d4","observation_id":"4a685c2a-0540-46d5-a3b2-90318582d391","resolution":{"observed_at":"2026-08-04T20:28:39.325984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.402616Z","title":"Denseclip: Language-guided dense prediction with context-aware 26 prompting,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.402616Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:14f44df4978be71425f45ebac4b888e3612a2fe81e5443b85caa158e5325ca66","observation_id":"2c88a0bd-8419-40f0-9109-cce9cd2fc776","resolution":{"observed_at":"2026-08-04T20:28:39.402616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.507684Z","title":"Maximum likelihood from incomplete data via the em algorithm,","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.507684Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:54ccb1853605fc8a1d0edaf063bb8ecc12778b28f60435ae8836d1767a9734a2","observation_id":"cafbbd45-bfb1-4552-8d82-ad72ab700b6f","resolution":{"observed_at":"2026-08-04T20:28:39.507684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.605237Z","title":"Mamba as a bridge: Where vision foun- dation models meet vision language models for domain-generalized se- mantic segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.605237Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:08a4652213147bdde0c44a5da62507787c7becb7a6858876690640aaf7d78c0e","observation_id":"def837d7-c0a9-4853-8926-1f51d2cfd4dd","resolution":{"observed_at":"2026-08-04T20:28:39.605237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.682308Z","title":"Acceleration of the em algorithm by using quasi-newton methods,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.682308Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:eb81f2711e3ac4d6e0b0ad4cedb9172a923ddca619608574bfb2afb88d8c1b23","observation_id":"90887f03-da98-4ec8-9b99-2640592bd7f6","resolution":{"observed_at":"2026-08-04T20:28:39.682308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.791003Z","title":"Prompt tuning for parameter- efficient medical image segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.791003Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:c9e926278befce065e522606c14960e9f2e0381c0d68c60861ef23f3c5726ae0","observation_id":"8fbcaaa3-9150-442d-b32a-d36e857c367b","resolution":{"observed_at":"2026-08-04T20:28:39.791003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.894615Z","title":"Cat: Coordi- nating anatomical-textual prompts for multi-organ and tumor segmen- tation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.894615Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:5fc72fd8a2d905a215e114ef5a1687ab00b6a5adf1f0381070244ea0e868db61","observation_id":"8027813f-3cd8-4544-b9ac-4a7ba8d46a93","resolution":{"observed_at":"2026-08-04T20:28:39.894615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.012187Z","title":"Multi-modality cross attention network for image and sentence matching,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.012187Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:b93fdbfacab2093d2aa20de4a41246c0e6b2546b97a82ff1d4f93491ada22344","observation_id":"132c9503-b433-47de-b897-2d348b3e9e91","resolution":{"observed_at":"2026-08-04T20:28:40.012187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.138474Z","title":"Hierarchical self-attention network for industrial data series modeling with different sampling rates between the input and output sequences,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.138474Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:c7814ad6969524452ea3bcf41e85f17d4086988c984a3292fc57b66a4e8c9a80","observation_id":"e034cd9b-f0cc-44cf-8d80-13ff51188298","resolution":{"observed_at":"2026-08-04T20:28:40.138474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.249073Z","title":"Transformers in vision: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.249073Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:c2f34ac19c5546453057bd891c9d99ef63221f3125881b27b8ae7779ce504638","observation_id":"95541161-14e8-40ad-a0a2-849d2beab883","resolution":{"observed_at":"2026-08-04T20:28:40.249073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.337264Z","title":"V-net: Fully convolutional neural networks for volumetric medical image segmentation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.337264Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:86f8bcb3c6d43ff9115877bc52580f5e440445efc662139a179d9623162d5b45","observation_id":"293b2886-9c48-4e62-8741-95d6b26cba69","resolution":{"observed_at":"2026-08-04T20:28:40.337264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.425082Z","title":"Learning to prompt for vision- language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.425082Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:7b0fb60e2640a170705a135e087798921efebf56d7b06b31068709a0b42fd362","observation_id":"2a10c736-b173-4958-9c12-bf82f65cbf29","resolution":{"observed_at":"2026-08-04T20:28:40.425082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.521564Z","title":"A similarity paradigm through textual regularization without forgetting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.521564Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:260d96638240a03fa636bad2d98caedf6d8fa673b49c5aad912d1a87ff321d19","observation_id":"b1a9b18c-ad1d-4b28-af2c-a283d318d17d","resolution":{"observed_at":"2026-08-04T20:28:40.521564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-04T20:28:40.628265Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.628265Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:dad939bb25c22f98b9bbda6e5bd467405cd127ca4f5f51aaf7d608b0fe8f5379","observation_id":"78158dc0-02d6-414b-9898-6001b1677b22","resolution":{"observed_at":"2026-08-04T20:28:40.628265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.752796Z","title":"Deep learning techniques for automatic mri cardiac multi-structures segmen- tation and diagnosis: Is the problem solved?,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.752796Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:0c1dd8e81079fa8d940db8388338f8ee779fc9b91dc175e32d44024a2dccc537","observation_id":"01b116cf-48d5-4688-b4bf-345afec9dc28","resolution":{"observed_at":"2026-08-04T20:28:40.752796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08813","last_updated":"2024-07-18T20:30:28Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T18:52:32Z","title":"FairDomain: Achieving Fairness in Cross-Domain Medical Image Segmentation and Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08813","snapshot_observed_at":"2026-08-04T20:28:40.880214Z","title":"Fairdomain: Achievingfairnessincross- domain medical image segmentation and classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.880214Z"},"links":{"cited_paper":"/paper/2407.08813","citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:3789fa723b5f711b29d6155fa912ddab084b02f5f823fc1aacc63b2dec597952","observation_id":"462afd20-be56-4c40-b711-0e7812a0eca2","resolution":{"observed_at":"2026-08-04T20:28:40.880214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.966053Z","title":"U-net: Convolutional net- works for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.966053Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:4544f0b49f1d0d903710a8c4fa28aca81e26d8b636106f9d5b6952ec7ca44c03","observation_id":"b3a965cd-e01f-4b2c-95fa-881e94cc56e8","resolution":{"observed_at":"2026-08-04T20:28:40.966053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.040000Z","title":"H2former: An efficient hierarchical hybrid transformer for medical image segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.040000Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:f414833316a6ea6435f5a007c7e6d989a03edc40c80f99b068c8054e2547bbff","observation_id":"8977c82e-621c-4fc5-82a9-c666e5a62490","resolution":{"observed_at":"2026-08-04T20:28:41.040000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.148896Z","title":"Improved regularization of convolutional neu- ral networks with cutout,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.148896Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:fc45a52dfb41ba90407ff1a6d1c5eac2c33ec403dabc3f530093b13f586aeaa6","observation_id":"28470aca-8529-4dfc-b563-1df3484453e8","resolution":{"observed_at":"2026-08-04T20:28:41.148896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.269873Z","title":"Robust and generalizable visual representation learning via random convolutions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.269873Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:40aa0eb9daf78a7ea8ccc5a01280b72c008dd556afedc115a9c80ce2f25d5358","observation_id":"d26f7384-3ef9-4e44-b2c0-19f09b61d903","resolution":{"observed_at":"2026-08-04T20:28:41.269873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.350067Z","title":"Domain generalization with mixstyle,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.350067Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:578804e9fa5ebd739ba65755ddb1950d5007b27b7241540a7fa331796109b28d","observation_id":"592ef65e-deec-4652-acd0-bd4cddcb5689","resolution":{"observed_at":"2026-08-04T20:28:41.350067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.550867Z","title":"Rethinking data augmentation for single-source domain generalization in medical image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.550867Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:4dd9ca775f3154dcab71e9beb6dd9733d7efc976e8dd4ff2f03934659af80a35","observation_id":"cae84a33-56ab-484b-bbf6-5195977fb3cd","resolution":{"observed_at":"2026-08-04T20:28:41.550867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.819842Z","title":"Prompting seg- ment anything model with domain-adaptive prototype for generalizable medical image segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.819842Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:824869793c3d8ae0c6665a720602788673c3e5a3850770df54ca471608478ab3","observation_id":"21c65fa8-8146-4d99-90c8-3ec2890f33d1","resolution":{"observed_at":"2026-08-04T20:28:41.819842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.980645Z","title":"A theory of learning from different domains,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.980645Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:36ffa1556ca582131a4b751fe8c2def43531301324341feb943e417ab32c7549","observation_id":"3110ab47-5f24-4d2c-967b-39c8dc1984a9","resolution":{"observed_at":"2026-08-04T20:28:41.980645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T00:08:14.622731Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2509.08570."}