{"as_of":"2026-08-08T17:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fec56ce527c3c4ecd27411a16567b9ba162c1612969cea82d2a5ff5988d312ca","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:09:15.626675Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:38:45.428427Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T21:38:48.445520Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"cited_work":{"arxiv_id":"2506.22567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.22567","snapshot_observed_at":"2026-08-05T21:38:48.445520Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","venue":"cs.CV","work_id":"62e5366c-1ad6-4d3a-a7c7-1fcf5d21b950","year":2025},"citing_paper":{"arxiv_id":"2508.08224","last_updated":"2025-08-13T05:32:22Z","snapshot_observed_at":"2026-08-08T06:54:01.807606Z","submitted_at":"2025-08-11T17:43:45Z","title":"Capabilities of GPT-5 on Multimodal Medical Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:38:45.428427Z"},"links":{"cited_paper":"/paper/2506.22567","citing_paper":"/paper/2508.08224"},"observation_digest":"sha256:21b57a52dff19109769e98961186e0c4f9145c86912d3e8d15f5cfbafc627554","observation_id":"1714f79a-990d-41ea-812c-5020fa6864d7","resolution":{"observed_at":"2026-08-05T21:38:48.592280Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.22567/citation-record","integrity":"/paper/2506.22567/integrity","json":"/paper/2506.22567/citation-record.json","paper":"/paper/2506.22567"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.688443Z","title":"Clip and complementary methods","venue":null,"work_id":"a2b158c7-1136-465e-bf73-08a26b9aebed","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:05.498720Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:3326c43c93bca46fe6e55d6fc7d5adb0c6743767d7b7d39d5843a18ea041874f","observation_id":"96ba57ab-1d5d-45b6-81fe-1387b901a03e","resolution":{"observed_at":"2026-08-06T22:10:19.763399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:05.611245Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:05.611245Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1e416b2fb80f304ca5496719091a42b558e88f2123992043dad7487d5802dde3","observation_id":"a8796f18-db02-4bb5-a4c2-f558a36013c1","resolution":{"observed_at":"2026-08-06T22:09:05.611245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.513548Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"d4be71fc-f0de-43a7-a250-98bda5bd7152","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:05.728940Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:3e86afcbafb8bf710012dc6fbc84a35a88959c6157f71058148a94d083b6be2c","observation_id":"78238203-5109-4545-acb2-c6d1f86aaa6c","resolution":{"observed_at":"2026-08-06T22:10:19.575937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:05.881143Z","title":"Foundation models for generalist medical artificial intelligence","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:05.881143Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:6ade5c57d079506c53178ffcc04054635bf6ae256651c2d1e9b35834fee71323","observation_id":"f56b83c6-c6ab-46c3-92c4-0e7a5f9e495f","resolution":{"observed_at":"2026-08-06T22:09:05.881143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:06.056193Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.056193Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:926d5ded6bb7e93c0762d667da0a17744dea89669ee571ed5af817f41d8de07d","observation_id":"4e5ef586-e0e9-4176-bb57-c44362e4fab8","resolution":{"observed_at":"2026-08-06T22:09:06.056193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.389378Z","title":"Cxr-clip: Toward large scale chest x-ray language-image pre-training","venue":null,"work_id":"b0aeebfe-060b-4567-8483-544fd67dd2d3","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.180448Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:0e529ac2ae140d2e4228e44d8c73e117ebb99b9dbd8949e9fc726722a9412072","observation_id":"d975457a-bd07-48b2-a247-b4e14633662f","resolution":{"observed_at":"2026-08-06T22:10:19.451742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:06.279074Z","title":"Merlin: A vision language foundation model for 3d computed tomography","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.279074Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:8f3a3ddd69bfdddc373cce7b1e8e81e55b1cd10ad35a42474876b8ca1db72ec0","observation_id":"7ac1f250-2e6a-4046-8815-13d3ea8e3d88","resolution":{"observed_at":"2026-08-06T22:09:06.279074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.244891Z","title":"Artificial intelligence for multimodal data integration in oncology","venue":null,"work_id":"6675618c-8887-4e57-a6e0-674cb855b711","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.440088Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:d60369e03b230466b5e71b9221e99056304350d481d84c19c9726441b77dd93f","observation_id":"4fee011c-cb58-40cd-a41a-bee4fc27cb08","resolution":{"observed_at":"2026-08-06T22:10:19.334884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14064","last_updated":"2025-02-23T03:13:01Z","snapshot_observed_at":"2026-08-07T18:03:53.349603Z","submitted_at":"2025-02-19T19:31:52Z","title":"Triad: Vision Foundation Model for 3D Magnetic Resonance Imaging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14064","snapshot_observed_at":"2026-08-06T22:09:06.524513Z","title":"Triad: Vision foundation model for 3d magnetic resonance imaging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.524513Z"},"links":{"cited_paper":"/paper/2502.14064","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:fb404b7f4d12d962ef66f493fcf03723f2b28d4fbb0b008ed6a7ea4ab330e2ab","observation_id":"06a9fa43-d70d-49c6-9daa-fce7085fd0cb","resolution":{"observed_at":"2026-08-06T22:09:06.524513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.131781Z","title":"A whole-slide foundation model for digital pathology from real-world data","venue":null,"work_id":"dc56ac34-24dd-4c85-bb41-d6f3f917712d","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.527790Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:0eb61f0353a416b0bb23d3c1aa87f66c2731ca8f7c746b541030b3dcfc0a185f","observation_id":"b04e16c4-4307-43cb-a8d0-fb111bbe9ecf","resolution":{"observed_at":"2026-08-06T22:10:19.185954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.926490Z","title":"A visual–language foundation model for pathology image analysis using medical twitter","venue":null,"work_id":"1dda675d-dc78-4479-a5ac-1b6c46e33a59","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.531758Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:cee91667655a63a7fb57e55dfccbbe9e8e64e53f69515735d1a311642e9f8248","observation_id":"f2e20680-ed10-4f92-b0e4-bbac30882d93","resolution":{"observed_at":"2026-08-06T22:10:19.033187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.733774Z","title":"A foundation model for generalizable disease detection from retinal images","venue":null,"work_id":"52bed81e-6015-4c70-b175-5e86211b744d","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.610421Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:0fa697ff046ff6614d69e66ba8c6bf944f9d867059ff216b3fa0e3ebdf19ea8a","observation_id":"7d39bbcc-626c-4e6c-9bb6-7b34412a53db","resolution":{"observed_at":"2026-08-06T22:10:18.820143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15421","last_updated":"2024-11-26T13:25:34Z","snapshot_observed_at":"2026-08-07T20:56:18.591259Z","submitted_at":"2024-11-23T02:53:08Z","title":"OphCLIP: Hierarchical Retrieval-Augmented Learning for Ophthalmic Surgical Video-Language Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15421","snapshot_observed_at":"2026-08-06T22:09:06.737442Z","title":"Ophclip: Hierarchical retrieval-augmented learning for ophthalmic surgical video-language pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.737442Z"},"links":{"cited_paper":"/paper/2411.15421","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:f0e56536637a02409c8856ffb321f86fe2abd25599323332c4164afd834dd9d3","observation_id":"663ded04-a4cf-417c-a503-f347e8d22ccf","resolution":{"observed_at":"2026-08-06T22:09:06.737442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:06.892066Z","title":"Transparent medical image ai via an image–text foundation model grounded in medical literature","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.892066Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:114193cd3779b85e22543fc0372e4e8d1a2bd1fa4b8777944f2310c5ffca12ba","observation_id":"61256a0d-298e-4106-8cc7-5b28ccc79cf9","resolution":{"observed_at":"2026-08-06T22:09:06.892066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.545080Z","title":"A generalist vision–language foundation model for diverse biomedical tasks","venue":null,"work_id":"000ecb23-6fe9-433c-9347-232cf808b1b0","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.061313Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:bf40347f4f0ff6bb35b0e37073ea0fe867ff29e9483c3ab448cf5a4a07926a8a","observation_id":"51521a6e-f79e-4c4f-ae14-17bcc45e6ca4","resolution":{"observed_at":"2026-08-06T22:10:18.601237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-07T17:23:53.412693Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-06T22:09:07.229393Z","title":"Quantifying the reasoning abilities of llms on real-world clinical cases","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.229393Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:a353fe2befd595d2a077cc369fae8373ade84780350fc2446d0953728908b1f7","observation_id":"3391c1e2-2fd8-4417-a6ec-7c27e67d08fa","resolution":{"observed_at":"2026-08-06T22:09:07.229393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.396147Z","title":"Unsupervised mri motion artifact disentanglement: introducing maudgan","venue":null,"work_id":"ca86ffc9-82f0-4e86-a21f-04a9c12a7f83","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.404228Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:4f07de1b69656eb42afb68578ae73e8a3ca232e58a2f1557f41df765ea7841e8","observation_id":"244163b3-b314-49db-b9e7-0b157dadcee6","resolution":{"observed_at":"2026-08-06T22:10:18.434680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.383075Z","title":"Mri super-resolution reconstruction using efficient diffusion probabilistic model with residual shifting","venue":null,"work_id":"c89cb448-2027-4614-9c6d-3f288e2b6d69","year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.562529Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:f20d559f76aa8ececd390bd1f54a27acdf54968ad13e0bf1e896046792c165ec","observation_id":"9b8d622c-b1cf-4115-a559-dffbab728116","resolution":{"observed_at":"2026-08-06T22:10:18.387777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06898","last_updated":"2025-05-11T08:32:01Z","snapshot_observed_at":"2026-08-07T15:48:09.842982Z","submitted_at":"2025-05-11T08:32:01Z","title":"Multi-Modal Explainable Medical AI Assistant for Trustworthy Human-AI Collaboration","version":1},"cited_work":{"arxiv_id":"2505.06898","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.06898","snapshot_observed_at":"2026-08-06T22:09:16.440837Z","title":"Multi-Modal Explainable Medical AI Assistant for Trustworthy Human-AI Collaboration","venue":"cs.CV","work_id":"39835ba8-723a-4ece-ad02-89c9fd00cd60","year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.681566Z"},"links":{"cited_paper":"/paper/2505.06898","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:f381dc2eda7665733b5b4bf8e01e5194d3c1a7313c340139b0b702c3706a1167","observation_id":"15bb0f42-7c7e-4c00-a372-a77e1e2559a8","resolution":{"observed_at":"2026-08-06T22:09:16.560723Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.268360Z","title":"Deep learning based multimodal biomedical data fusion: An overview and comparative review","venue":null,"work_id":"f48e1e60-f490-4730-a1d6-1bec96075efd","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.792392Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:2b4fd3e8a58cdf1240f56714a4e94ae1de15d6639ff73813055821155cf6b991","observation_id":"b571ac72-089f-4a92-a092-b35fa05ae35a","resolution":{"observed_at":"2026-08-06T22:10:18.336478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.132211Z","title":"The future of multimodal artificial intelligence models for integrating imaging and clinical metadata: a narrative review","venue":null,"work_id":"ef7da775-f12e-4696-8097-aed3b35be544","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.951396Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:d65ee8cba29699fe2d44303956cbdbccdaec3b802c3339c661fa6945d341172b","observation_id":"ef7e8cb6-9228-46b3-9977-bf5949f3c164","resolution":{"observed_at":"2026-08-06T22:10:18.186449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:17.942796Z","title":"Pmc open access subset","venue":null,"work_id":"2d86d928-f660-41a0-a6e5-7234c2c8fd46","year":2003},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.074142Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:67cac1761eef61119d8e263553c92e291c3ee091d7a08baf2003d523bc66c2a7","observation_id":"be6161bb-a1c0-4218-87a2-79be34f3ecd9","resolution":{"observed_at":"2026-08-06T22:10:18.012983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.765842Z","title":"Pmc-clip: Contrastive language-image pre-training using biomedical documents","venue":null,"work_id":"a2a52ba6-c60c-4cc4-b9e8-183598111785","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.179419Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:387e870bc5cc3c25d75c5cd719089493befab93cc69eb703d9cb0c2a74229505","observation_id":"e7e94c61-ee64-4c31-9b3d-faf22552cf44","resolution":{"observed_at":"2026-08-06T22:10:17.796190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07171","last_updated":"2025-04-01T19:50:25Z","snapshot_observed_at":"2026-08-04T10:46:31.777323Z","submitted_at":"2025-01-13T09:58:03Z","title":"BIOMEDICA: An Open Biomedical Image-Caption Archive, Dataset, and Vision-Language Models Derived from Scientific Literature","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07171","snapshot_observed_at":"2026-08-06T22:09:08.268784Z","title":"Biomedica: An open biomedical image-caption archive, dataset, and vision-language models derived from scientific literature","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.268784Z"},"links":{"cited_paper":"/paper/2501.07171","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:c9277827b8857f7cd6020965fdea357479e73d824758a102a18e1179dde6c656","observation_id":"49d28a79-d629-4158-bee3-97fd544f4eaf","resolution":{"observed_at":"2026-08-06T22:09:08.268784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15579","last_updated":"2025-04-26T08:58:40Z","snapshot_observed_at":"2026-07-06T20:26:21.639525Z","submitted_at":"2025-01-26T16:07:11Z","title":"An Explainable Biomedical Foundation Model via Large-Scale Concept-Enhanced Vision-Language Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15579","snapshot_observed_at":"2026-08-06T22:09:08.348110Z","title":"Conceptclip: Towards trustworthy medical ai via concept-enhanced contrastive langauge-image pre-training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.348110Z"},"links":{"cited_paper":"/paper/2501.15579","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:7c941dcf915f97d7b5d49cc663278a30b59e85f917535f0376f044da11a1fccf","observation_id":"4a13254b-659f-40e1-990c-5ae073f8bfd6","resolution":{"observed_at":"2026-08-06T22:09:08.348110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.620399Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"cea1c40b-a18f-4912-a742-4cb14e684ed4","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.426292Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:3ee3a40fa8b06969f59b71d249ca78938c60462dc5753fe9efe8417f0f2563dd","observation_id":"eb4d1cb3-3813-49af-99f1-a60d7ee65de3","resolution":{"observed_at":"2026-08-06T22:09:23.690551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.442889Z","title":"Clip-kd: An empirical study of clip model distillation","venue":null,"work_id":"875372c3-01e5-456e-9227-7d3badce41c6","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.516567Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:313f0ad9440cd4d2179315b8ba01af937f414e188d2e06ba04bb178a81886788","observation_id":"901a58d4-d5e4-4c92-9aff-920767e4feb3","resolution":{"observed_at":"2026-08-06T22:09:23.535033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06386","last_updated":"2022-03-30T06:01:53Z","snapshot_observed_at":"2026-07-06T12:47:02.433506Z","submitted_at":"2022-03-12T09:33:37Z","title":"Enabling Multimodal Generation on CLIP via Vision-Language Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.06386","snapshot_observed_at":"2026-08-06T22:09:08.626731Z","title":"Enabling multimodal generation on clip via vision-language knowledge distillation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.626731Z"},"links":{"cited_paper":"/paper/2203.06386","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:c6a39a8db9d3b4e6402bcc0c6457eaea41f7ddee602d7dd0010b5af8a588c547","observation_id":"2bcd8bbb-7039-49fb-b31c-96c56a697df5","resolution":{"observed_at":"2026-08-06T22:09:08.626731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:08.764595Z","title":"Medicalnarratives: Connecting medical vision and language with localized narratives","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.764595Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:171766ecaede55a977c7dc7fc079417875977d196c791c104b72d239b98f2180","observation_id":"954023f3-4d96-40f1-a9f3-c326ecd5389f","resolution":{"observed_at":"2026-08-06T22:09:08.764595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.259637Z","title":"Medclip: Contrastive learning from unpaired medical images and text","venue":null,"work_id":"1d6f4c7d-2d66-4119-b6cd-d7bcd8e2d795","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.889114Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1ea37615d5cfd9037960419556b2216e2067a91c63e63ef9e987c9679f824311","observation_id":"10492f40-8dd8-4cda-86db-59bdf23eb6c6","resolution":{"observed_at":"2026-08-06T22:09:23.350351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.046880Z","title":"A multimodal biomedical foundation model trained from fifteen million image–text pairs","venue":null,"work_id":"07059485-99fe-48c1-9f0c-879a16461d8e","year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.984350Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1d4fbb62b5eb121f15a3c3f35906c7370e4ab06bfe705568bc405e8f4e21df26","observation_id":"7f9543a3-e316-43ca-b8fa-b831c31b11ec","resolution":{"observed_at":"2026-08-06T22:09:23.113274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10372","last_updated":"2024-12-13T18:59:40Z","snapshot_observed_at":"2026-07-06T20:06:43.917795Z","submitted_at":"2024-12-13T18:59:40Z","title":"UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10372","snapshot_observed_at":"2026-08-06T22:09:09.209532Z","title":"Unimed-clip: Towards a unified image-text pretraining paradigm for diverse medical imaging modalities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.209532Z"},"links":{"cited_paper":"/paper/2412.10372","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:e2cfbec25ab49b3b16f79099deab4e9ded65571d3ed5329b1deae4b8fd2cd61f","observation_id":"8b2addf9-1076-464c-bc6c-eae20b642c71","resolution":{"observed_at":"2026-08-06T22:09:09.209532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.784383Z","title":null,"venue":null,"work_id":"b3dacd07-0ad8-44d1-90c6-15bf0a10f3dd","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.376378Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:42b8a7782ba78e9cab11d368c2e357ffbbecdff5d45da4dd00495544a6f2604f","observation_id":"48e01aca-1c84-454d-959a-4f4f0e23162b","resolution":{"observed_at":"2026-08-06T22:09:22.932945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.590996Z","title":"Quilt-1m: One million image-text pairs for histopathology","venue":null,"work_id":"59f414f9-bbb7-48c4-84c3-0ba92db90705","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.546420Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:9b155ab5852e1c012e1aac996de4264e09dc8699ea842adc09b5462f4577a06d","observation_id":"1135adcc-b56f-4594-8be0-c09064f4d878","resolution":{"observed_at":"2026-08-06T22:09:22.671164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02900","last_updated":"2025-07-10T08:33:52Z","snapshot_observed_at":"2026-07-06T18:57:14.251413Z","submitted_at":"2024-08-06T02:09:35Z","title":"MedTrinity-25M: A Large-scale Multimodal Dataset with Multigranular Annotations for Medicine","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02900","snapshot_observed_at":"2026-08-06T22:09:09.710112Z","title":"Medtrinity-25m: A large-scale multimodal dataset with multigranular annotations for medicine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.710112Z"},"links":{"cited_paper":"/paper/2408.02900","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:e16ff95235405b3743fc5c32db2e434ec029ae4eb135fe19982a90c26ddcc9e4","observation_id":"31afff91-5c0d-4f8b-851b-ed573b3c889e","resolution":{"observed_at":"2026-08-06T22:09:09.710112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.357230Z","title":"Multiple instance captioning: Learning representations from histopathol- ogy textbooks and articles","venue":null,"work_id":"bbcbbf4d-88cd-4039-b883-74b8df24d4e4","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.871658Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:ddff79fc804198f48c179f4a093f20414505cb35b17d3547df2b4c212bf5dd3a","observation_id":"f531272f-3b18-48de-96df-9085e23663a1","resolution":{"observed_at":"2026-08-06T22:09:22.457135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.207438Z","title":"Slake: A semantically-labeled knowledge-enhanced dataset for medical visual question answering","venue":null,"work_id":"b605324d-6654-406e-b23e-d41097889560","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.990786Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:01f6c36ffe3b419eceae93f3a7a4b371865cbcdf6f1301c19a8d318fa3cc44f1","observation_id":"6f6749f7-096e-4fa8-966b-5a8782a0958b","resolution":{"observed_at":"2026-08-06T22:09:22.274391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:10.245863Z","title":"A dataset of clinically generated visual questions and answers about radiology images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.245863Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:9cb5530751cbf2048c5969b075692ddc512e8e51791092ece0b568d25d3b3fdf","observation_id":"11183f65-a4c5-4f1f-903c-eb4116cf9cb8","resolution":{"observed_at":"2026-08-06T22:09:10.245863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.052470Z","title":"Komura, A","venue":null,"work_id":"0dea7b06-00f3-4ef0-b6cd-ec2019c036e8","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.439304Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:28bfb42fa1eebe57f4bf35cae05fa758155c40e3dc4e8a2aadf5c892c9414c8d","observation_id":"0ecb0056-ea55-4c59-af04-9e4d6b34f5d0","resolution":{"observed_at":"2026-08-06T22:09:22.107874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:10.652016Z","title":"Bracs: A dataset for breast carcinoma subtyping in h&e histology images","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.652016Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:8163fa412ba29bc156a33d88f8a321df3e6cd2010a0f73db1191d5fa674a4c31","observation_id":"bbf17714-4664-4406-b30f-5218fc3c31d0","resolution":{"observed_at":"2026-08-06T22:09:10.652016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:10.820403Z","title":"The cancer genome atlas pan-cancer analysis project","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.820403Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:3a02c443931dba363e4a805e3e2138fcaacb48c404f567ba53c0b5b8c59fbd10","observation_id":"fd924f54-604b-4b30-9c95-62785afcffdc","resolution":{"observed_at":"2026-08-06T22:09:10.820403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:10.961838Z","title":"Diagnostic assessment of deep learning algorithms for detection of lymph node metastases in women with breast cancer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.961838Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:b05f221d3499ece6fa8a5631b65b31bcc5b1b344b92eac0518bf893f0e3db0d5","observation_id":"ca579c63-41a6-4486-947e-741c90e9876d","resolution":{"observed_at":"2026-08-06T22:09:10.961838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16671","last_updated":"2025-11-23T00:34:43Z","snapshot_observed_at":"2026-08-02T18:24:11.208164Z","submitted_at":"2023-09-28T17:59:56Z","title":"Demystifying CLIP Data","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16671","snapshot_observed_at":"2026-08-06T22:09:11.105193Z","title":"Demystifying clip data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.105193Z"},"links":{"cited_paper":"/paper/2309.16671","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:066233562aed11021f0aaf853cf7684d3a9001f3bddb7143134928ef3df8148e","observation_id":"77b23275-4cc8-449d-81f8-50d967ded625","resolution":{"observed_at":"2026-08-06T22:09:11.105193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.878826Z","title":"Biomedbert: A pre-trained biomedical language model for qa and ir","venue":null,"work_id":"896dd55e-47b6-4af6-90bb-9e147a17cd1f","year":2020},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.289412Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:8465b9f918446e93f402e2ef7d91ccbe77aa7eae07fc8daffbccb1b076ebd90a","observation_id":"dd78bb3d-3da8-46c1-928e-f44c2da9663c","resolution":{"observed_at":"2026-08-06T22:09:21.964830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T22:09:11.477309Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.477309Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:5d1a5e7beadfe7698a173c2e1fa90428be6b9c66d1ce69dd030438df9956b92a","observation_id":"c6b7ede0-a432-4f06-b90c-18f489d33a69","resolution":{"observed_at":"2026-08-06T22:09:11.477309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:11.596534Z","title":"Attention-based deep multiple instance learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.596534Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1709e3fda541d4dd41c183e64d896f0064c3616da17d5d43f8f69ef01efb4ca3","observation_id":"f1c1a5d8-fd3f-437f-ba9e-0b4a21a28512","resolution":{"observed_at":"2026-08-06T22:09:11.596534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.697568Z","title":"A vision–language foundation model for precision oncology","venue":null,"work_id":"ac8b92fb-0efa-4cef-ad8c-76e99979180d","year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.754424Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:11b9df212ef09483e9a646b703eff97cca5299f82000d4c1d956d86c7f3c8657","observation_id":"8cf28a8e-8772-441f-8db8-c26f8aae9520","resolution":{"observed_at":"2026-08-06T22:09:21.790827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.533588Z","title":"Tcga-reports: A machine-readable pathology report resource for benchmarking text-based ai models","venue":null,"work_id":"d39c9032-2b59-4e41-a775-0286b34c9dd6","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.905762Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:c0a89e9f4b9b81895a7f093e65e61b97ade060d1cd75f10cfc1a98d02c35187f","observation_id":"ee86520d-184e-414c-803f-5686a5b24001","resolution":{"observed_at":"2026-08-06T22:09:21.614850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.377545Z","title":"Covid-net: A tailored deep convolutional neural network design for detection of covid-19 cases from chest x-ray images","venue":null,"work_id":"3feb438a-97b6-4789-8f7b-559cdd0f89b5","year":2020},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.027302Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:6f5b777a68f755c2410a4c10b4e8f013dcce7d9106a56db6012597c091756b2e","observation_id":"b651ca39-8611-4671-b306-782aae1a5d52","resolution":{"observed_at":"2026-08-06T22:09:21.452514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.211024Z","title":"Philip Kegelmeyer","venue":null,"work_id":"1fc8bda0-3396-4f44-85f6-06d18d1401f7","year":2001},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.136294Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:00f398ac4f496602240d8c96c91f8d466be3bef43f81748779d03d2c6347951b","observation_id":"8837456a-fe4e-4127-bb77-feeeeb8d22b4","resolution":{"observed_at":"2026-08-06T22:09:21.296841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:12.200307Z","title":"Two public chest x-ray datasets for computer-aided screening of pulmonary diseases","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.200307Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:b8f5cc2519e02b245a83a6860d5d4190b83c1f3aa1010ab17a3ccbe4ebee6852","observation_id":"02386925-3aa5-4f25-bd87-b652fd40813e","resolution":{"observed_at":"2026-08-06T22:09:12.200307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.014161Z","title":"Siim-acr pneumothorax segmentation","venue":null,"work_id":"4841510e-1322-48f1-a6d7-019ca34174b7","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.318478Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:a60cb07c74c01165f45d9479f5bac827a827f7a57a65dc8127a7717d744277dd","observation_id":"aa30a820-7b26-4770-b9ef-90e8fd7baa49","resolution":{"observed_at":"2026-08-06T22:09:21.082885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.816830Z","title":"Augmenting the national institutes of health chest radiograph dataset with expert annotations of possible pneumonia","venue":null,"work_id":"0b9b7e3c-a050-424f-9427-2d3b2424ac56","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.434537Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:53d9f5e20fb1bc08dee03f89e91be31c3f626145b8e5e6c4f4505e0e5ee1cc3c","observation_id":"c0a280d7-d35e-4bdb-9c8f-538d9310df59","resolution":{"observed_at":"2026-08-06T22:09:20.923983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.634035Z","title":"Brain Tumor Multimodal Image (CT & MRI)","venue":null,"work_id":"d5a7fc60-dfee-44ea-a57e-03c0037d268d","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.538811Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1039b148811d1603e17ef36918a05ca78a769a92537678b935225ca0a66b8755","observation_id":"42c27fdf-9b20-413f-b607-899e86b31a1b","resolution":{"observed_at":"2026-08-06T22:09:20.723024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2404.16000","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:16.104435Z","title":"A comprehensive and easy-to-use multi-domain multi-task medical imaging meta-dataset (medimeta)","venue":null,"work_id":"5cf080fd-b41d-408d-aade-211b7b0cdb78","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.676445Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:12fc9469e832f0af81b1d1f48b308e7b05253384526fd8adca55c216789d7644","observation_id":"6b1aab37-2bd3-480c-a932-cf8c8d58d882","resolution":{"observed_at":"2026-08-06T22:09:16.178185Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.510644Z","title":"Covid-net ct-2: Enhanced deep neural networks for detection of covid-19 from chest ct images through bigger, more diverse learning","venue":null,"work_id":"f55ea8a9-a1bb-4aa8-9278-3e2f00e27111","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.771523Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1fb59f182cdeeca50c6d95e2e148507d873ebc217ec6761d4eb99d705dcbaec5","observation_id":"f333df6c-05b5-4940-ac79-5f8651913ba4","resolution":{"observed_at":"2026-08-06T22:09:20.567384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:12.918917Z","title":"Medmnist v2-a large-scale lightweight benchmark for 2d and 3d biomedical image classification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.918917Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:b5e19ec01baba67acfeece85909df8943867f9fc73ac4521dcaec14921477b39","observation_id":"db636dfa-4579-407c-966b-0135d5977f7e","resolution":{"observed_at":"2026-08-06T22:09:12.918917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.368574Z","title":"Brain tumor mri dataset, 2021","venue":null,"work_id":"48cb761e-0d55-44e4-a34b-0bd8f2ad9ad9","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.058741Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:3456c44e5755df5e8993d4526a1c5d57487924b9d1e6350d53c3d2d963160c88","observation_id":"28ccdc36-53ca-45ff-b104-e78844f16c9c","resolution":{"observed_at":"2026-08-06T22:09:20.439724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.197910Z","title":"Deep-learning-assisted diagnosis for knee magnetic resonance imaging: development and retrospective validation of mrnet","venue":null,"work_id":"d73d8cc5-5d5b-4235-9375-e64c117758a1","year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.169713Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:96ba9b2d17f9259b9977c237957234aabab96bd9a419c5af5b02df2bd58ab886","observation_id":"7d62a276-cf29-4906-a593-de73f042ff96","resolution":{"observed_at":"2026-08-06T22:09:20.273737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.016139Z","title":"Role of inter-and extra-lesion tissue, transfer learning, and fine-tuning in the robust classification of breast lesions","venue":null,"work_id":"60430779-2c23-4e1c-8563-c08341250425","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.275608Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:c9a3fc17130e6be92f87e85d390abd39957bdcaf5199d4948ca700c1e6893c5d","observation_id":"e27df61b-a9eb-42e2-a5b8-a661b5a6da12","resolution":{"observed_at":"2026-08-06T22:09:20.106799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:13.350526Z","title":"Dataset of breast ultrasound images","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.350526Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:8dab79f3621ca7f4ff0e5f0e12d2649fa4128a2c6b8c4058cbd6f1074245efa5","observation_id":"ed6b850e-401a-48b6-81bd-6a727ce0a25b","resolution":{"observed_at":"2026-08-06T22:09:13.350526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.842686Z","title":"Diabetic retinopathy detection","venue":null,"work_id":"4694bf2e-9598-4df2-9415-d500f2c9a29d","year":2015},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.450785Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:21432c104d28836fee91058ca1d1daf117b198c7adf3d88231de8a6779bd6fdb","observation_id":"c84ab718-ef60-4d93-abf1-be009433f12d","resolution":{"observed_at":"2026-08-06T22:09:19.923891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.604879Z","title":"Automatic detection of 39 fundus diseases and conditions in retinal photographs using deep neural networks","venue":null,"work_id":"85df50ee-94b8-42ba-b752-87011231135e","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.592486Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:c103e4e3ca2148e269cd87e15d09e8a56d2ea3411dc739303abfca528cf6233a","observation_id":"7d0803e5-9687-4782-8563-9e3b1d51a1ea","resolution":{"observed_at":"2026-08-06T22:09:19.714171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.392644Z","title":"Fives: A fundus image dataset for artificial intelligence based vessel segmentation","venue":null,"work_id":"6b84f6c8-ec69-460f-85d5-10ba566018a4","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.699525Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:62bf79368397ab3e67e62cfb9674cd3a90e616eebb5feea3bc4fe735b666565a","observation_id":"d4a918d0-b4f0-43d7-a307-f5464308caa9","resolution":{"observed_at":"2026-08-06T22:09:19.502437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.34740/kaggle/ds","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:15.852949Z","title":"Retinal oct image classification - c8 [data set]","venue":null,"work_id":"55722b41-058a-42b9-99c6-51d7262dfd76","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.774826Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:e4a19eb71eb923f898091906e89e67fa3b4aae4d46592720c7ca0a038a261f9f","observation_id":"43b95e6c-1b23-493d-8b1d-9d39ddab78ac","resolution":{"observed_at":"2026-08-06T22:09:15.930294Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.215934Z","title":"Bach: Grand challenge on breast cancer histology images","venue":null,"work_id":"f3aeb944-0d81-46bb-8fba-2b4bec1a7491","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.873657Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:bb2aa98ebd479c00e80c3ef1098f843a0687d64929423c8704446a3bbb06d5cd","observation_id":"b9fa17bf-d65e-4589-b522-91aaf1ce44dc","resolution":{"observed_at":"2026-08-06T22:09:19.296259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.12142","last_updated":"2019-12-16T16:28:00Z","snapshot_observed_at":"2026-08-06T07:25:43.205348Z","submitted_at":"2019-12-16T16:28:00Z","title":"Lung and Colon Cancer Histopathological Image Dataset (LC25000)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.12142","snapshot_observed_at":"2026-08-06T22:09:13.976650Z","title":"Lung and colon cancer histopathological image dataset (lc25000)","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.976650Z"},"links":{"cited_paper":"/paper/1912.12142","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:a861eeafe50a7048034fb9012c25ece1047fe3544ace8c52f389fc2282ace04f","observation_id":"742742e3-5d6f-4aca-b3cb-1e3791f4fcff","resolution":{"observed_at":"2026-08-06T22:09:13.976650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.053642Z","title":"100,000 histological images of human colorectal cancer and healthy tissue","venue":null,"work_id":"e2b16a09-dc83-4c03-ba17-5feb3c0f5ed7","year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.050668Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:ba586b58c03e461c2ee7ea8510841ec2713ed00bd443844276225832868bc995","observation_id":"f16b75cb-d657-42c5-88d4-61497ba19e22","resolution":{"observed_at":"2026-08-06T22:09:19.131819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:18.850378Z","title":"Viable and necrotic tumor assessment from whole slide images of osteosarcoma using machine-learning and deep-learning models","venue":null,"work_id":"0f71eeae-a147-4420-bd44-3d8147455524","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.180280Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:f998d81f7e51892a6d5ed27374cb00a4d4beec622de9357d0a4c5f54d7cc3027","observation_id":"b8c13085-7bfc-4541-9d6c-99e7edbf6ce6","resolution":{"observed_at":"2026-08-06T22:09:18.956386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:18.671963Z","title":"Large-scale pretraining on pathological images for fine-tuning of small pathological benchmarks","venue":null,"work_id":"7a99fa44-ccfe-4f14-81d1-a6dd6c42d4b9","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.333621Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:9383426b983d10b4f11e8dd53c4867a44391b50cdeb1a06ce20cf6f8890ad332","observation_id":"ad4742ad-5884-4179-8694-304c34a110c1","resolution":{"observed_at":"2026-08-06T22:09:18.749417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:18.468409Z","title":"Multi-class texture analysis in colorectal cancer histology","venue":null,"work_id":"ca9d4078-977a-454a-bed8-ecc9c44526c1","year":2016},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.467421Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:5dca65facb86ccf16be2671fe607b7aa0ab0e4e88179a1fd20185d69018c038d","observation_id":"06741a13-d982-466e-b7b7-a89ab22eda96","resolution":{"observed_at":"2026-08-06T22:09:18.542159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:18.137513Z","title":"Predicting survival from colorectal cancer histology slides using deep learning: A retrospective multicenter study","venue":null,"work_id":"5e25353d-de44-407f-95a3-1d587018d512","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.593410Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:87b2abc4b80da7c0e0416e6765de475fb7c84dc808d409e04d4f7088b0662886","observation_id":"5b87e978-db3b-4cba-a33e-ccc502280678","resolution":{"observed_at":"2026-08-06T22:09:18.258083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:17.905534Z","title":"Deep learning for the detection of anatomical tissue structures and neoplasms of the skin on scanned histopathological tissue sections","venue":null,"work_id":"04bfee4a-3f76-4e4c-8acb-340121df0860","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.717861Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:4303da55ed78239fc7cba9e738ee3861eee877636aa298e5affbce928d197e7c","observation_id":"172c08c5-e908-43ef-b367-a56b614a7271","resolution":{"observed_at":"2026-08-06T22:09:18.006071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:17.617366Z","title":"Interpretable classification of alzheimer’s disease pathologies with a convolutional neural network pipeline","venue":null,"work_id":"fe2e208f-d1e3-46a4-a275-3b5af1ce101b","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.844361Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:0bacaba30a0909925126ff7c9aaf005e7f92471359bc3f38560338aac8aa6dfc","observation_id":"d2bdfe87-dd28-4bc8-ae8e-6844d35ef26a","resolution":{"observed_at":"2026-08-06T22:09:17.805711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:17.400907Z","title":"Deep learning from multiple experts improves identification of amyloid neuropathologies","venue":null,"work_id":"85730b77-fab4-473d-bb94-70f6b6c326ac","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.963499Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:fd1e7d9b8c6a8adb575144a11723f7589719974a22f925848db56e5ff8786f87","observation_id":"d93fc9a5-b44a-4e3d-9dbd-589944d017a7","resolution":{"observed_at":"2026-08-06T22:09:17.527224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:17.159053Z","title":"Kvasir: A multi-class image dataset for computer aided gastrointestinal disease detection","venue":null,"work_id":"589724b6-b267-4e5d-88bb-6e63e552b6a2","year":2017},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.131124Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:4e2d31f47be1b9986936c6549f5ac3b0f11dde3ecc4a6a69386bf3b5d3aeab5b","observation_id":"e0dee7a3-f05a-4ae9-9ea9-5dc87caf7a55","resolution":{"observed_at":"2026-08-06T22:09:17.273052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:16.880138Z","title":"Montalbo","venue":null,"work_id":"d13a45ad-b63c-44f2-845c-53692834be06","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.226882Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:444879b2a47f9009de0b56a299b4b5ee48b83ae09d35fb7b53f6cec29a69bc25","observation_id":"bacdd138-296e-421a-9888-657aa1946bc9","resolution":{"observed_at":"2026-08-06T22:09:17.013849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:15.369691Z","title":"The ham10000 dataset, a large collection of multi-source dermatoscopic images of common pigmented skin lesions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.369691Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:a2e64ed74657c6bbfc2d1af9f21f5fe5a0dbf0c84cd057ac55e12b06e702067e","observation_id":"7d4321d6-722b-4c8c-933d-b9f1d0a72b40","resolution":{"observed_at":"2026-08-06T22:09:15.369691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:16.697623Z","title":"Pad-ufes-20: A skin lesion dataset composed of patient data and clinical images collected from smartphones","venue":null,"work_id":"d3334de3-f8e2-4429-8ad6-7ff914ba900d","year":2020},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.484016Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:51b81adcde7063377a751337c7f3da66cae6bda0fbd4d91f0f322846867b7c8d","observation_id":"88a57ed3-838c-4a2a-b67d-abc046207477","resolution":{"observed_at":"2026-08-06T22:09:16.789470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T22:09:15.626675Z","title":"Benign\": 0,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.626675Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:892ce2ec834730b77b7cde15a61b6fd59a0844bfe50ed5bb323783bb20910950","observation_id":"4577c7e9-fe2c-46b2-8df2-ad9f69fd8699","resolution":{"observed_at":"2026-08-06T22:09:15.626675Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:56:49.985206Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":49},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 1 inbound Pith citation observation for arXiv:2506.22567."}