{"as_of":"2026-08-17T22:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:160d93c6e55915e452fbd76ea7a398577802ba78af9e090c070fb2af9f29d086","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T05:19:49.195013Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.08391/citation-record","integrity":"/paper/2502.08391/integrity","json":"/paper/2502.08391/citation-record.json","paper":"/paper/2502.08391"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.727474Z","title":"Lan- guage models are few-shot learners","venue":null,"work_id":"c35c8b1d-e010-4071-9333-874fad86b893","year":1901},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.025262Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:876c6d0ff80f9cb55b2a229e17aa5ffbad06c887ea365833195b27ee390cd937","observation_id":"622f2e52-c13c-42bb-935c-5d8a6d963527","resolution":{"observed_at":"2026-08-08T05:19:49.730748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.717866Z","title":"Histopathology whole slide image anal- ysis with heterogeneous graph representation learning","venue":null,"work_id":"ffcea5b1-9a24-4123-88cf-7ce2a35587a6","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.029466Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:1cdce68d9710028be64a0b44c183aafff9523b6c47cb22245a71a0ce32cfc493","observation_id":"5b711ba5-c45f-4d7e-bb42-41d865307e16","resolution":{"observed_at":"2026-08-08T05:19:49.721239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-08T05:19:49.033305Z","title":"PaLM: Scaling language modeling with Pathways","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.033305Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:5203cdd3143d7c044120eb12ab2f9902342d214a26218ffd1202230eaec4f77b","observation_id":"c9be97a5-0fb8-4529-a27e-dbbfa1614d6e","resolution":{"observed_at":"2026-08-08T05:19:49.033305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.707831Z","title":"Artificial intelligence and computational pathology","venue":null,"work_id":"dae1dd4c-7e6c-4ecd-a7dd-150f416fedb1","year":2021},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.037237Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:b7a49e8d3fd43df92e72bf23ceb83be7a1810c579af4d9fcaa8a58a9e6fff7f2","observation_id":"2cc86708-d9cb-469f-9ce7-847826d0e6b9","resolution":{"observed_at":"2026-08-08T05:19:49.711216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.02428","last_updated":"2019-04-25T10:06:09Z","snapshot_observed_at":"2026-08-02T18:54:43.326912Z","submitted_at":"2019-03-06T14:50:02Z","title":"Fast Graph Representation Learning with PyTorch Geometric","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.02428","snapshot_observed_at":"2026-08-08T05:19:49.041021Z","title":"Fast graph represen- tation learning with PyTorch Geometric","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.041021Z"},"links":{"cited_paper":"/paper/1903.02428","citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:8fda435ff941adc9243b29863eb409abbf1a1ac05f03a1d1efc94f878f135e42","observation_id":"f8295524-e12c-4c81-8555-7b76ae9dade2","resolution":{"observed_at":"2026-08-08T05:19:49.041021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.698281Z","title":"Multiple instance cap- tioning: Learning representations from histopathology text- books and articles","venue":null,"work_id":"5235d7d8-ee1b-4014-8165-28acfd8e8fba","year":2021},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.045118Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:afa864f4c818b1069ee234d63c546b6a001fb0f990a6b73a2d1f6d77aa33afeb","observation_id":"169748e9-af1e-4b5d-b2c7-732302694214","resolution":{"observed_at":"2026-08-08T05:19:49.701702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.688196Z","title":"CLIP-Adapter: Better vision-language models with feature adapters","venue":null,"work_id":"29856ed5-0ba8-4587-a40d-f52300c07466","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.048845Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:0c34d8579a99f231996d67d49c87b1249010d77a6a4f38c1aad4eadfa3176fc7","observation_id":"9e76745c-7b80-4870-aef0-59bfcd51cbb1","resolution":{"observed_at":"2026-08-08T05:19:49.691778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.678792Z","title":"Texts as images in prompt tun- ing for multi-label image recognition","venue":null,"work_id":"f68ca929-65a8-4cfb-9a68-e0ef2352445b","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.052083Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:9e504e01baf77b499c6f0e2a9695fec942e8047dbc50df50e3532a763c10705d","observation_id":"006f188b-0f33-4851-a959-97c6f8f1f73f","resolution":{"observed_at":"2026-08-08T05:19:49.682287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.669042Z","title":"E 2VPT: An ef- fective and efficient approach for visual prompt tuning","venue":null,"work_id":"7dbd3ee7-35d4-4428-a7d4-639c34e3d035","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.055363Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:00d90f3678130e9141ef5854b074a0ae25fb9e3520b5d981241041291387c443","observation_id":"c086aaf9-b4f0-47eb-8e96-ed6f71017c14","resolution":{"observed_at":"2026-08-08T05:19:49.672601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.658740Z","title":"H2-MIL: Ex- ploring hierarchical representation with heterogeneous mul- tiple instance learning for whole slide image analysis","venue":null,"work_id":"a8670076-8aba-4d80-b9b2-1c3025ec8687","year":2022},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.058549Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:bf47e1a6f264d075c22821c5fc4729339aeca13ac44d3a3228735d9ce04b49fa","observation_id":"3dc43fbb-d150-4ea2-ad02-0eb8e2b524ae","resolution":{"observed_at":"2026-08-08T05:19:49.662306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.648655Z","title":"ConSlide: Asynchronous hierarchical interaction Transformer with breakup-reorganize rehearsal for continual whole slide image analysis","venue":null,"work_id":"800fc316-15f7-490c-9a74-25d88f89a8ae","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.061603Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:6bf4135ade19889407fa14d662d20deed14b46e3515797b03e7ab98d237314fe","observation_id":"c6e3552f-27c8-4728-8ed6-e803954d4040","resolution":{"observed_at":"2026-08-08T05:19:49.652351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.638953Z","title":"A visual-language foundation model for pathology image analysis using medical Twitter","venue":null,"work_id":"823ea1ba-90db-4602-9f49-37e96953d5df","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.064693Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:2d9fc4098cafcbb4e73a197fbce8a8f64438b846e57eaac58d729e3d369a4f5f","observation_id":"cdb2370c-5ed7-42e8-bf1e-2252e20bea1d","resolution":{"observed_at":"2026-08-08T05:19:49.642361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.628616Z","title":"Quilt-1M: One million image-text pairs for histopathology","venue":null,"work_id":"1662f079-576b-445b-8cda-d4777817d216","year":2024},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.068172Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:e76719d7b29cf227b91acffe5927afd21ac57b3255e6e7c1b183437f60844991","observation_id":"53773a4d-4d7c-42e9-9b84-7052af8f437d","resolution":{"observed_at":"2026-08-08T05:19:49.632370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.618567Z","title":"Attention-based deep multiple instance learning","venue":null,"work_id":"5ddf90f8-25ce-4449-b3e2-859f4edad111","year":2018},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.071514Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:bef7c3886ae0e45cb47f9a9c861117cf70b2d9f51158342b5a46b9a4f376304c","observation_id":"12eea2da-7185-4a6b-bfc4-2ef636ea6e79","resolution":{"observed_at":"2026-08-08T05:19:49.622027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.607444Z","title":"MaPle: Multi-modal prompt learning","venue":null,"work_id":"daae8c53-e767-4ebf-bc74-312d0685576d","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.074667Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:6d98fb2ae1380849a8ca99a688ce39d4570afc31ae0313c13d098b65086634ff","observation_id":"87cd8a8f-d32d-4cda-96dd-73eac4506da0","resolution":{"observed_at":"2026-08-08T05:19:49.611359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.596705Z","title":"Dual-stream multiple instance learning network for whole slide image classifica- tion with self-supervised contrastive learning","venue":null,"work_id":"87914519-3324-4fce-9e4d-2effee0ab3e6","year":2021},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.078011Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:edead171d4a3b45f4b4c429619774bd6d632bb23cd6328276f04ca88fccfc56a","observation_id":"c2429bba-be7d-49d5-82c5-53f22f0265d3","resolution":{"observed_at":"2026-08-08T05:19:49.600646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.586099Z","title":"Task-specific fine-tuning via variational information bottle- neck for weakly-supervised pathology whole slide image classification","venue":null,"work_id":"96695e13-99e6-47c7-9ffa-61f00e1b448c","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.081165Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:cee7c8cd2d32a4c7d566300cd12704a5931d3a2b3a2e4eaf07d0d6709d1c66cd","observation_id":"83eb3851-5f78-43df-a352-2fccf1afce09","resolution":{"observed_at":"2026-08-08T05:19:49.589932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.575580Z","title":"BLIP: Bootstrapping language-image pre-training for uni- fied vision-language understanding and generation","venue":null,"work_id":"3cc4cf77-f041-427a-8048-551c182adb07","year":2022},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.084444Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:8fc0666f4542ab5fc483bab15627876f8b1eb20aed12f160e2d606e54f3650c5","observation_id":"4fdafb73-b396-4269-9f63-468e89fdf24b","resolution":{"observed_at":"2026-08-08T05:19:49.579025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.566001Z","title":"Weakly supervised histopathology image segmentation with self-attention","venue":null,"work_id":"b3418bf0-f054-4721-8117-78edca6b8dc1","year":null},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.087577Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:f24f65d943e90a07cc6654508cec9f850c4c54e1c548f175dae38b28748181bf","observation_id":"90b58d0f-a826-41c6-819d-288cfaa5ef2c","resolution":{"observed_at":"2026-08-08T05:19:49.569314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.090961Z","title":"Scaling language-image pre-training via masking","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.090961Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:5d246634e6171650ebb22a882b83ebba18129e94a87d7d85ae0543e777d59335","observation_id":"0bc3342f-bbe0-42aa-9742-a37732e510f7","resolution":{"observed_at":"2026-08-08T05:19:49.090961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.550001Z","title":"Interventional bag multi-instance learning on whole-slide pathological images","venue":null,"work_id":"94aea7c9-5b74-42be-aba8-f742746c6dc1","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.094412Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:e85164ff5c748ed4d9708c134a004ab8ff6116415ff6505ba9a93c9686a4d732","observation_id":"677ddb2e-c328-4145-8cfe-fa7213f25e9a","resolution":{"observed_at":"2026-08-08T05:19:49.553523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.539157Z","title":"CLIP is also an efficient segmenter: A text-driven approach for weakly supervised semantic segmentation","venue":null,"work_id":"1bb0e103-2f74-49e8-89a1-b5f1aa016917","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.097659Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:05469c927d0e605dfbda2cf6af6912099303e4c095ead45944bc36cb702f91ae","observation_id":"21ef308f-8c42-4c0f-b347-b59a9d76e0a5","resolution":{"observed_at":"2026-08-08T05:19:49.542935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12914","last_updated":"2023-07-25T17:56:38Z","snapshot_observed_at":"2026-08-16T15:13:43.223196Z","submitted_at":"2023-07-24T16:13:43Z","title":"Towards a Visual-Language Foundation Model for Computational Pathology","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12914","snapshot_observed_at":"2026-08-08T05:19:49.100863Z","title":"Towards a visual-language foundation model for computational pathol- ogy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.100863Z"},"links":{"cited_paper":"/paper/2307.12914","citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:e5bafc9dec9f815b2e65ba4a785e576b3124a516cbdd727c7dc52c36de71a2ce","observation_id":"684553e3-5e2b-4f58-955a-7ba50f292f63","resolution":{"observed_at":"2026-08-08T05:19:49.100863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.528734Z","title":"Visual language pre- trained multiple instance zero-shot transfer for histopathol- ogy images","venue":null,"work_id":"25d50cad-6f10-4c60-ad75-da07b65fb715","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.104578Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:a25c0d59d25538178353ecfd23b212166993dcc2950deda98158579ecd483310","observation_id":"ca31f63a-aebc-4705-a253-52d185413c06","resolution":{"observed_at":"2026-08-08T05:19:49.532793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.518541Z","title":"Data-efficient and weakly supervised computational pathology on whole- slide images","venue":null,"work_id":"d17ea056-d4b6-42a5-8887-4423d418d9ae","year":2021},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.107632Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:d3809ca641522b5f9e3e8870797e7c2e8dd51fe7f94f4fd2e7c4bcd5bf98febb","observation_id":"05ee08d3-b487-4768-8a7f-7aae5d79c0bb","resolution":{"observed_at":"2026-08-08T05:19:49.522063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.508626Z","title":"A framework for multiple-instance learning","venue":null,"work_id":"6403b984-34d1-40dc-83a8-c2815701ce85","year":1997},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.110816Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:11f100f1042d431c9664373461f0afb65306e7252f64e9f8d3031af20acb6594","observation_id":"ea6c5a3e-6d2d-4247-ba8e-7ce7e03854ee","resolution":{"observed_at":"2026-08-08T05:19:49.512192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.497912Z","title":"Sparse multi-modal graph Transformer with shared-context processing for representation learning of giga-pixel images","venue":null,"work_id":"992cb3fe-d9d1-4df7-bae1-4730acae44fc","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.114045Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:d8b23ba80d39dc1749db2081ee530b2724c8e920f03390ce9c5b4a91ffe61edf","observation_id":"c5cde27b-844e-4ff3-947a-f131cb32d9c6","resolution":{"observed_at":"2026-08-08T05:19:49.501571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.487363Z","title":"Digital pathology and artificial intelli- gence","venue":null,"work_id":"b8594244-67e4-490c-b946-d8a6ce77974c","year":2019},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.117323Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:bfd913cd7032a134be8f605a6ee177c8c6e6ac1b8b582e9a9bde8be742c8c4db","observation_id":"013fd2d3-d570-4157-894b-36b01b135fdd","resolution":{"observed_at":"2026-08-08T05:19:49.491037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T05:19:49.120761Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.120761Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:b9a9bcf4f5f8df7d119597af82959bc8e9602abc6d59c646a4639f3f555f5f0b","observation_id":"eff6e020-9e41-47c4-8270-4ee94ed62c07","resolution":{"observed_at":"2026-08-08T05:19:49.120761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.477111Z","title":"The rise of ai language pathologists: Exploring two-level prompt learning for few-shot weakly-supervised whole slide image classification","venue":null,"work_id":"01737d8c-8dd4-412a-932d-36069d0115fa","year":2024},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.124331Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:e7174ecc2226eeaa6f11e5adcbbf823c1c5e431bdf787874dfd8de2496766678","observation_id":"7c489878-6cdf-4e7d-9b40-01c2532b030d","resolution":{"observed_at":"2026-08-08T05:19:49.480751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.465997Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"23da8a8f-e09f-4ca6-91b7-f923b9e5272c","year":2021},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.127557Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:ab137e04ffe59cd6e057032b7760d709bbc87b8e03e320044d23afc072967973","observation_id":"c9e6320f-2d93-4322-9fc8-0b2426430d92","resolution":{"observed_at":"2026-08-08T05:19:49.469927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.455480Z","title":"DenseCLIP: Language-guided dense prediction with context-aware prompting","venue":null,"work_id":"69022900-32e8-4621-8530-48786d01fcf3","year":2022},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.130915Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:24c5107667e98daf57fe0e8bf64b77759b43fad5eb5f4c4e777f10ab54bccc37","observation_id":"7f51e0a6-b806-409d-917d-1b9642a55c79","resolution":{"observed_at":"2026-08-08T05:19:49.459162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.444611Z","title":"OCELOT: Overlapped cell on tissue dataset for histopathol- ogy","venue":null,"work_id":"89ee04c5-0778-4b61-ad90-aea10ab8a664","year":null},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.134166Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:e20ec71d8c2afad4faa5413dfdf9c7b1fc8d6f0bcc8caea8042d2eaba5d87c94","observation_id":"3bee25a2-5940-4886-8c5c-827c0a840bfa","resolution":{"observed_at":"2026-08-08T05:19:49.448493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.434088Z","title":"TransMIL: Transformer based correlated multiple instance learning for whole slide image classification","venue":null,"work_id":"a8aec6d6-1303-4f0b-b8dd-f6387cba05da","year":2021},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.137667Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:da3bd37f6812e1feb835c7576c20d7ee0cb984e7668f2219eb656c35ac1311b0","observation_id":"83cfb55a-c870-40b7-b3e3-69642739fb08","resolution":{"observed_at":"2026-08-08T05:19:49.437724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.423348Z","title":"MG-Trans: Multi-scale graph transformer with information bottleneck for whole slide image classification","venue":null,"work_id":"900a387c-940a-4bea-9d39-83704808bdd3","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.140872Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:9b8a14c4b92689072b5613b9d301dc50e38670881446926d8ab4d8ee647c8a8e","observation_id":"f4aa2e9a-eec9-4b7f-bb03-5b61e81f1077","resolution":{"observed_at":"2026-08-08T05:19:49.426947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.412696Z","title":"A structure-aware hierarchical graph-based multiple instance learning framework for pT staging in histopathological im- age","venue":null,"work_id":"fc2cee68-f96f-41ce-b568-85d54b85a636","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.144200Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:3cf5a070349def0dccf4a82ca09b5e31856ead70f4ac1f6d036c73d05c59e789","observation_id":"5b6c1f25-6e7a-4422-848e-df0b4d0130e4","resolution":{"observed_at":"2026-08-08T05:19:49.416356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.402765Z","title":"Artificial intelligence for digital and computa- tional pathology","venue":null,"work_id":"1e5dd290-e7c6-468f-a11c-1e9c6218876d","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.147504Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:34be6cc1db1ec5e7858ea0abf0ed1b2f293bdeb4f61f0009b4003160c4286e31","observation_id":"55af2845-25ff-4f46-8f3d-f7664b45884f","resolution":{"observed_at":"2026-08-08T05:19:49.406287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.150681Z","title":"Multiple instance learning framework with masked hard instance mining for whole slide image classification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.150681Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:4907f68165f7bc53645f339942da627ad2d6f6ce054878e44f39c4d36fa99621","observation_id":"afa72699-5caf-43cf-a9d1-faa48ead800c","resolution":{"observed_at":"2026-08-08T05:19:49.150681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-08T05:19:49.154089Z","title":"LLaMA: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.154089Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:07b9d2635d18a523a30d83c85347352e5f085f8b74fbd512083c535fc27f5241","observation_id":"2fdb74fe-ec58-4e08-8fa6-18686485bebe","resolution":{"observed_at":"2026-08-08T05:19:49.154089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.386164Z","title":"Visualizing data using t-SNE","venue":null,"work_id":"66fc6632-422f-49e3-aefc-2bf6d166b4ed","year":2008},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.157539Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:7698a9451cf8a29776fdc9b71903d3c66344e47ed5832bdcc9673495cee08e97","observation_id":"9b2cd60b-5b09-4d99-86c7-c131b295d77f","resolution":{"observed_at":"2026-08-08T05:19:49.389568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.375649Z","title":"CORA: Adapting CLIP for open-vocabulary detection with region prompting and anchor pre-matching","venue":null,"work_id":"68fc727a-f0eb-4050-815a-93d12d7d533e","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.160813Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:2f7a06f6583c7c6f6d11e6c6733e9cc9bfcc2b505830b236e37e8289357649d5","observation_id":"9e211769-f294-4b0e-a380-4762913485ff","resolution":{"observed_at":"2026-08-08T05:19:49.379362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.364428Z","title":"CAMEL: A weakly supervised learning framework for histopathology image segmentation","venue":null,"work_id":"481f1db8-bd12-441b-a292-9ae9541f32f4","year":2019},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.164068Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:6420b19c57bf8a97d488c80c8eae05d0cafeb8bf73dd2e4efec238847e889ad1","observation_id":"b616d0a5-0c59-49c7-82f3-e35bb3553a80","resolution":{"observed_at":"2026-08-08T05:19:49.368595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.353411Z","title":"Task residual for tuning vision-language models","venue":null,"work_id":"c2ab07bf-b41d-43b1-bca1-88a6e8ee1aab","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.167156Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:be91c0a3561cfa513249f11f1e2b63400680da5243582f070e7201dc93c88705","observation_id":"039d03ce-cdc5-4653-b49d-e3d9e4afafcb","resolution":{"observed_at":"2026-08-08T05:19:49.356948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.342900Z","title":"DTFD- MIL: Double-tier feature distillation multiple instance learn- ing for histopathology whole slide image classification","venue":null,"work_id":"8bb95744-e7c3-4c33-9726-3770bddfbca7","year":2022},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.170373Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:5a2b0291e364c44e66ff63bacd31d489a108bff7fa1274281da6973b7ecdcbd0","observation_id":"6d133488-02b4-4385-a129-eb1f7c8a42cb","resolution":{"observed_at":"2026-08-08T05:19:49.346591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00915","last_updated":"2025-01-08T22:58:51Z","snapshot_observed_at":"2026-07-06T14:57:39.647497Z","submitted_at":"2023-03-02T02:20:04Z","title":"BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00915","snapshot_observed_at":"2026-08-08T05:19:49.173991Z","title":"Large-scale domain-specific pre- training for biomedical vision-language processing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.173991Z"},"links":{"cited_paper":"/paper/2303.00915","citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:12c5d05e252314085102fd9499bb7a6e7364c57c9ced65b14bf1e47acc97ae30","observation_id":"7570aa47-0b78-45c1-93e0-62fe626d6cf4","resolution":{"observed_at":"2026-08-08T05:19:49.173991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.331434Z","title":"Text-guided foun- dation model adaptation for pathological image classifica- tion","venue":null,"work_id":"61e17f03-b038-4b4e-910e-93ce39c01b44","year":2023},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.177834Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:b2f2d3ce6f139b500b47150ca3ec333a89ca3db553bab3028a388de77383416e","observation_id":"70009f71-f00d-4638-b70f-d53da85f0a2a","resolution":{"observed_at":"2026-08-08T05:19:49.335261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.320582Z","title":"Gindra, Emily J","venue":null,"work_id":"8b074270-784e-4165-997f-d7ac349b76cc","year":2022},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.180920Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:e2a45dec409e1736f6b2ce840b4adebfbb641e68a772cc926fb79978c265d58c","observation_id":"8ce5761d-16c7-4b82-9bf1-6fbd5ae7fc78","resolution":{"observed_at":"2026-08-08T05:19:49.324183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.308617Z","title":"RegionCLIP: Region- based language-image pretraining","venue":null,"work_id":"b6a43621-32b6-418f-b21d-46e92a58fb77","year":2022},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.184253Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:ad6fbf6e80731635818119f3b9f6d641683ccd5e6ecd8cebdc89d0eb513570d1","observation_id":"4d810849-a02c-4b40-bd64-b4eea6637fab","resolution":{"observed_at":"2026-08-08T05:19:49.313535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.187589Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.187589Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:09f71a541c9972319d684cba983ea2e77d3273963b6000843f60132213b853b6","observation_id":"34d70d32-afe6-4115-a6ef-0ef800e2ed0c","resolution":{"observed_at":"2026-08-08T05:19:49.187589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.278735Z","title":"class name","venue":null,"work_id":"3964b4e9-ca45-44df-b4f6-19f3fb4b4bae","year":null},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.195013Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:50c02b2311b2fce6d98566e890cf8bb4e91c6c8c2d846396e292e8f4826814e3","observation_id":"92d05311-da09-492c-ae21-ccbf705e4f6d","resolution":{"observed_at":"2026-08-08T05:19:49.283201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T05:19:49.291116Z","title":"ABMIL + Low-scale","venue":null,"work_id":"dfd0365b-7692-4c43-8106-02a48bc80788","year":null},"citing_paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T05:19:49.191087Z"},"links":{"citing_paper":"/paper/2502.08391"},"observation_digest":"sha256:5c03defa294b46d43b0559f8ea3a3b605a27333707cb7fe7859accf005f7f1af","observation_id":"bb0633db-be89-47fa-b6a6-6023e04b618f","resolution":{"observed_at":"2026-08-08T05:19:49.294568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.08391","last_updated":"2025-02-12T13:28:46Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T01:06:29.746456Z","submitted_at":"2025-02-12T13:28:46Z","title":"ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":42},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2502.08391."}