{"as_of":"2026-08-07T15:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9663efb2354c066be07631556f769dbf43fbfc5ee7c2725abb9f3db41db2d12d","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:28:13.001882Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18072/citation-record","integrity":"/paper/2506.18072/integrity","json":"/paper/2506.18072/citation-record.json","paper":"/paper/2506.18072"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.917422Z","title":null,"venue":null,"work_id":"fd1d63b8-58d1-43b0-a5fe-2160117eac55","year":2015},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.234742Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:3fe45c9bb5dc3a9dc8e358abad32c40a967783713cf104076cfbd1f70b59ff4f","observation_id":"d449e804-f463-4a32-ab1e-56acff0dd912","resolution":{"observed_at":"2026-08-06T23:28:15.944740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.03323","last_updated":"2019-06-20T20:41:58Z","snapshot_observed_at":"2026-07-06T07:44:16.974916Z","submitted_at":"2019-04-06T00:34:39Z","title":"Publicly Available Clinical BERT Embeddings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.03323","snapshot_observed_at":"2026-08-06T23:28:07.271364Z","title":"Publicly available clinical bert embeddings","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.271364Z"},"links":{"cited_paper":"/paper/1904.03323","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:3586396c5ab1f78e1a1b6bcaf1c48c89662b9a7278c4ace320e323646805c658","observation_id":"ce99b672-e3e6-48c9-9de1-1615c5244eca","resolution":{"observed_at":"2026-08-06T23:28:07.271364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.878471Z","title":"Prior: Prototype representation joint learning from medical images and reports","venue":null,"work_id":"d1feea66-27cf-4dd8-99ae-0516a620bf26","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.380815Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:bc54899ed198b6333244e4d84ec5701a81c3b88d9c634b3f885a5d3958432d01","observation_id":"f8d216da-63fc-475a-a911-197292f4938e","resolution":{"observed_at":"2026-08-06T23:28:15.885613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.834260Z","title":"Quantifying tumour heterogeneity in 18 f-fdg pet/ct imaging by texture analysis","venue":null,"work_id":"536c9fa2-ff9b-4b78-95e1-a2e0ce34fbe0","year":2013},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.516306Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:7d060255c1ee8f19bd95bfb542f2b671622cdc2970889912bfc5cdd8b47d54a8","observation_id":"46ce62b0-0ae5-43a1-8a48-43102b376823","resolution":{"observed_at":"2026-08-06T23:28:15.858524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.775800Z","title":"As- sessment of tumor heterogeneity: an emerging imaging tool for clinical practice? Insights into imaging , 3:573–589,","venue":null,"work_id":"89f166dc-7de8-4639-9e44-9363f8ac985a","year":null},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.600204Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:86f01f04a8c09f519b3d461719d8c6fcdfd4689bcb942e6953893dea44af4951","observation_id":"a2b0524c-60fc-4aa6-b9ab-9904b9e06b57","resolution":{"observed_at":"2026-08-06T23:28:15.795005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.729497Z","title":"Feedback on a publicly distributed image database: the messidor database","venue":null,"work_id":"61cbe09c-7233-4404-82c7-9b12688251af","year":2014},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.728186Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:c9287ad8506eb1945514074eea8c6c02ff219f422234ea49d9a1ff42c10185c0","observation_id":"46f73411-55ed-4a4a-a01b-d3054b10a814","resolution":{"observed_at":"2026-08-06T23:28:15.748351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.697882Z","title":"Maskclip: Masked self- distillation advances contrastive language-image pretraining","venue":null,"work_id":"143e6abb-92bd-4cec-9f6d-37ae823669de","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.834074Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:681fee6f361bbe3fafe64a27a184fed7e08d942f7b868fab691b788854ee6fbb","observation_id":"31c7f85b-c6d7-481a-b4fc-02f8e73e12fc","resolution":{"observed_at":"2026-08-06T23:28:15.712157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.643755Z","title":"Machine-learning-based multiple abnor- mality prediction with large-scale chest computed tomogra- phy volumes","venue":null,"work_id":"528e6bea-ae84-42ba-854d-11a31152f261","year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.917459Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:5e5764269afddc6d271322adc7f4160b9c1c78e61bc90840dba84dc1f2a68bed","observation_id":"efb49268-427e-44f2-ac3f-782a976f0712","resolution":{"observed_at":"2026-08-06T23:28:15.652867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.605286Z","title":"Medbind: Unifying language and multimodal medi- cal data embeddings","venue":null,"work_id":"53d7bacc-cebc-4009-bd7c-e50c91ee862f","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.004186Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:f2fc286e932e7d6c9242f16e92bd8ffe04a4a24fed53a2348e50f02d88270cec","observation_id":"2e2103d0-b7b1-4f1d-8a36-54d584eac352","resolution":{"observed_at":"2026-08-06T23:28:15.628725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.571535Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":"fec28c00-a592-45ed-b099-4ddae68aa283","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.115873Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:8582e78817aeb986011e5b4fdac2257aef2a1466b87a48a9912caaeda3542f25","observation_id":"e212226b-ed90-4234-b563-ccc31d869bdb","resolution":{"observed_at":"2026-08-06T23:28:15.579531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.474130Z","title":"Anal cancer: Esmo–esso–estro clinical practice guidelines for diagnosis, treatment and follow-up","venue":null,"work_id":"ddcb9809-9e63-44cf-b494-2393097004c7","year":2014},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.215078Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:b3af76cd0d4fbe8554be4a35f5a4a9c2467642d55c0a17dd1ba4f53653752c84","observation_id":"2ecf5005-61b1-4cf2-8cba-dd469c480040","resolution":{"observed_at":"2026-08-06T23:28:15.534741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.346675Z","title":"Mimic-iv-ecg: Diagnostic electrocardio- gram matched subset","venue":null,"work_id":"3cae83bf-d764-4d97-9475-fe9af13737e7","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.332508Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:5185d2901a46b89a8f3cc7a57348a239718c389e62d1daa2bce066fa4b54ff8f","observation_id":"030b3eb2-0171-4d37-b79d-953def436cbe","resolution":{"observed_at":"2026-08-06T23:28:15.358534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:08.462195Z","title":"A foundation model utiliz- ing chest ct volumes and radiology reports for supervised- level zero-shot detection of abnormalities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.462195Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:ea5df8326916aee587ed2b5d8adb5221cbaccf81cb3bc0045ab44c0f887425c0","observation_id":"e30142bd-d6ea-4c71-b517-3844f80cc966","resolution":{"observed_at":"2026-08-06T23:28:08.462195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-06T23:28:08.562643Z","title":"Distilling the knowledge in a neural net- work","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.562643Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:9b06cbcd7a45a2bad2f2e3cbadd565f39ea29fb33832ac3505dabbb3c566d7ce","observation_id":"ec19bcee-ca1a-4704-aced-557ef8eb2e51","resolution":{"observed_at":"2026-08-06T23:28:08.562643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T23:28:08.689704Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.689704Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:eca0fb2d012a6c62c3c0ef28feeccd61aa6004a4ed1f8a5cb9c3e33a9c24a937","observation_id":"877c46a3-3d59-425a-b2b4-1e5ad180f2a2","resolution":{"observed_at":"2026-08-06T23:28:08.689704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.303681Z","title":"Gloria: A multimodal global-local represen- tation learning framework for label-efficient medical image recognition","venue":null,"work_id":"5f1ef69b-01f3-46bc-a39d-d44e91f29d53","year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.772127Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:6ac1d7f7425c1efb870ae056f2939ec60b16c84c5964ac48f5a3880a0949ecd3","observation_id":"d518a5bd-71cb-4abb-af8f-9047b30567f1","resolution":{"observed_at":"2026-08-06T23:28:15.314755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.237694Z","title":"A visual–language foundation model for pathology image analysis using medical twitter","venue":null,"work_id":"9b0c5a53-e6d4-462d-a3a5-d2b6acfbd131","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.785967Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:0e521356846b1a0432298b7ab912f12591e79d5dfe5d36d96a993f99b7699e85","observation_id":"8d6f62a4-d112-422e-8046-e84f4c6cde0a","resolution":{"observed_at":"2026-08-06T23:28:15.262642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.209484Z","title":"Modern diagnostic imaging technique applications and risk factors in the medical field: a review","venue":null,"work_id":"9e3f5bd8-aad6-4383-b7c6-a3e3e5e846a5","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.893403Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:c9ab4b0f001c8afbd0c5b27b1aa75ef87a2cb784df23439b9bdbee7b4ad18325","observation_id":"9b423863-73c6-4bf5-95e5-210a87f9179c","resolution":{"observed_at":"2026-08-06T23:28:15.217991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.133843Z","title":"Quilt-1m: One million image-text pairs for histopathology, 2023","venue":null,"work_id":"30effde3-f015-4eea-8df0-4c623d09c95d","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.012503Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:d6ad50908354bc3b9ae85b08a886af02e7271acfc4966afce3f27b5b20883037","observation_id":"ded1b7af-33e8-4163-a2bb-da694b10b94d","resolution":{"observed_at":"2026-08-06T23:28:15.165003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:09.124390Z","title":"Chexpert: A large chest radiograph dataset with uncertainty labels and expert comparison","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.124390Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:2d8ac74719a9725af6b115291a9ad51a2255f3baaeddaa462fc3ed0125f6f53c","observation_id":"4e83ab8b-6d5c-45c8-90d9-3065a3ae8128","resolution":{"observed_at":"2026-08-06T23:28:09.124390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-03T15:20:38.939869Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T23:28:09.248145Z","title":"Tinybert: Distill- ing bert for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.248145Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:9769e968b3b2335c7ec08625aa7bce39e878b19ad3e772601617e25dd0f8f52d","observation_id":"4080a1aa-4628-45d0-86f8-72a82dbc1432","resolution":{"observed_at":"2026-08-06T23:28:09.248145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10372","last_updated":"2024-12-13T18:59:40Z","snapshot_observed_at":"2026-07-06T20:06:43.917795Z","submitted_at":"2024-12-13T18:59:40Z","title":"UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10372","snapshot_observed_at":"2026-08-06T23:28:09.350646Z","title":"Unimed- clip: Towards a unified image-text pretraining paradigm for diverse medical imaging modalities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.350646Z"},"links":{"cited_paper":"/paper/2412.10372","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:500fafe6f28dc9b310dfaa172b446634d89af3eddf687b475631eeb97fd88ebd","observation_id":"c902c611-d289-432e-9b79-8b2dafd7d782","resolution":{"observed_at":"2026-08-06T23:28:09.350646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.046771Z","title":"Deep learning for the detection of anatomical tissue structures and neoplasms of the skin on scanned histopathological tissue sections","venue":null,"work_id":"cebbb447-8f79-43e2-a668-2deb3a91aa5e","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.449043Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:5048fe925dcc6d1c4c1944d538075333171817303e785731a69fe5c510231362","observation_id":"f8a10ad9-d40b-4084-9a7b-f2bffef89512","resolution":{"observed_at":"2026-08-06T23:28:15.068287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:09.580548Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.580548Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:15b15ac3108f4f90a1d4133a8faf01b5d4210eac7a92034096e69e14f52893e8","observation_id":"53e2af40-21f9-4ce2-9e42-45112e49afd9","resolution":{"observed_at":"2026-08-06T23:28:09.580548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.982117Z","title":"Grounded language-image pre-training","venue":null,"work_id":"372043d2-f60e-43c3-a42b-8ccbd608f7c9","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.674335Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:be33165e3e4efc1fdedef3fd060bab3f4757dd86c2d7483ca65068120f21c54f","observation_id":"a3a7d4ea-a431-4436-83b4-1b4814b43963","resolution":{"observed_at":"2026-08-06T23:28:14.998419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.930789Z","title":"Scaling language-image pre-training via masking","venue":null,"work_id":"3006a72f-d145-427c-9e28-6f9d5b8f8995","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.791695Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:24bae9a8243f6e7b6e89f17aef305c7c4c435ef0ee59876eb5074d3cde2f36ba","observation_id":"83c4146b-8fd8-449f-8339-29891922cb16","resolution":{"observed_at":"2026-08-06T23:28:14.947249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.870222Z","title":"Retinal vascular imaging: a new tool in microvascular dis- ease research","venue":null,"work_id":"98bb4dc8-a99a-489c-95ce-f2e2c24be563","year":2008},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.866271Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:b9f9a0e84e5566418cba4f9f08fc26ef8b06edcee5dfb010ac1ffba41b17a042","observation_id":"b61553ce-be21-4dc5-a5dd-d866c8913189","resolution":{"observed_at":"2026-08-06T23:28:14.903510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.836153Z","title":"An Open Access Database for Evaluating the Algorithms of Electro- cardiogram Rhythm and Morphology Abnormality Detec- tion","venue":null,"work_id":"be04b997-4f8a-4f7a-b0c5-7ed3911e7ce4","year":2018},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.991703Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:e975c03c1d21588dda8f73ffd9b091f7dd807a98ddcda74064b2f8cb40a6818f","observation_id":"f13e95e5-2c43-44a4-bf8f-e39f7f481800","resolution":{"observed_at":"2026-08-06T23:28:14.850148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.814550Z","title":"Cells, tissues, and disease: principles of general pathology","venue":null,"work_id":"898b5935-a715-484b-99dd-8204d74d5421","year":null},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.148560Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:83d32227a84434c21e42501b2b728137c46bb9fa20d98ae3b9652d326fb78769","observation_id":"1051f69d-4bd5-4c6c-b79a-e43544e24243","resolution":{"observed_at":"2026-08-06T23:28:14.820297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.781448Z","title":"Electrocardiography","venue":null,"work_id":"6b1d0cff-7cc2-4de5-9e1f-1e2586796f69","year":2001},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.257813Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:17017216cf8eb54494c582258b93386e8cf8c8bb88bc0e5a77dfb90a4e1d77c5","observation_id":"e01d9072-9b35-4f11-8bd5-1f90b2c443e9","resolution":{"observed_at":"2026-08-06T23:28:14.797911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:10.404625Z","title":"Im- proved knowledge distillation via teacher assistant","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.404625Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:c385c383793dfdec41f2ff6c30cb1198ca7582301ed8925262d52b4efdb5fb2d","observation_id":"c739753a-386b-47f6-9fe5-27f4c6f82589","resolution":{"observed_at":"2026-08-06T23:28:10.404625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.725429Z","title":"Slip: Self-supervision meets language-image pre- training","venue":null,"work_id":"b24cb948-d566-4d59-8a1d-3003c5a67401","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.514765Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:9390194c391a0e937aeae44e3adb8176fc7c936cdcd171b6448820dcfd2886f5","observation_id":"61ac73ff-cec3-4e06-a279-72d73ce972b4","resolution":{"observed_at":"2026-08-06T23:28:14.740566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.669258Z","title":"Imaging biomarker roadmap for cancer studies","venue":null,"work_id":"0f0763fc-56c8-4eb4-bc63-c1b199ab8a1b","year":2017},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.635991Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:9d196f164c5c2523c65a44b0a65804cbbf175936635aae53d25dc0ec7bc87ada","observation_id":"e06a81aa-6d90-41a8-a021-55becbc681c8","resolution":{"observed_at":"2026-08-06T23:28:14.688487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.625148Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"11c1f07a-92fe-4dc1-9c64-bb77fd46f076","year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.724749Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:7096a385096fc19da58daa92dac6ae26df9a90c66a58649db737be90302b1a8c","observation_id":"e1fa2ad1-3acb-42d6-8f84-8f7c99a61c8b","resolution":{"observed_at":"2026-08-06T23:28:14.634745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.534375Z","title":"Computed tomography: revolutionizing the practice of medicine for 40 years","venue":null,"work_id":"21eee05c-2b63-404d-88b6-ba2cdd24d50d","year":2014},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.826330Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:5539c7f45d146606bfdbcbebf7c33448d91d524826c7e36d0638a58cde9605f4","observation_id":"952d8afa-902e-434b-be2e-d8d09cb1c225","resolution":{"observed_at":"2026-08-06T23:28:14.558177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-03T03:32:02.223426Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-06T23:28:10.922563Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.922563Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:1c68be8a4bd6ae7ab5b279f97c6f489de62a436ad77a53cae5e1eac287e4e118","observation_id":"5d047baa-8550-4eeb-97f9-372bf9e4aeff","resolution":{"observed_at":"2026-08-06T23:28:10.922563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.494122Z","title":"Going deeper through the gleason scoring scale: An automatic end-to-end system for histology prostate grading and cribriform pattern detec- tion","venue":null,"work_id":"6d5599d7-db33-4dd3-a880-335c13cad281","year":2020},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.057460Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:7ee57702c993a0728abac2f80e166010acaa00835d235372941ec1171b2a5bec","observation_id":"2ea250c9-b9bb-4a54-8cfb-0aa82a5e449a","resolution":{"observed_at":"2026-08-06T23:28:14.509236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.461812Z","title":"A foundation language-image model of the retina (flair): Encoding expert knowledge in text supervision","venue":null,"work_id":"bc3f3d63-c40f-41ce-a2e0-83733583e637","year":2025},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.118039Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:9093fd7277523ed52099013e086ffbfa4bb3a3b58a10518ae6d1c2400f3a6aa2","observation_id":"738bc5d4-ed0c-4ce8-8fd7-42e12cc7b87f","resolution":{"observed_at":"2026-08-06T23:28:14.477769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08849","last_updated":"2024-12-10T15:35:31Z","snapshot_observed_at":"2026-07-06T19:15:00.165369Z","submitted_at":"2024-09-12T17:59:08Z","title":"DeCLIP: Decoding CLIP representations for deepfake localization","version":2},"cited_work":{"arxiv_id":"2409.08849","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.08849","snapshot_observed_at":"2026-08-06T23:28:13.366835Z","title":"DeCLIP: Decoding CLIP representations for deepfake localization","venue":"cs.CV","work_id":"89b386bc-b225-4332-8c68-20a5b83da026","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.234539Z"},"links":{"cited_paper":"/paper/2409.08849","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:ada5ec97138d1158d05bb89f5a4a96dee0d191f6f4c3ff70ee76f81ca2fe676b","observation_id":"76b5b8bd-d08f-4a80-badf-0457e6ea2020","resolution":{"observed_at":"2026-08-06T23:28:13.376692Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.440000Z","title":"Chest radiography in general practice: indications, diagnostic yield and consequences for patient management","venue":null,"work_id":"8473355e-a2a3-4e8b-9ed7-cc136e6a6c82","year":2006},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.406849Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:fbc29def1b495b0faa9f2cd7979829c4be41b4bdad4217fdc54814d0f0bf6270","observation_id":"495e251e-726c-43dd-badf-8d1cc63006b3","resolution":{"observed_at":"2026-08-06T23:28:14.448817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.408781Z","title":"Dime-fm: Distilling multimodal and efficient foundation models","venue":null,"work_id":"23342eaf-16f2-4ae6-a77b-2a410adb7d6f","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.534732Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:200a92948cddea0477f47bc8e6b4e7e03694b2f9597949d9c97afcb27abe20cf","observation_id":"cc6787e2-c145-4f98-8c46-ba660ef126cc","resolution":{"observed_at":"2026-08-06T23:28:14.414765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.374030Z","title":"Alpha- clip: A clip model focusing on wherever you want","venue":null,"work_id":"ab946b1b-ab86-45f1-9aa5-9f195f1a6cf1","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.622221Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:42588d2a5d8bc78e4379ec445a9612e76b728c3840130ada14babcd8aeda5a71","observation_id":"2ded2519-967f-4b8e-8505-783a05dba0c4","resolution":{"observed_at":"2026-08-06T23:28:14.389545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.264343Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":"8f8ca397-baee-4a27-97ae-74268a285499","year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.907313Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:66c2b29f56c94b21c4bef783c77c3c24511c19b0337708d84e3c14a28a246b9d","observation_id":"12546e7e-d03e-4b9f-a0b7-09b0baac8979","resolution":{"observed_at":"2026-08-06T23:28:14.304829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.203331Z","title":"Rotation equivariant cnns for digital pathology","venue":null,"work_id":"365f8417-44c4-4e1e-9ef3-66c351140c0f","year":2018},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.132600Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:bf4e3662a18cc1d28c79c9c8fd77d6bc8e65fe9b6fc5e43669bd079e557b37da","observation_id":"80e4fe9f-f65e-44b7-920e-96f50bea6fc4","resolution":{"observed_at":"2026-08-06T23:28:14.221016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.172591Z","title":"Ptb-xl, a large publicly available electrocardiog- raphy dataset","venue":null,"work_id":"972817f2-638b-431e-bc7a-e2dd68929eb1","year":2020},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.250670Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:e0be4538d1208f823f5997ae730c1a4206f6ca86324a2478c82730cdd7fa2bcf","observation_id":"d2d7b2a7-cff7-4187-9a54-7ee9daac4154","resolution":{"observed_at":"2026-08-06T23:28:14.185702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.134735Z","title":"Multi-granularity cross-modal align- ment for generalized medical visual representation learn- ing","venue":null,"work_id":"43500d05-01d8-4e17-8d34-7b9b468136e5","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.345227Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:a6b1d5b57fc4f180780eabff7e20a2b2c65f9fa8095b098fdba93f27ed465259","observation_id":"a79dda0e-3ace-4242-8034-cd853e87cdb4","resolution":{"observed_at":"2026-08-06T23:28:14.152099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.025551Z","title":"Efficient image captioning for edge devices","venue":null,"work_id":"5943ad42-8e39-48ed-8c42-663b998cc289","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.469190Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:18421ed986c3d38161866424268357ffd7fc65edb2e90a9f317d14846dba395c","observation_id":"eaf857f1-b1d0-4dfd-ae4c-b65a98ce5380","resolution":{"observed_at":"2026-08-06T23:28:14.084991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.958547Z","title":"Tinyvit: Fast pretraining distillation for small vision transformers","venue":null,"work_id":"04431447-df71-4f94-91e4-dbaf8e3e4d77","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.548030Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:1c9cff4c4e204c1885c7f0dd2b2d22572f6503425c0432b2d9e95bb610a4db08","observation_id":"c21021bb-2653-41a8-b8e0-5f6f0287b696","resolution":{"observed_at":"2026-08-06T23:28:13.968986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.929491Z","title":"Tinyclip: Clip dis- tillation via affinity mimicking and weight inheritance","venue":null,"work_id":"8eb6f547-ad6b-4e67-91da-dea77f069302","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.654056Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:e0eb053188768bf768a48c1700484daf05b6e385faf026d6b2b09d40394a3651","observation_id":"737567ca-5d89-415e-9644-4e2d34c4fc49","resolution":{"observed_at":"2026-08-06T23:28:13.940199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.880509Z","title":"Clip-kd: An empirical study of clip model distillation","venue":null,"work_id":"d03b20a9-617b-4a05-9836-1ed89b1d34e4","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.797659Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:50224404079545e36d4ece3dedbc89b7d06df64342783a36cc2b2e5b67907694","observation_id":"607a35a7-b5b9-49ce-9ee7-5ae5c8832840","resolution":{"observed_at":"2026-08-06T23:28:13.900745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09441","last_updated":"2024-12-16T11:26:26Z","snapshot_observed_at":"2026-07-06T19:02:03.017798Z","submitted_at":"2024-08-18T11:23:21Z","title":"CLIP-CID: Efficient CLIP Distillation via Cluster-Instance Discrimination","version":2},"cited_work":{"arxiv_id":"2408.09441","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.09441","snapshot_observed_at":"2026-08-06T23:28:13.294364Z","title":"CLIP-CID: Efficient CLIP Distillation via Cluster-Instance Discrimination","venue":"cs.CV","work_id":"30218e7f-ab38-4575-8e78-07b89a2cb515","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.853542Z"},"links":{"cited_paper":"/paper/2408.09441","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:17653ff25c562a0e34d41101fa56b7599d094b7cfa234758fc28818826c0b3c4","observation_id":"e9b23b80-f4f9-4880-b88a-fbf865742c95","resolution":{"observed_at":"2026-08-06T23:28:13.319921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07783","last_updated":"2021-11-09T17:15:38Z","snapshot_observed_at":"2026-07-06T12:08:35.761426Z","submitted_at":"2021-11-09T17:15:38Z","title":"FILIP: Fine-grained Interactive Language-Image Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07783","snapshot_observed_at":"2026-08-06T23:28:12.914424Z","title":"Filip: Fine-grained interactive language-image pre-training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.914424Z"},"links":{"cited_paper":"/paper/2111.07783","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:3d9270744bec2a9d29e4d0638e5b028ae685de04cdb19dc6b69fa962a24eb3d5","observation_id":"e18e71dd-2079-4c9d-97c5-8feaabc0f774","resolution":{"observed_at":"2026-08-06T23:28:12.914424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00915","last_updated":"2025-01-08T22:58:51Z","snapshot_observed_at":"2026-07-06T14:57:39.647497Z","submitted_at":"2023-03-02T02:20:04Z","title":"BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00915","snapshot_observed_at":"2026-08-06T23:28:12.934924Z","title":"Biomedclip: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.934924Z"},"links":{"cited_paper":"/paper/2303.00915","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:4cef15634eb64c6775d719bd0797c7f2073fb20128de36552156edbf54e82496","observation_id":"0826940a-6cfc-474b-8970-0b0159f5516a","resolution":{"observed_at":"2026-08-06T23:28:12.934924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.833953Z","title":"Contrastive learning of medical visual representations from paired images and text","venue":null,"work_id":"71a991f9-9dd2-4ae0-ad18-d950050ffd58","year":null},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.956611Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:7cfa6e94c1fb978700a6e48505a9d45fdf030e3440d9a2519692bc711a780201","observation_id":"5e170c9b-916f-4727-8dee-d69fcdf9a60c","resolution":{"observed_at":"2026-08-06T23:28:13.852122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.789200Z","title":"Bira-net: Bilinear attention net for diabetic retinopathy grading","venue":null,"work_id":"4894a670-a5c0-49e3-95cc-4eca4a031331","year":2019},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.973603Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:0eefc65564d7dffc7ab93e375bdda9df1c857c7800c01fc20cb52b4ec4f8aac7","observation_id":"e7e73ffa-5f3e-4afd-92f4-49b4fed36d9f","resolution":{"observed_at":"2026-08-06T23:28:13.803462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07353","last_updated":"2025-03-26T13:32:28Z","snapshot_observed_at":"2026-07-31T04:25:37.437501Z","submitted_at":"2023-12-12T15:21:57Z","title":"CLIP in Medical Imaging: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07353","snapshot_observed_at":"2026-08-06T23:28:13.001882Z","title":"Clip in medical imaging: A comprehensive sur- vey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:13.001882Z"},"links":{"cited_paper":"/paper/2312.07353","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:c70064b24b129c715bcc5fd6cbc86fcd9497679a60bc5f3066250443e89786a7","observation_id":"3cfbe601-b0a5-4254-b90c-b93fc3049210","resolution":{"observed_at":"2026-08-06T23:28:13.001882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","latest_version":2,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-06T23:21:00.198107Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":40},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2506.18072."}