{"as_of":"2026-08-14T17:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0a80c6be551f75cb52900c1b600b6d10486043c48e3be7d64f0d72410aba4cc5","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:17:48.121800Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:07:07.540354Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T15:34:48.298282Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":"2506.08356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08356","snapshot_observed_at":"2026-06-30T15:34:48.298282Z","title":"arXiv preprint arXiv:2506.08356 (2025)","venue":null,"work_id":"88eb3b26-9971-4490-b3b5-b42b2daabdd7","year":2025},"citing_paper":{"arxiv_id":"2604.08936","last_updated":"2026-04-10T04:06:11Z","snapshot_observed_at":"2026-08-02T15:11:57.470296Z","submitted_at":"2026-04-10T04:06:11Z","title":"M-IDoL: Information Decomposition for Modality-Specific and Diverse Representation Learning in Medical Foundation Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T17:18:05.539936Z"},"links":{"cited_paper":"/paper/2506.08356","citing_paper":"/paper/2604.08936"},"observation_digest":"sha256:264f8bcef6bd4f754584b683c3eda7f0bbeba3e8f2334902d81fddc81bd98416","observation_id":"8e69c662-1f2c-479a-baf2-bfa69f288ff1","resolution":{"observed_at":"2026-05-11T07:06:08.706047Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":"2506.08356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08356","snapshot_observed_at":"2026-06-30T15:34:48.298282Z","title":"arXiv preprint arXiv:2506.08356 (2025)","venue":null,"work_id":"88eb3b26-9971-4490-b3b5-b42b2daabdd7","year":2025},"citing_paper":{"arxiv_id":"2604.26283","last_updated":"2026-07-02T12:22:56Z","snapshot_observed_at":"2026-08-11T12:22:37.659078Z","submitted_at":"2026-04-29T04:23:35Z","title":"MedSynapse-V: Bridging Visual Perception and Clinical Intuition via Latent Memory Evolution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T14:02:54.395566Z"},"links":{"cited_paper":"/paper/2506.08356","citing_paper":"/paper/2604.26283"},"observation_digest":"sha256:e73252cea0cd22d48de890ccf4016c9565a5d9819f059bdd3c6cc94eb7b7a470","observation_id":"10b2fc26-09ab-4448-8bda-453d9588253d","resolution":{"observed_at":"2026-05-12T08:41:25.884555Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":"2506.08356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08356","snapshot_observed_at":"2026-06-30T15:34:48.298282Z","title":"arXiv preprint arXiv:2506.08356 (2025)","venue":null,"work_id":"88eb3b26-9971-4490-b3b5-b42b2daabdd7","year":2025},"citing_paper":{"arxiv_id":"2604.26283","last_updated":"2026-07-02T12:22:56Z","snapshot_observed_at":"2026-08-11T12:22:37.659078Z","submitted_at":"2026-04-29T04:23:35Z","title":"MedSynapse-V: Bridging Visual Perception and Clinical Intuition via Latent Memory Evolution","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T00:50:15.010488Z"},"links":{"cited_paper":"/paper/2506.08356","citing_paper":"/paper/2604.26283"},"observation_digest":"sha256:26e359741ee0a8abe61858dc16e600ea48d8078c3326839c485b0def0f48e8e4","observation_id":"c96ccbb1-8ccd-4a9b-8b84-783d7f9de267","resolution":{"observed_at":"2026-05-21T00:53:53.444926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":"2506.08356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08356","snapshot_observed_at":"2026-06-30T15:34:48.298282Z","title":"arXiv preprint arXiv:2506.08356 (2025)","venue":null,"work_id":"88eb3b26-9971-4490-b3b5-b42b2daabdd7","year":2025},"citing_paper":{"arxiv_id":"2605.21861","last_updated":"2026-05-21T01:17:13Z","snapshot_observed_at":"2026-08-02T07:31:09.145202Z","submitted_at":"2026-05-21T01:17:13Z","title":"Learning Emergent Modular Representations in Multi-modality Medical Vision Foundation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T08:03:26.899282Z"},"links":{"cited_paper":"/paper/2506.08356","citing_paper":"/paper/2605.21861"},"observation_digest":"sha256:fa5760401081ee9c25e7503bfde8020efc0192d995e8c74fff271cedadbd564a","observation_id":"de0fbaff-f16c-454a-b27c-feb5d9d600e0","resolution":{"observed_at":"2026-05-22T08:04:43.009309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":"2506.08356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08356","snapshot_observed_at":"2026-06-30T15:34:48.298282Z","title":"arXiv preprint arXiv:2506.08356 (2025)","venue":null,"work_id":"88eb3b26-9971-4490-b3b5-b42b2daabdd7","year":2025},"citing_paper":{"arxiv_id":"2605.27431","last_updated":"2026-05-22T05:01:21Z","snapshot_observed_at":"2026-08-06T06:43:33.194889Z","submitted_at":"2026-05-22T05:01:21Z","title":"Tackling Multimodal Learning Challenges with Mixture-of-Expert: A Survey","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T15:26:44.904121Z"},"links":{"cited_paper":"/paper/2506.08356","citing_paper":"/paper/2605.27431"},"observation_digest":"sha256:7038e3e72b30f1fae5b7417a86d1319910015a794ddf16b61c6b9a993f8ef4b5","observation_id":"09f23761-25ac-4aea-a4e8-fd0f331179da","resolution":{"observed_at":"2026-06-30T15:34:48.299864Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08356","snapshot_observed_at":"2026-08-05T21:07:07.540354Z","title":"arXiv preprint arXiv:2506.08356 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03322","last_updated":"2026-08-04T08:29:21Z","snapshot_observed_at":"2026-08-12T17:06:20.003107Z","submitted_at":"2026-08-04T08:29:21Z","title":"LocAnyMed: Vision-Language Grounding for Multimodal Medical Images","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T21:07:07.540354Z"},"links":{"cited_paper":"/paper/2506.08356","citing_paper":"/paper/2608.03322"},"observation_digest":"sha256:08de4a4f86bf069836f19d68625353c143a3ac4200e9643cacba7af9ace18948","observation_id":"57e88c4d-9892-4f82-997b-395e7c3a7058","resolution":{"observed_at":"2026-08-05T21:07:07.540354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.08356/citation-record","integrity":"/paper/2506.08356/integrity","json":"/paper/2506.08356/citation-record.json","paper":"/paper/2506.08356"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.654320Z","title":"Prior: Prototype-driven radiograph interpretation with optimized representations","venue":null,"work_id":"94ee0bec-0865-4cf0-bccc-f61ae603e360","year":null},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.864771Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:e6a91f3c18f9e6c7fc1dbc635ca8927b51376f45e242b74bc19d38c762ee0991","observation_id":"f5398c87-321f-4aff-86a1-21002849a1ac","resolution":{"observed_at":"2026-08-07T05:17:48.659236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.638757Z","title":"The rsna pulmonary embolism ct dataset.Radiology: Artificial Intelligence, 3(2):e200254, 2021","venue":null,"work_id":"8576a583-bddc-42dc-bdee-2e05da38378c","year":2021},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.870196Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:900292ce5ce1bedb332544887480ed90a4cff282c9110ebeac264548ca12143e","observation_id":"adaefa76-cb4a-4e27-87c3-f13d49d1e008","resolution":{"observed_at":"2026-08-07T05:17:48.643582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:47.875487Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.875487Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:2467e90771f50920964121d1a5429b040dba3156a1c804bf16fad5c7f3c09bbd","observation_id":"c1c29dcc-f63b-4ef2-b991-ffd567ea686a","resolution":{"observed_at":"2026-08-07T05:17:47.875487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.613061Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"d2932a02-c804-48d6-bfd8-f65897e0d441","year":2009},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.880672Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:880640a461f681a24ddb6c44f1ba9af2cae6ce450c21b2be88f9dd499b5f1502","observation_id":"91f15da7-3eba-4917-9148-45c94322bef9","resolution":{"observed_at":"2026-08-07T05:17:48.617956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.597145Z","title":null,"venue":null,"work_id":"686a0a00-d3ce-4465-8baf-3577d4a76ebd","year":2022},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.886216Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:0c08f4293a05bf60b70ebb14ab995b32649adf49ec5687363599901f4f18c3a6","observation_id":"d8a41f0d-4869-489b-a081-c179de96b5c6","resolution":{"observed_at":"2026-08-07T05:17:48.601944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.579451Z","title":"Lungren, and Serena Yeung","venue":null,"work_id":"7fb12257-696c-4015-a8f3-aa6e13167592","year":2021},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.891509Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:663bf33e19c459fd1cf40f558154484dbbeb1ae15e9db8324c533f07c40b5969","observation_id":"6d96e1aa-2df2-4258-a98c-9a1fc689c5ef","resolution":{"observed_at":"2026-08-07T05:17:48.584723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.562897Z","title":"Quilt-1m: One million image-text pairs for histopathology.Advances in neural information processing systems, 36:37995–38017,","venue":null,"work_id":"fd5ee9e2-5933-4a28-997e-6706d5940aed","year":null},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.896400Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:2ea9ec811ce2458f3d8720093c316af674eb5f3fbbc7652f38405392fae1b011","observation_id":"89fd9e6b-e67c-46f1-9532-a4bd50684258","resolution":{"observed_at":"2026-08-07T05:17:48.568027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.547263Z","title":"Chexpert: A large chest radiograph dataset with uncertainty labels and expert comparison","venue":null,"work_id":"3ec3c703-d765-4107-9530-02ce94029604","year":2019},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.901582Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:ef0d6c58114c24e81e5fb6fb5652d2c1701a8c6496a4ae86f8318775fe55b5c2","observation_id":"1e131399-c868-46f3-b7a3-89f9cc78067e","resolution":{"observed_at":"2026-08-07T05:17:48.552140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10372","last_updated":"2024-12-13T18:59:40Z","snapshot_observed_at":"2026-08-13T21:19:28.765174Z","submitted_at":"2024-12-13T18:59:40Z","title":"UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10372","snapshot_observed_at":"2026-08-07T05:17:47.906785Z","title":"Unimed- clip: Towards a unified image-text pretraining paradigm for diverse medical imaging modalities.arXiv preprint arXiv:2412.10372, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.906785Z"},"links":{"cited_paper":"/paper/2412.10372","citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:a7ac8e72a4642d0a5bf25cc336fddec0a26bdabe4c33e32ba12ee30b5b9d44aa","observation_id":"9d394f8d-0bdf-466f-bfd0-25daee8e2489","resolution":{"observed_at":"2026-08-07T05:17:47.906785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.529021Z","title":"Lepikhin","venue":null,"work_id":"5c31e435-14df-48ea-9345-7a3791a00efa","year":null},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.911947Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:ec1184abceaf19385575e5eae0559857a4d5b77df7bc617a1e58c07c54c5d309","observation_id":"e9396f99-3ef5-4e29-a832-d924af718337","resolution":{"observed_at":"2026-08-07T05:17:48.533942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15947","last_updated":"2024-12-23T08:05:14Z","snapshot_observed_at":"2026-08-06T02:31:58.372974Z","submitted_at":"2024-01-29T08:13:40Z","title":"MoE-LLaVA: Mixture of Experts for Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15947","snapshot_observed_at":"2026-08-07T05:17:47.917400Z","title":"Moe-llava: Mixture of experts for large vision-language models.arXiv preprint arXiv:2401.15947, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.917400Z"},"links":{"cited_paper":"/paper/2401.15947","citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:1b4ea3998edc55eb4068efede46127095c1edadf912e4d484335dcfa0d7ae887","observation_id":"b7bcc4d9-e371-46ce-9c39-807f1fb082f8","resolution":{"observed_at":"2026-08-07T05:17:47.917400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.512658Z","title":"Pmc-clip: Con- trastive language-image pre-training using biomedical docu- ments","venue":null,"work_id":"5c9e4a9a-1578-4398-9cff-ff0c94383f0c","year":2023},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:47.922391Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:140c93fe677524f683044bbb6b6646a6c290155abd937d31e1cc5bcbb70769c7","observation_id":"5f422193-30af-4b45-b2dd-f20620740774","resolution":{"observed_at":"2026-08-07T05:17:48.518368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.043723Z","title":"Visual instruction tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.043723Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:4655da4e72b69d7fc4cee5fbd7e3629ac597b9470c6d8df7b0260ae539b94d6f","observation_id":"2ca4d97a-76c8-4a08-b64b-9290924ac3d0","resolution":{"observed_at":"2026-08-07T05:17:48.043723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.486966Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"798d8908-aef3-42ff-bb67-92077350923a","year":2021},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.049109Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:c56be14d7c1e7f12019abb4d0f2af2135eb589dc104f39f054479dd66cf63fec","observation_id":"1f72311e-a390-4356-9a28-7809a119428f","resolution":{"observed_at":"2026-08-07T05:17:48.491696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.471770Z","title":"Lovt: Local vision-text alignment for medical image analysis","venue":null,"work_id":"d5031e40-4d2a-4735-bf27-ba11a8295ce7","year":2022},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.054021Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:a4e9ad784b8c69afc4bf1c91d059b00c4dc5721f1cd9e5c761dc63f44a808c0f","observation_id":"541895c5-d679-4d4e-a516-8856621bfd9e","resolution":{"observed_at":"2026-08-07T05:17:48.476519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.454463Z","title":"Quiltnet: Efficient deep learning inference on multi-chip accelerators using model partitioning","venue":null,"work_id":"83dccd6e-9814-4107-8289-8d5e1073b49b","year":2022},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.058881Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:6792e73a71d0b43d33369f525b277f7fd5dc5bb7bba71a424fdd55cdb700c902","observation_id":"3eca9f33-bf40-449b-8640-cef5ed274c1e","resolution":{"observed_at":"2026-08-07T05:17:48.460406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.437050Z","title":"An open access thy- roid ultrasound image database","venue":null,"work_id":"cea81bb0-69e2-4029-89ab-c0e42def962f","year":2015},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.064024Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:761f47c190718a667817a90c87f8a61426f50aee1e6ef7e62eed5b72863d7ce7","observation_id":"bd551092-4124-4d44-8d5a-1975a3e38f4d","resolution":{"observed_at":"2026-08-07T05:17:48.442592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.420074Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"2a90d34d-10cf-4332-9384-eef349bcf59e","year":2021},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.069520Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:5616fb6fb6a0a6a0f18f1627297af1e9ce056546cb6dde14bce46d2569fd4e6b","observation_id":"d06c4b51-7716-48a3-9252-109404a92299","resolution":{"observed_at":"2026-08-07T05:17:48.425176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.403694Z","title":null,"venue":null,"work_id":"92778186-d7c9-4f4c-8ff5-008d53e6a86c","year":2017},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.074576Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:00cfa98d22b36140db9ef8c6688e752aec058e115f1a0e57b78b4e5b018f8053","observation_id":"d57f68db-d743-4a2a-923a-b62be92f49c5","resolution":{"observed_at":"2026-08-07T05:17:48.408557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.079833Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.079833Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:b18deca6ab4205c3e881a6ac003d60d0f76497b9e71592d6fd09cc8e0c43d239","observation_id":"b7a8db79-c5a3-49a5-91d4-4c4d2b79a712","resolution":{"observed_at":"2026-08-07T05:17:48.079833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.388260Z","title":"Large language models encode clinical knowledge.Nature, 620 (7972):172–180, 2023","venue":null,"work_id":"65f8d4aa-74c9-42ca-b118-e07633714583","year":2023},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.085055Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:40fbffeb9f96e7bd4ea3a8ce3cf2eb24b3a3697a6f36134993eda10fe6f04243","observation_id":"efa49bd9-b0ad-446b-a36e-da63638d3529","resolution":{"observed_at":"2026-08-07T05:17:48.393110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.372748Z","title":"Medclip: Contrastive learning from unpaired medical images and text","venue":null,"work_id":"d8a2cba0-2ad9-4d9d-92d7-fc15fccbd15c","year":2022},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.090616Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:16313fbb89f60eeb9fea2e7c90e730b096e4dbc82d0f68dc582b1d124e6a124e","observation_id":"31d7b083-5b53-4600-acf5-83e43db10259","resolution":{"observed_at":"2026-08-07T05:17:48.377499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.356718Z","title":"Mm-retinal: Knowledge-enhanced founda- tional pretraining with fundus image-text expertise","venue":null,"work_id":"f8f66f06-06c5-4f99-bb59-b8e8e516b2eb","year":null},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.096110Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:87772ab8492d33922ff15b740862296c3bfeb2f5e75c6c95462ce1478b2f5b0c","observation_id":"0fa57136-a3e1-45a1-a1f5-0125523da4c8","resolution":{"observed_at":"2026-08-07T05:17:48.361645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.101446Z","title":"Deepseek-vl2: Mixture-of-experts vision-language models for advanced multimodal understanding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.101446Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:c0bd59e29d8eda470f02dd660c91c315755a8f52cc373538649c16d25451c193","observation_id":"fd752eab-7fd1-444f-abcf-e21d77a4ec37","resolution":{"observed_at":"2026-08-07T05:17:48.101446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00915","last_updated":"2025-01-08T22:58:51Z","snapshot_observed_at":"2026-07-06T14:57:39.647497Z","submitted_at":"2023-03-02T02:20:04Z","title":"BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00915","snapshot_observed_at":"2026-08-07T05:17:48.106513Z","title":"Biomedclip: A mul- timodal biomedical foundation model pretrained from fif- teen million scientific image-text pairs.arXiv preprint arXiv:2303.00915, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.106513Z"},"links":{"cited_paper":"/paper/2303.00915","citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:6c37530d31bafd22a75f966f85af1acc9d6cf4b7897885a1a5e99aaa26e4828a","observation_id":"04250e9c-33a1-4e97-86a3-4c0192ec77eb","resolution":{"observed_at":"2026-08-07T05:17:48.106513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07353","last_updated":"2025-03-26T13:32:28Z","snapshot_observed_at":"2026-08-13T12:41:11.146895Z","submitted_at":"2023-12-12T15:21:57Z","title":"CLIP in Medical Imaging: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07353","snapshot_observed_at":"2026-08-07T05:17:48.111873Z","title":"Clip in medical imaging: A survey.arXiv preprint arXiv:2312.07353, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.111873Z"},"links":{"cited_paper":"/paper/2312.07353","citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:f7d869fd9ed70b6e5a845072815d4096aa309e9cc30960d3c892906d9751112b","observation_id":"ec5c7f92-22b3-476f-b221-aa77b1730f19","resolution":{"observed_at":"2026-08-07T05:17:48.111873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.330507Z","title":"Zhao, Andrew Dai, Zhifeng Chen, Quoc Le, and James Laudon","venue":null,"work_id":"f5376448-01e6-4e7a-9287-34ee73813957","year":2022},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.117109Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:52fdce5b731b284ed0eb6ae9696ca8176d812ec2da63cc6091e5e2690ed6c5b5","observation_id":"3adb32e7-0589-4a28-815c-30456422e0c9","resolution":{"observed_at":"2026-08-07T05:17:48.335486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:17:48.311981Z","title":"Advancing radiograph representation learning with masked record mod- eling.ICLR, 2023","venue":null,"work_id":"3b97e214-d280-4ba2-ad89-32b2f1302e08","year":2023},"citing_paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:17:48.121800Z"},"links":{"citing_paper":"/paper/2506.08356"},"observation_digest":"sha256:755fac86b522e8b0d2aab26182a84745b1057e677ef6ae59875d127a63a401c9","observation_id":"174f643f-cd80-4210-8d85-820ba0178085","resolution":{"observed_at":"2026-08-07T05:17:48.319118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.08356","last_updated":"2025-06-11T12:15:03Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T13:12:38.108616Z","submitted_at":"2025-06-10T02:14:15Z","title":"MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 6 inbound Pith citation observations for arXiv:2506.08356."}