{"as_of":"2026-08-11T12:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5bd219fa66ac34dce9d8949731f8e074cc16b650c15bee91843b0e0125814d31","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T18:16:34.491054Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T03:31:45.670345Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.13800","snapshot_observed_at":"2026-08-02T03:31:45.670345Z","title":"Beyond medical diagnostics: How medical multimodal large language models think in space.arXiv preprint arXiv:2603.13800, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13860","last_updated":"2026-07-15T14:05:58Z","snapshot_observed_at":"2026-08-08T22:42:36.856342Z","submitted_at":"2026-07-15T14:05:58Z","title":"Towards Enhancing 3D Spatial Reasoning in Medical Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T03:31:45.670345Z"},"links":{"cited_paper":"/paper/2603.13800","citing_paper":"/paper/2607.13860"},"observation_digest":"sha256:174de893200764522ab1263f005b3c18457d8b798fc5bde9f7cf3e65f1377401","observation_id":"9915882e-1343-4c71-a4bc-08de70340285","resolution":{"observed_at":"2026-08-02T03:31:45.670345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.13800","snapshot_observed_at":"2026-08-01T00:38:26.906488Z","title":"Beyond medical diagnostics: How medical multimodal large language models think in space","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26196","last_updated":"2026-07-28T19:00:17Z","snapshot_observed_at":"2026-08-08T04:15:16.454718Z","submitted_at":"2026-07-28T19:00:17Z","title":"Rad-JEPA 3D: Radiology Joint-Embedding Predictive Model for 3D Computed Tomography","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T00:38:26.906488Z"},"links":{"cited_paper":"/paper/2603.13800","citing_paper":"/paper/2607.26196"},"observation_digest":"sha256:545c672c207e8c2f9a2795434343f0779e713e11e89f36cf59070b905da39e13","observation_id":"bd428541-2b5b-49af-8af2-ac17ec3a2430","resolution":{"observed_at":"2026-08-01T00:38:26.906488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.13800/citation-record","integrity":"/paper/2603.13800/integrity","json":"/paper/2603.13800/citation-record.json","paper":"/paper/2603.13800"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:16:31.730511Z","title":"Radimagenet-vqa: A large-scale ct and mri dataset for radiologic visual question answering.arXiv preprint arXiv:2512.17396,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:31.730511Z"},"links":{"citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:d9c6e842d2df688461046b5a3e90cccdba805c2df214fbb14e15000fcf6708b0","observation_id":"8cdf80f8-7fcc-4a86-9bd2-d10f737ed577","resolution":{"observed_at":"2026-08-02T18:16:31.730511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-02T18:16:31.894398Z","title":"Internlm2 technical report.arXiv preprint arXiv:2403.17297,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:31.894398Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:19f8e3574f6d860e24b951b890bcd8f3aaca935ef6671082328d91a210ce3ce4","observation_id":"affbb95c-25f5-46b9-9509-47599f013b87","resolution":{"observed_at":"2026-08-02T18:16:31.894398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:16:32.074506Z","title":"and Weis, S","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.074506Z"},"links":{"citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:619b3cffecaee9b8dc6a42440b2f1a808c1439f5b57cb0f23019a1b969b49d30","observation_id":"7a8e7323-7e07-4aa9-9dfe-f5102d46872f","resolution":{"observed_at":"2026-08-02T18:16:32.074506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T18:16:32.225215Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.225215Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:36ec0f66a3e2bb54bd251931b64e0a2f6b2a9ccfefc06f95c81c5f131075223b","observation_id":"10f0d040-f41d-4738-aed2-3cfc1f5e5f1a","resolution":{"observed_at":"2026-08-02T18:16:32.225215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:16:32.287343Z","title":"E., Er, S., Almas, F., Simsek, A","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.287343Z"},"links":{"citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:2d6e9ee26bdb02d5ef4416a5036ef3ad5158eacb39f8575f7ce5db68251db1ce","observation_id":"41aede8a-2506-414e-bf4d-893bad6e9653","resolution":{"observed_at":"2026-08-02T18:16:32.287343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10798","last_updated":"2023-11-17T07:28:16Z","snapshot_observed_at":"2026-08-10T16:02:13.140419Z","submitted_at":"2023-11-17T07:28:16Z","title":"INSPECT: A Multimodal Dataset for Pulmonary Embolism Diagnosis and Prognosis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10798","snapshot_observed_at":"2026-08-02T18:16:32.462014Z","title":"P., Yeung, S., Shah, N., and Fries, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.462014Z"},"links":{"cited_paper":"/paper/2311.10798","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:2963e53cf23173efffdf468c9b1c11bc89389955efb21f02ef3e09a1eb065e8d","observation_id":"d2890c10-b842-483a-a61d-fbcc0e3ee91c","resolution":{"observed_at":"2026-08-02T18:16:32.462014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10237","last_updated":"2024-09-01T16:39:31Z","snapshot_observed_at":"2026-08-07T06:50:58.775402Z","submitted_at":"2024-04-16T02:35:17Z","title":"Med-MoE: Mixture of Domain-Specific Experts for Lightweight Medical Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10237","snapshot_observed_at":"2026-08-02T18:16:32.584875Z","title":"Med-moe: Mixture of domain-specific experts for lightweight medical vision-language models.arXiv preprint arXiv:2404.10237,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.584875Z"},"links":{"cited_paper":"/paper/2404.10237","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:0941507c6153a407e52b7949d1b8cf71f32227e9cd23d3ac873cda7b2ace02a1","observation_id":"92d04f16-1da0-4392-9ea3-ee45a5c4d21a","resolution":{"observed_at":"2026-08-02T18:16:32.584875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:16:32.767136Z","title":"Menze, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.767136Z"},"links":{"citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:d9419093ae7463f2eb8b9f21015efab30ce4037f237785f8f321dd8c3869c8ce","observation_id":"e85a6bb2-37af-4a43-addf-454bc49270c9","resolution":{"observed_at":"2026-08-02T18:16:32.767136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-07T20:37:56.716831Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-02T18:16:32.946219Z","title":"B., Chen, C., Ouyang, C., and Rueckert, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.946219Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:8d8b8007e84c7920df1aecd65e262a1db7917a8d3bcc6d9e7eac040c4a61e60a","observation_id":"b0ee57f9-fc5b-4c1c-b1ab-46d0f6de3f2f","resolution":{"observed_at":"2026-08-02T18:16:32.946219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T18:16:33.107574Z","title":"Rajabi, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:33.107574Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:f3a0ec266fd907388ae0b87738b1343b9188486eac0b6bf105a1173a9ab241b1","observation_id":"c695bb43-0ca6-465b-b66d-a617325cf295","resolution":{"observed_at":"2026-08-02T18:16:33.107574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-02T18:16:33.382429Z","title":"Thermometer: Towards universal calibration for large language models.arXiv preprint arXiv:2403.08819,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:33.382429Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:1bb0f9031c49cf6ef817b13307cfa5a6ae66df01336205cf59f8acb6404da1d4","observation_id":"45844de7-df57-4c1c-9478-0cdc85e30134","resolution":{"observed_at":"2026-08-02T18:16:33.382429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:16:33.577395Z","title":"Med-2e3: A 2d-enhanced 3d medical multimodal large language model.arXiv preprint arXiv:2411.12783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:33.577395Z"},"links":{"citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:dd678173b0c5d9a185d09e66b9c5e41961aa23c869c21143255591280e31af3b","observation_id":"8231a844-0552-495b-ba5b-6254a2e1f2d2","resolution":{"observed_at":"2026-08-02T18:16:33.577395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:16:33.764085Z","title":"Prs-med: Position reasoning segmentation with vision- language model in medical imaging.arXiv preprint arXiv:2505.11872,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:33.764085Z"},"links":{"citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:0486073e0d211d7615af2d5281b0c6f0b62bac47a7f6bb319bba2261d9467f77","observation_id":"a5c8e9a8-e746-4805-81e5-31572e6effbe","resolution":{"observed_at":"2026-08-02T18:16:33.764085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-02T18:16:33.915250Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:33.915250Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:d7ba9ba0e2322778e4652f7a93accb0d22a87b923ac07d2d26bf3b1b9e2ba90a","observation_id":"abb47cb2-d812-47b1-8d73-addfa802534d","resolution":{"observed_at":"2026-08-02T18:16:33.915250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11969","last_updated":"2023-11-20T17:59:03Z","snapshot_observed_at":"2026-08-07T05:38:29.801244Z","submitted_at":"2023-11-20T17:59:03Z","title":"SA-Med2D-20M Dataset: Segment Anything in 2D Medical Imaging with 20 Million masks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11969","snapshot_observed_at":"2026-08-02T18:16:34.075552Z","title":"W., Han, R., Fei-Fei, L., and Xie, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:34.075552Z"},"links":{"cited_paper":"/paper/2311.11969","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:a0d46590a96e27d950696005d32766e488ad9781b98a6541e3256235f557e3d1","observation_id":"58c97126-eddf-46c9-9569-f8b15d2f7123","resolution":{"observed_at":"2026-08-02T18:16:34.075552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01442","last_updated":"2020-03-08T00:09:07Z","snapshot_observed_at":"2026-07-06T08:26:38.349660Z","submitted_at":"2019-10-03T13:16:36Z","title":"CLEVRER: CoLlision Events for Video REpresentation and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01442","snapshot_observed_at":"2026-08-02T18:16:34.210937Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:34.210937Z"},"links":{"cited_paper":"/paper/1910.01442","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:5d06d8b1fff8c9acd7a3b37b490c7b84dd1cf7ef15883dd2a69ebbc01479ca29","observation_id":"045dcfed-26c4-43a4-8afd-b72a2f621c61","resolution":{"observed_at":"2026-08-02T18:16:34.210937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:16:34.491054Z","title":"All of the embeddings are stored via the index storage of Faiss (Johnson et al., 2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:34.491054Z"},"links":{"citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:d7553fddc34a5aed384e15becfcfb80e350e2caa60aa1bfdc676e36a08095fe8","observation_id":"40d6e805-7964-4429-bbdd-e9664ac181a4","resolution":{"observed_at":"2026-08-02T18:16:34.491054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19280","last_updated":"2024-09-30T06:45:16Z","snapshot_observed_at":"2026-08-06T18:57:51.817317Z","submitted_at":"2024-06-27T15:50:41Z","title":"HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19280","snapshot_observed_at":"2026-08-02T18:16:32.110889Z","title":"H., Wang, X., Zhang, R., Cai, Z., Ji, K., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.110889Z"},"links":{"cited_paper":"/paper/2406.19280","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:336baea2b0997eaae1f43c9f48273db8367edd1110a85755f1e3e570253f66fe","observation_id":"ae4fd3de-ae19-4dd5-8777-e9e4ccb2e5c3","resolution":{"observed_at":"2026-08-02T18:16:32.110889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05201","last_updated":"2026-04-06T19:50:20Z","snapshot_observed_at":"2026-08-07T23:53:34.814339Z","submitted_at":"2025-07-07T17:01:44Z","title":"MedGemma Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05201","snapshot_observed_at":"2026-08-02T18:16:33.259309Z","title":"Medgemma technical report.arXiv preprint arXiv:2507.05201,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:33.259309Z"},"links":{"cited_paper":"/paper/2507.05201","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:131d9e3182783439be2826c37cf657daf57f44a606702a9cb3333aa4252a4f91","observation_id":"0a741358-8f30-4963-b68f-e2c7f550051a","resolution":{"observed_at":"2026-08-02T18:16:33.259309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.02629","last_updated":"2019-04-23T13:35:04Z","snapshot_observed_at":"2026-07-06T07:13:05.887491Z","submitted_at":"2018-11-05T05:10:18Z","title":"Identifying the Best Machine Learning Algorithms for Brain Tumor Segmentation, Progression Assessment, and Overall Survival Prediction in the BRATS Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.02629","snapshot_observed_at":"2026-08-02T18:16:31.590467Z","title":"T., Berger, C., Ha, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:31.590467Z"},"links":{"cited_paper":"/paper/1811.02629","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:292a24bdc952a6e5dc02f5e3ce0cc0fcf091f215940e1893f6900a2047aa0419","observation_id":"a4296c92-2c53-4b3c-afeb-f7c50ed16e66","resolution":{"observed_at":"2026-08-02T18:16:31.590467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-08-09T13:23:52.437582Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-02T18:16:34.354163Z","title":"Development of a large-scale grounded vision language dataset for chest ct analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:34.354163Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:7ce34fee07220ca21d2678138c8a75b2bab027fd066b1904f17cbe669551105c","observation_id":"905a0ddd-9284-4ddd-82ac-838b367e6fda","resolution":{"observed_at":"2026-08-02T18:16:34.354163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-02T18:16:32.339683Z","title":"Glm-4.1 v-thinking: Towards versatile multimodal reasoning with scalable reinforcement learning.arXiv preprint arXiv:2507.01006,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.339683Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:d1ecf06c10877117a99a74280dc1b291cf916e7d777f80ee19dc577bca31241f","observation_id":"4cda2cca-768e-485d-9590-fff01246125c","resolution":{"observed_at":"2026-08-02T18:16:32.339683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:16:31.198364Z","title":"E., Zhang, X., Zhu, M., Alabbad, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:31.198364Z"},"links":{"citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:246d6bfa334a5abdc8f289cb989292a6f3df46b854292886abdb0b4497202a55","observation_id":"a80220ef-d008-453c-992b-1a3fab8fb7ed","resolution":{"observed_at":"2026-08-02T18:16:31.198364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:16:32.187614Z","title":"3d- rad: A comprehensive 3d radiology med-vqa dataset with multi-temporal analysis and diverse diagnostic tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:32.187614Z"},"links":{"citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:a50dd4ab6875a1a1eb0b89138d1deda4aaa8689e5cb2e269df7889e634f7bae7","observation_id":"4f43c40d-00f4-41cb-9f16-410ebc1a8639","resolution":{"observed_at":"2026-08-02T18:16:32.187614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T18:16:31.472901Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:31.472901Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:aecc181f242d084dd05cd9dad90b6d87e3eb54d610ca7192d6f96543365dd852","observation_id":"38660bee-18d5-4990-b8d9-8e984c425151","resolution":{"observed_at":"2026-08-02T18:16:31.472901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00578","last_updated":"2024-03-31T06:55:12Z","snapshot_observed_at":"2026-07-06T17:53:35.219482Z","submitted_at":"2024-03-31T06:55:12Z","title":"M3D: Advancing 3D Medical Image Analysis with Multi-Modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00578","snapshot_observed_at":"2026-08-02T18:16:31.288447Z","title":"Q.-H., and Zhao, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:31.288447Z"},"links":{"cited_paper":"/paper/2404.00578","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:4c5c5bc6ad1532aa436a0b4539f74cfbf69d4f1537f8e490f5ed7134c9360cbf","observation_id":"bd8a8576-6537-45f3-ae60-098771088330","resolution":{"observed_at":"2026-08-02T18:16:31.288447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 2 inbound Pith citation observations for arXiv:2603.13800."}