{"as_of":"2026-08-08T02:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3d5f7036450bae6e21c131e30c6a46e001cd30d296652be70278b7ec19c4e77","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:24:13.175284Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19031/citation-record","integrity":"/paper/2505.19031/integrity","json":"/paper/2505.19031/citation-record.json","paper":"/paper/2505.19031"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:15.818697Z","title":"Cancers 15(2), 545 (2023)","venue":null,"work_id":"e2025bef-6517-4f7e-a9e5-b8bc3b477d5c","year":2023},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:10.277537Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:324f1398ec1534bb653855bed4f83444c62648ab6f4335cfa792ad29e17041cb","observation_id":"c7a72a24-b16b-4d8f-ae7a-61302ed27a6f","resolution":{"observed_at":"2026-08-07T14:24:15.883639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00578","last_updated":"2024-03-31T06:55:12Z","snapshot_observed_at":"2026-07-06T17:53:35.219482Z","submitted_at":"2024-03-31T06:55:12Z","title":"M3D: Advancing 3D Medical Image Analysis with Multi-Modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00578","snapshot_observed_at":"2026-08-07T14:24:10.371955Z","title":"arXiv preprint arXiv:2404.00578 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:10.371955Z"},"links":{"cited_paper":"/paper/2404.00578","citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:8e825957ac32ae9395633ce60577d84999cb40da775d83b359888957610b0b25","observation_id":"5d681346-a2ad-4700-910d-eed18fd9a76b","resolution":{"observed_at":"2026-08-07T14:24:10.371955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:15.626230Z","title":null,"venue":null,"work_id":"0cf06f6f-fa60-4bb7-a129-caf0d6d6fdeb","year":2023},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:10.493787Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:55946b571cf1513446c078391ea854378f75cff4f0e9ee6391239acd1fd037db","observation_id":"025a1d10-0b39-41c9-9cc0-e42556521ae7","resolution":{"observed_at":"2026-08-07T14:24:15.703492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:15.417778Z","title":"Biological psychiatry: cognitive neuroscience and neuroimaging1(3), 230–244 (2016)","venue":null,"work_id":"93dff3d7-cbeb-4f65-8e60-db8d053f0cda","year":2016},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:10.632153Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:e7efc36dc7fcc7ef913f57fd8bdfe4bcf40fcf8c420f7f2b193b06869a234c4e","observation_id":"ffdc48f3-5f7b-4508-be56-2f31a66e7b3a","resolution":{"observed_at":"2026-08-07T14:24:15.526172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.773576Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:10.773576Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:b94c37f0ce47f9cb87a64e19687e30887a1364af53fb40de3f2010ca0434291c","observation_id":"1c3fd77f-f21f-4e5e-b8fd-e07fd1824b3d","resolution":{"observed_at":"2026-08-07T14:24:10.773576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:24:10.907291Z","title":"arXiv preprint arXiv:2410.21276 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:10.907291Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:509f48c3485d14d339ab30a89daa01bf367a3d96a8a2578c0315610ccc17c826","observation_id":"aee9ebf1-8ec0-4a20-9825-d405e1a28756","resolution":{"observed_at":"2026-08-07T14:24:10.907291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:15.192486Z","title":"Radiology: Artificial Intelligence5(1), e220047 (2023)","venue":null,"work_id":"3cf35c7a-712c-4874-a018-4ce400c674d5","year":2023},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:11.049661Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:a919fe3d9dbe25156f1093669b2cc24a301c69ac9a648e24ade04eb10a4088e8","observation_id":"2c342d75-a7d0-49f1-889d-248d13e2b1b7","resolution":{"observed_at":"2026-08-07T14:24:15.266171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.984073Z","title":"Transactions on Machine Learning Research 2024 (2024), https://openreview.net/forum?id=skLtdUVaJa","venue":null,"work_id":"ef5f909b-f331-4864-85f4-014a9d542d0a","year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:11.166673Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:937941bb5cfcdcaf06bec8bee63a547471cfc945dcc29c40539831b28f070025","observation_id":"f97a701f-c6ff-4342-8d1f-dd7be612bf25","resolution":{"observed_at":"2026-08-07T14:24:15.099908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.817937Z","title":"Archives of neurology66(10), 1254–1259 (2009)","venue":null,"work_id":"d1ec3fdd-68d3-4b36-b294-d8c33c4b5a45","year":2009},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:11.284080Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:c007682d319cbca1c60d09592aa96827ecd6ac8aaa879f721fd7c6d17c4a83b1","observation_id":"25d5fc71-13dd-4f49-be02-eaed059b0ca6","resolution":{"observed_at":"2026-08-07T14:24:14.898592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.624515Z","title":"Nature Machine Intelligence3(4), 288–298 (2021)","venue":null,"work_id":"21fbccf4-fd59-46f3-999d-181b2bdf908c","year":2021},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:11.370365Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:efb4d328c8a37749f68b52519d94af68a51cf3154b14983ee6cc1ab7af3cc907","observation_id":"306052f8-c750-4d47-a850-b86dc2893e7f","resolution":{"observed_at":"2026-08-07T14:24:14.709365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.501957Z","title":"Scientific data 5(1), 1–10 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:11.501957Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:4843d2a335ff530274ffd74c3b77b59f450b05ffbf3c979f0d74ec5ffe348f22","observation_id":"17feca68-e54e-4282-a59d-d5b7bef384f7","resolution":{"observed_at":"2026-08-07T14:24:11.501957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.611023Z","title":"Advances in Neural Information Processing Systems36 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:11.611023Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:a9d4a3ab02467aa392c663ad6c2bf48878c7838910313fcbddb76001dd433f17","observation_id":"d05d9b3c-decd-4bea-bc2b-3aa238472727","resolution":{"observed_at":"2026-08-07T14:24:11.611023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.435846Z","title":"In: Benchmarking, Measur- ing, and Optimizing: Third BenchCouncil International Symposium, Bench 2020, 10 X","venue":null,"work_id":"7fdb71ef-e1b4-460d-869b-0ff46e5c3188","year":2021},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:11.730335Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:1dbc3420a8a63f14e6e9a3838d05fde349e31fe04f7e13e5832f8fee7ebb4e93","observation_id":"86b06bad-a99f-4dfb-8562-aa8fbd802b5e","resolution":{"observed_at":"2026-08-07T14:24:14.491820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.870901Z","title":"Advances in neural information processing systems36 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:11.870901Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:673e15edc0a9029cb01e18f12df3700064c35f3ee4a54467722658fd5407322c","observation_id":"820bac15-5f05-4bf5-91b3-f4a328a81309","resolution":{"observed_at":"2026-08-07T14:24:11.870901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11833","last_updated":"2024-10-29T12:34:11Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:47Z","title":"MMDU: A Multi-Turn Multi-Image Dialog Understanding Benchmark and Instruction-Tuning Dataset for LVLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11833","snapshot_observed_at":"2026-08-07T14:24:11.997396Z","title":"URL https://arxiv","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:11.997396Z"},"links":{"cited_paper":"/paper/2406.11833","citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:5b3119d89a92ceed74145af34fb45946f3fe9f9464b91c5f58e481650aa57bf6","observation_id":"09a076c8-e187-4eee-a58b-a509c02c1004","resolution":{"observed_at":"2026-08-07T14:24:11.997396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-05T16:51:32.094151Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-07T14:24:12.107542Z","title":"arXiv preprint arXiv:2403.05525 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:12.107542Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:264b4494fdedf94d66d9b77325e1c070a4f2a09e5b7ea5a0467666f871b13316","observation_id":"96e66d03-94e0-4e53-aca7-5f26a7acac5c","resolution":{"observed_at":"2026-08-07T14:24:12.107542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02718","last_updated":"2024-08-05T17:56:41Z","snapshot_observed_at":"2026-07-06T18:57:09.545013Z","submitted_at":"2024-08-05T17:56:41Z","title":"MMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02718","snapshot_observed_at":"2026-08-07T14:24:12.189818Z","title":"arXiv preprint arXiv:2408.02718 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:12.189818Z"},"links":{"cited_paper":"/paper/2408.02718","citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:4bef1a2dd067357cc8317b46441a5f8d4f6dac2032419ee5c9fb8f97e3b6ace8","observation_id":"d293c135-9ec3-4d29-b091-a03a1a1b1634","resolution":{"observed_at":"2026-08-07T14:24:12.189818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.319913Z","title":"In: Machine Learning for Health (ML4H)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:12.319913Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:604a7b163d050305375a4db69c5e7e8709eecd58be59c600eeb391219cff2023","observation_id":"6e302729-daf7-45f2-841b-99a6399dfc97","resolution":{"observed_at":"2026-08-07T14:24:12.319913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.256810Z","title":"Nature communications 13(1), 4566 (2022)","venue":null,"work_id":"d1af6f78-c748-40d7-be97-eb5bcc03365d","year":2022},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:12.441876Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:35a4963dfb828c84da5870c9570bc6b44f89e9cb2cad31f856f3013a184e329d","observation_id":"2d5b2357-880a-4743-b83e-447329e2b090","resolution":{"observed_at":"2026-08-07T14:24:14.346533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.071405Z","title":"BMC Pulmonary Medicine 20, 1–9 (2020)","venue":null,"work_id":"1e493f57-cf00-4842-bc11-17d0dbd2ea2d","year":2020},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:12.574854Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:1410fbb99f5e1f6e5714b115d8aed7542a55fe34fae793ef174fef6be1dd14dd","observation_id":"7bb5efd9-b31c-4b48-962a-b9154d48d5fc","resolution":{"observed_at":"2026-08-07T14:24:14.169298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.883288Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"8373282b-6afd-4f78-977e-08c627719847","year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:12.704747Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:3beb47e564509e0887043d8aba1bd236f2a0947581879773a068eed45eefc0b2","observation_id":"8d983b9b-b40e-4819-b24b-941264ec9c48","resolution":{"observed_at":"2026-08-07T14:24:13.986290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.701200Z","title":"In: The Thirty-eighth An- nual Conference on Neural Information Processing Systems","venue":null,"work_id":"75853edc-c70b-44fa-8442-dddba9dcd8c1","year":null},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:12.831889Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:ac473697cf4ec4a199a7254dfffe04d7e6d85c1ba75cc221492b87f9bfd6c2a5","observation_id":"30b2d87d-8990-4fea-9def-7b0ea24c755b","resolution":{"observed_at":"2026-08-07T14:24:13.809310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.536091Z","title":"Scientific data9(1), 768 (2022)","venue":null,"work_id":"cfd3badb-3033-41d4-86d6-43a161ad2f81","year":2022},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:12.918590Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:af53301518bd38398fc0f096d449d3c937e1bbf9770ce6a2c6c261845fd20321","observation_id":"6d4c5e61-8b59-41c8-bc7e-73dcb6d278d0","resolution":{"observed_at":"2026-08-07T14:24:13.609934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02463","last_updated":"2023-11-16T12:38:46Z","snapshot_observed_at":"2026-08-07T10:41:28.201668Z","submitted_at":"2023-08-04T17:00:38Z","title":"Towards Generalist Foundation Model for Radiology by Leveraging Web-scale 2D&3D Medical Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02463","snapshot_observed_at":"2026-08-07T14:24:13.004322Z","title":"arXiv preprint arXiv:2308.02463 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:13.004322Z"},"links":{"cited_paper":"/paper/2308.02463","citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:ccd3c5758f08dc5bf8a3bc7210db51fb262c94da6890c36d48ab6c652becde1f","observation_id":"ebd5d5bf-00b3-49cd-9d89-424a19521f26","resolution":{"observed_at":"2026-08-07T14:24:13.004322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.351323Z","title":"In: Proceedings of the 41st International Conference on Machine Learning","venue":null,"work_id":"4e9ed352-17cd-43e0-aa72-458256a9af72","year":2024},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:13.073032Z"},"links":{"citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:eb1bca84ba780dcdf561e0fd2531333bc2c087b0fbc1c3af85eccc492d6cdded","observation_id":"074a5f24-eda1-4e78-b2eb-e653be5b2fe9","resolution":{"observed_at":"2026-08-07T14:24:13.461879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10415","last_updated":"2024-09-08T01:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:50:16Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10415","snapshot_observed_at":"2026-08-07T14:24:13.175284Z","title":"arXiv preprint arXiv:2305.10415 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:13.175284Z"},"links":{"cited_paper":"/paper/2305.10415","citing_paper":"/paper/2505.19031"},"observation_digest":"sha256:d1d06bdecdf260b1416cac4f3a6ce88d2227d81215469dea4c85aec2e486030d","observation_id":"337ab775-8800-4d24-b14b-6e4fc401f9d2","resolution":{"observed_at":"2026-08-07T14:24:13.175284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19031","last_updated":"2025-05-25T08:31:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:53:43.098860Z","submitted_at":"2025-05-25T08:31:22Z","title":"Medical Large Vision Language Models with Multi-Image Visual Ability"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2505.19031."}