{"as_of":"2026-08-20T09:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f6473d2922c712815c7314c0382ae735b170681e021d4c28d1619050250ce76a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:01:39.697849Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T12:56:57.641234Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-12T15:16:27.659001Z","title":"Gmai-mmbench: A comprehensive mul- timodal evaluation benchmark towards general medical ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14522","last_updated":"2025-03-27T15:24:29Z","snapshot_observed_at":"2026-08-16T07:36:40.507887Z","submitted_at":"2024-11-21T18:59:36Z","title":"GMAI-VL & GMAI-VL-5.5M: A Large Vision-Language Model and A Comprehensive Multimodal Dataset Towards General Medical AI","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:16:27.659001Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2411.14522"},"observation_digest":"sha256:77291e11f445017e364330c126a9c8550167f57dfb043909affa1f54fa23a31f","observation_id":"9992be07-b41d-4250-8c0d-7bb53dc2a890","resolution":{"observed_at":"2026-08-12T15:16:27.659001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-12T14:31:37.234152Z","title":"Gmai-mmbench: A comprehensive multimodal evaluation benchmark towards general medical ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15296","last_updated":"2024-12-08T04:24:31Z","snapshot_observed_at":"2026-08-18T21:58:09.907460Z","submitted_at":"2024-11-22T18:59:54Z","title":"MME-Survey: A Comprehensive Survey on Evaluation of Multimodal LLMs","version":2},"reference_index":130,"source":"pdf_text","source_observed_at":"2026-08-12T14:31:37.234152Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2411.15296"},"observation_digest":"sha256:721660344623a975aea1d6b38b3c398beb997340b59b7f33d98dcc851a04ef51","observation_id":"653d52f7-f8b6-4a0d-9ffd-b65b81a91141","resolution":{"observed_at":"2026-08-12T14:31:37.234152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-10T23:10:33.010777Z","title":"GMAI-MMBench: A comprehensive multimodal evaluation benchmark towards general medical AI,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20927","last_updated":"2024-12-30T13:16:08Z","snapshot_observed_at":"2026-08-17T16:23:04.534730Z","submitted_at":"2024-12-30T13:16:08Z","title":"Enhanced Multimodal RAG-LLM for Accurate Visual Question Answering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T23:10:33.010777Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2412.20927"},"observation_digest":"sha256:10ce890befd127f5fe0aad0cde782c3bcd1f8798d1cbd77d9ffa251be9278dd4","observation_id":"c0c409ec-f4cd-4254-b5ac-a23523ad3eec","resolution":{"observed_at":"2026-08-10T23:10:33.010777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-10T18:24:41.806356Z","title":"Gmai-mmbench: A comprehensive multimodal evaluation benchmark towards general medical ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.11347","last_updated":"2025-03-15T02:35:48Z","snapshot_observed_at":"2026-08-15T06:37:59.261620Z","submitted_at":"2025-01-20T09:12:06Z","title":"EndoChat: Grounded Multimodal Large Language Model for Endoscopic Surgery","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T18:24:41.806356Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2501.11347"},"observation_digest":"sha256:983331a7ede920a411ba04a35e27c149ee6fed8d652372321262c78bcf7202f5","observation_id":"05c95cc0-e522-4712-a287-87ecab6a8ef2","resolution":{"observed_at":"2026-08-10T18:24:41.806356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-07T20:55:05.830828Z","title":"Gmai- mmbench: A comprehensive multimodal evaluation benchmark towards general medical ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09696","last_updated":"2026-07-07T14:07:33Z","snapshot_observed_at":"2026-08-15T16:05:00.957009Z","submitted_at":"2025-02-13T18:59:11Z","title":"ZeroBench: An Impossible Visual Benchmark for Contemporary Large Multimodal Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T20:55:05.830828Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2502.09696"},"observation_digest":"sha256:545cad84f41b6ded48aa802f2f1610ff8dcdfb668b694e0b69a8f783c5022867","observation_id":"1536fbc9-d5a1-4d3d-bd9a-969cd4e1f9d7","resolution":{"observed_at":"2026-08-07T20:55:05.830828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-16T11:01:39.697849Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16727","last_updated":"2025-06-02T17:24:17Z","snapshot_observed_at":"2026-08-17T08:58:05.249052Z","submitted_at":"2025-04-23T14:01:32Z","title":"Unveiling the Lack of LVLM Robustness to Fundamental Visual Variations: Why and Path Forward","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T11:01:39.697849Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2504.16727"},"observation_digest":"sha256:76e7a3edfdacd74f98f711b96bc0cca0e0fe693d74c53c5dd695c109da618bd8","observation_id":"ba242164-361b-49a3-96e9-e71874d61941","resolution":{"observed_at":"2026-08-16T11:01:39.697849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-15T23:45:13.590280Z","title":"J., He, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04653","last_updated":"2025-05-06T20:52:01Z","snapshot_observed_at":"2026-08-18T21:37:46.244199Z","submitted_at":"2025-05-06T20:52:01Z","title":"Advancing Conversational Diagnostic AI with Multimodal Reasoning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T23:45:13.590280Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2505.04653"},"observation_digest":"sha256:a77c48c4e07b72bff9c2d300c9e7aac6538abb17b0b1beb9cf19e76c5e7e409a","observation_id":"6b9d6fb6-13d8-487f-bef0-ce7d69091723","resolution":{"observed_at":"2026-08-15T23:45:13.590280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-15T20:21:14.656584Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13220","last_updated":"2025-05-19T15:02:59Z","snapshot_observed_at":"2026-08-18T23:48:51.883758Z","submitted_at":"2025-05-19T15:02:59Z","title":"SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:21:14.656584Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2505.13220"},"observation_digest":"sha256:21f4a04a6829c9aa4cbe48a20e15a9ccfe0350ec7b05590e6ef08a3c1f4e07b0","observation_id":"3b84247e-1e81-463f-b92d-a5e0a6498418","resolution":{"observed_at":"2026-08-15T20:21:14.656584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-07T12:01:02.897723Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00855","last_updated":"2025-06-01T06:28:36Z","snapshot_observed_at":"2026-08-16T02:03:31.506594Z","submitted_at":"2025-06-01T06:28:36Z","title":"MedBookVQA: A Systematic and Comprehensive Medical Benchmark Derived from Open-Access Book","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:02.897723Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2506.00855"},"observation_digest":"sha256:4e1df80a5064b66665d7cf9f3a082f9cc4701a467a867c5ef3d009ecc9502bb2","observation_id":"1119b38b-4acd-4913-b05a-11710da19228","resolution":{"observed_at":"2026-08-07T12:01:02.897723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-07T11:04:33.269754Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-14T01:13:13.516591Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.269754Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:5e5b250324055319a21e74ed9ca8f5d55d2c98347382a214ff1cf481fe36e24b","observation_id":"faf179a8-d2c9-4552-931e-acdd0bd8466a","resolution":{"observed_at":"2026-08-07T11:04:33.269754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-07T00:48:12.685232Z","title":"https: //uni-medical.github.io/GMAI-MMBench.github.io/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12594","last_updated":"2025-06-14T18:19:05Z","snapshot_observed_at":"2026-08-16T02:27:50.910548Z","submitted_at":"2025-06-14T18:19:05Z","title":"A Comprehensive Survey of Deep Research: Systems, Methodologies, and Applications","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:12.685232Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2506.12594"},"observation_digest":"sha256:567135eac7a9b6cbcf61453f02bbda2a3d92ccb8ad922440a0264a7b1f46ab1d","observation_id":"8cae3ded-b0c8-4b9c-94d9-bffe5b453791","resolution":{"observed_at":"2026-08-07T00:48:12.685232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-06T14:51:09.584692Z","title":"Gmai-mmbench: A comprehensive mul- timodal evaluation benchmark towards general medical ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17539","last_updated":"2025-07-23T14:19:30Z","snapshot_observed_at":"2026-08-15T10:28:53.898287Z","submitted_at":"2025-07-23T14:19:30Z","title":"Constructing Ophthalmic MLLM for Positioning-diagnosis Collaboration Through Clinical Cognitive Chain Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:09.584692Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2507.17539"},"observation_digest":"sha256:ce7d1bc1733812de24abda96ad656ef0a015d992c76c16e5b3a2b27f1e441f29","observation_id":"dbda4ea0-345f-4754-8794-444549350d65","resolution":{"observed_at":"2026-08-06T14:51:09.584692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-03T09:35:26.655659Z","title":"J., 2, He, J., 1, Qiao, Y., 1, Shanghai AI Laboratory, University of Washington, Monash University,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.17037","last_updated":"2026-06-23T18:08:52Z","snapshot_observed_at":"2026-08-03T09:35:21.823477Z","submitted_at":"2026-01-20T00:06:58Z","title":"AMVICC: A Novel Benchmark for Cross-Modal Failure Mode Profiling for VLMs and IGMs","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-03T09:35:26.655659Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2601.17037"},"observation_digest":"sha256:19437f2024f40fb77c8d785866d6b32c9054263809eedafabd120b9ce0d73a45","observation_id":"301888e4-a610-4cda-8fa9-3cbee294a3ef","resolution":{"observed_at":"2026-08-03T09:35:26.655659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":"2408.03361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-07-02T12:56:57.641234Z","title":"Gmai-mmbench: A comprehensive multimodal evaluation benchmark towards general medical ai","venue":null,"work_id":"2538daae-c67f-4c55-8add-85bb38d41a2e","year":2024},"citing_paper":{"arxiv_id":"2605.05810","last_updated":"2026-05-07T07:46:17Z","snapshot_observed_at":"2026-08-19T08:23:05.603971Z","submitted_at":"2026-05-07T07:46:17Z","title":"CXR-ContraBench: Benchmarking Negated-Option Attraction in Medical VLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T14:49:53.357083Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2605.05810"},"observation_digest":"sha256:b271f1d771632da234ed2f94ba8b4d50a3e87714a817ba464a9413953f0db5fb","observation_id":"4048306c-be35-42aa-bd1a-50e78abf1bcc","resolution":{"observed_at":"2026-05-11T18:41:09.736536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":"2408.03361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-07-02T12:56:57.641234Z","title":"Gmai-mmbench: A comprehensive multimodal evaluation benchmark towards general medical ai","venue":null,"work_id":"2538daae-c67f-4c55-8add-85bb38d41a2e","year":2024},"citing_paper":{"arxiv_id":"2606.06696","last_updated":"2026-06-04T20:24:47Z","snapshot_observed_at":"2026-07-06T23:46:28.942186Z","submitted_at":"2026-06-04T20:24:47Z","title":"MMBU: A Massive Multi-modal Biomedical Understanding Benchmark to Probe the Perception Capabilities of Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T01:39:30.851276Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2606.06696"},"observation_digest":"sha256:d84a61722aa583976bcbb8c32ef1f5ba0b1b07c3450b41d0c24d0f564d6840f3","observation_id":"361d4519-3a74-4f49-a9bf-5a7e8b7e51c7","resolution":{"observed_at":"2026-07-02T12:56:57.642951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-07-13T05:07:42.040673Z","title":"GMAI-MMBench: A comprehensive multimodal evaluation benchmark towards general medical ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09142","last_updated":"2026-07-16T10:17:24Z","snapshot_observed_at":"2026-08-19T05:44:19.673550Z","submitted_at":"2026-07-10T06:52:05Z","title":"MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T05:07:42.040673Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2607.09142"},"observation_digest":"sha256:252f70f2220fb7015297652930a6eac87f061834a26f78e2dcd0b877003a0e8f","observation_id":"e0052204-d841-44ec-97ea-fc217cd4c0cc","resolution":{"observed_at":"2026-07-13T05:07:42.040673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-02T07:43:30.865915Z","title":"GMAI-MMBench: A comprehensive multimodal evaluation benchmark towards general medical ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09142","last_updated":"2026-07-16T10:17:24Z","snapshot_observed_at":"2026-08-19T05:44:19.673550Z","submitted_at":"2026-07-10T06:52:05Z","title":"MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T07:43:30.865915Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2607.09142"},"observation_digest":"sha256:470c2fddddc9efb593fd4b341136d05b8baceb20f79fba75ad1f3568301c1801","observation_id":"3021863a-813b-46d5-95f9-a8515395b7e7","resolution":{"observed_at":"2026-08-02T07:43:30.865915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-02T13:52:07.866376Z","title":"GMAI-MMBench: A comprehensive multimodal evaluation benchmark towards general medical AI.arXiv preprint arXiv:2408.03361, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20462","last_updated":"2026-05-16T08:16:08Z","snapshot_observed_at":"2026-08-18T21:40:44.057807Z","submitted_at":"2026-05-16T08:16:08Z","title":"Marking the Wrong Symptoms: Evaluating LLM Watermarks in Medical Texts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T13:52:07.866376Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2607.20462"},"observation_digest":"sha256:9ce73bcebf532eba4464e034832ae4634a9611921e034fb24bbd31911424b36f","observation_id":"0c79f66d-e09c-4af3-a27e-78e5f01b2b7f","resolution":{"observed_at":"2026-08-02T13:52:07.866376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-01T05:36:45.204851Z","title":"GMAI-MMBench: A comprehensive multimodal evaluation benchmark towards general medical AI.arXiv preprint arXiv:2408.03361, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27566","last_updated":"2026-07-30T01:19:28Z","snapshot_observed_at":"2026-08-15T14:29:56.265537Z","submitted_at":"2026-07-30T01:19:28Z","title":"Objective-Aligned Direct Answer SFT for Robust Multi-Frame Medical VQA","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T05:36:45.204851Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2607.27566"},"observation_digest":"sha256:9edce2306c3d344fa8869b15a49168fba045d8b1ff089909bdb85d579cc41fc7","observation_id":"2246ef7e-d5c6-45be-bcc4-6ebde0bb7290","resolution":{"observed_at":"2026-08-01T05:36:45.204851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-14T14:04:08.989376Z","title":"arXiv preprint arXiv:2408.03361 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13309","last_updated":"2026-08-13T14:35:20Z","snapshot_observed_at":"2026-08-20T04:36:28.157750Z","submitted_at":"2026-08-13T14:35:20Z","title":"How Good are Foundation Models in Longitudinal MRI Disease Progression Reasoning?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:04:08.989376Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2608.13309"},"observation_digest":"sha256:1cb1287fb8eb1fc0e467f538f5718e5ab1ca188736c79ef4e70236a6ee48ac1a","observation_id":"90755ed4-8b29-4e2b-bfcf-421995badfa9","resolution":{"observed_at":"2026-08-14T14:04:08.989376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2408.03361/citation-record","integrity":"/paper/2408.03361/integrity","json":"/paper/2408.03361/citation-record.json","paper":"/paper/2408.03361"},"outbound":[],"paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","latest_version":7,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-16T13:28:08.884972Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2408.03361."}