Pith. sign in

Paper Citation Record · LEDGER

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation

As of 6 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2607.09142.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.09142 v3

Coverage vector

measured 60 of 60 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T07:43:33.938358Z

measured 60 of 60 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-06T06:34:29.942622+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

60 of 60 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved59
  • parse uncertain1
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 6a1ad8a4-881d-46b2-8649-94a2b439bebc · outbound

This paper cites Digital health market statistics 2026: Market size, investment and user adoption, 2026.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Digital health market statistics 2026: Market size, investment and user adoption, 2026

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:25.688712Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:25.688712Z digest=sha256:7123e73ad25c0781407a04b274e3a30b5b5a4a53e4632989b5477fd31a5ea314

Observation eee4d6a4-b9de-4afc-ae16-2833153e5602 · outbound

This paper cites Telemedicine and AI in healthcare: Top platforms, trends & 2026 outlook.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Telemedicine and AI in healthcare: Top platforms, trends & 2026 outlook

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:25.786509Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:25.786509Z digest=sha256:b1e466ab731fe2b930ecfddbd2c8a14a6f14782160150519e2d2a37c8aed4828

Observation 876d928c-fc1c-4adf-9ce4-4963652761ec · outbound

This paper cites Annual results announcement for the year ended december 31, 2025.HKEXnews,.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Annual results announcement for the year ended december 31, 2025.HKEXnews,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:25.910724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:25.910724Z digest=sha256:10dd60424fc7c6f76d32d7ce8ac40f657831c8e9c6a0f0721b13351ca95ecdac

Observation 73599099-f7c4-40ec-b3a6-f37940c1d36d · outbound

This paper cites Jd health introduces groundbreaking LLM-powered suite for comprehensive online and in-hospital healthcare scenarios.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Jd health introduces groundbreaking LLM-powered suite for comprehensive online and in-hospital healthcare scenarios

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:26.122716Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:26.122716Z digest=sha256:ced0c121d1a3a02d20912e048602494e07ed4a8809b417473f4b8e639d1a8bbf

Observation ff60bbc3-5ecb-4029-8655-37e3fc8bcbc0 · outbound

This paper cites Large language models in medicine.Nature Medicine, 29(8):1930–1940, 2023.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Large language models in medicine.Nature Medicine, 29(8):1930–1940, 2023

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:26.257849Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:26.257849Z digest=sha256:f913b7a10367852f035a078573466af6e803a645f609c35ea72cef64a0dbbd4f

Observation 432496d1-5fcf-4220-99ca-6085f0d7f763 · outbound

This paper cites The effect of using a large language model to respond to patient messages.The Lancet Digital Health, 6(6):e379–e381, 2024.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation The effect of using a large language model to respond to patient messages.The Lancet Digital Health, 6(6):e379–e381, 2024

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:26.413588Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:26.413588Z digest=sha256:0401848c3bb5b66a146ca36183febfdab55c9153e75ae416aea275bf57645c1e

Observation 181fbc43-a92c-4a1f-afac-30ed9ebc589b · outbound

This paper cites Sara Mahdavi, Sushant Prakash, Anupam Pathak, Christopher Semturs, Shwetak Patel, Dale R.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Sara Mahdavi, Sushant Prakash, Anupam Pathak, Christopher Semturs, Shwetak Patel, Dale R

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:26.523483Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:26.523483Z digest=sha256:176f989d915442d0fbafd0bc22a140dfd058d3b610baab529cba4ea289139db5

Observation 0918ed26-4579-4a86-a3b7-4623dd1e138a · outbound

This paper cites PubMedQA: A Dataset for Biomedical Research Question Answering.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation PubMedQA: A Dataset for Biomedical Research Question Answering

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:26.664483Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:26.664483Z digest=sha256:468640e76133719b21a39629d2a34aaa12b92b82de94e0281417bd0acea64943

Observation e177c21c-8e1e-4394-a07f-0a66afc3b90b · outbound

This paper cites What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:26.823891Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:26.823891Z digest=sha256:8bce0e5dcb5e3c2d4483ccc9a2b74baec024a2602cecbda77dcc03cf65d38959

Observation 183fe46d-a841-4df4-9fc0-51fcf547f4ae · outbound

This paper cites MedMCQA : A Large-scale Multi-Subject Multi-Choice Dataset for Medical domain Question Answering.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MedMCQA : A Large-scale Multi-Subject Multi-Choice Dataset for Medical domain Question Answering

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:26.937401Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:26.937401Z digest=sha256:77ffc959e6719a85bdb38ced82c22fb8e11d145c67a738d17f7d1736de05826f

Observation f508afda-9752-4fa1-aa52-4d8214ec7c63 · outbound

This paper cites Large Language Models Encode Clinical Knowledge.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Large Language Models Encode Clinical Knowledge

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:27.075346Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:27.075346Z digest=sha256:3da01e2fc77c0d29c691938d1f2f76e5d50186f5231e6ceed38d25b78e1d4a08

Observation 1870a552-4732-4b07-9ad8-5c25893fe155 · outbound

This paper cites Towards Expert-Level Medical Question Answering with Large Language Models.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Towards Expert-Level Medical Question Answering with Large Language Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:27.233202Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:27.233202Z digest=sha256:edc9feadb763ee02c9aa2984b366cd5b3127ce82b6e81a05418bc69853e8c9db

Observation fbb0743a-4cbf-4d02-9609-232b224dcf38 · outbound

This paper cites CBLUE: A Chinese Biomedical Language Understanding Evaluation Benchmark.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation CBLUE: A Chinese Biomedical Language Understanding Evaluation Benchmark

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:27.362450Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:27.362450Z digest=sha256:8db6036f6a88f1e74f11d97bdeebeccfb61f94a25735ec0518284be6e28517c2

Observation c0434527-5519-4fc2-b6b4-94de581d78a6 · outbound

This paper cites PromptCBLUE: A Chinese Prompt Tuning Benchmark for the Medical Domain.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation PromptCBLUE: A Chinese Prompt Tuning Benchmark for the Medical Domain

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:27.511156Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:27.511156Z digest=sha256:91e8616876b1bb8f514b4856e76fb098d6dc275aa84cb1b2263fc81526145cbb

Observation 8294e180-58e9-43c2-a5cb-53108082f788 · outbound

This paper cites Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:27.681801Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:27.681801Z digest=sha256:0b6f285b3bfd3609f49d9fe179e4744c054478d3d902c5e2405178eda23b1ea8

Observation 0b73336c-7c26-4e88-b773-3f6ccf58c482 · outbound

This paper cites CMB: A Comprehensive Medical Benchmark in Chinese.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation CMB: A Comprehensive Medical Benchmark in Chinese

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:27.798869Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:27.798869Z digest=sha256:8b8846704ef1b2ff21042dc25643d8994a56d916af1932bcb092e226fdd11aea

Observation cde0045c-0945-4411-bed9-9f84f6eb9ca6 · outbound

This paper cites MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:27.951292Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:27.951292Z digest=sha256:1b9a2848e6c8e853bdee58f277691c6f28c794e35fe0d343aae1a05164e8b715

Observation 9341c942-ee09-4468-99a3-3675518a7e40 · outbound

This paper cites MedBench v4: A robust and scalable benchmark for evaluating chinese medical language models, multimodal models, and intelligent agents.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MedBench v4: A robust and scalable benchmark for evaluating chinese medical language models, multimodal models, and intelligent agents

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:28.100984Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:28.100984Z digest=sha256:23c18354c53c992fbe2116bac810d951f10b0f3645434161a6c39a7e98562759

Observation 462b7725-9db1-45be-a48c-cc1c18e7da5d · outbound

This paper cites MedDialog: Two Large-scale Medical Dialogue Datasets.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MedDialog: Two Large-scale Medical Dialogue Datasets

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:28.248603Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:28.248603Z digest=sha256:fdddbc24d1a32d83034cbeac81e4a211c2d492badf327d2fecd72bf112f345b7

Observation d7c0bf2f-8490-46d8-a4f5-388493ca024b · outbound

This paper cites MedDG: An Entity-Centric Medical Consultation Dataset for Entity-Aware Medical Dialogue Generation.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MedDG: An Entity-Centric Medical Consultation Dataset for Entity-Aware Medical Dialogue Generation

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:28.362118Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:28.362118Z digest=sha256:a543313f5fc0e4f1e55cc677ffa690b1f9e2a66ad9cc29d7dcbdc12890e9002e

Observation ed20a62f-3db0-48d9-9903-f9a7e420320e · outbound

This paper cites MediTOD: An English Dialogue Dataset for Medical History Taking with Comprehensive Annotations.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MediTOD: An English Dialogue Dataset for Medical History Taking with Comprehensive Annotations

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:28.563988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:28.563988Z digest=sha256:b40f7d485b4cea9d558b8229a3e7b5ac88e4d11fbf82b7fa066d9c1acef29d78

Observation e3f088dc-644e-4366-b52e-6ba78e64699b · outbound

This paper cites An Automatic Evaluation Framework for Multi-turn Medical Consultations Capabilities of Large Language Models.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation An Automatic Evaluation Framework for Multi-turn Medical Consultations Capabilities of Large Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:28.746413Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:28.746413Z digest=sha256:34e48a340211d62d71f46416bda1b0d0e0fbfe5ff2afcc92c48231195ca67ea7

Observation 310599d4-a556-4d3c-9593-20d0146ef02c · outbound

This paper cites MediQ: Question-Asking LLMs and a Benchmark for Reliable Interactive Clinical Reasoning.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MediQ: Question-Asking LLMs and a Benchmark for Reliable Interactive Clinical Reasoning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:28.926838Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:28.926838Z digest=sha256:de250262f43ca816b85842fc1da93d04b968d9185c6b034fdb45e45e01983363

Observation 3979da11-9bc2-4c55-992e-7e00b5a2271c · outbound

This paper cites AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:29.119519Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:29.119519Z digest=sha256:dbbce049b0336d7085b22f5f3c6065c6ee6b725cd2156c5f1c03101d511c4c75

Observation e5d4cf8c-894c-4615-ac3a-d8e70632fee0 · outbound

This paper cites The dialogue that heals: A comprehensive evaluation of doctor agents’ inquiry capability.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation The dialogue that heals: A comprehensive evaluation of doctor agents’ inquiry capability

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:29.236433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:29.236433Z digest=sha256:9fb013273acb1b85df6c2a8615a0094c87f7b3e4da1c00b954a2d7f7ed7ec4d8

Observation ad75dbaa-267b-446c-91a2-c19939d35b20 · outbound

This paper cites MedConsultBench: A full-cycle, fine-grained, process-aware benchmark for medical consultation agents.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MedConsultBench: A full-cycle, fine-grained, process-aware benchmark for medical consultation agents

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:29.366837Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:29.366837Z digest=sha256:12d4b1f4a8ff9121db8cad3b0ec7f8e51804930334a7332596d9be420a6dd7ee

Observation b918b6c6-5b1a-485e-a607-543c27840528 · outbound

This paper cites MedDialBench: Benchmarking LLM Diagnostic Robustness under Parametric Adversarial Patient Behaviors.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MedDialBench: Benchmarking LLM Diagnostic Robustness under Parametric Adversarial Patient Behaviors

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:29.543299Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:29.543299Z digest=sha256:3b6cf51e1dbfde5d48ce1d7268e940942964d512f943dfb1ae69bd8ad6125a69

Observation 5c28d1b3-da97-4557-b02f-1ee05f199559 · outbound

This paper cites HealthBench: Evaluating Large Language Models Towards Improved Human Health.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation HealthBench: Evaluating Large Language Models Towards Improved Human Health

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:29.669791Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:29.669791Z digest=sha256:ca1f0fb02e33d3f950e3280135635909d53932c921c73faefddb56ebc68f68ed

Observation a3b41ff3-cf2a-498a-841c-860de381de38 · outbound

This paper cites MedDialogRubrics: A comprehensive benchmark and evaluation framework for multi-turn medical consultations in large language models.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MedDialogRubrics: A comprehensive benchmark and evaluation framework for multi-turn medical consultations in large language models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:29.782033Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:29.782033Z digest=sha256:10e92aa3c45bbfe048870c6cfd8c89752ec86760a0490290a996acbf57781462

Observation 03862263-cc3a-4a61-8712-b34e585cd437 · outbound

This paper cites HealthBench Professional: Evaluating Large Language Models on Real Clinician Chats.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation HealthBench Professional: Evaluating Large Language Models on Real Clinician Chats

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:29.880526Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:29.880526Z digest=sha256:4d00ba7fa68e2c373aa1cab1d0898702e4cf234571e022170d1ffae4c80d705e

Observation e3c44edf-094f-4393-b43d-1117baa87024 · outbound

This paper cites LiveMedBench: A contamination-free medical benchmark for llms with automated rubric evaluation.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation LiveMedBench: A contamination-free medical benchmark for llms with automated rubric evaluation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:29.950426Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:29.950426Z digest=sha256:ee24a536b04d7fd30e306f246d7fe23d73ab7c29d00a460ede08833178594c2f

Observation ba18ef32-8a30-44b3-8a64-c2b74b4e3b4e · outbound

This paper cites Pathological Visual Question Answering.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Pathological Visual Question Answering

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:30.054286Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:30.054286Z digest=sha256:aa3316f7d5139b0ca0c712d9fba8fe4242c92aa2c3182d832517b8deabc3deac

Observation 369af46b-79f9-4318-a36d-a07bcb501226 · outbound

This paper cites SLAKE: A Semantically-Labeled Knowledge-Enhanced Dataset for Medical Visual Question Answering.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation SLAKE: A Semantically-Labeled Knowledge-Enhanced Dataset for Medical Visual Question Answering

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:30.225146Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:30.225146Z digest=sha256:ed53db358a20bc0e2090ecc374793b2d64eea0b9f3cd0be9b85dedf3b5d50ab8

Observation f258a7b8-4738-47c0-b000-21122bbb8a47 · outbound

This paper cites PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:30.424951Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:30.424951Z digest=sha256:570ae928f0790ea70be2fa92e77faecc5dbcd815ed11a670e26aa2d91cfd4d39

Observation b3bd1d15-802d-4ec8-9978-b111521d6969 · outbound

This paper cites OmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation OmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:30.666324Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:30.666324Z digest=sha256:8454d10002ff4dcf0eb167753eb47ba495ee71292356abc41794237bb4b6e0b7

Observation 3021863a-813b-46d5-95f9-a8515395b7e7 · outbound

This paper cites GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:30.865915Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:30.865915Z digest=sha256:24677b4c77f40bceaf2e896d00694c46e13f7a085219762aca874f8b0dba96d8

Observation 3b39bde9-9457-408e-8b54-358d48810fcd · outbound

This paper cites 3MDBench: Medical multimodal multi-agent dialogue benchmark.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation 3MDBench: Medical multimodal multi-agent dialogue benchmark

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:31.006709Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:31.006709Z digest=sha256:d8b5fb6d680707f542378b55c0c88e1987dc33ebcab97b307c3d1a5322c27e77

Observation 354b8dcf-1fa4-42c8-97f1-151abf94012e · outbound

This paper cites Bleu: a method for automatic evaluation of machine translation.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Bleu: a method for automatic evaluation of machine translation

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:31.110964Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:31.110964Z digest=sha256:7a96ababa6d1697d16ff7ac84f92c35a4814056d7a2de700840895ae459e4437

Observation d18b794b-8000-48aa-b3d7-4d279717bb7b · outbound

This paper cites ROUGE: A package for automatic evaluation of summaries.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation ROUGE: A package for automatic evaluation of summaries

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:31.410371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:31.410371Z digest=sha256:924b0838edcc5bb1b6548901a43f00547322dd71b33f21981c099028670c556c

Observation 06ee9cf1-7695-493b-bb5d-11eacaead115 · outbound

This paper cites Automated Rubrics for Reliable Evaluation of Medical Dialogue Systems.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Automated Rubrics for Reliable Evaluation of Medical Dialogue Systems

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:31.569388Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:31.569388Z digest=sha256:32754ebd1b92e4e00c8113a1e27a74817ff6b3556d5faccd95e076dead6f9ed5

Observation c2fb55a3-c897-4da8-a337-a77d5b0a6f0d · outbound

This paper cites Deid-gpt: Zero-shot medical text de-identification by gpt-4.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Deid-gpt: Zero-shot medical text de-identification by gpt-4

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:31.765489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:31.765489Z digest=sha256:1af986e0714ae7bddda8fbda9a7c384456edb810540b2c5f268051a0eee55176

Observation c416349b-22aa-4f58-9327-06a7940f1254 · outbound

This paper cites Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:31.943930Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:31.943930Z digest=sha256:f8c07d7e97123d99408f2f5f12a972b43f670905e15dbfc14738b6f96fff7eda

Observation b4e77de7-b0ea-483e-b1da-89d4c3ce8286 · outbound

This paper cites Claude 4 Opus (versions 4.6 and 4.7).

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Claude 4 Opus (versions 4.6 and 4.7)

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:32.184738Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:32.184738Z digest=sha256:fef064dc670cfddef365cf1a95a98d8e9c10b8d36aea71d98185159f1be8cecc

Observation f335b87c-5989-4339-99ad-8c944f2be03d · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Gemini: A Family of Highly Capable Multimodal Models

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:32.274199Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:32.274199Z digest=sha256:97dde6ed8185950f4a5137c217d0aec46ebed9c9e88f090d06b433cd06d913e3

Observation 4477c2c2-fcd2-49a8-b58b-b394231ec60b · outbound

This paper cites Evaluation and mitigation of the limitations of large language models in clinical decision-making.Nature Medicine, 30(9):2613–2622, 2024.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Evaluation and mitigation of the limitations of large language models in clinical decision-making.Nature Medicine, 30(9):2613–2622, 2024

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:32.428880Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:32.428880Z digest=sha256:0cc329cbbce56ab99c1adcb0b7ec2e7f52621c7c08e516123c4c0c352eaa1c58

Observation 8e2217cf-6a56-44d0-a323-8ebf1191b520 · outbound

This paper cites Computing inter-rater reliability and its variance in the presence of high agreement.The British Journal of Mathematical and Statistical Psychology, 61(Pt 1):29–48, May 2008.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Computing inter-rater reliability and its variance in the presence of high agreement.The British Journal of Mathematical and Statistical Psychology, 61(Pt 1):29–48, May 2008

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:32.524263Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:32.524263Z digest=sha256:40a65a83fdef24eb4b9adb895e2213b511dba5947e559bb09fd283923bd70f78

Observation 4483cad1-d5f7-449f-9481-80bd33ee5731 · outbound

This paper cites OpenAI GPT-5 System Card.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation OpenAI GPT-5 System Card

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:32.654513Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:32.654513Z digest=sha256:6e0069e25fc30ca6b63884ee03362c23d191773ea03e31569d50029954e7fdbb

Observation e264408a-9830-4863-818a-3dbf2d558523 · outbound

This paper cites Kimi K2.6: Open-weight trillion-parameter MoE agent model.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Kimi K2.6: Open-weight trillion-parameter MoE agent model

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:32.828616Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:32.828616Z digest=sha256:7d182307ee6a1ea4103d45c60694e9f1dd0c237a67f3a4d263e463065b790bc3

Observation afe5a4f5-1d7d-4b54-98e0-74245ae93649 · outbound

This paper cites Kimi K2.5: Visual Agentic Intelligence.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Kimi K2.5: Visual Agentic Intelligence

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:32.919875Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:32.919875Z digest=sha256:75b13087681bbbd35c87b9c9533ecc4c21a9def8d1b709758d1fcb46fb724a01

Observation 970a2151-1b35-43bd-97e3-5f929883a890 · outbound

This paper cites Qwen3.6-27B and Qwen3.6-35B-A3B.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Qwen3.6-27B and Qwen3.6-35B-A3B

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:33.082950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:33.082950Z digest=sha256:c0e3cd34931355ba1a5e502bd1047038ab288726d55224e34efc46acf9779200

Observation 0082b4cb-43a1-4ea4-952d-5adb8e7403fc · outbound

This paper cites GLM-5: from Vibe Coding to Agentic Engineering.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation GLM-5: from Vibe Coding to Agentic Engineering

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:33.163310Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:33.163310Z digest=sha256:dae0ae4cfa4f6bd987ea865c6aaa0779c4559957981237215dddb077c3279633

Observation b5a2e2d9-9b8f-414f-9671-8936850fe550 · outbound

This paper cites Deepseek-v4: Towards highly efficient million-token context intelligence.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Deepseek-v4: Towards highly efficient million-token context intelligence

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:33.294868Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:33.294868Z digest=sha256:4854c9a19fd43e177c7d4d4c4db78abd6f5ce3120924db6f5be78e91aaf2ae81

Observation 6913a623-f7c6-4faa-a95e-6d8849a9926b · outbound

This paper cites MedGemma Technical Report.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation MedGemma Technical Report

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:33.376539Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:33.376539Z digest=sha256:1fb7b1b0b4d86fe944eb31a32d92c975ce1847c6dbb564a43b2b847215eec221

Observation 6a4e171b-9759-4461-9e21-9b52c520e620 · outbound

This paper cites Lingshu: A Generalist Foundation Model for Unified Multimodal Medical Understanding and Reasoning.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Lingshu: A Generalist Foundation Model for Unified Multimodal Medical Understanding and Reasoning

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:33.468367Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:33.468367Z digest=sha256:d890a50cc40d3577f81b102aed137996d02805c9abf9c1334978e8097b2a9bf9

Observation 36c637cd-853b-4147-8cb6-3d6cbb375d55 · outbound

This paper cites HuatuoGPT-3-32B large language model repository.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation HuatuoGPT-3-32B large language model repository

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:33.592310Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:33.592310Z digest=sha256:2b3bcbf81f5fc4a841efe5812d1bb886903dec827ef21d39ad74a31852f58e6f

Observation d7d60289-1b8a-44f2-825d-fb59cdb324b6 · outbound

This paper cites AntAngelMed medical large language model repository.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation AntAngelMed medical large language model repository

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:33.700922Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:33.700922Z digest=sha256:76dde89bc8566376e5d970fb358db299cff09b772d9a82192b9aada40b71e07a

Observation b90d72ee-6280-46d1-ae02-f1cfaf8a4bf7 · outbound

This paper cites Baichuan-m3: Modeling clinical inquiry for reliable medical decision-making.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Baichuan-m3: Modeling clinical inquiry for reliable medical decision-making

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:33.813874Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:33.813874Z digest=sha256:f427cd30044429f422c0241e9c7f17ff64ffdb408cff085c040868674bd463c7

Observation 43ace38b-6942-4848-ac4b-abb59379089c · outbound

This paper cites Baichuan-M2: Scaling Medical Capability with Large Verifier System.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Baichuan-M2: Scaling Medical Capability with Large Verifier System

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:33.938358Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:33.938358Z digest=sha256:33affeb450500e0c6b6eb4cf3341c4d689bbde191f67dd534a829e12ff0ef445

Observation d307073a-6f3b-4733-b603-53b7b3bc5a33 · outbound

This paper cites an unresolved cited work.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Unresolved cited work

Reference 2002

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:31.271033Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:31.271033Z digest=sha256:094b0908b7e4c8405bb70a4c35fb95596735575cacd3ac8ecfc98f25b60a1147

Observation a08c4839-7f50-40b1-8dca-8061cac79deb · outbound

This paper cites an unresolved cited work.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Unresolved cited work

Reference 2026

Resolution
parse uncertain
no resolver link, observed 2026-08-02T07:43:26.014553Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:26.014553Z digest=sha256:ee499ea8002fceadb3f3b0a742a7a0670ed9340d761039f6db3e48b66fc76728

Pith citing papers

No inbound Pith citation observations are available.