Pith. sign in

Paper Citation Record · LEDGER

Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2306.03030.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2306.03030 v3

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 8 of 8 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 8 of 8 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T11:27:14.817392Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-02T19:57:19.013998Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation b040dc8a-ab98-4fea-91b5-2692441fa5bc · inbound

Pruning General Large Language Models into Customized Expert Models cites this paper.

Pruning General Large Language Models into Customized Expert Models Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T11:27:14.817392Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T11:27:14.817392Z digest=sha256:e08306a56d219fbd8595f157927708f3370537338c57a1ddc4f8e2d3033b78cf

Observation af74d540-bebd-48dc-b5e1-7345a0cdcffa · inbound

Training-free LLM Merging for Multi-task Learning cites this paper.

Training-free LLM Merging for Multi-task Learning Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T00:59:43.421977Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T00:59:43.421977Z digest=sha256:e7a2af4d50da906b8ad7ee0954f817b38b1e257426aa430369009d9b77385d8c

Observation d7748025-a35f-4884-a999-4929bb2584cc · inbound

Prediction-Powered Risk Monitoring of Deployed Models for Detecting Harmful Distribution Shifts cites this paper.

Prediction-Powered Risk Monitoring of Deployed Models for Detecting Harmful Distribution Shifts Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Reference 3130

Resolution
unresolved
no resolver link, observed 2026-08-03T05:30:50.689747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:30:50.689747Z digest=sha256:a0692b8130e0258b456c1f7c0af83105e18b5ea119ffb9ddeb50294ec8e107a5

Observation 70a5d587-e9a0-426c-ab6a-dba39405ed1e · inbound

MedThink: Enhancing Diagnostic Accuracy in Small Models via Teacher-Guided Reasoning Correction cites this paper.

MedThink: Enhancing Diagnostic Accuracy in Small Models via Teacher-Guided Reasoning Correction Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Reference 23

Resolution
verified exact
arxiv_id, observed 2026-05-12T08:01:31.866559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-12T01:22:15.608348Z digest=sha256:1c100b531ee623624e7572b669d116adbf8df0221317155b8e369ddf38329eac

Observation 00dbe29a-eb37-4939-9d97-dd3f72da20c3 · inbound

Clinically Structured Rank-Gated LoRA for Cross-Benchmark Medical Question Answering cites this paper.

Clinically Structured Rank-Gated LoRA for Cross-Benchmark Medical Question Answering Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-07-01T10:05:41.004721Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-07-01T05:53:55.141657Z digest=sha256:b2d7fc3cd0df80cb56b8fb9146b1d38c81951bac651fd1c6c3c4707354362a2e

Observation 30a8fc90-3bbf-4b88-ae92-65ed477bc119 · inbound

Clinically Structured Rank-Gated LoRA for Cross-Benchmark Medical Question Answering cites this paper.

Clinically Structured Rank-Gated LoRA for Cross-Benchmark Medical Question Answering Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-07-02T19:57:19.015860Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-07-02T19:53:25.252752Z digest=sha256:badc9be8f1b4c48a97b3d49c90c6a9bcfda099e3a6c170095ff0534e7e43b7f9

Observation 661448f3-47e5-4a24-938a-a50081019ed6 · inbound

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation cites this paper.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Reference 16

Resolution
unresolved
no resolver link, observed 2026-07-13T05:07:42.040673Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T05:07:42.040673Z digest=sha256:489f93646390dfac03bcb48f9a6a127fc24784a3b950c9af4b65af87fa6cb7fe

Observation 8294e180-58e9-43c2-a5cb-53108082f788 · inbound

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation cites this paper.

MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T07:43:27.681801Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:43:27.681801Z digest=sha256:2370ef49f0a96c6bf92638fa58607ddeecf779e120e06ba56c1938f7fe4aa304