Pith. sign in

Paper Citation Record · LEDGER

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning

As of 21 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2505.21958.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.21958 v1

Coverage vector

measured 61 of 61 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:24:54.786375Z

measured 61 of 61 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

61 of 61 outbound references displayed

  • verified exact1
  • verified fuzzy38
  • unresolved22
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 1d396de4-e817-47f7-b7e9-b7b3b91f1cd5 · outbound

This paper cites Gpt-4 technical report,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Gpt-4 technical report,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:47.810248Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:47.810248Z digest=sha256:81c078e422e6fd2214ceb2667b26ac19381480bee9943988f4d60be9b84de2c2

Observation 65edc37e-dacf-487a-8eb9-0a7a5e2cfabe · outbound

This paper cites The Llama 3 Herd of Models.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning The Llama 3 Herd of Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:47.912259Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:47.912259Z digest=sha256:58127ae49ea0325be96949212f5af0377a087e1c958b375d7f1300439947651a

Observation cd7ad862-6986-472f-b77b-11bafee73dbb · outbound

This paper cites Qwen2.5 Technical Report.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Qwen2.5 Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:48.029236Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:48.029236Z digest=sha256:fdf8b776e066fd8f21cff347e5682fb505f4a954155bd9669ea22342c66f348b

Observation 6f70421c-5b6b-4c09-9be7-b824e314303b · outbound

This paper cites DeepSeek-V3 Technical Report.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning DeepSeek-V3 Technical Report

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:48.220374Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:48.220374Z digest=sha256:c70865a6dd0b111078eda09921bfa0e0f8f048fada77df6314fe2fbad9baf0a1

Observation e12e8ce5-37f8-4164-a3b9-d300194a03cb · outbound

This paper cites A Survey of Large Language Models.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning A Survey of Large Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:48.386623Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:48.386623Z digest=sha256:a4d3b6e598658b0c020c3083465feb59ebc6a7cb5dd299ba80174efdca0dfbfe

Observation ef79f36e-cc32-4260-a0a6-7262ecace4c8 · outbound

This paper cites Biomistral: A collection of open-source pretrained large language models for medical domains,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Biomistral: A collection of open-source pretrained large language models for medical domains,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:03.616908Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:48.492683Z digest=sha256:027e23c2af041f995a99587ea41a4ad9f3e80d4c05e6199f9468f35965fc7411

Observation e1c007bb-fd28-40b1-9964-705e026ebde3 · outbound

This paper cites Finetuned language models are zero-shot learners,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Finetuned language models are zero-shot learners,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:03.398256Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:48.589699Z digest=sha256:92b99ff43fd123fe8f5e1baf9f3213ae2845b69b20c70033d7ac9d79cad9a46e

Observation 18a4122d-9ada-4964-9f35-f92d2e582d6a · outbound

This paper cites Lima: Less is more for alignment,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Lima: Less is more for alignment,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:48.786671Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:48.786671Z digest=sha256:9920a99829fa27d615a87f1f27fa36d9fa1e46b4f5cd52fede42414618d8839e

Observation 1e79c7fe-34f9-426a-82d1-216ead68a4bc · outbound

This paper cites From quantity to quality: Boosting llm performance with self-guided data selection for instruction tuning,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning From quantity to quality: Boosting llm performance with self-guided data selection for instruction tuning,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:03.181655Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:48.905559Z digest=sha256:1d11bd37fcdf6930753fc94cc5623fe2b5373a955d975fd00d0bd0778a3e0efb

Observation 5e7239ec-01b5-4fd5-a0fb-cc8895e06971 · outbound

This paper cites What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:02.906508Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:48.998432Z digest=sha256:9de208621ef8f1e9e4962abd8aff64744c0ceebcd13a5d5d66f30060c8f624b1

Observation 5d0896ea-74f5-4eac-acbb-09cbdd56b144 · outbound

This paper cites Alpagasus: Training a better alpaca with fewer data,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Alpagasus: Training a better alpaca with fewer data,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:02.689668Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:49.147466Z digest=sha256:d3103081a2319583a737a3bccdd319c11411f9cc157eeb77edb197bb6faa48a0

Observation bc27c8c7-6cee-43ac-a8d4-cfe1331a3603 · outbound

This paper cites Selfcheckgpt: Zero-resource black- box hallucination detection for generative large language models,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Selfcheckgpt: Zero-resource black- box hallucination detection for generative large language models,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:02.453053Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:49.352656Z digest=sha256:7fa67b13a446a66394fd1f1e914a638043da669caa787a4d9f9b6ef9dbbb4b62

Observation 5dc06f3a-5663-44c2-9668-c87613474b15 · outbound

This paper cites Knowledge conflicts for llms: A survey,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Knowledge conflicts for llms: A survey,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:02.199183Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:49.490772Z digest=sha256:604f938f77a773f930efdfd0616ec6a79e3a7bc83e6e0a12e739c7be3661d0ea

Observation 15437f69-87e4-47c4-8a42-f433b53ffe59 · outbound

This paper cites Does fine-tuning llms on new knowledge encourage hallucinations?.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Does fine-tuning llms on new knowledge encourage hallucinations?

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:01.960444Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:49.709284Z digest=sha256:49c7f7ed72b868f1a41e87eca9773cba5e5f3ed05c74335b22fdff328b641d6a

Observation 71ed3bde-e1c3-4d1f-9037-9693f270a490 · outbound

This paper cites ConflictBank: A Benchmark for Evaluating the Influence of Knowledge Conflicts in LLM.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning ConflictBank: A Benchmark for Evaluating the Influence of Knowledge Conflicts in LLM

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:49.927620Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:49.927620Z digest=sha256:c1a026b5a3ada1eecda21b9ecec1ee3aaf43cfdfc412807ec54f2e173b4577da

Observation 20f26d8c-0ee4-4337-b606-128bec430268 · outbound

This paper cites Learning or self-aligning? rethinking instruction fine-tuning,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Learning or self-aligning? rethinking instruction fine-tuning,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:01.726250Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:50.066048Z digest=sha256:367db38ea6b70d52994e74459970bc22a24b74e74082d5fc18ba9dfa105c9ba8

Observation 85ba1d44-64d2-42ff-8657-1dcb06f79e16 · outbound

This paper cites A survey of knowledge enhanced pre-trained language models,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning A survey of knowledge enhanced pre-trained language models,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:01.510797Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:50.220681Z digest=sha256:b6841790f7cb3c37a2bc2bcddb3cf11fa16a9d1aeb0f229bf95f7394220f0cdf

Observation 5eda4091-bfb2-4790-a8af-5787af75c4ce · outbound

This paper cites Large language models on graphs: A comprehensive survey,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Large language models on graphs: A comprehensive survey,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:50.367296Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:50.367296Z digest=sha256:3df369a4efcf6f4720e7bf4bc0ed7e5a26879306430d6b0d34776a28c17055ae

Observation 80d4977e-ed01-4933-a43c-c3e0624df5df · outbound

This paper cites Towards making the most of chatgpt for machine translation,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Towards making the most of chatgpt for machine translation,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:01.261007Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:50.459626Z digest=sha256:0ff161967d99e8651262830fefe4b3fb6c9f1518b7227f0ece4d14696db623c4

Observation 5cffbdb6-9366-4ffb-b8c1-5681d168da58 · outbound

This paper cites Prompting large language model for machine translation: A case study,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Prompting large language model for machine translation: A case study,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:50.559887Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:50.559887Z digest=sha256:a118c0f1b88c6c2b50240c96c47941beda7059615581447de0b1d8e2ecb9a722

Observation 9128a127-a49c-4d1e-a2a0-2bb23d176d33 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:50.683598Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:50.683598Z digest=sha256:d519cf388ab23b65749b65bd0c1eda1fe95c44f1f5a33b3d0fafbae1042fa07a

Observation 3420d96c-d2ef-4ba2-8100-5139a36d6b13 · outbound

This paper cites Achieving >97% on GSM8K: Deeply Understanding the Problems Makes LLMs Better Solvers for Math Word Problems.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Achieving >97% on GSM8K: Deeply Understanding the Problems Makes LLMs Better Solvers for Math Word Problems

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:50.840520Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:50.840520Z digest=sha256:71370c1287210f4f6b6194a98f97f94d75aecf77e2fb9b3b57e8b30b8f22e345

Observation 30beb639-c3e1-4cb2-a8b0-12c3c2e6535b · outbound

This paper cites A survey on aspect-based sentiment analysis: Tasks, methods, and challenges,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning A survey on aspect-based sentiment analysis: Tasks, methods, and challenges,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:50.943502Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:50.943502Z digest=sha256:0a29711c1fbc9c6dac9e3d056bb7d66e1bb51e90413c305adaf09c762b546fa5

Observation 56586fd6-958b-4be5-b5c7-139e8b3b30c9 · outbound

This paper cites Knowledge graph augmented network towards multiview representation learning for aspect-based sentiment analysis,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Knowledge graph augmented network towards multiview representation learning for aspect-based sentiment analysis,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:01.045738Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:51.082202Z digest=sha256:09ab8d754a46b40bfa352e5136d2852d65296663a92afb20c7aca27b034d692a

Observation 1aece9e6-f3ae-4bb0-b567-eed7ec9f7405 · outbound

This paper cites Recommender systems in the era of large language models (llms),.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Recommender systems in the era of large language models (llms),

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:00.827993Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:51.217119Z digest=sha256:ae699eec50dd745a2dff4db01f831062697e9c0123b91166206a9e5d0fb587f2

Observation d421b72c-9311-4154-a1ac-09bdb0692777 · outbound

This paper cites Collm: Integrating collaborative embeddings into large language models for rec- ommendation,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Collm: Integrating collaborative embeddings into large language models for rec- ommendation,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:00.623466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:51.388681Z digest=sha256:99558f08137cc46230bc10728bd3d499cb03247c4d4869ba8c41e50ef6b6b326

Observation 9f5a873d-59a6-4d94-8478-78e58550e5b9 · outbound

This paper cites MEDITRON-70B: Scaling Medical Pretraining for Large Language Models.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning MEDITRON-70B: Scaling Medical Pretraining for Large Language Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:51.601388Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:51.601388Z digest=sha256:a2fbabdc98af226621ee9cfd32ff40c0d59706f2845630d58c39cabc129d4737

Observation 93df9939-9697-4f2c-82a1-fa441beea830 · outbound

This paper cites Zhongjing: Enhancing the chinese medical capabilities of large language model through expert feedback and real-world multi-turn dialogue,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Zhongjing: Enhancing the chinese medical capabilities of large language model through expert feedback and real-world multi-turn dialogue,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:00.439690Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:51.700577Z digest=sha256:f5b79a922dafb0c1a32118852fa7c587a5c1c2ca3efc6b3280ada6799487695e

Observation 9983f11c-f683-4774-ab5d-901caadd41ee · outbound

This paper cites AlpaCare:Instruction-tuned Large Language Models for Medical Application.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning AlpaCare:Instruction-tuned Large Language Models for Medical Application

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:51.823893Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:51.823893Z digest=sha256:411a52bd0675ef9358438adae09f82c32bb811d73e4e241a81f0c901cdb70b9b

Observation 30a58653-047e-48ec-a2a3-4fe50789ae20 · outbound

This paper cites Chatdoctor: A medical chat model fine-tuned on a large language model meta-ai (llama) using medical domain knowledge,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Chatdoctor: A medical chat model fine-tuned on a large language model meta-ai (llama) using medical domain knowledge,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:00.220029Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:51.884166Z digest=sha256:c011d3848232af5214858b1ca480ce9a461d16a92ca15c72fe04522f1a8c8552

Observation 9aae50ce-95df-4d2e-9950-8c8d242a8459 · outbound

This paper cites Survey of hallucination in natural language generation,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Survey of hallucination in natural language generation,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:51.963728Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:51.963728Z digest=sha256:76539178735848e32fc7c07a81d9ea7f2221123017fe5d4c6a32121bdfbd2b28

Observation 5be9b78a-ea5b-4fa4-b5da-09b26f18a6bb · outbound

This paper cites AlpaGasus: Training A Better Alpaca with Fewer Data.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning AlpaGasus: Training A Better Alpaca with Fewer Data

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:52.036217Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:52.036217Z digest=sha256:646d6f96c4c7c6aeb8a4dd2c05569839552af30546ab4cafd2553acc15ac820b

Observation b58b89a8-d939-4cb0-8183-236b9f97704d · outbound

This paper cites Resolving knowledge conflicts in large language models,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Resolving knowledge conflicts in large language models,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:25:00.031290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:52.146239Z digest=sha256:740b292e3265fe3930eb1506e7c82c9be5c7f5a02b50255d280a8b3bf5edf53e

Observation 7a294b64-64df-46cc-b604-9f6b5b5d953e · outbound

This paper cites Knowing what llms do not know: A simple yet effective self- detection method,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Knowing what llms do not know: A simple yet effective self- detection method,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:59.838185Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:52.249026Z digest=sha256:af87ec53d10abe319461dfa9888c9a87b955aa91bb01f3910865b20058616726

Observation a946d2de-0545-4d9e-9619-1d28cbe69367 · outbound

This paper cites Tug-of-war between knowledge: Exploring and resolving knowledge conflicts in retrieval-augmented language models,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Tug-of-war between knowledge: Exploring and resolving knowledge conflicts in retrieval-augmented language models,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:59.613086Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:52.343443Z digest=sha256:8dd0d27a15fa6224bd890e3fa1e5e5f2e291f7a1d7faa8b119f51b2947e70d11

Observation 1824b8df-6ae1-4778-8440-f88a1f06165e · outbound

This paper cites Characterizing mechanisms for factual recall in language models,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Characterizing mechanisms for factual recall in language models,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:59.469806Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:52.421636Z digest=sha256:6dd0fefd72da4f0ca02a91bf2cd066330fb2d8beab2ae52e137cadf49906dd0f

Observation 745e69b8-53e5-41f4-a0a1-a7a6d97279bd · outbound

This paper cites 3ds: Decomposed difficulty data selection’s case study on llm medical domain adaptation,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning 3ds: Decomposed difficulty data selection’s case study on llm medical domain adaptation,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:52.518779Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:52.518779Z digest=sha256:c68bde08c29ec62f9109f4c9e9d68849783568782b7046a93ff90624fd8d2c68

Observation 873964fe-71f8-4e52-bf76-bf5b35d4140e · outbound

This paper cites Language models are few-shot learners,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Language models are few-shot learners,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:59.278917Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:52.610709Z digest=sha256:31884b2c0c36aa2e96758e5da0375b8087aaad449c5bcf259577563273b7112f

Observation 661449de-fe25-4386-b4b4-1cd1a8470264 · outbound

This paper cites Rethinking the role of demonstrations: What makes in-context learning work?.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Rethinking the role of demonstrations: What makes in-context learning work?

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:59.079788Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:52.679560Z digest=sha256:3505d44d6218df8ea9fa59727f766962f6f5e0feca6381362def311169ed9d1f

Observation 9f051c0f-6d08-46fb-9b25-7dcb080c95a2 · outbound

This paper cites 60 Data Points are Sufficient to Fine-Tune LLMs for Question-Answering.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning 60 Data Points are Sufficient to Fine-Tune LLMs for Question-Answering

Reference 40

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:24:55.056801Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:52.763920Z digest=sha256:74685a5e12cd3f64b1f278ffa79c84bde0199357fa5317c9f07bdd07fbad967a

Observation f2e38901-2778-4804-99a5-ff5a5228a427 · outbound

This paper cites Self-consistency improves chain of thought reasoning in language models,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Self-consistency improves chain of thought reasoning in language models,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:52.860880Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:52.860880Z digest=sha256:fe4caeed824fb571c76b5b4b56bebdfa55a8bed6f37441b710d10c6102de50be

Observation d0677557-808e-43f1-85c0-bea677a2471e · outbound

This paper cites Detecting hallucinations in large language models using semantic entropy,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Detecting hallucinations in large language models using semantic entropy,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:58.819826Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:52.949868Z digest=sha256:874d1fe206b5b541cffc93049b5c43bc182dc1dd1fd7c8845cb4f9ab5d02081a

Observation d5a59bdc-b0f9-4154-818e-174ffa8b5f7a · outbound

This paper cites Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language generation,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language generation,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:58.542470Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:53.041213Z digest=sha256:8fd1d59bce5f2b6bd7715cb37afb38039797dad22b888a378af1ba003383213b

Observation be37b4b8-76f4-41e5-954b-7cac5b4becb3 · outbound

This paper cites A Survey on LLM-as-a-Judge.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning A Survey on LLM-as-a-Judge

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:53.172465Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:53.172465Z digest=sha256:7c7e7e7c0d8c3fe12ed9f643aa4e888816f109ab4a2dd9ab8a9f632c360cdd32

Observation e5ac1c1b-7ca3-494e-a139-3afcdc72ae8b · outbound

This paper cites M3-embedding: Multi-linguality, multi-functionality, multi-granularity text embeddings through self-knowledge distillation,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning M3-embedding: Multi-linguality, multi-functionality, multi-granularity text embeddings through self-knowledge distillation,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:58.311135Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:53.264865Z digest=sha256:d791a07721d4b0f46a6eb32aac461781560ed7946c690545b0e8c46872bda26a

Observation 7dc1ae78-6f9b-4a9b-bcc2-7d591f5c5673 · outbound

This paper cites Stanford alpaca: An instruction-following llama model,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Stanford alpaca: An instruction-following llama model,

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:53.364402Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:53.364402Z digest=sha256:2261c367d71b5bfcd627d3ca8b70014319bc897fc90f788c4e254cf6fdf4b631

Observation 6e49bca8-9d8f-4c94-9205-feea6bf9d26b · outbound

This paper cites MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:53.442182Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:53.442182Z digest=sha256:3741323e6dbd330251217cb518771b84a97cc7142e979244ddd3ee347d087fd4

Observation 78567fff-a044-4a83-8c21-c352140193fa · outbound

This paper cites Medmcqa: A large- scale multi-subject multi-choice dataset for medical domain question answering,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Medmcqa: A large- scale multi-subject multi-choice dataset for medical domain question answering,

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:58.087203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:53.487281Z digest=sha256:7743a944d4295bc1ae3a3dccb2be54e9b567c27ad93119ae63ef5d5c15dad5ec

Observation 812a55b4-f5cc-4043-97bc-025fdd11c0d3 · outbound

This paper cites What disease does this patient have? a large-scale open domain question answering dataset from medical exams,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning What disease does this patient have? a large-scale open domain question answering dataset from medical exams,

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:57.819254Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:53.586189Z digest=sha256:d3975756be754bd80058db69be273ad1b306620eb83e832561f0d261c366fa6c

Observation 51a2eed3-fe37-43ba-8ce3-f345899f4217 · outbound

This paper cites Pubmedqa: A dataset for biomedical research question answering,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Pubmedqa: A dataset for biomedical research question answering,

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:57.610019Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:53.713647Z digest=sha256:8c1d7cc376f0361458a9a59fade2643cd6123ca154a0f2a76e4532ee9089db09

Observation 5c387b4e-dad7-4de2-bc1d-e14b4cbafcc0 · outbound

This paper cites Measuring massive multitask language understanding,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Measuring massive multitask language understanding,

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-07T13:24:53.810143Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:24:53.810143Z digest=sha256:700a9e9125a02ac2db52295636b423ea0973f6da52ef8e65a892b6f71885bdfd

Observation 6341f18b-71a1-487c-8741-1af0bf8f369a · outbound

This paper cites A benchmark for long-form medical question an- swering,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning A benchmark for long-form medical question an- swering,

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:57.440868Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:53.914771Z digest=sha256:7f08273e8b19abb4e1e24a07f98ebd30ec9cc6dc44f6ce1976a5b79b4b358c7b

Observation 095e1fbb-fb8f-4bba-aa2c-66e7cad9145c · outbound

This paper cites Rouge: A package for automatic evaluation of summaries,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Rouge: A package for automatic evaluation of summaries,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:57.246418Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:54.021524Z digest=sha256:a3090a841724b881255651b0ee2bf3b046c172d4184272f0371d6fb116bd02a5

Observation 21b2d988-8ac7-4cfc-acb1-962b3f9bc556 · outbound

This paper cites Large language models encode clinical knowledge,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Large language models encode clinical knowledge,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:57.022893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:54.132253Z digest=sha256:27c5ef2848970c3134210d57ba282133b49691d8c83fc46299167ea805829c2f

Observation 2683c4ee-deb2-478d-9793-31ce0d71355b · outbound

This paper cites Toward expert-level medical question answering with large language models,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Toward expert-level medical question answering with large language models,

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:56.836579Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:54.235621Z digest=sha256:bc4db73dfaae4d5a2a6712df270d922f0f4c70ce04d62766f904c720ec4eceb7

Observation c7379532-a53f-4516-9fdf-895aefa8aac5 · outbound

This paper cites Lora: Low-rank adaptation of large language models,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Lora: Low-rank adaptation of large language models,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:56.641966Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:54.345567Z digest=sha256:73a9dac657b077e93e29a636e16870e4dd48b3cd57317d1f407ba5667de78ba1

Observation ba76a535-49af-448f-979b-7ba51080afaa · outbound

This paper cites Towards building multilingual language model for medicine,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Towards building multilingual language model for medicine,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:56.440110Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:54.427251Z digest=sha256:7f0d1841cc8c256329e5cde6767fe586ab4566a88bbf9c16761fd88a3cdaacc1

Observation 86989898-bdbe-41b4-aaa9-0de1b9785457 · outbound

This paper cites Med-halt: Medical domain hallucination test for large language models,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Med-halt: Medical domain hallucination test for large language models,

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:56.221661Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:54.490991Z digest=sha256:8cb3c8aa2169b0ea9778b6bc431bd7cb0067ffbdf3eaeeb152b61eaf177ceda7

Observation 3cd20c5e-0dc7-40bc-a92e-5a9946dc073d · outbound

This paper cites Xuanyuan 2.0: A large chinese financial chat model with hundreds of billions parameters,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Xuanyuan 2.0: A large chinese financial chat model with hundreds of billions parameters,

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:55.957105Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:54.566214Z digest=sha256:f91ccdfd4d7fcd9836c3601cce869ba70662d0670a1fafcdcc9581e18cb955d9

Observation 17ec2116-e2b9-44d5-9343-d0afda1769e0 · outbound

This paper cites Debertav3: Improving deberta using electra- style pre-training with gradient-disentangled embedding sharing,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning Debertav3: Improving deberta using electra- style pre-training with gradient-disentangled embedding sharing,

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:55.682603Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:54.668594Z digest=sha256:a9b4ec63803a9ea9b0222aec8fc264517e8c14ee655e5aa7f3f98f9cf1244a91

Observation 4d5b5e99-c269-4fbd-85b1-2f6ef3172e31 · outbound

This paper cites A broad-coverage challenge corpus for sentence understanding through inference,.

Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning A broad-coverage challenge corpus for sentence understanding through inference,

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:24:55.483363Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-07T13:24:54.786375Z digest=sha256:ee0d95ee4f444c6b93639d2063a0960995d6c5cd0681f078ee9ea32a98ef5f4c

Pith citing papers

No inbound Pith citation observations are available.