BioProBench provides a large-scale benchmark and training resource for evaluating and improving language models' reasoning about biological experimental protocols.
Language models are few-shot learners
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CL 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
BioProBench: A Corpus and Benchmark for Biological Protocol Reasoning in Autonomous Science
BioProBench provides a large-scale benchmark and training resource for evaluating and improving language models' reasoning about biological experimental protocols.