BERT embeddings and meta-classifiers trained on 172 expert-annotated defeaters from two assurance cases achieve F1≈0.84 in predicting quality ratings, outperforming the low inter-rater agreement (κ<0.442) between human reviewers.
AI-supported eliminative argumentation: Practical experience generating defeaters to increase confidence in assurance cases,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.SE 1years
2026 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Automating Quality Assessment with NLP of LLM-Generated Defeaters
BERT embeddings and meta-classifiers trained on 172 expert-annotated defeaters from two assurance cases achieve F1≈0.84 in predicting quality ratings, outperforming the low inter-rater agreement (κ<0.442) between human reviewers.