Tag
This paper presents an automated item evaluation (AIE) model that predicts item acceptance/rejection in standardized testing using fine-tuned DeBERTa classifiers on raw item text and Qwen3-generated critiques, achieving moderate accuracy and highlighting challenges with fairness-related rejections.