摘要:本研究运用多层面Rasch模型测量软件FACETS分析了计算机和15名专家评分员在一次广东省高考机助英语听说考试模拟测试中批阅215名考生口语录音的阅卷行为。研究发现:计算机自动评分和专家评分员评分的严厉度虽有显著差异,但并不会对考生能力分布产生决定性影响;计算机自动评分阅卷较低的评分偏差几率说明计算机自动评分比专家人工阅卷具有更高的内部一致性。
分类:期刊> 人文社会科学> 哲学与人文科学> 外国语言文字
收录:知网收录(中) > 维普收录(中) > 国家图书馆馆藏 > 上海图书馆馆藏
关键词:多层面rasch模型 机助英语听说考试 计算机自动评分 阅卷效度
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社