手机浏览器扫描二维码访问
第二节计算机化多阶段自适应测验设计
banner"
>
MST设计涉及以下几个技术环节:阶段数的确定、每个阶段中模块数的确定、每个模块的项目长度、统计目标与定性规范约束、计分方法(能力估计)、自适应策略与过程、组卷等。
现对以上技术环节一一展开。
一、阶段数的确定
构建MST时,首先考虑需要构建多少个阶段。
大多数研究和应用中,通常使用3~4个阶段。
更多的阶段或每一阶段内更多样化的模块难度会使测验的自适应性和灵活性更佳。
但是增加阶段数会提升组卷的复杂性,却对测验最终的精度没有很大提升(Luegester,1998)。
当测验所含阶段数较少时也会出现问题。
例如,两阶段测验,仅有一个阶段一和一个阶段二。
由于只有一个自适应点,当被试得分处于划界分数附近时,就有更大的可能出现路径错误。
两阶段测验应考虑建立一个“恢复路径(RecoveryRoutine)”
,即被试从前一阶段到下一阶段出错时,应及时改正错误,减少下一阶段模块选择的错误。
使用更多的阶段可以减少出现这种错误的可能性。
Patsula和Hambleton(1999)比较了多种不同的MST设计,他们发现这些设计之间仅有很小的差别。
但是这些测验设计在测量精度和效能方面表现出较大的差别。
测验的阶段数越多就越接近于CAT。
因此构建测验时,测验开发者应选择合适的阶段数。
阶段数过少无法精确测量出被试能力。
阶段数过多不但无法提升测量精度还会加大组卷难度和题目浪费,并面临和CAT同样的问题,如路由出错、多自适应点增长测验时间等。
二、每个阶段中模块数的确定
大多数研究和应用是阶段一使用一个模块,在随后的阶段中增加模块数量。
通常情况,每一阶段的模块数不超过8个,平均值为5个。
随着阶段数的提升,增加更多难度的模块数,可使测验更具有自适应性和灵活性。
同样,增加模块数也增大了组卷复杂性,并对测验最终精度没有很大提升(Luegester,1998)。
一般情况下,每一阶段最多4个模块,并且每个模块3个平行水平,这样的组合比较合适(Armstrong,Jones,Koppel&Pashley,2004)。
因此在构建测验时,测验开发者要合理制定每一阶段内的模块数。
有两种可选择的模块数:一种是随着阶段增加,阶段内的模块数也增加,以此提升能力估计精度;另一种是每一阶段的模块数都相同,这种情况主要用于一致题目曝光率MST的情况(图4-1-2)。
测验开发者可根据自己的需求进行选取。
三、每个模块的项目长度
已有的研究和应用中,模块的题目数为1~90个不等,大多为5个。
不同阶段中模块的长度可根据实际情况而定。
一些测验在阶段一中有较多题目,而随后阶段中题目数量较少。
增加阶段一中模块的长度对减小估计误差有显著效果(Kim&Plake,1993)。
他们都是草根出生,凭自己的努力走上仕途,但一个清廉,一个腐败,于是一见面就成了格格不入的对手...
周胜利大学毕业后,因接收单位人事处长的一次失误延误了时机,被分配到偏远乡镇农技站。他立志做一名助力农民群众致富的农业技术人员,却因为一系列的变故误打误撞进入了仕途,调岗离任,明升暗降,一路沉浮,直至权力巅峰...
简介我叫江羽,本想一直留在山上陪着我的绝色师父,却被师父赶去祸害未婚妻了。而且多少?九份婚书!?...
朝中无人莫做官,重活一世的秦毅不是这样认为。机遇来自于谋划,时时为朝前铺路,才能高官极品!上一世,含冤入狱,前途尽毁,孤独终老。这一世,从救省城下来的女干部开始,抓住每一个机遇,加官进爵,弥补遗憾,扶摇直上九万里!...
性格嚣张的林飞扬走马上任镇委书记当天就得罪了顶头上司,让大领导颜面无存,差点被就地免职,且看这个嚣张到骨子里的家伙如何凭借孙子兵法和三十六计勇闯重重危机,智破层层陷阱,在官场上混得风生水起,扶摇直上…...
官场,是利益的牢笼胜利者,在人间炼狱失败者,在人间监狱。爱与恨,恩与怨,熙熙攘攘,皆为利往...