跳转到内容

测试流程规范

请将以下流程标准化并严格执行。没有固定流程,您的比较所承载的将是测试条件的变异,而不是运动员能力的变化。

因素要求
设备每次使用同一台 iPad。记录型号
亮度相同设置,正常范围
观看距离相同,约一臂长
时段尽可能相同
疲劳状态不得在运动后立即测试
试次数量需留档者一律 60
素材组任何比较都须使用同一组素材
指导语每次宣读同一份稿子

完整的 60 试次测试,结果予以舍弃

首次接触测量的是「学会这项任务」,而不是预判能力。省略这一步会使每位运动员的首次留档结果偏低,而第二次看起来像是进步,实际上什么也没有改变。

运行两次完整测试并比较结果。

若两次阈值的差异在 2 × 标准误以内,说明该运动员状态稳定,此后可以信任单次测试结果。

若二者不一致,则暂时不要信任单次结果。原因要么是运动员的表现尚未稳定,要么是您的流程存在变异。在下任何结论之前,请再做第三次。

这是您自己的仪器在您自己手中的重测信度,无法从他人的装置上继承。

除非在研究某项短期干预,否则每 4–6 周复测一次。

预判是一项知觉—认知技能,在常规训练下不会逐周变化。测得过于频繁,主要是在测量噪声;而且对同一批素材的反复接触会引入对特定片段的熟悉度,而非一般性能力。

应用中没有历史记录。请至少记录:

日期 ____________________
运动员 ____________________
素材组 ____________________
设备 ____________________
试次数 ______
阈值 ________ ms ± ________ ms
或 未收敛 —— 原因:_______________
正确率(校正) ________ %
无响应率 ________ %
反应时中位数 ________ ms
反转次数 ________
计时无效试次 ________

只有变化幅度超过约 2 × 标准误时才算真实变化。

若基线为 133 ± 12 ms、复测为 141 ± 14 ms,属于噪声。若复测为 175 ± 13 ms,则是值得深入了解的变化。

以下情形永远不要比较:

  • 跨项目 —— 随机水平不同
  • 跨视角 —— 任务不同
  • 跨素材组 —— 刺激材料不同

若需撰写论文,方法描述如下:

采用时间遮蔽范式,配合收敛至 79.4% 正确率的三上一下自适应阶梯法。阈值取最后六次反转的均值,标准误为 SD/√6。反转次数少于六次或标准误大于 25 ms 的测试判定为未收敛并予以剔除。刺激呈现计时经硬件验证(60 Hz 下遮蔽误差中位数 3.4 ms,p95 为 5.3 ms);偏差超过两个显示刷新周期的试次被标记并从阈值估计中排除。响应潜伏期取自平台触摸事件,与实测遮蔽时刻处于同一单调时钟基准。

每个原始试次均已存储:预期提前量、实测提前量、偏差、两个时间戳、响应区域、正误,以及超时标记。目前取出这些数据需要直接访问设备数据库 —— 见当前限制