schultetable
错误次数用时与准确性透明计分

比较舒尔特方格用时时,为什么要看错误次数

用时更短不一定是严格同条件下更合适的记录。了解错误次数如何改变解释,并在不虚构能力分数的情况下并列比较速度与准确性。

作者 schulte-table.org 编辑团队 ·

29 秒但有 4 次错误,是否一定好过 33 秒且没有错误?仅凭这两行数据无法得到通用的是或否。它们代表两种不同的用时—错误组合:前者原始用时更短,后者没有记录到错误选择。

个人可以事先规定比较规则,但不应看完结果后才挑选有利算法。最透明的默认方式,是把原始用时和错误次数并列保留。若使用惩罚公式,也要同时显示原始值、惩罚大小和计算过程。

1. 当前各工具怎样记录一次错误

标准 5×5 速度测试只有选中当前目标才算正确。选错会把错误次数加 1,格子短暂显示反馈,目标序列不会前进。倒计时结束后,完成用时在正确选中 1 时重新锚定,并在正确选中 25 时结束;计时开始后的错误会自然占用时间,不会暗中再加惩罚。

倒序模式同样在错误时保持当前目标,并提示应找的数字;它可以暂停。字母模式要求点击当前显示的字母。红黑模式同时核对颜色与数字,并把错误细分为颜色错误和顺序错误。数字字母模式要求准确命中当前 token,选错后也不会推进。

这些工具都有错误计数,不等于反馈条件完全相同。提示、当前目标显示、暂停、不限时选项和本地历史流程都有差异,因此不能只看 mistakes 字段名就认为规则一致。

2. 三轮记录体现三种取舍

A 用时 33.0 秒、错误 0 次;B 用时 29.0 秒、错误 4 次;C 用时 31.5 秒、错误 1 次。若事先规定只比较无错误完成,A 满足条件而 B 不满足。若只按原始用时排序,B 最短。C 是另一种组合,并不会自动成为两者之间的“最佳折中”。

错误可能来自指针滑动、看错当前目标、点错颜色或误用规则。网站只记录任务事件,无法据此确定原因,更不能把三行压缩为对人的评价。

同一名义尺寸下的三组用时—错误结果
尝试用时错误只按记录可作的描述
A33.0 秒0原始用时最长;无记录错误
B29.0 秒4原始用时最短;有 4 次错误
C31.5 秒1用时居中;有 1 次错误

3. 三种比较方法分别保留了什么

只看原始用时最直观,但会丢掉错误信息。只有当所有记录都已满足同一个准确条件,例如全部为零错误时,这种排序才更容易解释,而且条件应明确写出。

用时与错误并列能保留两项观察,是本文建议的默认方式。可以先筛出零错误轮次,再比较这些轮次的原始用时,同时把其他记录保留为另一组,而不是让它们从历史中消失。

本站成绩计算器提供每次错误 0、1、2 或 3 秒的选择,默认是 2 秒。它把两项数据合成为调整后用时与练习效率点。惩罚大小只是本站或用户选定的约定,不是经过验证的心理测量权重。

调整后用时 = 原始用时 + 错误次数 × 所选惩罚秒数
练习效率点 = 格子数 ÷ 调整后用时 × 100

4. 把公开公式应用到三轮示例

按默认每错 1 次加 2 秒,A 仍为 33.0 秒,B 变成 37.0 秒,C 变成 33.5 秒。在这条已声明的规则下,A 的调整后用时最短。若惩罚改为 0 秒,调整后数值等于原始用时,B 又会最短。排序改变,是因为规则改变。

不要只展示 33.5 而隐藏 31.5 与 1 次错误,因为前者是计算值,不是计时器直接观察值。比较一串记录时,还要固定尺寸、模式、输入方式和惩罚设置。

按本站默认 2 秒惩罚计算
尝试原始用时错误增加用时调整后用时
A33.0 秒00.0 秒33.0 秒
B29.0 秒48.0 秒37.0 秒
C31.5 秒12.0 秒33.5 秒

5. 错误规则不同,就不是严格同条件比较

带即时反馈的严格顺序任务,与允许提示的不限时任务不是同一条件。倒序任务暂停时会排除暂停时长,而标准速度测试没有暂停控件。红黑目标同时包含颜色和数字,数字字母还可选择起始 token、完整倒序和高亮。即使两轮都写着“1 次错误”,错误发生时的规则与反馈也可能不同。

比较前请记录:是否计时、是否有提示或目标高亮、选错后是否保持当前目标、反馈期间计时是否继续,以及方向、大小写和起始 token 等模式设置。

6. 不要让一个派生数字遮住原始记录

不要用错误次数诊断注意状况,不要把零错误等同于一般能力,也不要用一次快但多错的记录宣称广泛变化。不要在表格软件里加入未公开惩罚,更不要只留下调整后数字而删除原始用时与错误。

可核对的记录会保留原始二元数据、任务配置和计算规则。它只能说明当前浏览器任务发生了哪些选择,不能给出医疗或注意诊断、智力分数、人群位置,也不能预测阅读与学习任务的结果。

相关工具

站内参考