ストループ テスト ガイド: カラーワード タスクの仕組み
赤インクで青という文字が表示されます。あなたの仕事は、単語自体を無視して、インクの色 (赤) に反応することです。
その小さな対立がストループ タスクの基礎です。これは、単語を読むなどの練習された反応が、指示によって要求される反応と競合したときに何が起こるかを研究するためのよく知られた実験方法です。
このガイドでは、タスクの仕組み、オンライン バージョンの記録、解釈をどこで停止する必要があるかについて説明します。
2 種類のトライアル
カラーワード ストループ タスクには通常、少なくとも 2 つの条件が含まれます。
- 一致: 単語とインクの色が一致します (青インクの青など)。
- 不一致: 単語とインクの色が矛盾しています (赤インクの青など)。
人々は、一致しない試験では遅くなったり、間違いを起こしやすくなることがよくあります。 2 つの条件間のパフォーマンスの違いはストループ干渉効果と呼ばれます。
ジョン・リドリー・ストループは、1935 年の論文連続言語反応における干渉の研究でこの干渉を記録しました。基本的な結果は、その後、多くのタスク設計、言語、および応答方法で再現されました。
オンラインテストの記録
オンライン ストループ テストでは、単語を無視しながらインクの色を選択します。結果ページには、そのセッションのいくつかの部分が要約されています。
- 精度: 正解したトライアルの割合。
- 平均反応時間: 有効なトライアル全体の反応時間。
- 一致および不一致の反応時間: 各条件の平均。
- ストループ効果: 不一致反応時間から一致反応時間を引いたもの。
- 条件の精度: エラーが 1 つの条件に集中していたかどうか。
精度とタイミングは密接に関連しています。より多くのエラーが発生しても、結果が速くても自動的に良い結果になるわけではありません。同様に、少数の正しい試行のみに基づく干渉推定値は、完全なセッションに基づく推定値よりも安定性が低くなります。
結果からわかること
結果は、現時点でこのバージョンのタスクをこのデバイス上でどのように実行したかを示します。それはあなたに役立ちます:
- 一致する試験と一致しない試験の違いを確認してください。
- あなた自身の応答では、速度と精度のトレードオフに注意してください。
- 同様の条件下で完了した繰り返しセッションを比較します。
- 教室または個人の学習活動で認知的干渉を実証します。
これらは有用な観察ですが、「注意力レベル」、「脳年齢」、「認知的健康状態」などのラベルよりも範囲が狭いです。単一のブラウザ セッションでは、これらの広範な特性は確立されません。
結果からは分からないこと
このサイトは標準化された臨床機器ではありません。その結果は次の目的で使用しないでください。
- ADHD、認知症、学習障害、またはその他の状態を診断します。
- 子供か大人が注意力に問題があるかを判断します。
- 自分のスコアを引用されていない年齢ベースの標準と比較します。
- 認知トレーニングが一般的な知能を変えたことを証明する。
- 雇用、運転、医療、教育の配置を決定する。
実験的なタスクは、強力な平均効果を生み出す可能性がありますが、それでも個人のランク付けの信頼性は低くなります。ストループ タスクに関する研究では、生の応答時間測定の信頼性が干渉差分スコアの信頼性とは異なる可能性があることも判明しました。これが、適格評価が検証済みの手順、適切な基準、および複数の証拠源を使用する理由の 1 つです。
スコアが変化する理由
人が大幅に変わっていない場合でも、パフォーマンスは変化する可能性があります。一般的な影響には次のようなものがあります。
- デバイスとブラウザ: 表示の更新、入力ハードウェア、オペレーティング システム、ブラウザのスケジュールにより遅延が追加されます。
- 応答方法: マウス、物理キーボード、タッチスクリーンのタイミングは同じではありません。
- 言語と読解の流暢さ: 競合する単語の反応の強さは、表示される言語への習熟度に部分的に依存します。
- 練習: 応答マッピングを学習すると、後のセッションが容易になります。
- 環境: 中断、画面の可視性、バックグラウンド アクティビティはセッションに影響します。
- 一時的な状態: 疲労、ストレス、モチベーション、注意力は速度と精度の両方に影響を与える可能性があります。
ブラウザベースのタスクは、デモンストレーションやデバイス内での比較に役立ちますが、ミリ秒の絶対値を異なるハードウェア設定間で交換可能として扱うべきではありません。
より再現性の高いテスト方法
自分のセッションを比較したい場合は、単純なプロトコルを使用します。
- 同じデバイス、ブラウザ、入力方法、テスト モードを使用します。
- 同様の環境、同様の時間帯でテストします。
- 数回試行した後に停止するのではなく、セッション全体を完了してください。
- 反応時間を解釈する前に精度を確認してください。
- 単一の最良または最悪のスコアではなく、複数のセッションを比較します。
- 睡眠不足やデバイスの変更など、明らかな状態の変化を記録します。
これはテストを臨床評価に変えるものではありません。それは単に個人的な比較のノイズを軽減するだけです。
教室でのデモンストレーション
ストループ効果は教育活動としても効果的です。参加者に、一致するリストでインクの色の名前を付けてもらい、次に矛盾するリストでインクの色の名前を付けるように依頼します。条件間の完了時間とエラーを比較し、無関係な単語によって指示された応答が中断される可能性がある理由について話し合います。
オフライン アクティビティの場合は、印刷可能なストループ テスト PDF を使用してください。教室でのデモンストレーションは、生徒を診断したりランク付けする方法としてではなく、干渉を説明するものとして提示されるべきです。
実践的なポイント
ストループ タスクは、認知的矛盾を観察しやすくするため、価値があります。その最大の教訓は、条件間の対比です。たとえルールが明確であっても、馴染みのある単語が色の命名目標を妨げる可能性があるということです。
オンライン結果を 1 つのタスク セッションに関するフィードバックとして使用します。繰り返し行う場合は設定の一貫性を保ち、速度と正確さの両方に注意し、小さな実験的測定値を個人に関する広範な主張に変えることは避けてください。
参考文献
- Stroop, J. R. (1935). Studies of interference in serial verbal reactions. Journal of Experimental Psychology, 18, 643–662. Publication record and original paper
- Hedge, C., Powell, G., & Sumner, P. (2018). The reliability paradox: Why robust cognitive tasks do not produce reliable individual differences. Behavior Research Methods, 50, 1166–1186. Full text
- Strauss, G. P., Allen, D. N., Jorgensen, M. L., & Cramer, S. L. (2005). Test-retest reliability of standard and emotional Stroop tasks. Assessment, 12(3), 330–337. PubMed
- Bridges, D., Pitiot, A., MacAskill, M. R., & Peirce, J. W. (2020). The timing mega-study: Comparing a range of experiment generators, both lab-based and online. PeerJ, 8, e9414. Full text