Методики психодиагностики

Раздел о том, как устроены психодиагностические методики: почему одни тесты дают повторяемый результат, а другие — гороскоп с научной лексикой, и по каким признакам это можно отличить, не будучи психологом.

Надёжность: тест должен повторяться

Надёжность — это устойчивость измерения. Её проверяют повторным прохождением через время и согласованностью пунктов между собой; последнюю чаще всего выражают коэффициентом альфа, предложенным Ли Кронбахом в 1951 году. Если тест при повторе через месяц даёт другой результат, измерял он не черту, а настроение.

Валидность: тест должен измерять заявленное

Надёжный тест может быть бесполезным: линейка стабильно измеряет длину, но не температуру. Валидность проверяют связями с другими измерениями — оценками экспертов, поведением, результатами других методик. Именно её нет у большинства развлекательных опросников, и именно об этом стоит спрашивать, встретив «уникальную авторскую методику».

Нормы и сравнение

Балл сам по себе не значит ничего: «34 из 50» становится осмысленным, когда известно распределение ответов сопоставимой группы. Отсюда важность стандартизации — процедура прохождения должна быть одинаковой, иначе сравнение теряет смысл.

Эффект Барнума

Бертрам Форер в 1949 году выдал студентам одинаковое описание личности, собранное из газетного гороскопа, и получил среднюю оценку точности 4,3 из 5. Универсальные формулировки — «вы бываете общительны, но иногда нуждаетесь в одиночестве» — воспринимаются как персональные. Хороший результат теста отличается тем, что содержит числа и говорит о вас то, что могло бы быть иначе.

Часто спрашивают

Почему серьёзные тесты длиннее? Устойчивость измерения растёт с числом пунктов: одна шкала из трёх утверждений слишком зависит от случайного ответа.

Что значит «тест валидизирован»? Что для него опубликованы данные о связи с другими измерениями. Если ссылок на публикации нет, фраза не значит ничего.