ВУЗ: Не указан
Категория: Не указан
Дисциплина: Не указана
Добавлен: 16.05.2021
Просмотров: 1627
Скачиваний: 7
В качестве меры корреляции вычисляется фи-коэффициент.
.
Значимость
фи-коэффициента определяется с помощью
критерия
(хи-квадрат):
.
Если вычисленное
значение
меньше табличного с одной степенью
свободы, то нулевая гипотеза об отсутствии
устойчивости пункта не отвергается
(т.е. пункт признается неустойчивым).
Использование фи-коэффициента удобно потому, что он одновременно оценивает степень оптимальности данного пункта теста по силе вопроса или трудности задания.
трудность задания – хар-ка, отражающая статистический уровень его решаемости в конкретной выборке стандартизации. 2 вида трудности: субъективно – психологическая; статистическая.
1)субъективно-психологическую (связана с индивидуально-психологическим барьером, величина которого определяется как обстоятельствами ,так и уровнем формирования необходимых для решений знаний, умений и навыков, психическим состоянием испытуемого и рядом других факторов.)
2)статистическую (объективную) трудности.
,
где UT – индекс трудности в процентах, N+ – число испытуемых, правильно решивших задание,N – общее число испытуемых.
В тестах типа "Выбор" с несколькими вариантами ответов испытуемый может случайно угадать правильный ответ. Для учета такого случайного успеха используется формула:
где N– – число испытуемых, не решивших задание,
m – количество вариантов ответа (например, в сериях С–Е теста Равена m = 8).
В случаях, когда велики выборка стандартизации (больше 100 испытуемых) и количество пунктов теста, индекс трудности определяется с помощью сопоставления контрастных (крайних) подгрупп.
Необходимо отметить, что чем больше значение индекса трудности, тем статистическая трудность задания выше, и наоборот. (оптимально=50)
Здесь необходимо отметить, что статистическая трудность задания является относительной характеристикой, т.к. зависит от особенностей выборки (ее возрастных, профессиональных, социокультурных и других различий).
Остановимся на вопросе упорядочивания отдельных заданий в тесте. Обычно если задание решают большинство испытуемых из выборки стандартизации, его (как легкое) помещают в начале теста. Если же задание решает незначительный процент испытуемых, то его (как трудное) помещают в конце теста. Одну-две самые легкие задачи ставят перед основными заданиями теста и используют в качестве примера.
Дискриминативность,- показатель согласованности пункта с тестом. В качестве меры соответствия успешности выполнения одной задачи (пункта) всему тесту в психодиагностике используются:
1) коэффициент дискриминативности данного пункта теста;
2) индекс дискриминации пункта;
3) четырехпольный коэффициент корреляции.
Коэффициент дискриминативности отдельного пункта равен коэффициенту корреляции между средним результатом анализируемого пункта (по принципу правильного/неправильного ответа или совпадения с ключом) и средним первичным результатом по всем пунктам теста. То есть коэффициент дискриминативности учитывает амплитуду отклонения индивидуальных суммарных баллов от среднего балла.
Из множества известных коэффициентов корреляции наиболее точной мерой оказался точечно-биссериальный коэффициент корреляции:
,
где
–
среднее арифметическое всех индивидуальных
оценок по всему тесту (средний балл по
всем испытуемым);
–
среднее арифметическое оценок по тесту
у испытуемых, правильно выполнивших
задание / показавших совпадение с
"ключом";
sх – среднеквадратичное отклонение индивидуальных оценок всех испытуемых выборки по всему тесту;
N+ – число испытуемых, правильно решивших анализируемую задачу (или тех, чей ответ на данный пункт опросника соответствует "ключу");
N – общий объем выборки.(>200)
Если <200:
,
где
–
среднее арифметическое индивидуальных
оценок испытуемых, выпол- нивших данное
задание;
sхd – среднеквадратичное отклонение индивидуальных оценок испытуемых, выполнивших данное задание;
Nd – общее число испытуемых, выполнивших данное задание.
Коэффициент дискриминативности, как и любой коэффициент корреляции, может принимать значения от –1 до +1. Высокие положительные значения этого коэффициента свидетельствуют об эффективности деления испытуемых; высокие отрицательные значения – о непригодности данного пункта для теста.
Задачи, характеризующиеся средней трудностью (около 50), обладают высокой дискриминативной способностью.
Индекс дискриминации D отдельного пункта теста вычисляется как разность между долей лиц, правильно решивших данную задачу (показавших совпадение с "ключом"), из "высокопродуктивной" и "низкопродуктивной" групп. Каждая из контрастных групп включает в себя по 27 % испытуемых от численности выборки, имеющих соответственно лучшие и худшие результаты по тесту в целом:
,
где
,
– числа испытуемых, выполнивших данное
задание в "высокой" и "низкой"
контрастных группах;
,
– объемы контрастных групп.
Наконец, для оценки дискриминативности можно воспользоваться четырехпольным коэффициентом корреляции:
|
|
Высокая |
Низкая |
|
Да |
А |
В |
|
Нет |
C |
D |
В первом столбце таблицы суммируются ответы испытуемых из "высокой" группы (при нормальном распределении – это "верхние" 27 %), во втором столбце – из "низкой" (нижние 27 %). Четырехпольный коэффициент корреляции рассчитывается по следующей формуле.
Если a > b:
;
Если a < b:
.
Критические
значения этого коэффициента,
свидетельствующие о диагностической
ценности пункта, вычисляются по формуле
хи-квадрат:
и проверяются для одной степени свободы.
Вопрос 42.
Общее представление о валидности теста.
тВалидность – комплексная характеристика методики (теста), включающая сведения об области исследуемых явлений и репрезентативности диагностической процедуры по отношению к ним.
Валидность теста – понятие, указывающее на то, чтó измеряет тест и насколько хорошо он это делает.
Валидность описывает также конкретную направленность методики (контингент испытуемых по возрасту, уровню образования, социально-культурной принадлежности и т.д.) и степень обоснованности выводов о конкретных условиях использования теста.
Отличие понятия валидности от надежности:
Надежность – это устойчивость процедуры относительно объектов (испытуемых).
Валидность – это устойчивость относительно предмета измерения, т.е. измеряемых свойств.
Надежность является необходимым, но не достаточным условием валидности.
Поэтому основное соотношение психометрии:
Валидность ≤ надежность.
Итак, валидность теста не может превышать его надежность.
Чем валиднее тест, тем лучше отображается в нем то качество (свойство), ради измерения которого он создавался.
Проверка валидности методики называется валидизацией. В ходе валидизации решаются сразу две задачи: 1)собственно задача измерения валидности и 2)оценка прагматической эффективности психодиагностической методики.
Критерий валидизации – непосредственная и независимая от валидизируемого теста используемая для проверки его валидности эмпирически очевидная мера психического свойства, на исследование которого он направлен. На основе общего подхода к определению ряда видов валидности – через сопоставление с тем или иным критерием измеряемого свойства – принят термин "критериальная валидность".
В большинстве процедур валидизации используется независимый внешний критерий того, что тест должен измерять .
В качестве критериев валидизации обычно используют:
-
объективные социально-демографические и биографические данные (стаж, образование, профессия, прием или увольнение с работы);
-
показатели успеваемости, чаще всего являющиеся критериальной мерой тестов способности к обучению, достижений в отдельных дисциплинах, тестов интеллекта;
-
производственные показатели эффективности выполнения отдельных видов профессиональной деятельности, имеющие наибольшее значение при валидизации методик, используемых в профотборе и профориентации;
-
результаты реальной деятельности (рисование, моделирование, музыка, составление рассказа и т.п.) при испытании тестов общих и специальных способностей, тестов личности;
-
врачебный диагноз или другие заключения специалиста;
-
контрольные испытания знаний и умений;
-
данные других методик и тестов, валидность которых считается установленной.
Среди многообразия видов критериев валидизации в самом общем виде выделяют объективные (относительно независимые от субъективных мнений, оценок людей) и субъективные критерии.
Тиффин и Маккормик выделили 4 типа критерия валидизации:
1) критерии исполнения – количество выполненной работы, успеваемость, время, затраченное на обучение, темпы роста квалификации и т.п.;
2) субъективные критерии – различные суждения, отражающие отношение человека к чему- или к кому-либо, его мнение, взгляды и пр. Обычно субъективные критерии получают с помощью интервью, опросников, анкет;
3) физиологические критерии – используются при изучении влияния окружающей среды и других ситуационных переменных на организм и психику человека (частота пульса, давление крови, электросопротивление кожи и т.д.);
4) критерии случайностей – применяются, когда цель исследования касается, например, проблемы отбора для работы таких лиц, которые менее подвержены несчастным случаям.
Внешний критерий должен отвечать трем основным требованиям:
1)он должен быть релевантным(смысловое соответствие диагностического инструмента независимому жизненно важному критерию)
2)свободным от помех
3) надежным. (он должен отражать постоянство и устойчивость исследуемой функции)
Оценка валидности методик может носить количественный (коэф-т корреляции между колич.значениями и тест.показателями).и качественный характер.
Коэффициенты валидности – это статистические показатели эмпирической валидности теста.
Ошибка оценки находится по формуле:
σ


е
= σу
·√1 – r2ху
, где
rху – коэффициент валидности,
σ
у
–
стандартное отклонение критериальных
показателей.
В



еличина
√1 – r2ху
указывает
на величину ошибки относительно ошибки
простого угадывания, т.е. при нулевой
валидности.
Если корреляция не обнаружена, то остается неопределенность: либо не валидна сама процедура, либо не верна гипотеза о наличии причинно-следственной связи между психическим свойством и социально ценным показателем.
Трудности в определении валидности:
1)Неожид.факторы
2)Валидность самого критерия. Проверка такой валидности представляет собой весьма трудную проблему
3) условия валидизации по критерию предполагают, что выборка полностью репрезентативна.
Вопрос 43 Типы и виды валидности теста.
2 типа валидности:
1)Подлинная – выражает отношение между результатами метода и тем, чтό с помощью метода изучалось;
. 2) Ложная валидность – иллюзия соответствия заключения по результатам тестирования личностным характеристикам обследуемого. Бывает: 1) очевидная– представление о тесте, возникающее у лица, не располагающего специальными сведениями о целях методики. 2) валидность, основанная на опыте – базируется на личном чувстве психолога, что так он "понимает испытуемого";3) валидность, опирающаяся на убеждение и на желание – исходит из необоснованного убеждения, что метод хорош.
Виды подлинной валидности :
Теоретическая (конструктная) валидизация –определяет область теоретической структуры психологических явлений, измеряемых тестом. Показывает, что замысел автора и результаты методики совпадают. Для ее определения требуется независимый критерий, лежащий вне методики.Для проверки важно, установить степень связи его с родственной методикой и отсутствие этой связи с другими методиками. Эмпирическая (прагматическая) валидизация –валидности теста, полученная сравнительным способом оценивания Для проверки выбирается независимый внешний критерий, определяющий успех деятельности, и с ним сравниваются результаты диагностической методики. Если связь между ними признается удовлетворительной, то методика действенна и эффективна.
Различают еще несколько видов подлинной валидности:
1. Валидность "по содержанию"– характеризует степень репрезентативности содержания теста измеряемой области психических свойств. Пригодность методики определяется, на основании репрезентативного сходства между вопросов и компонентами характеристики личности. Способ определения этого вида валидности – логико-семантический. (исслед.круг явлениймодельанализ степени соотв-я) 2. Валидность "по одновременности", – характеризует способность различать испытуемых на основании диагностического признака. Определяется с помощью внешнего критерия, по которому информация собирается одновременно с экспериментами по проверяемой методике.Показатель валидности - комплекс сведений, насколько удобен тест по сравнению с получением информации об исследуемом качестве из других источников . 3. Прогностическая валидность –с какой степенью точности и обоснованности методика позволяет судить о диагностируемом психологическом качестве спустя определенное время после измерения. 4. "Ретроспективная" валидность.- отражает события или состояние измеряемого качества в прошлом. Этот вид может быть использован для быстрого получения сведений о предсказательных возможностях методик.
Вопрос 44.
Валидность процедуры тестирования. Приемы ее обеспечения.
Валидность (Анастази) – понятие указывающие на то, что измеряет тест и насколько хорошо он это делает.
=> для теста это - действительная способность теста измерять ту психологическую характеристику, для диагностики которой он заявлен.
Один из основных (наряду с надежностью, репрезентативностью, объективностью, достоверностью и эффективностью) критериев оценки тестовых результатов
Валидность тестовых результатов - характеристика, показывающая пригодность тестовых результатов. Зависит от качества заданий, их числа, полноты охвата содержания дисциплины, распределения заданий по сложности, метода отбора заданий в тест, интерпретации результатов тестирования, совокупности испытуемых.
Необходимо знать факторы:
1 гр. факторов – у испытуемого может быть представления о: свойственно ему или нет поведенческое поведение, какое псих. свойство скрывается у психолога за той или иной формулировкой, как свойства соотносятся с общепринятыми моральными нормами и формулой успеха.
2 гр. Факторов – социальной желательности – обуславливает тенденции испытуемого давать о себе социально одобрительную информацию. Этот фактор будет сильнее, чем ближе испытуемый подойдет к загадкам исследования. (Если испытуемый получает большой балл по шкале – его протокол бракуется (опросник Айзенка). Высокие баллы свидетельствуют лишь о том, что испытуемый был неискренен)
3 гр. Факторов - на ответ испытуемого влияют представления о себе.