ВУЗ: Не указан

Категория: Не указан

Дисциплина: Не указана

Добавлен: 16.05.2021

Просмотров: 1627

Скачиваний: 7

ВНИМАНИЕ! Если данный файл нарушает Ваши авторские права, то обязательно сообщите нам.

В качестве меры корреляции вычисляется фи-коэффициент.

.

Значимость фи-коэффициента определяется с помощью критерия (хи-квадрат):

.

Если вычисленное значение меньше табличного с одной степенью свободы, то нулевая гипотеза об отсутствии устойчивости пункта не отвергается (т.е. пункт признается неустойчивым).

Использование фи-коэффициента удобно потому, что он одновременно оценивает степень оптимальности данного пункта теста по силе вопроса или трудности задания.

трудность задания – хар-ка, отражающая статистический уровень его решаемости в конкретной выборке стандартизации. 2 вида трудности: субъективно – психологическая; статистическая.

1)субъективно-психологическую (связана с индивидуально-психологическим барьером, величина которого определяется как обстоятельствами ,так и уровнем формирования необходимых для решений знаний, умений и навыков, психическим состоянием испытуемого и рядом других факторов.)

2)статистическую (объективную) трудности.

,

где UT – индекс трудности в процентах, N+ – число испытуемых, правильно решивших задание,N – общее число испытуемых.

В тестах типа "Выбор" с несколькими вариантами ответов испытуемый может случайно угадать правильный ответ. Для учета такого случайного успеха используется формула:

где N – число испытуемых, не решивших задание,

m – количество вариантов ответа (например, в сериях С–Е теста Равена m = 8).

В случаях, когда велики выборка стандартизации (больше 100 испытуемых) и количество пунктов теста, индекс трудности определяется с помощью сопоставления контрастных (крайних) подгрупп.

Необходимо отметить, что чем больше значение индекса трудности, тем статистическая трудность задания выше, и наоборот. (оптимально=50)

Здесь необходимо отметить, что статистическая трудность задания является относительной характеристикой, т.к. зависит от особенностей выборки (ее возрастных, профессиональных, социокультурных и других различий).

Остановимся на вопросе упорядочивания отдельных заданий в тесте. Обычно если задание решают большинство испытуемых из выборки стандартизации, его (как легкое) помещают в начале теста. Если же задание решает незначительный процент испытуемых, то его (как трудное) помещают в конце теста. Одну-две самые легкие задачи ставят перед основными заданиями теста и используют в качестве примера.

Дискриминативность,- показатель согласованности пункта с тестом. В качестве меры соответствия успешности выполнения одной задачи (пункта) всему тесту в психодиагностике используются:

1) коэффициент дискриминативности данного пункта теста;

2) индекс дискриминации пункта;

3) четырехпольный коэффициент корреляции.

Коэффициент дискриминативности отдельного пункта равен коэффициенту корреляции между средним результатом анализируемого пункта (по принципу правильного/неправильного ответа или совпадения с ключом) и средним первичным результатом по всем пунктам теста. То есть коэффициент дискриминативности учитывает амплитуду отклонения индивидуальных суммарных баллов от среднего балла.


Из множества известных коэффициентов корреляции наиболее точной мерой оказался точечно-биссериальный коэффициент корреляции:

,

где – среднее арифметическое всех индивидуальных оценок по всему тесту (средний балл по всем испытуемым);

– среднее арифметическое оценок по тесту у испытуемых, правильно выполнивших задание / показавших совпадение с "ключом";

sх – среднеквадратичное отклонение индивидуальных оценок всех испытуемых выборки по всему тесту;

N+ – число испытуемых, правильно решивших анализируемую задачу (или тех, чей ответ на данный пункт опросника соответствует "ключу");

N – общий объем выборки.(>200)

Если <200:

,

где – среднее арифметическое индивидуальных оценок испытуемых, выпол- нивших данное задание;

sхd – среднеквадратичное отклонение индивидуальных оценок испытуемых, выполнивших данное задание;

Nd – общее число испытуемых, выполнивших данное задание.

Коэффициент дискриминативности, как и любой коэффициент корреляции, может принимать значения от –1 до +1. Высокие положительные значения этого коэффициента свидетельствуют об эффективности деления испытуемых; высокие отрицательные значения – о непригодности данного пункта для теста.

Задачи, характеризующиеся средней трудностью (около 50), обладают высокой дискриминативной способностью.

Индекс дискриминации D отдельного пункта теста вычисляется как разность между долей лиц, правильно решивших данную задачу (показавших совпадение с "ключом"), из "высокопродуктивной" и "низкопродуктивной" групп. Каждая из контрастных групп включает в себя по 27 % испытуемых от численности выборки, имеющих соответственно лучшие и худшие результаты по тесту в целом:

,

где , – числа испытуемых, выполнивших данное задание в "высокой" и "низкой" контрастных группах;

, – объемы контрастных групп.

Наконец, для оценки дискриминативности можно воспользоваться четырехпольным коэффициентом корреляции:


Высокая

Низкая

Да

А

В

Нет

C

D

В первом столбце таблицы суммируются ответы испытуемых из "высокой" группы (при нормальном распределении – это "верхние" 27 %), во втором столбце – из "низкой" (нижние 27 %). Четырехпольный коэффициент корреляции рассчитывается по следующей формуле.

Если > b: ;

Если < b: .

Критические значения этого коэффициента, свидетельствующие о диагностической ценности пункта, вычисляются по формуле хи-квадрат: и проверяются для одной степени свободы.

Вопрос 42.

Общее представление о валидности теста.

тВалидность – комплексная характеристика методики (теста), включающая сведения об области исследуемых явлений и репрезентативности диагностической процедуры по отношению к ним.

Валидность теста – понятие, указывающее на то, чтó измеряет тест и насколько хорошо он это делает.


Валидность описывает также конкретную направленность методики (контингент испытуемых по возрасту, уровню образования, социально-культурной принадлежности и т.д.) и степень обоснованности выводов о конкретных условиях использования теста.

Отличие понятия валидности от надежности:

Надежность – это устойчивость процедуры относительно объектов (испытуемых).

Валидность – это устойчивость относительно предмета измерения, т.е. измеряемых свойств.

Надежность является необходимым, но не достаточным условием валидности.

Поэтому основное соотношение психометрии:

Валидность ≤ надежность.

Итак, валидность теста не может превышать его надежность.

Чем валиднее тест, тем лучше отображается в нем то качество (свойство), ради измерения которого он создавался.

Проверка валидности методики называется валидизацией. В ходе валидизации решаются сразу две задачи: 1)собственно задача измерения валидности и 2)оценка прагматической эффективности психодиагностической методики.

Критерий валидизации – непосредственная и независимая от валидизируемого теста используемая для проверки его валидности эмпирически очевидная мера психического свойства, на исследование которого он направлен. На основе общего подхода к определению ряда видов валидности – через сопоставление с тем или иным критерием измеряемого свойства – принят термин "критериальная валидность".

В большинстве процедур валидизации используется независимый внешний критерий того, что тест должен измерять .

В качестве критериев валидизации обычно используют:

  • объективные социально-демографические и биографические данные (стаж, образование, профессия, прием или увольнение с работы);

  • показатели успеваемости, чаще всего являющиеся критериальной мерой тестов способности к обучению, достижений в отдельных дисциплинах, тестов интеллекта;

  • производственные показатели эффективности выполнения отдельных видов профессиональной деятельности, имеющие наибольшее значение при валидизации методик, используемых в профотборе и профориентации;

  • результаты реальной деятельности (рисование, моделирование, музыка, составление рассказа и т.п.) при испытании тестов общих и специальных способностей, тестов личности;

  • врачебный диагноз или другие заключения специалиста;

  • контрольные испытания знаний и умений;

  • данные других методик и тестов, валидность которых считается установленной.

Среди многообразия видов критериев валидизации в самом общем виде выделяют объективные (относительно независимые от субъективных мнений, оценок людей) и субъективные критерии.

Тиффин и Маккормик выделили 4 типа критерия валидизации:

1) критерии исполнения – количество выполненной работы, успеваемость, время, затраченное на обучение, темпы роста квалификации и т.п.;


2) субъективные критерии – различные суждения, отражающие отношение человека к чему- или к кому-либо, его мнение, взгляды и пр. Обычно субъективные критерии получают с помощью интервью, опросников, анкет;

3) физиологические критерии – используются при изучении влияния окружающей среды и других ситуационных переменных на организм и психику человека (частота пульса, давление крови, электросопротивление кожи и т.д.);

4) критерии случайностей – применяются, когда цель исследования касается, например, проблемы отбора для работы таких лиц, которые менее подвержены несчастным случаям.

Внешний критерий должен отвечать трем основным требованиям:

1)он должен быть релевантным(смысловое соответствие диагностического инструмента независимому жизненно важному критерию)

2)свободным от помех

3) надежным. (он должен отражать постоянство и устойчивость исследуемой функции)

Оценка валидности методик может носить количественный (коэф-т корреляции между колич.значениями и тест.показателями).и качественный характер.

Коэффициенты валидности – это статистические показатели эмпирической валидности теста.

Ошибка оценки находится по формуле:

σLine 5Line 4Line 3Line 2е = σу ·√1 – r2ху , где

rху – коэффициент валидности,

σLine 12Line 11у – стандартное отклонение критериальных показателей.

ВLine 10Line 9Line 8Line 7Line 6 еличина √1 – r2ху указывает на величину ошибки относительно ошибки простого угадывания, т.е. при нулевой валидности.

Если корреляция не обнаружена, то остается неопределенность: либо не валидна сама процедура, либо не верна гипотеза о наличии причинно-следственной связи между психическим свойством и социально ценным показателем.

Трудности в определении валидности:

1)Неожид.факторы

2)Валидность самого критерия. Проверка такой валидности представляет собой весьма трудную проблему

3) условия валидизации по критерию предполагают, что выборка полностью репрезентативна.

Вопрос 43 Типы и виды валидности теста.

2 типа валидности:

1)Подлинная – выражает отношение между результатами метода и тем, чтό с помощью метода изучалось;

. 2) Ложная валидность – иллюзия соответствия заключения по результатам тестирования личностным характеристикам обследуемого. Бывает: 1) очевидная– представление о тесте, возникающее у лица, не располагающего специальными сведениями о целях методики. 2) валидность, основанная на опыте – базируется на личном чувстве психолога, что так он "понимает испытуемого";3) валидность, опирающаяся на убеждение и на желание – исходит из необоснованного убеждения, что метод хорош.

Виды подлинной валидности :

Теоретическая (конструктная) валидизацияопределяет область теоретической структуры психологических явлений, измеряемых тестом. Показывает, что замысел автора и результаты методики совпадают. Для ее определения требуется независимый критерий, лежащий вне методики.Для проверки важно, установить степень связи его с родственной методикой и отсутствие этой связи с другими методиками. Эмпирическая (прагматическая) валидизация –валидности теста, полученная сравнительным способом оценивания Для проверки выбирается независимый внешний критерий, определяющий успех деятельности, и с ним сравниваются результаты диагностической методики. Если связь между ними признается удовлетворительной, то методика действенна и эффективна.


Различают еще несколько видов подлинной валидности:

1. Валидность "по содержанию"– характеризует степень репрезентативности содержания теста измеряемой области психических свойств. Пригодность методики определяется, на основании репрезентативного сходства между вопросов и компонентами характеристики личности. Способ определения этого вида валидности – логико-семантический. (исслед.круг явлениймодельанализ степени соотв-я) 2. Валидность "по одновременности", – характеризует способность различать испытуемых на основании диагностического признака. Определяется с помощью внешнего критерия, по которому информация собирается одновременно с экспериментами по проверяемой методике.Показатель валидности - комплекс сведений, насколько удобен тест по сравнению с получением информации об исследуемом качестве из других источников . 3. Прогностическая валидность –с какой степенью точности и обоснованности методика позволяет судить о диагностируемом психологическом качестве спустя определенное время после измерения. 4. "Ретроспективная" валидность.- отражает события или состояние измеряемого качества в прошлом. Этот вид может быть использован для быстрого получения сведений о предсказательных возможностях методик.

Вопрос 44.

Валидность процедуры тестирования. Приемы ее обеспечения.

Валидность (Анастази) – понятие указывающие на то, что измеряет тест и насколько хорошо он это делает.

=> для теста это - действительная способность теста измерять ту психологическую характеристику, для диагностики которой он заявлен.

Один из основных (наряду с надежностью, репрезентативностью, объективностью, достоверностью и эффективностью) критериев оценки тестовых результатов

Валидность тестовых результатов - характеристика, показывающая пригодность тестовых результатов. Зависит от качества заданий, их числа, полноты охвата содержания дисциплины, распределения заданий по сложности, метода отбора заданий в тест, интерпретации результатов тестирования, совокупности испытуемых.

Необходимо знать факторы:

1 гр. факторов – у испытуемого может быть представления о: свойственно ему или нет поведенческое поведение, какое псих. свойство скрывается у психолога за той или иной формулировкой, как свойства соотносятся с общепринятыми моральными нормами и формулой успеха.

2 гр. Факторов – социальной желательности – обуславливает тенденции испытуемого давать о себе социально одобрительную информацию. Этот фактор будет сильнее, чем ближе испытуемый подойдет к загадкам исследования. (Если испытуемый получает большой балл по шкале – его протокол бракуется (опросник Айзенка). Высокие баллы свидетельствуют лишь о том, что испытуемый был неискренен)

3 гр. Факторов - на ответ испытуемого влияют представления о себе.