Навигация:

Главная Случайная страница Обратная связь ТОП Интересно знать Избранные Новые материалы

Топ:

Процедура выполнения команд. Рабочий цикл процессора: Функционирование процессора в основном состоит из повторяющихся рабочих циклов, каждый из которых соответствует...

Марксистская теория происхождения государства: По мнению Маркса и Энгельса, в основе развития общества, происходящих в нем изменений лежит...

Методика измерений сопротивления растеканию тока анодного заземления: Анодный заземлитель (анод) – проводник, погруженный в электролитическую среду (грунт, раствор электролита) и подключенный к положительному...

Интересное:

Лечение прогрессирующих форм рака: Одним из наиболее важных достижений экспериментальной химиотерапии опухолей, начатой в 60-х и реализованной в 70-х годах, является...

Что нужно делать при лейкемии: Прежде всего, необходимо выяснить, не страдаете ли вы каким-либо душевным недугом...

Распространение рака на другие отдаленные от желудка органы: Характерных симптомов рака желудка не существует. Выраженные симптомы появляются, когда опухоль...

Дисциплины:

Автоматизация Антропология Археология Архитектура Аудит Биология Бухгалтерия Военная наука Генетика География Геология Демография Журналистика Зоология Иностранные языки Информатика Искусство История Кинематография Компьютеризация Кораблестроение Кулинария Культура Лексикология Лингвистика Литература Логика Маркетинг Математика Машиностроение Медицина Менеджмент Металлургия Метрология Механика Музыкология Науковедение Образование Охрана Труда Педагогика Политология Правоотношение Предпринимательство Приборостроение Программирование Производство Промышленность Психология Радиосвязь Религия Риторика Социология Спорт Стандартизация Статистика Строительство Теология Технологии Торговля Транспорт Фармакология Физика Физиология Философия Финансы Химия Хозяйство Черчение Экология Экономика Электроника Энергетика Юриспруденция

Коэффициент ассоциации для оценки надёжности теста

2018-01-05

298

0.00 из 5.00 0 оценок

Заказать работу

⇐ ПредыдущаяСтр 3 из 3

Тесноту связи между качественными признаками X и Y измеряют с помощью коэффициента ассоциации. Где Х – вид теста, а Y – результаты тестирования. В простейшем виде формула, по которой рассчитывается этот показатель, выглядит следующим образом:

, (1.1)

где

a, b, c, d – численности коррелируемых групп.

Коэффициент ассоциации, как и пирсоновский коэффициент корреляции, изменяется от -1 до +1. Значимость можно проверить с помощью t-критерия Стьюдента. Нулевую гипотезу, которая сводится к предложению, что в генеральной совокупности этот показатель равен нулю, отвергают, если

, (1.2)

где

– количество тестируемых,

– коэффициент ассоциации,

– t-критерий Стьюдента,

для принятого уровня значимости () и числа степеней свободы .

Так как коэффициент ассоциации имеет прямое отношение к пирсоновскому критерию , на котором он основан, то распределение вероятных значений критерия является непрерывным. Качественные же признаки дискретны, их числовое значение не распределяются непрерывно. Учитывая эту особенность, в формулу (1.1) принято вносить поправку Йейтса на непрерывность вариации, равную половине объёма выборки. И формула (1.1) принимает следующий вид:

. (1.3)

Валидность

Кратко рассмотрим природу валидности, второй из основных характеристик эффективных тестов. Тест называется валидным, если он измеряет то, для измерения чего он предназначен. Однако такое определение не разъясняет удовлетворительно значения валидности. В этом случае возникает новый вопрос: как мы узнаем, что тест измеряет то, для чего он предназначен? В действительности, существует много различных способов доказательства валидности тестов, и каждый из них соответствует разным аспектам этого значения.

Говорят, что тест является, очевидно валидным, если о нем складывается впечатление, что он измеряет именно то, что подразумевается, особенно с точки зрения испытуемых

Конкурентная валидность – э та валидность оценивается по корреляции результатов данного теста с результатами других тестов. Так, если мы пытаемся установить конкурентную валидность некоторого теста интеллекта, мы будем изучать его корреляцию с другими тестами, валидность которых установлена.

Содержательная валидность. Этот термин применяется, в основном, по отношению к тестам достижений и может быть просто объяснён следующим образом. Если можно показать, что задания теста отражают все аспекты исследуемой области поведения, то тест является, по существу, валидным, при условии, что инструкции изложены ясно. Содержательная валидность не сводится к простой очевидной валидности, которая связан с внешним видом заданий теста. Если в тесте математических навыков мы хотим протестировать умение перемножать выражения скобках и имеем задания вида , то трудно оспаривать валидность этого задания. Очевидно, содержательная валидность полезна только для тех тестов, для которых, как в данном случае, смысл, измеряемого параметра полностью ясен.

Были описаны разнообразные способы установления валидности тестов, некоторые из них коренным образом отличаются друг от друга. Из обсуждения должно быть также понятно, что не может быть какого-либо единственного показателя, демонстрирующего валидность теста. Для полной ее проверки следует учитывать множеств получаемых показателей. Более того, как это станет ясно из дальнейшего изложения, валидность теста может фактически гарантироваться логически обоснованными методами конструирования тестов.

Дискриминативность

Дискриминативность – это способность отдельных заданий теста и теста в целом дифференцировать обследуемых относительно «максимального» и «минимального» результата теста.

Еще одной особенностью эффективных тестов является дискриминативность. Действительно, достижение удовлетворительного распределения показателей является одной из целей разработчика теста. При помощи тщательного конструирования теста можно обеспечить соответствующий уровень дискриминативности, а это именно то, в чем тесты значительно выигрывают по сравнению с другими формами испытаний. В общем, было обнаружено, что в оценке может быть использовано около девяти градаций [1], а в опросах, вероятно, наиболее эффективно использовать три градации: ниже среднего, средний уровень и выше среднего. Дискриминативность измеряется показателем дельта Фергюсона и принимает максимальное значение при равномерном (прямоугольном) распределении показателей ().

⇐ Предыдущая 1 23

Поделиться с друзьями:

Архитектура электронного правительства: Единая архитектура – это методологический подход при создании системы управления государства, который строится...

Общие условия выбора системы дренажа: Система дренажа выбирается в зависимости от характера защищаемого...

Состав сооружений: решетки и песколовки: Решетки – это первое устройство в схеме очистных сооружений. Они представляют...

Наброски и зарисовки растений, плодов, цветов: Освоить конструктивное построение структуры дерева через зарисовки отдельных деревьев, группы деревьев...