Computer-Based Testing¶
Computer-Based Testing (CBT, компьютерное тестирование) — это метод оценки знаний, навыков или способностей, при котором испытуемый выполняет задания на электронном устройстве (компьютере, планшете, смартшоне), а результаты обрабатываются и сохраняются в цифровом виде. CBT противопоставляется традиционному бумажному тестированию (paper-and-pencil testing) и включает как адаптивные алгоритмы, так и фиксированные наборы вопросов.
¶История
Первые эксперименты с компьютерным тестированием начались в 1960-х годах в США в рамках психометрических исследований. В 1970-е годы появились системы компьютерного адаптивного тестирования (CAT), которые подбирали сложность вопросов в зависимости от ответов испытуемого. В 1980-е годы, с распространением персональных компьютеров, CBT стало применяться в образовании (например, в тестах GRE — Graduate Record Examinations) и профессиональной сертификации (например, в экзаменах Microsoft Certified Professional). В 1990-е годы, с развитием интернета, возникли веб-ориентированные системы тестирования, такие как WebCT и Blackboard. В 2000-е годы CBT стало стандартом для многих международных экзаменов (TOEFL, IELTS, GMAT, ЕГЭ в России с 2009 года). В 2010-е годы рост мобильных устройств и облачных технологий привёл к появлению платформ для дистанционного прокторинга (например, ProctorU, ExamSoft).
¶Виды компьютерного тестирования
¶По способу адаптации
- Линейное тестирование: все испытуемые получают одинаковый набор заданий в фиксированном порядке. Результаты сравниваются по единой шкале.
- Адаптивное тестирование (CAT): алгоритм подбирает следующее задание на основе предыдущих ответов. Если испытуемый отвечает правильно, сложность возрастает; если неправильно — снижается. Это сокращает время тестирования и повышает точность оценки.
- Многостадийное тестирование (MST): испытуемый проходит несколько этапов (стадий), на каждом из которых выбирается модуль заданий определённой сложности.
¶По типу заданий
- Закрытые вопросы: выбор одного или нескольких вариантов ответа, установление соответствия, упорядочивание, «верно/неверно».
- Открытые вопросы: ввод текста, числа, формулы, загрузка файла (например, эссе, код программы).
- Интерактивные задания: симуляции, drag-and-drop, работа с виртуальными инструментами (например, в медицинских или инженерных тестах).
¶По способу проведения
- Локальное тестирование: проводится на компьютере без подключения к сети (например, в учебном классе). Результаты сохраняются локально и затем передаются.
- Онлайн-тестирование: проводится через интернет, часто с использованием веб-браузера. Требуется стабильное соединение.
- Прокторинг: наблюдение за испытуемым во время тестирования для предотвращения списывания. Прокторинг может быть живым (человек-наблюдатель через веб-камеру) или автоматизированным (анализ поведения с помощью ИИ, например, отслеживание взгляда, движений, звуков).
¶Технические и технологические аспекты
¶Платформы и программное обеспечение
Системы CBT включают серверную часть для хранения заданий и результатов, клиентскую часть для отображения интерфейса, а также модули администрирования (создание тестов, настройка параметров) и аналитики. Популярные платформы: Moodle, Blackboard, Canvas, ExamSoft, ProProfs, Google Forms (для простых тестов). Для адаптивных тестов используются специализированные алгоритмы, например, на основе модели Раша (Item Response Theory, IRT).
¶Безопасность
- Шифрование: данные передаются по протоколам HTTPS, SSL/TLS.
- Аутентификация: логин/пароль, биометрия (отпечаток пальца, распознавание лица), одноразовые коды.
- Защита от списывания: блокировка браузера (Lockdown Browser), запрет на переключение окон, мониторинг активности, рандомизация порядка вопросов и вариантов ответов.
- Антиплагиат: проверка текстовых ответов на совпадения с базами данных.
¶Проблемы и ограничения
- Технические сбои: отключение питания, потеря интернет-соединения, ошибки в программном обеспечении.
- Цифровое неравенство: разный уровень доступа к устройствам и интернету у испытуемых.
- Психометрические риски: при адаптивном тестировании возможно искажение результатов из-за угадывания или стресса.
- Валидность: не все типы знаний (например, устная речь, практические навыки) можно адекватно оценить через CBT.
¶Применение
¶Образование
- Вступительные экзамены: ЕГЭ (Россия), SAT, ACT, GRE, GMAT, TOEFL, IELTS.
- Текущий контроль: внутришкольные и внутривузовские тесты, онлайн-курсы (Coursera, edX, Stepik).
- Сертификация: профессиональные экзамены в IT (Cisco, Microsoft, Oracle), медицине (USMLE), бухгалтерии (CPA, ACCA).
¶Психология и кадровый отбор
- Психометрические тесты: оценка интеллекта (IQ), личностных качеств (Big Five), профессиональных склонностей.
- Кандидатские экзамены: тесты на логику, внимание, память при приёме на работу.
¶Медицина
- Клинические симуляции: виртуальные пациенты, диагностические задачи.
- Оценка знаний: тесты для врачей и медсестёр (например, аккредитация специалистов в РФ).
¶Государственные и военные структуры
- Тестирование госслужащих: проверка знаний законодательства, профессиональных стандартов.
- Военные тесты: оценка психологической устойчивости, технических навыков.
¶Преимущества и недостатки
¶Преимущества
- Автоматизация: быстрая обработка результатов, снижение затрат на ручную проверку.
- Гибкость: возможность проводить тестирование в любое время, в любом месте (при онлайн-доступе).
- Адаптивность: точная оценка уровня знаний за меньшее количество вопросов.
- Мультимедиа: использование видео, аудио, изображений, симуляций.
- Объективность: исключение человеческого фактора при оценке закрытых вопросов.
- Аналитика: детальная статистика по каждому заданию и испытуемому.
¶Недостатки
- Техническая зависимость: сбои оборудования или сети могут сорвать тестирование.
- Ограниченность типов заданий: сложно оценить творческие, устные или практические навыки.
- Риски списывания: при отсутствии прокторинга или слабой защите.
- Стресс у испытуемых: боязнь техники, незнание интерфейса.
- Стоимость внедрения: разработка платформы, обучение персонала, лицензирование.
¶Интересные факты
- Первое массовое компьютерное тестирование в США провели в 1970-х годах для оценки знаний по математике среди школьников.
- Система адаптивного тестирования GRE (Graduate Record Examinations) сократила среднее время теста с 3,5 часов до 2,5 часов.
- В России в 2023 году более 80% выпускников школ сдавали ЕГЭ в компьютерной форме по информатике.
- Некоторые платформы CBT используют нейросети для генерации заданий и анализа открытых ответов.
¶Критика
- Психометрическая критика: адаптивные тесты могут недооценивать или переоценивать знания из-за ошибок в алгоритмах подбора заданий.
- Социальная критика: CBT усугубляет цифровое неравенство, так как учащиеся из отдалённых регионов или с низким доходом имеют меньше доступа к качественному оборудованию и интернету.
- Педагогическая критика: чрезмерное увлечение CBT может привести к «натаскиванию» на формат теста, а не к глубокому усвоению материала.
- Этическая критика: автоматизированный прокторинг с использованием ИИ может нарушать приватность испытуемых (сбор биометрических данных, анализ поведения).
¶Источники
- Федеральный закон «Об образовании в Российской Федерации» (статья 59, регламентирующая проведение ЕГЭ).
- Стандарты ISO 23988:2007 «Информационные технологии — Оценка знаний с помощью компьютера».
- Доклады Educational Testing Service (ETS) о компьютерном адаптивном тестировании.
- Исследования ВШЭ (Москва) по эффективности ЕГЭ в компьютерной форме.
- Материалы конференций International Association for Computerized Adaptive Testing (IACAT).
BFOmetr — база данных и аналитика по компаниям России.
На главную BFOmetr →


