Разговор про оценку обучения обычно начинается с требования показать цифры. Требование законное: деньги потрачены, нужен отчёт. Дальше начинаются проблемы, потому что удобные для отчёта показатели меньше всего говорят о результате.
Процент прохождения, средний балл теста и оценка курса по пятибалльной шкале описывают взаимодействие человека с курсом, а не изменение в его работе. Все три можно улучшить, не улучшив обучение.
Оценка держится на одной вещи: соответствии заранее поставленной цели. Если цель была сформулирована через наблюдаемое действие, оценка становится технической задачей. Если цели не было или она звучала как «повысить уровень знаний», измерять нечего, и никакая методика этого не исправит.
Отсюда практическое следствие: вопрос «как мы будем оценивать результат» задаётся до старта разработки, а не после запуска. Заодно это неплохая проверка самой цели. Если непонятно, как измерить, скорее всего цель сформулирована плохо.
Тест на знание проверяет способность выбрать правильный вариант из списка сразу после чтения материала. Связь этого умения с рабочим поведением слабая, особенно там, где речь идёт о навыках взаимодействия.
Сотрудник может безошибочно ответить на все вопросы про принципы командной работы и не применять ни один из них. Знание формулировки и способность действовать по ней в напряжённой ситуации: разные вещи, и вторая из первой не следует.
Для процедурных задач тест ещё как-то работает. Для всего, что связано с поведением, он даёт ложное спокойствие.
Когда прямой числовой показатель недоступен, остаются косвенные признаки. По отдельности каждый слабый, вместе они дают достаточно надёжную картину.
Ни один из этих признаков не превращается в красивый процент. Зато все они относятся к работе, а не к курсу.
Отдельная сложность возникает там, где предметом обучения становится поведение: переговоры, обратная связь, работа с конфликтом.
Проверять тут стоит несколько вещей.
Самооценка после тренинга измеряет впечатление от тренинга, и не более того. Обычно она завышена, причём сильнее всего у тех, кто продвинулся меньше всех.
Качество отличается от результата и оценивается отдельно. Слово это скользкое: у заказчика, слушателя и разработчика под ним разное содержание.
Что можно проверить более или менее объективно.
Отказаться от чисел совсем не получится, да и не нужно. Разумнее договориться заранее, что именно будет считаться доказательством.
Хорошо работает договорённость про одну конкретную вещь. Один показатель, который заказчик считает убедительным, плюс несколько косвенных признаков рядом. Панель из двенадцати метрик тут лишняя. Один согласованный до старта критерий полезнее подробного отчёта, собранного постфактум из того, что удалось выгрузить.