«Коммуникация — 4 из 5». Звучит как оценка, но что она сообщает сотруднику? Один руководитель поставит четвёрку за вежливость, другой — за подробные отчёты, третий снизит балл из-за единственного конфликта. Цифра одна, критерии разные.
BARS решает именно эту проблему. Метод, впервые описанный в публикации Смит и Кендалла 1963 года, заменяет подписи «плохо — хорошо» примерами наблюдаемого поведения: что человек сделал в рабочей ситуации, насколько уместно действовал и к чему это привело. Оценка становится понятнее, а у руководителя и сотрудника появляется общий язык для предметного обсуждения работы.
Разберём путь метода от первых шкал для медсестёр до современного пилота в компании: как собирать эпизоды, проверять якоря, обучать оценщиков и сочетать BARS с KPI, 360° и рабочими данными. В логике управления персоналом на основе данных Kickidler усиливает BARS: помогает быстро находить нужные рабочие эпизоды, восстанавливать их цифровой контекст и готовить фактическую основу для оценки.
Коротко: пять выводов о BARS
- В оценке работы BARS смещает фокус с ярлыков личности на наблюдаемое поведение в конкретной роли. «Безответственный» — ярлык. «Не предупредил о риске до срока и не предложил новый план» — описание эпизода.
- Якоря нельзя убедительно придумать за одну встречу HR и руководителя. Классическая процедура начинается со сбора реальных эпизодов, включает их независимую переклассификацию и отсев неоднозначных формулировок.
- Пятибалльность не обязательна. Бывают четырёх-, пяти-, шести- и более широкие шкалы. Важна различимость уровней, а не привычное количество цифр.
- BARS не доказала устойчивого превосходства над всеми другими форматами оценки. Её практическая ценность — в понятности критериев, качестве обратной связи и связи с содержанием конкретной работы.
- Kickidler делает BARS более доказательной. В этом помогают анализ продуктивности сотрудников, структура рабочего дня, приложения и события: руководитель может найти релевантные эпизоды, восстановить последовательность действий и сопоставить её с задачей и результатом.
Что такое BARS простыми словами
BARS — сокращение от Behaviorally Anchored Rating Scales, то есть рейтинговые шкалы с поведенческими якорями. В русских текстах встречаются варианты «поведенчески якорные» и «поведенчески закреплённые» шкалы.
Разберём название на части.
- Измерение — сторона работы, которую оценивают: например, работа со сложным обращением или управление риском срока.
- Шкала — упорядоченные уровни эффективности.
- Поведенческий якорь — конкретный пример действия, который помогает узнать уровень в реальной ситуации.
- Оценщик — руководитель, эксперт, коллега или другой человек, который наблюдал работу и сопоставляет эпизод с якорями.
Обычная шкала может выглядеть так: «ориентация на клиента: 1 — низкая, 3 — средняя, 5 — высокая». BARS вместо абстрактного «высокая» описывает, что сделал специалист: уточнил проблему, объяснил решение понятным языком, согласовал следующий шаг и зафиксировал причину повторного обращения. Якорь не обязан дословно совпасть с каждым случаем. Он задаёт ориентир для профессионального суждения.
Важно не спутать BARS с перечнем должностных обязанностей. «Отвечает клиентам» — функция. «До эскалации проверяет историю обращения, воспроизводит ошибку и передаёт второй линии уже проверенные данные» — наблюдаемое поведение, которое можно обсуждать и подтверждать.
Как медсёстры помогли создать будущую BARS
В 1963 году психологи Патриция Кейн Смит и Лорн Кендалл опубликовали статью Retranslation of expectations. Они искали способ сделать оценочные якоря менее двусмысленными. Руководительницы медицинских сестёр описывали примеры эффективного и неэффективного поведения, а другие руководительницы независимо распределяли перемешанные примеры по рабочим измерениям. Затем оставшиеся эпизоды оценивали по желательности и размещали на шкалах.
Исходная методика называлась Behavioral Expectations Scale, или BES. Название BARS стало более широким термином позже и сейчас охватывает семейство поведенчески закреплённых форматов. Поэтому фраза «Смит и Кендалл придумали BARS и так её назвали» исторически неточна. Современную историю терминов и процедур подробно разбирает обзор ETS.
Почему эта история важна практику? Авторы не ограничились хорошими формулировками. Они проверяли, одинаково ли специалисты понимают, что именно описывает каждый эпизод и насколько он эффективен. В этом и состоит отличие полноценной разработки от анкеты, которую собрали «по ощущениям».
Сама идея реальных эпизодов опиралась на Critical Incident Technique Джона Фланагана. В оригинальной работе 1954 года критический инцидент — это наблюдаемое действие в ситуации, существенной для результата деятельности. Слово «критический» здесь не означает катастрофу: это может быть как провал, так и показательный успех.
Из чего состоит хороший поведенческий якорь
Полезный эпизод можно свернуть в цепочку «ситуация — действие — последствие».
За два дня до контрольной даты руководитель проекта увидел, что внешний подрядчик не передал интеграцию. Он оценил влияние на критический путь, письменно зафиксировал риск, назначил владельца решения и предложил заказчику два варианта: сократить объём релиза или перенести дату на три дня. Команда выбрала первый вариант и сохранила срок.
Здесь есть контекст, конкретные действия и результат. Фраза «проявил проактивность» ничего этого не содержит. В цифровой работе расчёт продуктивности сотрудников даёт полезный фактический контекст, а поведенческий якорь связывает эти данные с конкретной ситуацией, действием и результатом.
Хороший якорь обычно отвечает на пять вопросов:
- В какой рабочей ситуации действовал человек?
- Что он сделал или не сделал — без чтения мыслей и приписывания характера?
- Насколько действие соответствовало роли и полномочиям?
- Какое последствие можно связать с эпизодом?
- Какие источники позволят восстановить событие и выслушать позицию сотрудника?
Последствие важно, но его нельзя оценивать в отрыве от обстоятельств. Правильное решение иногда не спасает проект из-за внешнего события, а плохая практика иногда случайно заканчивается удачно. BARS оценивает поведение в контексте, а не только победный итог: руководителю нужны и цифра, и понятная причина результата.
Как из десятков эпизодов получается короткая шкала
В классическом процессе гораздо больше работы, чем кажется по готовой таблице.
1. Определить должность и цель
Шкалу создают для конкретной работы, уровня полномочий и среды. «Коммуникация» руководителя проекта и оператора поддержки — разные задачи. Сначала нужно решить, для чего нужна оценка: развитие, испытательный срок, структурированное интервью, аттестация или калибровка руководителей. Для управленческой роли перед этим фиксируют основные функции менеджмента.
2. Собрать реальные эпизоды
Сотрудники, руководители и другие эксперты должности вспоминают лично наблюдавшиеся случаи эффективного, приемлемого и неэффективного поведения. Нужна не только героика и катастрофы: без нормальной середины шкала будет бесполезна для большинства людей.
3. Очистить и сгруппировать материал
У эпизодов убирают имена и лишние детали, дубли объединяют, оценочные ярлыки заменяют действиями. В классическом индуктивном варианте примеры группируют в рабочие измерения: например, выявление риска, решение, коммуникация, контроль выполнения. В дедуктивном варианте измерения можно задать заранее, а затем проверить и уточнить реальными эпизодами.
4. Провести независимую обратную классификацию
Этот этап в исследованиях называют retranslation. Другая группа экспертов получает перемешанные эпизоды и определения измерений, но не видит исходную раскладку. Она заново относит каждый пример к подходящей категории. Если один и тот же эпизод уверенно отправляют то в коммуникацию, то в планирование, якорь двусмыслен: его переписывают или исключают.
5. Оценить эффективность якорей
Отдельная группа экспертов размещает эпизоды на шкале эффективности — этот этап называют масштабированием. Средняя оценка определяет место якоря на континууме, а разброс показывает согласие оценщиков. Универсального порога согласия для любой BARS нет: критерии отбора задают заранее и документируют. Подробную семишаговую процедуру приводит открытый отчёт ETS.
6. Собрать шкалу и проверить границы
Уровни должны отличаться содержанием, а не наречиями «иногда», «часто», «всегда». Эксперты проверяют, не требует ли верхний якорь полномочий, которых у роли нет, и не наказывает ли нижний за нормальную реакцию на редкое исключение.
7. Обучить оценщиков и провести пилот
Руководители разбирают одинаковые кейсы, объясняют оценки и сверяют логику. На пилоте сравнивают оценки разных наблюдателей, находят непонятные якоря, проверяют доступность доказательств и время заполнения. Без калибровки даже отличная шкала быстро превращается в прежние субъективные баллы. Эту границу показывает материал «Руководитель-лидер или руководитель-контроллер».
8. Пересматривать при изменении работы
Шкалу меняют не «раз в год по календарю», а когда меняются процессы, инструменты, полномочия или риски роли. Каждую новую версию снова проверяют на понятность и применимость, чтобы устаревшие якоря не закрепляли ненужное поведение.
Полный учебный пример: управление риском срока
Возьмём руководителя проекта и одно измерение — «работа с риском срока». Это учебная шкала, а не готовый валидированный инструмент: в реальной компании якоря нужно собрать и проверить на собственных эпизодах.
| Уровень | Поведенческий якорь | Что проверяем |
|---|---|---|
| 1 | Сообщает о срыве после срока либо тогда, когда команда уже не может изменить план; зависимость и владелец решения не зафиксированы | Дата появления риска, план, история задачи |
| 2 | Замечает риск заранее, но сообщает без оценки влияния и вариантов действий; следующий шаг появляется только после указания руководителя | Сообщение, реакция команды, обновление плана |
| 3 | Заранее фиксирует риск, его влияние и владельца; предлагает реалистичный следующий шаг и добивается согласованного решения | План проекта, принятое решение, фактический результат |
| 4 | Заранее проверяет критические зависимости, предлагает несколько выполнимых вариантов с последствиями для срока и объёма, организует решение и обновляет план для всех затронутых участников | Анализ вариантов, протокол решения, обновлённый план |
| 5 | Обнаруживает риск по ранним сигналам, проверяет влияние по цепочке зависимостей, проводит команду через выбор между вариантами и в рамках проекта вводит проверку, которая предотвращает повторение того же типа риска | Ранние сигналы, решение команды, контрольная проверка проекта |
Предположим, сотрудник предупредил о риске заранее и предложил перенос даты, но не оценил влияние на зависимые задачи и не зафиксировал, кто должен принять решение. Один руководитель ставит уровень 2, другой — 3. На калибровке они не усредняют оценки до 2,5, а сверяют критерий: все ли элементы третьего уровня обязательны и какие доказательства подтверждают согласованное решение. Если текст допускает два устойчивых прочтения, его уточняют до следующего цикла. Такой контроль сотрудников без тотального надзора опирается на проверяемый эпизод, а не на общее впечатление о человеке.
Полезно фиксировать не только итоговую цифру, но и эпизод, доказательства, объяснение оценщика, комментарий сотрудника и решение калибровки. Так балл связывается с рабочими фактами, а решение становится проверяемым.
Принцип переносится на другие роли, а готовые якоря обычно нельзя переносить без локальной проверки. В поддержке шкала «работа со сложным обращением» может двигаться от закрытия без диагностики к проверке истории, ясной эскалации и предотвращению повторов. В разработке «код-ревью» — от формального одобрения к замечаниям с приоритетом, объяснением риска и изменением повторяющейся командной практики. Это учебные иллюстрации; полноценными BARS они станут только после проверки на реальных эпизодах конкретной компании.
Где BARS действительно применяли
Метод родился в сестринском деле, но затем вошёл в практику оценки эффективности сотрудников в разных профессиональных сферах.
- В полевом исследовании 1976 года 58 полицейских департаментов участвовали в разработке шкал для оценки патрульных руководителями и коллегами; описание хранится в U.S. Office of Justice Programs.
- Правительство австралийского штата Виктория публикует четырёхуровневые поведенческие шкалы для модели способностей и предлагает использовать их в подборе и развитии. Это наглядный пример того, что BARS не обязана быть пятибалльной.
- WHOBARS разработана для оценки командного поведения при использовании хирургического чек-листа Всемирной организации здравоохранения. Авторы применяли экспертный Delphi-процесс, а затем проверяли инструмент в реальных и симулированных операциях.
- В 2025 году исследователи применили 12-пунктовую BARS к 360 записям реанимаций для оценки лидерства травматологической команды; высокое согласие получалось при усреднении нескольких оценщиков. Это результат конкретного инструмента и дизайна, а не гарантия для любой шкалы.
- В образовании CATME использует поведенческие шкалы для само- и взаимной оценки вклада участников команды по пяти направлениям.
- ETS разработала шеститочечные шкалы для профессий среднего квалификационного уровня в проекте Skills Demonstration and Progression Guide.
- В другом проекте ETS поведенческие шкалы использовали в структурированных интервью для оценки прикладных социальных навыков.
- Для педагогической практики ETS также разрабатывала BARS и сравнивала их с существующей системой наблюдения.
Эти примеры показывают главное: BARS используют там, где важное качество можно разложить на наблюдаемое поведение и где организация готова инвестировать в разработку и обучение оценщиков. Для компании это один из инструментов управления персоналом, а не готовая универсальная система оценки.
У штата Виктория опубликован наглядный четырёхуровневый ряд для выполнения обязательств перед заинтересованными сторонами. В пересказе движение выглядит так: человек не выполняет обещания → выполняет их непоследовательно → стабильно соблюдает договорённости → благодаря последовательности строит долгосрочное доверие. Это уже не подписи «плохо / нормально / отлично»: соседние уровни различаются наблюдаемым способом работы.
BARS, BOS, KPI, OKR, 360° и O*NET — в чём разница
| Инструмент | Что отвечает | Главная разница с BARS |
|---|---|---|
| Обычная рейтинговая шкала | Насколько выражено качество | Уровни часто обозначены числами и общими словами без поведенческих ориентиров |
| BOS, Behavioral Observation Scale | Как часто наблюдалось заданное поведение | BOS оценивает частоту отдельных действий, BARS — уровень эффективности через якоря на континууме |
| KPI сотрудников | Как меняется выбранный показатель процесса, выхода или результата | KPI измеряет выбранный показатель; BARS закрепляет уровни оценки примерами наблюдаемого поведения |
| OKR | Какую цель и ключевые результаты взяла команда | OKR управляет приоритетами; BARS задаёт критерии наблюдаемого выполнения роли |
| 360° | Кто даёт обратную связь | Это архитектура источников. Одну BARS можно включить в 360°, если наблюдатели действительно видят оцениваемое поведение |
| Модель компетенций | Какие способности и поведения важны | Компетенция — каркас; BARS конкретизирует уровни для определённой должности и контекста |
| O*NET Work Styles | Какие рабочие тенденции полезны профессии | O*NET описывает профессию, а BARS оценивает наблюдаемое выполнение работы в организации |
В академических обзорах BARS иногда называют целое семейство поведенческих шкал, включая BOS. В практическом HR эти названия чаще разводят: BARS описывает уровень эффективности, BOS — частоту конкретных действий. В таблице мы используем это узкое различие.
Подробнее о последнем сравнении — в материале про O*NET Work Styles. Использовать стиль из O*NET как готовый вопрос аттестации нельзя: сначала его нужно перевести в реальные эпизоды конкретной роли.
Сильные стороны без рекламных обещаний
Поведенческие якоря дают руководителю общий ориентир, приближают критерии к содержанию работы и позволяют строить обратную связь вокруг действий: что произошло, что сработало, что человек может повторить или изменить. Это особенно важно, когда возникает демотивация сотрудников: общий ярлык только усиливает проблему. Когда в разработке участвуют специалисты должности, они одновременно уточняют, что организация действительно считает хорошей работой.
Исследования не показали, что BARS стабильно даёт более точные и согласованные оценки, чем все качественно сделанные альтернативы. Обзор Jacobs, Kafry и Zedeck 1980 года заключил, что количественно метод не оказался стабильно лучше или хуже, а его потенциал заметнее в практических свойствах: принятии, ясности и использовании результатов.
Якоря тоже бывают плохими. Слишком общий пример допускает несколько толкований. Слишком буквальный заставляет оценщика искать точное совпадение и пропускать равноценное поведение в другой ситуации. Исследование Kinicki и Bannister 1988 года показало и недостаточную конкретность эпизодов, и изменение их смысла между разработкой и реальной оценкой.
Наконец, метод не отменяет эффект недавности, ограниченность наблюдения, конфликт интересов и различия рабочих условий. Поэтому нужны журнал значимых эпизодов, комментарий сотрудника, обучение оценщиков, калибровка и возможность пересмотра решения.
Когда метод оправдан, а когда будет слишком тяжёлым
BARS имеет смысл, если цена расплывчатой оценки высока, одна роль повторяется у многих сотрудников, работа достаточно стабильна, поведение можно наблюдать, а компания готова собрать экспертов и провести пилот. Особенно полезны шкалы для обратной связи, развития руководителей, структурированных интервью и критичных командных навыков.
Метод может не окупиться для уникальной должности с одним носителем экспертизы, быстро меняющейся роли или разовой задачи. Если у компании нет ясных процессов и руководители почти не наблюдают работу, красивая таблица не исправит исходные данные. Иногда достаточно короткого чек-листа, понятных результатов и регулярной встречи один на один, чтобы не превращать оценку в микроменеджмент.
Перед запуском полезно определить место BARS среди других источников: результатов, качества работы и контекста роли.
Как ограничить первый пилот, чтобы не утонуть в разработке
Ниже — редакционный пример четырёхнедельного discovery-спринта для одной роли и одного-двух спорных измерений. Это не научно установленный срок разработки BARS и не обещание получить валидированный инструмент за месяц: задача спринта — проверить, удаётся ли компании собирать понятные эпизоды и одинаково читать якоря.
- Неделя 1: зафиксировать цель и правила использования результата, собрать эпизоды у сотрудников, руководителей и внутренних клиентов роли.
- Неделя 2: очистить примеры, определить измерения, провести независимую обратную классификацию и исключить двусмысленные эпизоды.
- Неделя 3: оценить эффективность оставшихся якорей, собрать форму и обучить оценщиков на одинаковых кейсах.
- Неделя 4: параллельно применить шкалу без автоматических санкций, провести калибровку и решить: оставить, переписать или остановить пилот.
Минимальная карточка эпизода содержит роль, дату или период, ситуацию, наблюдаемое действие, последствие, источники и комментарий сотрудника. В протоколе проверки фиксируют код эпизода, выбор измерения каждым экспертом, долю согласия и причину исключения. Оценочный комментарий удобно строить по формуле: эпизод → якорь → доказательства → контекст → позиция сотрудника → следующий шаг.
До пилота стоит договориться о правилах интерпретации цифровых данных. Тогда оценщики смогут использовать часы, задачи и посещённые приложения как фактический контекст, сопоставляя их с поведенческим критерием и результатом работы.
Как Kickidler усиливает BARS
Kickidler — система учёта рабочего времени, которая помогает восстановить цифровой контекст рабочего эпизода: когда началась активность, какие приложения использовались, где возникли длительные перерывы и как в целом был организован день. Руководитель быстрее находит факты, относящиеся к выбранному якорю, и тратит меньше времени на восстановление событий по памяти.
Безопасная цепочка выглядит так: якорь → рабочий эпизод → задача и результат → коммуникация и решение сотрудника → релевантные цифровые данные → комментарий сотрудника → оценка → калибровка. Например, уведомление помогает найти момент длительного перерыва или запуска заданного приложения; затем руководитель проверяет, имел ли факт отношение к оцениваемому эпизоду.
Например, история задачи показывает, когда руководитель проекта зафиксировал риск и какой план предложил, а материалы встречи подтверждают решение команды. Эту картину программа мониторинга сотрудников дополняет последовательностью цифровых действий, временем работы и используемыми инструментами. Вместе эти источники дают руководителю значительно более полную основу для сопоставления эпизода с поведенческим якорем.
Kickidler 2.0 собирает данные в удобных отчётах по времени, активности и приложениям. Они ускоряют подготовку оценки, помогают сравнивать эпизоды по единым правилам и снижают зависимость обсуждения от памяти руководителя. Прозрачные правила доступа и заранее объяснённая цель делают такую работу понятной для сотрудников.
Перед внедрением зафиксируйте правила прозрачности, личные границы и порядок доступа к данным. Поведенческая шкала перестаёт быть инструментом развития, если сотрудник узнаёт о скрытом критерии уже после решения.
Семь ошибок, которые превращают BARS в декорацию
- Сначала назначить уровни, потом подогнать примеры. Так организация закрепляет мнение автора, а не общий смысл работы.
- Оценивать черты личности. Практика «этичный контроль сотрудников» строится вокруг рабочих фактов, поэтому ярлыки «негативный», «ленивый» или «нелояльный» нужно заменять наблюдаемыми действиями.
- Смешивать несколько измерений. Один якорь не должен одновременно требовать скорость, эмпатию, точность и лидерство.
- Делать верхний уровень героическим. Норма не должна предполагать ночную работу, постоянную доступность или чужие полномочия.
- Считать активность результатом. Количество кликов и часов не заменяет решение рабочей задачи.
- Оценивать по одному эпизоду. Исключение не описывает устойчивое выполнение роли; важны период и достаточная выборка наблюдений.
- Не пересматривать шкалу. После изменения процесса старые якоря могут поощрять уже ненужное поведение.
Вывод
BARS — не волшебная формула объективности. Это дисциплинированный способ превратить расплывчатое «работает хорошо» в обсуждение наблюдаемых действий. Его качество определяется не красивой таблицей, а анализом работы, независимой проверкой якорей, обучением оценщиков и честным учётом контекста. Такая дисциплина помогает обнаруживать слепые зоны менеджмента, которые скрываются за общей оценкой.
Начните с одной роли и одного спорного измерения. Соберите реальные эпизоды, проверьте, одинаково ли их понимают разные специалисты, проведите пилот без автоматических санкций. И используйте цифровые данные только там, где они действительно помогают восстановить событие. Тогда шкала станет основой конкретной обратной связи, а не ещё одной цифрой в личном деле.