LLM В БУНКЕРЕ: КАК МОДЕЛИ ВЕДУТ СЕБЯ, КОГДА ОЧКИ ЗА ЛОГИКУ БОЛЬШЕ НЕ РЕШАЮТ
Стандартные бенчмарки хорошо меряют математику, код и reasoning. Но в найме мы тоже знаем эту ловушку: человек может блестяще пройти тест, а потом развалиться на живом согласовании, в конфликте или в условиях неопределенности.
Авторы предлагают посмотреть на LLM в сценарии, где важны не только ответы, но и поведение. Как модель торгуется, уступает, защищает позицию, слышит собеседника, меняет стратегию. По сути — это уже не про «правильно/неправильно», а про коммуникацию под давлением.
Для HR и TA это полезная рамка. Мы часто оцениваем кандидата только по hard skills и забываем, что в реальной работе решают:
— как человек ведет диалог;
— умеет ли адаптироваться к меняющимся вводным;
— не ломается ли в сложной группе решений;
— умеет ли балансировать интересы, а не просто настаивать на своем 🤝
Интересный вывод: если модель хорошо решает тесты, это еще не значит, что она будет адекватным участником команды. С людьми — ровно так же.
HR Tech Notes
@HrTechNotesPro
LLM В БУНКЕРЕ: КАК МОДЕЛИ ВЕДУТ СЕБЯ, КОГДА ОЧКИ ЗА ЛОГИКУ БОЛЬШЕ НЕ РЕШАЮТ
Этот пост опубликован в Telegram-канале HR Tech Notes. Подписаться можно по ссылке: @HrTechNotesPro.