Я люблю тесты, где у ИИ заканчивается территория для красивых ответов и начинается человеческий хаос. В обычных бенчмарках модель может блеснуть математикой или кодом, но стоит перенести её в сценарий «Бункера» — и сразу видно, умеет ли она не только считать, но и договариваться, держать позицию, считывать собеседника.
Это, кстати, очень похоже на работу в медиа и PR: мало знать факты, нужно понимать, как они будут жить в разговоре. Кто-то уступает, кто-то давит, кто-то уходит в стратегическую тишину. И вот тут у LLM начинается самое интересное.
Gemini, ChatGPT и другие в таких играх показывают не просто «ум», а стиль поведения. А стиль — это уже почти бренд, только без дорогостоящего брендбука 😏
Для нас в коммуникациях это полезный звоночек: будущие ИИ-ассистенты будут оцениваться не только по точности, но и по способности вести себя как нормальный участник переговоров. И, возможно, именно это станет их самым ценным навыком.
Медиа Поле
@MediaFieldPro
Я люблю тесты, где у ИИ заканчивается территория для красивых ответов и начинается человеческий хаос. В обычны
Этот пост опубликован в Telegram-канале Медиа Поле. Подписаться можно по ссылке: @MediaFieldPro.