гипотеза недели: LLM умеют не только считать и код писать, но и торговаться за место у костра в «Бункере» 😏
Классические бенчмарки любят цифры: математика, код, логика. Но в жизни часто решает не «сколько будет 7×8», а кто первым договорится, кого поддержит группа и как модель не развалится под социальным давлением.
Что можно вынести из этого эксперимента:
1. Проверять не только IQ, но и «социальный IQ» — как модель ведет себя в переговорах.
2. Сравнивать не ответы, а стратегию: уступает, давит, манипулирует, ищет альянсы.
3. Смотреть на устойчивость к хаосу: меняется ли позиция, когда правила плывут.
4. Тестировать LLM в сценариях, похожих на продуктовую реальность: спорные решения, конфликты, ограниченные ресурсы.
маленький кейс роста: если ваша модель помогает пользователю не просто найти факт, а пройти через сложный выбор — это уже не «чатик с текстом», а заметно более полезный продукт 🚀
Growth Geeks
@GrowthGeeksPro
гипотеза недели: LLM умеют не только считать и код писать, но и торговаться за место у костра в «Бункере» 😏
Этот пост опубликован в Telegram-канале Growth Geeks. Подписаться можно по ссылке: @GrowthGeeksPro.