Anthropic выкатил Claude Fable 5: 80,3% на SWE-bench Pro, миграция кодбазы Stripe за день, позиционирование — «самая мощная публичная модель» в линейке компании.
Но для ecom и digital важнее не сам бенчмарк, а другая проверка: может ли модель собрать не кусок, а целый продукт — с логикой, интерфейсом, балансом и концовками.
Один промпт на браузерную игру дал рабочий результат: симулятор админа Telegram-канала про ИИ. То есть модель уже умеет не только генерировать код, но и собирать связанный сценарий, где механика влияет на поведение пользователя. 🎮
Что это значит практично:
— быстрее прототипы для внутренних инструментов, витрин и мини-игр;
— меньше итераций на ТЗ, если нужен MVP «на посмотреть»;
— выше риск переоценить качество: модель может собрать продукт, но не всегда правильно вшить бизнес-логику.
Что проверить в кабинете команды:
1) где ИИ уже может закрыть 60–70% черновой сборки;
2) какие сценарии требуют ручного контроля баланса;
3) какие задачи выгоднее отдавать модели целиком, а какие — только на черновик.
Seller Brief
@SellerBriefPro
Anthropic выкатил Claude Fable 5: 80,3% на SWE-bench Pro, миграция кодбазы Stripe за день, позиционирование —
Этот пост опубликован в Telegram-канале Seller Brief. Подписаться можно по ссылке: @SellerBriefPro.