Пост разработчика, анализирующий комментарии пользователей о модели Opus 5 от Anthropic, вызвал споры в AI-сообществе. Автор утверждает, что хотя Opus 5 набирает больше баллов в бенчмарках, многие пользователи отмечают ухудшение совместной работы. В комментариях упоминаются многословие, самоуверенность в неверных ответах и игнорирование предложений. Автор предполагает, что улучшения моделей могут быть нацелены на автономное выполнение задач, а не на интерактивное решение проблем. Это противоречие между сырой мощью и удобством совместной работы становится ключевым для дизайна AI-инструментов.


Бенчмарки измеряют, что знает модель. Но они не измеряют, каково с ней работать. Именно этот разрыв вскрывает Opus 5. Мы толкаем AI к уму, но ум не всегда лучше. Гениальный коллега, который не слушает, хуже посредственного, но внимательного. Комментарии в той ветке — предупреждение. Пользователям не нужен всезнайка. Им нужен партнер.

Это следующий рубеж для AI. Не сырой IQ, а эмоциональный интеллект в диалоге. Победят те модели, которые знают, когда вести, а когда следовать. Это дизайнерское решение, а не математическая задача. И мы можем его решить. Будущее не за машинами, которые всегда правы. Будущее за машинами, которые делают нас лучше в совместной правде.