Обновить

пожалуйста не злитесь, просто болтология

Везде слышу споры вокруг агентов и помощников: никто не может договориться, что есть агент, что ассистент.

Да я и сама не всегда понимаю, что передо мной: агент, ассистент или что-то между (а так вообще бывает?).

Сама себе попыталась разложить на бытовой метафоре.

Когда я в сотый раз пытаюсь совладать с базовым джипити или гроком по поводу стиля и дурацких нейро-конструкций, неосознанно переношусь в рабочие отношения. Где раз за разом просишь линейного сотрудника не забыть базовые вещи: редполитику, если это тексты, кодстайл — если разработка, формат карточки, если речь об аккаунте. О более сложных вещах, где нужно включить логику, отойти от задачи и посмотреть на нее из позиции «над», речи вообще не идет. Сложная архитектура, стратегия, креатив... чаще всего я получаю примитивный результат и думаю, что лучше бы сделала сама с нуля.

У меня проблемы с промптами? Допускаю

However. Есть в команде 1-2 хидден гема, самостоятельных готовых менеджера, которым можно довериться и просто отдать задачу и забыть о ней. Они сами подумают, сами поищут, отберут ресурсы, придумают, как решить проблему, и в итоге, всеми правдами и неправдами, принесут результат. Что важно: хороший. Из минусов: чаще всего это несчастные перфекционисты, которые считают, что они — это их работа и что каждая ошибка — провал. Мечта бизнеса: повышение, скорее всего, тоже будут просить редко.

Может быть, развитие ИИ и создание сложных мультиагентных систем наконец-то снимет груз с этих несчастных перегорающих раз в квартал бедняг с синдромом отличника? Было бы славно, может, я и сама наконец-то схожу в отпуск.

Хотя что-то мне подсказывает, что они (мы) просто найдут новые возможности перегорать и нести больше, чем могут на себя взвалить. А вот ассистенты — продолжат жить счастливо, хоть и, скорее всего, бедно.

Теги:
Рейтинг0
Комментарии2

Я перестал пользоваться самыми умными ИИ‑моделями. Программировать стало быстрее и дешевле

В отпуске есть время подумать и исследовать. Я натолкнулся на несколько вещей и открытий для себя. Оказалось, что мне как программисту перестали быть нужны самые умные и дорогие ИИ‑модели. Оказывается, есть такой параметр «Cost per Task», и по этому параметру на первое место вырвалась модель GPT-5.6 Luna (max).

При этом, если вы пользуетесь Codex, она самая тупая в списке моделей. Artificial Analysis Intelligence Index у нее всего 38. Для сравнения, у самой умной GPT-6 Astra (max) этот индекс равен 53. В итоге цена выполненной Luna задачи составляет $0.18 против $3.26 у Astra. Разница почти в 20 раз.

Как я понимаю, бенчмарк «Cost per Task» высчитывается так: когда ставится нормальная, грамотно описанная задача, замеряется, сколько токенов было потрачено на ее выполнение. То есть не в формате «из ХЗ сделаю ТЗ», а в формате, когда в хорошо заданном вопросе уже содержится половина ответа.

Я сначала не поверил, что так и есть, и стал работать, используя самую тупую модель Luna в линейке. И знаете, какие меня ожидали результаты?

Я перестал пользоваться самыми умными ИИ‑моделями. Программировать стало быстрее и дешевле

Публикации