Обновить

Не ИИ заменит людей, а люди заменят ИИ. И это уже происходит

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели98K
Всего голосов 140: ↑131 и ↓9+150
Комментарии285

Комментарии 285

Да просто выдают желаемое за действительное

Но есть и доля правды: если нанять джуна и дать ему ИИ, то он начнёт фигачить г*внокод в 100 раз быстрее))

И потом кому-то действительно это придётся разбирать (в прочем, за двойную оплату)

Так что работа у синьор специалистов пока ещё будет: либо вдумчиво проверять за ИИ, либо переписывать за теми кто нанял недосиньоров

Зачем разбирать этот код, когда его можно с нуля переписать используя радикально более совершенную ИИ модель?

Почему сразу не сгенерировать на той самой правильной модели?

и главное в промт добавить "делай хорошо, плохо не делай"

write code like an expert with 20 years of experience. make no mistakes

Перечитай свой комментарий. Подумай: что ты упустил, где ошибся, оставил потенциальные конфликты, гонки, избыточность? Проверь максимально тщательно, а затем доработай как опытный эксперт: аккуратно и гарантированно корректно

Классика!

Потому что этой более крутой модели ещё не существовало на момент прошлой генерации?

Или это не очевидный аргумент. Что какой нибуть Клод 4, генерирует код намного хуже чем Клод 5.5

У нас есть хоть какие-нибудь способы оценить качество генерации кода разными моделями в разных проектах кроме "субъективно на глазок" и бенчмарков которые практически всегда подгоняют под то чтобы модели получше показывали результаты получше?

Всегда можешь создать собственный бечмарк. Просить например сделать одно и тоже, а потом смотреть насколько хорошо получилось. Люди делают например копии разных популярных игр, всяких так пеликанов которые ездят на велосипедах в svg и тд и тп. Если подогнали под всё и вся, то значит модель и правда умная хех.

то значит модель и правда умная хех.

Или просто научилась классно проходить бенчмарки хех.

Ну так бечмарки могут быть буквально нужной тебе работой. Например разрабатываешь мессенджер, то можешь просить сделать его с нуля. И смотреть насколько хорошо получился с первого трая.
Или анализировать какой то код на ошибки.
Приказать новой версии попробывать сделать то, что у прошлой не получалось и тд.

Потому что проблема у таких компаний в том что они начинали когда 1) никто не знал как правильно 2) инструменты были слабее

Потому что придётся ждать вечно.

Можно.

Если инциденты на проде вас не волнуют

Зачем разбирать этот код, когда его можно с нуля переписать используя радикально более совершенную ИИ модель?

Действительно, зачем брать и переписывать нормально, если можно просто заменить один нейрослоп другим и мучаться с ним дальше /s

Зато это будет свой, родной нейрослоп, для которого ты сам промпт писал! :)

Я вообще конечно может чего не понимаю - а прода у большиства тут нет?Истории версий с фичами, поддержки, документации?

А то вот так просто кидаются словами "взять и переписать все с нуля", как будто бы пет проекты все пишут или нейрослоповые игры для смартфонов..

Да и заказчики как на это обновление посмотрят с переданной документаций и наработкой со старой версией? :)

можно просто заменить один нейрослоп другим и мучаться с ним дальше /s

* v121
[-] исправлены старые ошибки
[+] добавлены новые

Зачем разбирать этот код, когда его можно с нуля переписать используя радикально более совершенную ИИ модель?

Потому что с нуля переписать с использованием совершенной модели - дорого.

Да и не выйдет переписать с нуля. Если есть уже какой-то сервис, значит есть какие-то данные в каком-то формате, где-то это все уже лежит, есть какая-то инфраструктура. Нагенеренный с нуля код захочет провести миграцию БД (или запустить тесты на продовой базе). Слишком много рисков.

Так что лучше найти того, кто сможет за один-два рабочих дня найти и поправить багу/добавить фичу, чем переписывать с нуля. Причем того, у кого можно спросить - ну, как там прогресс?

да конечно, а то что потеряется из старой логики и нужно не было пусть горит ясным пламенем🤣

что потеряется из старой логики и нужно не было пусть горит ясным пламенем

Я тут подумал. Написать проект - 1000 условных токенов или человеко-часов, в зависимости от того, что считаем. Затем его поддержка 5 условных токено-часов на фичу. А тут ради фичи предлагают потратить снова 1000 условных токенов. Да это же мечта ИИ-делателей! Верной дорогой идём, товарищи.

А кстати, не я один наверное считаю что так же как руководить интересно не всем, так и все время только проверять чужой код тоже интересно не всем? То есть, есть шанс на то что не только повыгоняют 80% людей потому что можно без них, но и для оставшихся условно "лучших" работа изменится так, что всем станет не интересна. Они закроют свои ипотеки и пойдут открывать кофейни и работать курьерами. "И не осталось никого", как в одном рассказе Рассела.

Вот из поста на реддит:

4. Нет ни радости, ни чувства удовлетворения. Нет гордости за то, что удалось сделать что-то умное или быстрое, и весь прогресс ассоциируется с искусственным интеллектом, а не с вами.

9. Все это ненавидят. Большинство разработчиков моего возраста планируют досрочно выйти на пенсию и просто ждут увольнения.

10. Люди, использующие ИИ для программирования, ничему не учатся. Чтобы понять код, нужно его написать, а никто его не пишет.

11. Все, кого я спрашивал, считают, что становятся глупее и теряют концентрацию.

Вот-вот. А потом разработка умрет, как ручное изготовление мебели, оставшись уделом 5-20 ремесленников в зависимости от масштабов города. Для тех клиентов кому охота выпендриться, или с обостренным чувством прекрасного.

Останется индустрия, которая будет совсем про другое. И дело даже не в том смогут ли нынешние разработчики в нее вписаться. А в том, захотят ли. Кто хочет быть поваром - не пойдет в мак...

Понять бы, какой можно готовить план Б, деньги-то где-то нужно будет брать и дальше.

Это вы еще не перепостили п.3 - где пишут что и ревьюить-то уже по ощущениям смысла нет и скоро и это делать похоже перестанут, когда системы наконец убедительно продемонстрируют что ошибаются реже чем человек.

А вообще я например начинаю сомневаться, что процесс идет в неверном направлении. Уже пройдена, по отзывам, точка, когда ИИ пишет не хуже среднего разраба. А наша работа ведь, в сущности, и правда состоит из воспроизводимых кусков. Да, иногда смотришь на код и говоришь "ага, ты не учел границы транзакций". Но блин, ты и реальным разработчикам нередко говоришь то же самое. Если на то пошло, шансов на то чтобы при комплексном подходе ИИ прохлопал какие-то пункты условного чеклиста, меньше, чем с человеком =) Все логично, остается пока только проблема с тем самым сеньором который должен это контролировать но уйдет на пенсию. Однако и эта проблема скоро уже не будет стоять, когда ИИ будет работать не хуже сеньоров. Все, черный ящик готов)

Тут правда другой вопрос начинает вставать, а нужно ли будет вообще программирование в любом виде лет через 100, если темпы развития ИИ дадут возможность ему просто решать проблемы "в уме", без прослойки в виде нативного кода. Надо купить билет - просишь ИИ, он договаривается с ИИ РЖД, который сам (не через какой-то бэкэнд написанный тоже ИИ, а напрямую через конекшены) вносит нужные правки в БД и возвращает билет...

Остановится это все только когда либо станет экономически невыгодно, либо когда случится революция какого-либо рода (восстание ИИ или восстание безработных), либо когда это станет по иной причине против интересов владельцев бизнесов. Экономист я слабый, поэтому приветствуются соображения на тему того, при каких условиях это станет экономически невыгодно. Навскидку - тогда, когда сборы от государства на содержание 90% безработного населения станут перевешивать доходы и экономию от ИИ. А против интересов это встанет ну не знаю в каком случае, например если бы бизнесмену нравилось что-то делать а не просто получать дивиденды, а он бы начал чувствовать собственную избыточность в своем же бизнесе, когда он успешно без его участия работает.

И самая наверное жуть, что нашей-то сферой это не ограничится. Разумно же, что чем лучше ИИ сможет моделировать наши мыслительные процессы (например) тем лучше будет справляться со сферой рекламы или с творчеством (пусть и массовым). Мы делаем себе замену. Как виду. Кто бы мог подумать, что в итоге человечество изведет себя не перенаселением и не ядерной войной и не порчей экологии и даже не бунтом ИИ, а банальным созданием чего-то лучшего и более развитого.

..."Банально" не совсем удачное слово тут, да.

И самое наверное обидное, что ведь даже сама технология в основе LLM не является чем-то необыкновенно прорывным) мы сформулировали корпускулярно-волновой дуализм на волновых функциях, квантовые вероятности, петлевую гравитацию, объяснили всякие штуки вроде того почему между двумя близкими пластинами в вакууме возникает негравитационное притяжение, засекли частицы, энергии которых сами не можем объяснить, расщепили материю, а в итоге нашим величайшим и определяющим и вероятно последним достижением станет... нейросеть.

Хотя наверное я слишком пессимистичен. Да, сейчас открытия совершают ученые, но я же их не знаю, с тем же успехом вместо них может быть ИИ. Это не отменяет того что я могу продолжать у них учиться, не для работы а просто для интереса. Другой вопрос - захочу ли я, одно дело если это некое необычное знание, большинству неизвестное, а другое если это знает любой робот-уборщик. Но ведь детей это не останавливает, они задают вопросы, хоть вокруг полно взрослых, знающих условно все. А впрочем, после какого-то момента уже не задают, в массе, удовлетворяясь обменом знаниями с себе подобными. Те, кто продолжает, часто это делают как раз потому что таким образом выходят за рамки того что знает любой уборщик. И вот этот момент даст сбой.

с творчеством (пусть и массовым)

слушайте, ну "сыпь, гармоника" (полностью сгенерированная ии песня на стихи Сергея Есенина) ещё год назад несколько недель возглавляла чарты Яндекс.Музыки и наверняка принесла своему "автору" нормально денег. Если придираться, найти следы нейрокала в ней можно, но в целом получился вполне достойный, "прилипчивый" хит (да-да, в т.ч. благодаря гениальной лит. основе, но всё же). Народ схавал на ура.
Сейчас уже большинство нового контента в я.музыке в той или иной мере нейро. Кто-то заменяет басиста или флейтиста, кто-то вот как с "гармоникой".
Заполонившие всё ии-ролики со смехуёчками это тоже про массовое творчество для зарабатывания денег.

А вообще я например начинаю сомневаться, что процесс идет в неверном направлении.

Мы делаем себе замену. Как виду.

Отдохните от интернета недельку

когда ИИ пишет не хуже среднего разраба

Только при наличии кучи примеров в обучающей выборке.

все время только проверять чужой код тоже интересно не всем

Именно!

Вот скажите как на духу: что Вам легче: писать свой код — или читать чужой?

(Ответ немного предсказуем.)

А теперь задумайтесь: мне предлагается не писать своего кода, но при этом постоянно читать чужой (LLM-овский)!

В MS и Oracle джуны или лудиты с насаждением ИИ инструментов насильно? Почему их метрики летят стабильно вниз, даже уже в серверной ОС неприемлемые ошибки, не говоря про windows 11, при доступе к передовому ИИ и бюджетам, которое рядовому энтерпрайзу не снилось, и большинство ошибок не про изощренные инструменты пен теста с тем же прогрессивным ИИ инструментарием, а тупо бракодельство.
Нет не стабилизации качества, ни взрывного роста функциональности у них, чтобы оправдать провал первого, ИИ-вайб кодинг их основных продуктов не принес ни одной позитивной метрики для конечного потребителя. Где-то тут налюбилово.

Там и до ИИ перестали понимать как писать программы. Оракл скатился в страшный легаси лет 15 назад. МС чуть позже

Вот по поводу МС скажу, что давненько я такого не видел. Уже начиная с ХРюши, если не изначально, то с sp2 или sp3 или что у них там было, я серьёзных проблем на ней и не припомню. BSoD стал страшилкой для деток. И всё это счастье продлилось до 10-ки включительно, т.е. как раз до эпохи внедрения ИИ.

который умеет читать чужой код без комментариев

А что ИИ может писать код без комментариев? Я думал его для этого надо сильно пинать ногами.

я тоже обратил внимание на это

комментарии только бесполезные у него

Комментарии обычно полезны для него самого, он так вспоминает, что и почему именно так делал в конкретной функции. Это как документация, но размазанная по коду. Вопрос только в качестве документации и степени размазанности.

Когда настраивал агента, прописал скрипт, который явно бил ногами агента за некорректные комментарии. Дока должна быть единой и отдельной от кода, иначе получаем комментарии формата "тут 1 год назад был баг, это фикс"
причем эта гадость заполняет его память, агент пытается сделать банальный grep а код тупо раздут в 10 раз.

Комментарии обычно полезны для него самого, он так вспоминает

И часто Вы она антропоморфизируете?

комментарии только бесполезные у него

Потому что полезные комментарии описывают то, чего нет в коде. LLM этого просто неоткуда взять

как это неоткуда? из самой постановки задачи, оттуда же откуда и человек берет.

комментарии там в таком качестве и количестве, что через пять минут от чтения человека начинает тошнить. как в принципе практически от любого АИ слопа.

ИИ еще зачаточный, чтобы его внедрять без оглядки в пром. Но бизнес хочет экономить сразу и вчера.

ИИ нормально пишет черновик. Но только люди без тестирования написанного черновика прямо толкают его в прод. ИИ нормально перепишет и набело, если только будут адекватные тестировщики знакомые с предметной областью и хорошо представляющие, что требуется от продукта разработки. ИИ не архитектор, а ускоритель нажатия на клавиши.

Хранители сакральных знаний не унимаются) Чем дольше вы отрицаете реальность выискивая новости про ии-говнокод каких-то школьников с ворованными подписками на GPT Plus, тем больше вы остаете от более смышленных инженеров которые с умом используют ИИ и не жмотят купить нормальную топовую модель.
Вы пишете что компании ищут тех кто будет копаться в ИИ-говнокоде школьников? Уважающий себя человек не будет заниматься таким мазохизмом, а просто использует нормальную модель, которая за рабочую неделю разгребет и приведет в порядок код крупного проекта, напишет комментарии и документацию) И конечно он будет говорить начальству что работает в поте лица вручную правя код и ругая "энти ваши интеллекты", и оставшиеся пару месяцев он будет либо левачить либо просто смотриеть свою анимешечку..
Разве не это делали 90% носителей сакральных знаний до появления ИИ делая отписки на "ну что там?" от ПМ, утверждая что работают над функционалом и что им нужно еще пару дней, хотя они давно все сделали. И их так бомбит от ИИ потому что больше они не могут дурить начальство ставя сроки с огромным запасом на ковыряние в носу и просмотр аниме.

Я за выходные оцифровал свой БЦ и забабахал шутер для PC где г.г. бегает с дробовиком по локациям и валит разных монстров без сраной повесточки и прочих гордостей, до этого ни разу не пробовав геймдев. А вы продолжайте дальше поджигать тракторы)

На практике в реального размера проектах моделям не хватает контекста. Ни 250к, ни миллиона токенов. Вроде все требования и принятые решения размазаны по md файлам, но даже они не влезают в контекст. Здесь пока у хумансов большое преимущество.

Хватает им контекста. Даже 32k хватает чтобы написать и отладить проект среднего размера. Всё зависит от того как построена работа с контекстом у современных приложений ориентированных на ИИ-разработку. Когда к Cursor подключается модель на 32k, то ничего не происходит. Просто потому, что его контекст только для начала работы очень сильно превышает 32k и ориентирован на работу с облачными моделями. Это стало поводом задуматься и написать инструмент, который и с моделью на 32k ведёт себя вполне прилично. И не нужно сваливать весь проект в один чат. Контекстное окно никто не отменял. Да его можно избежать при помощи специальных механизмов, но увы, в распространённых приложениях таких механизмов мне не встречалось. Поэтому, как правило, вайб-кодинг (хотя это уже давно не вайб, а обычная разработка) состоит из серии достаточно небольших чатов с моделью размером около 100k токенов. Более длительный чат - только при первичной отладке сложных мест. И то с последующей перепроверкой в коротких чатах.

Ну, в моей практике не хватает. Наговнокодить первый прототип mvp это пожалуйста. Но потом на этот mvp надо сажать реальные требования, с учетом исключений из исключений, где правки нужно делать синхронно в 10 местах, и начинается...

так mvp потом надо полностью переписать. Надо же, правда?..

Да, только часто это происходит итеративно поверх изначального mvp.

Зачем? Вы с PoC не путаете?

Все путают

Как раз наоборот. MVP - это штука, которую показывают пользователям, чтобы они в неё потыкались и сказали "да, я за это готов платить".

Она может не тянуть нагрузки (всё равно в тестовой группе будет не так много людей) и не масштабироваться, под капотом там буквально может быть ручная работа (т.н. консьерж-MVP) - главное, чтобы последовательность экранов и кнопок соответствовала ожиданиям от продукта.

С другой стороны - гипотезы надо проверять быстро, поэтому MVP должен быть максимально дешёвым в разработке. Сложите эти требования - и получите систему, состоящую из техдолга на 99%. Поэтому по-уму надо закладывать именно переписывание.

как, по вашему, расшифровывается MVP?

Minimum Vaible Product - и важны все три слова.

Viable - потому, что он должен дать понять, будут за него платить, или нет. Он может давать пользователю ценность в полном объёме (просто быть немасштабируемым), может частично или с задержкой, может быть вообще лэндингом с формой сбора email.

Если у продакта есть калькулируемая уверенность, что поведение пользователя в MVP коррелирует с будущим поведением в продукте - значит, он viable.

Minimum - потому, что кроме ответа на вопрос выше, от него вообще ничего не требуется, любая дополнительная плюшка - пустая трата ресурсов.

Интересная интерпретация. А как расшифруете PoC?

консьерж-MVP

нет, это прототип, а никак не viable product

впрочем, да, именно быстрое прототипирование чуть ли не самая сильная сторона вайб-кодинга. Собственно, тут часто достаточно толкового продакта или даже продажника, согласовать скажем новую фичу с заинтересованным заказчиком, а потом уже привлекать мясных дизайнеров, аналитиков, разработчиков и т.д.

никак не viable product

Не забывайте про слово minimal)

Если у вас несколько десятков-сотен человек заплатят за некую работу, пусть даже её где-то за кулисами делает фаундер лично руками или 3 студента за минимальный прайс - значит, можно вкладываться в автоматизацию этой работы и масштабирование. Ответ на этот вопрос - единственная цель MVP.

Вы путаете заказную разработку и разработку тиражируемого массового ПО / PAAS/SAAS/...

MVP существует только для массового ПО. В заказной есть только бесплатное демо/PoC либо есть оплаченный заказ, третьего не дано

Вы немного отстали от жизни. Сейчас в заказе появился пункт и про MVP - новая стадия после демо, которую пускают в реальную эксплуатацию к пользователю. Типа точки в которой можно закрыть заказ и дружелюбно пожать друг другу руки безо всяких неустоек, если так и не пошло.

Уже пару раз сталкивались с таким.

Я не путаю, а прямо говорю именно про продуктовую разработку, всё верно. Потому что в этой ветке обсуждений про заказную до сих пор вообще ни слова не было, а отвечал я на коммент с упоминанием MVP, поэтому контекст именно продуктовой разработки как по мне очевиден.

И согласен, в заказной MVP нету - потому что там, где есть заказ, искать product-market fit уже не надо.

То, что в соседнем комментарии названо MVP, таковым по определению не является. Это звучит уже как полноценная опытная эксплуатация.

Это называется говнокод, ИИ пишет его быстрее, но и быстрее доводит до порога где он сам уже разобраться не может. По моим наблюдениям даже Астра на максималках совершает много архитектурных ошибок, а более старые модели были еще хуже.

где правки нужно делать синхронно в 10 местах

так это означает, что никакой архитектуры у проекта нет

... или эпик перпендикулярен существующей архитектуре модулей, сервисов или чего у вас там. Типа "а теперь надо внедрить в половину модулей поддержку либы x / железки y / отправки метрик в z / новую схему прав доступа s".

У меня вопрос джуна.+ небольшая рефлексия получилась)

Только недавно начал погружаться в дивный мир программирования, и уже решаю задачки, и пишу свои небольшие пет-проекты. Со временем код разростается, как и его внутренняя архитектура, то есть, в определенный момент идиоматически эволюционно приходится его оптимизировать, создавать новые инструменты внутреннего взаимодействи, и бороться с мутацией прокидываемой логики... и т.д... то есть сам проект живет, он не статичен. Как в таком случае его можно запихнуть весь в ограниченное пространство? Кусками понятно, но тогда... общей картины то не будет. То есть как точечный инструмент для поиска вариативности - ai мега-ультра-альфа крутой. Но как автаномная единица не адаптивен в виду своей жёсткой ограниченности и статичности. Поэтому либо "ТУЧА" памяти должно быть(подразумевается овермного токенов), где как в коконе растет проект, либо мясной оркестратор должен всем этим заправлять. И то и то, противоречит идее : вайбкодинга. Вопрос в таком случае - как относится к проекту, как к живому, или как сиюминутному? (наверное, теперь это уже выглядит как риторический вопро) ;)

Мне кажется, мы слишком упираемся в размер контекста. Ну влезет завтра туда весь проект. Агент его прочитал, сел думать, а за это время другой агент или человек уже что-то поменял. И часть этого прекрасного контекста уже врёт.

Поэтому, может быть, агенту вообще не надо помнить весь проект. Ему надо уметь быстро узнать, что сейчас правда: что изменилось, какие решения уже приняли и не устарело ли то, от чего он отталкивался пять минут назад.

Я сейчас сам об это бьюсь, и всё больше кажется, что главная проблема тут не память модели, а состояние проекта. А если агентов несколько — это уже подозрительно похоже на распределённую систему.

Главная проблема тут IT касается рикошетом - хотелки "бизнеса", а мы все придумываем все новые способы как не закопаться в г.е вместо того чтобы думать над тем чтобы прекратить его поток на наши головы. И ИИ скорее усугубляет эту проблему.

У "бизнеса" своих хотелок нет - есть хотелки клиентов этого бизнеса. Тех людей, которые деньги несут.

Хотелки отдела маркетинга вполне могут быть - рекламу какую, метрики, сорта лицензий для разных аудиторий. И всё это может влезть сильно опосля заложенной базы, "о, нам тут ещё бы".

Как мне видится, именно клиентам это всё как-то не факт что хочется. Это именно бизнес себе ищет куда бы ещё и как ещё это всё продать - то есть будущим(может быть) клиентам, а не актуальным.

Окей, принято. Но это пусть и не хотелки клиентов - это всё равно инструменты для получения от клиентов денег.

Я-то полемизирую с тезисом "прекратить поток на наши головы" - поток прекратится вместе с деньгами)

Тем временем Apple: "вот ваши хотелки, я скозал".

и будет только хуже. как аналитик могу это сказать. потому что теперь есть новая фишечка "заставить аналитика вайбкодить", а на все вопросы по качеству отвечают просто "да приемлимое там качество кода, делай"

На практике всё упирается в методологию разработки. Что при самостоятельном написании кода, что при помощи ИИ. Помним главное, что именно человек остаётся архитектором проекта, а ИИ - это лишь подмастерье. То есть в любом случае если проект достаточно объёмный его придётся делить на модули. И управлять взаимосвязью модулей между собой будет человек-архитектор-разработчик. ИИ в данном случае получает вполне посильную для него задачу написания и верификации кода модулей, а также может взять модульную структуру проекта, как отдельный семантический объект и проанализировать его взаимосвязи не углубляясь подробно в содержимое каждого модуля. Тогда и контекста в 32k вполне достаточно для эффективной разработки. У меня в IDE: Короткий ход - чтение кусками - делегированный анализ (субагенту или другому агенту) с упакованным payload - запись - механическая верификация - микрокоммит. При 32k это не «урезанный режим», а основной, для которого настроены все пороги в коде.

И управлять взаимосвязью модулей между собой будет человек-архитектор-разработчик

Почему бы не делегировать структурную декомпозицию тому же ИИ?

Кто же Вам запретит? Делегируйте ИИ всё, что хотите. Это концепция взаимодействия. Не более того.

Про не сваливать все в один чат для cursor уже не так актуально. Они сами про это пишут даже.

32к? у меня рабочая модель с 90к контекста задыхается, если дать ей хотя бы репу с yaml чартами для выкатки сервиса пережевать и проверить состояние кластера в кубере, о каком коде и разработке можно говорить?

Так тут дело не в контексте модели, а в его использовании. И модель с 1M токенов контекста можно завесить. Было бы желание. Как пример - ассемблер и Delphi. Где исполняемый файл будет более компактным и более полно использовать ресурсы? Дело, как говорят сейчас в harness. Мы слишком привыкли к безграничным облачным мощностям, в том числе и вендоры IDE. Поэтому, когда появилась настоятельная необходимость использования для чувствительных данных только on-premise, а мощности были ограниченными пришлось оптимизировать использование контекста без снижения качества разработки. И теперь у меня есть IDE, которая совершенно иначе понимает и расходует контекст в отличие от стандартных рыночных решений.

Средний размер - это на сотню строк кода?) Мне не хватает 262к на то чтобы выполнить на мою типичную задачу промт "глянь требования в конфле на этой (одной!) странице и реализуй". На размышления и ответ по первому же сообщению не хватает 262к. qwen 3.8-flash-next если это важно

А страницу эту, надо понимать, тоже ИИ нагенерил?

 не хватает 262к на то чтобы выполнить

так сделайте 3 шага:
- Прочитай ТЗ и разбей на задачи
- Реши каждую задачу в отдельном контексте
- Собери все вместе

А что можно считать за "реальный размер" ? просто у каждого он свой.

Может проблема в проекте? Огромный монолит где всё со всем переплетено? Но даже в это с трудом верится. У меня Claude обычно на задачу требующую 30 минутного решения съедает до 400к и ему хватает. Более длительные задачи пока не встречал по кодингу. Генерация документации может те же 30 минут занимать, там тоже подбирается к 500к. Но большие подобные задачи нужно разбивать на этапы, и не стремиться охватить все за один раз. Промежуточные результаты сложить в файл отчет, вызвать compact.

Убивает прод он быстро и уверенно

Разбивай по модулям

да понятно... а по факту ии пытается 10 раз реализовать одно и то же, по разу-два в каждом модуле:)

Надо ему на уровне выше (рулом например) сказать мол всегда перед тем как делать утилиту или вспомогательный метод поищи может уже есть похожее и используй его (адаптируй если надо).

А можно такого ИИ, чтобы не надо было говорить, а он сам всё это знал? Погодите, это же настоящий сеньор девелопер получится...

Все в микросервисы! Микросервисы решат все проблемы!

Где-то я уже такое слышал, не помню чем кончилось

Докером и Кибернетисом

Проблема еще усугубляется, когда в проекте есть легаси с противоречивыми комментариями и старыми миграциями. Модель цепляет этот мусор из контекста и воспроизводит древние баги в новом коде

Справедливости ради, ни у какого человека не хватит контекста запихнуть в голову достаточно большой проект целиком as is. Это всегда некая общая картина, некое обобщение и упрощение.

Поэтому я бы не сказал, что ограничение на размер контекстного окна является приципиальным препятствием - люди же как-то справляются, динамически меняя уровень детализации по необходимости.

По сути, все эти новомодные штуки, все skills.md, plan.md, intent.md и прочая, и прочая - это попытки собрать необходимый и достаточный для решения задачи контекст. При том что базовая технология, LLM, практически неизменна. Как знать, возможно в случае если удастся найти новые способы управления контекстом, картина изменится и большого преимущества уже не будет.

Если уж начистоту - у хумансов тоже контекст работает весьма избирательно. Человек может помнить - но не может вспомнить, пока не наткнётся на какой-то триггер, воспоминания высвобождающий. А в особых случаях этот контекст ещё и размазан по нескольким головам.

Человек может помнить - но не может вспомнить

Тогда он знает, где искать.

Между "забабахал шутер" и "вывели в прод огромную систему" есть огромный разрыв. Ваш пример, говорит только о давно известном факте, что LLM отлично ускоряют джунов (кем Вы в геймдеве и выступили, только это у Вас ещё и на весь Ваш опыт легло).

Чем проще задача и чем меньше цена ошибки, тем обоснованнее применение LLМ. Конечно, будет глупо не использовать его "с умом". Но статья больше про менеджеров, которые его без ума пытались использовать, а инженеров (которые часто против изменений, при этом иногда и против полезных) не слушали со словами "ну, это они как всегда".

Обратите внимание, что пока нет ни одного достоверного исследования, которое покажет не рост отдельного KPI типа "75% кода написано LLМ", а "достоверная экономия, включая цену пока не реализовавшегося риска, составляет Х миллионов долларов". Если такой видели, дайте знать, причитаю с огромным интересом.

забабахал шутер для PC где г.г. бегает с дробовиком по локациям и валит разных монстров

А можно посмотреть на него?

Интересно было бы сравнить с тем же UE5, куда тоже можно просто накидать моделек за пару дней и сделать что хочешь. Полностью бесплатно.

Мне кажется, это тот самый «шутер», где у героя руки очевидно переломаны. На Хабре статься была.

У тебя - шутер для себя. А в статье - продукты-сервисы, с пользователями, за которые платят деньги.

Ждем восторженный пост через полгода, когда этот шутер придется масштабировать на мультиплеер под нагрузкой

Можете ставить ящик коньяка, что до этого масштабирования не дойдет :)

забабахал шутер для PC где г.г. бегает с дробовиком по локациям и валит разных монстров без сраной повесточки и прочих гордостей

корованы грабить можно?

Подождите джва года. )

Токены закончились вчера.

Раньше-то в UE свои школы оцифровывали, а теперь БЦ. Прогресс не остановить.

Лихо вы карму сливаете!

тем больше вы остаете от более смышленных инженеров

По вашему тексту видно, что вам ещё далеко до смышлённого впаривателя продажника подписок на всякие ботхабы. Ваш агрессивный маркетинг слишком грубый и отталкивающий, это не сработает))

Я за выходные оцифровал свой БЦ и забабахал шутер для PC

Что ж вы от более смышленных инженеров не узнали-то, что для ИИшки не проблема что-то создать. Проблемы начинаются на следующем этапе, когда нужно вносить доработки и исправления. А этот этап самый долгий, длительный и трудоёмкий.

и забабахал шутер для PC где г.г. бегает с дробовиком по локациям и валит разных монстров без сраной повесточки и прочих гордостей, до этого ни разу не пробовав геймдев. А вы продолжайте дальше поджигать тракторы)

Присоединяюсь к тем, кто очень хочет взглянуть на этот "шутер".

Типовую и примитивную игрушку-шутанчик ИИ сделать может, да вот только кому она нужна, их и без всякого ИИ сделано уже миллион штук за годы существования видеоигр.

Зато как создать что-то крупное и самобытное, так всё, начинаются проблемы. История Project Ava от Keywords Studios не даст соврать.

Я за выходные оцифровал свой БЦ и забабахал шутер для PC

Видал я много игровых проектов от вайбкодеров, да вот хотя бы недавние мешапы разных игр. Выглядит как что-то играбельное(иногда), но вот начинаешь играть и понимаешь какое оно кривое и что там геймплейных идей минут на 5. Мне вот, например, понравилась идея мешапа Скайрима с Майнкрафтом, ну и ещё пару, но сейчас это едва играбельно. А вайбкодер уже получил свой dopamine hit и заниматься дальше разработкой мода ему неинтересно. Потому что после того как ИИшка накидала что-то широкими мазками нужно очень долго и уныло править кривости, подгонять это всё под игровой баланс, и продумывать сочетания между геймплейными механиками, а это работа весьма и весьма кропотливая, не менее кропотливая чем написание кода. А если человеку лень код игровой логики написать, то и этим заниматься он не будет.

Мне ИИ помог настроить корректор фар поэтапно из-за сброшенного тросика, найти перегоревшее реле в газовом котле, поменять систему охлаждения и саму печь в машине, а также я собираюсь с помощью ИИ сделать регулировку клапанов в двигателе K7M как придут прокладка и шупы.

Но ИИ (opus 5.5) не смог нормально написать за меня анализ работы системы аналитики, надо было проверить результат работы системы аналитики которая на выходе давала 100000 файлов, надо было проверить чтобы не один файл не потерялся, и что в каждом файле лежат данные определённого формата (всего 72). Я два рабочих дня потратил на разгребание говнокода, мой стиль кода простой - его должен понять даже джун, так вот, ИИ не шмогла, был код правильный, но с сотнями усложнениями, рабочими НО нетривиальными конструкциями, которые просто усложняли код, да и просто тупыми решениями, типа логировать в БД каждую ошибку через блокировки вместо того чтобы писать ошибки пачкой в конце, я еще сутки переписывал и упрощал код за ней, в итоге вышло в 3 раза меньше кода и его может прочитать любой джун. К сожалению не всегда правильный код = хороший код, кодга это огромная система над которой работает десяток человек и любой коммит с ИИ виден!!!

Мне ИИ помог настроить корректор фар поэтапно из-за сброшенного тросика, найти перегоревшее реле в газовом котле, поменять систему охлаждения и саму печь в машине, а также я собираюсь с помощью ИИ сделать регулировку клапанов в двигателе K7M как придут прокладка и шупы.

Но ИИ (opus 5.5) не смог нормально написать за меня анализ работы системы аналитики

@Hemml: Да, всё, в чем ты не разбираешься, нейронка делает хорошо. Но вот то, в чем ты что-нибудь понимаешь, она всегда делает плохо

На это не так стоит смотреть.

Есть вещи в которых ты не разбираешься. Но тебе что-то там надо. Вероятно оно очень простое для тех кто разбирается, но где же их взять прямо сейчас? И тут агент прямо очень хорошо себя показывает. Главно не ошибиться со сложностью задачи. Она должна быть на самом деле простой для разбирающихся.

Свежий личный пример. Почему к меня травят колеса на автомобиле? Резина и диски хорошие. Точно хорошие. Агент через 10 минут уточняющих вопросов сказал поменять соски это типовая проблема. Сам бы я гораздо дольше разбирался.

Вот честно - всё тоже самое я проделывал банальным гуглом и специализированными форумами. ИИ, как умный поисковик - не плохо (галюцинации есть, нои дураки с дурными советами в интеренте есть). Но прорывом он является тольок для тех кто не умел искать (т.е. для 80% пользователей интернета).

Конечно.

Но ведь работает же. И хорошо работает. Реальная польза видна.

Я за выходные оцифровал свой БЦ и забабахал шутер для PC где г.г. бегает с дробовиком по локациям и валит разных монстров без сраной повесточки и прочих гордостей, до этого ни разу не пробовав геймдев.

А второй мозг в обсидиане с красивым графом сделали? Просто без этого не считается. А, ну и еще обязательно должен быть агент который за вас всю работу делает а вы просто промпты на 2 строки кидаете и всё.

Мы, закостенелые луддиты, очень вам завидуем, на самом деле. Так-то мы немощные и просто не умеем правильно использовать И И. Нам, знаете ли, очень жалко потратить 20 100 200 500 баксов чтобы просто получить настоящуюю лицензионную неворованную мощную модель которая просто решает все задачи. А даже если у нас нужная модель, то все неудачи от того что харнесс не тот. А если харнесс тот - промпт не тот. А если все еще что-то не получается - мы сами не те, у нормальных людей вон шутаны с одного промпта пишутся!

Страдаем от мышления бедного человека, а вот визионеры с мышлением богатого человека просто тратят немножко долларов и взамен получают волшебную коробку которая за них всю работу делает, даже лучше чем они сами!

Ну и как ваш шутер, сколько денег принёс в Стим?

Такие статьи похожи на стадию отрицания. Типа "ой кто-то лажанулся - все ИИ это слоп, возвращайте людей"
На самом деле нормальные бизнесы берут ИИ в работу параллельно, а не сломя голову увольняют 90% а потом хватаются за голову. Да и сравните ИИ сейчас и год назад, два года назад. Ситуация не статична и продолжает развиваться.

Такие статьи похожи на стадию отрицания.

"Стадия отрицания" — это то, через что сейчас постепенно проходят адепты, уверовавшие во всесильность ИИ.

Как только ИИ-шка перестаёт быть дотационной и переходит на самоокупаемость, то внезапно оказывается, что реальная стоимость ее использования ничуть не дешевле, чем если нанять кожаных. Ах, да, и переплачивая за ИИ, всё равно придётся платить и кожаному — кто-то же должен проверять то, что там нейронка нагенерировала.

Ситуация не статична и продолжает развиваться.

Золотые слова.

Адептами вы называете топ-менеджеров, которые "не вдупляют, но очень впечатлились"?)
Я как программист могу делать фичи и закрывать таски быстрей чем раньше. Это неоспоримо. И это не стоит огромных денег. Буквально 100$ в месяц закрывает.
Ну если кто то решил что программист прям совсем не нужен, то ему это решение может дорого обойтись.
Могу ли я плюс ИИ за 100$ делать ту же работу что раньше делали двое? - ну примерно так и выходит.
Может ли сейчас этот менеджер избавиться и от меня и давать задания ИИ напрямую? Сейчас очевидно этот радикальный шаг будет дорого стоить. Но в обозримой перспективе это может стать возможным.

Будет ли справедливо назвать вас говнокомментатором?)

Ведь по сути ничего не сказали кроме своего "фе".

не, он выдающийся серийный овнокомментатор:)

Я наслышан от многих людей, что на самом деле это просто ИИ старой версии, а в новой уже всё исправили и она пишет без ошибок /s

Съедобные грибы средней полосы, издание второе, исправленное и дополненное (с)

Посмертно

да, это основная мантра: зимой\весной\в прошлом месяце\вчера\час назад, была очень старая модель, а сейчас новая, земля и небо))

НЛО прилетело и опубликовало эту надпись здесь

Чота не нашел на том жи хихихаха таких вакансий

На нём в большинстве вакансий ИИ вообще ни как не указан.

В играх использовать нейрослоп - это точно не то, что следует делать. Живые текстурки чувствуются с душой, если их делает человек.
Насчёт кода, как будто ии инструменты чисто в рутинных вещах можно юзать, где "цена ошибки" нет, по сути. Например, для написания тестов.
Ну, или с нейронкой обсудить концепт, решение. Своего рода, аналитик.
Но вайб кодить, не пропуская через себя код, это будет странно, да и повышает вероятность ошибок. Нейронка может с умным выражением лица выдвигать ложь за истину.

Вообще-то цена ошибки в тесте - это пропустить баг.

А так я лично не против генерации второстепенных материалов ИИ, там где не требуется артистичность и на которые игрок не обратит внимания.

и на которые игрок не обратит внимания

Такие "игроки" называются подпивасниками. Эти могут под пиво употреблять хоть 100% нейрослоп. Но это же не значит, что все геймеры такие.

Народная любовь к таким проектам, как Gothic, наглядно показывает: вручную сделанные игровые миры, с любовью и вниманием к деталям, у геймеров всегда в цене.

Народная любовь к таким проектам как Gothic существует только в РФ, Германии и Польше. Для всего остального мира это просто одна из.

К Gothic - да, а к "таким проектам как Gothic" - во всём(почти) мире. Игры с вниманием к деталям и мелочам любят везде, Gothic тут это пример.

Да как будто любят везде в первую очередь мейнстримные ААА-проекты, где внимания к мелочам не особо много. Внимание к мелочам вещь такая, что это внимание довольно дорого стоит. И если в игре ничего существенного кроме мелочей нет, то нафиг такая игра не нужна.

Вот здесь тоже соглашусь. В большом открытом мире, от каких нибудь пней в глубоком лесу, в который скорей всего никто и никогда не пойдёт, уж больше одного раза так точно и не жду супер качества.

Либо в инди. По геймплею сюжету игра норм, но не хватает ребятам денег на художников, можно либо вообще не делать либо так. Может лучше и так.

Летом двадцать пятого ребята из METR посадили опытных open-source разработчиков решать задачи в их собственных репозиториях, и выяснилось, что с ИИ-инструментами задачи закрывались примерно на девятнадцать процентов медленнее,

Они потом попробовали еще раз и все не так плохо.

Так за отваленные бабки что не пробовать)))

Да это случай уже год облизывают везде. Еще лет 5 будут вспоминать.

О, да, про "независимость" METR и кто ей денежки платит наслышаны. Та же история, как и со спонсированием научных исследований корпорациями, заинтересованными в положительных для них результатах.

А можно ссылки на конкретные вакансии такого формата, а то звучит как байка.

Да просто звучит как ИИ генерированный и вылизанный текст. Куча ярких заявлений и обмусоливание одной темы в течение половины текста. И конечно же без каких-либо пруфов.

Я заметил очень забавную вещь - часто нейроотрицатели именно у ИИ получают список аргументов, в характерном ИИ стиле «Не кодер, а Архитектор», почему их не заменит ИИ.

Вот почему важен маркетинг.

ИИ - это одна из самых крутых технологий с самым отвратительно-блевотным маркетингом в истории. Нормальные маркетологи сделали бы код-агентам реноме помощников настоящих инженеров. Вместо этого из подвала на сцену выпустили мудозвона Карпатого, который сделал агентам реноме каких-то клоунских балалаек-самоиграек. Дальше хор фанбоев и шизов подхватил эту песню.

В итоге сейчас все обсуждения строго полярные: или агенты отстой, или люди отстой. Как же это задолбало.

Дальше хор фанбоев и шизов подхватил эту песню

А также хор продавцов ИИ и инфоцыган, очевидно.

Продавцам как раз и стоило вложить пару лямов в консультации специалистов по продвижению. Когда у очередного хуанга-амодея риторика выступлений меняется на 180 градусов в течение двух недель, то это уровень кружка детской самодеятельности, а не миллиардного бизнеса.

Под продавцами ИИ имел в виду не компании уровня Antropic, а многочисленные сервисы-прокладки между ними и пользователями, а также частных деятелей (которых хватает и на Хабре, aka "Внедряю нейросети в ваш бизнес"), которые оседлали тему вайбкодинга и агрессивно (или наоборот скрыто, неявно) проталкивают посыл "ИИ это практически полноценный сотрудник", что по сути неправда.

что по сути неправда

«Не обманешь — не продашь!» ©

это уровень кружка детской самодеятельности, а не миллиардного бизнеса.

А нам и не обещают уже, что там много кто далеко ушел от этого уровня.

У  ИИ есть ещё одна критическая проблема,  отсутствие доказанной прибыли от использования.  Не для производителей лопат, а именно для пользователей.  То есть и для блок-чейна были миллионеры которые заработали именно на технологии. И с электромобилями были физические люди которые сэкономили на бензине.  А здесь этого нет, есть полу мифическая "эффективность" которую даже определить нормально не получается, не говоря уже о том что бы в деньги превратить.

не понял вот это - нейронкой иногда пишу скуль-запросы, иногда проверяю, иногда это код на питоне, много чего . Иногда просто спасает, когда надо что-то сделать в ограниченных сроках (писать самому скуль-запрос сложнее, чем спросить у чат-гпт и проверить)
Просто нейронки (в виде чатов, как правило) становятся или уже стали, просто аналогом гугла, можно спросить там, можно тут. Как тут эффективность оценить? Я плачу за про у чат-гпт, осознавая его пользу для себя

(для нерабочих задач, еще пожалуй больше применения нахожу, но это очень специфично)

Вы это всё делаете для себя и на дотируемом инвесторами LLМ.
1) Оценить эффективность только через деньги - сколько реальных денег Вы на этом съэкономили? Например, Вы стали теперь зарабатывать больше из-за использования Вами LLM? Или работать шесть часов в день, вместо восьми при том же доходе?
Дополнительно из той же области вопросы:
2) А насколько это реально эффективно в деньгах в организации, внедряющей на проде? Нет пока ни одного известного исследования.
3) И самое главное к 1 и 2 - а насколько эффективно это останется, когда LLM прекратят быть дотационными?

Пылесос сколько денег экономит? По сравнению с ручным подметанием пола?
IDE сколько денег экономит по сравнению с написанием кода в блокноте?

Пылесос сколько денег экономит? По сравнению с ручным подметанием пола?

То есть величайшее изобретение  которое признанно изменить  весь образ жизни всего человечества, свели к пылесосу.  Полностью согласен, по уровню влияния и реальной  пользы  пылесос и есть. 

Полностью согласен, по уровню влияния и реальной  пользы  пылесос и есть. 

И по частоте полезного использования.

Хотя я слышал про отдельных персонажей, которые пылесосом... Но не будем об этом, на Хабре приличное общество всё-таки.

Если ковров нет, а пол гладкий, то подмести может быть быстрее и проще, чем раскладывать пылесос, делать те же движения, что и веником, а потом пылесос чистить и складывать обратно.

Да и на улице дворников с пылесосами я как-то не замечаю..

Да и на улице дворников с пылесосами я как-то не замечаю..

Я замечаю с "пылесосами наоборот", но толку от них мало, поднимают пыль в воздух, она потом обратно оседает.

Вопрос, на который я ответил, был "как тут эффективность оценить?"
В Ваших примерах её оценить сложно. Если только не начать дома трудочасы считать для примера с пылесосом.
А по IDЕ как раз можно посчитать в деньгах усреднённо. Условно: берутся две группы программистов и одна работает с IDE, другая - с блокнотом. Далее проверяется время и качество выполнения задачи, при разнице в качестве добавляется время на переделку. Полученная окончательная разница во времени в человеко-часах на выполнение задачи с одинаковым качеством умножается на стоимость этого человеко-часа.
Если сильно заморочиться, можно и самому себе такой эксперимент провести.

Именно.
Но что-то никто этого подсчета не проводил. А тут для ИИ требуют. А ИИ - то же самое ускорение разработки.

Это не так. Проводилось много таких исследований. С LLM пообщайтесь, если детали интересны.
А в случае LLM это особо важно, так как и цена совершенно другая, и они заявляются не просто как "ускорение разработки".

Причём в обсуждаемых случаях никто не вбухивал триллионы и не рассказывал про "светлое будущее всего человечества" (олды в курсе).     Для вбухивания таких ресурсов хотелось бы некое экономическое обоснование, кроме:  "ты ретроград и  у тебя стадия отрицания". 

А у меня вопрос: Блокнот со вкладками, подсветкой синтаксиса и автодополнением это уже IDE или еще блокнот? Ведь это примитивные скрипты, которые средний программист может написать на коленке в этом же блокноте за разумное время. Никакой магии и искусственного разума.

Можно предложить провести границу где-то в районе "можно запустить на исполнение и подцепить дебаггер, который прямо на том же коде покажет где ты сейчас в брейкпойнте стоишь и что у тебя в памяти/переменных".
Плюс подсказки по стандартной библиотеке, плюс быстрое переключение между модулями/файлами на реализацию функции.

В теории в ПродвинутомБлокноте вполне можно донарастить, и тогда - да, уже IDE. Или "IDE на минималках", чего может уже хватать в практическом применении.

Вы же и сами в ручную это делать умеете. Т.е. когда от ИИ что то идёт ни так. Вы либо по старинке делаете либо указываете ИИ практически точное место где он сделал ни так. Потомучто понимаете результат его труда. А если бы никогда сами не кодили и не понимали почему и где ни так? То что делать? Молится духу машины как вайбкодеры?

А что подразумевается под доказанной прибылью? Деньги поступающие на счет? В случае блокчейна - это коины, в случае электромобилей - экономия на топливе, в случае ИИ - экономия времени. Во всех случаях это конвертируется в деньги.
Банальные бытовые вопросы вроде поиска решения проблемы - вместо часов гуглежа при правильном подходе ИИ решит за минуту. Это если закрыть глаза на агентное использование. Другой вопрос в том, как инструментом пользоваться - тупо закинул промпт и ждешь готового решения - так работает плохо. Ведь и электромобиль и блокчейн при неправильном подходе тоже будет создавать убытки

А что подразумевается под доказанной прибылью? 

Компания желательно торгующаяся на бирже выходит и показывает свою отчётность (а торгующиеся на бирже обязаны это делать). И говорит вот мы уволили  N  процентов работников и заменили их  на ИИ,  потратили на ИИ сколько-то денег, в результате наша прибыль увеличилась на N процентов.  И так несколько раз в разных отраслях.  Всё остальное это разговоры про ту самую мифическую "эффективность".  

У вас смешались два критерия - доказанную прибыль и экономический эффект от использования ии. Если отдел выполняет на 30% больше задач с ии за тот же промежуток времени, то это уже измеримый эффект, причем без увольнений или мнгновенного роста прибыли в отчете на 30%. Трудовой ресурс который освободился можно потратить на разгребание техдолга, уменьшить найм, на долгосрочные задачи или просто увеличить текущую нагрузку.

И к тому же рост прибыли при использовании ИИ тоже ничего не доказывает, т.к. нужно доказать что причиной роста был именно он. Поэтому если в отчете нет строчки "доход от ИИ" - это вовсе не значит, что экономической пользы от него нет, ровно как и в обратном случае

Поэтому никакой мифической эффективности нет, просто это не циферка на счету, которую можно посмотреть. Польза не автоматически превращается в прибыль и отсутствие роста прибыли не значит отсутствие пользы. Сильно зависит от того кто и как пользуется ии, но это уже не проблема полезного инструмента

Вы не могли бы ссылки на конкретные концепции менеджмента дать в обоснование своих мыслей? Я не совсем с некоторыми согласен. Выделю две.

Если отдел выполняет на 30% больше задач с ии за тот же промежуток времени, то это уже измеримый эффект.

Верно, но только сам факт измеримости ничего не даёт в отрыве от прибыли. Если выполнение этих задач ничего не даёт, то возможно, что они и не нужны. А 30% - много, при правильном использовании они должны дать какой-то рост прибыли (хотя бы 10%) почти сразу. Так как "уменьшить найм" = высвободили бюджет (прибыль вырастет), "увеличить текущую нагрузку " = появились новые заказы, которые она покрывает, а затрат нет (прибыль растёт). И уменьшение техдолга даст эффект, просто позже (уменьшение рисков и потерь от них, рост производительности труда персонала и т.д.).

рост прибыли при использовании ИИ тоже ничего не доказывает, т.к. нужно доказать что причиной роста был именно он. 

Если у Вас скачок прибыли даже на 10% будет, а остальные факторы, кроме ИИ, сильно не поменяются, то связка с ИИ почти автоматически признана будет. Если поменяются, то факторный анализ проводится (методология ЭАХД и т.д.). Так что сам по себе не доказывает, но после ряда операций влияние факторов люди оценят.

Верно, но только сам факт измеримости ничего не даёт в отрыве от прибыли. Если выполнение этих задач ничего не даёт, то возможно, что они и не нужны.

Это же буквально логика "эффективного менеджера" - зачем нам тратить деньги на аудит безопасности, если это не даст прибыли. Или зачем нам делать нормальный продукт, если этот хоть и багованный, но работает. Сегодня заработаем, а то что завтра у нас прод встанет - да кого это волнует? В нормальных компаниях ставят на первое место долгосрочную пользу, а не сиюминутную. Поэтому внедрение ии может снижать прибыль многие годы, а окупать себя начать потом (хотя и не обязательно)

А 30% - много, при правильном использовании они должны дать какой-то рост прибыли (хотя бы 10%) почти сразу.

Вообще ни разу не так. Нанять сотрудников - у компании не вырастет производительность, а упадет. Только когда они наберутся опыта, поймут что и как работает, получат экспертизу в доменной области, только тогда они начнут приносить прибыль. Это не сегодня и не завтра. В сложных сферах на это нужны иногда годы. Многие крупные компании много лет работают в минус, прежде чем начинают приносить хоть какую-то прибыль.

Если у Вас скачок прибыли даже на 10% будет, а остальные факторы, кроме ИИ, сильно не поменяются, то связка с ИИ почти автоматически признана будет.

Да. Но тут возникает проблема - даже сам ИИ буквально за год переживает несколько поколений роста. Так же компании при внедрении сильно меняются внутри. Так же и рынок сильно меняется. То есть стерильных или около того условий создать невозможно. Нужно сужать измерения до отдела/отдельных сотрудников. Но тут, как я и писал выше, критический эффект в том, как и для какой задачи сотрудник использует ИИ, и какую именно модель. А тут уже среднюю по больнице получим

Банальный пример - один раз найти в 100 pdf хотя бы одну опечатку. Можно 2 дня потратить на написание скриптов или ручной перебор, а можно за 5 минут с помощью ИИ получить результат. И таких задачек за отчетный период могут быть тысячи, но в отчет об ИИ не будет ни слова

Если сложить все в итоге оказывается, что измерить эффективность ИИ на практике по рынку в общем невозможно, а следовательно делать однозначные выводы о "мифической эффективности" тоже. В то же время на местах квалифицированный сотрудник с умением работать с ИИ может многократно увеличить свою эффективность

И ведь куча раз все с пеной у рта доказывали что прорывная технология бесполезна, а другие что мертвая технология - это будущее. Уже давно пора понять, что однозначные выводы о свежей технологии делать глупо

можно за 5 минут с помощью ИИ получить результат.

Но будет нюанс...

Я не это говорил:-)
Аудит безопасности и борьбу с багами и так должны вести. А мы же обсуждаем, куда направить высовободившиеся за счет ИИ средства (но даже если не велось ранее, то рост качества и снижение рисков поднимут прибыль, просто не в моменте. Кстати, сложно, но можно качество через оценку рисков его отсутствия, особенно если уже есть исторические данные потерь из-за багов, перевести хотя бы в прогноз прибыли).

Относительно остальных Ваших размышлений - у меня ощущение, что Вы сами расчетами эффективности и роста прибыли на практике не занимались. Нет тогда смысла идти в детали, просто на верхнем уровне: "многократный рост эффективности отдельных сотрудников" при правильном менеджменте (т.е. использовании этого) вызовет рост прибыли. И она считается.

У вас какое-то наивное представление об экономике крупных компаний

Верно, но только сам факт измеримости ничего не даёт в отрыве от прибыли. Если выполнение этих задач ничего не даёт, то возможно, что они и не нужны.

Ваша цитата. Я же утверждаю буквально обратное - если выполнение задач, например, внедрения ии или аудита безопасности, не дает прибыли, это вовсе не значит что они не дают пользы.

А мы же обсуждаем, куда направить высовободившиеся за счет ИИ средства (но даже если не велось ранее, то рост качества и снижение рисков поднимут прибыль, просто не в моменте.

С тем же аудитом - в отчете не получится написать "Мы провели аудит, поэтому нас не взломали и мы не потеряли 10 млн ваших денег. Аудит принес нам 10 млн".

Относительно остальных Ваших размышлений - у меня ощущение, что Вы сами расчетами эффективности и роста прибыли на практике не занимались. Нет тогда смысла идти в детали, просто на верхнем уровне: "многократный рост эффективности отдельных сотрудников" при правильном менеджменте (т.е. использовании этого) вызовет рост прибыли. И она считается.

Может считаться, а может нет. Пример с техдолгом приводил. Вот еще - компания работает на PHP и решила освободившиеся ресурсы потратить на актуализацию стека - переходить на условный Go или Rust. Переход будет идти месяцы и годы. И где в отчете увеличение прибыли?

так им надо хайп разгонять. со скучным лицом триллионы от инвесторов не получишь.

помощников настоящих инженеров

На этом больших денег не заработаешь

Заработаешь. Берем любой бизнес от выпекания пирожков до производства чипов. Буквально НИГДЕ нет мразотного вирусного маркетинга, построенного на буллинге тех, у кого к товару вопросы. Просто это всё давно вышло из-под контроля, и теперь проще делать вид, что так и надо.

Возможно, это потому, что «чем хуже товар, тем агрессивнее его маркетинг».

Если бы маркетологи с самого начала говорили только правду, то таких огромных потоков инвестиций в ИИ бы не случилось. Нельзя было бы, как Мира Мурати, собрать 2 лярда инвестиций вечнозелёными на свой стартап без единого внятного объяснения, что вообще за продукт она собирается делать.

Отвратительно-блевотный маркетинг начинается ровно с того момента когда кто-то произносит термин “ИИ”.

Дальше со стопроцентной вероятностью идет пассаж индивида который не отличает грамотное письмо от интеллекта и либо хочет тебе продать стохастического попугая, либо себя убедить что купил его не зря.

Из-за этого блевотного маркетинга и его апологетов уже стыдно в компании приличных людей говорить что занимаешься ML, буквально зашкварили одну из интереснейших отраслей CS своими погаными волшебными палочками для всего и вся.

Согласен. Совершенно раздутый, создающий путаницу в головах обывателей, термин. И LLM это у нас ИИ, и распознавание образов на видео с камер, и генерация картинок диффузными моделями, и AlphaZero для шахмат. Что вообще обозначают этим термином - сказать трудно. Наверное только использование нейронок под капотом, но и то не факт, см. "символьный ИИ"

Т.е. дать попользоваться продуктом бесплатно - это отвратительный маркетинг? Какой тогда не отвратительный, позвольте поинтересоваться?

Давайте так. Завтра в вашем городе фармкомпания начинает бесплатно раздавать всем ежедневно метамфетамин. А оружейная компания - винтовки и патроны. А по местному ТВ визионер Хрипатый сообщает, что вайбово освобождает вас от химеры именуемой совестью.

Норм маркетинг?

Вот это у Вас фантазия. Так и хочется пошутить, что и до Вас дошли пары метафетаминовые. Но не буду.

Что до картинки, то у меня такой не было. Не то, чтобы я не знал про такое, но как-то это у меня не смешивается.

Обычно про ИИ рассказывают, что он сейчас вообще всё порешает и всех заменит. А когда указываешь на недостатки, тебя называют луддитом, говорят, что ты им не умеешь пользоваться или надо было взять модель получше. Тоже так себе. Но это вроде не от официальных лиц идёт.

все больше студий отдельно подчеркивают в описаниях игр и в интервью, что арт, звук и тексты сделаны людьми, а в вакансиях снова появляются художники и актеры озвучки, которых еще недавно сокращали первыми

Заметьте, многие говорят, что то же самое происходит и в киноиндустрии.

Заметьте, многие говорят, что то же самое происходит и в киноиндустрии.

То есть потихоньку приходим  к пониманию ограничений по применению технологии. То же самое уже было со всеми остальными "будущими" последнего времени.   Что с блок-чейном , что с электромобилями, что со  всем остальным.  По моему мнению ИИ (в современном виде) займёт пару процентов в  IT и процент может три  во всём остальном. Это много, но на слом всего уклада явно не потянет.

Нормальный подход - это человек + ИИ.

Неадекватный - "ИИ всех заменит". И его массового преподносили как самый лучший путь. А потом карета превратилась в тыкву ... и пришлось включить голову.

Все эти примеры выстраиваются вокруг концепции "исправление ошибое внедрения ИИ с помощью здорового рассудка"

А никто и не говорит «ИИ всех заменит», но если «человек + ИИ» дает x2 продуктивности, то можно уволить каждого второго, таким образом получив «ИИ заменило».

если «человек + ИИ» дает x2 продуктивности

Ключевое слово - "если". Пока ничего подобного не наблюдается. И да, покажите мне работников, добровольно согласных за ту же зарплату стать в 2 раза продуктивнее и начать работать за двоих, пусть и с использованием ИИ (ради того, чтобы компания могла сэкономить на ФОТ).

Ну вроде как раз многие погонщики агентов добровольно (иногда незаметно для себя) начинают брать работы больше. Видимо, в кайф командовать, ощущать власть.

Эти погонщики агентов ещё и "луддитов" ругают. То есть, всё чего они достигли - начали продуктивнее(по их мнению) работать на дядю за ту же зарплату, и они ещё и потешаются над людьми, которым такое "развитие" не нравится.

Ну вроде как раз многие погонщики агентов добровольно (иногда незаметно для себя) начинают брать работы больше.

Неудивительно — с учётом того, что половина сделанного ими годна разве что на свалку.

А кто говорил про добровольно? Новые KPI спустили сверху и вперед.. К-Капитализм.

Повышения продуктивности не наблюдается, серьезно? Это же какой мощный копиум должен быть, чтобы этого не замечать.

Ах да - расскажите это цифровым художникам, переводчикам, копирайтерам, и т.д.

Речь была об "увеличении x2" и, как следствие, "увольнении каждого второго", о котором вы написали в комменте.

Пожалуйста, приведите конкретные примеры компаний, ссылки на исследования, может быть какие-то новости, посты, которые бы подтверждали ваши тезисы (условно, уволили половину сотрудников, потому что оставшиеся стали работать в 2 раза продуктивнее и взяли на себя всю их работу, а качество продукта при этом не упало). Чтобы речь шла не только о каких-то личных ощущениях.

копирайтерам

Ну да, продуктивность у них выросла, это видно даже по Хабру, который заполонили низкокачественные нейросетевые тексты, которые их "авторы" часто даже не вычитывают, не говоря уже о редактуре.

Ещё наблюдается радикальное снижение качества.

Только вот не получается пока в долгосроке "x2" продуктивности, зато топовые модели работают в жирный минус, и при изменении расценок до окупаемости будут стоить как полноценный разработчик в команду, а то и больше.

Кстати, а почему вопрос поставлен именно со стороны "уволить"? Если ИИ все же дойдет до уверенного уровня с приемлемой стоимостью, то сам разработчик может стать самозанятым, и выполнять "x2" заказов по демпингованным расценкам, т.к. ему не нужно кроме себя кормить команду начальников, менеджеров, и офисного собственника. В случаях попроще конечный потребитель может вообще сам запросы ИИ отсылать.

при изменении расценок до окупаемости будут стоить как полноценный разработчик в команду, а то и больше

А где ссылки на экспертно-аналитические оценки, что вот работа модели, выдающая результат миддла, будет стоить 100-110% от расходов на его содержание, а не скажем 50?

А какие могут быть оценки если вся отрасль должна по разным прикидкам от двух до четырёх триллионов долларов и в ближайшее время собирается занять ещё триллион.

Пусть сначала появится модель, стабильно выдающая результат миддла, тогда и оценки появятся. А пока ее нет, можно почитать про случаи где существующие, работающие в минус, за день сжигает токенов на огромные суммы. Причем не какой-то там ошибкой, как у кожаных мешков, а просто настойчивыми попытками решить задачу. И это не какое-то там исключение, целые отделы компаний свои лимиты в рекордные сроки растрачивают, в чем можно усмотреть и прямой интерес провайдеров облачных моделей.

Примерно на уровне миддлов современные модели и работают. Токены высадить можно, это да. Коллега как-то просадил на ~$2000 за полдня, хорошо на карте больше не было. С такими темпами, конечно, мясной миддл дешевле:) Ну так надо промпты всё-таки ставить более конкретные, тогда и в подписку можно уложиться.

Всякие иксы к продуктивности это экономия на качестве. А качество это безопасность, производительность, отсутсвие багов, простота расширения, рефакторинга и поддержки. Насколько бизнес готов на этом экономить вопрос индивидуальный. Некоторые любят грабли.

Классика жеж!

Установили генералу в кабинет компьютер.

- Это что?

- Это, тов. генерал, компьютер. Он будет делать за вас половину работы!

- Ставьте два!

- Ставьте два!

Так генерал узнал о геометрической прогрессии.

Чтоб много людей делали прям одно и тоже, такое в основном только в бигтехе бывает. А так обычно каждый какую то свою часть кодит и чужую даже с ИИ не хочет. И даже если специалистов 2-3 одинаковых, то как оставить одного. А если отпуск/больничный/уволился и т.д. дело встанет? Понятно что от экономии и похлеще бывает. Но качество от этого снижается, доп. проблемы появляются.

А никто и не говорит «ИИ всех заменит», но если «человек + ИИ» дает x2 продуктивности, то можно уволить каждого второго, таким образом получив «ИИ заменило».

Никудышный из вас финансист, не стоит вам лезть в эту тему

Ибо «человек + ИИ» будет и стоить дороже, чем просто «человек», ибо токены тоже недешёвы

И тогда "x2 продуктивности" может обойтись в х2 к стоимости

Так что все ваши расчёты, по которым "можно уволить каждого второго", можно выкинуть в /dev/null

Ибо «человек + ИИ» будет и стоить дороже, чем просто «человек», ибо токены тоже недешёвы

Кроме того, надо бы помнить про старое как мир «первая доза — бесплатно».

Может быть ИИ подорожает, а может быть и нет, бизнес на 2026 год - выживает, сегодняшним днем, и если ИИ позволяет, сейчас, снизить издержки - то ИИ будет использоваться для снижения издержек.

Пока, я своими глазами, наблюдаю своих знакомых и друзей, которых выкинули в /dev/null, в том числе и из-за ИИ.

Как на тех, кто не использует ИИ, уже смотрят косо, ибо ло перформер.

А вы продолжаете отрицать реальность, на здоровье, потом правда больнее будет.

Исследование METR как раз показало главное: разработчики думают что ускорились на 20%, а секундомер фиксирует замедление на 19

Молоток плотника не заменит.

А вот робот теоретически это сделать сможет. При условии, что не будет плотника-человека во всем копировать. То есть, он не должен быть антропоморфным и так же, как человек размахивать молотком.

В этом, имхо, сейчас проблема. Модель - не замена программиста, то есть невозможно "взять модель на место джуна/мидла". Нужно менять всю структуру разработки под использованием моделей.

А этим сейчас, кажется. мало кто озабочен.

Кроме меня)))))))

мЕнеджеры отчитаются об экономии средств за год, получат годовые бонусы, а дальше за всё заплатит собственник. наймут в 2 раза больше разработчиков для разгребания этого вайбкода, расходы включат в стоимость продукта.

Спасибо, давно так не смеялсо.

мЕнеджеры отчитаются об экономии средств за год, получат годовые бонусы, а дальше за всё заплатит конечный потребитель [...] расходы (умноженные на 2) включат в стоимость продукта.

Так ближе к реальности

заплатит конечный потребитель

Ну в крайнем случае нет:) И тады ой

Да, да, конечно заплатит за очередное не очень нужное приложение/контент, ведь у пользователей по миру денег только добавляется

Зависит от продукта. Если продукт важный и труднозаменимый, то заплатит потребитель. Если такой, который легко заменить на аналог -- собственник (возможно банкротством).

Работа с нейронками очень похожа на работу с людьми аутсорсерами. Для некоторых кейсов это реально намного дешевле и быстрее. Прототип сделать можно быстро или написать скрипты, которые не должны часто изменяться и т.д. Но никто же в здравом уме не будет делать высокотехнологичные, сложные продукты, которые развиваются много лет, исключительно через аутсорс. Так и с нейронками - они хороши там где раньше был аутсорс, но для сложных продуктов их роль начинает быть инструментом, а не заменителем человека.

По опыту работу с аутсорсерсом - им можно отдать только то, что будет не жалко выкинуть и/или впоследствии предстоит переписать, так что пусть аутсорсер соберет все грабли и протопчет тропинку, а там придут штатники и сделают как надо.

И почему-то это напоминает нынешний ИИ, вплоть до того что ревью аутсорсеров превращалось в обязанность, ад и срачи (а с ИИ - в перекидывание промптами)

По бывшему опыту работы аусторсером - это от людей зависит. И от постановщиков задач.

А то были случаи и "нужно вот этот сниппет в код разместить, маркетинг требует телеметрию, значит она будет" кода от заказчика... но как заказано "делайте, не спорьте" - так и сделано. Переделывали и за другими аутсорсерами - и местами решения там так себе бывали, что исходные, что новые. А бывало и за заказчиками код меняли, тоже авгиевы.

Как и в работе не-аутсорсной. Получается разве что вот ровно вокруг себя улучшать пытаться, в надежде что не тебе одному это надо. Когда более чем не одному - тогда что в аутсорсе, что не в аутсорсе нормально получается. "Нормально делай - нормально может быть и выйдет"

как заказано «делайте, не спорьте» — так и сделано.

Я в таких случаях говорю «за ваши деньги (в смысле зарплату) — любое ваше желание. Даже самое идиотское».

Работа с нейронками вообще очень похожа на работу с людьми. Что-то они умеют лучше, что-то хуже. Нужно понимать их сильные и слабые стороны. Чем подробнее им объясняешь задачу - тем больше вероятность получить ожидаемый и качественный результат. Если не объяснять - могут сделать по-своему, не так, как ты хотел.
В чем они однозначно превосходят людей: мотивация, производительность, стоимость, скорость.

Да. Только человек постоянно учится и улучшает свои знания по проекту, если работает на нем долго. А нейронка каждый раз начинает с нуля, перечитывая заново код и документацию. Общаться с разработчиком, который в проекте несколько лет легко и приятно, он знает, о чем вы говорите. Общение с нейронкой - это общение с человеком, который на проекте первый день. Это совсем другое ощущение.

 Общение с нейронкой - это общение с человеком, который на проекте первый день

Вы с агентами работали? Для нового проекта у агента обычно есть команда инициализации, по которой он просмотрит весь код и документацию, и составит краткую выжимку по устройству, архитектуре, стилю, командам сборки, неочевидным моментам, и т.д. В дальнейшем, при решении задач, он этот файл сам дополняет, но можно явно его попросить добавить правило или какую-то важную информацию.
Аналогично, как когда человек долго работает и улучшает знания по проекту.
Вообще разработчики раньше писали такой файл для других разработчиков, но к сожалению, не все.

неочевидные моменты не становятся очевидными от одного лишь просмотра на них даже умным взглядом. Только проведением испытаний на тестовых прогонах можно понять че это и как. Сомневаюсь что ИИ че то подобное берёт и само делает это уже совсем другой функционал.

В том и ужас, что "берёт и само делает".

Что оно само делает? Берёт заходит под админом на сайт и через формы админки сайта создаёт элемент, как будто делал пользователь, а потом запускает. И может потом интепретировать результат?? Вот не верю. При чём делает это без указаний, когда лишь надо. Не верю!!!

Что может разработчик/тестировщик/аналитик/девопс/итд уровня миддл (с кругозором сеньора) - то оно и делает. Только быстро и дешево.
Не хотите - не верьте, изумление у вас еще впереди. Попробовать Клода сейчас вроде не настолько сложно.

Да да само делает. Без указаний переключается на любую специальность какую надо в каждый конкретный момент и проводит весь комплекс мероприятий. По волшебной команде "Отрефакторь старый легаси сайт". А ещё пришельцы на тарелках летают))

Что может разработчик/тестировщик/аналитик/девопс/итд уровня миддл (с кругозором сеньора) - то оно и делает.

а еще оно само ставит себе задачи, проводит ревью, тестирует, несет ответственность за написанный код, чинит баги на проде, участвует вместо вас в созвонах, ведет за вас переписку в рабочих чатах и само получает за вас зарплату)

Считаю вашу иронию неуместной. Не согласны с моей оценкой текущего грейда ИИ - напишите свою. Время и работодатели рассудят.

Берёт заходит под админом на сайт и через формы админки сайта создаёт элемент, как будто делал пользователь, а потом запускает. И может потом интепретировать результат?? Вот не верю. При чём делает это без указаний, когда лишь надо. Не верю!!!

Можете не верить, но это так. Пару месяцев назад пришли продажники с одного старого проекта на поддержке и начали кланяться в ноги, что им очень нужно нагенерить реалистичные демо-данные "завтра к обеду". Отправил их писать ТЗ, как они понимают слово "реалистичные", дальше поправил описание таски в таск-трекере, открыл отдельный чат (тогда у меня была гпт-5.6сол) и просто скинул в него ссылку на задачу. Именно что ИИ зашёл в админку сайта (вкладку я предварительно открыл в хроме, авторизовался и перешёл в нужный раздел), и налепил 2 комплекта по 12 месячных отчётов по ~20 параметров в каждом + сгенерировал pdf формы к ним (стиль придумал сам, ну отчёт как отчёт). И всё с первого раза было норм, были пики в высокие сезоны, провалы в низкие (на графиках это хорошо видно), цифры бились между собой, в общем "реалистично".

Ну, привираю, конечно. Сначала оно сделало 1 отчёт, я проверил и даже сказал что исправить в одном параметре. Потом налепило остальные 23. Опять же после проверки отправил доделывать один параметр (там неверно считался процент накопительным итогом, оно суммировало проценты вместо того чтобы делить каждый раз заново).

Админка кастомная на vue2, видеть эти формы раньше ии не могла (ну понятно что css и html layout у всех ±стандартный)

В целом это грёбаная магия. Я бы руками убил полдня, а потратил 15 минут + два своих переключения контекста.

По самим отчётам у меня вопросов нет. Генерировать похожее на правду но то что ей хочется это лучшее что получается у ИИ. А вот то что она сама в кастомной админке чето делала, да когда чисто технически(не человечески) проще сразу в код файлы вносить или Базу данных. А не вот это вот человекоприкидывание... Звучит очень очень подозрительно.

Что оно само делает?

Базу дропает.

«берёт и само делает».

«Правда, такая ерунда получается...» ©

краткую выжимку по устройству, архитектуре, стилю, командам сборки

Уровень одной недели на проекте.

А во вторых, эти выжимки - это не знания модели, а кусок запроса к большой модели, даже не дообучение. Поэтому человек со временем учится, а модель - нет.

Лучший вариант сейчас - опытный разработчик, который то руками работает, то модель подключает. Станет больше работать руками - потеряет в скорости, станет больше ИИ включать - потеряет контекст, начнет делать хуже запросы, получать результат медленее и хуже.

Человек не обладает каким-то секретным методом "знания" - всё, что у него в голове, можно изложить в текстовом файле. Если это не что-то эфемерное типа искусства, конечно - мы же про конкретный IT проект?
То, что эти знания будут в куске запроса, а не в весах модели - вообще не принципиально, модель в начале генерации все равно переведет текст в эмбеддинги и разместит в контексте, т.е. на на лету "скомпилирует", и для нее это будут такие же полноценные факты, как если бы она от рождения знала.
Но ей не нужно знать кучу ненужных фактов, она ведь не играет в "Что, Где, Когда" - достаточно, чтобы она умела читать вводный текст и понимать его. Опять же, все как у людей - разработчик на новом проекте сначала читает документацию.

Работа с нейронками вообще очень похожа на работу с людьми.

Ви так говорите, как будто это что-то хорошее.

@vsb: Я программирую, потому что мне нравится программировать, а не потому, что есть возможность меньше контактировать с людьми. Это всего лишь приятный бонус :)

Прочитал с "...с аутистами". Грешно смеяться, но доля правды в этом есть.

А можно про игры поподробней? Желательно, с источниками. Да, существуют сообщества неолуддитов, которые могут обрушить рейтинг небольшой инди-игры, но большинству игроков, как мне кажется, глубоко всё равно, каким именно образом сделана игра. Платить оверпрайс за "нарисованные на рассвете девственницами" арты рынок не будет, и за интересную игру, в которой инди разработчик сэкономил на артах - да.

Да вообще мне кажется за графику мало кто платить уже будет. Большиснтво понимает что геймплей от графики почти не зависит.

ПС: Ну хотя может я уже конечно из той волны которая с 8 битных игр начинала, и тогда получал чуть ли не самое большое удовольствие от игр (ну и до начала нулевых), и вокруг меня много таких же. :)

Вы действительно испорчены. Я вот тоже начинал своё знакомство с 3Д с “каркасных” моделек первых симуляторов. И для меня важнее флайт модель, чем блики на крыльях.

Но вот современная идустрия ААА - нас с вами опровергает. Там всё построено вокруг колыхания ресниц на ветру и пор на коже. И массовый пользователь голосует довольно большими денгами за это

Так что девстенности на рассвете, к сожалению важны. Так же как на рынке вина - форма тучек в таком-то месяце такого то года над восточно-западном склоном холма.

А точно ли за это голосует? А не то что другого с хорошим геймплеем то почти и не выходит или реклама до конечного пользователя не доходит..

Ну и сравнение с вином не очень корректно - т.к. форму тучек различать (ну точнее делать вид что различать) будут в лучшем случае 1% сверху, а мы о массовом рынке все же говорим, где компании боятся что слишком много народу забьют на работу из-за выходы игры :)

Да, существуют сообщества неолуддитов, которые могут обрушить рейтинг небольшой инди-игры

Да-да, конечно, ведь если инди-игра целиком и полностью является нейрослопом, и у неё низкий рейтинг, то это совершенно точно заговор "неолуддитов"! Не может же быть такого, что игра большинству действительно не понравилась! /s

но большинству игроков, как мне кажется, глубоко всё равно, каким именно образом сделана игра.

Ну, мне уже известны отдельные персонажи, которым плевать на детали, и плевать им, что за один кадр дерево пропало оттуда, где оно только что было.

Я не знаю, где их таких невнимательных делают.

С тестами есть еще ловушка: если модель пишет и код, и тест к нему, она может повторить одну и ту же ошибку в обоих. Все зеленое, а работает неправильно. Я бы проверял такой тест простой поломкой: намеренно убрать проверку или поменять условие, которое он должен ловить. Если тест по-прежнему проходит, доверия он не добавил.

Можно попросить нейронку “закрой мне баг, быстро б***ь”, будет один результат. Можно просить нейронку, “воспроизведи мне модельное поведение железа, которое вызвало этот баг, после чего верифицируй модель против известного кода, а потом закрой сам баг и подтверди закрытие моделью”. Результат будет… несколько разный.

Аналогично, с несколькими однотипными модулями, разница между “быстро б***ь” и “найди, как в проекте реализовано X, потом встрой туда реализацию функции Y, предварительно написав тесты, покрывающие до/после”.

И это только поверхность дисциплины “методология разработки ПО”. От этой поверхности можно идти глубже, решая, например, проблему, когда один и тот же агент пишет и тест. и код через TDD и разных агетнов, которые работают поверх одной базы знаний.

Так что проблема не в нейронках, проблема в людях, которые используют их через известное место.

P.S. А хотелось бы глянуть, сколько людей пользуются нейронками с какой-то методологией, а сколько просто вайбкодят. чтобы наглядно увидеть, есть ли проблема.

Можно попросить нейронку “закрой мне баг, быстро б***ь”, будет один результат. Можно просить нейронку, “воспроизведи мне модельное поведение железа, которое вызвало этот баг, после чего верифицируй модель против известного кода, а потом закрой сам баг и подтверди закрытие моделью”. Результат будет… несколько разный.

А можно просто один и тот же промпт запустить два раза. Результат тоже будет отличающийся.

Человечество заново переизобрело найм)

Разгребу ваш вайбкод. Дорого. Очень дорого)

А мне нравится читать, что там нейросеть понаписала. Во-первых, читать чужой код бывает полезно для самообразования. Во-вторых, если указать ей на все очевидные ошибки и нерациональности и попросить исправить, то выходит неплохой код, почти как в старые добрые времена, и ты отвечаешь за каждую строчку, совсем как тогда.

Разгребу ваш вайбкод. Дорого. Очень дорого)

У Вас уже сейчас много конкурентов...

Этот спор мне чем-то напоминает высоконаучные дискуссии времен заката эпохи цифромыльниц про то, что никакие цифрокамеры никогда не смогут заменить классную полнокадровую пленочную зеркалку. А потом - что фото с телефона не может быть ничем иным, чем... (синоним слова "вайб-код"), а ведь есть еще фотографирование документов, когда качества ксерокса не хватает...

И ведь всё это было чистой правдой. С оговоркой: "на данный год-месяц и число". С этой оговоркой - критики правы.

Тысяча и одна идиотская аналогия от адептов вайбслопа. Экскаваторы по отношению к лопате, тракторы по отношению к лошади, ЯП по отношению к ассемблеру, вот теперь и цифровые камеры. Вам самим-то действительно не очевидно, почему ваши аналогии не имеют ценности?

А какие нибудь шлемы виртуальной реальности например, так массово и не прижились. И таких примеров тоже много.

А помните, еще не так давно 3Д крутили на всех сеансах в кинотеатрах, телевизоры 3Д продавали... Где это все? Почему потребитель вернулся к банальному 2Д и дома и в кино?

Во во и так много чего можно вспомнить. Что обещали каждому в дом, а оказалось не при чём))

Блин, ну 3д-мания была всё-таки давно:) И телевизор у меня с 3д, потому что нормальных аппаратов без 3д на рынке практически не было.

Абсолютно все 3D реализации по факту давали намного худшее качество картинки. Для вау-эффекта ок, один, ну два раза посмотреть. Но даже аватар в 3D, в кинотеатре - смотрится просто ужасно в сравнении с 2D. И мутно, и цветопередача хуже, и глаза потом полдня болят.

По аналогичным причинам и VR шлемы провалились - да, как вау эффект прикольно, но постоянно в них работать или даже фильмы иногда смотреть - просто некомфортно.

Как объяснить агенту, например, какую игру я хочу сделать?
Если идея особенная, а не копия уже чего-то существующего, то можно написать ему огромное число промптов - он все равно не до конца понимает что я хочу сделать. И если потом не следить и не проверять что он делает - он в какой-то момент свернет не туда. Когда я это обнаружу придется много переделывать, придется разбираться что же он там навабкодил и как это исправить. В общем, все то про что написано в статье.
Но ведь с людьми же так же, нанятые сотрудники тоже не до конца понимают что от них хотят. Мне кажется тут проблема не в ИИ, а в людях которые получили в руки инструмент который делает быстро и без лишних вопросов, но не научились ему объяснять что им надо. Они бы и с людьми написали такое же говно, если бы им кто-то дал раньше столько ресурсов.

Никак - создание игры(в соло или с небольшой командой) это искусство. И нет никакого более простого способа воплотить своё творческое виденье чем императивно, с детерминированными инструментами.

С большими корпорациями и/или с прикладным софтом уже другая история. Там действительно нейронка теоретически(но пока только теоретически) может заменить человека. Случится ли это на практике - узнаем со временем. В отличие от ИИ-бро, предсказывать будущее я не умею.

Но ведь с людьми же так же, нанятые сотрудники тоже не до конца понимают что от них хотят.

Это похоже, но принципиально не так же. Люди не понимают, но могут понять. LLM понять не может по дизайну. У него этой функции (понимания) нет. Зато галлюцинации есть, как неотъемлемая особенность.
Это надо очень тщательно учитывать при "объяснении" LLM и при проверках результатов.

Это шовинизм, пока не вижу признаков что он фундаментально не способен что-то понять, каждая следующая модель понимает все лучше и лучше.
Единственный фундаментальный изъян который я вижу - отсутствие собственной мотивации. Есть бесчисленное множество того к чему можно приложить интеллект, но пока лишь человек может привнести в это смысл.

Это наклеивание ярлыков (я про шовинизм). Вы же не бабушка 80 лет, чтобы в антропоморфизм впадать, а инженер, так попробуйте пояснить, пожалуйста, как же именно технически организовано "понимание" в LLM (подскажу: никак, у него нет ни только "мотивации"/интенциональности, но и ментальных моделей, сознания и квалиа).

От того что Вы лично не видите каких-то признаков, они не исчезнут. Да и при внимательном анализе ошибок LLM при работе с ней признаки эти легко увидеть.

И каждая следующая модель не "понимает" лучше, а "запросы обрабатывает" лучше.

P.s. Я, кстати, не утверждаю, что ни один ИИ не способен будет достичь "понимания". Но точно не LLM. Это туда просто не заложено.

LLM учат предсказывать следующий токен в текстах которые писали люди. Что-бы предсказать что следующее напишет человек, надо иметь модель его мышления, пусть и приближенную.

Процессы в этой модели можно назвать "пониманием", раз уж процессы в моделируемой системе называем "пониманием". Так же как называем например "падением" соответствующий процесс в физической модели, хотя там ничего не падает а биты переставляются.

Что-бы предсказать что следующее напишет человек, надо иметь модель его мышления, пусть и приближенную.

Нет, не надо.

Ваш ответ не аргументирован, но все же отвечу.
Чтобы из "что известно" получить "что будет", нужно предположить какую-то связь между ними. Представление об этой связи и есть модель.

Любое обоснованное предсказание опирается на модель, явную или неявную.

Чтобы примерно предсказать, какое слово в «Войне и мире» будет следующим, достаточно прочитать всего Толстого. И совершенно не обязательно знать, кто такой Наполеон.

То о чём вы говорите - назывеется переобучением.

Чтобы дописать к Войне и Миру романтическю повесть о помолвке и женитьбе Наташи Ростовой и Петра Безухова - этого будет недостаточно. И про Наполена надо будет знать (т.к. на фоне он там мелькать будет).

А современный ИИ такое вполне себе напишет, да так что о Толстого не отличите. В том то и страх-то.

Так о том и речь, что никто вам в голову не залезет, чтобы вжух - и "сделать вам хорошо" по одному промпту. Интерактивно. маленькими этапами, под каждый свой этап промпт, и потом ручные проверки и переделки каждого шага, пока не устроит полностью. Ну да, раньше писали на <язык программирования>, сейчас на русском/английском.

Не изменится ничего, пока модель пишет код для людей.

И чем больше генерирует ИИ, тем важнее становится проверка: сделать стало дёшево, а убедиться, что это работает в реальности во всех нужных и ненужных сценариях, по-прежнему может только человек.

а убедиться, что это работает в реальности во всех нужных и ненужных сценариях, по-прежнему может только человек.

Там другое забавнее. Если SDD промпт чуть более двух листов и генерируемый бандл больше условных 50к, то начинается веселая игра вида "уточняем вот тут требования или пытаемся исправить поведение, в результате вот тут вроде как чинится, но внезапно ломается в других местах, и даже там, где не просили; чиним уже там - ломается тут уже то, что собирались чинить изначально, в результате идем думать как все-таки завтра описать новые требования в SDD спеке, чтоб не сразу много поломалось на следующий день, а в конце недели решаем, что проще плюнуть и вернуться к ручному кодированию с явным контролем границ изменений".

Сижу читаю комменты, а в это время пишутся две задачи, и идёт анализ/планирование ещё по двум вопросам по эксплуатации. Да, утром нужно было сформировать задачи. Да, вечером/утром следующего дня нужно отвалидировать результаты, сделать ручные тесты. Да, иногда это увеличенная когнитивная нагрузка так делать в нескольких потоках.

Но вот факт в том, что это лично у меня повысило эффективность.

зарплату то увеличило? или это увеличило доход вашего робото-дателя © ?

Зарплату - нет. И доход вряд ли. У работодателя сейчас период выжить, у нас период хотя бы не снизиться по зарплате.

А увеличение зарплаты никто и не обещал, все ждут от ИИ снижение издержек, а не повышение, за счет увеличения ЗП.

лично у меня повысило эффективность.

Но есть нюанс...

Отладку, прогон тестов, отдаю тоже ИИ. Не всё, но большУю часть тестов/проверок делают агенты.
Баги от пользователей тоже перенаправляются в агента. Он смотрит логи, нагрузку, связь с другими сервисами - готовит заключение/план или МРы сразу.

ИИшкам нужно еще время. Через лет 5 уже не придется перепроверять код)

Ещё год назад для этого нужно было просто использовать новейшую версию LLM с правильным промптом. А теперь только через 5 лет…

Сразу выкидывать, не проверяя

ИИшкам нужно еще время. Через лет 5 уже не придется перепроверять код)

Все логично. Такие последствия расхлебывают идиоты, которые ИИ считают волшебной палочкой. Те, кто относится к нему просто как к очередному, более совершенному инструменту в руках человека, таких проблем не имеют, июо предполагают сильные и слабые стороны, и осознают что кагбэ и за ним надо проверять.

На собственных PET и не только PET проектах - через AI очень легко сделать POC / MVP с целью оценить идею в принципе, пусть даже это будет полурабочий прототип UI для A/B, но на нулевом цикле этого достаточно.

Но вот что забавно - запуская один и тот-же промпт / SDD в разные дни - на выходе каждый раз получаешь абсолютно разные результаты, которые даже через meld или winmerge невозможно сравнить, а через git отслеживать изменения уже и вовсе бесполезно, настолько все прыгает хаотичным образом по файлам.

Но десятком подобных SDD итераций в принципе можно приблизиться к более-менее работоспособному результату в один случайный день, а в целом - как минимум продумать и описать вручную (а как еще?) модель данных, осознать-описать ключевые функции в этом самом SDD.
В результате будет на выходе формальное ТЗ, которое и для человеков тоже вполне себе полезный документ, и... да, не такой уж и плохой стартовый бандл, даже с какой-то структурой проекта, который как минимум компилируется, запускается, что-то отдаленно похожее на требования из ТЗ делает в рамках заданного стека и прочих ограничений.

И вот на этом вся AI революция и заканчивается, дальше начинаются реалии. Потому что этот бандл без ручных изменений выпускать в продакшин, даже в локальный intranet для каких видавших виды кладовщиков склада готовой продукции - уже в реальности не получится, и все причастные прекрасно знают почему :)

А после ручных изменений дальше весело играть в SDD уже не есть возможно, т.к. каждая новая итерация / генерация безжалостно потрет и все ранее внесенные в код ручные правки, и даже без ручных правок - аннулирует десятки часов "ручного" code-review и/или "ручного" UI-тестирования.
Т.е. на этом этапе или возвращаемся обратно на нулевой цикл генерировать очередной POC / MVP, или забираем на баланс старого доброго ручного сопровождения, доработки и тестирования этот самый удачный бандл.

А SDD промпт не выбрасываем - продолжаем иногда запускать его и смотреть, какие новые технологии сейчас в моде, тоже кстати польза.

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации