У нас в компании все очень похоже. Сказали отныне будет спек-дривен девелопмент. Пригнали контрактников с большим опытом (ну то есть они этим занимаются очень долго, больше года). Контрактники нам паписали скилы вокруг spec-kit, внедрили CodeRabbit, показали каким быть новый процесс, и учат как правильно запускать агентов параллельно в полностью автоматическом режиме, чтобы ты ему эпик из джиры даешь, а утром у тебя все сделано.
Простые тикеты, типа поменять текст на лейбле, агенты щелкают на ура. Ну как щелкают... Генерируют спеки, планы, таски, тесты, код, playwright-тесты, запускают CodeRabbit (локально, затем на сервере, когда PR создан), затем самописный код-ревью скил, затем человек еще на всякий случай проверяет, затем в тикет дописывается простыня что и как сделано (для аудита), пяток тестовых сценариев для QA, и через полдня и энное количество токенов текст поменян, и тикет уходит в QA, где люди тоже уже подустали от общения в стиле wall-of-text, поэтому не читают а сразу скармливают все Клоду, чтобы тот все разьяснил, а лучше сразу сделал.
В прошлые времена это бы тоже заняло полдня, была бы заметка для QA где и что смотреть, и не было бы всего остального нагенерированного слопа.
Делается ли все теперь в 3-5 раз быстрее, как мечтает менеджмент? Смотря как мерять. Если по сгенерированному объему и покрытию бессмыссленными тестами то да.
С более сложными тикетами узкое место обычно ревью. Так как мы хотим надежный код, то мы на него натравливаем максимальное количество ревью-агентов, которые часто не согласны с кодом, друг с другом, и даже если просто перезапустить, то могут дать разные результаты. Обычно это признак того, что требования слишком размыты. Но узнаем мы об этом поздно, приходится править PR. Но править теперь требуется не только код, но и все связанные нагенерированные артефакты: спеки, план, таски, тесты, сам тикет. Клод при этом всегда что-то пропускает, несоответствия спекам всплывют на ревью снова, и получаем цикл. Можно в принципе оставить агентов гонять этот цикл на ночь, но результат как правило плохой и дорогой в смысле сожженных токенов.
Один из подходов, который тестируем, и пока вроде успешно, это показать агенту "идеальный код" : какое-то простое приложение, где ИИ может почерпнуть все недостающие требования: как генерировать фронтенд (фреймворки, библиотеки, элементы, поведение, и т.д.), как выглядит типичный бэкенд (фреймворки, библиотеки, хранилище, транзакционность, пагинация, параметры ендпоинтов, и т.п.). Но правда писать его приходится ручками...
В общем мы пробуем, работа идет, но ускорится в разы пока не получается...
У нас в компании платную версию тестировали пару месяцев в качестве пилотного проекта. В итоге отложили пока на полку. Он конечно автоматизирует административные шаги (за счет того что ему разрешено использовать больше тулзов по умолчанию, изза чего он требует собсвенный виртуальный линукс), типа запушить код, тикет заапдейтить, и т.п., но львиная доля времени, которая уходит на проверку человеком никуда не девается. В плане генерации целого приложения, или даже просто работа над сложной задачей, где все слои подробно и качественно не расписаны, он точно также буксует, как и все остальные.
Я вот пытаюсь посмотреть канал Russia Today https://t.me/rtnews из Канады, получаю ошибку "This channel can't be displayed because it violates local laws (Canada)." - получается иногда Telegram таки подчиняется требованиям местных властей?
Если сравнить, с другими странами, то тут мало что нового.
Лицензирование криптопосредников это фактически аналог европейского MiCA. Требования KYC/AML давно действуют в США, Канаде и ЕС. Передача данных в налоговые органы через биржи тоже.
Из необычного - тестирование и лимиты для неквалифицированных инвесторов, которые сейчас распространяются в РФ только на некоторые сложные фин инструменты.
Поэтому да, гайки закручивают, но Россия тут не уникальна.
Мало у кого есть самодисциплина что-то откладывать на протяжении всей жизни, и никогда не притронуться к сбережениям: то самому хочется купить, то жена мозг вынесет, то детей надо на ноги ставить, то внуков устроить.
И, по наблюдениям, все эти планы на десятилетия вперед с большой вероятностью не сработают...
А что именно победило: агентность или явная доменная декомпозиция? Вы заранее разбили базу знаний на смысловые домены, написали манифесты экспертов и научили роутер между ними выбирать. То есть в систему уже встроена довольно богатая модель предметной области. Возможно именно она и дает основной прирост качества?
В общем, Гит – вещь хорошая, когда тебя – больше одного, а когда ты один, то им можно и пренебречь…
Когда один, то возможно не нужен гит-сервер. Но даже если один, и работаешь над чем-то дольше чем один день, то возможность посмотреть историю или откатиться часто оказывается очень полезна, всего-то нужно для этого запустить `git init`.
У меня тоже мысли в том же направлении идут. Все что мы считаем аксиомой в разработке (OOP, DRY, KISS, Clean code, рефакторинг, и т.п.) имеет целью помочь человеку управляться со сложностью с учетом ментальных ограничений человека:
мы лучше понимаем объекты когда это черный ящик с парой методов,
мы забываем обновить все копии кода если что-то надо поменять, поэтому нужны функции, наследование и прочие приемы повторного использования кода,
нам проще читать чем писать, поэтому упор всегда на читаемость и дедупликацию
нам нужно делать рефакторинг потому что в какой-то момент мы запутались и не можем разобраться в сложности.
и т.д.
У ИИ все по другому:
ИИ проще сгенерировать несколько кусков похожего кода, чем прочитать функцию, реконструировать взаимосвязи и понять что она делает;
от ИИ не надо прятать внутреннюю реализацию объекта, и вообще объект для ИИ может быть не нужен или даже вредить
ИИ легко преобразует код из одного языка или синтаксиса в другой, сохраняя эквивалентность, так что традиционные тесты делаются ненужными
Сейчас код является основным артефактом, определяющим систему. Для ИИ таким артефактом тоже скорее всего будет код, но язык был бы заточен для описания архитектуры, спецификаций, графа зависимостей, движка политик и ограничений и системы формальных контрактов. А сгенерированный код не традиционном ЯП делается вторичен.
И было бы интересно увидеть как будет выглядеть что-то сложное на таком языке. Человеку все равно надо это как-то понимать...
сравнивается gross зарплата, а не net. Income tax может быть 30-35% для зарплаты 147к
147к это не средняя зарплата в ИТ, а только разработчики. support analyst-ы получают меньше 100к gross
Зарплаты 147к сосредоточены в нескольких городах, где жилье значительно дороже среднего по стране. Правильнее было бы брать среднюю цену жилья именно там.
не учтен property tax, в среднем по США 1% от стоимости жилья в год. В РФ фактически копейки
Не учтена homeowners insurance, в частности liability, в раоне $100-$200 в мес для квартиры. В РФ liability не требуется, и цифра в месяц в несколько раз ниже.
В США редко дают 20% первоначального взноса при покупке, а это значит требуется еще и PMI (mortgage insurance) $200-$250 в месяц
Не упомянуты HOA/Condo fees, начинаются от 300 дол для квартир
Это все конечно не отменяет того факта, что с ипотекой 19% лучше не связываться...
Занятость в производстве во всех этих статистических отчетах либо стоит, либо сокращается долгие. Рост демонстрируют только
госструктуры
уход (за стареющими беби-бумерами)
финансовые сервисы (для стареющих беби-бумеров)
Опять же знаю случаи, с 2-мя дипломами работают в доме престарелых. А чтобы кто-то с дипломом инженера работал инженером, то не видел такого с ранних 2-х тысячных. К сожалению, этих анекдотических случаев слишком много, они сливаются в грустную картину.
Вы видимо не следите. Я слежу примерно с 2022 года, когда это меня начало касаться персонально. Я работал в глобальной ИТ компании контрактником, они меня продавали разным клиентам на протяжении 17 лет. Так вот, уже тогда их продажники жаловались, что клиенты просто не хотят новых проектов, приостанавливают существующие, и уж нет бюджетов как раньше. В итоге после полугодичного простоя с сохранением зарплаты им оказалось выгоднее меня уволить с выходным пособием. На моей теперешней работе у меня есть данные по payroll одной сети франшиз быстрого питания, моей задачей было организовать выгрузку этих данных за 6 лет. Так вот количество работников в 2019 было 40 тыс, а в 2025 - 26 тыс, т.е. каждый год небольшое сокращение. Если спросить что будет в следующем году, то скорее всего тенденция сохранится.
Поэтому да, везде замирание экономической активности и сокращения, и это все на фоне увеличения стоимости жизни более чем вдвое по сравнению с доковидными временами.
Мне кажется, проблема шире, чем ставки ФРС, AI и очередной цикл найма-увольнений.
Западные экономики десятилетиями выносили производство в страны с более дешёвой рабочей силой, накапливали тем самым эффект Кантийона (Сначала страна богатеет за счёт производства, лучшего в мире, затем растущие доходы смещают экономику в сторону услуг и luxury-потребления, за ту же работу требуется платить тому же работнику больше, после чего производство становится неконкурентоспособным и переносится за рубеж). Теперь понадобятся десятилетия чтобы вернуть все назад, и не факт что удастся... На данный момент работы нет нигде, не только во ИТ.
Поэтому я бы смотрел на происходящее не как на кризис IT, а как на проявление более глубокого кризиса экономической модели развитых стран. AI здесь скорее ускоритель процесса, чем его причина. Так же как и ковид.
РФ в этом плане тоже кратковременно вошла в фазу luxury-потребления, но производство не успело уйти, да и санкции не дали.
Интересно, но недостаточно метрик. Из статьи не очень понятно, какая часть успеха связана именно с Claude Code, а какая с выстроенным процессом (планы, аудит, несколько ревьюеров, регрессия, ручной контроль). Многие описанные сбои вроде давно известны: неполное покрытие, anchoring, пропуск edge cases и коррелированные ошибки ревьюеров. Было бы особенно интересно увидеть статистику: какой процент планов проходит с первого раза, сколько переоткрывается после аудита и сколько решений пришлось выбросить полностью.
Что делать, если опыта и историй дохрена, есть что рассказать и чем поделиться, но я косноязычный интроверт? К тому же это случается сплошь и рядом, чем больше человек погружен в какую-то тему, тем сложнее ему о ней рассказать... Что плохого чтобы дать ЛЛМ свои мысли, и чтобы она их разложила по порядку и красиво оформила? Даже профессиональные писатели используют редакторов и корректоров. Мне кажеться нет ничего плохого чтобы ЛЛМ помогла.
Сам Боб Мартин, когда его прижали к стенке, где-то сказал, что Agile не единственно верная и не самая лучшая методология, и что он просто кричал про нее больше, чем другие про свои методологии. Поэтому если где-то кто-то не следует слепо Agile, это не значит что там процессы хуже. Скорее всего они лучше, так как адаптированы под конкретную ситуацию на земле. Но менеджеры любят Agile потому что это дает общепринятую структуру процесса, с одинаково трактуемыми терминами, и с однозначно определенными ролями и церемониями, что на всех проектах все выглядит единообразно. А проблем у Agile предостаточно.
Да, ИИ реально меняет саму суть работы. Кодинг постепенно уезжает на уровень ниже. Вполне возможно, что через какое-то время «писать код руками» будут примерно так же, как когда-то писали программы в машинных кодах до появления нормальных компиляторов.
Но это вообще не значит, что разработчики становятся не нужны. Скорее наоборот — растёт уровень сложности задач. Просто CRUD’ом уже никого не удивишь. Компьютеры давно есть в машинах, телевизорах и холодильниках. Скоро, кажется, даже лампочка будет со своим firmware, и, возможно, маленьким ИИ :) Так что толковые ребята всё равно будут нужны. Неважно, как они будут называться — разработчики, или операторы ИИ. Всегда будут нужны люди, которые понимают, куда как с имеющимся ресурсом (сейчас к списку добавлся ИИ) решать проблемы.
Да, тоже также. Но ревью остается узким местом. И, честно говоря, с ИИ крайне редко на ревью что-то годное происходит. В основном косметические изменения, которые только тормозят процесс (потому что менеджеры меряют вовлеченность девелоперов в ревью по количеству комментов). Говоря о процессах, который надо менять, я имею в виду процесс ревью тоже, так как время он отнимает много, а выхлоп дает мало. Может ревью надо переносить на шаг раньше, туда где формируются требования. Но так пока не принято.
Devin AI как раз и есть такой виртуальный сотрудник, работающий на своем виртуальном компе: даешь ему тикет, он читает его из Jira, скачивает репо, анализирует, создает ветку, коммитит туда фиксы, создает ПР, и ждет чтобы его отревьюили. Экономит время на шагах, связанных с “бумажной работой”: созданием ПР, и красиво заполняет все поля в тикете.
Но львиная доля времени все равно уходит на ревью человеком.
Еще у нас любят заставить ИИ писать тесты. Размер тестов уже превышает размер многих приложений. Каждый ПР изза тестов делается в несколько раз больше чем раньше, и где-то за гранью способностей человека все это понять.
А самое неприятное, что я пока ни разу не видел ситуацию, чтобы изза изменений вдруг упал тест, и чтобы ИИ пофиксал бы код. Он всегда фиксает тест.
Может тесты теперь уже не так актуальны, ведь они писались чтобы ловить ошибки людей, которые ИИ не делает?
В общем чувство такое, что вообще все что мы знали о нашей работе теперь надо пересматривать…
Писать его приходится ручками...
У нас в компании все очень похоже. Сказали отныне будет спек-дривен девелопмент. Пригнали контрактников с большим опытом (ну то есть они этим занимаются очень долго, больше года). Контрактники нам паписали скилы вокруг spec-kit, внедрили CodeRabbit, показали каким быть новый процесс, и учат как правильно запускать агентов параллельно в полностью автоматическом режиме, чтобы ты ему эпик из джиры даешь, а утром у тебя все сделано.
Простые тикеты, типа поменять текст на лейбле, агенты щелкают на ура. Ну как щелкают... Генерируют спеки, планы, таски, тесты, код, playwright-тесты, запускают CodeRabbit (локально, затем на сервере, когда PR создан), затем самописный код-ревью скил, затем человек еще на всякий случай проверяет, затем в тикет дописывается простыня что и как сделано (для аудита), пяток тестовых сценариев для QA, и через полдня и энное количество токенов текст поменян, и тикет уходит в QA, где люди тоже уже подустали от общения в стиле wall-of-text, поэтому не читают а сразу скармливают все Клоду, чтобы тот все разьяснил, а лучше сразу сделал.
В прошлые времена это бы тоже заняло полдня, была бы заметка для QA где и что смотреть, и не было бы всего остального нагенерированного слопа.
Делается ли все теперь в 3-5 раз быстрее, как мечтает менеджмент? Смотря как мерять. Если по сгенерированному объему и покрытию бессмыссленными тестами то да.
С более сложными тикетами узкое место обычно ревью. Так как мы хотим надежный код, то мы на него натравливаем максимальное количество ревью-агентов, которые часто не согласны с кодом, друг с другом, и даже если просто перезапустить, то могут дать разные результаты. Обычно это признак того, что требования слишком размыты. Но узнаем мы об этом поздно, приходится править PR. Но править теперь требуется не только код, но и все связанные нагенерированные артефакты: спеки, план, таски, тесты, сам тикет. Клод при этом всегда что-то пропускает, несоответствия спекам всплывют на ревью снова, и получаем цикл. Можно в принципе оставить агентов гонять этот цикл на ночь, но результат как правило плохой и дорогой в смысле сожженных токенов.
Один из подходов, который тестируем, и пока вроде успешно, это показать агенту "идеальный код" : какое-то простое приложение, где ИИ может почерпнуть все недостающие требования: как генерировать фронтенд (фреймворки, библиотеки, элементы, поведение, и т.д.), как выглядит типичный бэкенд (фреймворки, библиотеки, хранилище, транзакционность, пагинация, параметры ендпоинтов, и т.п.). Но правда писать его приходится ручками...
В общем мы пробуем, работа идет, но ускорится в разы пока не получается...
У нас в компании платную версию тестировали пару месяцев в качестве пилотного проекта. В итоге отложили пока на полку. Он конечно автоматизирует административные шаги (за счет того что ему разрешено использовать больше тулзов по умолчанию, изза чего он требует собсвенный виртуальный линукс), типа запушить код, тикет заапдейтить, и т.п., но львиная доля времени, которая уходит на проверку человеком никуда не девается. В плане генерации целого приложения, или даже просто работа над сложной задачей, где все слои подробно и качественно не расписаны, он точно также буксует, как и все остальные.
Я вот пытаюсь посмотреть канал Russia Today https://t.me/rtnews из Канады, получаю ошибку "This channel can't be displayed because it violates local laws (Canada)." - получается иногда Telegram таки подчиняется требованиям местных властей?
Если сравнить, с другими странами, то тут мало что нового.
Лицензирование криптопосредников это фактически аналог европейского MiCA. Требования KYC/AML давно действуют в США, Канаде и ЕС. Передача данных в налоговые органы через биржи тоже.
Из необычного - тестирование и лимиты для неквалифицированных инвесторов, которые сейчас распространяются в РФ только на некоторые сложные фин инструменты.
Поэтому да, гайки закручивают, но Россия тут не уникальна.
Мало у кого есть самодисциплина что-то откладывать на протяжении всей жизни, и никогда не притронуться к сбережениям: то самому хочется купить, то жена мозг вынесет, то детей надо на ноги ставить, то внуков устроить.
И, по наблюдениям, все эти планы на десятилетия вперед с большой вероятностью не сработают...
А что именно победило: агентность или явная доменная декомпозиция? Вы заранее разбили базу знаний на смысловые домены, написали манифесты экспертов и научили роутер между ними выбирать. То есть в систему уже встроена довольно богатая модель предметной области. Возможно именно она и дает основной прирост качества?
Когда один, то возможно не нужен гит-сервер. Но даже если один, и работаешь над чем-то дольше чем один день, то возможность посмотреть историю или откатиться часто оказывается очень полезна, всего-то нужно для этого запустить `git init`.
У меня тоже мысли в том же направлении идут. Все что мы считаем аксиомой в разработке (OOP, DRY, KISS, Clean code, рефакторинг, и т.п.) имеет целью помочь человеку управляться со сложностью с учетом ментальных ограничений человека:
мы лучше понимаем объекты когда это черный ящик с парой методов,
мы забываем обновить все копии кода если что-то надо поменять, поэтому нужны функции, наследование и прочие приемы повторного использования кода,
нам проще читать чем писать, поэтому упор всегда на читаемость и дедупликацию
нам нужно делать рефакторинг потому что в какой-то момент мы запутались и не можем разобраться в сложности.
и т.д.
У ИИ все по другому:
ИИ проще сгенерировать несколько кусков похожего кода, чем прочитать функцию, реконструировать взаимосвязи и понять что она делает;
от ИИ не надо прятать внутреннюю реализацию объекта, и вообще объект для ИИ может быть не нужен или даже вредить
ИИ легко преобразует код из одного языка или синтаксиса в другой, сохраняя эквивалентность, так что традиционные тесты делаются ненужными
Сейчас код является основным артефактом, определяющим систему. Для ИИ таким артефактом тоже скорее всего будет код, но язык был бы заточен для описания архитектуры, спецификаций, графа зависимостей, движка политик и ограничений и системы формальных контрактов. А сгенерированный код не традиционном ЯП делается вторичен.
И было бы интересно увидеть как будет выглядеть что-то сложное на таком языке. Человеку все равно надо это как-то понимать...
Неточности:
сравнивается gross зарплата, а не net. Income tax может быть 30-35% для зарплаты 147к
147к это не средняя зарплата в ИТ, а только разработчики. support analyst-ы получают меньше 100к gross
Зарплаты 147к сосредоточены в нескольких городах, где жилье значительно дороже среднего по стране. Правильнее было бы брать среднюю цену жилья именно там.
не учтен property tax, в среднем по США 1% от стоимости жилья в год. В РФ фактически копейки
Не учтена homeowners insurance, в частности liability, в раоне $100-$200 в мес для квартиры. В РФ liability не требуется, и цифра в месяц в несколько раз ниже.
В США редко дают 20% первоначального взноса при покупке, а это значит требуется еще и PMI (mortgage insurance) $200-$250 в месяц
Не упомянуты HOA/Condo fees, начинаются от 300 дол для квартир
Это все конечно не отменяет того факта, что с ипотекой 19% лучше не связываться...
Занятость в производстве во всех этих статистических отчетах либо стоит, либо сокращается долгие. Рост демонстрируют только
госструктуры
уход (за стареющими беби-бумерами)
финансовые сервисы (для стареющих беби-бумеров)
Опять же знаю случаи, с 2-мя дипломами работают в доме престарелых. А чтобы кто-то с дипломом инженера работал инженером, то не видел такого с ранних 2-х тысячных. К сожалению, этих анекдотических случаев слишком много, они сливаются в грустную картину.
Вы видимо не следите. Я слежу примерно с 2022 года, когда это меня начало касаться персонально. Я работал в глобальной ИТ компании контрактником, они меня продавали разным клиентам на протяжении 17 лет. Так вот, уже тогда их продажники жаловались, что клиенты просто не хотят новых проектов, приостанавливают существующие, и уж нет бюджетов как раньше. В итоге после полугодичного простоя с сохранением зарплаты им оказалось выгоднее меня уволить с выходным пособием.
На моей теперешней работе у меня есть данные по payroll одной сети франшиз быстрого питания, моей задачей было организовать выгрузку этих данных за 6 лет. Так вот количество работников в 2019 было 40 тыс, а в 2025 - 26 тыс, т.е. каждый год небольшое сокращение. Если спросить что будет в следующем году, то скорее всего тенденция сохранится.
Поэтому да, везде замирание экономической активности и сокращения, и это все на фоне увеличения стоимости жизни более чем вдвое по сравнению с доковидными временами.
Мне кажется, проблема шире, чем ставки ФРС, AI и очередной цикл найма-увольнений.
Западные экономики десятилетиями выносили производство в страны с более дешёвой рабочей силой, накапливали тем самым эффект Кантийона (Сначала страна богатеет за счёт производства, лучшего в мире, затем растущие доходы смещают экономику в сторону услуг и luxury-потребления, за ту же работу требуется платить тому же работнику больше, после чего производство становится неконкурентоспособным и переносится за рубеж). Теперь понадобятся десятилетия чтобы вернуть все назад, и не факт что удастся... На данный момент работы нет нигде, не только во ИТ.
Поэтому я бы смотрел на происходящее не как на кризис IT, а как на проявление более глубокого кризиса экономической модели развитых стран. AI здесь скорее ускоритель процесса, чем его причина. Так же как и ковид.
РФ в этом плане тоже кратковременно вошла в фазу luxury-потребления, но производство не успело уйти, да и санкции не дали.
Интересно, но недостаточно метрик. Из статьи не очень понятно, какая часть успеха связана именно с Claude Code, а какая с выстроенным процессом (планы, аудит, несколько ревьюеров, регрессия, ручной контроль). Многие описанные сбои вроде давно известны: неполное покрытие, anchoring, пропуск edge cases и коррелированные ошибки ревьюеров. Было бы особенно интересно увидеть статистику: какой процент планов проходит с первого раза, сколько переоткрывается после аудита и сколько решений пришлось выбросить полностью.
Что делать, если опыта и историй дохрена, есть что рассказать и чем поделиться, но я косноязычный интроверт? К тому же это случается сплошь и рядом, чем больше человек погружен в какую-то тему, тем сложнее ему о ней рассказать... Что плохого чтобы дать ЛЛМ свои мысли, и чтобы она их разложила по порядку и красиво оформила? Даже профессиональные писатели используют редакторов и корректоров. Мне кажеться нет ничего плохого чтобы ЛЛМ помогла.
Сам Боб Мартин, когда его прижали к стенке, где-то сказал, что Agile не единственно верная и не самая лучшая методология, и что он просто кричал про нее больше, чем другие про свои методологии. Поэтому если где-то кто-то не следует слепо Agile, это не значит что там процессы хуже. Скорее всего они лучше, так как адаптированы под конкретную ситуацию на земле. Но менеджеры любят Agile потому что это дает общепринятую структуру процесса, с одинаково трактуемыми терминами, и с однозначно определенными ролями и церемониями, что на всех проектах все выглядит единообразно. А проблем у Agile предостаточно.
Про
не согласен.
Да, ИИ реально меняет саму суть работы. Кодинг постепенно уезжает на уровень ниже. Вполне возможно, что через какое-то время «писать код руками» будут примерно так же, как когда-то писали программы в машинных кодах до появления нормальных компиляторов.
Но это вообще не значит, что разработчики становятся не нужны. Скорее наоборот — растёт уровень сложности задач. Просто CRUD’ом уже никого не удивишь. Компьютеры давно есть в машинах, телевизорах и холодильниках. Скоро, кажется, даже лампочка будет со своим firmware, и, возможно, маленьким ИИ :) Так что толковые ребята всё равно будут нужны. Неважно, как они будут называться — разработчики, или операторы ИИ. Всегда будут нужны люди, которые понимают, куда как с имеющимся ресурсом (сейчас к списку добавлся ИИ) решать проблемы.
Да, тоже также. Но ревью остается узким местом. И, честно говоря, с ИИ крайне редко на ревью что-то годное происходит. В основном косметические изменения, которые только тормозят процесс (потому что менеджеры меряют вовлеченность девелоперов в ревью по количеству комментов). Говоря о процессах, который надо менять, я имею в виду процесс ревью тоже, так как время он отнимает много, а выхлоп дает мало. Может ревью надо переносить на шаг раньше, туда где формируются требования. Но так пока не принято.
Devin AI как раз и есть такой виртуальный сотрудник, работающий на своем виртуальном компе: даешь ему тикет, он читает его из Jira, скачивает репо, анализирует, создает ветку, коммитит туда фиксы, создает ПР, и ждет чтобы его отревьюили. Экономит время на шагах, связанных с “бумажной работой”: созданием ПР, и красиво заполняет все поля в тикете.
Но львиная доля времени все равно уходит на ревью человеком.
Еще у нас любят заставить ИИ писать тесты. Размер тестов уже превышает размер многих приложений. Каждый ПР изза тестов делается в несколько раз больше чем раньше, и где-то за гранью способностей человека все это понять.
А самое неприятное, что я пока ни разу не видел ситуацию, чтобы изза изменений вдруг упал тест, и чтобы ИИ пофиксал бы код. Он всегда фиксает тест.
Может тесты теперь уже не так актуальны, ведь они писались чтобы ловить ошибки людей, которые ИИ не делает?
В общем чувство такое, что вообще все что мы знали о нашей работе теперь надо пересматривать…