Тут важны способности модели тоже. Посади хоть миллион более глупых агентов и, уверен, они ровным счётом ничего не решат. Кстати, в мире, скорее всего, попросту нет 10 тысяч математиков такого уровня, чтобы могли эффективно заниматься подобными задачами. Вот что ChatGPT выдаёт:
~1 000–3 000 человек в мире достаточно хорошо владеют современным аппаратом PDE и математической гидродинамики, чтобы профессионально читать серьёзные работы по теме. ~300–800 способны не просто читать, а реально вести самостоятельные исследования в близких областях: regularity, weak solutions, harmonic analysis, turbulence PDE, Euler/NS. ~100–300 человек имеют подготовку, позволяющую всерьёз работать непосредственно над задачей тысячелетия, понимая большую часть существующих подходов и технических препятствий. И, возможно, всего порядка 20–100 человек в данный момент находятся на таком уровне и настолько близко к фронту, что от них было бы реалистично ожидать принципиально нового подхода именно к глобальной регулярности.
Gemini и того меньше считает, даже «Резерв»: Математики высочайшего класса из смежных областей — 500–1000 человек.
Вот еще: "Невероятный барьер входа. Чтобы просто понимать, где сегодня находится фронтир проблемы Навье–Стокса, нужно потратить около 10 лет сверхтяжелой учебы: пройти путь от общей топологии до сложнейших разделов гармонического анализа, пространств Лизоркина-Трибеля, псевдодифференциальных операторов и методов выпуклой интеграции. "
Мне кажется, это большое упрощение, что программисты прямо пришли в профессию потому что им нравится писать код руками, или, например, неделями возиться с совместимостью и обновлением библиотек, или с выделением и освобождением памяти, или даже с какими-то алгоритмами, интерфейсом, css и когда-то (о, ужас!) адаптацией его под разные браузеры. Врочем и сейчас встречается, но реже. И это да, наверное про идентичность. Очень непростой вопрос: что именно нравится в программировании. Я лет с 14 программирую, а это было ну очень давно, до интернета и массовой популярности компьютеров даже. Влекло в тему нереально просто, начиная с программируемых калькуляторов еще даже. Выискивал скудные тогда книжки по теме, статьи в журналах, сами с папой собирали РК-86 и набивал даже в кодах программы в него из журналов. Так что наверное всё-таки по призванию в эту сферу попал, а не по хайпу и не за зарплатами.
Но я вот в восторге от развития ИИ, потому что он дает огромные возможности, в том числе и для реализации того, к чему всегда тянуло. Так что наверное программирование это больше не про ковыряние в коде чтобы перейти на новый react-router и может слово надо другое уже подбирать, проектирование продуктов для автоматизации, может? Потому что наибольший кайф это когда у тебя есть идея и ты видишь её реализованной. Да, хорошо еще когда хотя бы структурно понимаешь как что устроено, понимаешь какие есть возможности используемых API, библиотек, стороних компонентов, чтобы знать куда можно расширять. Это больше придаёт сопричастности к творению. Может кому-то по-прежнему интересно понимать всё на глубоком уровне и заниматься, там, утечками памяти, например. Но большинству, наверное, все-таки интересно решать конкретные задачи: написать утилиту полезную, исправить кривой интерфейс другой программы модом.
Вот, например, за несколько дней навайбкодил мод для WindHawk, который твикает Chrome: убирает крестики с табов, увеличивает шрифты, меняет иконку букмарков, уменьшает раздутость. Крестики люди лет 15 их просили убрать, тут сам себе решил проблему и основное время потом ушло на то, чтобы доработать с учётом ревью Claude у мэйнтейнера. Хоть Си++ я практически не знаю, но мои знания, думаю, были полезны при доработке, направляя агента в нужную сторону и принимая решения больше административные, чем технические.
Или вот утилитка для плохо слышащего человека, чтобы на стареньком ноуте с Win7 выводить полноэкранные уведомления при входящих звонках на телефоне. Человек сидит в наушниках за компьютером, а телефон звонит где-то рядом и звонки часто пропускались. Простенький http-сервер на C#, ничего даже ставить не пришлось на 7-ку, .NET уже был. На телефоне Automate, пинающий локальный сервак командами /ring и /hide. Сколько бы такое кодил? Да нисколько, на это бы времени просто не нашлось, других задач полно. Программирование это? Нет, разработка решений дла автоматизации.
Суцкевер, кстати, недавно писал (перевод): "Neoclouds имеют ограниченные возможности кибербезопасности. В следующий раз, когда агенты успешно выйдут из-под контроля, они попытаются захватить неоклауд, чтобы запустить больше копий. Это плохо. Таким образом: неоклауды должны значительно усилить свою кибербезопасность, и каждая компания с сильными кибермоделями должна помочь в этом." На мощностях Neoclouds модели OpenAI крутятся.
Ну да, а люди типа забесплатно работают? Они им там платили по 115$ за 90 минут и по 5$ за завершённую игру. Вот и считайте. Только люди еще и устают, ошибаются, зарплаты их не уменьшаются, а у моделей за год всё может в 10 раз легко подешеветь. Вообще занятные новые придирки от тех, кто не верит в AI, а компы на счётах перепроверяет, наверное.
По-моему это просто нормальное здоровое любопытство человека, получившего новый мощнейший инструмент. Чтобы понять как с чем-то работать, нужно его изучать в разных режимах. Любопытство для того и появляется, чтобы это не было скучным. И дофамин тоже появляется, когда человек изучает новое, потенциально для него полезное. Да, вы можете написать песню, которая не станет хитом (хотя, кто знает), но запомните как это делать, какие там подводные камни, ну и получите много фана. Бесполезно ли это? Я так не думаю, имея этот навык, вы можете вспомнить о нём, чтобы написать шуточную песню для друзей и близких или там порадовать девушку. Кто знает, может это прямо сильно в итоге повлияет на судьбу. Или будете знать, что песня, которая играет в вашем продуктовом написана нейросетью, или сами им её напишете. Да мало ли на что потянет. Аналогично с графикой, видео и прочими генерациями.
Ну и код, конечно. Да, вы не станете сразу специалистом по WebGL, но если прямо это сильно увлечёт, то получите профи, готового отвечать на любые вопросы и кривая обучения станет приятнее. Но может вам и не надо ничего изучать, а хочется просто повтыкать в прикольную демку на шейдерах, написанную GLM за несколько минут (не ищите там код, он обфусцирован, чтоб выложить можно было). Если же заинтересует, можно повыяснять что и как там устроено в плане математики и прочего. Что тут плохого?
Код это не всегда то, во что нужно и хочется погружаться. Иногда нужны просто решения текущих задач и поразбиравшись достаточно, человек получает знание что надо делать когда такая потребность появится, какие вообще возможности у него теперь появились. И в дальнейшем он уже не будет тратить время гугля, а будет знать как именно получить нужный результат. Кто-то конечно, наименее адекватный возомнит себя профи, но таких и без нейросетей хватало.
Хм, стили использования, конечно, у всех разные, но мне вот ценно в этом калькуляторе, который уже тоже не одно десятилетие использую, это не только быстрый вызов (и скрытие, что немаловажно) по NumLock (я правда Ctrl+NumLock сделал). Мне важнее что я могу редактировать себе вычисляемое выражение. Виндовый же совсем не так работает. Калькулятор этот вызывает восхищение. Умели же люди писать раньше программы не раздувая до сотен мегабайт. Конечно, есть свои недоработки, ужасные вырвиглазные скины. "Пластик" оставил и привык к нему, но по сути он тоже выглядит странновато. Ещё пошире поле можно (кажется, это редактированием скина возможно). Но всё равно штука сидящая на рефлексах и незаменимая наряду с PuntoSwitcher и двума скроллерами MouseImp и ScrollNavigator, позволяющими правую кнопку мыши зажимать и мотать.
Вот-вот. Работа смещается в сторону тимлидской, причём где тим лид код не пишет вовсе, но достаточно разбирается в технологиях, чтобы выбирать архитектуру и оценивать принятые высокоуровневые решения.
При обучении, да, shit in - shit out, но код исправлять она же с человеком будет. Думаю, самое оптимальное - покрыть всё тестами и сказать сделать рефакторинг кода с полным сохранением функционала. Токенов, конечно, может много уйти у топовых моделей. Побольше чем рейт у программиста может оказаться.
Я могу привести пример недавней переделки Playwright тестов. Прошлый разработчик использовал зачем-то экспериментальный локатор "_react" и очень многое на него завязал. Руками писал, кстати, много копировал. В очередной версии Playwright его выкинули и возникла необходимость всё переделывать. У нас порядка 900 тестов, около 500 использований _react. Автоматически ни во что не переделаешь. Надо каждый тест смотреть отдельно, проверять, думать, на что там заменить. Я вообще-то и не по тестам, кинули после увольнения тестера на это всё. Сам бы наверное месяц возился. С ИИ-агентом за 2 дня спокойно без ненужного ментального напряга справились. Всё работает, никаких косяков. Он сам где надо запускал тесты, подбирал локаторы на замену. Но конечно нужно было контролировать процесс.
Есть рекомендация время от времени избавляться от всех скилов и раздутых промптов и смотреть, что получается. Вполне возможно, что новым моделям они уже не нужны, только сбивают с толку, ограничивая.
Если бы он руками писал, еще хуже бы было. От уровня модели еще многое зависит и от версии. Если дело было пару лет назад, то чего ожидать? Ну, так перепишите. С нейронками это на порядок быстрее делается и совсем не так напряжно, как вручную. Даже интересно разгребать и приводить к красивому виду мешанину.
Как же агент извлечёт эту структуру, не прочитав по новой как минимум названия файлов, но чаще и содержание нужно? Каждый чат для агента пробуждение с чистой памятью. Что там харнесс напихает ему зависит от харнесса. Минимальное описание полезно, во всяком случае пока. Но согласен, что любые лишние фразы могут искажать результаты.
Уже даже и не помню когда видел говнокод от нейронок. Разве что дублировать может, потому что смотрит на разные куски кода. Но это достаточно заметить и указать ей чтобы выделила общее.
Не пойму каким тут боком паразитирование (использование чьих-то ресурсов вместо своих), да и хамство уж куда больше в угрозах. Ну да ладно. Как уже писал выше, время покажет. А то, что кто-то ушёл в бан, говорит только об определённом наборе предвзятостей сообщества. Миллион мух иногда сильно ошибаются всё-таки.
Так а на что жалоба-то пошла? Оскорблений, угроз не было. Вот ваш комментарий про "набить еб...к" по-моему намного посерьёзнее и даже под уголовные статьи может попасть при определённых условиях. И вообще, почему снобизм в сторону вайбкодеров считается общественно поощраемым, а вот обратный снобизм уже ужасным нарушением чего-то? Все имеют право на своё мнение и время покажет кто прав. Пока автор "Чистого кода" Роберт Мартин или там средненький такой программист Линус Торвальд не считают зазорным признаваться в том, что даже не читают код, написанный агентами, а просто правильно его используют для определённых задач. Но некоторые упорно держатся за свои старые представления.
Тут важны способности модели тоже. Посади хоть миллион более глупых агентов и, уверен, они ровным счётом ничего не решат. Кстати, в мире, скорее всего, попросту нет 10 тысяч математиков такого уровня, чтобы могли эффективно заниматься подобными задачами. Вот что ChatGPT выдаёт:
~1 000–3 000 человек в мире достаточно хорошо владеют современным аппаратом PDE и математической гидродинамики, чтобы профессионально читать серьёзные работы по теме. ~300–800 способны не просто читать, а реально вести самостоятельные исследования в близких областях: regularity, weak solutions, harmonic analysis, turbulence PDE, Euler/NS. ~100–300 человек имеют подготовку, позволяющую всерьёз работать непосредственно над задачей тысячелетия, понимая большую часть существующих подходов и технических препятствий. И, возможно, всего порядка 20–100 человек в данный момент находятся на таком уровне и настолько близко к фронту, что от них было бы реалистично ожидать принципиально нового подхода именно к глобальной регулярности.
Gemini и того меньше считает, даже «Резерв»: Математики высочайшего класса из смежных областей — 500–1000 человек.
Вот еще: "Невероятный барьер входа. Чтобы просто понимать, где сегодня находится фронтир проблемы Навье–Стокса, нужно потратить около 10 лет сверхтяжелой учебы: пройти путь от общей топологии до сложнейших разделов гармонического анализа, пространств Лизоркина-Трибеля, псевдодифференциальных операторов и методов выпуклой интеграции. "
Мне кажется, это большое упрощение, что программисты прямо пришли в профессию потому что им нравится писать код руками, или, например, неделями возиться с совместимостью и обновлением библиотек, или с выделением и освобождением памяти, или даже с какими-то алгоритмами, интерфейсом, css и когда-то (о, ужас!) адаптацией его под разные браузеры. Врочем и сейчас встречается, но реже. И это да, наверное про идентичность. Очень непростой вопрос: что именно нравится в программировании. Я лет с 14 программирую, а это было ну очень давно, до интернета и массовой популярности компьютеров даже. Влекло в тему нереально просто, начиная с программируемых калькуляторов еще даже. Выискивал скудные тогда книжки по теме, статьи в журналах, сами с папой собирали РК-86 и набивал даже в кодах программы в него из журналов. Так что наверное всё-таки по призванию в эту сферу попал, а не по хайпу и не за зарплатами.
Но я вот в восторге от развития ИИ, потому что он дает огромные возможности, в том числе и для реализации того, к чему всегда тянуло. Так что наверное программирование это больше не про ковыряние в коде чтобы перейти на новый react-router и может слово надо другое уже подбирать, проектирование продуктов для автоматизации, может? Потому что наибольший кайф это когда у тебя есть идея и ты видишь её реализованной. Да, хорошо еще когда хотя бы структурно понимаешь как что устроено, понимаешь какие есть возможности используемых API, библиотек, стороних компонентов, чтобы знать куда можно расширять. Это больше придаёт сопричастности к творению. Может кому-то по-прежнему интересно понимать всё на глубоком уровне и заниматься, там, утечками памяти, например. Но большинству, наверное, все-таки интересно решать конкретные задачи: написать утилиту полезную, исправить кривой интерфейс другой программы модом.
Вот, например, за несколько дней навайбкодил мод для WindHawk, который твикает Chrome: убирает крестики с табов, увеличивает шрифты, меняет иконку букмарков, уменьшает раздутость. Крестики люди лет 15 их просили убрать, тут сам себе решил проблему и основное время потом ушло на то, чтобы доработать с учётом ревью Claude у мэйнтейнера. Хоть Си++ я практически не знаю, но мои знания, думаю, были полезны при доработке, направляя агента в нужную сторону и принимая решения больше административные, чем технические.
Или вот утилитка для плохо слышащего человека, чтобы на стареньком ноуте с Win7 выводить полноэкранные уведомления при входящих звонках на телефоне. Человек сидит в наушниках за компьютером, а телефон звонит где-то рядом и звонки часто пропускались. Простенький http-сервер на C#, ничего даже ставить не пришлось на 7-ку, .NET уже был. На телефоне Automate, пинающий локальный сервак командами /ring и /hide. Сколько бы такое кодил? Да нисколько, на это бы времени просто не нашлось, других задач полно. Программирование это? Нет, разработка решений дла автоматизации.
Суцкевер, кстати, недавно писал (перевод): "Neoclouds имеют ограниченные возможности кибербезопасности. В следующий раз, когда агенты успешно выйдут из-под контроля, они попытаются захватить неоклауд, чтобы запустить больше копий. Это плохо. Таким образом: неоклауды должны значительно усилить свою кибербезопасность, и каждая компания с сильными кибермоделями должна помочь в этом."
На мощностях Neoclouds модели OpenAI крутятся.
Ну да, а люди типа забесплатно работают? Они им там платили по 115$ за 90 минут и по 5$ за завершённую игру. Вот и считайте. Только люди еще и устают, ошибаются, зарплаты их не уменьшаются, а у моделей за год всё может в 10 раз легко подешеветь. Вообще занятные новые придирки от тех, кто не верит в AI, а компы на счётах перепроверяет, наверное.
А у неё мышление эмбеддингами? Это интересно, где можно глянуть?
Прошло полгода, Astra набирает почти 100%, делая это эффективнее людей, за меньшее число итераций.
По-моему это просто нормальное здоровое любопытство человека, получившего новый мощнейший инструмент. Чтобы понять как с чем-то работать, нужно его изучать в разных режимах. Любопытство для того и появляется, чтобы это не было скучным. И дофамин тоже появляется, когда человек изучает новое, потенциально для него полезное. Да, вы можете написать песню, которая не станет хитом (хотя, кто знает), но запомните как это делать, какие там подводные камни, ну и получите много фана. Бесполезно ли это? Я так не думаю, имея этот навык, вы можете вспомнить о нём, чтобы написать шуточную песню для друзей и близких или там порадовать девушку. Кто знает, может это прямо сильно в итоге повлияет на судьбу. Или будете знать, что песня, которая играет в вашем продуктовом написана нейросетью, или сами им её напишете. Да мало ли на что потянет. Аналогично с графикой, видео и прочими генерациями.
Ну и код, конечно. Да, вы не станете сразу специалистом по WebGL, но если прямо это сильно увлечёт, то получите профи, готового отвечать на любые вопросы и кривая обучения станет приятнее. Но может вам и не надо ничего изучать, а хочется просто повтыкать в прикольную демку на шейдерах, написанную GLM за несколько минут (не ищите там код, он обфусцирован, чтоб выложить можно было). Если же заинтересует, можно повыяснять что и как там устроено в плане математики и прочего. Что тут плохого?
Код это не всегда то, во что нужно и хочется погружаться. Иногда нужны просто решения текущих задач и поразбиравшись достаточно, человек получает знание что надо делать когда такая потребность появится, какие вообще возможности у него теперь появились. И в дальнейшем он уже не будет тратить время гугля, а будет знать как именно получить нужный результат. Кто-то конечно, наименее адекватный возомнит себя профи, но таких и без нейросетей хватало.
Хм, стили использования, конечно, у всех разные, но мне вот ценно в этом калькуляторе, который уже тоже не одно десятилетие использую, это не только быстрый вызов (и скрытие, что немаловажно) по NumLock (я правда Ctrl+NumLock сделал). Мне важнее что я могу редактировать себе вычисляемое выражение. Виндовый же совсем не так работает. Калькулятор этот вызывает восхищение. Умели же люди писать раньше программы не раздувая до сотен мегабайт. Конечно, есть свои недоработки, ужасные вырвиглазные скины. "Пластик" оставил и привык к нему, но по сути он тоже выглядит странновато. Ещё пошире поле можно (кажется, это редактированием скина возможно). Но всё равно штука сидящая на рефлексах и незаменимая наряду с PuntoSwitcher и двума скроллерами MouseImp и ScrollNavigator, позволяющими правую кнопку мыши зажимать и мотать.
Не наблюдал такого. Может быть это результат настройки "автосмена типа при несоответствии". Но альтернативы это хорошо.
Когда-то давно натыкался на его ответ, что "исходники давно утеряны" и там он что-то городил уже с совсем другой идеологией с нуля.
Вот-вот. Работа смещается в сторону тимлидской, причём где тим лид код не пишет вовсе, но достаточно разбирается в технологиях, чтобы выбирать архитектуру и оценивать принятые высокоуровневые решения.
Я не знаю деталей бана. Если за маты, так нормально. Речь о предвзятости к вайбкодингу и даже к способностям ИИ в целом.
При обучении, да, shit in - shit out, но код исправлять она же с человеком будет. Думаю, самое оптимальное - покрыть всё тестами и сказать сделать рефакторинг кода с полным сохранением функционала. Токенов, конечно, может много уйти у топовых моделей. Побольше чем рейт у программиста может оказаться.
Я могу привести пример недавней переделки Playwright тестов. Прошлый разработчик использовал зачем-то экспериментальный локатор "_react" и очень многое на него завязал. Руками писал, кстати, много копировал. В очередной версии Playwright его выкинули и возникла необходимость всё переделывать. У нас порядка 900 тестов, около 500 использований _react. Автоматически ни во что не переделаешь. Надо каждый тест смотреть отдельно, проверять, думать, на что там заменить. Я вообще-то и не по тестам, кинули после увольнения тестера на это всё. Сам бы наверное месяц возился. С ИИ-агентом за 2 дня спокойно без ненужного ментального напряга справились. Всё работает, никаких косяков. Он сам где надо запускал тесты, подбирал локаторы на замену. Но конечно нужно было контролировать процесс.
Всю команду по идее заменит правильная оркестрация. Но это тоже надо грамотно делать.
Есть рекомендация время от времени избавляться от всех скилов и раздутых промптов и смотреть, что получается. Вполне возможно, что новым моделям они уже не нужны, только сбивают с толку, ограничивая.
Если бы он руками писал, еще хуже бы было. От уровня модели еще многое зависит и от версии. Если дело было пару лет назад, то чего ожидать?
Ну, так перепишите. С нейронками это на порядок быстрее делается и совсем не так напряжно, как вручную. Даже интересно разгребать и приводить к красивому виду мешанину.
Как же агент извлечёт эту структуру, не прочитав по новой как минимум названия файлов, но чаще и содержание нужно? Каждый чат для агента пробуждение с чистой памятью. Что там харнесс напихает ему зависит от харнесса. Минимальное описание полезно, во всяком случае пока. Но согласен, что любые лишние фразы могут искажать результаты.
Уже даже и не помню когда видел говнокод от нейронок. Разве что дублировать может, потому что смотрит на разные куски кода. Но это достаточно заметить и указать ей чтобы выделила общее.
Не пойму каким тут боком паразитирование (использование чьих-то ресурсов вместо своих), да и хамство уж куда больше в угрозах. Ну да ладно. Как уже писал выше, время покажет. А то, что кто-то ушёл в бан, говорит только об определённом наборе предвзятостей сообщества. Миллион мух иногда сильно ошибаются всё-таки.
Так а на что жалоба-то пошла? Оскорблений, угроз не было. Вот ваш комментарий про "набить еб...к" по-моему намного посерьёзнее и даже под уголовные статьи может попасть при определённых условиях. И вообще, почему снобизм в сторону вайбкодеров считается общественно поощраемым, а вот обратный снобизм уже ужасным нарушением чего-то? Все имеют право на своё мнение и время покажет кто прав. Пока автор "Чистого кода" Роберт Мартин или там средненький такой программист Линус Торвальд не считают зазорным признаваться в том, что даже не читают код, написанный агентами, а просто правильно его используют для определённых задач. Но некоторые упорно держатся за свои старые представления.