Если этот трафик генерит обучение ИИ, и при этом каждый запрос приходится несколько секунд решать задачу с вычислением хеша, как будто в какой-то момент реально будет проще и дешевле склонить себе репозиторий и работать с ним локально…
Пет проекты, которые откладывались годами, делаются в виде MVP за несколько вечеров. Да, надо ревьювить, да, надо проверять. Да, гораздо лучше и самому понимать, как работает весь код (это про то, что не программистом сложнее отличить работающий плохой продукт от работающего хорошего).
Но нудно писать руками - точно уже не надо. И это офигенно.
Возможно, таких проектов и нет практически. Нужно, чтобы сошлись сразу три звезды - и открытость проекта, и высокие требования к скорости его работы, и какая-никакая новизна.
Если делать для себя движок игры или торгового бота - зачем открывать код? Если делать какую-то утилиту без строгих требований к скорости - зачем делать её на плюсах? Ну а существующие проекты, понятно, уже существуют.
Посмотрите ради интереса на тот же Zed. Вот его очень активно пилят нейронками. Если бы не существовало Rust, наверное, он мог бы быть на C++ :)
Вы взяли проект, у которого в ридми явно написано «This repository is released for agentic system research purposes only. Everything in this repo is generated by AI agents. Do not use this project for production». То есть он не заявлялся ни как пример хорошей архитектуры, ни как образец кода без ошибок. Он заброшен уже полгода как.
Вполне возможно, что он сгенерирован парой промптов и в принципе не ревьювился.
Удивительно было бы не найти в нем косяки. Только ценность исследования факты выше здорово снижают
Готовые решения есть. Как на уровне agents.md и скилов (явно указывать писать простой код в лоб), так и на уровне промежуточного ревью (ничего не мешает отметить, что такие-то новые участки нужно упростить).
На уровне общей архитектуры проекта и тестов тоже - если LLM видит, что, образно, фичи лежат там, вспомогательные файлы там, общий UI - там, то и косяков становится практически ноль - нужные методы дописывает куда надо. Ну и если вдруг тесты ломает, вполне себе чинит.
Я же четко написал "стоимость написания кода". Не про ревью, не про тестирование, не про поддержку. Это никуда не делось.
И речь в статье как раз о том, что если раньше от разработчика в целом могло быть достаточно просто средненько писать код (а косяки как раз ловились на ревью и в тестировании), то сейчас средненько писать код может и нейронка.
Пет проект, который сам доводил бы до MVP минимум несколько месяцев - пару недель.
Масштабная подготовка коммерческого проекта к локализации - ночь Клода вместо месяца работы нескольких команд
Доработки рабочей утилиты - несколько минут вместо нескольких часов
Новая рабочая утилита - несколько часов вместо нескольких дней
Мне удивительно вообще такое объяснять, возможно, вы нейронками не пользуетесь?
Про стоимость разработчика я в статье и говорю, что бизнесу ценен человек, который вникает в задачи и отвечает за результат. А не тот, кто или бездумно кодит, или делегирует это LLM без дальнейшего ревью и ответственности за результат. Поэтому и вывод - писать обычный код - это уже не суперспособность.
Возможно, не совсем понял, но зачем для этого могла понадобиться (в статье явно указано, что не понадобилась) база? Если к каждому из состояний можно придти из собранного путем какого-то количества действий с кубиком, получается, это просто список всех вариантов действий? Кроме того, что их просто много (но это как будто не значит, что нужно много памяти или вычислений), в чем именно сложность?
Ну так одно дело когда мощности простаивают, а другое - когда несколько месяцев работают нон-стоп. В статье указано, что аренда стоила бы больше полумиллиона долларов. Подозреваю, что затраченное электричество обошлось бы минимум в $100000. И никто даже не заметил?
Читается как детектив. В очень интересное время мы сейчас живем. Похоже, релизный цикл много какого софта в ближайшее время сильно сократится, тем же браузерам или операционкам неделями висеть с дырами будет непозволительной роскошью
Да, спасибо, вопрос был именно про это. Просто такой подход, кроме того, что дорогой, ещё и, мягко говоря, не особо безопасный. Что если вместо нормальных данных кто-то в поля ввода закинет prompt injection, где будет указано удалить всю базу?
Если честно, я вообще не понял. Это тот самый вайбкодинг в вакууме (или, скорее, в кубе), когда для регистрации нового пользователя не выполняется обычный код добавления в базу данных, а вызывается LLM, которая это делает «руками»?
У C100 ещё был старший брат X100, который, насколько я помню, выделялся космическим (по меркам своего времени) объемом памяти - около 9 мб. Конкуренты имели 1-2. Ну и игра там была залипательная, про снежки
Прикручен GLM-5.2 как один из пайпов на новые коммиты. Вполне неплохо ревьювит, находит и логические ошибки, и утечки, иногда предлагает оптимизации. Да, какая-то часть тредов при проверке оказывается false positive. Все как у людей, собственно.
Не знаю, как у модели уровня последнего Opus можно получить вывод, подобный приведенному в статье. Может, это специально сделано? (: А если нет - поделитесь, пожалуйста, методикой работы с LLM.
Если этот трафик генерит обучение ИИ, и при этом каждый запрос приходится несколько секунд решать задачу с вычислением хеша, как будто в какой-то момент реально будет проще и дешевле склонить себе репозиторий и работать с ним локально…
Все так.
Пет проекты, которые откладывались годами, делаются в виде MVP за несколько вечеров. Да, надо ревьювить, да, надо проверять. Да, гораздо лучше и самому понимать, как работает весь код (это про то, что не программистом сложнее отличить работающий плохой продукт от работающего хорошего).
Но нудно писать руками - точно уже не надо. И это офигенно.
Возможно, таких проектов и нет практически. Нужно, чтобы сошлись сразу три звезды - и открытость проекта, и высокие требования к скорости его работы, и какая-никакая новизна.
Если делать для себя движок игры или торгового бота - зачем открывать код? Если делать какую-то утилиту без строгих требований к скорости - зачем делать её на плюсах? Ну а существующие проекты, понятно, уже существуют.
Посмотрите ради интереса на тот же Zed. Вот его очень активно пилят нейронками. Если бы не существовало Rust, наверное, он мог бы быть на C++ :)
А кто сказал, что не пользуются?
Вы взяли проект, у которого в ридми явно написано «This repository is released for agentic system research purposes only.
Everything in this repo is generated by AI agents. Do not use this project for production». То есть он не заявлялся ни как пример хорошей архитектуры, ни как образец кода без ошибок. Он заброшен уже полгода как.
Вполне возможно, что он сгенерирован парой промптов и в принципе не ревьювился.
Удивительно было бы не найти в нем косяки. Только ценность исследования факты выше здорово снижают
Готовые решения есть. Как на уровне agents.md и скилов (явно указывать писать простой код в лоб), так и на уровне промежуточного ревью (ничего не мешает отметить, что такие-то новые участки нужно упростить).
На уровне общей архитектуры проекта и тестов тоже - если LLM видит, что, образно, фичи лежат там, вспомогательные файлы там, общий UI - там, то и косяков становится практически ноль - нужные методы дописывает куда надо. Ну и если вдруг тесты ломает, вполне себе чинит.
Я же четко написал "стоимость написания кода". Не про ревью, не про тестирование, не про поддержку. Это никуда не делось.
И речь в статье как раз о том, что если раньше от разработчика в целом могло быть достаточно просто средненько писать код (а косяки как раз ловились на ревью и в тестировании), то сейчас средненько писать код может и нейронка.
Пет проект, который сам доводил бы до MVP минимум несколько месяцев - пару недель.
Масштабная подготовка коммерческого проекта к локализации - ночь Клода вместо месяца работы нескольких команд
Доработки рабочей утилиты - несколько минут вместо нескольких часов
Новая рабочая утилита - несколько часов вместо нескольких дней
Мне удивительно вообще такое объяснять, возможно, вы нейронками не пользуетесь?
Про стоимость разработчика я в статье и говорю, что бизнесу ценен человек, который вникает в задачи и отвечает за результат. А не тот, кто или бездумно кодит, или делегирует это LLM без дальнейшего ревью и ответственности за результат. Поэтому и вывод - писать обычный код - это уже не суперспособность.
Если каждое состояние вычисляется по фиксированной формуле за несколько шагов - очевидно, что список хранить не требуется
Возможно, не совсем понял, но зачем для этого могла понадобиться (в статье явно указано, что не понадобилась) база? Если к каждому из состояний можно придти из собранного путем какого-то количества действий с кубиком, получается, это просто список всех вариантов действий? Кроме того, что их просто много (но это как будто не значит, что нужно много памяти или вычислений), в чем именно сложность?
Ну так одно дело когда мощности простаивают, а другое - когда несколько месяцев работают нон-стоп. В статье указано, что аренда стоила бы больше полумиллиона долларов. Подозреваю, что затраченное электричество обошлось бы минимум в $100000. И никто даже не заметил?
Читается как детектив. В очень интересное время мы сейчас живем. Похоже, релизный цикл много какого софта в ближайшее время сильно сократится, тем же браузерам или операционкам неделями висеть с дырами будет непозволительной роскошью
Да, спасибо, вопрос был именно про это. Просто такой подход, кроме того, что дорогой, ещё и, мягко говоря, не особо безопасный. Что если вместо нормальных данных кто-то в поля ввода закинет prompt injection, где будет указано удалить всю базу?
Если честно, я вообще не понял. Это тот самый вайбкодинг в вакууме (или, скорее, в кубе), когда для регистрации нового пользователя не выполняется обычный код добавления в базу данных, а вызывается LLM, которая это делает «руками»?
Да не то это совсем. Одно дело помнить 30 команд и жонглировать ими, а совсем другое написать что тебе нужно в пару человеческих предложений
Почему бы и нет? Если реально мощнее и по уровню шума сопоставимо - отличный конкурент. Наверное, по размерам только явно крупнее.
Классика.
Люди делятся на три типа: те, кто еще не делает бэкапы; те, кто уже делает бэкапы; и те, кто проверяет, что бэкапы корректно восстанавливаются.
У C100 ещё был старший брат X100, который, насколько я помню, выделялся космическим (по меркам своего времени) объемом памяти - около 9 мб. Конкуренты имели 1-2. Ну и игра там была залипательная, про снежки
Прикручен GLM-5.2 как один из пайпов на новые коммиты. Вполне неплохо ревьювит, находит и логические ошибки, и утечки, иногда предлагает оптимизации. Да, какая-то часть тредов при проверке оказывается false positive. Все как у людей, собственно.
Не знаю, как у модели уровня последнего Opus можно получить вывод, подобный приведенному в статье. Может, это специально сделано? (: А если нет - поделитесь, пожалуйста, методикой работы с LLM.
“Play has no limits” прямо под текстом уведомления особенно иронично выглядит