Обновить
73

Техножрец

1,6
Рейтинг
49
Подписчики
Отправить сообщение

Прикидочный расчёт даёт пять-десять извлекаемых ватт на квадратный метр с поверхности открытой воды. В тоже время солнечная панель даёт сотню ватт с того же квадратного метра. Работать будет, но выгода сомнительна.

Ну и физическое обоснование у вас, конечно, полный отстой.

Я вот не сторонник этой spec-first технологии. Прежде чем писать спеку надо проверить гипотезу а для этого надо накостылять прототип. И спека там скорее мешает, чем помогает

Спецификация - она как комментарий. Нужна только там, где код не документирует себя сам

А еще надо завести для агента его собственную доску и совсем конфетка получается. Этап планирования модифицируется до нарезки карточек, исполнение становится гораздо более контролируемым. Благодаря коментариям агент прекрасно умеет вспоминать, что он делал неделю назад и вообще, начинает шарить за общее направление разработки. Но у агента/агентов должна быть именно что своя отдельная доска. Человеческую они засрут.

Ну разумеется, рефакторить надо умышленно. Программирование агентами немыслимо без постоянного рефакторинга.

Но они почти не уменьшают сложность самой системы.

Это ошибка. Они великолепно уменьшают сложность системы

Этот никто довольно умён, чтобы закрывать разрыв, но архитектурное видение у него пока хромает.

Надо сказать, проблема с тем, что по одним и тем же спекам можно написать две очень разные программы - не новая. Программист - существо даже менее детерминированное, чем LLM. Раньше это как-то считалось нормальным. Ныне спохватились

Спеки именно как заменитель исходного кода не особенно то работают. Дьявол кроется в деталях, которые спеки не покрывают. Ну, или мы пока не знаем, как эти спеки правильно писать

Учитывая, что это была 32х битная либа от шестнадцатого года, которую за десять лет не удосужились актуализировать - сомневаюсь, что производителю это интересно

Мы тут на днях скачали либу для управления режимами компортов с сайта производителя промкомпьютеров. Кодекс её дизасемблировал и выяснил, что в ней ошибка. Значения регистров для одного из портов неправильно выставлялись. Написали свою.

Ну, кроме шуток, я выкинул парочку матбиблиотек и библиотек структур данныз потому что нейронка нормально пишет прикладуху по месту.

Таки да. Тут решение в том, что агента просто не пускают на прод. Это стратегия. Но она означает, что работать будут люди. А инженерная задача в том, чтобы работал агент и работал максимально безопасно. У присутствия агента на проде есть неоспоримые преимущества, но это требует компромисных решений, выстраивания системы защиты от дурака нацеленной на агента.

Это пока. А потом вы захотите длинные траектории и вам придётся или отключать защиту вообще, или поручать контроль классической программе, которая не умеет в сложный синтаксис, чем сильно прибивает автономность... или поручать проверку llm-ке. Ну или отказаться от длинных траекторий

Статья несколько принижает. 11 токенов в секунду - это вполне приемлимо для беседы. И даже для простых агентских операций.

Медлительно, конечно, но вполне юзабельно

С чего бы дискриминатор вообще видел какой-то код. У него есть только список правил, запрос, поле для выноса решения и поле для обоснования, почему решение такое. Он больше ничего видеть не должен.

Инженеры не создают абсолютно надёжных систем. Мы снижаем вероятность отказа, а не устраняем его возможность.

Проблема в том, что человек через некоторое время нач6ёт механически апрувить всё, что прислал ИИ. Я ниже писал, что нужен второй агент. Потому что второй агент (который всегда с нулевым контекстом) всегда на стрёме в отличие от человека. Человек на апруве - это театр безопасности, а не безопасность. (Но людям не не нравится ^^. Минусують )

Поэтому и пишу, что "в том числе". Тут, очевидно, главная дыра - непроверенное api, которое слишком много позволяет. Но пользователя с пустым ником проверка запроса вполне могла и обязана была поймать (если я правильно понял, что у них произошло).

Ну, а вы протестируйте гварда, чтобы он валидные запросы пропускал. А отказ не фатален. Первый агент скорректирует своё поведение

Да, если это снижает вероятность ошибки. Но врядли мы можем придумать для третьего более строгие правила, чем для второго, так что работать не будет. А вот дискриминатор снижает вероятность ошибки кратно

1
23 ...

Информация

В рейтинге
1 881-й
Зарегистрирован
Активность