Pull to refresh
73
Игорь@lexore

Infrastructure Engineer

13
Subscribers
Send message

Нет инструментов, позволяющих определить/повысить/как-то работать с уровнем доверия от LLM.

Я наблюдаю, что сейчас в отношении LLM люди разделились на два лагеря:

  • Да он же ничего не умеет!

  • Вау, как классно он работает!

Разница между ними - знание инструментов вокруг LLM. Дело в том, что LLM сам по себе - это отличный, но ограниченный инструмент. Но с его ограничениями уже научились справляться - просто сейчас эти ограниченные возможности расширяются и усиляются за счет других инструментов. Каких инструментов, конкретно? - спросите вы. А я и отвечу:

  • Плагины superpowers и CE (compound engineering). Они содержат инструкции к LLM, которые заставляют нейросеть разрабатывать новые фичи по четко установленным правилам. Туда входит и "задать вопросы сначала", и "написать спек", и "провести ревью", и "запускать тесты". Один superpowers уже творит чудеса.

  • harness - обвязка, которая дает возможность LLM запускать тулы (claude code, codex, opencode, pi, кучи их).

  • скиллы - набор инструкций и скриптов, которые позволяют LLM более предсказуемо выполнять операции.

  • ratchet - храповик. "Храповик (храповой механизм, трещотка) — это зубчатое устройство, которое пропускает движение в одну сторону и блокирует его в обратную" - Google. В LLM это концепция, не позволяющая LLM ошибаться дважды. Каждый раз, когда LLM допускает ошибку (например, неверно определяет поля в таблице БД), это записывается в постоянной памяти. В следующий запуск LLM будет помнить, что "так делать не надо".

  • агенты/субагенты - во первых, это ускорение за счет того, что задача делится на таски, которые выполняются параллельно (но с учетом зависимостей). Во вторых, это создание разных ролей - один агент пишет, а второй ревьювит. Причем, у них нет единого контекста. Ревьювер не имеет доступа к контексту того, кто пишет код. У него могут быть свои, строгие инструкции в стиле "не допускай переусложненного кода".

  • хуки в обвязке - на каждое действие LLM можно поставить хук, который проверит "а не фигню ли LLM делает".

  • тупо другая LLM, как ревьювер - GPT отлично ловит недочеты Claude, Claude отлично находит слабые места в коде от GPT.

  • Self-review и self-improve - это уже более серьезный уровень. Нейросеть анализирует написанный код и замечания, делает выводы о том, что можно улучшить в следующий раз, и сразу правит контекст/память/скиллы.

Такие инструменты позволяют "держать LLM в узде". С одной стороны, понижается количество типичных ошибок. Одни и те же ошибки перестают происходить. С другой стороны, повышается качество и предсказуемость работы модели.

Многие из этих инструментов или концепций появились в 2026 году. Сфера "работа с ИИ" сейчас развивается взрывными темпами. С одной стороны, появляется куча инструментов, решающих проблемы "глупых LLM". С другой стороны, сами LLM становятся умнее. Нам остается только "держать руку на пульсе" - следить за новостями, находить рабочие решения и применять их.

Суть статьи одной строкой:

В наше время никому нельзя доверять. Мне - можно.

Ди Мино изучает классическую историю и языки с 18 лет, читает про письмо А семь лет, дважды ездил на Крит

Если это самоучка, страшно представить, какой там послужной список у выпускников вузов! Так, глядишь и Рукопись_Войнича переведут.

Еще один подход - просто сказать нейросети "посмотри в наших документах". И пусть сама ходит, ищет, анализирует. Конечно, если это "посмотри" настроено. Но сейчас для этого есть все: и MCP, и скиллы с API, и даже интеграция с браузером.

А почему бы просто не озвучить вилку? Тем более, если человек - ведущий проекты и знающий рынок, и может оценить стоимость соискателя. Можно даже сказать индивидуальную вилку "на глаз", для этого конкретного кандидата.

На самом деле, это риторический вопрос. Конечно же, у вас есть причины, по которым вы не озвучиваете вилку. Вы о них знаете. Но, похоже, вы не осведомлены о причинах, по которым кандидат не озвучивает прошлую ЗП.

Позвольте указать на них. Если человек работает за 100к, а на собеседовании попросит 300к, то сразу возникнут вопросы к его аппетитам и, возможно даже, к его адекватности. Ведь найм - это очень часто переманивание. Человека пытаются переманить и предлагают +15-20%. Суть в том, что 100к+15% - это все равно меньше, чем 300к. Но у некоторых HR'ов или нанимающих менеджеров (допустим, не у вас) все равно может возникнуть идея "зажрался". Хотя может быть указанный случай - тот самый случай, когда 300к - это адекватная зп, а кандидату просто очень сильно недоплачивали на прошлом месте работы. Но это еще пойди докажи.

Получается, что информация о прошлой ЗП может понизить новую ЗП. А вот повысить она её может вряд ли. Выходит, это игра в одни ворота. Так вот, чтобы не играть в игру "продай себя" на повышенной сложности, проще не говорить ЗП с прошлой работы.

Вам бы, с вашими талантами (учитывая количество статей в профиле) работать где-нибудь в StarLink Маска. Там очень нужны люди, которые понимают, как строить mesh сети.

Вот именно. Этим оператором является владелец этой Wi-Fi сети. То есть, если ваш клиент сделает публичную сеть на базе вашего оборудования, он еще и тут подставляется. Вы, конечно, можете сказать, что вы к этому не имеете отношения напрямую. Здесь ваши действия можно расценить, как "подстрекательство" (побуждение, склонение или призыв другого человека к совершению вредных, недозволенных или преступных действий).

Если бы этот автомат мог так задушевно общаться, как Брендон, он мог бы наторговать в плюс просто за счет консультаций.

С юридической точки зрения мы этот вопрос проработали максимально подробно. Юристы говорят что если нет возмездной составляющей в оказании таких услуг то делится интернетом можно.

Очень сомнительно, что этот вопрос был хоть как-то проработан с юридической токи зрения. В случае предоставления услуг связи, нет понятия "в складчину". Есть лицо, которое заключило договор с провайдером. Это одно лицо. Если это лицо раздает интернет дальше за деньги, то это безусловно возмездное оказание услуг связи. В этом случае, каждый ваш клиент нарушает как договор с провайдером, так и законы. А вы - организатор этих нарушений и преступлений. Почему? Потому что приходите к людям и склоняете их к этому.

По сути это как если бы вы организовали публичную wi-fi сеть.

А это, кстати, еще хуже. По ФЗ-97 от 05.05.2014 и связанным постановлениям, для публичных Wi-Fi сетей обязательна идентификация пользователей, с фиксацией ФИО и MAC-адреса устройства. А еще оператор этой сети обязан хранить данные о том, кто подключался. не менее 6–12 месяцев.

Т.е., теперь будет два перегруженных контекстных меню

Не пристало Арагорну переживать из-за минусов ботов-однодневок

Оказывается, это не оно.

Вижу скриншот с телефона в качестве ответа.

Оказывается, это https://www.catalysis-science.com/

Наука о катализе и химическая инженерия. В такой области я, не то что маргиналам, я бы не всякому ученому дал бы вещать. А то потом мы получаем "совершенно безопасные" вещества, которые запрещают через 10 лет.

Простите, а что такое КэтСай?

В файловом реестре можно получить некоторую версионность, если делать подпапки с версиями: tool/v1, tool/v2 и т.д.

1
23 ...

Information

Rating
4,887-th
Registered
Activity

Specialization

DevOps-инженер, Инженер по доступности сервисов