Обновить
4
Тимур Умаров@4wards1

Пользователь

0,2
Рейтинг
Отправить сообщение

Очень актуальная статья, спасибо! Сколько времени у вас ушло на все описанные замеры (с учётом поднятия и настройки тестового стенда)?

Истории реальные, ок. Но текст написан отвратительно. Я бы даже сказал "блевотно". Ну неужели вы сами не видите, насколько ужасно ИИшка пишет тексты? Зачем вы продолжаете скармливать нормальные исходники тупым моделькам, которые превращают его в кашу из говна и палок?

Попытка высмеять оппонента, уводя диалог от фактов к абсурдным намёкам на паранойю - глупый детский приём. Применяется тогда, когда ответ по существу будет невыгоден.

Так всё-таки? С чего вдруг ваш "не-LLM" комментарий внезапно содержит что-то про Python, когда в изначальном диалоге ни слова о нём не было? Это ведь не кусок системного промпта или памяти вашего ИИ-агента, правда?

То есть вы утверждаете, что про Python не нейросеть нагаллюцинировала?

"т.к. у вас Python": а вот этого собеседник нигде не упоминал.

Слоп-комментаторы - это отдельный вид рака интернета. Выдавать сгенерированный LLM-мусор за свою собственную экспертизу - что за странная психическая девиация?

Это заявляли, по-моему, ещё для Opus 4.6

Поздравляю с переизобретением MCP, что тут ещё сказать.

https://en.wikipedia.org/wiki/Model_Context_Protocol

Но это же очевидный. Рваный. Нейрослоп. Без человечности. Без связности. Это не просто очевидно. Это просто набор типичных LLM-ных клише. Буквально каждое из них. Здесь. Но давайте начистоту: здесь нужно признать честно. Без отговорок.

Это очевидный нейрослоп, заметный невооружённым глазом.

Сейчас в CLAUDE.md только описание проекта, предметной области и правил сборки\запуска. Ни одной строки вида "пиши лаконично, излагай мысли последовательно, не повторяй разными словами то, что уже писал ранее".

А в Codex перепробовал 5-6 вариантов глобального personalization-промпта, с примерами "хорошо\плохо", и он всё равно даже после тюнинга был субъективно гораздо хуже, чем Claude из коробки.

Даже если удавалось добиться сокращения, то ответ становился неестественным и тяжело читаемым. То есть Codex сокращает текст не за счёт выбора более удачных формулировок и структуры текста, а за счёт грубого сжатия с потерей смысла. То есть такое "сокращение" никак не решает задачу "сделать ответы более комфортными для восприятия", а скорее наоборот.

Установлен. И в Personalization пробовал 5-6 вариантов ограничений с разной степенью детализации. В итоге Claude из коробки даёт более чёткие и лаконичные ответы, чем Codex с сотней строк вида "вот так отвечать можно, а так - нельзя".

У меня с точностью до наоборот. Claude гораздо лучше следует ограничениям, если они изложены чётко и недвусмысленно.

К тому же стилистика сообщений у Codex ужасная, он повторяет одну и ту же мысль многократно в разных формулировках, растягивая короткие ответы на десяток абзацев. При этом инструкции вида "излагай мысли последовательно, без повторов и не относящейся к заданному вопросу информации" он полностью игнорирует, продолжая лить воду в колоссальных объёмах. Мне физически неприятно читать такое.

Сколько раз на вашей памяти эти дряхлые обезьяны учитывали реалии, когда выпускали очередной "гениальный" законопроект или сборник рекомендаций?

Интересно увидеть, как на практике репозиторный слой держит границу транзакции. Выглядит сомнительно.

Вот банальный пример. Допустим, у вас есть юзкейс (в вашей классификации это второй "сервисный" слой). В нём необходимо выполнить регистрацию пользователя. Следовательно, это чтение из БД (проверка существования), затем запись в БД (свежий пользователь), а затем запись события в outbox (отдельная от пользователя таблица) и опционально запись события о регистрации для аудита (также отдельная таблица).

И если у вас транзакция держится на уровне UserRepository, то вам придётся пихать в репозиторий знания о том, что есть outbox и есть аудит. Это очень грязно.

По моему скромному опыту границы транзакций всё-таки определяются на уровне юзкейсов, а не на уровне репозиториев.

Markdown-файлов можно сделать несколько и связать их ссылками.

Безусловно, если хочется изобрести свой велосипед, то никто ни в силах помешать. Но преимущества этого велосипеда высосаны из пальца и не выдерживают критики.

Для IDE семейства IDEA давно существует "pycharm-index" и его близнецы. Решает ту же задачу, но через встроенные инструменты IDE. Найти всех наследников, объявления или использования класса\метода - моментально. Плюс умеет в умное переименование и перемещение, а также забирает результаты диагностики IDE, подхватывая ошибки синтаксиса, дублирование и прочее.

Зачем вводить тег, который будет нужен 1 раз в 5 лет?

С точностью до наоборот. Вы видели требования к джунам? А количество вакансий?

Порог входа вырос, а не снизился, потому что джуны, работающие на уровне LLM, больше не пользуются спросом.

А если вы под "входом в сферу" подразумеваете то, что теперь любители могут проще сваять для себя поделку, которой кроме этого любителя никто и никогда не воспользуется - так это подмена понятий. Давайте тогда говорить, что мультиварки снизили порог входа в ресторанную сферу, потому что теперь любители могут быстрее и проще готовить для себя шаблонные блюда.

Тема статьи была очень интересна. Но прочитав её до конца, я остался разочарован, так как ответа на вопрос из заголовка в ней нет. Вместо него - поток сознания на смежные темы, пусть и слегка причёсанный перед публикацией.

Не можно. Автор же прямо в первом абзаце описывает сценарий:

Иногда бывает нужно запустить рабочие программы так, чтобы отделить их от ОС (не устанавливать поверх системы, использовать другие библиотеки, сформировать portable пакет и т.д.).

Каждый раз полностью откатывать систему к начальному состоянию - нерационально. Контейнер-песочница куда проще и быстрее.

Какое-то костыльное переизобретение тестов получилось. Вот только тесты детерминированы, а "исполняемую спецификацию" агент может частично проигнорировать, если она сложна.

К тому же тесты можно запустить вручную и\или встроить в пайплайн CI\CD. А "исполняемую спецификацию" - нет.

Получилось изобретение ради изобретения, работающее хуже, чем нативные тесты.

Информация

В рейтинге
2 697-й
Зарегистрирован
Активность

Специализация

Бэкенд разработчик, Преподаватель
Средний
От 300 000 ₽
Python
ООП
Django
Flask
Nginx
Базы данных
PostgreSQL
REST
Git
Docker