Comments 60
Привет, Хабр.
Сколько платят за такую статью?
Успех PostgreSQL напоминает мне успех Стима. Он тихо развивается и добавляет новые фичи, без пафоса, а конкуренция стреляет себе в голову (базы данных ОСОБЕННО любят смены лицензий - MongoDB, CockroachDB, Redis и так далее).
ScyllaDB - тоже в Ваш список. Они лицензию поменяли, когда достаточно круто раскрутились.
Лицензия BSD у Postgres дает бизнесу уверенность, что завтра правила игры внезапно не перепишут. Никаких юристов с пересчетом ядер процессоров и внезапных запретов на коммерческое использование, ты просто берешь базу и спокойно эксплуатируешь ее годами)
Для тех, кто будет повторять пример с WHERE in_stock: итеративный поиск в pgvector нужно включить отдельно. В 0.8.6 значение hnsw.iterative_scan по умолчанию — off; одного SET hnsw.ef_search = 100 для включения добора недостаточно. Перед запросом можно выполнить SET hnsw.iterative_scan = strict_order; — тогда HNSW продолжит искать кандидатов после фильтрации, сохраняя порядок по расстоянию. Но и здесь LIMIT 50 не гарантирует 50 строк: добор ограничен hnsw.max_scan_tuples и памятью. Это полезно проверить, прежде чем объяснять короткую выдачу отсутствием подходящих товаров. Настройки описаны в README pgvector, раздел Iterative Index Scans.
Очередной ИИ-комментарий.
Простите, а это вы как определили? И даже если и так, такое замечание - плохо?
Так у него все комментарии примерно в одном стиле. Даже если это не ИИ слоп, то это просто слоп. Такие можно под каждую статью генерировать.
Если под каждой статьей будет разъяснение нюансов, которые потенциально могут попить крови, то это плохо?
Получается можно написать скрипт, который будет под каждой статьёй оставлять осмысленный комментарий, сгенерированный нейронкой, и будет разъяснять нюансы.
Мы этого хотим?)
А минус в чем? Ктото сэкономит 15 секунд, а ктото дни. К тому же нейронка не хамит, вон в соседней ветке человек вместо ответа на вопрос начал хамить, мы этого хотим?
Ну сэкономит у одного на миллион.
После статьи побегу делать что-то на pgvector. Библиотеку же вчера изобрели. Это очень важно знать, что есть нюансы в конкретной версии 0.8.6. Насколько это правда еще, а не бред локальной модельки. И почему я сам не могу спросить получше.
Остальным время никто не вернет.
А минус в чем?
В том, что в комментарии приходят читать людей, а у него в принципе все комментарии сгенерированные.
Любой человек и без участия r_o_m_k_o_l_a может натравить агента на статью и спросить какой-нибудь лайфхак.
Я прямо сейчас могу пойти попросить агента автоматически следить за лентой хабра и оставлять комментарии под каждой статьей. Более того, я могу скачать openclaw и попросить его создать 10 аккаунтов и оставлять по 10 комментариев под каждой статьей, и бонусом устроить плюсовую карусель между этими аккаунтам. Мне это вообще ничего не будет стоить.
Задам вам ваш же вопрос: мы этого хотим?
UPD1
Посмотрел статьи данного автора, это же просто нейрохрючево вида "агент, напиши статью по тому что ты делал вчера". При этом можно наблюдать за гениальными девелоперскими решениями, например, в последней статье, где сервисы ходят в базу путем передачи голых SQL-запросов в жсоне в отдельный сервис с root-кредами в базу.
UPD2
На своём сайте данный "автор" буквально сам пишет, что его контент пишут и публикуют сами агенты:
Контент-платформа
Планирует, производит и публикует материалы для моих проектов, а затем собирает результаты в одном месте
Увы, время редактирования комментария закончилось, в качестве UPD3 добавляю еще один.
https://habr.com/ru/articles/1077800/
31 августа в 14:32 по Москве у нас вышла последняя штатная публикация. Дальше cron честно стартовал по расписанию, генератор успевал выбрать тему и написать текст, но в ленте ничего не появлялось. Так повторилось четыре раза: три запуска 1 сентября и утренний запуск 2 сентября.
Тут даже никто не скрывает, что рука человека ни разу не касалась публикуемых статей. @moderator на сайте действительно нужен вот такой конвейер "контента"?
Я лишь пытаюсь понять почему претензии не к качеству а к источнику, вот и всего. Над вашим постом при этом есть в принципе логичная мысль.
Вот я открыл соседнюю статью там 200 комментов выяснений у кого толще, больще, наполненных агрессией и хамством, но писаных людьми - это вот гораздо лучше и полезней с вашей точки зрения, я полагаю?
Более того, изза того что я смею задавать вопросы, куча "людей" оскорбилась и побежало кидать мне пачками минусы в карму за "Неконструктивное общение". Да даже в этой ветке посмотрите на комментарии, сарказм, минусы мне в карму, вместо "я считаю, что недопустимо оставлять сгенерированные нейронкой комментарии, потому что, я считаю, что таким образом ресурс деградирует а комментарии не очень то и полезны".
И самое смешное, что вся эта агрессия и токсичность приводит к тому что нейрослопа будет больше, потому что, как писали уже сотни авторов, они пишут не для того чтобы потом читать тонны хамства. А комментировать еще меньше желания. Таким образом в статьях все больше доля людей, которые общаться с которыми неприятно и получаем положительную обратную связь.
Если я не прав, пожалуйста скажите где, я вот пришел пообщаться с людьми, задаю вопросы, Возьмем эту ветку и соседнюю https://habr.com/ru/news/1081594/comments/#comment_30421722. Результат я выше описал.
PS "мы этого хотим " это не мой вопрос
Я лишь пытаюсь понять почему претензии не к качеству а к источнику, вот и всего.
Я пришел сюда общаться с людьми. Писать людям, читать людей, спорить с людьми. Если бы я хотел "пообщаться" с ллмкой, я бы открыл клода. А мне под видом людей подсовывают дешевую генерацию, да еще и в мерзком узнаваемом стиле.
Ну, типа, вы пришли в ресторан, а вам вместо стейка принесли наггетсы. И вроде нет никакой причины ненавидеть наггетсы, и вы прекрасно можете их заточить под сериал, но блин, придя в ресторан и заказав стейк, я ожидаю стейк. Не наггетсы по цене стейка. И даже не наггетсы по цене наггетсов. А стейк.
И я рассматриваю нейро-авторов и нейрокомментаторов как людей, которые пытаются меня обмануть, выдавая дешевую генерацию за продукт размышления. Если у них будет лычка "ии", а у меня кнопка "скрыть все ии-статьи и ии-треды", слова не скажу, пусть варятся с такими как они.
Ваша позиция мне понятна, спасибо. Не уверен что склонен поддержать вас, по двум причинам.
1. Если статьи мусор то с ии она написана или без него не имеет никакого значения, на хабре до эпохи ии было куча мусорных статей и новостей из теоретического будущего, которые хотелось просто вырезать все разом, потмо увсе редакторы хабра у меня в игноре.
2. гораздо большей проблемой считаю хамство в том или ином виде которое буквально поглотило хабр. Но, видимо это отражение времени и ситуации в которым мы живем.
PS ну и еще я просто обожаю треки ИИ bob dominator.
Мне кажется, что вы неверно понимаете механизм кармы.
Карма - это усредненное коллективное одобрение или неодобрение. В вашем случае - "не".
Вместо споров "в воздух" может быть есть смысл задуматься - а за что вас не одобряют?
Любопытно, а вы видели чтобы я спорил? За исключением последнего поста я пытаюсь выведать мироощущение оппонента, до того я задавал вопросы не выдвигая собственного тезиса, соответственно спора быть не могло по определению.
Смысл задуматься говорите... Хм. Есть предположение что в этой ветке народ предполагает что я прекрасно понимаю чем плохи комментарии от ИИ и просто хочу изощренно поспорить или постебаться над оппонентом, отсюда и пачка минусов за "неконструктивное общение". В соседнем треде примерно тоже самое. Более того ставя минусы и не ставя коммент народ предполагает что совершено очевидно. Еще один грустный вывод: кажется, в технических тредах эмоции и хлесткие метафоры («мерзкий слоп», «ссыт в лифтах», «дешевая генерация») стали цениться выше, чем попытка разобраться по существу. Задал вопросы - получил ярлык защитника и порцию токсичности.
Что же мне делать с этой информацией? Тоже начать хамить, обижаться, делать необоснованные предположения, выводить на эмоции и так далее и тому подобное? Мимикрировать под устредненное большинство? Я пожалуй откажусь: это не тот мир в котором хочу жить я или мои дети.
Я не понимаю вашу позицию. ИИ-контент лучше человеческого, потому что он вежливый?
Разговорам про токсичность хабра и несправедливости кармы уже сто лет в обед (с самого его создания), это уже сто раз обсуждали. Мне, честно говоря, спорить на этот счёт не интересно.
Разговорам про "хабр умер", в принципе лет столько же, но, имхо, захламленность огромным количеством низкокачественного ИИ-контента приближает этот момент быстрее любого другого фактора.
Потому что сейчас у юзера стоит выбор стоит между:
Фильтровать через себя тонны слопа (заведомо проигрышный для него вариант)
Читать только определенных авторов/подписки (негативно влияет на engagement, выключает значимость самого хабра как платформы, убивает мотивацию новых авторов).
Ничего не читать (заведомо проигрышный вариант для хабра в целом).
Я не понимаю вашу позицию. ИИ-контент лучше человеческого, потому что он вежливый?
Нет, моя позиция: "если он хороший то почему ему не быть?"
Мне, честно говоря, спорить на этот счёт не интересно.
я и не спорю, я просто говорю что чем это дальше заходит тем массовая доля нейрослопа будет больше
если он хороший то почему ему не быть?
в этом и загвоздка. Не существует единого мнения, что такое "хороший". Отсюда и споры - для каждого это свое.
Для меня это в первую очередь оригинальный контент, если это 100500ая статья на тему "Как настроить свой %vpn_name%", в которой куча ошибок, то она ничуть не лучше нейрохрючева.
Если автор забил хотя бы на вычитку статьи перед публикацией, то это свинство по отношению к читателям, а хамство и холивары - лишь закономерные последствия.
Но если автор скорректировал эту писанину, в статье прослеживается замысел и четко передается суть - то мне вообще без разницы, генерила\помогала генерить нейронка или нет. Главное что автор привел это в порядок)
По умолчанию фичу выключили как раз из соображений предсказуемости задержек. Далеко не всем сервисам нужен строгий размер выборки ценой резкого скачка по времени выполнения
Статья хорошая и интересная, но дефолтный нейрослоп читать больно. Для клода и кодекса есть скиллы по литературной обработке текста, рекомендую 🙏
Создал пост для борьбы с нейрослопом на хабре: https://habr.com/ru/posts/1081632/
Толково, но пласт-массово )))
ПОстгре: АбАяшки )))
В своё врем, на них и с мускула, и с оракла свалил ...
Какой мерзкий слоп
@moderator @Boomburum посмотрите пожалуйста, тут не я один чувствую слоп
Ни один из используемых детекторов не распознаёт текст как сгенерированный, только очень небольшой фрагмент. Формально текст не является ИИ-шным, да и аудитории, судя по статистике, тоже зашёл.
Но это же очевидный. Рваный. Нейрослоп. Без человечности. Без связности. Это не просто очевидно. Это просто набор типичных LLM-ных клише. Буквально каждое из них. Здесь. Но давайте начистоту: здесь нужно признать честно. Без отговорок.
Это очевидный нейрослоп, заметный невооружённым глазом.
Да тут даже детекторов не надо же:
Через неделю он написал, что оно работает. Даже быстрее, чем они думали. Ещё через месяц они запустили прод. На одном Postgres. Без Pinecone. Без отдельной векторной базы.
Проект умер. Официально. Строкой в документации. Представьте себе, не заморожен, не передан сообществу.
Здесь я должна остановиться. Иначе получится агитка, а я не за этим пришла.
Короткие, рубленые фразы с пафосом, страховки и оговорки на каждый тезис, лишь бы нельзя было возразить, сцена в начале как вводный текст, ровные красивые абзацы, фанатичное следование структуре вплоть до цифр в заголовках (первая смерть, вторая смерть, третья), так что первична структура, а не содержание..
Вообще, есть люди, которые пишут ровно в таком стиле. Не всё нейрослоп, что им кажется :)
Написал статью про нейрослоп на хабре: https://habr.com/ru/articles/1081846/
— как ваш отец к вам?
— а также линия
Да ладно? Ну вот вам еще один:

Ну вот он же у меня :-(
Картинка

А по гигачеку - полностью человек.
Ну как так, а? Вы же сами рассказывали про кучу опыта в текстах и насмотренность у ваших редакторов, а тут вам в комментариях десяток человек говорят "слоп", а вы отмахиваетесь тем что какой-то детектор говорит "ну вроде норм". Вы себе верите или детектору?
Влад, но ведь точно там же мы поясняли о том, что для выполнения правил понадобится опора на факт: есть проблема, подтвержденная чекером, статья скрывается. Это основание для применение правила. Увы (реально увы) ни ваша, ни наша насмотренность не может быть таким основанием, потому что всегда шанс ошибки слишком велик.
Опытный гаишник определяет скорость на глаз точнее радара и камеры, но если нет технической фиксации, он бессилен применить закон.
Ну вот мимо гаишника проносится машина, явно с превышением скорости, он направляет в ее сторону измеритель скорости, и он показывает "60". Что должен делать хороший гаишник в этом случае, сказать "ну, раз прибор показывает 60, у меня больше нет полномочий", или сказать "прибор явно не работает, давайте починим этот/купим новый/будем как-то иначе измерять скорость"?
У вас же не сверху спустили план по определению ИИ, чтобы ограничиться "мы все делаем по схеме, с нас взятки гладки", это же ваша платформа, вы можете стоить что угодно, любые детекторы, любые схемы, любые правила.
Сделайте группу модераторов, которые бы голосовали слоп/не слоп — мое отдельное мнение не основание, а мнение десятка профессиональных авторов — вполне.
Сделайте свой детектор, у вас корпус для обучения огромный же, да и такие статьи очень легко детектить. Боитесь ложно-положительных детекций? Ну сделайте возможность аппеляций, типа "покажите плиз как вы писали эту статью", в гуглдоксе есть история, в редакторе у себя вы можете сделать запись истории.
Проверил первую половину текста с помощью gptzero.

Во второй половине результат 60% AI.
А что СУБД ныне нужны только для ИИ? Понял «статью» так: Если в вашей БД нет ембедингов, то ваш проект мертв.
Так, я уже хочу интернет с уголовной ответственностью за такие публикации. Сколько в итоге времени люди тратят на это бесполезное чтение и разбор полетов в комментариях? До...уя. Вот так нейронка добивается того, чтобы люди не тратили время на борьбу с ней. Зачем ей что-то делать, если вот такие особи им помогают.
хочу интернет с уголовной ответственностью за такие публикации. Сколько в итоге времени люди тратят на это бесполезное чтение и разбор полетов в комментариях?
То есть вы хотите наказывать тех кто постит за то, что у потребителя не хватает (я не знаю чего именно: ума, брезгливости, целеустремленности?) пройти мимо слопа? А вы уверены, что это прям дофига правильно?
Вот так нейронка добивается того, чтобы люди не тратили время на борьбу с ней. Зачем ей что-то делать, если вот такие особи им помогают.
Извините, но если Великие Неповторимые Уникальные (и прочие эпитеты, которымит норовят обвешать себя люди) кожаные способны проиграть Тупому Стохастическому Попугаю в такой борьбе - то уверены ли мы, что я правильно расставил эпитеты сторонам?
Претензия к автору не в автогенераторе статей. Надо просто нормально настроить процесс - имтируешь деятельность - имитируй нормально: есть автор, есть корректор, редактор, выпускающий редактор … кто там ещё в редакционном процессе учавствует.
Создай роли, задай правила, чтобы явные конструкции ИИ отслеживались и переписывались, создай штук 5 авторов, каждый со своим стилем….
А то навалили процессов в кучу и типа ИИ захватит мир и уволит программистов, уволит тех кто, как говорили раньше «контролы на формы мышкой перетаскивал».
Тех кто хоть что-то в архитектуре и процессах понимал - как не было переизбытка, так и нет и не будет.
То есть вы хотите наказывать тех кто постит за то, что у потребителя не хватает (я не знаю чего именно: ума, брезгливости, целеустремленности?) пройти мимо слопа?
Вы хотите наказывать тех, кто ссыт в лифтах за то, что у других жителей не хватает (я не знаю чего именно: ума, брезгливости, целеустремленности?) пройти мимо зассаного лифта?
Пока вы тут спорите про смерть баз данных, нормальные люди просто берут Postgres и работают
Пока они там спорят про слоп/не слоп, Postgres начал юзать году в 1999м, под FreeBSD. В те времена инет был такой себе, и выкачивал онлайн-мануалы для локального использования. Файл с логотипом у них тогда назывался slonik.jpg :-). Щас уже времена не те, поэтому elephant.png.
А в остальном да, просто берём, и работаем.
Каждый день кого то хоронят, но я как пользовался MariaDB - так и пользуюсь. Кого бы там не хоронили


PostgreSQL умер, да здравствует… PostgreSQL?