Обновить

ИИ превратит интернет в Вавилонскую Библиотеку (но хуже)

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели16K
Всего голосов 18: ↑17 и ↓1+21
Комментарии19

Комментарии 19

По факту я вижу другое.

Кривые, косые, с орфографическими ошибками тексты инфлюенсеры отдают ИИ и получется вполне читабельный и интересный материал.

Вместо копания в статьях Гугла, в 90% случаев я получаю от ИИ то, что мне нужно.

ИИ более интеллектуальный и честный собеседник, чем среднестатистический обыватель.

Сейчас главный тормоз достоверности информации - это человек. В отличие от ИИ у него есть злой умысел не писать правду.

бро не надо усреднять всех с собой. мне , моей бабуле и догу и еще нескольким миллионам человек не интересно читать слоп . и да я пользуюсь не аи поиском , а вместо туалетной бумаги использую бересту . ваш ход

Если сложить всё вместе, получается неприятная арифметика.

Ощущается флёр бексконечно ломающейся логики.

И какая-какая, говорите, этимология слова "порода"?! По вашим словам "порода" и "род" - не однокоренные. С источником этого лингвистического откровения хотелось бы ознакомиться ))

Порода.

Тихонов А. Н. Морфемно-орфографический словарь. — М. : Школа-Пресс, 1996.

Лично я, правда, нахожу это странным и по меньшей мере не бесспорным.

Понимаете, нужно использовать не школьные определения, а смотреть в этимологию. У слов "народ", "урожай", "порода", "зарождение" (и "порождение") - корень один: "род" как нечто generation, произошедшее, порождённое от чего-то. Т.е. у нас два уровня: 1. Школьный разбор существительных на приставку, корень, суффикс и окончание и 2. Лингвистический анализ происхождения слова (этимология). Так вот, с этимологической точки зрения - корень у этих слов один. А с позиции школьной училки... это какая училка попадётся.

Как-то так.

Я-то понимаю.
Чтобы посадить ИИ в лужу, стоило подобрать другой пример.

Ну, я по опыту общения с ИИ знаю, что с ним надо общаться не как с калькулятором, а как с соседом - который много чего знает, но и приврать не дурак. То есть переспрашивать, уточнять, ловить на противоречиях. В этом случае оно (нейросеть) даже вполне себе пригодно. С другой стороны, "для того, чтобы задать правильный вопрос, нужно знать большую часть ответа" - вот в чистом виде Ответчик из рассказа Шекли ))

Я иногда для развлечения спрашиваю у Джемини, где моя любимая. Она всякий раз принимается врать напропалую, с кучей красочных деталей. Не унимается даже тогда, когда я ей прямо тыкаю открытые источники, где дана такая информация.

Страшно не это, а то, что будет, если о чём-то таком её спросит кто-нибудь другой или я сам спрошу о чём-то, в чём не способен различить враньё. С другой стороны, спрашивать о чём-то, в чём не способен различить враньё, вообще не правильно, это в любом случае получишь только иллюзию истины, даже если отвечать будет честный и знающий человек.

Ха-ха, «народ». Я помню как классе в третьем пытался доказать кому-то, что в этом слове праиндоевропейский корень «-нара-», означающий «человек». Мне объяснили, что все проще, и этимология банальна – «род».

А ведь, держу пари, какой-нибудь льстивый gpt поддакивать бы начал) Надо проверить…

У слова «порода» корень пород, а не род

Чё, простите? А что означает слово "пород", которое по вашему является там корнем?

Когда надо что‑то узнать об инструменте или сервисе, мне хочется сначала посмотреть, что о них пишут другие люди

Понимаете, ли, голубчик, в чем дело: уровень среднего обывателя модели уже давно превзошли. В том числе по связности изложения. Если уж брать ваш пример, то "что пишут люди" разложится примерно на следующее:

  1. Холивар вокруг языка программирования, на котором написан сервис. Как будто мне, как пользователю, на это не насрать...

  2. Холивар вокруг "а нужен ли вообще сервис". Очень содержательно, да...

    1. Перечисление 100500 методов делать почти то же самое другим инструментом/сервисом (можно блины есть с лопаты, да)

    2. Обсуждение личностей тех, кто использует сервис vs тех, кто его не использует. С обязательным перекрестным приглашением матерей участников дискуссии на ночной сеанс в кино

  3. Холивар вокруг владельца сервиса в связке с его ценой. Невероятно ценная для меня как потребителя информация, что Вася считает 10$ большой суммой, а Андрей считает 1000$ маленькой.

  4. ...

  5. Обсуждение Гитлера, граммофона, гуттаперчевых мальчиков, гудрона, гидроизоляции, сравнительных достоинств свиного и говяжьего гуляша

И вот из этой горы говна я как потребитель пытаюсь вытащить информацию о сервисе/инструменте.

Ещё они опросили 879 контент‑маркетологов, и 87% признались, что ИИ так или иначе используют. Детектор не идеален, сами авторы это оговаривают.

А до эпохи ИИ сайты били полны полезной информации?

Ищешь хелп по какой нибудь команде Linux, поисковик выдает 100500 млн страниц, открываешь первую:

Баннер -картинка на 2/3 экрана, дальше растекания автора мыслью по древу - экранов так на 2-3 как минимум, где-то в середине запрятана строчка с примером который нужен.

Это ещё лучший вариант, некоторые специалисты видео на 30 минут генералитет где большая часть это авторское «А… ну вот вроде как …»

Теаепрь задаешь вопрос- получаешь ответ с примерами. Если текста много - говоришь - сократи - и все дела.

Про что-то что хоть как-то связано с товарами в продаже вообще искать невозможно стало: попробуйте погуглить про стандарты утепления/отопления домов . Вам выдадут кучу ссылок на конторы которые строят/продают и ни слова про то что вам надо.

Интернет убили копирайтеры задолго до АИ, АИ спас его- вернул текст и достаточно конкретный.

Проверить что пишут люди - нельзя так как все отзывы либо накручены либо только позитивные.

Ну, проблема ИИ в том, что он сейчас учится на текстах тех самых копирайтеров. Это даже не отравление данных, это нейтронная бомба ))

поисковик выдает 100500 млн страниц... Баннер -картинка на 2/3 экрана, дальше растекания автора мыслью по древу - экранов так на 2-3 как минимум, где-то в середине запрятана строчка с примером который нужен

Ну такие были правила игры. Не растекаешься на 2-3 экрана? Поисковик тебя не выдает. Вообще. И ты пытаешься выживать на прямых переходах постоянной аудитории. Такие ресурсы были, форумы назывались. Подскажите, где они сейчас?

...в которых собраны огромные объёмы написанных людьми текстов

Думаю, это временное. С учётом общего роста объёмов, в ближайшие несколько лет, они будут собирать то, что сами и сгенерили. Уж 50...70% это ж точно. 😒

иногда выдаёт правдоподобный, но неверный или бессмысленный ответ. Починить это трудно, потому что при обучении с подкреплением «на данный момент нет источника правды».

Што? А на кой тогда такое "подкрепление", если не на что опираться? Нет источника - не подкреплять. Чему нейросеть научим - тем они и ответят, в принципе как дети. Зачем же учить их на пустом слове, а потом удивляться - смотрите она нам наврали (сгаллюцинировали).

Я как разработчик наоборот вижу улучшение ситуации. Раньше для решения каких-то проблем нужно было искать информацию, как правило, google выходил либо на stack overflow, либо на статьи medium, либо на официальную доку. И то и то имело свои недостатки:

  1. Не всегда проблема была точно как у меня.

  2. Решения неточные, написаны на коленке

  3. Официальная документация часта скупая и недостаточная

Сейчас ответы под вопрос по коду попадают гораздо лучше сразу от Gemini.

А вне программирования ранее хватало Википедии в 80% случаев. У нее примерно те же недостатки как Вы пишите в статье, тольке текста больше чем в ответе гугловского ИИ.

Самое забавное что сама математическая суть обучения ИИ и есть - поиск осмысленных книг в Вавилонской Библиотеке. При условии что “близкие” книги стоят рядом (условие “близости” - это отдельный вопрос)

Т.е. (утрированно!) все пространство входных-выходных векторов - и есть та самая “библиотека”. Для нейросети “помечают” те “книги” которые считаются осмысленными. И нейросеть в процессе обучения старается выстроть принцип размещения “осмысленных книг”. И затем её используют чтобы найти ещё не помеченные “осмысленные книги” по этой системе.

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации