Pull to refresh

Comments 20

Самое интересное здесь даже не 1,9 человека из Google, а то, насколько ИИ изменил масштаб ошибки.

Раньше разработчик мог руками накосячить на одной странице и потом полчаса искать причину. Теперь агент за 10 секунд может идеально и последовательно сломать 300 страниц, после чего уверенно написать: «Готово, всё проверено».

По ощущениям, главная проблема AI-driven разработки сейчас не генерация кода и контента, а отсутствие нормального контура верификации. Агентам дали скорость уровня промышленного конвейера, а контроль качества пока остался примерно на уровне «открыл пару страниц — вроде работает».

И ещё очень показательно, что миллион слов, JSON-LD, FAQ и llms.txt проиграли обычной статье под реальный поисковый запрос. Похоже, старое доброе «сделай что-то реально нужное людям» пока оптимизируется лучше любого SEO для нейросетей :)

..и коммент написал ИИ. Т.е. с комментом даже соглашусь, тем более что гугл сам пишет про свои требования к контенту, и генеренка его, бедного, как‑то не устраивает. Типа вот написано и разжёвано.

Ну и да, мир меняется. Грабли теперь не в том, чтобы сделать «ещё 1000 страниц» — это как раз стало дешёво и технически просто. Гораздо сложнее понять, какие из тех страниц вообще кому‑то нужны, что реально получает показы и переходы, где текст хороший для живого читателя, и какие темы имеет смысл развивать на сайте дальше. Да и, если честно, даже непонятно, кому сайты нужны, когда ровно то же самое мы привыкаем спрашивать у ИИ.

На этом фоне особенно бесит, когда ишещь что‑то через гугл, и залетаешь на сайт — а там дорвей. Т.е. там для гугла не генеренка, там «контент для людей с привнесенной полезностью»!

главная проблема AI-driven разработки сейчас не генерация кода и контента, а отсутствие нормального контура верификации

Может быть потому что контур верификации не отделим от контура обследования и проектирования? Возможно, придёт к тому что роль аналитика и QA сольются.

Контур верификации ограничен сверху качеством обследования, аналитики.

Аналитик и QA могут остаться разными, если между ними есть общий артефакт/документация с оракулами проверки. Но артефакт переносит только явную часть. Поэтому в малых командах аналитик + QA вполне интересный вариант теперь

Вот да. Мой личный рекорд: агент нашёл 232 сломанных файла, героически починил, а потом выяснилось, что 228 из них он сам и сломал за пять минут до этого. Отчитался про оба подвига с одинаковой гордостью)

Контур верификации у меня был такой: я и фраза «проверь ещё раз». Масштабируется примерно как стирка руками.

А со статьёй под Вордстат вообще обидно. Месяц вылизывал JSON-LD, а выстрелила одна статья, которую написал за вечер. Мораль старая, только теперь за неё ещё и токенами платишь

Сайт получился классным, хоть я и не по искусству. Хм, вы правда решили создать википедию 2.0 Art Edition - с таким гигантом в плане SEO тягаться крайне сложно. Типа зачем идти к вам, если у вас и так инфа из вики?

Сайт целиком из нейрослопа - вот он, дивный новый интернет. Да и эта статья, впрочем, тоже.

Дизайн, конечно, типично нейросетевой. Для арт-сайта хочется чего-нибудь поизящнее.

Две картины на страницу мало. Я бы сделал что-то типа быстрого обзора из картин и минимальных сведений о них.

Стянутые с Википедии картинки и сгенерированные нейронкой описания с ошибками (что вы и признали). Может прозвучит грубо, но я надеюсь, что поисковики продолжат выдавать наверху результатов поиска Википедию и старые большие сайты про искусство, которые там лет пятнадцать сидят.

Открыл "Рождение Венеры". Страница открылась в тонне пустого места. Промотав полкилометра пустоты наверх, увидел разбросанный текст прямо поверх картины, из-за чего её вообще не видно.

На сайте реально 2000 страниц? Почему не в БД? Хотя можно не отвечать.

Потому что агентам проще работать с текстом.

Я как-то начинал делать CMS и прикрутил OpenAI compatible API для перевода страниц (через DeepSeek сам это делал). Потом оказалось, что проще просить агентов самим переводить тексты и адаптировать их под соответствующий язык, чем делать то же самое программно через API. Я переводил с русского на английский и испанский.

А потом вообще оказалось, что агентам дешевле работать с markdown, чем с html (внезапно!!). Я (вернее, агенты) прикрутил marked для конвертации md -> html. Сейчас доступны оба формата для страниц:

Сам подход с построением сайта - agent-first (llms.txt явялется аналогом sitemap.xml, но для агентов). Я вообще считаю, что проще дать адрес такого сайта своему агенту / модели и попросить их вкратце рассказать, что это и с чем едят. А уже потом с ними углубляться в детали этого сайта.

Мне вообще кажется, что "нейрослоп" изменит принципы индексации. Вот пример - https://mindstream.app.wiredgeese.com/?publication=905698 Эта же статья в пересказе нейронки и сопоставленная с вектором моих интересов (так я на неё и попал).

Сайт не видел, но судя по написанному, там мухи с котлетами смешаны, поэтому такие долгие правки и ИИ галлюцинации, он просто не может сосредоточиться на главном, на контенте.

Думаю это связанно с тем что, автор не программист и понимание принципа MVC улучшит положения.

а вы попробуйте посмотреть и потом выдавать ценное мнение)

так я же любя) вы молодец

К вопросу о том, почему гугл "плохо видит" - вы серьезно думаете, что гуглопоиск не умеет определять нейрослоп? Слопу - слопово... Слоповая статья на Хабре поможет примерно в той же пропорции (впрочем, здесь хотя бы промпт был, скорее всего, человеческим).

А сама задумка автора - не хорошая и не плохая. Как в любой отрасли - из тыщи попыток инноваций "выстреливает", в лучшем случае, одна-две, чаще меньше и сильно. Эта конкретная попытка, возможно, в топ 10 процентов, ибо автор что-то все-таки знает о предмете - и не пожалел своего времени на поиск ошибок. На что-то большее это вряд ли потянет: пересказать Википедию Гугл и сам может, да и всякие там авторские права на картинки, опять же, Гуглу доступнее. А автор заодно чуток узнал про программирование - уже польза какая-никакая. Вреда особого я не вижу, опять же, ибо Гугл слоп видит, да и многим пользователям без особой разницы. "А если не видно разницы, то..." - и далее по тексту.

Автору успехов! разок-другой шишек набьет - глядишь, чему и научится.

Ну для начала вопрос, а простую страницу карту сайта сделали?

А так проблем тут на вскидку:

Код тормозит вывод сайта, а гугл это не любит.

Куча внешних ссылок.

Мало текста, текст написан супер интеллектом, и он не о чем. Гугл уже год, больше такое понимает.

Гугл думает, что вы музей. А карты организации у него нет.

Ну и самое печальное доменная зона.

Почитал, позабавило.

Автор похоже съедал все возможные ошибки а архитектуре а потом удивляется что все работает через одно место или не работает.

Я бы предложил:

Если не хотите БД ( в смысле реляционную или NO SQL, так как «АИ с файлами работают лучше…» делайте классическую иерархическую БД, привязанную к каталогам.

Каталог картинки- в нем файлы с ID

Каталог статьи En

Каталог image to article - в нем ссылки матчем ID картинки и статьи на английском

Запускаем, проверяем что все работает.

Далее надо добавлять как каталоги с переводами.

Используем тот же ID что и в английской версии, тогда АИ может нормально матчить оригинальный текст и перевод.

Дальше можно добавлять переводы по мере необходимости, править и т.д.

Возможностей накосячить у АИ не будет, так как может лазить. Только по новым каталогам.

Потом пишем простой скрипт с помощью АИ который либо генерит статический сайт на любом языке, либо обеспечивает рендеринг по запросу. Хотя статика будет проще.

на мой взгляд, сайт страшненький - в пространстве размером с визитку уживаются (нет) три размера шрифта, четыре цвета, +жирный и подчеркнутый

в шапке рамочка на плашке, под ней гигантский баллон с рандомными текстами (не про текущую картину и не про текущего живописца) при этом место в разметке навсегда оставлено пустым

ткнул в художника - на его страничке громадная кнопка "назад к библиотеке" (я был в библиотеке? ) и "смотреть хронологию" - по второй открывается пронумерованный перечень бреда (цитата: Рождение образа Средневековый символ Возрождение Драма и театр взгляда Современность приходит в живопись Авангард и разрыв с традицией Идея важнее объекта Глобальная арт-среда) не связанного ни с полотном, ни с художником.

странные эпитеты (мастер текучей линии)

"удивительные факты" вложены трижды рамка в рамку и в каждой трижды написаны "факты"

это настолько УГ, прошу прощения, что публиковать стыдно.

на школьной олимпиаде дрочеров в скрипты - да, но не вне контура учебного заведения.

Не удаётся получить доступ к сайту...
вот и весь сказ

не здавайтесь)

фидбек

Зашел на сайт. Мона Лиза. Окей. Промотал ниже. Смотрю, есть эпохи искусства. Выделены "Все эпохи". Нажимаю следующий раздел - ренессанс. Ничего не меняется, только почему-то поменялся фон. Стало чуть темнее. Окей, нажимаю дальше. Барокко и Рококо. Нажимаю. Опять ничего не меняется, картины одинаковые, что Барокко, что Рококо. Окей, ну пойдем дальше. Модернизм почему-то точно так же совпал с авангардом. Постимпрессионизм совпал с символизмом. Почему? Непонятно. Ну ладно.

Такое количество проблем с разработкой сайта, по моему скромному мнению, связано с достаточно простой вещью: языковой агент делает ровно то, что его попросят. Вы попросили сделать страничку с картинами - он стал делать HTML-страничку. Потом попросили сделать больше страничек. Он стал делать больше. Вы стали добавлять новые разделы, он стал добавлять их во все странички. Вы стали добавлять какие-то фильтры, новые идеи, навигацию. И он стал вносить эти изменения в каждую страничку, и, естественно, раздувая до безумного размера контекст, путаясь во всех этих тысячах страниц, используя скрипты при обновлениях (те самые ошибочные исправления ошибок сотнями за раз), потому что контент не помещается в контекст, и так далее.

А если с самого начала объяснить свою идею агенту и предложить не начинать сразу креативить, а продумать как это будет работать, то можно абсолютно не знать никакие термины, не быть специалистом по архитектуре ПО и так далее. Агент сам это всё прекрасно разработает, напишет техническое задание, придумает оптимальный формат хранения данных, сделает шаблоны, форматы и прочее.

А для автора, может даже сделать отдельное десктопное приложение для работы с контентом, с обратной связью с агентом, галочками "перегенерировать", "проверить", отдельным разделом "оформление" и так далее.

Это вообще целый новый подход к разработке (думаю написать об этом статью).

Ну а в целом автор молодец, местами любопытно читать.

Sign up to leave a comment.

Articles