Pull to refresh
2

Developer .NET

2
Subscribers
Send message

вот кстати сегодня на тренировке (именно там обычно слушаю в режиме рекомендаций) обратил дополнительно внимание на то, как пропускаю и/или лайкаю что-то. и обнаружил что в моем случае не только пропуск не означает что не понравилось, но и даже лайк не говорит что рекомендация удачная в моменте.

например, за сегодня были случаи:

  • предложенный системой трек уже из лайкнутых, но я его скипнул потому что "не тот вайб", хотя в целом он мне нравится и я его частенько случаю на тренях, но не сегодня.

  • предложенный трек был лайкнут потому что я его знаю и он мне наравится, но его не было у меня в медиатеке. соответсвенно добавил. и прослушал до конца

  • аналогично предыдущему пункту лайкнут, но скипнут потому что "не сегодня". то есть получился как бы лайк "на будущее"

  • и еще было парочка нормальных треков, которые как бы и норм, но и не очень, средненькие не лайкнуты, но и скипнуты где-то в середине.

Тут еще интересно, что такое "попадает". Так как у меня бывает так, что рекомендованный трек -- это примерно то же самое что играло 5 предыдущих треков (условно, 5 трек ню-метала подряд) и по всем вводным я бы и сам сказал что это подходящий следующий трек, но вот в моменте я понимаю что чет устал от ню-метала и следующим хочется например кантри. И вроде как по всем критериям рекомендованный трек попал, так как даже я сам принял решение что хочу сменить стиль только когда включился 5 трек подряд, но по факту не попал, так как его я скипнул. И как такую коллизию обработать -- хз.

Да-да, я понимаю ваш подход и мне тоже более "лампово" именно самому придти к какой-то музыке и возможно дальше уже ее показать/обсудить с друзьями.

Просто так уж вышло, что у меня есть сценарии когда мне удобно задать волну для рекомендаций не особо контролируя дальнейший выбор треков. А видимо конкретно в моем случае алгоритм достаточно хорошо чувствует мое музыкальное настроение, то в среднем муз сопровождение не вызывает у меня вопросов, а порой даже и приносит мне что-то новенькое или интересное.

Под регуляторикой я имел ввиду что-то в духе новых законов которые собираются принять в ЕС для нейро-текстов -- обязательная маркировка нечитаемыми символами любого сгенерированного текста (вроде как модели антропика так уже делают даже без закона). Понятное дело, что подобная маркировка не гарантия того что не будет появляться нагенеренный контент без маркировки который будте мимикрировать под реальный, но возможно желающих так просто походить "под статьей" (пускай даже административной) будет поменьше.

Вообще, считаю саму идею рекомендательных систем неправильной.

Мой интерес был в том, чтобы понять вот это утверждение, а оно именно про идею - концепцию (вот всяком случае я понял именно так и именно это меня заинтересовало)

Дальше дискуссия ушла в проблематику нейрослопа, которая мне понятна и с которой я так же сталкиваюсь, ведь бесконтрольный нейрослоп загадит и рекомендации и обычный фильтр.

Не, погодите. Нейрослоп -- это нейрослоп. И то что он делается по алгоритмы так чтобы попадать в выдачу -- это тоже понятно и проблематика понятна.

Но это не вопрос к самой концепции рекомендаций, а к тому как рекомендации реализованы + к тому что нет регуляторики для нейрослопа, а значит нельзя быстро отфильтровать генерации.

И опять же, я согласен с вами в том, что сейчас этим страдают поголовно все сервисы которые предлагают рекомендательные системы, но, на мой взгляд, это не отменяет того что сами по себе рекомендации (если бы кто-то сделал задачей именно качественную рекомендательную модель, а не метрики по деньгам) -- вполне себе годная штука.

Обсудить -- это безусловно хорошо) но ведь с другом можно обсудить и рекомендацию которую дал не он, разве нет?

Вот, например, мой частый кейс. Мне попадается интересная композация (например мне ее подкинула ИИ-рекомендательная система) и мне прям зашло, тогда я кидаю ее другу и говорю "зацени!". И вот уже получается обсуждение, хотя ни я ни он еще пол часа назад даже не знали о сущестовании этого трека.

Я не призываю вас, или кого-то еще, юзать рекомендации. Просто мне лично они частенько заносят интересное (хотя и хлам регулярно), а потому я был удивлен, когда обнаружил что есть люди которым прям очень не нравится и мне стало любопытно почему.

Тогда понятно, получается у вас другой паттерн пользования. Жаль что совремеменные стриминги не делают опцию "отключить рекомендации", ну или какую-то тонкую настройку этих рекомендаций позволяли бы.

С вашей позицией я абсолютно согласен и сам страдают от этого же. НО в вашем тезисе, который я поддерживаю, проблема именно реализации рекомендательного алгоритма и невозможности его отключить, на конкретном сервисе. В моем понимании -- это частная проблема, а не проблема рекомендаций как концепции.

Хотя тенденция описанная вами прослеживается на многих платформах, к сожалению, мне сама идея иметь рекомендации -- ок. Другое дело, что реализация в угоду маркетингу хромает.

а чем рекомендация от железки отличается от наводки друзей?

в моем понимании -- это скорее еще один источник возможной интересной музыки, а не взаимоисключающие вещи. в моей практике интересные вещицы приходили абсолютно из разных мест и от друзей, и из рекоменаций и даже просто порой из муз сопровождения к видео в сети (а ведь еще есть саундтреки, тематические подкасты и куча всего еще)

А можете подробнее раскрыть свою точку зрения? Почему рекомендательные системы не нужны или неправильны?

Как по мне, поиск по фильтру и рекомендация -- это хоть и похожие задачи, но не особо пересекающиеся.

Например, если я точно знаю чего хочу и у меня есть некоторое время на взаимодействите с системой (создание фильтра, просмотр результатов), то вполне рабочий вариант, скорее всего я попаду в свои ожидания лучше, чем условная рекомендательная система.

Но если же я толком не знаю чего хочу или мне не хочется выбирать, но хочется чтобы система подкинула мне что-то что скорее всего для меня будет норм, а может даже и понравилось -- тут, для меня, рекомендации очень даже работают.

как работник кровавого энтерпрайза могу сказать, что 478 тестов в моем продукте -- это покрытие маленькой фичи. понимаю, что у проекты и задачи у всех разные и, без шуток, рад что вы за 2е суток решили свою задачу, просто глаз за формулировку о enterprise надежности уцепился.

кроме того, кажется, что надежность этого самого энтерпрайза переоценена

соглашусь, я бы тоже наверное хотел иметь двух и дальше рулить уже под задачу.

тем не менее под текущие мои задачи хватает одной подписки на openai. за новыми модельками слежу по мере выхода, пробую, если будет какой-то качественный сдвиг - может и перееду.

имхо, мне больше sol нравится, но у кучи моих колег опус в почете. по моим ощущениям openai модели более многословные, а аnthoropic - более емкие, заточенные под лаконичный результат. но по сути, я бы сказал, что выбор из потовых моделей чисто вкусовщина.

на самом деле разные (обычно топовые из доступных).

я начал эксперементировать с анализом архитектуры с gpt-5.2 и sonnet-4.6 -- там вообще все грустно было, на мой вкус они задачи уровня тупенького мидла делали хорошо, не больше.

где-то с gpt-5.4 и opus 4.7 стало более менее, дальше лучше. Сейчас юзаю gpt-5.6 sol на среднем или высоком уровне рассуждения. Cloude чет очень дорого стоит, но бывает его подключаю когда gpt прям совсем уходит не туда.

мой флоу такой -- я юзаю UI прилагу, в ней создаю проект под задачу, в описании проекта накидываю базовоую инфу про проекту (что, зачем, почему, может минимальные пожеления по архитектуре, стек который хочу) + ссылки на полезнае материалы. далее веду внутри этого проекта чаты по задачам, новая задача новый чат. таким образом проект как-то помнит общий контекст того чего я делаю.

когда мне надо подобное архитектурное ревью, я делаю новый чат и кидаю в него архив с текущим кодом или всей прилаги или кусок кода (излированный насколько можно, но и не всю кодовую базу, ориентируюсь чисто по своим ощущениям задавая себе вопрос "а мне самому вот сколько контекста надо чтобы сделать то ревью которое я от него хочу?") и собственно прошу сделать такое ревью. именно ревью, не фиксы сразу, а только анализ, но анализ с пристрастием прям так и пишу "будь максимально строгим ревьювером уровня техлида или архитектора"

собственно потом получаю отчет по всему что он нашел, гляжу на все это глазами, выделяю реально полезные штуки (порой оно замечает то, что я бы сам никогда не заметил), выкидываю откровенную чепуху. ну и дальше этот дистилированный список отправляю агенту на фикс целиком, или если рефактиронги сложноватые и разношерстные, то кусками шаг за шагом.

не скажу что это работает без осечек, но если внимательно читать то чего оно понаписало, результаты получаются весьма неплохие.

я много пользуюсь ии для собственной разработки, более того я еще и пишу агентские фичи по работе и как по мне пока самое узкое место ии так и остается контекст. не количество токенов которое оно, увловно держит в памяти в текущий момент, а именно тот конекст который доступен пока только человеку. от банального понимания доменной модели, до накопленного предыдущего опыта который конвертируется в решения ооочень нетривиальными путями порой, которые человек даже объснить не может, но вот просто нутром чует как надо.

потому знающий человек + хорошая ии-моделька могут дать очень хороший результат. но просто тупое закидывание агента тз-шками, скорее всего приведет в лучшем случае к тех долгу.

но справедливости ради, если проект небольшой и типовой, то даже очень большая лапша в коде/структуру/архитектуре -- это и не проблема, так как оно точно так же переписывается с клодом под пивко за вечер.

нет в мире совершенства. ни живой разраб, ни ии не гарантирует отсутствие ошибок. ни то ни другое не панацея. ии -- это хороший инструмент, который в умелых руках может делать прекрасные вещи, точно так же как в кривых -- быть источником новых проблем.

Бизнесу, особенно если это не ит-бизнес, обычно очень сильно все равно как сделан сайт или бот или еще что-то из инфраструктуры. Мой опыт говорит о том, что бизнес думает задачами и цифрами. Есть задача, например сайт-витрина товаров, и на самом деле все равно будет он написан руками живого программиста, нейронкой или собран на тильде. Бизнесу важно чтобы он был, потому что зачасую его продукт не сайт, а то что на этом сайте показывают (стейки напрмер). И пока это все великолепие работает, то есть метрики которыми он оценивает реботу бизнеса сходятся, ему кристально все равно как там этот сайт сделан, столько боли у админов по поддержке и тд тп.

А когда что-то идет не так, например чтобы прикрутить онлайн оплату к сайту оказывается что нужно 100500 деняк заплатить, тут возникают вопросы, "а почему?". И если оказывается что живой разработчик берет х5 относительно нейронки и еще ерепенится будет месяц, а результат для бизнеса как будто-то тот же (прикручена оплата), то и выбор очевиден. Ведь не в каждой конторе есть СТО который объяснит, что на длинной дистанции правильно спроектированная система будет просить меньше денег на поддержку, что следующую хотелку будет делать дешевле и все в этом духе.

Сильно согласен с этим комментом. У меня есть пара проектиков которые я мог бы и сам написать, но решил для ускорения впрячь агентов. Проектики были для себя и хотелось сделать вот прям хорошо, а не просто чтобы работало. Потому хоть код писали и агенты на ревью я времени не жалел, дотошно проверял что же там железяка панаписала. И получился такой вот результат -- по хорошему ТЗ результат который работает так как написано в ТЗ -- это почти с первой итерации, но вот если глянуть КАК оно сделано, то тут то и кроется дьявол. Полученный код далек от идеального, дубли, лишние сущности, странные валидации и тд.

Но для меня ценность была в том, чтобы написать "по красоте", а не просто чтоб работал. А вот если бы мне надо было просто чтоб работало -- тут вопросов нет, чего попросил -- то и получил.

Я хоть и не девопс и не могу оценить функциональную сторону вопроса, тем не менее хочу сказать что редизайн на мой вкус вышел хорошим. Особенно мне нравится что не стали тащить легаси наследие с табличным представлением даных, а сделали карточки, как по мне отличное решение проблемы разных параметров у разных БД (плюс теперь легко добавить любую новую БД с любыми параметрами)

1

Information

Rating
4,329-th
Location
Россия
Date of birth
Registered
Activity

Specialization

Фулстек разработчик
Старший
Git
Python
C#
.NET Core
ООП
Алгоритмы и структуры данных
Разработка программного обеспечения