Бороться надо за качество статей, а не за отсутствие признаков использования LLM. В противном случае не останется авторов, которые захотят эти статьи писать.
Как автор, могу сказать - проблема в мотивации, как всегда.
Непонятно, зачем долго рождать статью, если она почти моментально забивается сиюминуткой и нейрослопом. Можно, конечно, считать, что авторы не умеют в маркетинг... но не везде же в Интернете имхо должны быть кошечки и "Новый ИИ - мы все умрём?" - где-то должно быть место под аналитику?
Пока нахожу выход в подписке на платных авторов, которые могут себе позволить авторское мнение. Но сам там пока не пишу.
Узнали контекст? Это жизнь большинства современных руководителей и предпринимателей. От тебя требуется, а тебе ничего не дают. Надо людей – ищи. Найдёшь неумелых – учи. Не хотят работать – воспитывай и перевоспитывай. Не хватает заказов – иди ищи, продавай. Не дают что-то смежники – придумай, как выпросить, сторговаться, спереть. Отстаёте от технологий – развивайтесь. Нет, денег не дадим – сами что-нибудь придумайте. Клиенты от вас ушли, заказы закончились – штош, затягивайте пояса потуже. Что-нибудь там придумайте, не до вас сейчас.
Это... имхо все-таки отличие предпринимателя от руководителя в том, что предприниматель может сам себе поставить задачу.
Нет кадров? Автоматизируем, или исключаем задачу, или аутсорс. Клиенты ушли? Переходим на экономный профиль, новое направление делаем.
И, самое главное - у предпринимателя большой потенциальный бонус за это.
А смысла в руководстве (т.е. быть менеджером среднего звена) без ресурсов я не вижу. Нужны такие руководители? Ищите, давайте ресурсы... ни один нормальный человек с самоуважением на такие должности не пойдет (имхо).
Отрицательные - стоимость (нужно будет вызовы делать)
Положительные - LLM имхо лучше трекают ситуативные спецтермины, нежели эвристики + это апргрейдабельно, кому нужно - используют тяжелые модели, чтобы лучше выделить. Универсально, опять же - не нужно думать, какой словарь подставить, какие эвристики, как потенциальную билингву разруливать; как с китайского/корейского переводить.
готовый словарь уже с переводом, ида он делается spacy+ частотники , а потом улетает в llm для перевода
А можете подсказать, на каком этапе он делается? Потому что я так понял по документации, что сразу же идет первый этап перевода (включая Fast mode), но не понял, когда делается словарь.
И да - не хотите сделать опциональное заполнение словаря через LLM вместо spacy?
Вопрос - я правильно понял, что словарь пока создается только через spacy и эмпириками и без перевода, а не через LLM с предположительными вариантами перевода? Второе было бы крайне удобно - чтобы сама сеть проанализировала на 0 проходе текст, и сформировала глоссарий. Потому что руками тяжко и долго.
Скорее всего нативно будет голосовой диалоговый интерфейс "в наушнике". Любой графический (и не только) интерфейс уже содержит в себе ограничения. Потому-что просто невозможно показать все, поэтому агент должен решить что показывать а что нет.
Практика показывает, что голосовой интерфейс а) медленнее (тяжело ждать полной озвучки вариантов), б) не очень приватный; не хочется разговаривать самому с собой в общественном месте.
Компания тратит миллионы на HR-бренд, рассказывает про ценности и заботу о людях, а потом на входе выдаёт кандидату анкету-дубль, тестовое на х часов и заканчивает всё молчанием.
А секрет - в KPI. Выполняется как KPI на продвижение бренда, так и KPI на "отсев" массы и выбора "идеального" кандидата.
Нууу, имхо здоровой автоматизации не нужны документы. Ей нужны отслеживания параметров - и это делается аналитикой.
Проблема начинается имхо когда на каждый чих начинают навешиваться юридически значимые документы - вот тогда да, бухгалтер и проч. вместо подсчетов начинает заниматься тем, как этот документ выглядит в глазах проверяющих, что работу как бы не упрощает.
если раньше пачки контрольных документов получали раз-два в день, то сейчас они льются нескончаемым потоком с очень короткими сроками исполнения
Ну, это же было ЧЬЕ-ТО решение - постоянно получать пачки контрольных документов. Может, задать этот вопрос тому, ЧЬЁ это решение было, а не воздевать руки к небу с вопросом "ну как же так получилось-то?".
Давайте так - цифровизация отдельно, решения начальства - отдельно.
Вместо этого бухгалтерия получила ... огромный объем отчетности, контроля и анализа, который при ручной обработке просто не имел бы экономического смысла.
Ужас в том, что он и сейчас в основном не имеет экономического смысла, а имеет смысл политический (до*** до копеек и деталей).
Если нужна аналитика по проводкам - идут к аналитику; или смотрят построенный отчет. Бухгалтер имхо, к сожалению, в основном занимается официально нужными бумагами (не факт, что кем-то используемыми), число которых с ростом автоматизации выросло многократно.
Кстати, боюсь, что результатом "инфляции качества ПО" станет тот же почти те же самые хрестоматийные "а давайте поиграемся со шрифтами / подвинем кнопку на 4px". ПО качественней особо не станет, но можно будет помучить подчиненных/контрагентов разными хотелками.
Впрочем, это лишь дополнение - идея "инфляции качества" мне нравится.
Честно, не очень понимаю восторга. У вас у самого была хорошая статья на Хабре "LLM не научились врать". Если вы работаете с текстом, вы работаете с теми же самыми ограничениями непонимания.
Если же у вас символьные вычисления, то либо вам надо сузить пространство до строго проверяемого (например, мат. теоремы), либо символьная система тупо не будет работать - несмотря на все долгие рассуждения про онтологии (просто онтологии были в свое время предметом моего проф. интереса). Рекомендую глянуть историю про проект Cyc, если вдруг не видели.
Системы символьного анализа строгие, но именно из-за этой строгости в подавляющем большинстве практических кейсов не применимы в целом, и требуют суровой ручной практической донастройки на кейс инженером/экспертом.
Когда я начал писать статью, дал запрос, какие современные представления о подростковой психологии? Потом дал психологический портрет дочери. И ИИ (Gemini 3.1 pro) выдал ответ - твой мануал это нудное чтиво на 100 страниц мелким почерком, для подростка с описанием, с клиповым мышлением, нужно изменить подачу материала! Дал обоснование.
Спасибо, очень ценное замечание - я действительно мысленно подумал "как бы это было приятно видеть мне", а не думал в терминах ЦА.
написано легко для понимания, а вот картинки мне не зашли)
Да, у меня похожее ощущение - большая часть картинок имхо просто фон, и, возможно, не стоят того. Но некоторые довольно к месту - например, про быстрые сахара, где график энергии - хорошо иллюстрируют.
и не только под гейм-сленг.
Гейм-сленг имхо как раз очень неплохое решение - выражаясь языком когнитивной лингвистики, это метафорическая система, понятная подросткам (ну, и мне тоже близка - я всё ещё норм в игры).
Кстати, еще из интересных элементов я видел такую штуку - https://paper2gal.com/ - превращение любых доков в короткую визуальную новеллу с вопросами на понимание (т.е. классическая реадаптация формата под пользователя). Тестировал на описании Бородинской битвы - имхо было на удивление неплохо. Думаю, куда бы прикрутить.
Спасибо за вашу работу, имхо, мануал очень годный, буду использовать как прототип, добавлять свои важные вещи.
Спасибо, очень годно; уже взял и распечатал. Для легкого увеличения веса: говорю как тоже ИТ-архитектор и в свое время педагог дополнительного образования, с несколькими дипломами у учеников :)
Конечно, увы, есть нейросетевая стилистика текста- вот эти обороты "X устроено так" в обычном случае, выражаясь вашими словами, мой антивирус бы не прошли - я как такие обороты вижу, сразу чувствую, что хотят продавить; но тут содержание перевешивает форму. И в целом, да - "лучшее враг хорошего" - у вас, наверное, был вариант "сделать так или сделать никак". Сделать хоть что-то - да, имхо лучше.
Насчет содержания - на мой взгляд, конечно, пропущены некоторые "топовые хакерские приемы", но, да, не всё идеально :)
/s в конце не забывайте, пожалуйста :)))) а то я специально зашел в ваши другие комментарии на всякий случай ПРОВЕРИТЬ, что вы человек :)
Как автор, могу сказать - проблема в мотивации, как всегда.
Непонятно, зачем долго рождать статью, если она почти моментально забивается сиюминуткой и нейрослопом. Можно, конечно, считать, что авторы не умеют в маркетинг... но не везде же в Интернете имхо должны быть кошечки и "Новый ИИ - мы все умрём?" - где-то должно быть место под аналитику?
Пока нахожу выход в подписке на платных авторов, которые могут себе позволить авторское мнение. Но сам там пока не пишу.
Имхо, отличная идея - пусть сами решают. Найм руководителя, умеющего что-то делать, на рынке от 1-2 месяцев и от 500К.
Это... имхо все-таки отличие предпринимателя от руководителя в том, что предприниматель может сам себе поставить задачу.
Нет кадров? Автоматизируем, или исключаем задачу, или аутсорс. Клиенты ушли? Переходим на экономный профиль, новое направление делаем.
И, самое главное - у предпринимателя большой потенциальный бонус за это.
А смысла в руководстве (т.е. быть менеджером среднего звена) без ресурсов я не вижу. Нужны такие руководители? Ищите, давайте ресурсы... ни один нормальный человек с самоуважением на такие должности не пойдет (имхо).
Это норм, понятно, есть утомление от проекта.
Мне привычнее делать через LLM; может потом либо ваш подход использую, либо свой допишу (и постараюсь PR сделать)
В любом случае - спасибо за работу, круто!
Это называется "эффективное освоение бюджета". /s
Отрицательные - стоимость (нужно будет вызовы делать)
Положительные - LLM имхо лучше трекают ситуативные спецтермины, нежели эвристики + это апргрейдабельно, кому нужно - используют тяжелые модели, чтобы лучше выделить. Универсально, опять же - не нужно думать, какой словарь подставить, какие эвристики, как потенциальную билингву разруливать; как с китайского/корейского переводить.
А можете подсказать, на каком этапе он делается? Потому что я так понял по документации, что сразу же идет первый этап перевода (включая Fast mode), но не понял, когда делается словарь.
И да - не хотите сделать опциональное заполнение словаря через LLM вместо spacy?
Посмотрел гитхаб; сам занимался переводами.
Вопрос - я правильно понял, что словарь пока создается только через spacy и эмпириками и без перевода, а не через LLM с предположительными вариантами перевода? Второе было бы крайне удобно - чтобы сама сеть проанализировала на 0 проходе текст, и сформировала глоссарий. Потому что руками тяжко и долго.
У меня это сделано на сайте так - посмотрите, может что пригодится.
Да, в некоторых случаях может быть удобно. Вывод вообще требует много места.
Практика показывает, что голосовой интерфейс а) медленнее (тяжело ждать полной озвучки вариантов), б) не очень приватный; не хочется разговаривать самому с собой в общественном месте.
А секрет - в KPI. Выполняется как KPI на продвижение бренда, так и KPI на "отсев" массы и выбора "идеального" кандидата.
— А бюджет?— Мы верим в тебя."
Нууу, имхо здоровой автоматизации не нужны документы. Ей нужны отслеживания параметров - и это делается аналитикой.
Проблема начинается имхо когда на каждый чих начинают навешиваться юридически значимые документы - вот тогда да, бухгалтер и проч. вместо подсчетов начинает заниматься тем, как этот документ выглядит в глазах проверяющих, что работу как бы не упрощает.
Ну, это же было ЧЬЕ-ТО решение - постоянно получать пачки контрольных документов. Может, задать этот вопрос тому, ЧЬЁ это решение было, а не воздевать руки к небу с вопросом "ну как же так получилось-то?".
Давайте так - цифровизация отдельно, решения начальства - отдельно.
Ужас в том, что он и сейчас в основном не имеет экономического смысла, а имеет смысл политический (до*** до копеек и деталей).
Если нужна аналитика по проводкам - идут к аналитику; или смотрят построенный отчет. Бухгалтер имхо, к сожалению, в основном занимается официально нужными бумагами (не факт, что кем-то используемыми), число которых с ростом автоматизации выросло многократно.
Кстати, боюсь, что результатом "инфляции качества ПО" станет тот же почти те же самые хрестоматийные "а давайте поиграемся со шрифтами / подвинем кнопку на 4px". ПО качественней особо не станет, но можно будет помучить подчиненных/контрагентов разными хотелками.
Впрочем, это лишь дополнение - идея "инфляции качества" мне нравится.
Честно, не очень понимаю восторга. У вас у самого была хорошая статья на Хабре "LLM не научились врать". Если вы работаете с текстом, вы работаете с теми же самыми ограничениями непонимания.
Если же у вас символьные вычисления, то либо вам надо сузить пространство до строго проверяемого (например, мат. теоремы), либо символьная система тупо не будет работать - несмотря на все долгие рассуждения про онтологии (просто онтологии были в свое время предметом моего проф. интереса). Рекомендую глянуть историю про проект Cyc, если вдруг не видели.
Системы символьного анализа строгие, но именно из-за этой строгости в подавляющем большинстве практических кейсов не применимы в целом, и требуют суровой ручной практической донастройки на кейс инженером/экспертом.
А можно вообще ***** всех, если не делают правильно. Не факт, что поможет, но ощущается как "управление сильных". /sarcasm
Спасибо, очень ценное замечание - я действительно мысленно подумал "как бы это было приятно видеть мне", а не думал в терминах ЦА.
Да, у меня похожее ощущение - большая часть картинок имхо просто фон, и, возможно, не стоят того. Но некоторые довольно к месту - например, про быстрые сахара, где график энергии - хорошо иллюстрируют.
Гейм-сленг имхо как раз очень неплохое решение - выражаясь языком когнитивной лингвистики, это метафорическая система, понятная подросткам (ну, и мне тоже близка - я всё ещё норм в игры).
Кстати, еще из интересных элементов я видел такую штуку - https://paper2gal.com/ - превращение любых доков в короткую визуальную новеллу с вопросами на понимание (т.е. классическая реадаптация формата под пользователя). Тестировал на описании Бородинской битвы - имхо было на удивление неплохо. Думаю, куда бы прикрутить.
Спасибо за вашу работу, имхо, мануал очень годный, буду использовать как прототип, добавлять свои важные вещи.
Спасибо, очень годно; уже взял и распечатал. Для легкого увеличения веса: говорю как тоже ИТ-архитектор и в свое время педагог дополнительного образования, с несколькими дипломами у учеников :)
Конечно, увы, есть нейросетевая стилистика текста- вот эти обороты "X устроено так" в обычном случае, выражаясь вашими словами, мой антивирус бы не прошли - я как такие обороты вижу, сразу чувствую, что хотят продавить; но тут содержание перевешивает форму. И в целом, да - "лучшее враг хорошего" - у вас, наверное, был вариант "сделать так или сделать никак". Сделать хоть что-то - да, имхо лучше.
Насчет содержания - на мой взгляд, конечно, пропущены некоторые "топовые хакерские приемы", но, да, не всё идеально :)