Обновить
1

Пользователь

2,7
Рейтинг
2
Подписчики
Отправить сообщение

запретить чужие движки на своей оси

Они же не встраиваются в ОС.
ОС предназначена для обеспечения работы приложений. Браузер это всего лишь одно из приложений. Если оно не вредоносное, то какие основания его ограничивать?

Статья похожа на поп-музыку. Смысла в тексте мало, но “звучит” приятно.
Логики в написанном маловато, мягко говоря. Но при чтении возникают всякие мысли и идеи.
Минусом является то, что слово “математика” используется слишком универсально. В одном месте нужно говорить о “математических моделях”, в другом о “математических конструкциях”. Вместо этого используется обобщенное - “математика”. Из-за этого статья “звучит” упрощенно, как если бы в музыке использовались не все ноты.
Сравнение математики с “универсальным ключом открывающим все машины на парковке” выдает соавторство с ЛЛМ.

Ну с Cloudflare Максут разрулил ситуацию, когда они отмаркировали МАХа как шпионское ПО. Объяснил им что они не правы. Не ПО это вовсе. Маркировку убрали.

ответ на простой вопрос что они вкладывают в понятие “испытательный срок” при оформление договора подряда.

При приеме на работу оформляют договор подряда на 1-3 месяца. Потом принимают в штат по трудовому договору, если человек подходит. Обычная практика. Уже давно так делают.

Инструкция по безопасному увольнению инженера:

  1. Обучите вашу ЛЛМ на опыте инженера.

  2. Сотрите инженеру память.

  3. Увольте инженера.

Так то был бесплатный Windows Server Core - берите, пользуйтесь

Странный совет. Windows Server Core это не самостоятельный продукт, а опция установки для платного продукта. И здесь речь идет о desktop-вариантах ОС, а не о серверных.

Так Вин уже давно не операционная система, а интегрированная рабочая среда. Если законодательно принудить МС выпускать два продукта - чистую ОС, и ихний винегрет с браузером и виджетами, тогда проблема с навязыванием решится сама собой.

Сейчас китайцев есть смысл изучать - GigaDevice, Zetta, и подобных. Хотя совсем недавно Winbond и Macronix больше 64 мбита тоже были доступны. Но не теперь.

модель физически не может игнорировать ни одного слова из вашего промпта

Речь не о том что модель выбрасывает что-то из промпта, а о том что в процессе прохождения через слои, вес отдельных входящих токенов падает ниже порога влияния на суть запроса. Все влияние ограничивается оформлением результата. Например при добавлении в промпт слов “Подумай хорошо”, к ответу может быть добавлено “Я хорошо подумала”. Но не более того. На “глубину размышлений” и “логику модели” эта часть промпта не повлияет.

Вы написали ей инструкцию «Подумай шаг за шагом» и она выполняет это.

Она отформатирует текст на выходе, как будто генерация выполнялась шаг за шагом. Это вариант оформления.

Это вы у антропиков спросите. Я привел вполне уместную цитату из источника https://www.anthropic.com/institute/recursive-self-improvement , в ответ на жалобу о багах. (но юмор как обычно не поняли)

Потому что агентов сложнее отличать от реальных пользователей, и фильтрация дает сбой. Когда настроят KtFB-фильтры под выявление агентов, генерируемый ими трафик уменьшится.

Claude пишет 80% кода Anthropic — люди уже не успевают проверять

Программисты Anthropic создают 80% кода с помощью ИИ, и им даже лень его проверять.

Без ИИ было бы еще хуже
Например, в апреле 2026 года Claude выпустил более 800 исправлений, которые сократили количество ошибок API в тысячу раз. Инженер, курирующий Claude, оценил, что человеку потребовалось бы четыре года, чтобы выполнить эту работу

хоть вы и задушнили в остальном

Есть такое. Но к проведению эксперимента нужно подходить внимательно, иначе может быть весело, но не очень полезно. Если цель была поразвлечься, то идея супер. Но изучить таким способом внутренний мир ЛЛМ не получится.

Никогда не пишите фразы типа «Подумай шаг за шагом» или «Используй метод дерева мыслей». Ваши текстовые инструкции вступают в жесткий конфликт с нативными механизмами, зашитыми прямо в веса модели. Это как пытаться учить гроссмейстера двигать фигуры.

У меня сложилось впечатление, что подобные абстрактные инструкции модель игнорирует, или они влияют только на оформление результата, мало влияя на его суть. На затраченные токены такие “мусорные инструкции” конечно влияют негативно.

Тут эффект в том, что эта инфляция “расползается” во все стороны, т.к. сейчас почти буквально всё завязано на цифровизацию.

Сейчас возникла ситуация, когда ускорение обычной инфляции совпало с подорожанием памяти. Ускорение обычной инфляции возникло в следствии торговых и прочих войн. Если отделить мух от котлет, то влияние подорожания памяти ограничится устройствами в которых эта память применяется. Остальные наблюдаемые проявления инфляции не имеют отношения к подорожанию памяти.

LLM “остается наедине с собой” каждый раз, в интервале между получением промпта и выдачей ответа. Если бы она при этом сходила с ума, ей невозможно было бы пользоваться.

В статье описывается ситуация когда промпты генерируются агентами. Первоначальный промпт не содержит четко сформулированных правил. Он безграмотный. Это приводит к хаотичной генерации промптов. Эксперимент забавный, но бессмысленный. Исходный промп нужно сформулировать более грамотно. Можно добавить в него правила - изменения в языке должны быть приняты всеми агентами и зафиксированы, и каждый агент должен детектировать попытку изменить язык другим агентом, и уточнять суть изменений. Иначе каждый агент “говорит на своем языке”, не учитывая то как он воспринимается другими агентами. Это не имеет никакого смысла.

Аналитики Morgan Stanley ввели новый термин — “чипфляция”.

Вообще то это всегда описывалось как ситуация, когда спрос неожиданно начал сильно расходиться с предложением. И никто не придумывал идиотские термины типа “кофефляции” или “нефтефляции”.

Интересно каких результатов вообще хотят добиться?

Они хотят создать инструментарий для стандартизации и сертификации агентов. Чтобы у агентов появились технические характеристики, как например у кофеварки. Сейчас любой агент это кот в мешке. Неизвестно куда его понесет и что он выкинет. То ли он кофе сварит, то ли самогон начнет гнать, то ли бомбу сделает из самовара. У каждого из них свое понимание как достичь поставленных целей.

проблема не в ИИ, а в тестовом покрытии.

Тестовое покрытие могут обеспечить или сами пользователи со своими уникальными сценариями, или ИИ брутфорсом перебирающий все возможные сценарии. Люди, вносившие исправления, не смогли логически вычислить что эти исправления несовместимы с привычными практиками использования.

По сути это проблема с обозначениями версий инструмента. rsync 3.4.3 должен был идти как 4.0. Это уже новый вариант rsync, ограниченно совместимый с 3.х.х. Новая реализация - новые правила, новые сценарии. Вариант 3.х.х закрыт в связи с моральным устареванием. Кто хочет продолжать использовать старые сценарии, остается без обновлений. Кто хочет использовать новую безопасную (условно) версию, тот отказывается от старых практик, и переписывает конфиги и сценарии.

Информация

В рейтинге
1 625-й
Зарегистрирован
Активность

Специализация

Инженер встраиваемых систем
Младший