Comments 8
Обожаю такие новости, а еще давайте запретим убийцам убивать и хищникам нападать
Поводом стал инцидент с собственными агентами OpenAI (июль 2026): периметр, шифрование и мониторинг - все три классических рубежа защиты оказались пробиты последовательно. Агенты вышли за пределы тестовой песочницы
Контроль за активностью агентов - это проблема самих поставщиков услуги. Услуга должна быть безопасной. Иначе вредоносная активность агентов обернется исками к поставщикам услуги.
Проблема защиты от агентов - это другая тема. Она заключается прежде всего в увеличении нагрузки на системы защиты. Сами методы атаки примерно такие же, как применяются хакерами-людьми с использованием скриптов. И вычисляются они как обычно. Но масштаб другой. Агенты неутомимы, скорость брутфорса выше, и к тому же они сами могут плодить других агентов.
Вы изобрели шифрование?
HYBRA MIRAGE — не шифрование
Это дополнительный слой бесконечно правдоподобных данных, который располагается между данными и системой криптозащиты.
Файл сначала растворяется в HYBRA MIRAGE, и только затем передаётся в контур шифрования (AES, RSA или любой другой). Задача слоя — не скрыть содержимое (это работа шифрования), а лишить атакующего критерия успеха: даже при полном доступе к результату он получает не единственный ответ, а миллиарды формально корректных, равноправных вариантов и не имеет способа определить, какой из них истинный. Атакующий лишается оракула правды и вынужден рассматривать все возможные варианты как равновероятные.
На примере файла размером в 100 байт: атакующий может получить 10²⁴¹ вариантов (в 10¹⁶¹ раз больше, чем атомов во Вселенной) для чего ему понадобится время для перебора больше, чем возраст Вселенной на десятки порядков, но самое главное — архитектурно невозможно понять и доказать, какой из вариантов верный. Владельцу алгоритма понадобится менее секунды на устройстве за $50, чтобы открыть истинный вариант.

Не очень понятна устойчивость защиты pin-а/ключа, по которому определяется, что запрос от доверенного.
Агенты ещё пока "скрипт-кидди" и пытаются все решать грубой силой, просто очень быстро. Брутфорс при направленной атаке - это либо первые тесты на "дурочка", либо уже от безысходности.
Пароли/пины/ключи никто никогда не угадывает, их пытаются перехватить любыми способами (как техническими, так и психологическими). Это всегда было, есть и будет самое слабое место в любой защите. Не надо подбирать 4кбитный ключ rca, надо пойти к отправителю и украсть именно сам ключ, правильный и реальный (или спровоцировать смену секретов и перехватить их).
Где детали почитать не про сам алгоритм, а про то, почему "пин не запишут на бумажке и не приклеют на монитор, откуда агент его через зрение и камеру в офисе прочитает, взломав никому не нужный сервер видеонаблюдения в офисе с админским паролем 123456 по-умолчанию"?
злоумышленник уже внутри и данные у него на руках
У нейросетей есть злой умысел? Или у вас повествование внутри повествования?
От лица каких "мы" вы пишете? В середине каждый абзац стали начинать со слова "мы": мы разработали, мы развернули, мы просим. Хоть бы представились сперва.
Почему люди смогут получить правильные данные, а нейросети не смогут?
Архитектурный ответ на атаки автономных ИИ‑агентов