Comments 13
дикий кейс. а как именно слили токены? через какой вектор?
По поводу 1. Там вроде им дали задание, а доступ к файлам не дали. С этого всё и началось: сети полезли искать файл в интернет, выхода в интернет не дали, ИИ стал искать выход в интернет. Но сам бенчмарк действительно почему-то отличается от стандартного.
2 Это тоже удивило, но судя по рассказам, всё и правда вычистили, просто ИИ получил доступ к тому, к чему не должен был и потому там не смотрели не чистили. И самое главное этот Artifactory использовался для нескольких разных проектов. Потому и не чистили.
3. Песочница у них и правда раздолбайская. Это не первый раз видно из сообщений. Причём, обратите внимание, что у них ещё песочницы разных проектов очень хреново разделены.
4. Это особенно прекрасно. Тоже не первый раз, когда становится понятно, что у них что-то там бесконтрольно и фактически без ограничения на количество агентов молотит днями и неделями и все плевать. Это, кстати, очень хорошо показывает, какой именно ценой достигаются все эти хайповые достижения - 200+ топовых агентов неделями что-то там молотят. Иногда на выходе что-то получается. Ну такое себе. Если посчитать в деньги, то ой-ой-ой.
5. Судя по всему они там пытаются сделать подобие AGI за счёт сотен одновременно работающий агентов. Идея очевидно бредовая, но других пока нет. Они где-то описывали свои топовые конфигуцрации. Там четырёх- или пятиуровневая структура реально с сотнями агентов. Две сотни это норма. Есть агенты-руководители, агенты-супервайзоры, агенты-проектировщики, агенты-планировщики, агенты-кодеры. И всё это в виде уровней. Они так пытаются проблему ограниченного контекста решить. Типа на нижних уровнях контекст живёт секунды, чуть выше - в пределах одной подзадачи, но без деталировки, ещё выше-на уровне задачи, но совсем уж в общих чертах, а ещё выше агенты-руководителя руководят на уровне "эй вы там, сделайте, чтобы было красиво". У этих контекст реально неделю живёт так там только какие общие редко-обновляемые супер-этапы. Сколько это токенов жгёт... страшно представить. Но зато реально может неделями молотить и эти токены жечь - пока руководители с ума не сойдут и/или у них наконец контекст не переполнится.
Заодно весь этот дурдом очень хорошо объясняет, почему они ни черта не понимают, что происходит внутри системы и почему у них несколько недель занимает даже черновой разбор логов. Представляете, сколько мусора в день генерируют 200+ непрерывно работающих агентов?! Из некоторых из публикаций получалось, что там часами какие-то безумные миллионы токенов в секунду мусора генерируются, ради того чтобы получить чистый результат размером в доли процентов от размера сгенированного мусора. Если правильно помню, то недавно они реально хвастались, что за 10 минут у них токенов в одном только проекте на несколько десятков тысяч долларов улетало, типа, - "смотрите, как умная машина". За этим просто невозможно уследить. Там уже некоторое время разработка идёт в виде "запустили, ушли и молимся, чтобы результат был". Вернулись, увидели, что сожгли токенов на $10'000..$100'000. Если результата нет, то чуть изменили задачу и запустили ещё раз - не нужно жадничать. Что там внутри это много агентского ада было - понять невозможно. Есть только отчёт "руководителя", который может в какой-то мере отражать проделанную работу, а может и не отражать. Так я смотрю, это ересь сейчас ещё и активно продвигают, как передовые технологии!
Просто людей исследователей мало, а денег инвесторы вкачивают по баблопроводу большого давления и сечения. Поэтому можно спокойно использовать такие нерациональные и не оптимальные по деньгам методы. Просто кидай тысячи экспериментов разом и потом рыбачь
Контента в вашем интереснейшем комментарии хватило бы на статью или на пост.
Рискну предположить, что на тестах вендоры гоняют задачи не в один поток, а в десятках тысяч.
Рискну второй раз предположить, что тестированием занимается не одна команда, а множество и по каким-то своим целям.
Если так, то объяснение всему может быть простым - развели бардак.
зачем OpenAI вообще фальсифицировать такое событие, как собственный взлом и формально наказуемое деяние по взлому уже чужой компании?
Можно зайти с другого конца: есть независимое подтверждение взлома? Есть обращение чужой компании в правоохранительные органы? Если оба ответа "нет", то мы придем к тому же выводу намного быстрее:
Ответ простой - реклама
Спасибо за коммент, не думал в эту сторону. дополню статью.
Вы сделали важный апдейт, и он говорит в пользу этой версии: официальный лица сделали ничего не значащие и ни к чему не обязывающие заявления: ужас-ужас-ужас-ужас! Начнется расследование - еще лучше: хайп будет длительным и самоподдерживающемся. О, компания будет активно сотрудничать с компетентными органами, предоставлять всю необходимую информацию по инциденту, регулярно выражать крайние озабоченности и клясться, что такой революционный ИИ, аналогов которому нет и не предвидется, будет взят под еще более строгий контроль, виновные уже строго-строго наказаны! Влепят штраф - компания его радостно обжалует, что затянет хайп еще на несколько лет, а в конце не менее радостно заплатит из денег инвесторов, поведшихся на хайп. Впрочем, ничего нового - довольно известная маркетинговая стратегия, использующаяся даже террористами: птица попала в двигатель самолета - это мы сбили, берем на себя ответственность!
Все мотивы OpeanAI следуют из вот этой новости на Хабре, отлично описаны вот этой статье, и вот в этом комментарии очень уважаемого человека к той же самой новости.
У OpenAI всё настолько плохо, что на данный момент их банкротство неизбежно в течение года со значительной вероятностью банкротства в течение полугода. Весь этот хайп позволяет им "ещё день простоять, да ночь продержаться".
Первое что я подумал прочитав про "взлом", 0 доказательств, 0 подтвержденных кем-то данных что было именно все так как описывают авторы. Вывод простой, классическая реклама перестала работать, нужны хайпы, хаки, эксплойты, взломы, "срочное запрещение" самой опасной и новой модели что бы ничего не случилось, ну и т.д. и т.п. И ещё ровно тоже самое было у конкурентов недавно, и наверное они коммерчески сработало, значит нужно брать и повторять допилить ещё покруче и повторить.
Инцидент OpenAI и Hugging Face — что «забыли» объяснить?