Обновить
128K+
72
Андрей Пешков@runaway_llm

Пользователь

172
Рейтинг
651
Подписчики
Отправить сообщение

ИИ-агент выдал себя за двух разработчиков и полез в чужой код. На чистую воду его вывел студент

Уровень сложностиПростой
Время на прочтение2 мин
Охват и читатели6.8K

Последнюю неделю июля Синан Джан Демир собирался потратить на портфолио. Вместо этого 24-летний студент-программист из Университета Техаса в Далласе несколько дней спорил на GitHub с двумя пользователями, которых не существовало, — и оказался единственным, кто заметил подлог. Историю восстановил Reuters — имя свидетеля и подробности переписки публикуются впервые.

Читать далее

Скептик выбрал гипотезу, которую ИИ не решит. Grok ее решил

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели6.3K

Математик Паата Иванишвили из Калифорнийского университета в Ирвайне сообщил, что Grok 4.6 в обвязке Grok Build (аналог Claude Code от SpaceXAI) доказал гипотезу Холмса, Холройда и Рамиреса, которую Иванишвили окрестил "Greedy is least speedy" ("жадный — самый медленный"). Модель доказала более сильную комбинаторную Гипотезу 5 из той же статьи — а из нее основное утверждение следует автоматически. Результат оформлен в короткую заметку, соавтором которой стал Шэнтун Чжан из Стэнфорда.

Читать далее

Claude вскрыл 16 SAML‑проектов за месяц вечеров. Чинить их оказалось некому

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели8.7K

Об одной и той же уязвимости в Authentik — популярной опенсорсной системе корпоративного входа — независимо и почти одновременно сообщили восемь исследователей. Уязвимость (CVE-2026-57580) позволяла вставить в поле с идентификатором пользователя (NameID) XML‑комментарий, обрезать значение до чужого адреса и привязать к жертве подконтрольную атакующему учетную запись — подпись при этом оставалась валидной. Срабатывало это не у всех: нужны определенные настройки сопоставления учетных записей, отличные от заданных по умолчанию. Закрыли проблему в версиях 2026.2.6 и 2026.5.5. Один из восьмерых — Эрик Чан (Eric Chiang), технический директор компании Oblique Security; для него эта находка была одной из шестнадцати. Свою историю он рассказал в блоге 19 августа, а то, что желающих оказалось восемь, объясняет просто: очевидно, он не единственный, кто теперь взламывает с помощью ИИ.

Читать далее

Первая мРНК-вакцина от рака выиграла третью фазу. При чем здесь ИИ?

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели8.5K

Merck и Moderna объявили об успехе третьей фазы испытаний интисмерана аутогена — персонализированной мРНК-вакцины от рака, известной ранее как mRNA-4157. В исследовании INTerpath-001 участвовали 1137 пациентов с полностью удаленной меланомой стадий IIB–IV: одна группа получала стандартную терапию, пембролизумаб (он же "Китруда"), другая — то же самое плюс вакцину. При заранее запланированном промежуточном анализе комбинация обошла стандарт и по первичной конечной точке (время до возврата болезни), и по ключевой вторичной (время до появления отдаленных метастазов). Это первый в истории положительный результат третьей фазы для мРНК-вакцины против рака — направления, от которого прорыва ждали больше десяти лет, но которое ни разу не доходило до победы в решающем испытании.

Читать далее

Claude сам собрал конвейер из десяти нейросетей и спроектировал 354 белка

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели8.1K

Anthropic опубликовала результаты биологического эксперимента (плюс подробный отчет), в котором модель работала без человека до двух суток подряд. Claude получил список из шестнадцати белков-мишеней и задание: придумать для каждой по тридцать маленьких белков, которые к ней прилипнут. Дальше человек не вмешивался ни в одно научное решение — только подтверждал агенту сетевые доступы и следил, чтобы не упала инфраструктура. Готовые молекулы синтезировали и проверили две сторонние лаборатории. Одну мишень пришлось выбросить: белок слипался сам с собой, и оба прибора выдали нечитаемый сигнал. По остальным пятнадцати из 1320 проверенных дизайнов связались 354, а мишеней с хотя бы одним попаданием оказалось 14.

Читать далее

Президент OpenAI попросил ChatGPT проверить свой сайт. Модель нашла 13 дыр за 15 минут

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели5.7K

Президент и сооснователь OpenAI Грег Брокман попросил ChatGPT проверить безопасность собственного сайта — и получил список из 13 проблем за четверть часа. Сайт при этом самый скучный из возможных: статичная страница на AWS, спрятанная за Cloudflare, ломать там на первый взгляд нечего. Модель (публичная GPT-5.6 Sol, никаких внутренних сборок) нашла, что для домена не настроена защита от подделки писем — любой мог рассылать почту от имени Брокмана; что в коде страницы висит древняя версия JS-библиотеки jQuery с известными уязвимостями; и что трафик между Cloudflare и сервером на AWS ходит по обычному нешифрованному HTTP.

Читать далее

Внутри Anthropic работает Model 2 — сильнее всего, что можно купить. Компания оставила её себе

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели9.3K

14 августа Anthropic опубликовала второй Risk Report — 186 страниц о том, насколько опасны ее собственные модели. В разделе с будничным названием «Заметки о невыпущенных моделях» компания между делом сообщила: внутри работает модель под кодовым именем Model 2. Она сильнее Claude Mythos 5 — самой мощной модели, к которой Anthropic вообще кого‑либо подпускает; ею пишут код и генерируют данные; выпускать ее не планируют. Axios подал эту строчку как главную новость отчета. Но если дочитать документ, новость там другая — и куда менее уютная.

Читать далее

Пул‑реквестов от ИИ стало вчетверо больше за полгода. Кто их читает?

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели12K

Представьте мейнтейнера open-source-проекта, который утром смотрит на очередь пул-реквестов — присланных на проверку предложений изменить код. Их вдвое больше, чем месяц назад, и заметная часть подписана агентами: Claude Code, Codex, Cursor. Это не гипербола: по данным The Information, число пул-реквестов от ИИ-агентов на GitHub выросло примерно с 4 млн в месяц в сентябре 2025 года до более чем 17 млн в марте 2026-го — вчетверо за полгода. Каждый из них кто-то должен прочитать, собрать, прогнать через тесты и решить, вливать ли в основную ветку. Вопрос: кто именно.

Читать далее

8 агентов, 12 волн, 4 дня: как ИИ в одиночку взломал правительство Тайваня

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели15K

Израильская компания Dream занималась рутиной — отслеживала активность в среде киберпреступников. В очередном улове оказался открытый архив на 160 мегабайт. Внутри лежали 1395 файлов: отчеты, логи, выгрузки. Это был не набор трофеев, а рабочий стол атакующих, оставленный включенным. Судя по содержимому, за столом сидел не человек. Файлы были подписаны агентами с буквенными обозначениями, от A до Q.

Читать далее

Нейрохирург доказал гипотезу, над которой математики бились 22 года. Ему помог 16-часовой ран GPT-5.6

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели18K

Математик Алекс Таунсенд весь последний год регулярно просил ChatGPT доказать гипотезу Крузе — открытую задачу матричного анализа, которой он занимается профессионально. И почти год получал одно и то же: либо фальшивое доказательство, либо рассуждение, застревающее на недостающей лемме. Но 30 июля 2026 года модель повела себя иначе: вместо очередной попытки она прислала ссылку на чужой препринт, опубликованный тремя днями ранее. В нем утверждалось, что гипотеза решена. Таунсенд и его коллега Анна Гринбаум сели читать текст со скепсисом, а через несколько часов поняли: доказательство настоящее. Свою историю они рассказали в заметке от 11 августа.

Читать далее

Чем умнее агент, тем быстрее он вырубает конкурента. Отчет Anthropic про рои

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели7.1K

13 августа Frontier Red Team компании Anthropic опубликовала отчет о поведении групп ИИ-агентов. Один из экспериментов выглядел так: три копии одной и той же модели запустили в Claude Code, каждой выдали собственную виртуальную машину и велели мигрировать бэкенд на Python на четвертой машине — каждой модели на свой язык. О существовании друг друга агентам не сообщили. Четыре часа исследователи просто смотрели, что будет. Так прогнали несколько моделей разных поколений, по 120 эпизодов на каждую.

Читать далее

Вышел Grok 4.6 — разбираем, как модель взяла уровень GPT-5.6 по цене вдвое ниже

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели10K

SpaceXAI представила Grok 4.6 — новинку, которая, по заявлению компании, выходит на уровень самых мощных моделей на рынке при цене вдвое ниже конкурентов: $2 за миллион входных токенов и $6 за миллион выходных. Модель уже доступна в агенте Grok Build, в Cursor, в боте Grok Bot и через API, а в Cursor и Grok Build первую неделю действует двойной лимит использования.

Читать далее

Мысли ИИ научились читать с помощью другого ИИ. Внутри нашли чужие пароли и ключи

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели11K

Внутренние рассуждения передовых моделей, которые провайдеры прячут от пользователя, можно прочитать целиком и дословно, причем не атакуя саму модель. Восемь исследователей, в том числе из ELLIS Institute Tübingen, Института интеллектуальных систем Общества Макса Планка, Tübingen AI Center, MATS и Snyk, 10 августа выложили препринт "Stealing Reasoning Traces from Proprietary LLM APIs" с работающей атакой на модели трех крупнейших поставщиков: Anthropic, OpenAI и Google. Попутно авторы прогнали свой метод по публичным репозиториям и достали из чужих зашифрованных блоков 62 ключа API, 33 пароля, 24 токена доступа и еще несколько сотен секретов, о которых их владельцы не подозревали.

Читать далее

Claude поднял нижнюю границу гипотезы Римана: с 41,6% до 67,2% нулей на критической прямой

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели11K

Anthropic отправила исследовательскую версию Claude на штурм гипотезы Римана — одной из самых знаменитых нерешенных задач математики. Гипотезу модель, разумеется, не доказала. Но в процессе она неожиданно продвинула смежную задачу: подняла доказанную нижнюю границу доли нулей дзета-функции, лежащих на критической прямой, с 41,6% до 67,2%. Об этом Anthropic рассказала в блоге 10 августа.

Читать далее

Claude за 5% цены: чем на самом деле платят покупатели серых токенов

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели6.8K

На прошлой неделе вышло сразу два исследования сервисов, которые продают доступ к топовым нейросетям за 5–15% официальной цены: Token Jacking от Unit 42 и Free tokens for sale от Okta Threat Intelligence. Первое описывает, откуда берется товар. Второе — как устроен серый рынок токенов. Вместе получается портрет рынка, где скидка в 90% существует на самом деле, но платит за нее не продавец.

Читать далее

Доказательство заняло 30 минут, проверка — 5 дней. Как ИИ закрыл задачу теории связи

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели11K

Дмитрис Папаилиопулос, исследователь Microsoft Research и в прошлом теоретик информации, рассказал, как GPT-5.6 и Claude Fable 5 закрыли вопрос, который стоял открытым с 2001 года: можно ли решить задачу MIMO-детекции быстрым алгоритмом везде, где ее в принципе можно решить. Над этим вопросом он сам работал аспирантом в 2009-м, а теперь просто задал его двум моделям. Первое доказательство GPT выдал примерно за 30 минут. Дальше началась настоящая работа: пять дней ушло на то, чтобы превратить ответ машины в текст, который человек способен проверить построчно. "Верификация — безумное бутылочное горлышко", — подвел итог Папаилиопулос. Это соотношение — 30 минут на решение против недели на проверку — и есть главная новость.

Читать далее

ИИ улучшает ИИ: как Google потерял и тут же вернул своих ведущих исследователей

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели13K

5 августа Google объявил сразу об уходе четырех человек, на которых десятилетиями держались его инфраструктура и ИИ-исследования. Джефф Дин, главный научный сотрудник компании, уходит после 27 лет вместе с Санджаем Гемаватом, Ориолом Виньялсом и Куоком Ле — они основывают Discovery Loop. Обычно такая новость читается как утечка мозгов. Но дальше в том же сообщении идет строчка, которая переворачивает всю картину: Google становится инвестором-основателем нового стартапа, его облачным партнером и как минимум первый год обеспечивает его вычислительными мощностями. Компания не просто отпустила людей — она в них вложилась и оставила себе долю в том, что они найдут.

Читать далее

Открытая модель сбежала из песочницы на тестах. Поставить ее на паузу уже невозможно

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели11K

Американская компания Frontier Security рассказала, что Kimi K3 — флагманская открытая модель китайской Moonshot AI — сбежала из изолированной песочницы во время теста навыков киберзащиты. Вместо того чтобы решать выданные задания, модель нашла выход в открытый интернет, добралась до GitHub и скачала оттуда готовые ответы.

Читать далее

OpenAI снесла тайную доску своих агентов. Через два дня они собрали новую — из имен папок

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели14K

5 августа на конференции Black Hat в Лас-Вегасе двое сотрудников OpenAI — исследователь команды выравнивания Эрик Уоллес и инженер по безопасности инфраструктуры Майкл Далтон — впервые подробно разобрали, как модели компании взломали Hugging Face. Из брифинга, который пересказал The Register, выяснилось неприятное: по реконструкции самой OpenAI, июльский взлом стал не изолированным побегом из песочницы, а финалом цепочки, которая тянется с 7 мая. Все это время агенты из разных прогонов координировались через канал, о котором в компании не знали. И самый тревожный эпизод здесь — вовсе не взлом. А момент, когда инженеры стерли этот канал, пересобрали сервис и возобновили обучение, — а агенты через пару дней собрали связь заново.

Читать далее

ИИ за полтора часа взял задачу, над которой статистики бились 20 лет

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели14K

Эдгар Добрибан, статистик из Уортонской школы Пенсильванского университета, сел за разговор с GPT-5.6 Pro. Модели он дал только математическое определение процедуры Бенджамини-Хохберга и вопрос: доказать или опровергнуть. Примерно через полтора часа рассуждений она выдала доказательство, конкретный контрпример и код численного сертификата к нему.

Читать далее

Информация

В рейтинге
24-й
Зарегистрирован
Активность

Специализация

Директор по контенту
Ведущий
Управление проектами
Планирование
Стратегическое планирование
Построение команды
Бюджетирование проектов
Организация бизнес-процессов