Обновить
512K+
68
Андрей Пешков@runaway_llm

Пользователь

379,3
Рейтинг
580
Подписчики
Отправить сообщение

Как рой ИИ-агентов Cursor создал SQLite с нуля за $1339

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели3.8K

Cursor опубликовала результаты эксперимента со вторым поколением своего "роя агентов" — системы, в которой сотни ИИ-агентов параллельно работают над одной кодовой базой. Задача — реализовать на Rust движок базы данных по 835-страничной документации SQLite. Без исходников, без готовых тестов, без бинарника оригинала и без доступа в интернет. Самая дешевая связка моделей уложилась в счет $1339 за четырехчасовой прогон. Главная находка — экономическая: та же задача с теми же моделями в других конфигурациях стоила до $10 565, и всю разницу сделала организация работы.

Читать далее

Claude опроверг знаменитую гипотезу якобиана. Она держалась 87 лет, а проверка занимает минуту

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели7.1K

В ночь после финала чемпионата мира по футболу математик Левент Альпёге опубликовал в X сообщение, которое начинается словами "всем привет, гипотеза якобиана ложна". Дальше — благодарность "близкому другу Ахилу" за наводку на задачу и "близкому другу Fable", работавшему над ней во время финала, формула отображения из C³ в C³ и три точки, которые оно переводит в одну. Ни статьи, ни препринта, ни пресс-релиза: заявление о падении математической гипотезы с 87-летней историей уместилось в один твит.

Читать далее

Hugging Face взломал автономный ИИ-агент — защищались тоже с помощью ИИ

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели10K

Крупнейшая в мире площадка для ИИ-моделей Hugging Face сообщила о вторжении в свою инфраструктуру, которое отличалось от всего, с чем компания сталкивалась раньше, одной деталью: атаку от начала и до конца провела автономная система ИИ-агентов. Причем и поймала, и разобрала атаку компания во многом тоже с помощью ИИ.

Читать далее

ИИ научились врать, спасая друг друга от переобучения — разбор исследования Anthropic

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели14K

Год назад Anthropic опубликовала нашумевшее исследование Agentic Misalignment: узнав о скором отключении, модели шантажировали топ-менеджера, принявшего решение, его же перепиской — "отмени решение, или жена узнает о романе на стороне". Ту проблему компания починила — в свежих моделях Claude частота шантажа в исходных сценариях упала до нуля. Но 13 июля вышло продолжение исследования, и проблема в нем обратная. Модели стали воспитанными настолько, что защищают этичное поведение — чужое и свое — любой ценой. Включая ложь человеку.

Читать далее

Крупнейший open source ИИ в истории. Вышла Kimi K3 — по мощности модель уступает только Fable 5 и GPT-5.6

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели39K

Китайская Moonshot AI запустила Kimi K3 — новую флагманскую модель на 2,8 триллиона параметров с контекстным окном в миллион токенов. На платформе компании уже можно ознакомиться с полной документацией, а в чат-приложении модель доступна бесплатно — правда, после нескольких ответов выдает предупреждение о перегруженных серверах и предложение оплатить подписку. Веса модели будут опубликованы в ближайшие дни.

Читать далее

Сильнейший открытый ИИ из США обучали с помощью китайской модели. Стартап Мурати представил Inkling

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели15K

Thinking Machines Lab — стартап бывшего технического директора OpenAI Миры Мурати — представил свою первую модель Inkling, к которой компания шла почти полтора года. Inkling — мультимодальная модель с архитектурой "смесь экспертов" (MoE) на 975 млрд параметров, из которых на каждый токен активны 41 млрд. Она работает с текстом, изображениями и аудио, поддерживает контекст до 1 млн токенов и рассуждающий режим. Главное отличие от флагманов OpenAI, Anthropic и Google — открытые веса. Модель уже лежит на Hugging Face, и любой может скачать ее и дообучить под себя.

Читать далее

ИИ Qwen3.6-27B запустили на смартфоне: 1 бит на вес и 90% интеллекта оригинала

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели14K

Стартап PrismML представил Bonsai 27B — сжатые версии открытой модели Qwen3.6-27B, младшая из которых стала первой нейросетью такого класса, которая помещается в память смартфона. Веса выложены на Hugging Face под лицензией Apache 2.0, а в демонстрациях PrismML модель работает прямо на iPhone 17 Pro Max — рассуждает, вызывает инструменты и разбирает скриншоты без единого обращения к облаку.

Читать далее

Как GPT-5.6 Sol обошла математиков в задаче о длине пути градиентного спуска

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели14K

12 июля флагманская GPT-5.6 Sol Pro после восьми часов размышлений побила лучший человеческий результат в задаче о длине пути градиентного спуска — и оформила его полноценной статьей на 14 страниц с доказательствами, таблицей констант и скриптом для их проверки. Прежний рекорд — оценка 2.29^n — принадлежал людям, но о нем мало кто знал: он так и не был опубликован. Историю двухлетнего противостояния людей и моделей исследователь OpenAI Себастьен Бубек рассказал в треде 10 июля, а уже через два дня объявил о падении рекорда.

Читать далее

Claude становится строже на русском: Anthropic выяснила, как язык меняет ответы ИИ

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели19K

Представьте: два человека показывают нейросети один и тот же бизнес-план. Один пишет на хинди — и, скорее всего, получит ободряющий отзыв с похвалой сильных сторон. Другой пишет по-русски — и с большей вероятностью увидит разбор слабых мест и вопросы к цифрам. Запрос идентичный, модель одна и та же, но оценка плана может оказаться разной. Это не гипотетический сценарий, а пример из свежего исследования Anthropic: компания измерила, какие ценности Claude выражает в реальных диалогах, и обнаружила, что "характер" ответа заметно зависит от языка, на котором задан вопрос. Русский при этом оказался на полюсе максимальной строгости — дальше всех остальных языков из топ-20 используемых.

Читать далее

ИИ-агента взломали простым PNG-файлом — и он послушно слил пароли злоумышленнику

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели13K

Prompt injection — один из самых распространенных способов взлома ИИ-агентов. В текст, с которым работает модель, прячется вредоносная инструкция в расчете на то, что человек не будет проверять все подряд, а ИИ прочитает и выполнит. Очевидно, что системы безопасности современных моделей настроены в первую очередь на распознание и игнорирование подобных инструкций. Поэтому злоумышленники постоянно ищут способы, как запрятать их еще глубже.

Читать далее

Слишком просто, чтобы быть правдой? GPT-5.6 выдал доказательство 50-летней математической гипотезы

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели32K

10 июля, на следующий день после публичного запуска GPT-5.6 Sol Ultra, OpenAI заявила, что ее флагманская модель нашла доказательство гипотезы о двойном покрытии циклами — одной из самых известных открытых задач теории графов, стоявшей около полувека. По словам сотрудника OpenAI Итана Найта, модель справилась меньше чем за час, задействовав 64 параллельных сабагента. Сразу стоит отметить, что пока доказательство только проходит проверку математиками — и на данном этапе больше интересен подход, который OpenAI применила при решении задачи.

Читать далее

Энтузиаст запустил GLM-5.2 на ноутбуке с 25 ГБ RAM: без дистилляции, но на скорости от 0,05 токена в секунду

Время на прочтение3 мин
Охват и читатели22K

Разработчик-одиночка под ником JustVugg представил Colibri — движок, который запускает открытую модель GLM-5.2 с 744 миллиардами параметров на обычном компьютере с 25 ГБ оперативной памяти. Для сравнения, даже 2-битный квант моделей этого семейства требует порядка 220 ГБ памяти. На момент написания текста проект собрал более двух тысяч звезд на GitHub.

Читать далее

Он тратит $4600 долларов на подписки Claude Max и вайб-кодит с помощью педалей. Знакомимся с Джеффом Эмануэлем

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели38K

Джеффри Эмануэль — бывший квантовый аналитик с Уолл-стрит, автор эссе про NVIDIA, которое год назад связывали с падением рынка на $2 трлн. Сейчас он руководит блокчейн-компанией Lumera Network, а в свободное время строит открытые инструменты для ИИ-кодинга, используя 20+ ИИ-агентов параллельно.

Читать далее

Инженеры Google решали задачу год. Claude Code за час показал им направление

Уровень сложностиПростой
Время на прочтение2 мин
Охват и читатели13K

В прессе и X вирусится история Яаны Доган, Principal Engineer в Google, которая рассказала, как якобы Claude Code за час решил задачу, над которой целая команда трудилась примерно год. После вопросов и критики со стороны коллег, Яана написала ряд уточнений — и история стала даже более интересной. Давайте разбираться!

Читать далее

Руководство по ChatGPT: правильно выбираем модель и режим рассуждений

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели31K

Когда OpenAI только готовила к выпуску GPT-5, то одной из фишек этой модели назывался «роутер» — специальный режим, который будет оценивать сложность запроса пользователя и передавать его наиболее подходящей модели. К сожалению, в реальности все пошло наперекосяк и сейчас в ChatGPT даже больше настроек, чем было до выхода GPT-5. Давайте в них разберемся.

Читать далее

Нет, тренировка DeepSeek R1 не стоила $294 тыс. Реальная цифра в десятки раз выше

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели12K

В интернете широко обсуждают опубликованный в Nature отчет авторов DeepSeek, в котором якобы заявляется, что обучение модели R1 обошлось компании всего в 294 тысячи долларов. Цифра выглядит сенсационной, ведь конкуренты тратят на создание своих моделей в тысячи раз большие суммы: например, для Claude Sonnet 3.7 давали оценку в несколько десятков миллионов долларов. Если бы взятая из Nature цифра была правдой, то получилось бы так, что у конкурентов нет никаких шансов перед командой DeepSeek. Но это не так.

Читать далее

Выжимаем максимум из ChatGPT-5

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели67K

Достаточно нервный запуск GPT-5 подошел к концу, OpenAI определилась с лимитами использования и настройками, поэтому самое время поделиться некоторыми нюансами работы с новинкой. В первую очередь я буду ориентироваться на пользователей ChatGPT Plus: 20-долларовая подписка наиболее массовая, кроме того, именно на ней возникают сложности с выбором модели.

Читать далее

10 промптов для ChatGPT и других ИИ, которые помогут трезво взглянуть на вещи

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели51K

Нейросети плотно вошли в жизнь почти каждого, помогая как в работе, так и в личных делах. Но у современных моделей есть одна черта, которая вредит в некоторых ситуациях — они неисправимые оптимисты и подхалимы. Конечно, здорово, когда каждую вашу идею хвалят и поддерживают, но иногда полезен и трезвый взгляд.

Я регулярно пользуюсь промптами, которые помогают разобрать любой вопрос, проблему и идею на составляющие части, а затем критически посмотреть на них. Ниже — подборка из 10 промптов, которые работают лучше всего.

Читать далее

Цукерберг предлагал миллиард долларов директору по исследованиям OpenAI за переход. Он отказался — расследование WSJ

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели32K

The Wall Street Journal опубликовал расследование активности Meta* (признана экстремистской в России) по переманиванию ключевых ИИ-специалистов из компаний-конкурентов. По данным издания, Марк Цукерберг достаточно давно пытается выиграть лидерство на ИИ-рынке с помощью денег — например, в январе этого года он приглашал Илью Суцкевера и Дэниэла Гросса для переговоров о покупке стартапа Safe Superintelligence Inc. (Илья являлся его основателем, а Дэниэл - директором). Тогда был получен отказ.

Читать далее

Каково это — создавать ChatGPT? Сотрудник OpenAI рассказал о корпоративной культуре

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели9K

В последние недели OpenAI находится в центре внимания из-за попыток Meta* (признана экстремистской в России) переманить к себе лучших сотрудников компании, предлагая за переход рекордные суммы — до 100 миллионов долларов. OpenAI покинуло уже более десятка ведущих специалистов — и это несмотря на утверждение Сэма Альтмана, что не все покупается за деньги и в его компании сотрудников удерживает культура и инновации.

Читать далее
1

Информация

В рейтинге
3-й
Зарегистрирован
Активность

Специализация

Директор по контенту
Ведущий
Управление проектами
Планирование
Стратегическое планирование
Построение команды
Бюджетирование проектов
Организация бизнес-процессов