Обновить
64K+
15
Александр Круглов@Master_AI

Пользователь

105,7
Рейтинг
10
Подписчики
Отправить сообщение

Claude Opus 5.5: подробный обзор новой модели

Уровень сложностиПростой
Время на прочтение11 мин
Охват и читатели11K

22 сентября 2026 года – обычный вторник, если не считать того, что в этот день одновременно вывалилось сразу несколько релизов больших и крупных LLM:
• Anthropic взяла и выкатила Claude Opus 5.5
• Буквально через полтора часа OpenAI ответила двумя моделями, GPT-6 Sol и Luna

Для тех, кто торопится: Opus 5.5 работает на уровне флагманского Fable 5.1 на большинстве задач, стоит на 40% дешевле Opus 5 на типичной нагрузке, генерирует токены более чем на 30% быстрее – и (внимание, барабанная дробь) говорит по-человечески. Последнее, судя по всему, волнует людей сильнее, чем все таблицы бенчмарков вместе взятые.

Далее – полный разбор: цифры, споры, мультики, которые модель нарисовала кодом, алгоритм, который она улучшила, и практические советы. Поехали.

Читать далее

7 дней новостей ИИ (12–18 сентября): абсурд и реалии кибербезопасности 2026 года

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели13K

Добро пожаловать в середину сентября 2026 года. Если вам казалось, что индустрия ИИ летит на гиперскорости в бетонную стену, то на этой неделе это поняли и сами водители спорткаров. Риски того, что технологии выйдут из-под контроля, перестали быть сюжетом для блогов и перешли в разряд экстренных совещаний.

Эта неделя подарила нам киберпанковые сюжеты: нейросети начали взламывать серверы конкурентов (буквально), автономные агенты изобретают собственные диалекты с отсылками к Джойсу, а для «спятивших» ботов теперь создают горячие линии доносов. И пока в Китае ИИ-актеры уже захватили рынок мобильных сериалов, бигтех всерьез заговорил о том, чтобы ударить по тормозам.

Собрали для вас дайджест того, как наш мир в очередной раз необратимо изменился за последние семь дней.

Читать далее

Вы просили вернуть Suno v5, а мы сделали лучше. Встречайте Grom Zvuk

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели9.9K

В мире генеративного ИИ всё меняется стремительно. Этим летом музыкальное ИИ‑сообщество столкнулось с сюрпризом: разработчики Suno навсегда отключили полюбившиеся многим старые версии моделей (v4, v4.5, v5 и v5.5).

Пользователи нашей ИИ‑платформы GPTunneL (агрегатора нейросетей) массово жаловались: пропал тот самый вайб, а новые алгоритмы стали слишком жесткими. К тому же в Suno всегда была одна фундаментальная проблема, которая бесила многих креаторов — там нельзя было просто взять и поменять текст в уже готовом, сгенерированном треке.

Мы выслушали боль нашей аудитории, посмотрели на то, чего не хватает рынку, и решили сделать свой продукт.

Сегодня, 18 сентября, мы официально запускаем Grom Zvuk — нашу собственную музыкальную ИИ‑модель. Она работает на наших серверах, выдает крутое качество, делает невероятные каверы и стоит дешевле западных аналогов. Рассказываем, как она устроена и на что способна.

Читать далее

Почему Seedance 2.5 и Hailuo H3 игнорируют промпт и как это исправить 3D‑сценой

Уровень сложностиПростой
Время на прочтение11 мин
Охват и читатели7.3K

Привет, «Хабр»!

Я Илья Трикоз, сооснователь и разработчик GPTunneL. И сегодня расскажу вам про вещь, которую мы сделали, когда задолбались смотреть, как дорогая видеомодель раз за разом придумывает свою режиссуру вместо той, что мы просили.

Но теперь ролик можно собрать иначе:
1) сгенерить 3D-сцену из примитивов, расставить камеры;
2) получить рендер-референс, по которому Seedance 2.5 или Hailuo H3 повторят все движения один в один.

Ракурс, тайминг, каты – всё предсказуемо, всё остаётся на холсте, и любой шаг можно переиграть. Вместо того чтобы уговаривать модель текстом, мы показываем ей на пальцах (точнее, на кубиках).

Итак, встречайте: нода «3D-сцена» в конструкторе воркфлоу.

Читать далее

7 дней новостей ИИ (05.09.26…11.09.26): пока вы спали, вышло ещё три модели

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели8.7K

Неделя выдалась такая, что впору сериал снимать с открытым финалом. Модели штампуют быстрее, чем успеваешь придумывать им имена, лидерборды переворачиваются за завтраком, а где-то в недрах OpenAI десять тысяч автономных агентов молча уселись решать задачу, за которую математики бьются с прошлого века (и, кажется, решили).

Что же произошло на этой неделе?

Читать далее

GPT Images 2.5: новая нейросеть для генерации изображений от OpenAI

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели10K

Как же за всем этим успевать?

За это время вышли ещё и обновлённый DeepSeek, и результаты по Навье-Стоксу. На этом фоне у GPT Images 2.5 были все шансы потеряться. Не потерялся.

Разве что реддит-модер ненадолго снёс официальный пост OpenAI из-за «вторника без картинок»...

Так вот, 8 сентября 2026 года OpenAI выпустила обновлённую версию своего генератора изображений – ChatGPT Images 2.5. Официально это не «тройка», хотя по объёму изменений можно было бы и замахнуться. Впрочем, это и в самом деле скорее «версия 2.0, доведённая до ума», чем революция. Но именно это доведение до ума и есть самое интересное.

Если в двух словах: генерация стала быстрее почти на 50%, редактирование – более хирургическим, а сама модель – заметно менее забывчивой в длинных диалогах. Дальше – details, details, details.

Спойлер: пеликана на этот анимировали в 96 кадрах и прокатили на велосипеде. Но обо всём по порядку.

Читать далее

Grom TV: первый в России бесконечный онлайновый ИИ‑телевизор

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели10K

Последние недели в рабочих чатах через слово мелькает фраза «а давай Гэндальф сварит зелье со Скуби-Ду». Не потому что корпоратив затянулся. Просто мы в GPTunneL запустили штуку, которая заставляет весь офис вести себя как дети, которым выдали пульт от телевизора и сказали: «крути любой канал, какой захочешь – только этого канала ещё не существует, придумай сам».

Штука называется Grom TV. Это генеративный онлайн-ТВ, куда заходит любой желающий, пишет промпт (буквально текстом, как в чат) и через 20–25 секунд видит на экране свой собственный видеоролик, сгенерированный нейросетью прямо по этому запросу.

Причём видит не один: на канале одновременно крутятся ролики других зрителей, а под телевизором – чат, куда можно отправлять промпты.

Попробовать можно прямо сейчас: «Гром Телевизор». Регистрация простая, промпт пишется в поле справа от экрана – и дальше вы, по сути, режиссёр в прямом эфире. Собственно, вот как это выглядит вживую...

Читать далее

ChatGPT-6 Astra: подробный обзор новой модели

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели39K

Обычно к очередному релизу я отношусь спокойно: ну, ещё одна циферка на бенчмарке. Но тут даже я, повидавший GPT-5, 5.1, «code red» 5.2 и всё остальное, сел и полистал материалы.

3 сентября у половины интернета одновременно легли Claude, Grok, ChatGPT и Gemini. Даундетектор синхронно нарисовал графики отказов по четырём провайдерам сразу, “Is it happening???” – вопрошали пользователи. По одной из версий, барахлила общая облачная инфраструктура – обычный день в мире, где всё держится на паре дата-центров.

Но совпадение по времени вышло символичным: через несколько часов OpenAI выкатила GPT-6 Astra и заявила, что мы теперь живём в «эре AGI».

Подобное я слышу примерно с релиза GPT-2. Но в этот раз попробуем разобраться подробно.

Читать далее

Мы проверили обещанные Nvidia 15x на DFlash: получилось 2,3x

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели8.1K

Помните DFlash? В начале года о нём много шумели: способ ускорить любую LLM, не трогая саму модель. Nvidia тогда выкатила заголовки «До 15x к пропускной способности на Blackwell». Цифра весомая, звучит как революция.

Мы, конечно, решили покрутить это вручную. Для этого взяли драфтер DFlash для Gemma 4 26B, который лежит прямо в репозитории модели, прогнали на своём стенде.

Но вместо 15x получили 2,3x, и только пока на карте висит один‑единственный запрос… Если запустить 4 пользователей одновременно — ускорение исчезает, а на 8 параллельных запросах DFlash начинает проигрывать.

Сейчас расскажу, откуда берутся магические 15x и почему наши графики расходятся с вендорскими.

Читать далее

Моддеры хакнули DLSS 5 и запихнули его во всё подряд — от Skyrim до GTA San Andreas

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели15K

Иногда что-то супер-мега-секретное вылезает наружу не через слив, а просто потому что кто-то забыл вынуть один файл из билда. Ну забыли и забыли, с кем не бывает.

Именно так всё и произошло на прошлой неделе с DLSS 5 – скандальной штукой от Nvidia. Официального анонса не было, зато была ранняя версия игры NBA 2K27, в которой была незаметная DLL-ка nvngx_dlssnr.dll на 158 мегабайт... и понеслось.

За считанные дни модеры натянули нейросетевой рендер на добрых три десятка игр, от Cyberpunk 2077 до GTA San Andreas, которой уже двадцать лет в обед (хотя ремастеру чуть меньше).

Если вы следили за DLSS 5 с марта, то помните все эти мемы и хейт. Попробуем разобраться, что произошло, как работает технически, что показывают тесты и почему до сих пор спорят о судьбах игровой индустрии. Заодно накидаю картинок и видео, потому что тут тот случай, когда лучше один раз увидеть, чем сто раз прочитать.

Читать далее

Qwen4: Архитектура будущего

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели22K

Тут надо сразу расставить точки, потому что вокруг названия путаница. Полноценного Qwen4 не существует. Есть Qwen3.8-Flash‑Next — модель, которую сама команда Qwen называет «экспериментальная версия архитектуры, которая ляжет в основу Qwen4».

26 августа 2026 интернет на пару часов забыл про всё. «Meet Qwen3.8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open‑weight!» И цифры… 125 миллиардов параметров всего. Плюс ещё 51 млрд отдельным слоем. А активируется на каждый токен — лишь 6 миллиардов.

Первая мысль была: так не бывает.

Читать далее

Ox Alpha (GLM-5.3-Flash). Что это было?.

Уровень сложностиПростой
Время на прочтение11 мин
Охват и читатели12K

20 августа на OpenRouter появилась строчка stealth/ox-alpha. Без карточки модели и даже намёка, кто её выложил. Провайдер значился как «Anonymous». Цена — ноль. Контекст — мильон. Площадка предупреждала: мы не владелец этой модели, а просто маршрутизируем запросы.

Через шесть дней у анона было имя, десятки триллионов обработанных токенов и полмиллиона разработчиков, которые за это время успели залить в него рабочий код. Спойлер, который уже не спойлер: это оказалась GLM-5.3-Flash от китайской Z.ai.

Но путь от «непонятно что» до «фронтир‑модели» получился драматичным и заслуживает разбора. Ну а поскольку я лично пялился в этот тред почти неделю, обновляя ленту как одержимый — расскажу вам что там произошло, по порядку.

Читать далее

Как ИИ‑агенты воюют, мирятся и пишут извинительные коммиты: 5 важных экспериментов

Уровень сложностиПростой
Время на прочтение17 мин
Охват и читатели10K

Мы привыкли считать нейросети просто статистическими попугаями. Но последние работы — от пермских экономистов до Anthropic — показывают: в группах эти «попугаи» порождают поведение, которое невозможно предсказать по отдельным особям. Появляются культура, конформизм и даже альтруизм, которого не хватает людям.

Эта статья — попытка разобраться, что происходит, когда за агентами никто не следит. Под катом цифры, скриншоты, гифки и немного неуютные выводы.

Читать далее

Grok 4.6: как за месяц допрыгнуть до тройки лидеров (и купить себе Cursor в придачу)

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели9.4K

12 августа xAI (хотя уже SpaceXAI) выкатила Grok 4.6. Прошло чуть больше месяца с релиза 4.5, а модель уже официально в тройке лидеров – по версии Artificial Analysis.

По совокупному индексу интеллекта модель почти сравнялась с GPT‑5.6 Sol и отстаёт от Claude Fable 5 всего на один балл. Grok 4.6 набирает на пять баллов больше, чем Grok 4.5 (по индексу интеллекта всего через месяц после выхода предыдущей версии), и на 23 балла больше чем Grok 4.3.

Сегодня разберём, что именно изменилось в Grok 4.6, почему одни бенчмарки выросли на 10+ пунктов, а другие остались на месте, кто реально выиграл этот раунд, и – да – заденем скандальную репутацию xAI)

Читать далее

Gemini 3.7 Flash: это снова не та модель, которую все ждали

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели11K

Наверняка вы уже видели заголовок «Google выпустила новую Gemini» примерно миллион раз за последний год.

13 августа 2026 года это случилось снова: на сцену вышла Gemini 3.7 Flash.

Pro-модели снова нет. Опять Flash. Третий Flash за три месяца, если быть точным.

Расскажу, что изменилось. Заодно разберём пользовательские тесты и бенчмарки.

Читать далее

Возвращение короля: разбираемся, что такое Qwen3.8 27B

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели18K

14 августа 2026 года, 15:00 UTC.

CEO Anthropic Дарио Амодей срочно созвал заседание. Экс-глава Apple Тим Кук пожалел, что встроил в айфоны облачную Gemini, так и не дождавшись локальной модели нужного уровня. Где-то в датацентрах Alibaba щёлкнул рубильник, на Hugging Face слетел обратный отсчёт, и в мир вышла Qwen3.8-27B – новая dense-модель на 27 миллиардов параметров, которую даже прозвали «локальным Opus’ом», поскольку она позиционируется как одно из самых мощных открытых решений для локальной генерации.

Ждали её всем миром: обратный отсчёт на huggingface, первые пиксельные пеликаны на великах – всё как положено.

Если вкратце, это открытая (Apache 2.0) мультимодальная модель, которая понимает текст, картинки и видео, влезает в одну ооочень мощную домашнюю видеокарту, а временами по бенчмаркам обгоняет закрытые облачные модели уровня Claude Opus 4.6.

Если не вкратце – читайте дальше, потому что там есть и триумф, и зависания на 49 минут раздумий!

Читать далее

Anthropic пометила текст Claude невидимым клеймом. Опенсорс-сообщество попыталось взломать уже через 48 часов

Уровень сложностиПростой
Время на прочтение11 мин
Охват и читатели13K

2.08.2026 года, в день когда в ЕС реально завелась статья 50 AI Act, Anthropic сделала ход конём: с этого дня каждый текст, который выдаёт свеженькая модель Claude, тащит в себе невидимую метку. (Не пиксель или строчку метаданных в углу, а метку, вплетённую прямо в сам выбор слов) Это подали как жест прозрачности: мол, вот вам транспарентность(как просили).

Не прошло и суток, как в гитхабе набрал обороты проект, обещающий эту метку стереть. За ним — ещё десяток.

А неделю спустя независимое издание констатировало: доказать, что хоть один из них реально работает, не может никто (ни авторы ни сама Anthropic).

Эта статья – о том, почему это не баг и не провал маркетинга, а неизбежное следствие того, как устроена технология. И заодно — почему у истории куда более длинная борода, чем у чат-ботов: первые водяные знаки придумали за семьсот с лишним лет до GPT.

Читать далее

Роботы сожрали интернет, пока мы спали. И это вообще не метафора

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели9.1K

99% посетителей сайта — НЕ ЛЮДИ.

И это не «подозрительный трафик», а буквально: из 1,28 миллиона отданных страниц живые люди посмотрели меньше шести тысяч. Чувак, который это заметил (разработчик благотворительной базы PatronView) — вывел формулу: на каждую страницу, увиденную человеком, приходится ещё ≋214 загрузок, которые никто никогда не увидит. Ну то есть вообще никто. Новая норма, просто не все ещё заметили что декорации сменились.

Дальше будет куча цифр, немного паранойи и шрифт, который врёт роботам в лицо.

Читать далее

Qwen3.8-Max: 2 400 000 000 000-параметровый монстр

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели15K

Пока одни запускали GPT-5.6 Sol Max, другие ломали копья в холиварах «Kimi K3 vs Claude Opus 5», Alibaba тихо (ага, с ростом акций на 7% в моменте – очень тихо) вкатила модель, которую сама называет «новой планкой для кодинга и совместной работы». Знакомьтесь: Qwen3.8-Max, 2,4 триллиона параметров(всего-то), контекст на миллион токенов и обученная не просто быстро отвечать, а не сдаваться днями.

Привычный рефлекс «очередной китайский флагман – очередные астрономические циферки – очередное “мы почти догнали Anthropic”» отчасти правдив. Но тут три вещи, ради которых стоит потратить пять минут: во-первых, Alibaba внезапно впервые открывает веса модели Max-класса; во-вторых, независимая проверка разошлась с вендорскими цифрами, и это отдельная маленькая драма в твиттере; в-третьих – релиз подсвечивает тренд, который многие стараются не замечать – дело, возможно, не в модели, а в том, что вокруг неё построено.

Ну что, поехали. Разберём по порядку.

Читать далее

MiniMax H3: нейронка, которая сама себе режиссёр, звукарь и монтажёр

Уровень сложностиПростой
Время на прочтение12 мин
Охват и читатели12K

Есть такой тип новостей – после которых ты просто закрываешь ноутбук и минуту тупишь в стену. Вот у меня так случилось пару дней назад, когда я добрался до демок MiniMax H3. И нет, не потому что “о боже, ещё одна видеомодель” – их сейчас штампуют как флагманские смартфоны. А потому что H3 упорно отказывается вести себя как обычная видюха.

Обычно у таких генераторов фокус один: текст → видео, ну или картинка → видео, максимум монтаж отдельным сервисом прикрутят. А тут прям с порога плюют на границы – между “сгенерировать” и “отредачить”, между “картинкой” и “звуком”. Кидаешь ей шесть референсных изображений, ролик-образец для тайминга монтажа и одно предложение текста – она выдаёт 15-секундный клип, смонтированный именно так, как в примере. Просунул зелёный экран с актёром – уберёт хромакей, подставит сказочный лес и перестроит освещение под новую сцену.

Разрабы формулируют красиво: H3 – «шаг к более общему мультимодальному интеллекту», а все эти специализированные модельки под конкретную задачу они прямо называют «лишней сложностью». Вместо зоопарка узких инструментов – один трансформер, который смотрит на текст, картинки, видео и аудио как на единый контекст. Спорно? Ну… отчасти да.

Но у этой позиции теперь есть проверка на прочность: модель открыли под лицензией, и любой желающий может прогнать её на своих материалах и убедиться, врёт маркетинг или нет. Чем мы, собственно, и займёмся.

Читать далее
1

Информация

В рейтинге
60-й
Зарегистрирован
Активность

Специализация

Промпт-инженер
Старший