Обновить
128K+
87
@python_leaderread⁠-⁠only

Пользователь

28,4
Рейтинг
255
Подписчики
Отправить сообщение

Z.ai выпустили GLM-5.3-Flash: ту самую Ox Alpha, которая за неделю стала топ-1 в OpenCode и OpenRouter

Время на прочтение2 мин
Охват и читатели11K

Z.ai выпустили GLM-5.3-Flash, первую нативно мультимодальную модель семейства GLM-5. Она поддерживает контекст до 1 млн токенов и содержит 320 млрд параметров, из которых при генерации активируются 18 млрд.

До официального релиза модель анонимно тестировали в OpenCode и OpenRouter под именем Ox Alpha. По данным OpenCode, за шесть дней она обработала 42 трлн токенов. В недельном рейтинге OpenRouter Ox Alpha также заняла первое место с 23,2 трлн токенов — вдвое больше, чем у ближайшей DeepSeek V4 Flash.

Читать далее

Qwen4: первая модель Alibaba на архитектуре нового поколения — Qwen3.8-Flash-Next

Время на прочтение1 мин
Охват и читатели7.7K

Alibaba анонсировали Qwen3.8-Flash-Next — первую публичную модель на архитектуре следующего поколения Qwen4. Открытые веса должны появиться 26 августа в 15:00 UTC.

Несмотря на Qwen3.8 в названии, команда прямо называет модель предварительным показом Qwen4. Её выпускают заранее, чтобы разработчики библиотек и систем инференса могли подготовиться к полноценному релизу нового поколения.

Читать далее

Чип OpenAI разогнал Kimi K2.5 почти до 700 токенов в секунду

Время на прочтение1 мин
Охват и читатели5.4K

В июне OpenAI и Broadcom представили Jalapeño, первый собственный чип OpenAI для инференса языковых моделей. Тогда компании рассказывали в основном про архитектуру и обещали начать развёртывание до конца года. Теперь появились первые результаты.

На Kimi K2.5 чип выдаёт 694 токена в секунду на пользователя против 182 у топового железа NVIDIA текущего поколения. На DeepSeek R1 разрыв получился ещё немного больше: 700 против 169 токенов в секунду.

Читать далее

OpenAI вернёт 5-часовой лимит в Codex для подписчиков за $20

Время на прочтение1 мин
Охват и читатели13K

В ночь на 26 августа OpenAI снова включит 5-часовой лимит для подписчиков ChatGPT Plus стоимостью $20 в месяц. Ограничение появится в ChatGPT Work и Codex поверх недельного лимита. Почти два месяца использовалась схема без 5-часового окна.

Подписчиков Pro за $100 и $200 изменение пока не затронет. В ближайшие месяцы 5-часовое ограничение для них включать не планируют.

Читать далее

Orca: бесплатная open-source ADE набрала 50 тысяч звёзд на GitHub

Время на прочтение1 мин
Охват и читатели19K

Репозиторий Orca, созданный в марте 2026 года, меньше чем за полгода набрал 50 тысяч звёзд. По состоянию на 25 августа у проекта уже больше 53 тысяч звёзд.

Orca — это ADE (Agent Development Environment), среда для параллельной работы с AI-агентами. Десктопное приложение построено на Electron.

Читать далее

Cursor запустил Origin: конкурента GitHub для AI‑агентов

Время на прочтение1 мин
Охват и читатели12K

Cursor начал развёртывание Origin: собственного сервиса для хранения кода, рассчитанного на работу с большим количеством AI-агентов. Платформа была анонсирована в июне как альтернатива традиционным Git-хостингам, а теперь стала доступна в ранней бете пользователям платных тарифов Cursor.

На старте Origin поддерживает репозитории, пул-реквесты, просмотр и поиск кода, а также синхронизацию с GitHub. Репозитории можно создавать через вкладку Codebase или выборочно импортировать из GitHub.

Читать далее

DeepSeek поднимает цены на API: в пиковые часы до 12 раз

Время на прочтение2 мин
Охват и читатели7.1K

DeepSeek объявили новые цены на API моделей V4 Flash и V4 Pro. Они начнут действовать 16 августа в 16:00 UTC, или в 19:00 по Москве.

Раньше API стоил одинаково круглые сутки. Теперь появятся часы пик: с 01:00 до 04:00 и с 06:00 до 10:00 UTC. В это время каждый токен будет стоить вдвое дороже, чем в остальные часы.

Но это не просто повышение в два раза. Сами базовые цены тоже выросли. Например, миллион выходных токенов V4 Flash сейчас стоит $0,28. После обновления он будет стоить $0,66 вне часов пик и $1,32 в часы пик: в 2,4 и 4,7 раза дороже соответственно.

Читать далее

Z.ai выпустили GLM-5.3: обошла Opus 4.8, но уступила Fable 5 и GPT-5.6 Sol

Время на прочтение1 мин
Охват и читатели10K

Z.ai выпустили GLM-5.3, новую модель для программирования и долгих агентных задач.

GLM-5.3 использует ту же базовую модель, что и GLM-5.2. Компания не меняла архитектуру и не проводила новый претрейн. Изменения внесли на этапе пост-тренинга: в течение месяца модель обучали с подкреплением на дополнительных рабочих окружениях.

На Terminal-Bench 3.0 результат вырос с 4,6% до 28,3%, на DeepSWE — с 46,2% до 66,9%. Веса обещают открыть через две недели, после дополнительной проверки безопасности.

Читать далее

DeepSeek Harness набрал 37 тысяч звёзд за первый день: что умеет новый кодинг‑агент

Время на прочтение3 мин
Охват и читатели26K

DeepSeek открыли исходный код DeepSeek Harness, новой среды для создания и запуска AI-агентов. Проект вышел в статусе developer preview под лицензией MIT.

Harness можно запустить одной командой через npx. Она поднимает локальный Web UI, в котором агент читает и редактирует файлы проекта, запускает команды, ищет информацию, строит планы и делегирует работу субагентам.

Главная особенность проекта заключается в архитектуре. Модели, инструменты, skills, сессии, песочницы, хранилище, оркестрация, интерфейс и даже сам цикл агента реализованы как заменяемые плагины. Разработчик может собрать собственную конфигурацию без форка ядра Harness.

Читать далее

OpenAI и Cerebras разогнали GPT-5.6 Sol до 750 токенов в секунду

Время на прочтение2 мин
Охват и читатели9.2K

OpenAI и Cerebras представили Ultrafast, новый режим обработки запросов GPT-5.6 Sol в OpenAI API. Он генерирует до 750 выходных токенов в секунду и работает до 14 раз быстрее Standard processing.

Это не отдельная облегчённая модель. Cerebras запускает полную GPT-5.6 Sol на своей инфраструктуре, поэтому, по заявлениям компаний, ускорение не требует снижать качество ответов. Пока Ultrafast доступен только ограниченной группе клиентов, а стоимость режима не раскрыта.

Читать далее

DeepSeek обновили V4 Pro: конкурент Fable 5, Kimi K3 и GLM 5.2

Время на прочтение1 мин
Охват и читатели13K

DeepSeek без большого анонса обновили V4 Pro. Новая версия уже работает в API под прежним ID deepseek-v4-pro, поэтому существующие интеграции переключатся на неё автоматически.

Главный прирост в задачах для coding-агентов. В Terminal Bench 2.1 модель набрала 87,9 балла против 72,1 у V4 Pro Preview. Это почти уровень Kimi K3 с 88,3 и Fable 5 с 88 баллами — и выше Opus 4.8 с 85.

Читать далее

xAI выпустили Grok 4.6: модель сравнялась с GPT-5.6 Sol

Время на прочтение2 мин
Охват и читатели10K

xAI представили Grok 4.6 — новую версию модели с упором на длительную работу AI-агентов, программирование и создание интерактивных приложений. По словам разработчиков, модель лучше удерживает многошаговые задачи, чаще проверяет собственные результаты и продолжает работу после первого подходящего решения.

В Artificial Analysis Intelligence Index новинка получила 61 балл — столько же, сколько GPT-5.6 Sol Max. Fable 5 Max набрала 62 балла, а Grok 4.5 High — 56.

Читать далее

SpaceXAI выпустили Grok Bot: мессенджер для взаимодействия с AI‑агентами

Время на прочтение2 мин
Охват и читатели5.1K

SpaceXAI представили Grok Bot — приложение для взаимодействия с AI-агентами. Продукт вышел 11 августа в формате ранней беты.

Grok Bot позволяет создавать ботов для разных задач и общаться с ними в формате мессенджера. Агенты работают на постоянном облачном компьютере, могут входить в приложения и на сайты, использовать сохранённые пользовательские сессии и выполнять многоэтапные задачи.

Читать далее

NVIDIA представили Nemotron 3.5 Lightning, быструю локальную модель

Время на прочтение2 мин
Охват и читатели7.1K

NVIDIA выпустили Nemotron 3.5 Lightning, новую открытую модель для локальных AI-агентов. Её можно скачать с Hugging Face и файлы модели занимают около 20 ГБ.

Nemotron 3.5 Lightning создавали прежде всего для скорости. NVIDIA предлагает использовать её в постоянно работающих агентах, которые пишут код, вызывают инструменты, проверяют результаты и выполняют большие очереди однотипных задач.

Читать далее

Spotify выпустили Xirp — единую среду для Claude Code, Codex и т.д

Время на прочтение2 мин
Охват и читатели8.4K

Spotify представили Xirp — независимую от поставщика среду для агентной разработки. Она позволяет запускать и управлять сессиями Claude Code, Gemini CLI и OpenAI Codex из одного приложения, переключаясь между агентами без потери контекста.

По данным компании, внутри Spotify инструментом уже пользуются более 1300 инженеров. Теперь разработчики и команды вне Spotify могут подать заявку на участие в бета-тестировании.

Читать далее

Новая модель OpenAI нашла более 400 уязвимостей в ядре популярной ОС

Время на прочтение2 мин
Охват и читатели6.1K

OpenAI выпустили GPT-5.6-Cyber, специализированную модель для исследования уязвимостей, разработки эксплойтов и проверки сложных цепочек атак.

Модель появилась в рамках программы Daybreak. Вместе с ней OpenAI представили два уровня доступа: Daybreak Blue с GPT-5.6 Sol для аудита кода, анализа вредоносного ПО и проверки патчей и Daybreak Red с GPT-5.6-Cyber для продвинутых исследований безопасности.

Читать далее

Meta выпустили Muse Glimmer 30B: локальная модель для кодинга помещается в 24 ГБ памяти

Время на прочтение2 мин
Охват и читатели10K

Meta открыли веса Muse Glimmer, мультимодальной модели на 30 млрд параметров для локальных AI-агентов и программирования. Модель опубликована на Hugging Face под лицензией Apache 2.0 и в квантизированном виде запускается на устройствах с 24 ГБ памяти.

Релиз состоялся через пять дней после выхода Muse Code, нового терминального кодинг-агента Meta. Агент пока находится в бете и работает на облачной Muse Spark 1.2. Компания также сообщила, что готовит более крупные и значительно более мощные модели, но не назвала дату их выпуска.

Читать далее

Anthropic сделает Auto mode режимом по умолчанию в Claude Code: люди пропустили 86,4% опасных команд

Время на прочтение3 мин
Охват и читатели15K

Anthropic объявили, что с 14 августа новые сессии Claude Code на тарифах Pro, Max и Team будут запускаться в Auto mode по умолчанию. В этом режиме агент не просит разрешение перед каждым действием: каждый вызов инструмента проверяет отдельный классификатор, который должен блокировать необратимые, разрушительные и выходящие за границы рабочего окружения операции.

По данным Anthropic, пользователи одобряют 97% запросов Claude Code на выполнение команд, а автоматическая проверка в контролируемом эксперименте обнаружила значительно больше опасных действий, чем люди.

Читать далее

JetBrains представили Context: семантический индекс репозиториев для Claude Code, Codex и Junie

Время на прочтение2 мин
Охват и читатели10K

JetBrains открыли ранний доступ к JetBrains Context — сервису, который создаёт семантический индекс программных репозиториев и предоставляет его кодовым агентам. Продукт интегрируется с Claude Code, Codex CLI и Junie CLI, а использовать его можно из IDE JetBrains, Air, Visual Studio Code и других редакторов.

При работе с крупным проектом кодовому агенту приходится многократно искать определения, читать файлы и запускать дополнительных агентов для изучения кодовой базы. JetBrains Context индексирует репозиторий постепенно и позволяет агенту запрашивать связанные фрагменты кода, реализации, API и зависимости по смыслу, а не только по ключевым словам.

Читать далее

JetBrains готовит IntelliJ IDEA к работе с Cursor, Codex и Claude Code через LSP

Время на прочтение2 мин
Охват и читатели8.4K

JetBrains представили предварительную версию расширения Java & Kotlin by IntelliJ IDEA для Visual Studio Code, Cursor и других редакторов на базе VS Code. Оно запускает в фоне LSP-сервер, использующий технологии анализа Java и Kotlin из IntelliJ IDEA.

Это не означает, что сама IntelliJ IDEA переходит на LSP или отказывается от собственной платформы анализа кода. В данном случае LSP используется для передачи возможностей IntelliJ IDEA во внешние редакторы.

Читать далее
1
23 ...

Информация

В рейтинге
Не участвует
Дата рождения
Зарегистрирован
Активность