Pull to refresh
128K+
88
Иван Никитин@python_leader

Passionate Developer.

34,9
Rating
253
Subscribers
Send message

DeepSeek поднимает цены на API: в пиковые часы до 12 раз

Reading time2 min
Reach and readers5.9K

DeepSeek объявили новые цены на API моделей V4 Flash и V4 Pro. Они начнут действовать 16 августа в 16:00 UTC, или в 19:00 по Москве.

Раньше API стоил одинаково круглые сутки. Теперь появятся часы пик: с 01:00 до 04:00 и с 06:00 до 10:00 UTC. В это время каждый токен будет стоить вдвое дороже, чем в остальные часы.

Но это не просто повышение в два раза. Сами базовые цены тоже выросли. Например, миллион выходных токенов V4 Flash сейчас стоит $0,28. После обновления он будет стоить $0,66 вне часов пик и $1,32 в часы пик: в 2,4 и 4,7 раза дороже соответственно.

Читать далее

Z.ai выпустили GLM-5.3: обошла Opus 4.8, но уступила Fable 5 и GPT-5.6 Sol

Reading time1 min
Reach and readers7.4K

Z.ai выпустили GLM-5.3, новую модель для программирования и долгих агентных задач.

GLM-5.3 использует ту же базовую модель, что и GLM-5.2. Компания не меняла архитектуру и не проводила новый претрейн. Изменения внесли на этапе пост-тренинга: в течение месяца модель обучали с подкреплением на дополнительных рабочих окружениях.

На Terminal-Bench 3.0 результат вырос с 4,6% до 28,3%, на DeepSWE — с 46,2% до 66,9%. Веса обещают открыть через две недели, после дополнительной проверки безопасности.

Читать далее

DeepSeek Harness набрал 37 тысяч звёзд за первый день: что умеет новый кодинг‑агент

Reading time3 min
Reach and readers23K

DeepSeek открыли исходный код DeepSeek Harness, новой среды для создания и запуска AI-агентов. Проект вышел в статусе developer preview под лицензией MIT.

Harness можно запустить одной командой через npx. Она поднимает локальный Web UI, в котором агент читает и редактирует файлы проекта, запускает команды, ищет информацию, строит планы и делегирует работу субагентам.

Главная особенность проекта заключается в архитектуре. Модели, инструменты, skills, сессии, песочницы, хранилище, оркестрация, интерфейс и даже сам цикл агента реализованы как заменяемые плагины. Разработчик может собрать собственную конфигурацию без форка ядра Harness.

Читать далее

OpenAI и Cerebras разогнали GPT-5.6 Sol до 750 токенов в секунду

Reading time2 min
Reach and readers8.8K

OpenAI и Cerebras представили Ultrafast, новый режим обработки запросов GPT-5.6 Sol в OpenAI API. Он генерирует до 750 выходных токенов в секунду и работает до 14 раз быстрее Standard processing.

Это не отдельная облегчённая модель. Cerebras запускает полную GPT-5.6 Sol на своей инфраструктуре, поэтому, по заявлениям компаний, ускорение не требует снижать качество ответов. Пока Ultrafast доступен только ограниченной группе клиентов, а стоимость режима не раскрыта.

Читать далее

DeepSeek обновили V4 Pro: конкурент Fable 5, Kimi K3 и GLM 5.2

Reading time1 min
Reach and readers12K

DeepSeek без большого анонса обновили V4 Pro. Новая версия уже работает в API под прежним ID deepseek-v4-pro, поэтому существующие интеграции переключатся на неё автоматически.

Главный прирост в задачах для coding-агентов. В Terminal Bench 2.1 модель набрала 87,9 балла против 72,1 у V4 Pro Preview. Это почти уровень Kimi K3 с 88,3 и Fable 5 с 88 баллами — и выше Opus 4.8 с 85.

Читать далее

xAI выпустили Grok 4.6: модель сравнялась с GPT-5.6 Sol

Reading time2 min
Reach and readers9.9K

xAI представили Grok 4.6 — новую версию модели с упором на длительную работу AI-агентов, программирование и создание интерактивных приложений. По словам разработчиков, модель лучше удерживает многошаговые задачи, чаще проверяет собственные результаты и продолжает работу после первого подходящего решения.

В Artificial Analysis Intelligence Index новинка получила 61 балл — столько же, сколько GPT-5.6 Sol Max. Fable 5 Max набрала 62 балла, а Grok 4.5 High — 56.

Читать далее

SpaceXAI выпустили Grok Bot: мессенджер для взаимодействия с AI‑агентами

Reading time2 min
Reach and readers4.4K

SpaceXAI представили Grok Bot — приложение для взаимодействия с AI-агентами. Продукт вышел 11 августа в формате ранней беты.

Grok Bot позволяет создавать ботов для разных задач и общаться с ними в формате мессенджера. Агенты работают на постоянном облачном компьютере, могут входить в приложения и на сайты, использовать сохранённые пользовательские сессии и выполнять многоэтапные задачи.

Читать далее

NVIDIA представили Nemotron 3.5 Lightning, быструю локальную модель

Reading time2 min
Reach and readers6.6K

NVIDIA выпустили Nemotron 3.5 Lightning, новую открытую модель для локальных AI-агентов. Её можно скачать с Hugging Face и файлы модели занимают около 20 ГБ.

Nemotron 3.5 Lightning создавали прежде всего для скорости. NVIDIA предлагает использовать её в постоянно работающих агентах, которые пишут код, вызывают инструменты, проверяют результаты и выполняют большие очереди однотипных задач.

Читать далее

Spotify выпустили Xirp — единую среду для Claude Code, Codex и т.д

Reading time2 min
Reach and readers8.3K

Spotify представили Xirp — независимую от поставщика среду для агентной разработки. Она позволяет запускать и управлять сессиями Claude Code, Gemini CLI и OpenAI Codex из одного приложения, переключаясь между агентами без потери контекста.

По данным компании, внутри Spotify инструментом уже пользуются более 1300 инженеров. Теперь разработчики и команды вне Spotify могут подать заявку на участие в бета-тестировании.

Читать далее

Новая модель OpenAI нашла более 400 уязвимостей в ядре популярной ОС

Reading time2 min
Reach and readers6K

OpenAI выпустили GPT-5.6-Cyber, специализированную модель для исследования уязвимостей, разработки эксплойтов и проверки сложных цепочек атак.

Модель появилась в рамках программы Daybreak. Вместе с ней OpenAI представили два уровня доступа: Daybreak Blue с GPT-5.6 Sol для аудита кода, анализа вредоносного ПО и проверки патчей и Daybreak Red с GPT-5.6-Cyber для продвинутых исследований безопасности.

Читать далее

Meta выпустили Muse Glimmer 30B: локальная модель для кодинга помещается в 24 ГБ памяти

Reading time2 min
Reach and readers9.5K

Meta открыли веса Muse Glimmer, мультимодальной модели на 30 млрд параметров для локальных AI-агентов и программирования. Модель опубликована на Hugging Face под лицензией Apache 2.0 и в квантизированном виде запускается на устройствах с 24 ГБ памяти.

Релиз состоялся через пять дней после выхода Muse Code, нового терминального кодинг-агента Meta. Агент пока находится в бете и работает на облачной Muse Spark 1.2. Компания также сообщила, что готовит более крупные и значительно более мощные модели, но не назвала дату их выпуска.

Читать далее

Anthropic сделает Auto mode режимом по умолчанию в Claude Code: люди пропустили 86,4% опасных команд

Reading time3 min
Reach and readers15K

Anthropic объявили, что с 14 августа новые сессии Claude Code на тарифах Pro, Max и Team будут запускаться в Auto mode по умолчанию. В этом режиме агент не просит разрешение перед каждым действием: каждый вызов инструмента проверяет отдельный классификатор, который должен блокировать необратимые, разрушительные и выходящие за границы рабочего окружения операции.

По данным Anthropic, пользователи одобряют 97% запросов Claude Code на выполнение команд, а автоматическая проверка в контролируемом эксперименте обнаружила значительно больше опасных действий, чем люди.

Читать далее

JetBrains представили Context: семантический индекс репозиториев для Claude Code, Codex и Junie

Reading time2 min
Reach and readers9.9K

JetBrains открыли ранний доступ к JetBrains Context — сервису, который создаёт семантический индекс программных репозиториев и предоставляет его кодовым агентам. Продукт интегрируется с Claude Code, Codex CLI и Junie CLI, а использовать его можно из IDE JetBrains, Air, Visual Studio Code и других редакторов.

При работе с крупным проектом кодовому агенту приходится многократно искать определения, читать файлы и запускать дополнительных агентов для изучения кодовой базы. JetBrains Context индексирует репозиторий постепенно и позволяет агенту запрашивать связанные фрагменты кода, реализации, API и зависимости по смыслу, а не только по ключевым словам.

Читать далее

JetBrains готовит IntelliJ IDEA к работе с Cursor, Codex и Claude Code через LSP

Reading time2 min
Reach and readers8.3K

JetBrains представили предварительную версию расширения Java & Kotlin by IntelliJ IDEA для Visual Studio Code, Cursor и других редакторов на базе VS Code. Оно запускает в фоне LSP-сервер, использующий технологии анализа Java и Kotlin из IntelliJ IDEA.

Это не означает, что сама IntelliJ IDEA переходит на LSP или отказывается от собственной платформы анализа кода. В данном случае LSP используется для передачи возможностей IntelliJ IDEA во внешние редакторы.

Читать далее

Вышел Agent Plugins 1.0: единый формат расширений для Codex, Cursor и Copilot

Reading time2 min
Reach and readers11K

Vercel объявили о публичной доступности Agent Plugins 1.0.0: открытого и независимого от конкретного вендора формата для упаковки расширений ИИ-агентов. Стандарт позволяет объединить Agent Skills и MCP-серверы в один переносимый плагин.

Сейчас разработчикам расширений часто приходится адаптировать один и тот же Skill или MCP-сервер под форматы разных клиентов. Agent Plugins предлагает общую структуру каталога.

Читать далее

DeepSeek предупредили о «значительном» повышении цен на API

Reading time1 min
Reach and readers15K

В личных кабинетах DeepSeek Open Platform появился баннер о предстоящем повышении цен на API. Пользователям сервиса также начали приходить письма с тем же предупреждением.

DeepSeek пишет, что планирует «значительно» повысить общие цены на API-сервисы. Новую тарифную сетку и дату её вступления в силу компания пока не опубликовала и просит следить за объявлениями на платформе и электронной почтой.

Читать далее

Alibaba выпустили Qwen3.8-Max: стоит в четыре раза дешевле Opus 5, но уступает в сложном кодинге

Reading time3 min
Reach and readers14K

Команда Qwen выпустила Qwen3.8-Max, новую флагманскую MoE-модель на 2,4 трлн параметров. На каждом токене активируются 95 млрд параметров, размер контекста составляет 1 млн токенов.

В API модель стоит $2 за миллион входных и $6 за миллион выходных токенов. Это в 2,5 раза дешевле Kimi K3 по генерации и больше чем в четыре раза дешевле Claude Opus 5.

Веса Qwen3.8-Max обещают опубликовать на Hugging Face и ModelScope на следующей неделе. Это будет первая модель Max-класса от Qwen с открытыми весами. Вместе с ней команда пообещала открыть веса Qwen3.8-27B.

Читать далее

1 224 сотрудника западных AI‑лабораторий попросили США придумать, как притормозить AI

Reading time1 min
Reach and readers9K

1 224 сотрудника OpenAI, Anthropic, Google, Meta и других компаний подписали заявление Pacing the Frontier. Они просят правительство США поддержать международную разработку механизмов, которые позволят намеренно регулировать темп развития AI.

Среди первых подписантов — Дарио Амодеи, главные научные сотрудники OpenAI и Meta, а также топы Google DeepMind. Но важная деталь: это подписи сотрудников, а не официальные подписи самих компаний.

На момент проверки в полном списке нет ни одного сотрудника китайской AI-лаборатории.

Читать далее

JetBrains протестировали скилл Ponytail: объём кода сократился на 15%, а расходы на 10%

Reading time4 min
Reach and readers16K

JetBrains опубликовали результаты тестирования Ponytail — скилла для coding-агентов, который должен бороться с оверинжинирингом. Он предлагает агенту сначала поискать самое простое решение и только после этого писать новый код.

Авторы Ponytail заявляют о сокращении объёма генерируемого кода на 54%, количества токенов — на 22%, расходов — на 20%, а времени выполнения задач — на 27%. В независимом тесте JetBrains показатели оказались скромнее, но скилл действительно сработал.

Читать далее

Дженсен Хуанг: ограничения открытых моделей вытолкнут инновации из США

Reading time2 min
Reach and readers12K

Глава NVIDIA Дженсен Хуанг опубликовал свой первый пост в X. В нём он поделился совместным открытым письмом в поддержку моделей с открытыми весами.

Документ подписали 25 организаций, включая NVIDIA, Microsoft, Meta, IBM, Mistral, Hugging Face, Mozilla, The Linux Foundation, Palantir, Perplexity, Replit, ServiceNow, Andreessen Horowitz и Y Combinator. OpenAI, Anthropic, Google и Amazon среди подписантов нет.

Читать далее
1
23 ...

Information

Rating
229-th
Date of birth
Registered
Activity

Specialization

Бэкенд разработчик
Ведущий
Python
SQL
Git
ООП
PostgreSQL
Docker
Django