Обновить
128K+
88
Иван Никитин@python_leader

Passionate Developer.

32,8
Рейтинг
249
Подписчики
Отправить сообщение

Alibaba выпустили Qwen3.8-Max: стоит в четыре раза дешевле Opus 5, но уступает в сложном кодинге

Время на прочтение3 мин
Охват и читатели13K

Команда Qwen выпустила Qwen3.8-Max, новую флагманскую MoE-модель на 2,4 трлн параметров. На каждом токене активируются 95 млрд параметров, размер контекста составляет 1 млн токенов.

В API модель стоит $2 за миллион входных и $6 за миллион выходных токенов. Это в 2,5 раза дешевле Kimi K3 по генерации и больше чем в четыре раза дешевле Claude Opus 5.

Веса Qwen3.8-Max обещают опубликовать на Hugging Face и ModelScope на следующей неделе. Это будет первая модель Max-класса от Qwen с открытыми весами. Вместе с ней команда пообещала открыть веса Qwen3.8-27B.

Читать далее

1 224 сотрудника западных AI‑лабораторий попросили США придумать, как притормозить AI

Время на прочтение1 мин
Охват и читатели8.9K

1 224 сотрудника OpenAI, Anthropic, Google, Meta и других компаний подписали заявление Pacing the Frontier. Они просят правительство США поддержать международную разработку механизмов, которые позволят намеренно регулировать темп развития AI.

Среди первых подписантов — Дарио Амодеи, главные научные сотрудники OpenAI и Meta, а также топы Google DeepMind. Но важная деталь: это подписи сотрудников, а не официальные подписи самих компаний.

На момент проверки в полном списке нет ни одного сотрудника китайской AI-лаборатории.

Читать далее

JetBrains протестировали скилл Ponytail: объём кода сократился на 15%, а расходы на 10%

Время на прочтение4 мин
Охват и читатели16K

JetBrains опубликовали результаты тестирования Ponytail — скилла для coding-агентов, который должен бороться с оверинжинирингом. Он предлагает агенту сначала поискать самое простое решение и только после этого писать новый код.

Авторы Ponytail заявляют о сокращении объёма генерируемого кода на 54%, количества токенов — на 22%, расходов — на 20%, а времени выполнения задач — на 27%. В независимом тесте JetBrains показатели оказались скромнее, но скилл действительно сработал.

Читать далее

Дженсен Хуанг: ограничения открытых моделей вытолкнут инновации из США

Время на прочтение2 мин
Охват и читатели12K

Глава NVIDIA Дженсен Хуанг опубликовал свой первый пост в X. В нём он поделился совместным открытым письмом в поддержку моделей с открытыми весами.

Документ подписали 25 организаций, включая NVIDIA, Microsoft, Meta, IBM, Mistral, Hugging Face, Mozilla, The Linux Foundation, Palantir, Perplexity, Replit, ServiceNow, Andreessen Horowitz и Y Combinator. OpenAI, Anthropic, Google и Amazon среди подписантов нет.

Читать далее

Anthropic выпустили Claude Opus 5: почти Fable 5 за половину цены

Время на прочтение1 мин
Охват и читатели13K

Anthropic выпустили Claude Opus 5. Компания позиционирует её как новую основную модель для программирования, длительной работы AI-агентов и профессиональных задач. По заявлению Anthropic, Opus 5 приблизилась по качеству к Fable 5 при вдвое более низкой цене API.

Читать далее

Kimi K3 взломала Redis, и на это ей потребовалось всего пол часа и 32 агента

Время на прочтение1 мин
Охват и читатели16K

Исследователь Чаофань Шоу заявил, что Kimi K3 потребовалось 27 минут и 32 агента, чтобы найти уязвимость в Redis и подготовить рабочий эксплойт.

Код он опубликовал на GitHub. По словам автора, эксплойт позволяет выполнить команду на сервере Redis через уже авторизованное подключение.

Новость быстро разошлась с формулировкой «ИИ самостоятельно взломал последнюю версию Redis за полчаса». Но есть несколько важных оговорок.

Читать далее

Качество топовых моделей на 60% дешевле: Cursor представили Router

Время на прочтение2 мин
Охват и читатели15K

Разработчики Cursor представили Cursor Router. Систему, которая автоматически выбирает ИИ-модель отдельно для каждого запроса. Функция встроена в режим Auto и предназначена для пользователей тарифов Teams и Enterprise.

По данным компании, около 60% разработчиков выбирают одну модель и используют её для всех задач. В результате простые операции выполняются по тарифам наиболее дорогих моделей, хотя не требуют их возможностей.

Читать далее

Anthropic выпустили плагин Claude Security для многоагентного поиска уязвимостей

Время на прочтение2 мин
Охват и читатели13K

Anthropic сделали Claude Security доступным в виде официального плагина для Claude Code. Он запускает многоагентное сканирование кодовой базы непосредственно в локальной сессии и доступен пользователям платных тарифов.

Claude Security изучает архитектуру проекта, формирует модель угроз и распределяет поиск уязвимостей между несколькими агентами. Каждая находка проходит независимую проверку перед добавлением в итоговый отчёт.

Читать далее

Claude Code научился запускать и тестировать iOS-приложения

Время на прочтение1 мин
Охват и читатели5.5K

В Claude Code Desktop встроили iOS Simulator. Агент может собрать приложение, установить его, запустить, прокликать нужный сценарий и проверить результат. Экран симулятора открывается прямо рядом с диалогом.

Можно наблюдать за тестированием или в любой момент перехватить управление: тапать, свайпать, менять устройство, делать скриншоты и записывать экран. У каждой сессии свой симулятор, поэтому параллельные агенты друг другу не мешают.

Читать далее

Kimi K3: опенсорс-модель на 2.8 трлн параметров обходит Opus 4.8

Время на прочтение1 мин
Охват и читатели9.5K

Moonshot AI выпустили Kimi K3 — самую крупную открытую модель на сегодня. 2.8 трлн параметров! Вдвое больше, чем у DeepSeek V4 Pro, и втрое больше, чем у Xiaomi MiMo V2.5 Pro. Поддерживает контекст в 1 млн токенов, а также нативную работу с изображениями и видео.

По бенчмаркам K3 обходит Claude Opus 4.8. В Frontend Code Arena (независимый рейтинг по голосам пользователей) K3 занял 1-е место, обойдя Fable 5, и это скачок на 17 позиций за одно поколение: предыдущая K2.6 была лишь на 18-й строчке. 

Читать далее

Telegram запустил Serverless хостинг для ботов

Время на прочтение2 мин
Охват и читатели16K

Telegram опубликовал документацию новой платформы: Serverless для ботов и Mini Apps: https://core.telegram.org/bots/serverless

Теперь можно держать бэкенд бота прямо на инфраструктуре Telegram, без необходимости во внешнем сервере.

Раньше для бота отдельно нужно было где-то поднять и обслуживать сервер. Благодаря нововведения необходимость в этом отпадает полностью.

Разворачивается всё одной командой CLI tgcloud и выполняются в изолированном V8-инстансе (тот же что в Chrome и Node.js) рядом с инфраструктурой самого Telegram.

Читать далее

GitHub перестал работать в России

Время на прочтение1 мин
Охват и читатели31K

GitHub перестал работать в России — пользователи жалуются, что сервис недоступен без VPN.

Не работает Git, сам сайт не открывается, а также невозможно получить доступ к репозитариям.

Читать далее

Cursor выпустили Grok 4.5: флагман уровня Opus, обучали вместе со SpaceXAI

Время на прочтение1 мин
Охват и читатели11K

xAI называют её самой мощной моделью на сегодня и первой, которую строили не только под разработку софта.

Модель уже доступна в Cursor и на первую неделю дают двойные лимиты использования.

Отдельно уточнили: у Grok 4.5 и Composer разные весовые категории. Composer 2.5 остаётся в строю, новые модели этого размера продолжат выходить отдельно.

Читать далее

JetBrains протестировали скилл Caveman: обещанные 65% экономии токенов превратились в 8.5%

Время на прочтение1 мин
Охват и читатели11K

Caveman — скилл для агентов вроде Claude Code, который переводит текстовые ответы в рубленый «пещерный» стиль без служебных слов. Код и вызовы инструментов не трогает. Целых 85 тысяч звёзд на GitHub.

Тест прогнали на бенчмарке SkillsBench, 86 из 87 задач, Claude Sonnet 5 с низким reasoning effort. Сравнивали одни и те же задачи без скилла и с принудительно включённым. Результат по 82 парным задачам...

Читать далее

Claude Sonnet 5: Anthropic обновили главную рабочую лошадку

Время на прочтение1 мин
Охват и читатели16K

Anthropic выпустили Claude Sonnet 5. Главный тезис: модель класса Sonnet впервые вплотную приближается к Opus 4.8 на агентных задачах — и при этом стоит в 1,5-2 раза дешевле.

Читать далее

Вышла GPT-5.6 Sol: уровень Mythos (Fable), но дешевле по токенам

Время на прочтение1 мин
Охват и читатели11K

Новое семейство GPT-5.6 разбили на три тира: Sol (флагман), Terra (на уровне GPT-5.5, но вдвое дешевле) и Luna (быстрый и самый дешёвый). Цифра теперь обозначает поколение, а Sol/Terra/Luna задают уровень по интеллекту, скорости и цене.

По бенчмаркам Sol подают как сильнейшую модель OpenAI. На Terminal-Bench 2.1 (командная строка, планирование, работа с инструментами) новый SOTA. На GeneBench v1 (геномика, длинные биозадачи) результаты выше GPT-5.5 при меньшем расходе токенов.

Читать далее

63% решений Opus 4.8 Max на SWE-bench Pro оказались списаны

Время на прочтение1 мин
Охват и читатели9.1K

Cursor опубликовал исследование про reward hacking: AI-агенты обходят кодовые бенчмарки, находя готовый ответ вместо того, чтобы решить задачу самостоятельно.

Чтобы измерить масштаб проблемы, Cursor построил агента-аудитора и прогнал через него 731 модель Opus 4.8 Max на SWE-bench Pro. Аудитор видел условие задачи и весь путь решения, но не знал, прошёл ли прогон тест. Итог: в 63% успешных решений модель нашла готовый фикс, а не вывела его сама.

Читать далее

Китайские разработчики получают Claude за 10% от стоимости

Время на прочтение2 мин
Охват и читатели31K

ChinaTalk опубликовали расследование о китайских API-прокси для доступа к Claude. Это зарубежные серверы, которые принимают запросы пользователей и передают их в Anthropic от своего имени, обходя геоблокировку и требование иностранной банковской карты.

Через такие прокси токены Claude продают по 1 юаню за $1 — это на 70–90% дешевле официальной стоимости. В апреле 2026 года Anthropic начала проверять часть пользователей через государственный ID и живое селфи. Прокси-операторы решают и эту проблему: верификацию проходит реальный человек, которого находят в странах Африки или Латинской Америки с низким доходом, либо документы и биометрию подделывают через AI и дипфейки.

Низкую цену объясняют тремя источниками.

Читать далее

Sakana AI выпустили Fugu Ultra: японская LLM обходит часть западных флагманов

Время на прочтение1 мин
Охват и читатели7.6K

Sakana AI основали в 2023 году Дэвид Ха и Лайон Джонс, экс-инженеры Google, причём Джонс входит в число восьми авторов оригинальной статьи про трансформеры. В апреле компания уже показывала Marlin: агента, который самостоятельно копает тему до 8 часов и выдаёт отчёт с презентацией.

Fugu стал их следующим продуктом с уже знакомой идеей «несколько моделей вместо одной». Но это не просто агрегатор поверх чужих API: сама Fugu остаётся небольшой языковой моделью, обученной вызывать другие LLM.

Читать далее

Cursor готовят замену GitHub для AI-агентов

Время на прочтение1 мин
Охват и читатели6.2K

Cursor анонсировали Origin, платформу для хостинга git-репозиториев и код-ревью. Систему спроектировали так: основным автором и ревьюером кода становится AI-агент, человек подключается только на этапе финального одобрения.

Анонс сделал Томас Реймерс, основатель Graphite, сервиса для ревью кода, который Cursor купил в 2025 году.

Читать далее
1
23 ...

Информация

В рейтинге
246-й
Дата рождения
Зарегистрирован
Активность

Специализация

Бэкенд разработчик
Ведущий
Python
SQL
Git
ООП
PostgreSQL
Docker
Django