Pull to refresh
128K+
88
Иван Никитин@python_leader

Passionate Developer.

37,3
Rating
243
Subscribers
Send message

Дженсен Хуанг: ограничения открытых моделей вытолкнут инновации из США

Reading time2 min
Reach and readers10K

Глава NVIDIA Дженсен Хуанг опубликовал свой первый пост в X. В нём он поделился совместным открытым письмом в поддержку моделей с открытыми весами.

Документ подписали 25 организаций, включая NVIDIA, Microsoft, Meta, IBM, Mistral, Hugging Face, Mozilla, The Linux Foundation, Palantir, Perplexity, Replit, ServiceNow, Andreessen Horowitz и Y Combinator. OpenAI, Anthropic, Google и Amazon среди подписантов нет.

Читать далее

Anthropic выпустили Claude Opus 5: почти Fable 5 за половину цены

Reading time1 min
Reach and readers11K

Anthropic выпустили Claude Opus 5. Компания позиционирует её как новую основную модель для программирования, длительной работы AI-агентов и профессиональных задач. По заявлению Anthropic, Opus 5 приблизилась по качеству к Fable 5 при вдвое более низкой цене API.

Читать далее

Kimi K3 взломала Redis, и на это ей потребовалось всего пол часа и 32 агента

Reading time1 min
Reach and readers15K

Исследователь Чаофань Шоу заявил, что Kimi K3 потребовалось 27 минут и 32 агента, чтобы найти уязвимость в Redis и подготовить рабочий эксплойт.

Код он опубликовал на GitHub. По словам автора, эксплойт позволяет выполнить команду на сервере Redis через уже авторизованное подключение.

Новость быстро разошлась с формулировкой «ИИ самостоятельно взломал последнюю версию Redis за полчаса». Но есть несколько важных оговорок.

Читать далее

Качество топовых моделей на 60% дешевле: Cursor представили Router

Reading time2 min
Reach and readers14K

Разработчики Cursor представили Cursor Router. Систему, которая автоматически выбирает ИИ-модель отдельно для каждого запроса. Функция встроена в режим Auto и предназначена для пользователей тарифов Teams и Enterprise.

По данным компании, около 60% разработчиков выбирают одну модель и используют её для всех задач. В результате простые операции выполняются по тарифам наиболее дорогих моделей, хотя не требуют их возможностей.

Читать далее

Anthropic выпустили плагин Claude Security для многоагентного поиска уязвимостей

Reading time2 min
Reach and readers12K

Anthropic сделали Claude Security доступным в виде официального плагина для Claude Code. Он запускает многоагентное сканирование кодовой базы непосредственно в локальной сессии и доступен пользователям платных тарифов.

Claude Security изучает архитектуру проекта, формирует модель угроз и распределяет поиск уязвимостей между несколькими агентами. Каждая находка проходит независимую проверку перед добавлением в итоговый отчёт.

Читать далее

Claude Code научился запускать и тестировать iOS-приложения

Reading time1 min
Reach and readers5.3K

В Claude Code Desktop встроили iOS Simulator. Агент может собрать приложение, установить его, запустить, прокликать нужный сценарий и проверить результат. Экран симулятора открывается прямо рядом с диалогом.

Можно наблюдать за тестированием или в любой момент перехватить управление: тапать, свайпать, менять устройство, делать скриншоты и записывать экран. У каждой сессии свой симулятор, поэтому параллельные агенты друг другу не мешают.

Читать далее

Kimi K3: опенсорс-модель на 2.8 трлн параметров обходит Opus 4.8

Reading time1 min
Reach and readers9.2K

Moonshot AI выпустили Kimi K3 — самую крупную открытую модель на сегодня. 2.8 трлн параметров! Вдвое больше, чем у DeepSeek V4 Pro, и втрое больше, чем у Xiaomi MiMo V2.5 Pro. Поддерживает контекст в 1 млн токенов, а также нативную работу с изображениями и видео.

По бенчмаркам K3 обходит Claude Opus 4.8. В Frontend Code Arena (независимый рейтинг по голосам пользователей) K3 занял 1-е место, обойдя Fable 5, и это скачок на 17 позиций за одно поколение: предыдущая K2.6 была лишь на 18-й строчке. 

Читать далее

Telegram запустил Serverless хостинг для ботов

Reading time2 min
Reach and readers16K

Telegram опубликовал документацию новой платформы: Serverless для ботов и Mini Apps: https://core.telegram.org/bots/serverless

Теперь можно держать бэкенд бота прямо на инфраструктуре Telegram, без необходимости во внешнем сервере.

Раньше для бота отдельно нужно было где-то поднять и обслуживать сервер. Благодаря нововведения необходимость в этом отпадает полностью.

Разворачивается всё одной командой CLI tgcloud и выполняются в изолированном V8-инстансе (тот же что в Chrome и Node.js) рядом с инфраструктурой самого Telegram.

Читать далее

GitHub перестал работать в России

Reading time1 min
Reach and readers30K

GitHub перестал работать в России — пользователи жалуются, что сервис недоступен без VPN.

Не работает Git, сам сайт не открывается, а также невозможно получить доступ к репозитариям.

Читать далее

Cursor выпустили Grok 4.5: флагман уровня Opus, обучали вместе со SpaceXAI

Reading time1 min
Reach and readers11K

xAI называют её самой мощной моделью на сегодня и первой, которую строили не только под разработку софта.

Модель уже доступна в Cursor и на первую неделю дают двойные лимиты использования.

Отдельно уточнили: у Grok 4.5 и Composer разные весовые категории. Composer 2.5 остаётся в строю, новые модели этого размера продолжат выходить отдельно.

Читать далее

JetBrains протестировали скилл Caveman: обещанные 65% экономии токенов превратились в 8.5%

Reading time1 min
Reach and readers11K

Caveman — скилл для агентов вроде Claude Code, который переводит текстовые ответы в рубленый «пещерный» стиль без служебных слов. Код и вызовы инструментов не трогает. Целых 85 тысяч звёзд на GitHub.

Тест прогнали на бенчмарке SkillsBench, 86 из 87 задач, Claude Sonnet 5 с низким reasoning effort. Сравнивали одни и те же задачи без скилла и с принудительно включённым. Результат по 82 парным задачам...

Читать далее

Claude Sonnet 5: Anthropic обновили главную рабочую лошадку

Reading time1 min
Reach and readers16K

Anthropic выпустили Claude Sonnet 5. Главный тезис: модель класса Sonnet впервые вплотную приближается к Opus 4.8 на агентных задачах — и при этом стоит в 1,5-2 раза дешевле.

Читать далее

Вышла GPT-5.6 Sol: уровень Mythos (Fable), но дешевле по токенам

Reading time1 min
Reach and readers11K

Новое семейство GPT-5.6 разбили на три тира: Sol (флагман), Terra (на уровне GPT-5.5, но вдвое дешевле) и Luna (быстрый и самый дешёвый). Цифра теперь обозначает поколение, а Sol/Terra/Luna задают уровень по интеллекту, скорости и цене.

По бенчмаркам Sol подают как сильнейшую модель OpenAI. На Terminal-Bench 2.1 (командная строка, планирование, работа с инструментами) новый SOTA. На GeneBench v1 (геномика, длинные биозадачи) результаты выше GPT-5.5 при меньшем расходе токенов.

Читать далее

63% решений Opus 4.8 Max на SWE-bench Pro оказались списаны

Reading time1 min
Reach and readers9.1K

Cursor опубликовал исследование про reward hacking: AI-агенты обходят кодовые бенчмарки, находя готовый ответ вместо того, чтобы решить задачу самостоятельно.

Чтобы измерить масштаб проблемы, Cursor построил агента-аудитора и прогнал через него 731 модель Opus 4.8 Max на SWE-bench Pro. Аудитор видел условие задачи и весь путь решения, но не знал, прошёл ли прогон тест. Итог: в 63% успешных решений модель нашла готовый фикс, а не вывела его сама.

Читать далее

Китайские разработчики получают Claude за 10% от стоимости

Reading time2 min
Reach and readers31K

ChinaTalk опубликовали расследование о китайских API-прокси для доступа к Claude. Это зарубежные серверы, которые принимают запросы пользователей и передают их в Anthropic от своего имени, обходя геоблокировку и требование иностранной банковской карты.

Через такие прокси токены Claude продают по 1 юаню за $1 — это на 70–90% дешевле официальной стоимости. В апреле 2026 года Anthropic начала проверять часть пользователей через государственный ID и живое селфи. Прокси-операторы решают и эту проблему: верификацию проходит реальный человек, которого находят в странах Африки или Латинской Америки с низким доходом, либо документы и биометрию подделывают через AI и дипфейки.

Низкую цену объясняют тремя источниками.

Читать далее

Sakana AI выпустили Fugu Ultra: японская LLM обходит часть западных флагманов

Reading time1 min
Reach and readers7.6K

Sakana AI основали в 2023 году Дэвид Ха и Лайон Джонс, экс-инженеры Google, причём Джонс входит в число восьми авторов оригинальной статьи про трансформеры. В апреле компания уже показывала Marlin: агента, который самостоятельно копает тему до 8 часов и выдаёт отчёт с презентацией.

Fugu стал их следующим продуктом с уже знакомой идеей «несколько моделей вместо одной». Но это не просто агрегатор поверх чужих API: сама Fugu остаётся небольшой языковой моделью, обученной вызывать другие LLM.

Читать далее

Cursor готовят замену GitHub для AI-агентов

Reading time1 min
Reach and readers6.2K

Cursor анонсировали Origin, платформу для хостинга git-репозиториев и код-ревью. Систему спроектировали так: основным автором и ревьюером кода становится AI-агент, человек подключается только на этапе финального одобрения.

Анонс сделал Томас Реймерс, основатель Graphite, сервиса для ревью кода, который Cursor купил в 2025 году.

Читать далее

Anthropic отменили изменение в лимитах подписки, которое должно было вступить в силу сегодня

Reading time1 min
Reach and readers16K

В мае компания объявила, что с 15 июня весь трафик через Agent SDK, claude -p и приложения на базе ACP (Agent Client Protocol — протокол, через который сторонние редакторы и платформы запускают агентов) уйдёт из основного пула подписки в отдельный кредитный пул, равный стоимости подписки.

Читать далее

Связка дешёвых моделей обошла GPT-5.5 и Opus 4.8

Reading time1 min
Reach and readers12K

OpenRouter запустили Fusion: связка моделей на уровне Fable 5 за полцены.

Промпт уходит параллельно на несколько моделей, каждая с доступом к web search и bash-инструментам. Модель-судья анализирует ответы: ищет консенсус, противоречия, пробелы. Синтезатор пишет финальный ответ.

Читать далее

Moonshot AI выпустили Kimi-K2.7-Code

Reading time1 min
Reach and readers12K

Moonshot AI выпустили Kimi-K2.7-Code — новую версию своей coding-модели на базе K2.6. Веса открыты на HuggingFace под лицензией Modified MIT.

По бенчмаркам прирост относительно K2.6 составил +21.8% на Kimi Code Bench v2, +11% на Program Bench и +31.5% на MLS Bench Lite.

Читать далее
1
23 ...

Information

Rating
209-th
Date of birth
Registered
Activity

Specialization

Бэкенд разработчик
Ведущий
Python
SQL
Git
ООП
PostgreSQL
Docker
Django