Модель теперь умеет взаимодействовать с программами так же, как и человек: нажимать кнопки, заполнять формы, работать с таблицами и редакторами без специального ПО.
Утверждение - "без специального ПО" - не соответствует действительности. Модель не управляет компьютером напрямую. Она просит внешнюю программу выполнить действие.
Этот инструмент доступен только через API, должен быть реализован разработчиком, и требует среды, которая выполняет клики и ввод.
Вы серьёзно? Такое впечатление, что автор стать не полностью разобралась в теме. Пишут, ещё как пишут, им только дай волю. Другое дело, насколько это работает. Причём ответ не такой однозначный как можно подумать.
Написание спецификаций. Самый ценный навык в 2026 - не кодинг, а написание точных, недвусмысленных спецификаций
Ещё раз повторю вопрос, Софья, вы это серьёзно? А то, что в моделях появились специальные режимы планирования, это ни о чем не говорит? Да уже и раньше достаточно было вызвать уточняющие вопросы и модель выдавала массу подробностей, о которых сам разработчик мог узнать только во второй половине проекта.
Оркестрация агентов.
Cursor и Claude Code делают это автоматом.
Контекст-инжиниринг. Обеспечение агентов правильной документацией, ограничениями и примерами.
А вот здесь да, вполне можно согласиться. Это сейчас выходит на первый план. Но и LLM тоже не стоят на месте. Например, тот же Claude Code может теперь просто по названию проекта поднять несколько предыдущих сессий и подхватить их контекст. Поэтому и создавать контекст вручную, без использования того же LLM, это уже потеря времени.
Как сильно замедляются запросы, когда выходишь за лимиты?
Они вроде как не замедляются, просто к месячной подписке добавляется ещё и дополнительная оплата, теперь уже конкретно по количеству токенов
В целом у меня есть вопросы которые можно и моделям попроще кормить, а есть которые хочется получить максимальное качество, видимо теперь придётся думать у кого спрашивать.
Именно так и получается, что не сильно хочется палить из дорогой пушки (Опус) по воробьям, если можно на простых задачах обойтись Сонетом.
Я не понял из статьи, а почему "прощай, cursor" то?
Ну вот, смотрите: есть две платные подписки - Cursor и Claude. У Cursor главная фишка - модели работают непосредственно с кодом проекта без копипаста. Теперь такая же фишка появилась у Claude и получается, что можно обойтись одним Claude без Cursor.
Там и добавлять не надо, поскольку он там уже есть. Так вот речь и о том, что теперь Claude Code сам по себе без Cursor встраивается в проект и работает не только в режиме CLI
ну так это как раз и подтверждает сказанное выше на примере - "Enterprise-бекенд, от десятков до сотен тысяч строк кода в контексте"
Его (Opus) выгодно использовать - финтех, критичные бекенды, сложная оптимизация, редкий, но тяжёлый ресёрч‑рефакторинг.
А если в проекте нет такой сложности, то стоит ли платить больше? Я вот уже несколько дней подряд на Опусе очень быстро упираюсь в лимит, буквально в рамках одного не самого большого чата. Но в целом, моя исходная постановка вопроса была не совсем правильной. Не какую модель выбрать, а можно использовать разные (из этих двух) под разные задачи. Другое дело, что не всегда заранее можно понять, будет ли задача простой или сложной. Иногда вроде мелочь, а растягивается на пару дней.
А вот что говорят другие, по отзывам в интернете. Что называется, есть нюансы.
На реальных задачах разрыв между актуальными Opus и Sonnet небольшой: оба решают большую долю задач.
В предыдущих версиях, Sonnet 3.5, например, лучше справлялся с типичными задачами кодинга, а Opus брал глубиной рассуждений. Сейчас линейки сблизились.
Opus дороже за токен, что очень даже заметно. Его выгодно использовать - финтех, критичные бекенды, сложная оптимизация, редкий, но тяжёлый ресёрч‑рефакторинг.
Sonnet оптимален как «рабочая лошадка» для повседневной разработки.
Насчёт лимитов ещё не успел проверить Claude Code. Но вот несколько дней назад работал ещё с чатом Claude и там пару раз нарывался на расходование дневного лимита. Раньше такого как-то не было, никаких сообщений не появлялось.
Насчёт людей компьютеров и как с их помощью НАСА делала расчёты для лунных полётов есть недавний классный фильм "Скрытые фигуры", где Кевин Костнер командует целыми толпами людей, которые пишут на бумажках. И все время резало слух это слово "компьютинг", когда вроде и компьютеров у них ещё не было.
Когда-то давно узнал такой лайфхак, что иногда можно понять, что ты находишься во сне. И тогда можно делать удивительные вещи. Запомнилась, увы, только одна, что можно забраться на высокую гору и задать вопрос восседающему там мудрецу. Причём вопрос очень важный, например, о смысле жизни, о том, что делать в той или иной сложной ситуации и т.д.
Но зато научился другому лайфхаку. Если снится плохой сон, то не выходя из этого сна переделываю его, чтобы был хэппи-энд.
Как один из вариантов оценки сегодняшнего состояния ситуации с ИИ - да. Но не как абсолютный и единственный. Стакан как всегда или наполовину пуст, или наполовину полон.
Утверждение - "без специального ПО" - не соответствует действительности. Модель не управляет компьютером напрямую. Она просит внешнюю программу выполнить действие.
Этот инструмент доступен только через API, должен быть реализован разработчиком, и требует среды, которая выполняет клики и ввод.
Вы серьёзно? Такое впечатление, что автор стать не полностью разобралась в теме. Пишут, ещё как пишут, им только дай волю. Другое дело, насколько это работает. Причём ответ не такой однозначный как можно подумать.
Ещё раз повторю вопрос, Софья, вы это серьёзно? А то, что в моделях появились специальные режимы планирования, это ни о чем не говорит? Да уже и раньше достаточно было вызвать уточняющие вопросы и модель выдавала массу подробностей, о которых сам разработчик мог узнать только во второй половине проекта.
Cursor и Claude Code делают это автоматом.
А вот здесь да, вполне можно согласиться. Это сейчас выходит на первый план. Но и LLM тоже не стоят на месте. Например, тот же Claude Code может теперь просто по названию проекта поднять несколько предыдущих сессий и подхватить их контекст. Поэтому и создавать контекст вручную, без использования того же LLM, это уже потеря времени.
Полностью согласен, ощущение просто сложно передать, что-то вроде терминатора, который рушит все на своём пути.
Дуо, Дуо, лучше бы они больше времени уделяли обновлению упражнений. ИИ здесь просто незаменим, но пока его там не особо видно.
Надо полюбить чувство голода
Gemini в последнее время явно прогрессирует.
LOL: Реинкарнация "Пегого Дудочника"? ))
https://www.youtube.com/watch?v=Dy3FXLfAYcQ
А как именно он маскируется?
"давно" было в MAX, а теперь это и в Pro.
Они вроде как не замедляются, просто к месячной подписке добавляется ещё и дополнительная оплата, теперь уже конкретно по количеству токенов
Именно так и получается, что не сильно хочется палить из дорогой пушки (Опус) по воробьям, если можно на простых задачах обойтись Сонетом.
Ну так это же на MAX! ))
Ну вот, смотрите: есть две платные подписки - Cursor и Claude. У Cursor главная фишка - модели работают непосредственно с кодом проекта без копипаста. Теперь такая же фишка появилась у Claude и получается, что можно обойтись одним Claude без Cursor.
Там и добавлять не надо, поскольку он там уже есть. Так вот речь и о том, что теперь Claude Code сам по себе без Cursor встраивается в проект и работает не только в режиме CLI
ну так это как раз и подтверждает сказанное выше на примере - "Enterprise-бекенд, от десятков до сотен тысяч строк кода в контексте"
А если в проекте нет такой сложности, то стоит ли платить больше? Я вот уже несколько дней подряд на Опусе очень быстро упираюсь в лимит, буквально в рамках одного не самого большого чата. Но в целом, моя исходная постановка вопроса была не совсем правильной. Не какую модель выбрать, а можно использовать разные (из этих двух) под разные задачи. Другое дело, что не всегда заранее можно понять, будет ли задача простой или сложной. Иногда вроде мелочь, а растягивается на пару дней.
А вот что говорят другие, по отзывам в интернете. Что называется, есть нюансы.
На реальных задачах разрыв между актуальными Opus и Sonnet небольшой: оба решают большую долю задач.
В предыдущих версиях, Sonnet 3.5, например, лучше справлялся с типичными задачами кодинга, а Opus брал глубиной рассуждений. Сейчас линейки сблизились.
Opus дороже за токен, что очень даже заметно. Его выгодно использовать - финтех, критичные бекенды, сложная оптимизация, редкий, но тяжёлый ресёрч‑рефакторинг.
Sonnet оптимален как «рабочая лошадка» для повседневной разработки.
а почему именно Opus, а не Sonnet?
Насчёт лимитов ещё не успел проверить Claude Code. Но вот несколько дней назад работал ещё с чатом Claude и там пару раз нарывался на расходование дневного лимита. Раньше такого как-то не было, никаких сообщений не появлялось.
Насчёт людей компьютеров и как с их помощью НАСА делала расчёты для лунных полётов есть недавний классный фильм "Скрытые фигуры", где Кевин Костнер командует целыми толпами людей, которые пишут на бумажках. И все время резало слух это слово "компьютинг", когда вроде и компьютеров у них ещё не было.
Когда-то давно узнал такой лайфхак, что иногда можно понять, что ты находишься во сне. И тогда можно делать удивительные вещи. Запомнилась, увы, только одна, что можно забраться на высокую гору и задать вопрос восседающему там мудрецу. Причём вопрос очень важный, например, о смысле жизни, о том, что делать в той или иной сложной ситуации и т.д.
Но зато научился другому лайфхаку. Если снится плохой сон, то не выходя из этого сна переделываю его, чтобы был хэппи-энд.
Как один из вариантов оценки сегодняшнего состояния ситуации с ИИ - да. Но не как абсолютный и единственный. Стакан как всегда или наполовину пуст, или наполовину полон.