Комментарии 1
GPT гораздо лучше ваншотит, он может не совсем корректно внести изменения, особенно по части гуев, но после него приблуда на питоне или реакте запускается гарантированно. После Opus стабильно минимум один проход, чтобы вообще поднять бекенд.
А вот по решению задач Opus гораздо лучше, я сейчас в рамках эксперимента прикручиваю к игре Starsector мультиплеер, и пока GPT переписывает туда-сюда тесты и пытается угадать названия внутриигровых команд и переменных, Claude просто декомпилит код и ищет их там. И, что характерно, находит. Комбо из Opus (high или max) как планировщика и GPT5.5 как исполнителя сейчас очень нравится.
Это все в рамках вайбкода, то есть я сам код могу только примерно почувствовать, писать не умею.
UP: а, еще GPT наотрез отказывается помогать с обходом ТСПУ. Клоду скармливаю целые статьи и форумы, обсуждаю, выбираем что и как прикрутить - Codex просто "у меня кибербезопасность, я на вас пожалуюсь". Claude только один раз подвел, когда на следующий день после написания VK TURN Tunnel отказался дальше его редачить, потому что до него "вдруг" дошло, что он чью-то инфраструктуру не по назначению использует.

SWE-rebench: Opus 4.8 стал экономнее, но в эффективности уступил GPT-5.5