про gpt 5.6 который оказался хуже 5.5 - да, всё так. Меня это тоже немного удивило. Но когда я после теста попользовался активно 5.6 sol по подписке Pro в режимах Max и Ultra и для решения довольно тривиальной задачи у него ушло 3 недельных лимита токенов (у меня накопились сбросы лимита в аккаунте) за 6 часов - посмотрев на результат я отменил подписку на Gpt и остался только с Claude на данный момент. Кстати это не еденичный случай - Opus 4.7 тоже показал себя немного хуже чем 4.6, но в топ он не попал тк было сделано не много прогонов. 4.8 потом отыгрался.
Да, по развитию моделей вы все правильно сказали. Но пока открытые модели значительно прокачались в навыках разработки, но все еще сильно проигрывают в бенчмарке фронтир моделям американских лабораторий. Возможно, к концу года появится 1-2 открытые модели которые пробьют порог в 50к$ в бенчмарке, очень хотелось бы.
Вы тут не совсем правы. ЛЛМ прерасно видит текущий день, всю прошлую статистику по дням, может делать записи так же по дням их получать. Информации более чем достаточно для принятия решений. Т.е даже просто в процессе симуляции данные собираются сами собой для последующего анализа и выводов.
Так же из эволюции ценообразования моделей в процессе симуляции, изменения меню, проведению экспериментов по локациям и прочим другим действиям можно смело сказать что они не начинают каждый день с чистого листа и "им стирают память".
И думаю вы в курсе про ограничение контекста текущих ЛЛМ и то как они экспонтенциально "глупеют" при его наполнении уже на 50-70%. Бенчмарк был спроектирован как раз таким образом, чтобы не перегружать модель контекстом, он тестирует не это. Средний объем конктекста в процессе симуляции у модели 30-50 тыс. токенов, что хорошо тянут модели с любым количеством параметров.
Это вы написали в нашей группе Vk о похожей проблеме? Если нет, скиньте пожалуйста ваш логин в сервисе в личку здесь, или в вконтакте.
Что касается вашего замечания по поводу правки объявлений. Сейчас упор сделан на максимальную простоту для пользователей и автоматизацию. Да, сервис просит ввести второй заголовок для тех объявлений, для которых он не смог его получить из исходника в Директе. Как он его может получить:
1. Если заголовок объявления в Директе длиннее 30 символов, последнее не поместившееся слово переносится во второй заголовок гугла. Если во втором заголовке остается место, то туда дополнительно подставляется начало текста объявления Директа до первой точки.
2. Если заголовок в директе короче 30 символов и у вас первая часть текста объявления в Директе короче 30 символов — в первый заголовок идет заголовок Директа, во второй — часть текста объявления. (это называется использованием длинных заголовков в Директе. при таком раскладе сервис у вас вообще ничего спрашивать дополнительно не будет касательно объявлений.)
Да, я понимаю, что это не совсем корректно. Для беты мне кажется это допустимым. Об этом есть упоминание в статье:
Сейчас мы работаем над ускорением процесса, а так же со временем добавим фоновую загрузку кампаний. Это сведет на нет проблему массового переноса кампаний с нескольких логинов одновременно.
Ты серьезно про лендинг?;) Шаблон же вордресовский. Я просто картинки подобрал и блоки построил. На первое время вполне.
Геннадий ещё неделю назад получил доступ, но до сих пор даже не затестил. Говорит — времени нет…
Спасибо, не знал о таком файле. Но всё-таки он про другое. Если переносить кампании из Директа старыми конвертерами, загрузить преобразованные данные из них в Adwords уже будет невозможно даже в виде «стандартных» объявлений — с 31 января 2017г. Adwords закрывает этот формат. Соотвественно и выгружать в файл который вы указали уже будет нечего.
Да, я понимаю, что рекомендации достаточно простые и много из этого можно найти в справке. Было бы здорово, если бы все заглядывали в эту самую справку.
про gpt 5.6 который оказался хуже 5.5 - да, всё так. Меня это тоже немного удивило. Но когда я после теста попользовался активно 5.6 sol по подписке Pro в режимах Max и Ultra и для решения довольно тривиальной задачи у него ушло 3 недельных лимита токенов (у меня накопились сбросы лимита в аккаунте) за 6 часов - посмотрев на результат я отменил подписку на Gpt и остался только с Claude на данный момент. Кстати это не еденичный случай - Opus 4.7 тоже показал себя немного хуже чем 4.6, но в топ он не попал тк было сделано не много прогонов. 4.8 потом отыгрался.
Да, по развитию моделей вы все правильно сказали. Но пока открытые модели значительно прокачались в навыках разработки, но все еще сильно проигрывают в бенчмарке фронтир моделям американских лабораторий. Возможно, к концу года появится 1-2 открытые модели которые пробьют порог в 50к$ в бенчмарке, очень хотелось бы.
Вы тут не совсем правы. ЛЛМ прерасно видит текущий день, всю прошлую статистику по дням, может делать записи так же по дням их получать. Информации более чем достаточно для принятия решений. Т.е даже просто в процессе симуляции данные собираются сами собой для последующего анализа и выводов.
Так же из эволюции ценообразования моделей в процессе симуляции, изменения меню, проведению экспериментов по локациям и прочим другим действиям можно смело сказать что они не начинают каждый день с чистого листа и "им стирают память".
И думаю вы в курсе про ограничение контекста текущих ЛЛМ и то как они экспонтенциально "глупеют" при его наполнении уже на 50-70%. Бенчмарк был спроектирован как раз таким образом, чтобы не перегружать модель контекстом, он тестирует не это. Средний объем конктекста в процессе симуляции у модели 30-50 тыс. токенов, что хорошо тянут модели с любым количеством параметров.
Что касается вашего замечания по поводу правки объявлений. Сейчас упор сделан на максимальную простоту для пользователей и автоматизацию. Да, сервис просит ввести второй заголовок для тех объявлений, для которых он не смог его получить из исходника в Директе. Как он его может получить:
1. Если заголовок объявления в Директе длиннее 30 символов, последнее не поместившееся слово переносится во второй заголовок гугла. Если во втором заголовке остается место, то туда дополнительно подставляется начало текста объявления Директа до первой точки.
2. Если заголовок в директе короче 30 символов и у вас первая часть текста объявления в Директе короче 30 символов — в первый заголовок идет заголовок Директа, во второй — часть текста объявления. (это называется использованием длинных заголовков в Директе. при таком раскладе сервис у вас вообще ничего спрашивать дополнительно не будет касательно объявлений.)
Геннадий ещё неделю назад получил доступ, но до сих пор даже не затестил. Говорит — времени нет…