Комментарии 9
Интересное решение, спасибо что поделились!
По stealth/union-alpha: интересно что за модель, судя по качеству она на уровне Opus 5 и Astra.
Спасибо за коммент) Рад, что разбор пригодился!) Модель только вчера выкатили - решил сразу "бросить её в бой" - как раз совпало что повод есть). Если кому-то пригодился такой тест-разбор - значит писал статью не зря))
По поводу качества эта union-alpha реально удивила. Помимо сильного самоанализа, она отработала в разы быстрее предыдущего stealth/ox‑alpha. Ну и само что мне зашло - на выходе получился чистый JSON, что в n8n не пришлось вручную убирать/добавлять ноды.
Интригует ещё вот какой момент: у stealth/ox‑alpha провайдеры хотя бы сразу прописали четкие сроки бесплатного периода а как только он кончился = сразу стало понятно, кто поставщик и что за модель). А тут вообще никакой конкретики по таймингам. Так что интрига двойная...
А тут вообще никакой конкретики по таймингам
Если правильно помню, предыдущие stealth модели были доступны от 1 до 2 недель.
да, вроде так было) у stealth/ox‑alpha неделя была - и сразу спустя это время выяснилось что за модель кто поставщик и сумма (хотя потом ещё неделю 50% скидки давали). а в данном случае абсолютно нет дедлайна
Всё, кончилась халява!
Вот тебе и неделя-две. (((
У меня постоянно были ошибки от нагрузки на модель, мне не зашла. Ох Альфа себя в разы лучше показала (GLM 5.3 flash). Пользуюсь ей до сих пор, чуть умнее соннета, но не дотягивает до опус. При оркестрировании опусом- идеально все делает. Долгое время на b.ai была бесплатной, пока обкатывали локалку, видимо)
про окс альфа у меня опыт её аналогичного теста был тоже - только там в разы по мощнее , на 60 млн. токенов - подробно опубликовал такой тест https://habr.com/ru/articles/1076084/ . Конечно на вкус и цвет товарищей нет) могу сказать что Pareto скорость выдала нереальную по сравнению с GLM 5.3 flash . Кстати в одном проекте опробовал не надолго в Visual code GLM 5.3 FlashX = кстати как и заявлено что скорость в разы от тёзки флэш модели лучше) вот только не знаю на счёт GLM 5.3 - на опен роутер в 2 раза дороже вышеперечисленных а по бенчмаркам апгрейд относительно 5.2 внушительный = на DeepSWE выдает 66.9% против прежних 46.2%)... явно затачивали под long-horizon задачи. Ей не пользовались?)


Не бенчмарком единым: стелс‑модель union‑alpha на реальной задаче — сутки от релиза до боя