Как вам могли фуры молча привезти и позвонить только за полчаса до разгрузки, если их еще растаможить должны были и вам как минимум уведомление об этом должно было прийти? Да и как тысяча немаркированных коробок таможню вообще прошла?
Не нужна там треть бюджета. Там много, но реально. Вон Диспик хвастается что учат всего на 10 тысячах видеокарт. Это тоже не сдача от покупки кофе, но вполне разумные деньги для бигтеха.
Ну это, кстати, к вопросу о специалистах - вот Греф прям отрицает что есть кадровая проблема, но она очевидно есть. Судя по последней модели Сбера там все плюс-минус нормально с претрейном, но прям печально с пост-трейном - т.е. SFT + RL, причем настолько что многие популярные бенчи не приведены, с V4 Flash (которая была в сравнении базовых моделей) нету сравнения в non-thinking режиме, только с не особо удачной v3.2 exp, которой Гигачат еще и уступает на многих бенчах. Имхо, как раз сказывается недостаток скилловых RL спецов на российском рынке.
За ссылку спасибо. Но если так все плохо, то значит reasoning они все-таки еще толком не освоили - он может формально есть, но работает хуже чем у того же R1 (не 05-28, а январского).
Ну где-то так и получается, это уровень Claude 3.5 Sonnet примерно.
Ну хз, вроде по бенчам все-таки не дотягивает. Скорее ближе к Claude 3 Sonnet - где-то хуже, где-то лучше. Как-то напрягает, что они прям старательно избегают мерить многие популярные бенчи для Instruct модели и только базовые на них сравнивают. Видимо там все довольно плохо - судя по всему сказывается то, что в России почти нет сильных специалистов по RL, который сейчас чуть ли не ключевой компонент пост трейна. Недавно как раз видел вакансии от Сбера на RL с обещаниями зарплаты в 1 млн+ :)
Да нет, с ризонингом - https://huggingface.co/ai-sage/GigaChat3.5-432B-A28B Ризонинг у них добавился год назад, ещё в GigaChat 2.0.
Не понял. Авторы сами пишут на хаггинг фейсе "flagship instant model of the GigaChat family" (instant = нет ризонинга) и сравнивают с DeepSeek v3.2 Exp (тоже instant).
Что интересно - V4 Flash тоже есть, но только в сравнении Base моделей, т.е. по-сути просто сравнение претрейнов. У Instruct остаётся только v3.2 exp, которому Гигачат тоже проигрывает во многих бенчах :) а V4 Flash даже в Non-Thinking режиме сильно лучше и меньше по размеру. Это значит что у Сбера большие проблемы именно со стадиями после претрейна - т.е. SFT и, наиболее вероятно, RL. А как раз здесь идёт большая часть прибавок у новых моделей.
Если есть reasoning, то где бенчи для него и сравнение с другими такими моделями? У GigaChat 2.0 Max действительно увидел "effort" в API - где можно глянуть бенчи для него с разными уровнями? Нашел только в статье от Танька про T-Pro 2.0, где они с Гигачатом сравниваются. Это у ризонинг модели все так плохо? 45% GPQA Diamond.
Но с вашими оценками по отставанию я всё равно согласен. С другой стороны, обвинять их в отставании было бы странно. С какой стати они не должны отставать?
Греф заявляет что отстают на год от американцев и на полгода от китайцев, я написал что не согласен и реальное отставание минимум 2 и 1.5 года соответственно. Где я писал что они не должны отставать и обвинял их в этом?
Так а где речь про кражу? То что их архитектура основана на DeepSeekV3 это не обвинение и не что-то плохое. Это вообще был ответ на пост, в котором утверждалось что Gigachat это Квен.
У Гигачата отставание сильно больше, чем год от американцев и полгода от китайцев. Их последняя открытая модель все еще без ризонинга, что как-то странно выглядит в середине 2026 года. Уже одно это означает что они отстают от китайцев минимум на 1.5 года и от американцев на почти 2 года (o1 вышла в превью в сентябре 2024, DS R1 в январе 2025), а это огромный срок для этой сферы. Мб есть закрытые модели, которые сильно лучше, но сужу по тому что видел и щупал.
Посмотрим что вышло у американцев 1+ год назад: Grok 4, Claude Opus/Sonnet 4 (1 год и 2 месяца), Gemini 2.5 Pro (1 год и 4 месяца, в превью еще с декабря 2024 была). Последний Gigachat 3.5 Ultra отстает от них всех.
У китайцев полгода назад вышла Kimi K2.5, которая ощутимо сильнее Гигачата. Можно даже на почти ровно год назад уйти к Kimi K2, которая тоже лучше Гигачата.
Тут еще стоит упомянуть, что те же китайцы сами ускоряются в сокращении разрыва между ними и американским фронтиром, а еще не понятно сможет ли Сбер также ускориться, ну если не брать в расчет что в принципе можно взять условную свежую Kimi K3 и подтюнить, а потом заявить что Россия уже не отстает от Китая и только на месяц-два позади американцев.
Ну это правда, претрейн они сами делают, как и остальные стадии. Я про архитектуру только говорю - за основу взяли DeepSeekV3 и модифицировали, т.е. по сравнению с тем же Яндексом довольно крупный объем работы.
DeepSeek не выдуман, DeepSeek V4 Pro действительно 1.6 триллионов - остальные циферки это догадки, да.
Кстати, вдогонку к Вашим замечаниям - если инициализация весов тоже должна быть "суверенной", то YandexGPT не пройдет, они юзают не только архитектуру Qwen, но и их веса для инициализации. По-крайней мере в YandexGPT 5 так было. У GigaChat юзается архитектура Дипсика, поэтому они тоже вполне могли часть слоев проинициализировать их весами :)
Не в тему, но разве у этих пятикилограммовых гробов не пропадает основная фишка ноутбука - мобильность? Условно, с собой его особо не потаскаешь, да и даже в какие-то короткие командировки его брать - такое себе удовольствие. Единственный плюс, что если надо будет переезжать, то тут да, удобно сложить один ноут, чем перевозить пк с моником. По мощности, удобству и остальному он сливает ПК с хорошим монитором (27-32 дюйма) и периферией, несмотря на то что по итогу стоит +- столько же. Можете рассказать в чем плюс таких машинок для вас? Просто интересно.
У меня тоже был 18-дюймовый гроб где-то 4.5 кг весом (+ здоровенный блок, который где-то еще наверное 2-2.5 кг весил), но по итогу отказался в пользу ПК + легкого ноутбука. Ну и шумел он знатно, но температуры действительно были неплохие как для ноутбука, даже в троттлинг не улетал.
Какой матриархат, что ты несешь? Назови хоть одну женщину в правительстве с какой-то толикой реально власти? Та же Набиуллина может только разгребать последствия и не влияет на политический курс.
Как вам могли фуры молча привезти и позвонить только за полчаса до разгрузки, если их еще растаможить должны были и вам как минимум уведомление об этом должно было прийти? Да и как тысяча немаркированных коробок таможню вообще прошла?
Ну это, кстати, к вопросу о специалистах - вот Греф прям отрицает что есть кадровая проблема, но она очевидно есть. Судя по последней модели Сбера там все плюс-минус нормально с претрейном, но прям печально с пост-трейном - т.е. SFT + RL, причем настолько что многие популярные бенчи не приведены, с V4 Flash (которая была в сравнении базовых моделей) нету сравнения в non-thinking режиме, только с не особо удачной v3.2 exp, которой Гигачат еще и уступает на многих бенчах. Имхо, как раз сказывается недостаток скилловых RL спецов на российском рынке.
Ну и компьюта у китайцев все же больше.
За ссылку спасибо. Но если так все плохо, то значит reasoning они все-таки еще толком не освоили - он может формально есть, но работает хуже чем у того же R1 (не 05-28, а январского).
Ну хз, вроде по бенчам все-таки не дотягивает. Скорее ближе к Claude 3 Sonnet - где-то хуже, где-то лучше. Как-то напрягает, что они прям старательно избегают мерить многие популярные бенчи для Instruct модели и только базовые на них сравнивают. Видимо там все довольно плохо - судя по всему сказывается то, что в России почти нет сильных специалистов по RL, который сейчас чуть ли не ключевой компонент пост трейна. Недавно как раз видел вакансии от Сбера на RL с обещаниями зарплаты в 1 млн+ :)
Не понял. Авторы сами пишут на хаггинг фейсе "flagship instant model of the GigaChat family" (instant = нет ризонинга) и сравнивают с DeepSeek v3.2 Exp (тоже instant).
Что интересно - V4 Flash тоже есть, но только в сравнении Base моделей, т.е. по-сути просто сравнение претрейнов. У Instruct остаётся только v3.2 exp, которому Гигачат тоже проигрывает во многих бенчах :) а V4 Flash даже в Non-Thinking режиме сильно лучше и меньше по размеру. Это значит что у Сбера большие проблемы именно со стадиями после претрейна - т.е. SFT и, наиболее вероятно, RL. А как раз здесь идёт большая часть прибавок у новых моделей.
Если есть reasoning, то где бенчи для него и сравнение с другими такими моделями? У GigaChat 2.0 Max действительно увидел "effort" в API - где можно глянуть бенчи для него с разными уровнями? Нашел только в статье от Танька про T-Pro 2.0, где они с Гигачатом сравниваются. Это у ризонинг модели все так плохо? 45% GPQA Diamond.
Греф заявляет что отстают на год от американцев и на полгода от китайцев, я написал что не согласен и реальное отставание минимум 2 и 1.5 года соответственно. Где я писал что они не должны отставать и обвинял их в этом?
Кстати, нашел его интервью где-то двухлетней давности, где он говорил тоже самое - Греф заявил, что РФ отстает в разработке ИИ из-за недостатка вычислительных мощностей .
Так а где речь про кражу? То что их архитектура основана на DeepSeekV3 это не обвинение и не что-то плохое. Это вообще был ответ на пост, в котором утверждалось что Gigachat это Квен.
У Гигачата отставание сильно больше, чем год от американцев и полгода от китайцев. Их последняя открытая модель все еще без ризонинга, что как-то странно выглядит в середине 2026 года. Уже одно это означает что они отстают от китайцев минимум на 1.5 года и от американцев на почти 2 года (o1 вышла в превью в сентябре 2024, DS R1 в январе 2025), а это огромный срок для этой сферы. Мб есть закрытые модели, которые сильно лучше, но сужу по тому что видел и щупал.
Посмотрим что вышло у американцев 1+ год назад: Grok 4, Claude Opus/Sonnet 4 (1 год и 2 месяца), Gemini 2.5 Pro (1 год и 4 месяца, в превью еще с декабря 2024 была). Последний Gigachat 3.5 Ultra отстает от них всех.
У китайцев полгода назад вышла Kimi K2.5, которая ощутимо сильнее Гигачата. Можно даже на почти ровно год назад уйти к Kimi K2, которая тоже лучше Гигачата.
Тут еще стоит упомянуть, что те же китайцы сами ускоряются в сокращении разрыва между ними и американским фронтиром, а еще не понятно сможет ли Сбер также ускориться, ну если не брать в расчет что в принципе можно взять условную свежую Kimi K3 и подтюнить, а потом заявить что Россия уже не отстает от Китая и только на месяц-два позади американцев.
Ну это правда, претрейн они сами делают, как и остальные стадии. Я про архитектуру только говорю - за основу взяли DeepSeekV3 и модифицировали, т.е. по сравнению с тем же Яндексом довольно крупный объем работы.
GigaChat на основе архитектуры DeepSeek сделан, поэтому это точно не правда.
DeepSeek не выдуман, DeepSeek V4 Pro действительно 1.6 триллионов - остальные циферки это догадки, да.
Кстати, вдогонку к Вашим замечаниям - если инициализация весов тоже должна быть "суверенной", то YandexGPT не пройдет, они юзают не только архитектуру Qwen, но и их веса для инициализации. По-крайней мере в YandexGPT 5 так было. У GigaChat юзается архитектура Дипсика, поэтому они тоже вполне могли часть слоев проинициализировать их весами :)
Плюс. Лучше смотрится без фильтров.
Не в тему, но разве у этих пятикилограммовых гробов не пропадает основная фишка ноутбука - мобильность? Условно, с собой его особо не потаскаешь, да и даже в какие-то короткие командировки его брать - такое себе удовольствие. Единственный плюс, что если надо будет переезжать, то тут да, удобно сложить один ноут, чем перевозить пк с моником. По мощности, удобству и остальному он сливает ПК с хорошим монитором (27-32 дюйма) и периферией, несмотря на то что по итогу стоит +- столько же. Можете рассказать в чем плюс таких машинок для вас? Просто интересно.
У меня тоже был 18-дюймовый гроб где-то 4.5 кг весом (+ здоровенный блок, который где-то еще наверное 2-2.5 кг весил), но по итогу отказался в пользу ПК + легкого ноутбука. Ну и шумел он знатно, но температуры действительно были неплохие как для ноутбука, даже в троттлинг не улетал.
Прям сами TSMC обещают или кто-то другой?
Ага, чекисты-либералы.
Какой матриархат, что ты несешь? Назови хоть одну женщину в правительстве с какой-то толикой реально власти? Та же Набиуллина может только разгребать последствия и не влияет на политический курс.
Имхо, ROCm даже хуже интеловского стака. По вычислительной мощности сама карта значительно слабее, например тот же prefill будет сильно медленнее.
Ну и вопрос удобства еще - Mi 50 изначально с пассивным охладом, т.е. дополнительно надо будет наколхозить свой охлад.
Ну Варшава - Варшавская, очевидно, а вот про Финляндию не знаю
Вот бы еще одного убедили