ну 180 нм — это чипы для карт и SIM, врядли на них инференс построишь :) Сбер их сам, кстати, потребляет миллионами. Расчёт в инференсе, очевидно, на 28 нм: их заявили к 2028–2030, и это единственный узел под ИИ, где не нужен EUV — TPU как раз на нём и работал. Сроки, наверное, съедут, тк своей памяти нет вообще, так что лично я бы называл это горизонтом лет на десять... Но с учетом текущей ситуации в стране, вообще не понятно что с этим проектом будет...
Ходила байка что Греф был готов вложить в производство чипов 200 млрд руб и думал, что хватит, а когда посчитали реальный ценник — остыл. Но проблема не только в деньгах: для 5 нм нужен EUV-литограф ASML, а его не продают никому, тот же Китай вбухал $150+ млрд и всё равно сидит на 7 нм.
Если посмотреть историю по рынку, то $1,5 млрд хватит на фабрику максимум для 28 нм, а это эпоха GTX 980. Google, правда, свой первый TPU под инференс поиска делал ровно на 28 нм. Но это был 2015 год. Как они потянут современные нейросети - хз. Поэтому, мне кажется, что расчет Грефа сделан на "суверенный инференс".
В основном на английском, 75% времени. Плюс наш менеджер по работе с поставщиками свободно говорит и на английском, и на китайском, так что остальное время - переводили через нее
Конкретно после мехмата у нас, по-моему, нет, но тут могу ошибаться, специально не отслеживаю. Я на образование почти не смотрю. Смотрю на перформанс конкретного человека и на то, какие задачи он реально закрывает.
Для примера: у нас есть ряд ребят, кто много лет работал в Яндексе на разных позициях, в том числе топовых - показывают отличный результат. А есть сотрудники 2004–2005 года рождения, без высшего образования вообще, и это не мешает им работать на высоком уровне. Причём это люди уже с другим мышлением, чем поколения родившиеся в 1980-90-х.
Так что диплом сам по себе, лично для меня, мало о чём говорит.
Отвечу за себя - мы нанимаем сеньоров и сильных людей, команда у нас относительно небольшая (сейчас 52 человека), и идём мы несколько быстрее рынка за счёт уровня, а не числа рук. Платим таким людям по рынку.
Спасибо. И спасибо отдельно за «интересна информацией, а не оценками» — это ровно то, чего я и хотел: оценки мои личные, верно. А вот по фактуре каждый может сделать свои выводы.
Про «слои, которые оборачивают разработчиков» - соглашусь, но смягчу. Не везде Ж. Там, где продуктом занимаются люди, которые сами понимают технологию, а не пересказывают её с чужих слайдов, то там получается нормально. Но проблема в том, что таких пока мало.
спасибо за обратную связь! Тут даже не столько нейрослоп, сколько моя "неоптимизированная" подача мысли в статье. Дальше буду стараться более компактно писать, что бы повышать дочитываемость текста.
Тут не могу сказать. Лучше у самого Сбера спросить. В целом мы подобный вопрос с ними обсуждали - но они настаивают что у них своя модель полностью обученная с нуля (во что, лично я, слабо верю)
Спасибо за разбор по делу, приятно читать такие комментарии :)
Где вы правы - там не спорю. HBM против GDDR, bandwidth как боттлнек на больших батчах, ECC, bit flip от перегрева - всё так.
Про перегрев именно четырых 5090 в стаднатрных 19 дюймах серверных юнитах - пока лично я не могу сказать, тк мы как раз в изучении данного вопроса. Но есть заявление, как минимум, одного поставщика, что так работать может и уже проведены нагрузочные тесты. Как узнаю - напишу результат.
Под задачи на 7–32B, а их в корпоратах большинство — спокойно живут на потребительском железе, и там оно дешевле. Фронтир и 70B+ требуют датацентровых карт с NVLink и ECC - я так и писал.
Далее Вы пишите что корпам нужен on-premise в закрытом контуре. ИИ-Фабрика - это и есть on-premise в контуре заказчика, данные не покидают периметр. Возможно, вы упустили это в моем тексте.
Про «панику агрегатора», чтобы обвинить меня в том, что агрегатор мёртв, надо пропустить целый абзац в моей статье и не читать мои другие статьи на хабре, где я пишу что на чистом агрегаторстве, как это массово сложилось сейчас в России (обертка поверх чужих апи) - бизнес не построишь, и мы уже давно не там. Я это говорю с начала 2025 года :)
Навайбкодить можно и за вечер. Но это будет агрегатор, не суперапп – в статье как раз про эту разницу. И только один OpenRouter не берите, он не настолько нестабильный. Когда он ляжет, отвечать будете вы, не он.
Я фаундер GPTunneL, листал Хабр, случайно наткнулся на статью. Спасибо за упоминание, хотя мы себя агрегатором уже давно не считаем - строим AI-платформу с вайбкодингом, AI-агентами, GraphRAG, собственной нейросетью GROM. Движемся в сторону AI Super App.
По статье: для разработчиков указан Claude Sonnet 3.5 - он все-таки заметно устарел, актуальны Sonnet 4.6 и Opus 4.6. А для контент-заводов лучше смотреть профильные площадки, заточенные именно под конвейер контента - если кому актуально, пишите, порекомендую.
В целом рынок растёт огромными темпами, места хватит всем. Удачи коллегам.
Не могу сказать ) Но если китайская - как будто Яндексу нужно поискать другого производителя )
ну 180 нм — это чипы для карт и SIM, врядли на них инференс построишь :) Сбер их сам, кстати, потребляет миллионами. Расчёт в инференсе, очевидно, на 28 нм: их заявили к 2028–2030, и это единственный узел под ИИ, где не нужен EUV — TPU как раз на нём и работал. Сроки, наверное, съедут, тк своей памяти нет вообще, так что лично я бы называл это горизонтом лет на десять... Но с учетом текущей ситуации в стране, вообще не понятно что с этим проектом будет...
Много ) Но я больше про сам подход: страна, которая печеньку пакует как премиум электронику, и гуманоида собирает серийно.
У нас же Алису открываешь - так статическим электричеством ударить может, а не то что премиум устройство открываешь...
Ходила байка что Греф был готов вложить в производство чипов 200 млрд руб и думал, что хватит, а когда посчитали реальный ценник — остыл. Но проблема не только в деньгах: для 5 нм нужен EUV-литограф ASML, а его не продают никому, тот же Китай вбухал $150+ млрд и всё равно сидит на 7 нм.
Если посмотреть историю по рынку, то $1,5 млрд хватит на фабрику максимум для 28 нм, а это эпоха GTX 980. Google, правда, свой первый TPU под инференс поиска делал ровно на 28 нм. Но это был 2015 год. Как они потянут современные нейросети - хз. Поэтому, мне кажется, что расчет Грефа сделан на "суверенный инференс".
В основном на английском, 75% времени. Плюс наш менеджер по работе с поставщиками свободно говорит и на английском, и на китайском, так что остальное время - переводили через нее
Конкретно после мехмата у нас, по-моему, нет, но тут могу ошибаться, специально не отслеживаю. Я на образование почти не смотрю. Смотрю на перформанс конкретного человека и на то, какие задачи он реально закрывает.
Для примера: у нас есть ряд ребят, кто много лет работал в Яндексе на разных позициях, в том числе топовых - показывают отличный результат. А есть сотрудники 2004–2005 года рождения, без высшего образования вообще, и это не мешает им работать на высоком уровне. Причём это люди уже с другим мышлением, чем поколения родившиеся в 1980-90-х.
Так что диплом сам по себе, лично для меня, мало о чём говорит.
Справедливо - "вопрос оптики". Конкретно ЦИПР показывает тех, кто на ЦИПР приехал.
Опять же, повторюсь, возможно, картину я вижу не всю. Будет фактура, которая её поправит - скидывайте, с удовольствием разберу.
Отвечу за себя - мы нанимаем сеньоров и сильных людей, команда у нас относительно небольшая (сейчас 52 человека), и идём мы несколько быстрее рынка за счёт уровня, а не числа рук. Платим таким людям по рынку.
Спасибо. И спасибо отдельно за «интересна информацией, а не оценками» — это ровно то, чего я и хотел: оценки мои личные, верно. А вот по фактуре каждый может сделать свои выводы.
Про «слои, которые оборачивают разработчиков» - соглашусь, но смягчу. Не везде Ж. Там, где продуктом занимаются люди, которые сами понимают технологию, а не пересказывают её с чужих слайдов, то там получается нормально. Но проблема в том, что таких пока мало.
спасибо за обратную связь! Тут даже не столько нейрослоп, сколько моя "неоптимизированная" подача мысли в статье. Дальше буду стараться более компактно писать, что бы повышать дочитываемость текста.
Данные у вас - а не в Клоде. Клод - api, которое потом можно еще и на GLM в своем контуре, например, переключить.
Будем надеятся что ИИ не постигнет учесть АвтоВАЗ :)
Где забанили? Не понял комментарий, если честно
Тут не могу сказать. Лучше у самого Сбера спросить. В целом мы подобный вопрос с ними обсуждали - но они настаивают что у них своя модель полностью обученная с нуля (во что, лично я, слабо верю)
Спасибо за разбор по делу, приятно читать такие комментарии :)
Где вы правы - там не спорю. HBM против GDDR, bandwidth как боттлнек на больших батчах, ECC, bit flip от перегрева - всё так.
Про перегрев именно четырых 5090 в стаднатрных 19 дюймах серверных юнитах - пока лично я не могу сказать, тк мы как раз в изучении данного вопроса. Но есть заявление, как минимум, одного поставщика, что так работать может и уже проведены нагрузочные тесты. Как узнаю - напишу результат.
Под задачи на 7–32B, а их в корпоратах большинство — спокойно живут на потребительском железе, и там оно дешевле. Фронтир и 70B+ требуют датацентровых карт с NVLink и ECC - я так и писал.
Далее Вы пишите что корпам нужен on-premise в закрытом контуре. ИИ-Фабрика - это и есть on-premise в контуре заказчика, данные не покидают периметр. Возможно, вы упустили это в моем тексте.
Про «панику агрегатора», чтобы обвинить меня в том, что агрегатор мёртв, надо пропустить целый абзац в моей статье и не читать мои другие статьи на хабре, где я пишу что на чистом агрегаторстве, как это массово сложилось сейчас в России (обертка поверх чужих апи) - бизнес не построишь, и мы уже давно не там. Я это говорю с начала 2025 года :)
Спасибо за комментарий, еще раз!
Я бы даже сказал что крупные компании - это всегда лотерея по людям. Сбер тут не уникален, если честно.
Интересно будет сравнить с нашей моделью GROM на GPTunneL
с qwen пока не гоняли, а с соннетом и хайку такие результаты https://llm.gptunnel.ru
Насколько я видел в больших компаниях, Сбер ставит решения on-premise "под ключ" - вместе с железом и интеграцией с софтом клиента
Навайбкодить можно и за вечер. Но это будет агрегатор, не суперапп – в статье как раз про эту разницу. И только один OpenRouter не берите, он не настолько нестабильный. Когда он ляжет, отвечать будете вы, не он.
Я фаундер GPTunneL, листал Хабр, случайно наткнулся на статью. Спасибо за упоминание, хотя мы себя агрегатором уже давно не считаем - строим AI-платформу с вайбкодингом, AI-агентами, GraphRAG, собственной нейросетью GROM. Движемся в сторону AI Super App.
По статье: для разработчиков указан Claude Sonnet 3.5 - он все-таки заметно устарел, актуальны Sonnet 4.6 и Opus 4.6. А для контент-заводов лучше смотреть профильные площадки, заточенные именно под конвейер контента - если кому актуально, пишите, порекомендую.
В целом рынок растёт огромными темпами, места хватит всем. Удачи коллегам.