Обновить

Как я увеличил производительность своего сервера для LLM‑вычислений почти в два раза и причем здесь six‑seven

Уровень сложностиСредний
Время на прочтение18 мин
Охват и читатели15K
Всего голосов 12: ↑10 и ↓2+12
Комментарии16

Комментарии 16

Очень интересное решение, с удовольствие прочту чего сможете выжать из этих карт, удачи вам!
ps а как вообще, комфортно работать с нейронками, мне особенно интересно в плане работы с тем же Гермесом в частности.

напомните, что есть гермес? у меня сейчас для них узкая задача - в самописном окружении считают математику распространения ЭМ волн, поэтому не особо знаком с другими решениями

Мультиагентная система. Типа той же OpenClaw

спасибо, почитаю. я все еще пвтаюсь найти агента который так же хорошо сможет мне писать приложения, как чатгпт. типа сделал промпт подождал час и пришел за готовым результатом. внес правки и снова получил готовый архив. openhands попробовал, но оказался слишком тяжелым и медленным, час он только структуру проекта пытался создать

да, камрад выше ответил на ваш вопрос - у меня он крутится автономно в проксмокс впcке на моем домашнем серваке и он там сам себе хозяин :) очень рекомендую попробовать, ресурсов жрет мало а польза большая (если правильно приготовить)

То-то я смотрю они на вторичке подорожали. За статью большое спасибо, буду ждать продолжения.

не сильно кстати. я брал комплект своих по 5 штуку, сейчас 8-9 стоят.

10гб на борту это грустненько, может придумают какой то хак с перепайкой чипов как у cmp50hx, будет веселее. Но 170hx не догнать конечно

Замена чипов на 20 гигов сразу упрется в возможности шины, контроллер физически не успеет прокачать такой объем весов на адекватной для генерации токенов скорости

не скажите. 20гб еще приемлемо. тем более с частотой 9.5ГГц на память в этих картах. упирается все в то, что на 50hx чипы gddr6, они адекватно стоят. на 90hx gddr6x, совместимые чипы по 2300 стоят или около того. такой эксперимент я проведу, но позже. пока жаба душит

170hx и стоят даже на вторичке в 15 раз дороже. 90hx это верхний предел для относительно бюджетного ИИ-кластера

Там и памяти при разблокировке 64ГБ (~120 000 руб на авито) или 80ГБ но таких не видел в продаже.

Ещё нужно знать, что там PCIe x4.

тогда определенно своих денег стоит. другой вопрос в том, что у меня пока столько нет на поиграться с нейросетями)))

Интересно посмотреть на тайминги при сплите модели на несколько таких карт. По шине PCIe они обычно обрезаны с завода, так что профит от анлока ядер легко упрется в скорость обмена между слотами

читайте первую часть статьи. карты доделаны до 8 дифференциальных пар вместо 4 с завода. можно доделать на 16, но я потерял пакет с конденсаторами, пока не до того чтоб найти.

лично я выше 1Гбит по rx/tx не видел при сплите карт, есть даже ощущение что и до 8 пар (что дает 2Гбит) я зря расширил

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации