Comments 22
ее место заняла открытая модель, которую может скачать кто угодно.
Скачать кто угодно, а вот запустить не только лишь все: даже квантованная до 1 бита она весит больше 200 гигов...
Если почитать профильные темы на редите, то видно что там встречаются люди с четырьмя rtx6000pro, то есть почти 400 гигов, с учётом зарплат у некоторых итишников в США там я думаю найдутся тысячи кто сможет себе это позволить.
чего не сделаешь лишь бы не платить 100 баксов за подписку
По ценам Авито двухпроцессорная система с 16 каналами 64Gb DDR4 ECC (1Tb, ~400Gb/s суммарной пропускной способности) это где-то пол миллиона. С парой 3090 для общих экспертов - 5..15 токенов/сек получится, наверное. Дешевле автомобиля, по крайней мере.
Ну не все же решили покупать прям сегодня по текущим ценам, у кого-то уже было ddr4 256-512 gb. да и 3090 до недавнего времени были недорогие.
сетап немного дешевле автомобиля чтобы.... чтобы.... очень быстро генерить лендинги уровня джуна--. ниша достаточно маргинальная.
В два (с лишним) раза дешевле мотоцикла, в два(без малого) раза дороже 5090 - не что-то прям непредставимо запредельное. И потом, терабайт RAM - это(для GLM5.2) даже для весов в FP8 и памяти в F16 с запасом, если планки по 32Gb - будет дешевле игрового компьютера с 5090.
Ну, ужас - но не ужас ужас ужас!
Ниша вообще не маргинальная, если ты клепаешь дорвеи или сетки сайтов под сео тысячами в день
Дешевле занести эти полмиллиона в апи опен-аи или клауда. Хватит на пару лет активной разработки без геморроя с железяками
"двухпроцессорная система" плохо работает для инференца. Однопроцессорная система для инференца работает в разы быстрее двухпроцессорной.
Ну так это модель уровня ентрпрайз. Никто и не обещал, что она заведется на домашнем игровом ноуте
gemini 3.5 flash хорош, всех китайцев обошел.

Обошла где и почему столько криков про фйбл? Она работает как недавний опус, хотя самоуверенная как все современный модели от жтой компании и задушенная цензурой. В каких то там автономных - может быть, но при этом жжет столько токенов и времени что проще и дешевле самому сделать
Fable конечно получше был, на тех задачах, на которых получилось его проверить, но только вот по ценам на API за одну задачу сжигалась стоимость базовой месячной подписки z.ai
Очень даже достойная модель, разве что медленная. Перешел пока на нее, может потом кто-то из топов подсуетится, а может наоборот, начнут по указке правительства бодро стрелять себе в ноги и вводить доступ по паспорту. Ну, невелика потеря, китайцы по ощущениям отрыв сократили до трех месяцев, не критично.
GLM 5.2 определенно лучше предыдущих, но вот что она прям обходит топ модели других производителей я бы поспорил. В моем тесте на создание однофайлового блога на php эта модель ни разу из трех генераций не смогла сделать код который бы не давал ошибок в каком либо месте. Таких косяков в коде модель от Gemini и GPT не делали. Хотя у них было по одной попытке, а не три как у GLM 5.2
В тесте на создание визуальной симуляции солнечной системы тоже косяки допустил.
То что она тащит либы с сидиэна и юзает тайлвинд, говорит только о том, что ее жестко зафайнтюнили на современные фронтенд-паттерны
Как Fable 5 могла обойти, если она отключена?
Открытая GLM-5.2 обошла Fable 5 в дизайне — в Design Arena раскрыли секрет успеха