У меня в основном веб разработка. вот сегодня делал проект ~ 30 000 строк кода, на vue.js, лимит меньше 60% за 5 часов не смог опустить. Но я: - работаю в zcode - читаю и формулирую задачи довольно подробно (может из-за этого медленно) - в agents.md запретил использование встроенного браузера (всё равно ии плохо пока тестирует, оставил только синтаксис и smoke тесты) - обычно не использую MCP (мне из коробки функционала достаточно) - не использую всякие superpowers (как по мне для хорошей модели они избыточны, лучше системный промпт свой под конкретный проект написать) - стараюсь после 200 000 заполнения контекста начинать новый чат (замечаю ии начинает чуть чуть тупить) - использую гит - в новом чате стараюсь сразу дать только нужные @файлы как контекст
В таком сценарии мне лимитов за глаза. И видимо у меня ещё старая подписка, недельных лимитов у меня нет.
на среднем pro плане у меня не получилось ни разу опустить 5-часовой лимит меньше чем на 60%. Этот нон стоп кодинг на большой кодовой базе через zcode (там вообще ~90% в кеш улетает), в прайм часы. Если кодить ночью по МСК, то у меня обычно 90-80% максимум (т.е. трачу 10-20% 5 часового лимита). После нового года годовая подписка конвертируется в подписку по токенам, возможно там хуже будет.
На pro подписке нужно делать больше 2 запросов в минуту в течении 5-часов чтобы лимит достичь.
Все вышеперечисленные тесты бесполезны для определения лучшей модели, потому что модели на таком коде и обучались. Вы придумайте свои уникальные тесты, тогда хотя бы немного объективно будет. Например, ни одна из моделей не смогла мне сделать полноценную jigsaw puzzle, с элементами tetris вместо кусочков.
Она пока бесплатная в kilo code (плагин для vs code) пока промо период (там ещё несколько бесплатных моделей) и вроде в opencode. В kodacode я думаю тоже бесплатная. Бесплатная - пока промо периоды. В roocode и в z.ai coding plan её пока нет.
В некоторых тестах glm 5 обходит claude opus 4.6 вроде, или очень близко. В lite плане (по скидке за 3$, без скидок 10$ в месяц - лимитов больше в 3 раза чем в Claude Pro plan. В pro плане z.ai лимитов больше в 5 раз чем в lite плане - это нужно больше двух запросов в минуту отправлять непрерывно 5 часов, чтобы упереться в лимит). Туда же входят Vision Analyze, Web Search, Web Reader and Zread MCP. У них ещё и генератор картинок z.image есть.
Я купил pro план на год когда была новогодняя акция за ~144$, это меньше 12 000р. Z.ai в топе открытых моделей. И работает без VPN. Если вообще в целом сравнивать цену токенов - то получается примерно в 15+ раз дешевле чем в claude (это на OpenRouter).
зависит от задач, я lite план не пробовал, но мне кажется pro в целом получше будет:
в "часы пик" всё же будет быстрее (пишут до 60%). у меня pro днём работает медленнее, чем ночью
лимиты на pro в 5 раз больше
на pro есть доступ к "Access Vision Analyze, Web Search, Web Reader and Zread MCP", если вам это нужно
скорее всего в этом году появятся новые модели, на pro к ним точно будет доступ (и приоритетный)
у меня даже получилось с трудом использовать их api у себя на сайте (в админке перевожу описание товаров с английского на русский) - качество конечно слабое (по сравнению с gemini), скорость ужасная (2-3 минуты на 3 абзаца текста), но зато в 1 клик работает (написал плагин для wordpress). не уверен что это будет работать на lite
с другой стороны, если у вас ограничен бюджет, задачи не масштабные и мало запросов, и программируете, например, по ночам, то lite плана будет достаточно. Я даже больше скажу, сейчас полно разных акций и промо, когда можно бесплатно использовать модели получше GLM (например, дают бесплатные токены в kiro или есть модель kimi 2.5 в kilo, там же glm 4.7 сейчас бесплатный пока). Или можно купить абуз antigravity за 700р на год - там модели gemini и claude opus 4.5 + nana banana, хотя опыт и отличается от vs code.
я скачал архив, запустил install.bat, потом run.bat - у меня заняло 3+ гига на диске C (видимо питон и что-то ещё, в общем совсем не portable версия) и 10+ гигов на том диске, куда я скачал. Затем в самой программе я просто перешёл во вторую вкладку, где клонирование голоса - и у меня ещё скачалось 5гб. Без всяких подтверждений-запросов. В фоне. Я никакие модели отдельно не качал.
20гб места чтобы можно было медленно озвучивать небольшие тексты - сомнительно.
У меня 3080ti пару строк текста озвучивает минуты 2. Средненькое качество (интонации часто не в тему или вообще меняются). Разве что для коротких фраз подойдёт. Но работает без интернета, когда всё докачается.
Сейчас очень недорого модели на z.ai. Лайт план около 2000р в год, pro план я взял чуть меньше 12 000. На про плане нужно писать больше 2 промптов в минуту чтобы упереться в 5 часовой лимит (т.е. 600 запросов за 5 часов). Да и на лайт плане я думаю лимит очень сложно достичь. А качество glm 4.7 уровня claude sonnet 4.5
А можно вообще бесплатные использовать, я долго сидел в roo code на grok-code-fast, потом перешёл на minmax m2 (они и сейчас там бесплатны). Но это для работы. Для чистого вайбкодинга можно использовать opencode (там тоже много бесплатных моделей, включая glm 4.7 сейчас) или cto.new (нужен инвайт).
Да, я купил pro подписку на год чуть меньше 12 000р. Но сейчас бывает по скорости вообще по разному. То за 20 секунд код генерирует, то за 4 минуты (один и тот же промпт), видимо из-за наплыва бесплатных пользователей (в opencode, например, эта модель бесплатна). На pro плане одному лимита невозможно достичь - нужно нон-стопом писать по 2 промпта в минуту (если непрерывно 5 часов). Мне кажется и на лайт плане лимита очень сложно достичь
С чего вы взяли, что я противопоставляю стоимость платной подписки стоимости запуска локальных моделей? Я такого нигде не писал. Я утверждал только, что качество ответов онлайн версии открытых моделей ничем не отличается от локальных, т.к. модель одна и та же. И что у локальных моделей свои плюсы.
Причём тут вообще стоимость? Это только один из аспектов, далеко не самый важный.
Вы точно ресурсом не ошиблись? Формулировать мысли не умеете, уровень аргументации очень низкий.
Причём тут gpt3? Он вышел 5 лет назад, а новые модели появляются каждую неделю на https://huggingface.co.
Вы ютуба насмотрелись? Сейчас модели ставятся в 1 клик в каком-нибудь lm studio, а результаты объективно оцениваются в специализированных тестах, или хотя бы на LMAreana.
Про отсылку к 20$ вообще не понятно. Вы давным давно один раз запустили квантованную модель на средненьком игровом пк и вам не понравилось качество ответа? Последнюю модель запустите неквантованную на H100 хотя бы, на компе с 64x4гб оперативкой, это сейчас недорого.
Я каждый день использую ИИ в работе, и локальные, и онлайн, у меня много разных подписок и доступы к последним моделям, я в этом немного разбираюсь.
А вы, судя по тому, что не знаете как запустить локальную модель с поиском по интернету (да и вообще кучей MCP) не разбираетесь.
У меня в основном веб разработка. вот сегодня делал проект ~ 30 000 строк кода, на vue.js, лимит меньше 60% за 5 часов не смог опустить. Но я:
- работаю в zcode
- читаю и формулирую задачи довольно подробно (может из-за этого медленно)
- в agents.md запретил использование встроенного браузера (всё равно ии плохо пока тестирует, оставил только синтаксис и smoke тесты)
- обычно не использую MCP (мне из коробки функционала достаточно)
- не использую всякие superpowers (как по мне для хорошей модели они избыточны, лучше системный промпт свой под конкретный проект написать)
- стараюсь после 200 000 заполнения контекста начинать новый чат (замечаю ии начинает чуть чуть тупить)
- использую гит
- в новом чате стараюсь сразу дать только нужные @файлы как контекст
В таком сценарии мне лимитов за глаза. И видимо у меня ещё старая подписка, недельных лимитов у меня нет.
на среднем pro плане у меня не получилось ни разу опустить 5-часовой лимит меньше чем на 60%. Этот нон стоп кодинг на большой кодовой базе через zcode (там вообще ~90% в кеш улетает), в прайм часы. Если кодить ночью по МСК, то у меня обычно 90-80% максимум (т.е. трачу 10-20% 5 часового лимита). После нового года годовая подписка конвертируется в подписку по токенам, возможно там хуже будет.
На pro подписке нужно делать больше 2 запросов в минуту в течении 5-часов чтобы лимит достичь.
Так он видимо и тестировал, сможет ли модель удалить всё с его компа.
Китайцы в ИИ отстают примерно на полгода, и этот разрыв уменьшается.
Это пока. На днях на китайскую GLM цены в 3 раза выросли.
vk.play сам продаёт steam ключи, зачем им блокировка?
Про 15гб бред какой-то. Я покупаю в отечественном vkplay steam игру, какую-нибудь call of duty которая весит ~150гб и скачать её не могу?
Все вышеперечисленные тесты бесполезны для определения лучшей модели, потому что модели на таком коде и обучались. Вы придумайте свои уникальные тесты, тогда хотя бы немного объективно будет. Например, ни одна из моделей не смогла мне сделать полноценную jigsaw puzzle, с элементами tetris вместо кусочков.
В 1С примерно такой синтаксис.
Китайские модели так-то в основном на лучших платных моделях обучены, чаще на sonnet и opus.
Она пока бесплатная в kilo code (плагин для vs code) пока промо период (там ещё несколько бесплатных моделей) и вроде в opencode. В kodacode я думаю тоже бесплатная. Бесплатная - пока промо периоды. В roocode и в z.ai coding plan её пока нет.
В некоторых тестах glm 5 обходит claude opus 4.6 вроде, или очень близко. В lite плане (по скидке за 3$, без скидок 10$ в месяц - лимитов больше в 3 раза чем в Claude Pro plan. В pro плане z.ai лимитов больше в 5 раз чем в lite плане - это нужно больше двух запросов в минуту отправлять непрерывно 5 часов, чтобы упереться в лимит). Туда же входят Vision Analyze, Web Search, Web Reader and Zread MCP. У них ещё и генератор картинок z.image есть.
Я купил pro план на год когда была новогодняя акция за ~144$, это меньше 12 000р. Z.ai в топе открытых моделей. И работает без VPN. Если вообще в целом сравнивать цену токенов - то получается примерно в 15+ раз дешевле чем в claude (это на OpenRouter).
зависит от задач, я lite план не пробовал, но мне кажется pro в целом получше будет:
в "часы пик" всё же будет быстрее (пишут до 60%). у меня pro днём работает медленнее, чем ночью
лимиты на pro в 5 раз больше
на pro есть доступ к "Access Vision Analyze, Web Search, Web Reader and Zread MCP", если вам это нужно
скорее всего в этом году появятся новые модели, на pro к ним точно будет доступ (и приоритетный)
у меня даже получилось с трудом использовать их api у себя на сайте (в админке перевожу описание товаров с английского на русский) - качество конечно слабое (по сравнению с gemini), скорость ужасная (2-3 минуты на 3 абзаца текста), но зато в 1 клик работает (написал плагин для wordpress). не уверен что это будет работать на lite
с другой стороны, если у вас ограничен бюджет, задачи не масштабные и мало запросов, и программируете, например, по ночам, то lite плана будет достаточно. Я даже больше скажу, сейчас полно разных акций и промо, когда можно бесплатно использовать модели получше GLM (например, дают бесплатные токены в kiro или есть модель kimi 2.5 в kilo, там же glm 4.7 сейчас бесплатный пока). Или можно купить абуз antigravity за 700р на год - там модели gemini и claude opus 4.5 + nana banana, хотя опыт и отличается от vs code.
если всё же соберётесь покупать, рекомендую успеть пока скидки https://z.ai/subscribe
я скачал архив, запустил install.bat, потом run.bat - у меня заняло 3+ гига на диске C (видимо питон и что-то ещё, в общем совсем не portable версия) и 10+ гигов на том диске, куда я скачал. Затем в самой программе я просто перешёл во вторую вкладку, где клонирование голоса - и у меня ещё скачалось 5гб. Без всяких подтверждений-запросов. В фоне. Я никакие модели отдельно не качал.
20гб места чтобы можно было медленно озвучивать небольшие тексты - сомнительно.
У меня 3080ti пару строк текста озвучивает минуты 2. Средненькое качество (интонации часто не в тему или вообще меняются). Разве что для коротких фраз подойдёт. Но работает без интернета, когда всё докачается.
За старания - спасибо.
Гейминг:
только ≈ 10–15% игр в Steam имеют нативную поддержку Linux
≈ 85–90% — Windows-only (и без Proton на Linux не запускаются)
плюс использование эмулятора всегда будет медленнее, чем запуск с нативной поддержкой
плюс проблемы с драйверами/мониторами
так что для гейминга - только windows. Максимум - steam os.
Сейчас очень недорого модели на z.ai. Лайт план около 2000р в год, pro план я взял чуть меньше 12 000. На про плане нужно писать больше 2 промптов в минуту чтобы упереться в 5 часовой лимит (т.е. 600 запросов за 5 часов). Да и на лайт плане я думаю лимит очень сложно достичь. А качество glm 4.7 уровня claude sonnet 4.5
А можно вообще бесплатные использовать, я долго сидел в roo code на grok-code-fast, потом перешёл на minmax m2 (они и сейчас там бесплатны). Но это для работы.
Для чистого вайбкодинга можно использовать opencode (там тоже много бесплатных моделей, включая glm 4.7 сейчас) или cto.new (нужен инвайт).
Да, я купил pro подписку на год чуть меньше 12 000р. Но сейчас бывает по скорости вообще по разному. То за 20 секунд код генерирует, то за 4 минуты (один и тот же промпт), видимо из-за наплыва бесплатных пользователей (в opencode, например, эта модель бесплатна). На pro плане одному лимита невозможно достичь - нужно нон-стопом писать по 2 промпта в минуту (если непрерывно 5 часов). Мне кажется и на лайт плане лимита очень сложно достичь
С чего вы взяли, что я противопоставляю стоимость платной подписки стоимости запуска локальных моделей? Я такого нигде не писал.
Я утверждал только, что качество ответов онлайн версии открытых моделей ничем не отличается от локальных, т.к. модель одна и та же. И что у локальных моделей свои плюсы.
Причём тут вообще стоимость? Это только один из аспектов, далеко не самый важный.
Вы точно ресурсом не ошиблись? Формулировать мысли не умеете, уровень аргументации очень низкий.
Причём тут gpt3? Он вышел 5 лет назад, а новые модели появляются каждую неделю на https://huggingface.co.
Вы ютуба насмотрелись? Сейчас модели ставятся в 1 клик в каком-нибудь lm studio, а результаты объективно оцениваются в специализированных тестах, или хотя бы на LMAreana.
Про отсылку к 20$ вообще не понятно. Вы давным давно один раз запустили квантованную модель на средненьком игровом пк и вам не понравилось качество ответа? Последнюю модель запустите неквантованную на H100 хотя бы, на компе с 64x4гб оперативкой, это сейчас недорого.
Я каждый день использую ИИ в работе, и локальные, и онлайн, у меня много разных подписок и доступы к последним моделям, я в этом немного разбираюсь.
А вы, судя по тому, что не знаете как запустить локальную модель с поиском по интернету (да и вообще кучей MCP) не разбираетесь.