Cerebras - вот это топ (по крайней мере был 3 месяца назад). Ограничение - 30rpm и 1м токенов в день. Ни тот, ни другой лимит на самом деле не выставляются строго, выдавливал с него больше 2м токенов за день, и частенько больше 30rpm. В лимиты по количеству запросов упирался всего несколько раз за пару месяцев.
Минусы - всего 4 не самых лучших модели на тот момент, но для задач обработки текста - самое то.
Зато скорость - больше 500 токенов в секунду (да, серьезно), и задержка не сказать что огромная.
Никто пока не написал, потому напишу первым: спасибо.
Обязательно попробую собрать и поставить расширение. А то политика по токенам cursor, в последние полгода, хоть и понятна, но в отличие от codex и claude довольно жадна.
Ранее на тарифе за 60$ можно было потратить токенов почти на 200$. Сейчас - на 70$.
Всё так. Но тут залогом покупки является 10и-миллиардный штраф. Хотя, если Маску что-то не понравится, ему без разницы будет на штраф и сделка не состоится.
Раньше на этом тарифе можно было больше чем на 600$ потратить токенов, сейчас только 400 с копейками, но даже так это довольно много. Но уходят всё равно влёт, если использовать формат работы с разделением ролей агентов и их тесном взаимодействии при работе над задачами.
Есть ещё cerebras с их free лимитами. Там модели B-tier, но для вашего случая вполне достаточно. Но вообще, вот люди собрали список сервисов/провайдеров, где есть возможность юзать API LLM'ок бесплатно: https://github.com/mnfst/awesome-free-llm-apis
Может кому полезно будет для пет-проектов или личного пользования.
Это и есть благо для общества, когда это происходит постепенно. Сокращения проходят в небольших количествах и не за раз. Люди успевают переучиться, рынок успевает перераспределить ресурсы по потребностям.
Сейчас же случай совершенно иной. Слишком быстро и массово происходит эта "автоматизация". И не в конкретной стране, а по всему миру.
Помимо спецификаций в таком подходе должны быть прописаны четкие правила написания кода (хотя бы конфиг линтера и форматтера) и подходов к реализации функционала. Описаны паттерны и антипаттерны. Общая архитектура. А также необходим артефакт, содержащий пополняемый список переиспользуемых модулей.
Иначе при вашем подходе у вас будет 127 черных ящиков, внутри которых можно будет часто встретить одинаковый, но не вынесенный функционал, разный код-стайл, разные подходы к чтению, валидации и обработке входных данных и тд.
Привести к единому стилю такие ящики будет довольно сложно. Либо можно этого не делать, но тогда, когда (а не если) что-то пойдет не так, отладить взаимодействие модулей будет достаточно трудоемкой задачей.
Cerebras - вот это топ (по крайней мере был 3 месяца назад). Ограничение - 30rpm и 1м токенов в день. Ни тот, ни другой лимит на самом деле не выставляются строго, выдавливал с него больше 2м токенов за день, и частенько больше 30rpm. В лимиты по количеству запросов упирался всего несколько раз за пару месяцев.
Минусы - всего 4 не самых лучших модели на тот момент, но для задач обработки текста - самое то.
Зато скорость - больше 500 токенов в секунду (да, серьезно), и задержка не сказать что огромная.
Я ожидал, что буду иметь полный контроль над тем какие устройства подключены, а также могу рассчитывать на прозрачность их подключения.
Никто пока не написал, потому напишу первым: спасибо.
Обязательно попробую собрать и поставить расширение. А то политика по токенам cursor, в последние полгода, хоть и понятна, но в отличие от codex и claude довольно жадна.
Ранее на тарифе за 60$ можно было потратить токенов почти на 200$. Сейчас - на 70$.
Зато он, в отличие от остальных, на двух колесах, и колеса эти - круглые. Уже хорошо.
Плюс RBAC на токены доступа, чтобы по токенам, которые выдаются AI, был доступ только на определенные самим пользователем действия.
Так у курсора же уже очень давно формат с пакетом долларов, который тратиться на любую модель по стоимости её токенов.
То есть, если подписка за 60$, то можно потратить токенов на 70$ и плюс в пять раз больше лимиты на их composer модели.
На открытках с машинами людей обычно нет. Так что тут не вижу логических дыр. А вот к качеству архитектуры на заднем фоне вопросы есть.
Делегировать отделу кадров
Всё так. Но тут залогом покупки является 10и-миллиардный штраф. Хотя, если Маску что-то не понравится, ему без разницы будет на штраф и сделка не состоится.
Раньше на этом тарифе можно было больше чем на 600$ потратить токенов, сейчас только 400 с копейками, но даже так это довольно много. Но уходят всё равно влёт, если использовать формат работы с разделением ролей агентов и их тесном взаимодействии при работе над задачами.
Я бы даже сказал 3.7. На подписке в 200$ его можно почти круглосуточно использовать в несколько потоков. Но качество не позволяет.
Есть ещё cerebras с их free лимитами. Там модели B-tier, но для вашего случая вполне достаточно. Но вообще, вот люди собрали список сервисов/провайдеров, где есть возможность юзать API LLM'ок бесплатно: https://github.com/mnfst/awesome-free-llm-apis
Может кому полезно будет для пет-проектов или личного пользования.
Россия и правда страна возможностей. Просто это не про возможности простого народа.
Del
Вы шутите?
Там нет кода, только стопка exe файлов.
Думаю у нас разное понимание о том, что такое "следить за развитием проекта".
Конечно можно!
Для этого даже специальная платформа есть: github.
Не благодарите.
Это и есть благо для общества, когда это происходит постепенно. Сокращения проходят в небольших количествах и не за раз. Люди успевают переучиться, рынок успевает перераспределить ресурсы по потребностям.
Сейчас же случай совершенно иной. Слишком быстро и массово происходит эта "автоматизация". И не в конкретной стране, а по всему миру.
Помимо спецификаций в таком подходе должны быть прописаны четкие правила написания кода (хотя бы конфиг линтера и форматтера) и подходов к реализации функционала. Описаны паттерны и антипаттерны. Общая архитектура. А также необходим артефакт, содержащий пополняемый список переиспользуемых модулей.
Иначе при вашем подходе у вас будет 127 черных ящиков, внутри которых можно будет часто встретить одинаковый, но не вынесенный функционал, разный код-стайл, разные подходы к чтению, валидации и обработке входных данных и тд.
Привести к единому стилю такие ящики будет довольно сложно. Либо можно этого не делать, но тогда, когда (а не если) что-то пойдет не так, отладить взаимодействие модулей будет достаточно трудоемкой задачей.