Обновить
2
Павел Коковин@Per_Ardua

Frontend developer

Отправить сообщение

Cerebras - вот это топ (по крайней мере был 3 месяца назад). Ограничение - 30rpm и 1м токенов в день. Ни тот, ни другой лимит на самом деле не выставляются строго, выдавливал с него больше 2м токенов за день, и частенько больше 30rpm. В лимиты по количеству запросов упирался всего несколько раз за пару месяцев.

Минусы - всего 4 не самых лучших модели на тот момент, но для задач обработки текста - самое то.

Зато скорость - больше 500 токенов в секунду (да, серьезно), и задержка не сказать что огромная.

Я ожидал, что буду иметь полный контроль над тем какие устройства подключены, а также могу рассчитывать на прозрачность их подключения.

Никто пока не написал, потому напишу первым: спасибо.

Обязательно попробую собрать и поставить расширение. А то политика по токенам cursor, в последние полгода, хоть и понятна, но в отличие от codex и claude довольно жадна.

Ранее на тарифе за 60$ можно было потратить токенов почти на 200$. Сейчас - на 70$.

Зато он, в отличие от остальных, на двух колесах, и колеса эти - круглые. Уже хорошо.

Плюс RBAC на токены доступа, чтобы по токенам, которые выдаются AI, был доступ только на определенные самим пользователем действия.

Так у курсора же уже очень давно формат с пакетом долларов, который тратиться на любую модель по стоимости её токенов.

То есть, если подписка за 60$, то можно потратить токенов на 70$ и плюс в пять раз больше лимиты на их composer модели.

На открытках с машинами людей обычно нет. Так что тут не вижу логических дыр. А вот к качеству архитектуры на заднем фоне вопросы есть.

Делегировать отделу кадров

Всё так. Но тут залогом покупки является 10и-миллиардный штраф. Хотя, если Маску что-то не понравится, ему без разницы будет на штраф и сделка не состоится.

Раньше на этом тарифе можно было больше чем на 600$ потратить токенов, сейчас только 400 с копейками, но даже так это довольно много. Но уходят всё равно влёт, если использовать формат работы с разделением ролей агентов и их тесном взаимодействии при работе над задачами.

Я бы даже сказал 3.7. На подписке в 200$ его можно почти круглосуточно использовать в несколько потоков. Но качество не позволяет.

Есть ещё cerebras с их free лимитами. Там модели B-tier, но для вашего случая вполне достаточно. Но вообще, вот люди собрали список сервисов/провайдеров, где есть возможность юзать API LLM'ок бесплатно: https://github.com/mnfst/awesome-free-llm-apis

Может кому полезно будет для пет-проектов или личного пользования.

Россия и правда страна возможностей. Просто это не про возможности простого народа.

Вы шутите?

Там нет кода, только стопка exe файлов.

Думаю у нас разное понимание о том, что такое "следить за развитием проекта".

Конечно можно!

Для этого даже специальная платформа есть: github.

Не благодарите.

Это и есть благо для общества, когда это происходит постепенно. Сокращения проходят в небольших количествах и не за раз. Люди успевают переучиться, рынок успевает перераспределить ресурсы по потребностям.

Сейчас же случай совершенно иной. Слишком быстро и массово происходит эта "автоматизация". И не в конкретной стране, а по всему миру.

Помимо спецификаций в таком подходе должны быть прописаны четкие правила написания кода (хотя бы конфиг линтера и форматтера) и подходов к реализации функционала. Описаны паттерны и антипаттерны. Общая архитектура. А также необходим артефакт, содержащий пополняемый список переиспользуемых модулей.

Иначе при вашем подходе у вас будет 127 черных ящиков, внутри которых можно будет часто встретить одинаковый, но не вынесенный функционал, разный код-стайл, разные подходы к чтению, валидации и обработке входных данных и тд.

Привести к единому стилю такие ящики будет довольно сложно. Либо можно этого не делать, но тогда, когда (а не если) что-то пойдет не так, отладить взаимодействие модулей будет достаточно трудоемкой задачей.

1
23 ...

Информация

В рейтинге
Не участвует
Откуда
Новосибирск, Новосибирская обл., Россия
Дата рождения
Зарегистрирован
Активность