Pull to refresh
8K+
46
Pavel Zloi@efreelancer

Руководитель направления AI/ML

12,1
Rating
51
Subscribers
Habr CareerHabr Career
Send message

Пробовал, по форме делает хорошо, удобно запустить длинную сессию, решить проблему и через этот скил сгенерить свой скил. Из недостатков, пожалуй, то, что он оформляет под стандарт ClaudeCode и для Codex, Cursor и других агентов надо будет ещё тюнить.

Плюс он проводит валидацию через модели Anthropic (а точнее текущую выбранную модель), и поскольку модель умная, скилы обычно получаются у неё тоже умные и заточенные под нюансы моделей Anthropic, и когда мы пытаемся запустить его на агентах других вендоров или on-premise моделях, частенько оказывается, что скил работает неправильно. Поэтому свои скилы я тестирую через саб-агентов на разных моделях, разных вендорах и разных кодовых агентах.

Но отвечая на вопрос, для базовых вещей и если в команде все пользуются ClaudeCode то скил от Anthropic подходит отлично.

С правилами тоже надо уметь работать, они нужны когда мы говорим об ахитектуре и общих паттернда, навроде где хранить тесты, как запустить демостенд, как оформлять код, что нельзя делать.

А вот скилы это как-раз подключаемая история когда нужна заметно реже, как пример мои скилы rpa-* для работы с исходниками, они нужны по большому счёту только вначале сессии, где я описываю агенту что делать, а в скилах сказано как это делать.

Плюс важный момент, что /goal ограничен на клоде 4к символов и просто копипастить промты не получится, тут и приходят на помощь скилы.

Спасибо! На собственном опыте выстраданные советы.

Верно, можно взять уже готовый квен или дипксик и не заморачиваться, однако, цель подобных экспериментов это удовлетворение любопытства и спортивный интерес.

Отличная публикация, рад что наработки по ruGPT3XL пригодились.

Кстати по ходу чтения пришла мысль, можно ведь проинициализировать пустую ruGPT3XL, по аналогии с базовой habrGPT, и обучить на полном датасете, а затем сравнить какая модель покзывает более качественные ответы, полагаю что это будет ruGPT3XL, ведь 0.5B меньше чем 1.3B, но всё же.

Прочёл с удовольствием, словно остросюжетный детектив, автору огромное спасибо за проделанный труд!

Планируется ли релиз скриптов обучения, генераторов датасета и весов в публичный доступ или эта модель скорее эдакая лабораторная работа?

Всё верно, именно об этом я и написал:

Из этой таблицы можно сделать предположение, что поставщики OpenRouter либо используют более эффективное железо, либо каким-то образом субсидируют разницу

Плюс нюансик, OR это посредник, они берут 5% сверху коммиссии за токены, а сами по сути модели не поставляют, только проксируют до поставщиков.

Настройки через settings.json не работают для защиты от проверки региона, приложение не работает, а если настроить черзе ключ --proxy то всё работает корректно и модельки и детектор.

У меня проблем с этим не возникало, скажу даже больше, у меня на ноуте и агентном сервер установлены сразу codex, claudecode, cursor, coddy и opencode. А какие проблемы возникают?

Попробуйте по предложенной мною в публикации схеме адаптировать решение под Windows, сам я видндовс не пользуюсь, поэтому точно подсказать что делать не смогу, но уверен тот же клод код прекрасно справится.

Рад что пригодилось!

settings.json это первое что я попробовал, однако, это настройки только для моделей, но проверка страны тут не работает.

только одно но - впн всё равно надо включить для запуска десктоп-клиента

Вот моё решение как-раз обходит эту проблему.

Описанный процесс вполне валиден, у меня например в папке Obsidian в корне лежит AGENT.md и в нём такой вот текст, а можно скажем просто текст в промте (перечисляя скилы) написать и будет тоже самое, разница лишь в том что первый вариант агент читает каждый раз сам, а второй надо писать руками.

Когда слишком долго читаешь нейрослоп помаленьку начинаешься незамечая того использовать его сам)

Ну я скорее имел ввиду какой-нибудь научпоп или прочий развлекательный коньтент, навроде публикаций на Хабр или скажем в личном блоге в той же Телеге, а юридические документы и прочие истории по ГОСТу это да, должны помимо содержимого иметь правильную форму, и часто некоторые авторы этим пользуясь выдают под этой формой отсутствие содержания.

Ну к слову скзаать модельки так не пишут, но этот приём аля “кстати где он” и тому подобное мне очень нравится)

Information

Rating
657-th
Location
Москва, Москва и Московская обл., Россия
Registered
Activity

Specialization

Бэкенд разработчик, ML разработчик
Ведущий
Linux
PHP
Python
Многопоточность
Нейронные сети
Машинное обучение
Kubernetes
Golang
Высоконагруженные системы