Обновить
20
Сергей@javdet12

Lead DevOps Engineer

8
Подписчики
Отправить сообщение

Векторная БД, используем qdrant с ембедингом от Google. У них есть небольшой бесплатный лимит на это дело

Здравствуйте, на этапе классификации я использую Sonnet 4.6 (тут не требуется самых сильных моделей), ей доступны чат в Mattermost и, как вы правильно заметили RAG с информацией об устройстве проекта. Знаниями пользуется редко, т.к. в системном промпте сделано достаточно четкое описание категорий, ключевых слов и примеров. Бывает временами путает запрос по инциденту с обычным вопросом об инфраструктуре. Но в целом достаточно точен, плюс всегда можно обратиться в треде еще раз, дав уточнения

Выглядит интересно. Посмотрю, могу ли использовать у себя. Спасибо

Стараемся оставлять поддержку сквозной авторизации в тех MCP серверах, которые ее поддерживают. В остальных случаях пока через общую сервисную учетоку. Через Keycloak интересное решение. Если правильно понял флоу: клиент при подключении к MCP-серверу проходит OAuth 2.1 с PKCE через браузер, получает токен, а дальше MCP-сервер делает token exchange в Keycloak и ходит к целевым системам уже от имени конкретного пользователя?

Тут надо добавить, что это самый дорогой стартап. У той же nvidia капитализация под 3 трлн

Для лучшей безопастности стоит использовать ACL с паролями в хешированном виде. Ну и включить TLS

Немного смотрели, но на тот момент, vector был более знаком и закрывал потребности. Спасибо за совет, подумаем в эту сторону

Да верно, в каких то кейсах это может помочь. Маркетинг и аналитики смотрят такие данные по очень разным полям: методам, юзер агентам, реферерам и т.д. Поэтому все закрыть метриками к сожалению не выйдет. Также работает над вариантом добавления части полей в индекс.

Приветствую, используем. Здесь нужно понимать, что в отличии от эластика, где индексируется весь документ, тут происходит поиск по всему тексту сообщений и это медленнее (если данные не в кэше). Поэтому при таком поиске стараемся максимально помочь локи выполнить запрос быстрее: четче ставим временные ограничения, добавляем индексированные поля в запрос, где это возможно.

Тема тюнинга Elastic stack потянет на отдельную статью) Если есть, какие то более конкретные вопросы могу что-то подсказать.

Да возможно, но за последние пол года как минимум, в нашей схеме работает хорошо. В планах есть написать оператор для него на подобии https://banzaicloud.com/docs/one-eye/logging-operator/.

Пробовали использовать opendistro, но не всех фич в нем хватало (с ходу могу вспомнить отсутствие автокомплита в кибане, были некоторые сложности с ISM).

Этот компонент системы пожалуй единственный, с которым проблем не было, поэтому нет

Информация

В рейтинге
Не участвует
Откуда
Санкт-Петербург, Санкт-Петербург и область, Россия
Дата рождения
Зарегистрирован
Активность

Специализация

DevOps-инженер, Lead devops
Ведущий
Kubernetes
AWS
Linux
Golang
Prometheus
ELK Stack
Grafana
Ansible
Terraform
n8n