Обновить
0
Артём Шмарёв@Ashmarev

Enterprise AI Architect | Data Gov & MDM Leader

Отправить сообщение

Хороший кейс, спасибо за подробное описание! Сейчас думаем про похожий проект, поэтому особенно интересны несколько технических моментов:

  • Какую нагрузку система держит по RPS / concurrent users?

  • Как организован модуль цензурирования: rule-based подход, ML-классификатор или что-то ещё?

  • Используется ли tool-calling?

  • Как организована трассировка и отслеживаемость запросов между компонентами?

  • Исследовались ли вопросы защиты персональных данных и изоляции пользовательского контекста?

  • Насколько трудоёмкой оказалась подготовка и очистка данных для RAG?

  • На чём реализована очередь запросов?

  • Как оркестратор определяет, что ресурсы LLM перегружены и новые запросы временно не стоит забирать из очереди?

Было бы интересно узнать детали эксплуатации под реальной нагрузкой.

Спасибо за интересную статью! И за взгляд на проблему доступности со стороны реальных пользователей. Есть над чем подумать при разработке.

Может кому будет полезно, если gephi не запускается с сообщением «Cannot find java 1.8 and higher» нужно:
1. установить свежую версию java java.com/ru/download
2. прописать путь в файле gephi.conf (C:\Program Files\Gephi-0.9.2\etc):
jdkhome=«C:/Program Files (x86)/Java/jre1.8.0_XXX» (вместо XXX ваш номер скачанного обновления Java.

Информация

В рейтинге
Не участвует
Откуда
Санкт-Петербург, Санкт-Петербург и область, Россия
Зарегистрирован
Активность