AriaQA22 мар в 12:25

RAG: как Филин Палыч-реранкер навел порядок в цифровом королевстве

Средний

15 мин

7.7K

Искусственный интеллектПрограммирование * Научно-популярноеМашинное обучение * Data Mining *

Комментарии 9

Adam-qubit 22 мар в 13:22

Сказка отлично объясняет базовую архитектуру RAG и баланс между скоростью и точностью.

Можно добавить. Эмбеддинги + векторный поиск. Гибридный поиск, метаданные, иерархические чанки. Ретривер + реранкер. Метрики качества и оценки. Индексы (HNSW, IVF). Мониторинг, обновления данных, права доступа.

В общем, команда сказочных героев пополниться новыми персонажами.

AriaQA 22 мар в 13:39

Спасибо! Бобёр Метрикант с зеркалами, наверное, уже строит себе нору где то в архиве Филина Палыча. Сделаю вторую часть, если первая понравится аудитории. Идея была в том, чтобы объяснить RAG как можно проще и чтобы объяснение запомнилось.

Bobos 23 мар в 04:39

Суть статьи: RAG строится на двух этапах:

Быстрый этап: ANN-индекс (IVF/HNSW) — находит похожие фрагменты среди огромного объема данных (жертвуя точностью ради скорости).
Точный этап: Реранкер (кросс-энкодер) — перепроверяет и сортирует найденное, отбрасывая нерелевантные данные (жертвуя скоростью ради точности на финальном отрезке).

AriaQA 23 мар в 04:49

Да, верно. Это комплимент или вы тестируете, внимательно ли я читаю комментарии? :)

Bobos 23 мар в 06:57

Вдруг кто-то захочет почитать целиком, но сомневается, стоит ли

SlavaVSLK 23 мар в 05:10

Как раз последнее время пытаюсь сделать как в сказке (точность и скорость), тестирую на локальной модели text-embedding-qodo-embed-1-1.5b. Может подскажете локальные варианты получше (для кодовой базы), если есть?

AriaQA 23 мар в 05:21

Если говорить про локальные модели для кода я пробовала Nomic Embed v2 (137M) и Snowflake Arctic Embed S (33M). Обе работают на CPU, качество хорошее, бесплатные, Nomic чуть точнее, Arctic быстрее. Для кода ещё важно не просто эмбеддинг, а гибрид с BM25, иначе имена переменных теряются.У меня в итоге встала связка: Arctic + BM25 + HNSW. А вы на чём сейчас тормозитесь на скорости или на точности?

theillarionov 21 час назад

Потерял доступ к акку Хабра, прошел целый квест по восстановлению чтобы поставить плюсик ) Даже не сколько за сам материал (подача классная, интересная, для начинающих самое то), но мне прям дико полезны были ссылки на использованную литературу. Полгода как "вкатываюсь" в ИИ-шечку, как-то не додумался до этого поста читать прям статьи, второй вечер зачитываюсь. Спасибо за наводку!

AriaQA 20 часов назад

Спасибо огромное! :-) Я прямо растрогалась, восстанавливать доступ ради плюсика, это сильно. Очень приятно, что ссылки пригодились. Удачи вам во вкатывании!

Зарегистрируйтесь на Хабре, чтобы оставить комментарий