Обновить

Закрытый Jev против открытой Laya: сравниваем decision-модели в RAG-реранжировании

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели7.1K
Всего голосов 7: ↑7 и ↓0+10
Комментарии7

Комментарии 7

Круто, спасибо!

Опоздали с Laya. Вышел Jeff. Ещё быстрее Jev и локально. Это дообученная Qwen https://github.com/firelex/jeff работает быстро даже на CPU (у меня Huawei простенький)

А что скажете про новую Julia-1?

Может быть имеет смысл расширить список рабов Jeff'ом и Julia-1?

Список кандидатов растет быстрее, чем я успеваю их прогонять. Julia-1 - любопытный случай: 144 млн, mmBERT и все локально. На фоне Laya у нее есть шанс выглядеть заметно лучше.

Огромное вам спасибо за качественный обзор!

Жаль только, что аналоги сейчас выходят быстрее чем есть возможность протестировать и свести все в одну таблицу, интересно было бы почитать общий тест с Kev, Jeff, Julia и тд.

Спасибо! С таким темпом общая таблица устареет раньше, чем допишется. Kev, Jeff и Julia-1 - первые кандидаты. Наборы и код открыты, так что продолжить можно без переделки - https://github.com/stemirkhan/jev-laya-benchmarks

Эх… Jev, кажется, отличный пример, как сделать локальную революцию, да пользователю именно то, что он хочет, а не то, что случайно выкатилось из задней двери исследовательской лаборатории, и, при этом, вообще не иметь защитного рва.

Ведь, в отличии от sota, тут размер модели ограничен самой постановкой задачи, а, увы, зная путь, повторять маленькие модели отлично умеют как коммерческие, так и некоммерческие конкуренты.

PS: ну и да, ожидаю, что след шагом будут модели оценщики для определенных отраслей. Условно, jev для кодинга на go, jev для юридических документов на французском и т.д.

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации