Почему для сохранения контекста не передавать в виде истории целиком диалог в формате «вопрос пользователя - ответ LLM» на ограниченную глубину - 5-10 последних? Плюс, возможно, ранее найденные чанки.
Мне кажется, что при таком подходе будет сложно упереться в ограничение контекстного окна LLM.
Если я правильно понял, то не прослушивание производилось через банан и грязь, а запись. Видимо, в цифровом формате - возможно, с коррекцией ошибок. Т.е. для этой цели действительно достаточно практически любого проводника.
Нигде не сказано, что именно слушали через банан. ИМХО, больше хайп и кликбейт, чем показательный эксперимент.
Самая интересная тема не раскрыта: через кого весь трафик сливается в ТфОП/MNO? А-номер подставной или покупается у кого-то официально?
Какую прикладную задачу решали? Или это статья ради статьи: LLM спроектировала что-то, LLM это что-то описала?
Почему для сохранения контекста не передавать в виде истории целиком диалог в формате «вопрос пользователя - ответ LLM» на ограниченную глубину - 5-10 последних? Плюс, возможно, ранее найденные чанки.
Мне кажется, что при таком подходе будет сложно упереться в ограничение контекстного окна LLM.
К какой наиболее оптимальной структуре входных документов вы в итоге пришли?
Проводились ли эксперименты с сохранением контекста между запросами одного пользователя? Если да, то каковы результаты?
Если я правильно понял, то не прослушивание производилось через банан и грязь, а запись. Видимо, в цифровом формате - возможно, с коррекцией ошибок. Т.е. для этой цели действительно достаточно практически любого проводника.
Нигде не сказано, что именно слушали через банан. ИМХО, больше хайп и кликбейт, чем показательный эксперимент.