16 / 28
Query expansion, HyDE и multi-query: как улучшить recall в RAG?
Если короткий запрос пользователя плохо матчит чанки, переписываем сам запрос. Multi-query: LLM генерирует N парафразов, делаешь N retrieval'ов и объединяешь (RRF). HyDE: LLM пишет «гипотетический ответ», эмбеддинг ответа лучше матчит документ-ответ, чем эмбеддинг вопроса. Query expansion: добавляем синонимы/связанные термины. Все три повышают recall ценой latency и иногда precision.