Context Ranking: как отобрать по-настоящему полезные фрагменты из репозитория.
Рассказываем, как Context Ranking помогает автодополнению собирать контекст для LLM. В живом репозитории много потенциально полезной информации, поэтому искать фрагменты только по похожим словам недостаточно. Нужно ещё определить, какие из них действительно стоит показывать модели.
В центре внимания классика ранжирования BM25: почему редкие идентификаторы ценнее популярных слов, зачем учитывать размер файла и почему десять одинаковых совпадений не должны быть в десять раз полезнее одного.

