База знаний

Векторизация превращает фрагменты документов в векторы для семантического поиска бота. Сверху — статус индекса (сколько векторов, синхрон с базой, модель). Ниже выбери документы и запусти эмбеддинг: только ожидающие (не платить за уже встроенное) или пере-эмбедить всё. Прогон идёт фоном с живым прогрессом — его можно отменить. Векторизуются только фрагменты для поиска (child); контекстные блоки (parent) вектор не получают.
Индекс поиска (Milvus)
Векторов в индексе
Синхрон с базой
Тип индекса
Модель
text-embedding-3-small
Документы для векторизации
ДокументФрагментовВстроеноОжидают
Загрузка…
Векторизуются только фрагменты для поиска (child). Контекстные блоки (parent) вектор не получают.
Near-дубли в индексе
Ищет почти-одинаковые фрагменты (cosine ≥ порога) по уже готовым векторам — быстро, без пере-эмбеда. Исключи лишний из пары.