База знаний
База знаний — это набор документов, разрезанных на фрагменты и переведённых в векторы, чтобы воркфлоу мог искать по смыслу, а не по точному совпадению слов. В графе база подключается нодой rag_kb к rag_query (детерминированный поиск) или к rag_tool (поиск, который решает выполнить агент). Пополнять базу можно и из самого воркфлоу — нодой kb_write.
Создание базы
- Нажмите Новая в списке слева.
- Заполните Название, при желании — Описание.
- Выберите Модель эмбеддингов. В списке модели платформы и модели ваших подключений; если список пуст, сначала настройте провайдера с API-ключом.
- При необходимости измените Размер фрагмента и Перекрытие фрагментов.
- Нажмите Создать.
Новая база знаний
Модели платформы и модели ваших подключений.
В символах. Допустимо от 100 до 4000.
Сколько символов соседние фрагменты делят между собой. От 0 до 500.
Размер фрагмента считается в символах: текст режется рекурсивно по абзацам и предложениям до кусков нужной длины, а перекрытие повторяет хвост предыдущего фрагмента в начале следующего, чтобы фраза не терялась на стыке.
При создании платформа один раз обращается к выбранной модели коротким запросом: так измеряется размерность вектора, которая закрепляется за базой навсегда. Если эндпоинт не отвечает, база не создаётся — вместо неё вы получите ошибку с просьбой проверить идентификатор модели, базовый URL подключения и ключ.
Добавление документов
Выберите базу слева и нажмите Добавить документ. В окне две вкладки — Загрузить файл и Добавить URL — и общий для них блок метаданных.
- Файл: PDF, DOCX, TXT или MD. Содержимое проверяется на соответствие расширению,
поэтому переименованный в
.pdfфайл будет отклонён. - URL: адрес должен начинаться с
http://илиhttps://. Страница скачивается, HTML превращается в текст (markdown) и дальше обрабатывается как обычный документ.
Метаданные — строки вида «ключ / значение / тип» (string, number, date). Они
приписываются каждому фрагменту источника, и по ним потом можно ставить жёсткие фильтры
поиска: например, отдел = логистика или дата > 2026-01-01. Тип задаёт правила
сравнения, поэтому у чисел и дат он важен. Строки с пустым ключом игнорируются.
Статусы обработки
Документ обрабатывается в фоне и проходит через несколько состояний. Пока открыта страница, статус обновляется каждые пару секунд.
База знаний
Регламенты поддержки
text-embedding-3-small · фрагмент 500 / перекрытие 50
| Документ | Статус | Фрагменты |
|---|---|---|
| policy.pdf | Готово | 42 |
| faq.md | Обработка | — |
| example.com/prices | Ожидание | — |
| broken.docx | Ошибка | — |
- 1Список баз: название и число проиндексированных документов. Иконка корзины появляется при наведении.
- 2Модель и параметры нарезки выбранной базы — их видно под названием.
- 3Документ в обработке показывает полосу прогресса и текущий шаг; готовый — число фрагментов.
- Ожидание — документ сохранён, обработка ещё не началась.
- Обработка — идёт загрузка, нарезка и индексация; под строкой видны полоса прогресса и текущий шаг.
- Готово — рядом со статусом появляется число фрагментов, документ участвует в поиске.
- Ошибка — под строкой выводится текст ошибки (например, не удалось скачать страницу или файл не читается).
Счётчик в левом списке считает именно проиндексированные документы, поэтому он растёт в момент перехода в «Готово», а не при загрузке файла.
Удаление
Корзина в строке документа удаляет документ вместе с его фрагментами из векторного хранилища и загруженным файлом. Корзина в списке слева удаляет базу целиком — со всеми документами, векторами и файлами. Оба действия необратимы.
Лимиты и оплата
Число баз, объём загруженных документов и количество векторов ограничены тарифом владельца пространства; при исчерпании квоты загрузка отклоняется. Индексация оплачивается по токенам эмбеддингов, если используется модель платформы; для моделей из ваших подключений платит ваш провайдер, и платформа их не тарифицирует.