01
Что такое «база знаний» и зачем она ИИ?
Представьте память нового сотрудника. Обычный ИИ каждый день приходит на работу «чистым»: он умный, но ничего не знает про вашу компанию — и начинает додумывать. База знаний — это его опыт: всё, что компания знает, собранное в одном месте и приведённое в порядок.
В базу попадают ваши документы, переписка, договоры, отчёты и инструкции. На любой вопрос ассистент отвечает не «по памяти модели», а из этой базы — со ссылками, где именно взята каждая фраза.
- Ответы — из ваших документов, а не из интернета: модель опирается только на то, что написано у вас.
- Каждый факт — со ссылкой: к любому утверждению можно открыть первоисточник и проверить.
- Помнит контекст: вчерашняя переписка и позапрошлогодний договор для неё — связанные вещи, а не разные вселенные.
Коротко: база знаний превращает «умного незнакомца» в сотрудника, который знает вашу компанию и показывает, откуда взята каждая фраза.
02
Чем это лучше обычного поиска по документам?
Обычный поиск отвечает на вопрос «в каких файлах есть это слово?» — выдаёт список ссылок, а читать и сопоставлять вам. База знаний отвечает на вопрос «как правильно?» — готовым ответом с доказательствами.
- Понимает смысл, а не слова. Вопрос «можно ли продлить договор?» найдёт ответ и в регламенте, и в письме, где самого слова «продлить» нет.
- Собирает ответ из разных мест. Сроки — из договора, условия — из приложения, практика — из переписки: система сведёт это в один ответ и покажет, что откуда взято.
- Показывает источник рядом с каждым фактом. Не верите — откройте оригинал одним кликом.
Если надёжного ответа в базе нет, система честно говорит «в документах такого нет», вместо того чтобы угадывать. Это принципиально: отсутствие ответа лучше уверенной догадки.
Разница: поиск даёт «где искать», база знаний даёт «как правильно» — и доказывает это ссылками.
03
Как туда попадают знания компании?
Вы подключаете источники — дальше система делает сама. Это как нанять архивариуса, который работает круглосуточно и ничего не теряет.
- Источники подключаются как есть. Почта, чаты, общие диски, сканы, выгрузки из учётных систем — ничего не нужно заранее причёсывать.
- Система читает и наводит порядок. Из потока убираются дубли и шум; каждый документ получает «паспорт»: откуда взят, когда, кто автор, какая степень конфиденциальности.
- Важные сведения извлекаются аккуратно. Суммы, сроки, стороны, статусы достаются из текстов и связываются между собой: этот договор — к этому клиенту, это письмо — к той поставке.
- Ничего не удаляется. Старые версии сохраняются: всегда видно, что было известно системе на любую прошлую дату.
Итог: вы работаете как обычно, а база знаний растёт сама — и остаётся в порядке без ручной разборки завалов.
04
Как система не путает старое и новое?
Главная болезнь любых баз — устаревшие ответы: «так было в прошлом году». У нас свежесть — это правило конвейера, а не надежда на аккуратных сотрудников.
- Новое заменяет старое автоматически. Пришло обновление регламента — ответы перестраиваются под него, а прежняя версия остаётся в истории с датой.
- У каждого факта — дата. «Что действует сейчас?» и «как было раньше?» — два разных вопроса, и система их не смешивает.
- Противоречия видны. Если в двух документах написано разное, система не выбирает наугад — показывает оба варианта со ссылками и помечает конфликт.
- Спорное уходит человеку. То, что нельзя подтвердить однозначно, помечается как требующее проверки, а не выдаётся за истину.
Принцип: доверять можно не обещанию «мы всё обновляем», а свежей проверке — любой факт можно перечитать в источнике прямо сейчас.
05
Кто что увидит? Права доступа
«Единая база» не значит «общая для всех». Наоборот: у каждого документа и каждого факта есть владелец и границы доступа — как в хорошем архиве, где ключи выдаются под роспись.
- Права наследуются из ваших систем. Кто имел доступ к документу в почте или на диске — тот же доступ сохраняется в базе знаний. Новых «сюрпризов» не появляется.
- Сначала определяется, кто спрашивает. Поиск идёт только по тому, что этому человеку разрешено. Запрещённое не «спрятано в ответе» — оно вообще не участвует в поиске.
- Граница доступа — часть архитектуры. Финансы видит финансовая служба, персональные данные — HR. Это не «просьба к модели», а техническое правило, которое нельзя обойти формулировкой вопроса.
- Всё логируется. Кто какой вопрос задавал и какие источники использовались — видно в журнале.
Коротко: база знаний знает не меньше вашей файловой системы, но разглашает не больше неё.
06
Как это устроено — весь конвейер
От документа до готового ответа путь проходит несколько ступеней. Ключевая граница — приватности: до неё всё живёт внутри вашей компании, пересекает её только один шаг.
-
Приём источников
Почта, чаты, диски, сканы и выгрузки принимаются как есть. Каждый объект получает «паспорт»: источник, владелец, дата, канал и гриф чувствительности.
-
Наведение порядка
Убираются дубли, подписи, дисклеймеры и прочий шум. Сканы распознаёт локальная модель — изображение не покидает контур. Документ раскладывается на понятные части: разделы, таблицы, приложения.
-
Приватность — до индекса
Персональные данные вырезаются ещё до того, как текст попадёт в базу: имена и номера заменяются обратимыми метками, ключ к ним хранится только у вас. Не уверены, что фрагмент чист, — он просто не отправляется.
-
Индексация и связи
Тексты превращаются в смысловой индекс прямо в вашем контуре. Факты связываются между собой: договор ↔ клиент ↔ поставка ↔ переписка. Так система отвечает на вопросы «во всю ширину», а не одним файлом.
— — — граница приватности — — —
-
Ответ со ссылками
На вопрос система находит нужные места, собирает ответ и прикладывает источники. Нет надёжного основания — честное «в документах нет». Спорные места помечаются и идут человеку на проверку.
-
Свежесть и журнал
Новое автоматически заменяет устаревшее, прежние версии остаются в истории с датами. Каждый вопрос и каждый использованный источник фиксируются в журнале.