База знаний · в карточках

База знаний компании для ИИ

«А чем это лучше ChatGPT, Claude и других чат-ботов?» — этот вопрос нам задают чаще всего. Ответ прост: обычный чат-бот не знает вашу компанию. Мы собираем знания компании в единую базу знаний — и ассистент отвечает по вашим документам со ссылками, а не придумывает.

Эта же база — фундамент безопасности («Безопасность») и защиты от галлюцинаций («Галлюцинации»): ответы строятся только на проверенных источниках.

01

Что такое «база знаний» и зачем она ИИ?

Представьте память нового сотрудника. Обычный ИИ каждый день приходит на работу «чистым»: он умный, но ничего не знает про вашу компанию — и начинает додумывать. База знаний — это его опыт: всё, что компания знает, собранное в одном месте и приведённое в порядок.

В базу попадают ваши документы, переписка, договоры, отчёты и инструкции. На любой вопрос ассистент отвечает не «по памяти модели», а из этой базы — со ссылками, где именно взята каждая фраза.

  • Ответы — из ваших документов, а не из интернета: модель опирается только на то, что написано у вас.
  • Каждый факт — со ссылкой: к любому утверждению можно открыть первоисточник и проверить.
  • Помнит контекст: вчерашняя переписка и позапрошлогодний договор для неё — связанные вещи, а не разные вселенные.

Коротко: база знаний превращает «умного незнакомца» в сотрудника, который знает вашу компанию и показывает, откуда взята каждая фраза.

02

Чем это лучше обычного поиска по документам?

Обычный поиск отвечает на вопрос «в каких файлах есть это слово?» — выдаёт список ссылок, а читать и сопоставлять вам. База знаний отвечает на вопрос «как правильно?» — готовым ответом с доказательствами.

  • Понимает смысл, а не слова. Вопрос «можно ли продлить договор?» найдёт ответ и в регламенте, и в письме, где самого слова «продлить» нет.
  • Собирает ответ из разных мест. Сроки — из договора, условия — из приложения, практика — из переписки: система сведёт это в один ответ и покажет, что откуда взято.
  • Показывает источник рядом с каждым фактом. Не верите — откройте оригинал одним кликом.

Если надёжного ответа в базе нет, система честно говорит «в документах такого нет», вместо того чтобы угадывать. Это принципиально: отсутствие ответа лучше уверенной догадки.

Разница: поиск даёт «где искать», база знаний даёт «как правильно» — и доказывает это ссылками.

03

Как туда попадают знания компании?

Вы подключаете источники — дальше система делает сама. Это как нанять архивариуса, который работает круглосуточно и ничего не теряет.

  • Источники подключаются как есть. Почта, чаты, общие диски, сканы, выгрузки из учётных систем — ничего не нужно заранее причёсывать.
  • Система читает и наводит порядок. Из потока убираются дубли и шум; каждый документ получает «паспорт»: откуда взят, когда, кто автор, какая степень конфиденциальности.
  • Важные сведения извлекаются аккуратно. Суммы, сроки, стороны, статусы достаются из текстов и связываются между собой: этот договор — к этому клиенту, это письмо — к той поставке.
  • Ничего не удаляется. Старые версии сохраняются: всегда видно, что было известно системе на любую прошлую дату.

Итог: вы работаете как обычно, а база знаний растёт сама — и остаётся в порядке без ручной разборки завалов.

04

Как система не путает старое и новое?

Главная болезнь любых баз — устаревшие ответы: «так было в прошлом году». У нас свежесть — это правило конвейера, а не надежда на аккуратных сотрудников.

  • Новое заменяет старое автоматически. Пришло обновление регламента — ответы перестраиваются под него, а прежняя версия остаётся в истории с датой.
  • У каждого факта — дата. «Что действует сейчас?» и «как было раньше?» — два разных вопроса, и система их не смешивает.
  • Противоречия видны. Если в двух документах написано разное, система не выбирает наугад — показывает оба варианта со ссылками и помечает конфликт.
  • Спорное уходит человеку. То, что нельзя подтвердить однозначно, помечается как требующее проверки, а не выдаётся за истину.

Принцип: доверять можно не обещанию «мы всё обновляем», а свежей проверке — любой факт можно перечитать в источнике прямо сейчас.

05

Кто что увидит? Права доступа

«Единая база» не значит «общая для всех». Наоборот: у каждого документа и каждого факта есть владелец и границы доступа — как в хорошем архиве, где ключи выдаются под роспись.

  • Права наследуются из ваших систем. Кто имел доступ к документу в почте или на диске — тот же доступ сохраняется в базе знаний. Новых «сюрпризов» не появляется.
  • Сначала определяется, кто спрашивает. Поиск идёт только по тому, что этому человеку разрешено. Запрещённое не «спрятано в ответе» — оно вообще не участвует в поиске.
  • Граница доступа — часть архитектуры. Финансы видит финансовая служба, персональные данные — HR. Это не «просьба к модели», а техническое правило, которое нельзя обойти формулировкой вопроса.
  • Всё логируется. Кто какой вопрос задавал и какие источники использовались — видно в журнале.

Коротко: база знаний знает не меньше вашей файловой системы, но разглашает не больше неё.

06

Как это устроено — весь конвейер

От документа до готового ответа путь проходит несколько ступеней. Ключевая граница — приватности: до неё всё живёт внутри вашей компании, пересекает её только один шаг.

  1. Приём источников

    Почта, чаты, диски, сканы и выгрузки принимаются как есть. Каждый объект получает «паспорт»: источник, владелец, дата, канал и гриф чувствительности.

  2. Наведение порядка

    Убираются дубли, подписи, дисклеймеры и прочий шум. Сканы распознаёт локальная модель — изображение не покидает контур. Документ раскладывается на понятные части: разделы, таблицы, приложения.

  3. Приватность — до индекса

    Персональные данные вырезаются ещё до того, как текст попадёт в базу: имена и номера заменяются обратимыми метками, ключ к ним хранится только у вас. Не уверены, что фрагмент чист, — он просто не отправляется.

  4. Индексация и связи

    Тексты превращаются в смысловой индекс прямо в вашем контуре. Факты связываются между собой: договор ↔ клиент ↔ поставка ↔ переписка. Так система отвечает на вопросы «во всю ширину», а не одним файлом.

    — — — граница приватности — — —
  5. Ответ со ссылками

    На вопрос система находит нужные места, собирает ответ и прикладывает источники. Нет надёжного основания — честное «в документах нет». Спорные места помечаются и идут человеку на проверку.

  6. Свежесть и журнал

    Новое автоматически заменяет устаревшее, прежние версии остаются в истории с датами. Каждый вопрос и каждый использованный источник фиксируются в журнале.

Пять принципов под капотом

Инженерные правила, на которых держатся все карточки выше.

ПРИНЦИП 01

Ответы только из базы

Ассистент опирается на документы компании, а не на память модели. Нет основания — честное «нет данных», а не догадка.

ПРИНЦИП 02

Доказательства обязательны

Каждый факт сопровождается источником, который можно открыть. Ответ без доказательств не считается ответом.

ПРИНЦИП 03

Приватность до всего остального

База живёт в вашем контуре; наружу уходит только обезличенный фрагмент под конкретный запрос. Самое чувствительное не уходит вообще.

ПРИНЦИП 04

Права доступа — не просьба, а стена

Границы видимости встроены в устройство базы: вопрос физически ищет только там, где спрашивающему разрешено.

ПРИНЦИП 05

Свежесть проверяема

У каждого факта дата и история версий. Любой ответ перечитывается в источнике прямо сейчас — доверие строится на read-back, а не на обещаниях.

Соберём базу знаний на ваших документах

Подключим ваши источники в контуре, покажем ответы со ссылками на реальных примерах и согласуем границы доступа с вашей ИБ-службой.

info@ai-automation.llc Как мы боремся с галлюцинациями →