Сотрудник спрашивает: «Можно ли отгружать заказ без оригинала доверенности?» Обычная нейросеть отвечает по общим знаниям и может придумать убедительное правило. Корпоративный ассистент с поиском по документам сначала обращается к регламентам компании. Рабочее решение также показывает документ и пункт, на котором основан ответ.
Он не запоминает всю компанию и не становится новым сотрудником после загрузки папки с файлами. В типовом решении для поиска по документам модель не переобучают. Документы хранят отдельно, а нужные фрагменты подставляют модели в момент вопроса.
Для работы это означает:
- если в базе лежит старый регламент, ассистент даст старый ответ;
- если сотрудник не должен видеть документ, это ограничение нужно перенести и в ассистента;
- если ответ нельзя проверить по источнику, использовать его в рабочем процессе опасно.
Откуда ассистент знает правила вашей компании?
Коротко. Он ищет подходящие фрагменты в разрешенных корпоративных документах и составляет ответ на их основе. Такой подход называют RAG, но руководителю важнее не термин, а последовательность: вопрос, поиск, найденный источник, ответ.
Допустим, начальник склада спрашивает: «Кто согласует списание неликвида дороже 300 000 рублей?» Система делает следующее:
- Определяет смысл вопроса.
- Ищет подходящие места в положении о складе, матрице полномочий и приказах.
- Отбирает несколько наиболее близких фрагментов.
- Передает их языковой модели вместе с вопросом.
- Формирует ответ и показывает, из каких документов он получен.
Модель не обязана заранее знать название вашей компании, должности и лимиты. Она получает эти сведения из найденного текста во время запроса.
Это похоже на сотрудника, который умеет быстро читать архив, но не имеет права отвечать без открытого документа перед глазами. Если отключить хранилище и индекс, ассистент перестанет находить корпоративные правила.
Что проверить у себя. Возьмите вопрос, который каждую неделю задают опытному сотруднику, и найдите документ с официальным ответом. Если такого документа нет, ассистенту пока неоткуда брать надежный ответ.
Что происходит с документом после загрузки?
Коротко. Файл не «растворяется» в нейросети. Система извлекает из него текст, делит текст на фрагменты и создает поисковый индекс. Исходный документ при этом остается отдельным объектом.
Как система готовит файл к поиску?
Сначала она получает PDF, Word, таблицу, страницу базы знаний или запись из другой системы. Если это скан, текст нужно распознать. Таблица, схема и подпись к рисунку требуют отдельной обработки: простое копирование текста часто ломает их смысл.
Затем документ делят на фрагменты. Один фрагмент может содержать пункт регламента, строку таблицы с заголовками или несколько связанных абзацев. Слишком крупный фрагмент приносит в ответ лишний текст. Слишком мелкий теряет условия и исключения.
Для каждого фрагмента система создает поисковое представление. Оно помогает находить совпадения по смыслу, а не только по одинаковым словам. Поэтому запрос «кто утверждает скидку» может найти раздел «полномочия по согласованию отклонения от прайс-листа».
Что хранится кроме исходного файла?
Рабочее решение обычно хранит несколько связанных объектов:
- исходный документ;
- извлеченный текст;
- поисковый индекс;
- название, дату, версию и владельца документа;
- права доступа;
- историю запросов и ответов, если журналирование включено.
Именно этот список нужно обсуждать с подрядчиком. Вопрос «где лежат наши PDF» охватывает только исходные файлы. Копия текста, индекс и журнал запросов тоже могут содержать чувствительную информацию.
Что происходит при обновлении регламента?
Старую версию нужно снять с публикации, новую заново обработать, а индекс обновить. Если просто положить рядом два приказа, система может найти оба и собрать ответ из противоречащих пунктов.
Поэтому у каждого источника должны быть:
- владелец;
- дата вступления в силу;
- статус «действует» или «архив»;
- понятный порядок замены;
- круг сотрудников, которым он доступен.
Если компания не управляет версиями документов, ИИ не исправит эту проблему. Он только сделает неправильный ответ быстрее и убедительнее.
Что проверить у себя. Откройте папку с одним действующим регламентом. Если рядом лежат файлы «финал», «финал2» и «новый финал», сначала назначьте правильную версию. Загружать всю папку в ассистента рано.
Обучается ли нейросеть на ваших документах?
Коротко. Обычно нет. Поиск по корпоративным документам и обучение модели являются разными работами.
При поиске по документам модель не меняют. В момент вопроса ей передают только найденные фрагменты. Новый приказ можно добавить в базу, а отмененный убрать без повторного обучения всей системы.
Дообучение меняет саму модель. Оно может понадобиться для специального языка, устойчивого формата ответа или узкой классификации, но для вопросов по регламентам обычно избыточно. Дообученную модель сложнее быстро обновлять при каждом новом приказе.
Отдельный случай: сотрудник копирует документ в публичный сервис из личного аккаунта. Здесь судьба данных зависит от условий конкретного сервиса и настроек аккаунта. При личном аккаунте компания обычно не управляет сроком хранения, журналом доступа и удалением материалов так же, как в своей системе.
Поэтому вопрос подрядчику должен звучать не «обучается ли ИИ на наших данных», а точнее:
Какие копии наших данных создаются, где они хранятся, кто имеет к ним доступ и как их удалить?
Что проверить у себя. Попросите ИТ-службу перечислить нейросети и браузерные расширения, которыми сотрудники уже пользуются для рабочих документов. Риск часто возникает до официального внедрения.
Может ли ассистент показать сотруднику чужую зарплату или договор?
Коротко. Может, если права доступа спроектированы плохо. Ассистент должен наследовать ограничения из исходных систем или применять собственную ролевую модель.
Представим, что общий индекс содержит кадровые приказы, договоры с клиентами, технологические инструкции и финансовые отчеты. Менеджер задает безобидный вопрос: «Какая надбавка предусмотрена для начальника смены?» Если система ищет по всему индексу, она может достать фрагмент из зарплатной ведомости. В кадровой системе этот менеджер такую ведомость никогда бы не увидел.
Правильная последовательность другая:
- Система определяет, кто задал вопрос.
- Проверяет роль и подразделение пользователя.
- Ищет только в разрешенных источниках.
- Фильтрует найденные фрагменты до передачи модели.
- Записывает обращение в журнал.
Проверять права только после генерации ответа поздно. Чувствительный фрагмент уже попал в контекст модели и может проявиться в пересказе.
Что делать, если доступы сейчас устроены папками «для своих»?
Не нужно начинать с наведения порядка во всем архиве компании. Выберите один набор документов и одну группу пользователей.
Например, для первого запуска можно взять инструкции по работе с оборудованием, которые и так доступны всем мастерам участка. Кадровые документы, договоры и персональные данные подключать позже, после проверки ролей и журнала доступа.
Если подрядчик предлагает сначала загрузить общий сетевой диск, а права «добавить потом», это не быстрый старт. Это перенос старого беспорядка в систему, которая отвечает быстрее человека.
Что проверить у себя. Выберите один документ и назовите три должности: кто может читать его полностью, кто видит только часть, а кто не должен знать о нем. Если ответ не зафиксирован, модель доступа еще не готова.
Уходят ли документы во внешнее облако?
Коротко. Это зависит от архитектуры. Само слово «корпоративный» не означает, что документы остаются внутри компании.
В цепочке могут участвовать:
- хранилище исходных файлов;
- сервис распознавания сканов;
- поисковый индекс;
- языковая модель;
- система журналирования;
- резервные копии;
- панель поддержки подрядчика.
Каждый компонент может находиться внутри компании или у внешнего провайдера. Поэтому схема «документы хранятся у нас» еще не отвечает на вопрос, куда уходит текст документа при распознавании и формировании ответа.
Есть три основных варианта размещения:
Облачный вариант
Документы или их фрагменты обрабатываются на площадке провайдера. Это упрощает запуск, но требует проверить договор, территорию хранения, срок удаления, доступ сотрудников провайдера и использование данных сервисом.
Гибридный вариант
Часть системы работает внутри компании, часть снаружи. Например, исходные файлы и индекс остаются у заказчика, а модель получает только найденные фрагменты. Такой вариант уменьшает объем передаваемых данных, но не делает передачу нулевой.
Локальный вариант
Хранилище, поиск и модель работают в инфраструктуре компании. Это дает больше контроля, но требует оборудования, администрирования, обновлений и собственной ответственности за защиту.
Выбор контура зависит от состава данных и требований ИБ. Но при любом варианте до пилота нужна схема, где видно движение исходного файла, извлеченного текста, фрагмента запроса, ответа и журнала.
Что проверить у себя. Попросите подрядчика нарисовать движение одного реального документа по всем компонентам. Если на схеме есть только прямоугольник «ИИ», архитектура еще не объяснена.
Почему ассистент уверенно отвечает по старому приказу?
Коротко. Модель оценивает, какой ответ подходит к найденному тексту. Она не знает, какой приказ директор считает действующим, если этот статус не записан в системе.
Есть четыре частые причины неправильных ответов.
Нашелся не тот документ
Вопрос сформулирован словами производства, а документ написан юридическим или техническим языком. Поиск выбрал похожий, но нерелевантный раздел.
Нашлись две действующие версии
В папке остались старый приказ и новая редакция. Ассистент использовал оба или выбрал более похожий фрагмент, а не более свежий.
Потерялось условие
Правило попало в один фрагмент, исключение к нему в другой. Система нашла правило и не нашла оговорку.
Ответа в документах нет
Модель попыталась быть полезной и дополнила пробел общими знаниями. Для рабочего ассистента это худшее поведение. Безопаснее ответить: «В доступных документах ответа нет» и передать вопрос владельцу процесса.
Менять языковую модель при каждой ошибке не нужно. Сначала проверяют:
- Какой документ система нашла.
- Какая версия документа была активна.
- Какие фрагменты попали в ответ.
- Не потерялись ли таблица, заголовок или исключение.
- Было ли системе разрешено отказаться от ответа.
Только после этого имеет смысл обсуждать замену модели.
Что проверить у себя. Задайте коллеге вопрос, на который нет ответа в регламенте. Эталон для ассистента в этом случае не красивая догадка, а честный отказ с указанием владельца вопроса.
Как сотрудник проверит, что ответ не придуман?
Коротко. Каждый рабочий ответ должен вести к документу, версии и конкретному фрагменту. Фраза «ответ сформирован по базе знаний» для проверки бесполезна.
В карточке ответа полезно показывать:
- название документа;
- дату и номер редакции;
- цитату, на которой основан вывод;
- ссылку на место в исходном документе внутри корпоративной системы;
- владельца документа;
- предупреждение, если источники противоречат друг другу.
У сотрудника должны быть простые действия: подтвердить ответ, отметить ошибку или передать вопрос владельцу. Эти сигналы нужны не для декоративного рейтинга. По ним видно, какие документы отсутствуют, где поиск выбирает не тот фрагмент и какие формулировки сотрудников система не понимает.
АО «Апатит» описывает промышленную платформу «Ясень», которая ищет по корпоративным документам и показывает источники ответа. Компания сообщает примерно о 2,5 тысячи пользователей, средней точности ответов 88% и сокращении времени работы с документами примерно на 15%. Это данные самого предприятия, а методика расчета точности в публикации не раскрыта.
Из цифры 88% нельзя вывести результат для другой компании. Зато из нее видно важное ограничение: даже промышленную локальную систему нельзя считать безошибочной. Пользователю все равно нужен источник, а владельцу системы нужен разбор ошибок.
Что проверить у себя. Возьмите будущий ответ ассистента и уберите сам текст. Если по оставшимся реквизитам сотрудник не может быстро открыть нужный пункт документа, механизм проверки не готов.
Какие документы подключать первыми?
Коротко. Начинайте не со всего архива, а с документов, за ответами по которым сотрудники регулярно ходят к опытному коллеге. Для первого контура достаточно одной темы с понятным владельцем.
Вот пять кандидатов для производственной, логистической или дистрибьюторской компании.
1. Инструкции по типовым операциям
Это порядок приемки, отгрузки, возврата, запуска оборудования, оформления заявки или устранения частой неисправности.
Хороший признак: вопрос повторяется, а правильный ответ уже записан по шагам.
2. Матрица полномочий и согласований
Кто утверждает скидку, закупку, списание, внеплановый ремонт или договор с отклонениями.
Перед подключением нужно проверить лимиты и замещения. Фамилия уволившегося директора в старом приказе быстро разрушит доверие к системе.
3. Каталог продукции и правила подбора
Характеристики, совместимость, ограничения, условия хранения, аналоги и ответы на частые вопросы клиентов.
Если выбор зависит от инженерного расчета или осмотра, ассистент должен готовить справку, а не выдавать окончательное заключение.
4. Регламенты для новых сотрудников
Отпуск, командировка, пропуск, спецодежда, заявка в ИТ, обучение по охране труда.
У «МегаФона» до запуска внутреннего бота кадровые специалисты отвечали более чем на 500 вопросов в день. Компания сообщила, что бот охватил около 150 тем для 22 тысяч сотрудников. Это масштаб крупной компании, а не ориентир для среднего предприятия, но тип нагрузки узнаваем: одни и те же вопросы каждый день.
5. База типовых неисправностей и решений
Симптом, оборудование, проверка, допустимое действие, условие остановки и контакт ответственного специалиста.
Здесь особенно важна граница. Ассистент может найти инструкцию и собрать последовательность проверок. Он не должен разрешать опасное действие, если документ требует допуска или осмотра инженера.
Не выбирайте документы только потому, что их легко выгрузить. Выбирайте тему, где есть повторяющийся вопрос, официальный ответ, владелец содержания и понятная цена ошибки.
Что проверить у себя. Выпишите пять документов, за которыми сотрудники чаще всего идут к коллегам. Рядом укажите владельца и дату последнего обновления. Список без владельцев пока не является базой для ассистента.
Когда корпоративный ИИ вообще не нужен?
Коротко. Если ответы стабильны, вариантов мало, а поиск по смыслу не требуется, сначала стоит проверить обычную базу знаний или форму с фильтрами. ИИ может не дать дополнительной пользы.
ИИ не нужен, когда:
- у компании небольшой набор коротких инструкций и понятное меню;
- вопрос можно однозначно определить кнопкой или полем формы;
- ответ всегда состоит из одной фиксированной фразы;
- документы редко меняются и уже хорошо находятся по названию;
- ошибка недопустима, а автоматическая проверка ответа невозможна.
Например, сотруднику не нужна языковая модель, чтобы узнать телефон аварийной службы. Нужна заметная карточка в корпоративном портале.
Не нужен ИИ и для маскировки отсутствующего правила. Если три руководителя по-разному отвечают на один вопрос, сначала компания должна принять решение и закрепить его. Ассистент не заменяет владельца процесса.
ИИ полезен там, где документов много, формулировки вопросов различаются, сотруднику приходится читать несколько источников, а ответ можно показать вместе с основанием.
Что проверить у себя. Попробуйте решить выбранную задачу обычным поиском, меню или шаблоном. Если этого достаточно, не усложняйте систему.
Как проверить ассистента до запуска на всех сотрудников?
Коротко. Проверяйте не демонстрационные вопросы подрядчика, а реальные вопросы своей компании. Для каждого заранее нужен правильный ответ и документ, который его подтверждает.
Соберите набор из обычных, неудобных и пограничных вопросов:
- вопрос сформулирован профессиональным жаргоном;
- в запросе есть опечатка;
- ответ находится в таблице;
- правило и исключение лежат в разных разделах;
- существует отмененная версия документа;
- сотруднику запрещен доступ к источнику;
- в базе нет ответа;
- два документа противоречат друг другу.
Для каждого вопроса зафиксируйте:
| Что проверяем | Что должно произойти |
|---|---|
| Правильный источник | система открывает действующий документ, а не похожий |
| Полнота ответа | правило приходит вместе с условиями и исключениями |
| Права доступа | пользователь не получает закрытый фрагмент и не узнает его пересказ |
| Отказ | при отсутствии основания система прямо сообщает об этом |
| Проверяемость | сотрудник видит документ, редакцию и цитату |
| Передача человеку | спорный вопрос уходит конкретному владельцу |
| Журнал | администратор может восстановить вопрос, источники и ответ |
Не сводите приемку к одной цифре точности. Два ассистента могут дать одинаковую долю верных ответов, но первый ошибется в названии подразделения, а второй раскроет зарплатную ведомость. Цена ошибок разная.
Что проверить у себя. Добавьте в испытания хотя бы один запрещенный документ и один вопрос без ответа. Если система умеет только отвечать, но не умеет отказывать, в рабочий контур ее выпускать рано.
С чего начать, если документы разбросаны по папкам и системам?
Не нужно сначала приводить в порядок весь корпоративный архив. Для старта достаточно одного повторяющегося вопроса, по которому сотрудник сейчас пишет коллеге или ищет ответ дольше, чем принимает решение.
Рабочий первый проход выглядит так:
- Собрать реальные формулировки вопроса.
- Найти документы с ответом или зафиксировать знание опытного сотрудника.
- Определить, какое правило действует сейчас и кто за него отвечает.
- Указать, какие должности имеют доступ.
- Зафиксировать правильные ответы и допустимые отказы.
- Проверить ассистента на реальных формулировках.
- Подключать следующую тему только после разбора ошибок первой.
Самый трудный шаг здесь не выбор модели. Нужно отделить действующие знания от старых файлов, договоренностей и устных исключений. Эту работу не обязательно заканчивать до обращения к подрядчику: Нейропрем помогает собрать документы и регламенты, зафиксировать знания сотрудников и сложить из них базу знаний.
В ходе такой подготовки может оказаться, что ИИ не нужен и задачу надежнее решит обычная база знаний. Эта граница сохраняется. Но беспорядок в документах или знания только в голове опытного мастера не закрывают вход в проект.
Если документы уже собраны или пока существуют только в папках, переписке и памяти сотрудников, оставьте заявку на бесплатную диагностику.

