Что подключается к Sensei и кому это нужно
Sensei — надстройка над тем, что у вас уже есть. Переносить базу знаний никуда не нужно: она остаётся в вашей wiki, на вашем диске, в ваших файлах, а Sensei отвечает по ней с цитатами на источники.
Сценарии
Одна и та же механика, разные задачи. Ниже — те, под которые у нас есть собственный опыт, а не догадки.
AI для техподдержки
Оператор спрашивает обычной фразой и получает ответ словами вашей документации — вместо того чтобы листать дерево wiki при ждущем клиенте.
Поиск по Yandex Wiki
Wiki остаётся главной: статьи пишутся там же, а Sensei отвечает по ним и следит за изменениями сам.
Поиск по Google Диску
Регламенты в Документах, прайсы и Q&A в Таблицах, архив PDF — по выбранным файлам, без доступа ко всему диску.
Источники данных
Источники складываются: у одного пространства их может быть сколько угодно, и ответ собирается по всем сразу.
| Источник | Что индексируется | Что важно знать |
|---|---|---|
| Yandex Wiki | Дерево статей целиком, с исключением ненужных веток | Подключение по OAuth или сессии браузера; несколько wiki на одно пространство |
| Google Диск | Документы, Таблицы, PDF, DOCX, TXT, Markdown | По одному выбранному файлу, не папкой; экспорт до 10 МБ |
| Текстовый слой документа целиком | Сканы и фотографии не читаются — распознавания текста нет | |
| Word (DOCX) | Текст документа целиком | Старый формат .doc не поддерживается — пересохраните в .docx |
| Excel и CSV | Таблицы вопрос-ответ, реестры, выгрузки | Это поиск по знаниям в таблице, а не расчёты по числам |
| TXT и Markdown | Текст файла целиком | Без ограничений по структуре |
| Страница сайта по ссылке | Основной текст страницы без меню и футера | Один адрес — одна статья; обхода сайта нет, только публичные адреса |
| Таблица или документ по ссылке | Файл, лежащий по публичному URL | Обновление отслеживается по заголовкам ответа сервера |
| Публичное API | Ваш собственный продукт спрашивает Sensei | OAuth client_credentials, один метод POST /api/v1/ask |
Чего Sensei пока не умеет
Честнее сказать сразу, чем выяснить это на второй неделе внедрения.
- Нет прямых коннекторов к Confluence, Notion, Битрикс24, 1С, Telegram, почте, Jira и SharePoint. Выгрузку из любой из этих систем в файл или таблицу Sensei проиндексирует, но забирать данные сам не будет.
- Нет обхода сайта целиком. Один адрес — одна статья: список страниц задаётся вручную. Страницы, которые рисуются скриптом в браузере, вернут пустой текст.
- Нет распознавания текста на картинках. Скан договора или фотография инструкции — это картинка; из неё Sensei не прочитает ничего. Нужен PDF с текстовым слоем.
- Google Диск подключается по файлу, а не папкой целиком, и экспорт больших таблиц ограничен 10 МБ на стороне Google.
- Sensei не пишет вашим клиентам. Это помощник команды, а не бот первой линии: он отвечает вашему сотруднику, а что сказать клиенту — решает человек.
Частые вопросы
Нужно ли переносить базу знаний в Sensei?
Нет. Статьи остаются там, где написаны: в wiki, на диске, в файлах. Sensei читает их и строит поисковый индекс, а при изменениях перечитывает сам. Это надстройка над существующей базой, а не ещё одно место, куда всё надо скопировать.
Сколько источников можно подключить к одному пространству?
Столько, сколько нужно по тарифу: источники складываются, и ответ собирается по всем сразу. Типичная связка — wiki с регламентами плюс таблица с историей обращений.
Что будет, если ответа в документах нет?
Sensei скажет, что точного ответа в базе нет, вместо того чтобы придумать похожий. Такие случаи видны в статистике — по ним понятно, каких статей в базе не хватает.
Мои документы попадут в обучение нейросети?
Нет. Документы используются только для того, чтобы ответить на ваш вопрос, и не уходят в обучение моделей. Подробности о хранении — в документации и политике конфиденциальности.
Можно ли подключить источник, которого нет в списке?
Если из системы можно выгрузить данные в файл или таблицу — да, через загрузку файла. Прямого коннектора к системам вне списка сейчас нет, и обещать его до реализации мы не будем.