Краткий Обзор

Корпоративная база знаний часто создается для людей, способных восполнять пробелы, распознавать устаревшие документы и обращаться к коллегам за помощью. Агент не способен ни на одно из этих действий. Следовательно, подготовка контента для агента подразумевает в основном его удаление, принятие решений и тегирование, а не добавление нового.

Практический процесс включает пять этапов: аудит полноты и актуальности, архивирование противоречивых и устаревших материалов, реорганизация структуры статей, тегирование для удобства извлечения и назначение ответственных с соглашением об уровне обслуживания (SLA) для поддержания актуальности. Пятый этап определяет, насколько долгосрочными будут инвестиции.

Принципы извлечения контента слоем Retrieval обсуждаются в статье Grounding и RAG в Agentforce.

Этап 1: Целенаправленный Аудит

Не следует проверять всю базу данных. Вместо этого составляется список сценариев, которые будет обрабатывать агент, и формируется перечень реальных вопросов, взятых из фактически поступивших обращений, а не вымышленных. Для каждого вопроса проверяется: наличие статьи, дата последнего обновления, ответственный и актуальность ответа на текущий момент.

Результатом являются четыре категории: содержание актуально и покрыто, содержание покрыто, но устарело, содержание покрыто несколькими противоречивыми версиями, и содержание отсутствует. Третья категория наиболее рискованна, поскольку она приводит к тому, что агент выдает различные ответы на один и тот же вопрос.

Выявленный в четвертой категории пробел не всегда является проблемой — он становится основой для нового контента, а пока остается списком тем, требующих участия человека.

Этап 2: Архивирование до Написания

Самое сложное в организациях — это принятие решения об удалении. Однако устаревшая статья в базе знаний наносит больший ущерб, чем отсутствующая: отсутствие приводит к эскалации, а устаревшая статья приводит к ошибочному, но уверенному ответу.

Простое рабочее правило: любая статья, не имеющая владельца и не обновлявшаяся в течение определенного для ее области срока, исключается из индекса. Она может оставаться в архиве для документации, но недоступна для агента.

В случае конфликта между двумя версиями решение принимает владелец контента, а не техническая команда. Это требует бизнес-решения, и его игнорирование приводит к возвращению проблем на этапе тестирования.

Этап 3: Структура Статьи

Хорошая структура для агента также хороша и для читателя, поэтому это не дублирующая работа. Заголовок формулируется как вопрос или сценарий на языке, используемом пользователями, а не на внутреннем жаргоне. Первый абзац содержит краткий и самодостаточный ответ. Детали излагаются в разделах с подзаголовками.

Два правила, непосредственно влияющие на качество извлечения информации: условия соответствия и исключения должны быть в отдельном и помеченном разделе, а не вплетены в предложение; таблицы должны быть небольшими и самодостаточными, так как обрезанная таблица приводит к частичному ответу.

Чего следует избегать: длинных статей, охватывающих пять тем. Лучше разбить их на пять сфокусированных статей — извлечение будет точнее, а обслуживание легче.

Более широкие принципы управления знаниями в Service Cloud подробно изложены в Управление Knowledge в Salesforce.

Этап 4: Тегирование и Разделение Аудиторий

Минимальное тегирование, необходимое почти в каждой организации: продукт или линия услуг, рынок или страна, язык, целевая аудитория, статус утверждения и срок действия. В глобальной организации отсутствие тегов для рынка и языка — основная причина неверных ответов: агент с полной уверенностью извлечет политику другой страны.

Разделение аудиторий — это решение в области безопасности, а не только классификация. Контент, написанный для представителей, иногда содержит скидки, формулировки для обработки возражений и информацию о конкурентах. В клиентском канале по умолчанию должен действовать принцип белого списка: только контент, явно помеченный как разрешенный для клиента, становится доступным.

Документ, большая часть которого разрешена, но один абзац содержит конфиденциальную информацию, не является редким исключением — это часто встречающаяся ситуация. Решение состоит в разделении документа, а не в пометке всего документа как внутреннего.

Этап 5: Ответственность и Обслуживание

Этот этап определяет долгосрочную устойчивость результата. За каждой областью знаний закрепляется ответственный, устанавливается частота проверки и определяется, что происходит по истечении срока действия статьи — автоматическое удаление из индекса, а не оповещение, которое никто не читает.

Механизм обратной связи делает обслуживание эффективным. Каждое обращение, завершившееся эскалацией из-за отсутствия источника, добавляется в список пробелов в контенте, что является наилучшим приоритетным списком для создания нового контента. Лучше написать пять статей, которые действительно необходимы, чем пятьдесят, которые казались важными.

Бюджетирование: поддержка контента — это постоянная статья расходов, а не проект. Организации, которые относятся к ней как к разовой задаче, видят снижение точности ответов в течение двух кварталов.

Пороги Входа в Индекс

КритерийМинимальный ПорогПричина
ОтветственностьОтветственный по имени для каждой статьиБез ответственного нет того, кто будет обновлять
АктуальностьВ рамках определенного для области периода проверкиПредотвращает цитирование отмененной политики
УникальностьЕдинственный источник для каждой темыПредотвращает противоречивые ответы
АудиторияПомечено как внутреннее или разрешенное для клиентаПредотвращает раскрытие конфиденциальной информации
СтруктураВопрос в заголовке и краткий ответ в началеУлучшает точность извлечения

Сценарий: 1400 Документов Уменьшены до 190

Поставщик ИТ-услуг планировал подключить агента к папке SharePoint с 1400 документами. Первоначальная проверка показала, что только около 30% из них были обновлены за последние три года, и около 200 были черновиками или рабочими версиями.

Вместо проекта генеральной очистки команда определила 25 сценариев, которые должен был охватывать агент. Из всей базы данных было найдено 190 релевантных документов; из них 40 были противоречивыми и требовали решения от трех владельцев областей знаний. Выбранные документы были разделены на сфокусированные статьи и помечены по продукту и аудитории.

Пилот был запущен со 190 элементами вместо 1400, и точность ответов была значительно выше, чем в первой попытке. Остальная часть базы данных осталась в архиве и постепенно добавлялась в соответствии со списком пробелов, накапливающимся в результате реальных эскалаций.

Риски и Превентивные Меры

РискКак проявляетсяПревентивные меры
Включение всей базы данныхНизкая точность и трудность выявления причиныВключение по сценариям, а не по всей базе данных
Статьи без владельцаТихое устареваниеОтветственность как условие входа в индекс
Противоречивые версииРазные ответы на один и тот же вопросБизнес-решение и архивирование
Смешивание внутреннего и внешнего контентаРаскрытие конфиденциальной информации клиентуБелый список для внешнего канала
Обслуживание как одноразовый проектСнижение точности в течение двух кварталовПостоянное бюджетирование и SLA на обновление

Метрики Готовности Контента

МетрикаОпределениеЧастота
Покрытие сценариевПроцент сценариев с утвержденной статьейЕжемесячно
АктуальностьПроцент статей в индексе в рамках срока действияЕжемесячно
Дублирование темКоличество тем с более чем одним источникомЕжеквартально
Пробелы из эскалацийКоличество новых тем, которые потребовались, но отсутствовалиЕженедельно
Среднее время обновленияСколько времени требуется для исправления ошибочной статьиЕжемесячно

Если требуется поддержка в подготовке базы знаний и создании модели обслуживания, услуга Agentforce и ИИ является практическим путем для дальнейших шагов.

Чек-лист для Подготовки Знаний

  • ☐ Составлен список реальных вопросов на основе фактических обращений.
  • ☐ Каждый вопрос классифицирован: актуальный, устаревший, противоречивый или отсутствующий.
  • ☐ Статьи без владельцев архивированы или им назначен владелец.
  • ☐ Конфликты разрешены владельцем контента.
  • ☐ Статьи структурированы: заголовок-вопрос, краткий ответ, разделы.
  • ☐ Условия соответствия и исключения находятся в отдельном разделе.
  • ☐ Проведено тегирование по продукту, рынку, языку, аудитории и сроку действия.
  • ☐ Внутренний контент отделен от контента, одобренного для клиента.
  • ☐ Определена частота проверки и автоматическое удаление по истечении срока действия.
  • ☐ Создан механизм преобразования эскалаций в список для написания нового контента.