For the complete documentation index, see llms.txt. This page is also available as Markdown.

Дополнительные настройки

В данном разделе мы подробно расскажем о дополнительных настройках

Описание дополнительных настроек

После того, как прописали основные Инструкции Агента, ввели Название Агента и настроили Время ожидания в секундах, можем переходить к дополнительным настройкам. Для этого перейдите во вкладку Доп.настройки:

Перед Вами развернётся меню с рядом дополнительных вкладок настроек:

Параметры LLM

Выбор языковой модели

При нажатии на поле "Языковая модель" откроется список доступных для подключения моделей.

Выбор модели оформлен таким образом, чтобы было возможным сравнить имеющиеся варианты по ключевым показателям. Качество - взвешенная оценка работы модели. Тип - показывает основные особенности модели, является ли модель думающей, принимает ли изображения для обработки, на каком уровне выполняет математические операции. Стоимость - средняя стоимость модели в сравнении с другими моделями.

Обратите внимание, если у модели активна иконка обработки изображений, это означает, что она принимает изображения напрямую, если иконка неактивна, то модель будет работать с изображениями через внутренний механизм обработки изображения на платформе, который передаст в модель только описание изображения, прямой обработки изображения не будет.

Флаг "Указать языковую модель для тестового чата" позволяет выбрать отдельную модель для тестового чата в кабинете Савви. Таким образом, Вы можете, например, сравнить работу моделей в одном агенте.

Параметры ответа

В данном разделе Вы можете настроить теплоту ответов, используя ползунок "Случайность", чем больше значение, тем более креативным будет ответ, чем меньше, тем более точным и формальным. В диалогах, где нужно точное следование инструкциям, прогнозируемые ответы, лучше придерживаться умеренных, значений, если нужно более разнообразное и свободное общение, то можете увеличить значение случайности.

Максимальное количество токенов в ответе агента - определяет максимальный ответ, который может быть обработан от модели, при превышении лимита в диалоге отобразиться ошибка. В большинстве случае не требует изменений, но в ряде моделей с размышлениями значение необходимо увеличить, значение подбирается опытным путем.

Лимит параллельного вызова функций - если сценарий работы агента подразумевает выполнение большого количества функций, то в некоторых случаях превышение лимита в 10 вызовов приведет к ошибке, если результат выполнения каждой следующей не зависит от результата предыдущей, в этом случае лучше увеличить лимит параллельного вызова, после чего функции будут вызваны параллельно, и не выйдет ошибка последовательного вызова. Дополнительно, это позволит уменьшить стоимость диалога, поскольку вызов всех функций будет осуществлен в рамках одного обращения к модели.

Структурированный ответ

Использовать структурированный ответ - позволяет отправлять большой ответ, содержащий изображения, разбивая его на отдельные сообщения. Более подробно можно ознакомиться с функционалом в отдельной инструкции Структурированные ответы (отправка картинок агентом).

Использовать свою схему - при активации флага откроется окно для ввода своей JSON-схемы, которая позволит структурировать сообщения иным заданным образом.

Параметры ответов

Креативность агента

Соответствие режима значению температуры:

  • Стабильность - 0 (менее креативен, больше отвечает по заранее заготовленному тексту)

  • Сбалансированность - 10 (В сбалансированном режиме чат-бот сочетает точность с лёгкой долей креативности. Этот режим подходит для общения, где требуется и ясность, и немного гибкости)

  • Креативность - 20 (более разнообразные и креативные ответы)

История сообщений (контекст)

Передавать историю сообщений - этот параметр отвечает за то, сколько последних сообщений передаётся в модель для обработки. Другими словами - сколько последних сообщений запоминает агент.

  • Не передавать историю - в этом случае агент будет работать в режиме Вопрос-Ответ.

  • Передавать всю историю - весь диалог за всё время будет передан в модель. Модель будет лучше понимать контекст разговора, но это увеличит расход токенов, а в некоторых ситуациях, может привести и к ухудшению понимания контекста. Например, в бьюти-сфере, когда клиент записывается на услугу раз в месяц и задаёт одни и те же вопросы с определённой периодичностью. В этом случае мы рекомендуем ограничивать контекст истории по времени.

  • Передавать историю за Х сообщений - это значит, что в памяти агента будет храниться определённое количество сообщений, которое задаётся пользователем.

  • Передавать историю за Х минут - это значит, что в памяти агента будет храниться история сообщений только за определённое время.

Маскирование персональных данных

Подробно о Маскировании персональных данных Вы можете прочитать по ссылке .

Условия прерывания диалога

  • Не отвечать при прерывании диалога человеком - в случае, когда сотрудник вмешивается в диалог в зависимости от канала из которого поступает обращение, агент будет переставать отвечать.

  • Фразы по которым будет срабатывать принудительное прерывание диалога - в случае, если в диалоге прозвучит данная фраза (от сотрудника или клиента), агент перестанет отвечать и передаст диалог человеку (администратору). Бывают ситуации, когда сотрудник пишет в конечном канале и СРМ-системы не всегда распознают это сообщение, как сообщение от сотрудника. В этом случае, данная настройка помогает приостановить диалог из конечного канала.

  • Игнорировать первые сообщения от сотрудника - используется, если для начала диалога предусмотрена рассылка.

  • Фразы по которым прерывание срабатывать не будет - используется, если, например, в середине диалога у Вас происходит рассылка или подтверждение записи, и надо, чтобы агент не останавливался, а продолжал общение. В этом случае, надо прописать текст рассылки.

Условия возобновления диалога

  • Возвращение управления агенту после прерывания - настройка, которая позволяет возобновить общение агента спустя установленное время.

  • Время возвращения управления агенту в минутах - время, через которое агент снова возобновит своё общение после прерывания.

  • Фразы для возобновления - фразы, после которых агент включится снова в работу.

Игнорирование сообщений покупателя

Данная настройка служит для того, чтобы агент игнорировал фразы клиента.

  • Если включен флаг Не добавлять сообщение в диалог, то сообщение клиента не будет учитываться в контексте при дальнейшем развитии диалога.

Распознавание изображений

Этот раздел настроек позволяет управлять процессом распознавания изображений агентом. Вы можете выбрать один из режимов работы с изображениями:

  • Выключено — модель не будет распознавать изображения.

  • Передавать в модель напрямую — продвинутый режим, когда модель распознаёт изображения без возврата текста и сразу понимает смысл изображения.

  • Всегда — в этом режиме агент всегда будет распознавать изображения и при этом действовать согласно прописанной инструкции под выпадающим списком.

  • Если не найдено в БЗ — в данном режиме агент будет в первую очередь искать совпадение изображения в БЗ. В случае, если совпадений не будет найдено, агент будет действовать согласно прописанной инструкции под выпадающим списком.

Нераспознанные сообщения

В некоторых каналах могут приходить служебные сообщения или сообщения, которые агент не сможет обработать. На этот случай предусмотрена данная настройка, которая позволяет прописать текст сообщения, который будет отправляться в случае получения нераспознанного сообщения.

Разделение ответа от агента

Разбивка ответа агента на несколько сообщений в зависимости от выбора настроек.

Как настроить?

  1. Выбираем тип разделения ответов.

  2. Устанавливаем размер чанка (количество предложений/параграфов) одной части разделённого ответа.

  3. Выставляем задержку между отправками сообщения в секундах.

Сообщения до и после

Это текст, который будет отправлен До и/или После сообщения от нейросети. Например, можно использовать для подписи, что это агент.

Например: Агент ответил фразой

А в канал (и соответственно конечному клиенту) будет отправлено:

Условия замены

  • Вызывать фоллоу-апы после ответа сотрудника — означает, что бот будет отправлять фоллоу-апы не только после своих сообщений, но и в случае, если клиент не ответит после сообщения сотрудника.

    Подробнее с настройкой фоллоу-апов Вы можете ознакомиться по этой ссылке.

  • Фразы для замены замены служат для того, чтобы в ответе агента заменять нежелательные слова или словосочетания на желаемые.

    Например, чтобы агент в ответах вместо слова "фирма" использовал слово "компания", необходимо прописать "фирма" в поле Значение, а "компания" в поле Параметр.

    Включённая настройка Фраза может быть частью другого слова позволяет заменять часть слова в ответе.

Фоллоу-апы

Рабочее время

Данный раздел позволяет указать часовой пояс, в рамках которого работает и отвечает агент. А так же, позволяет настроить недельное и дневное расписание его работы.

Как настроить расписание работы агента?

Для начала включаем настройку Указать рабочее время:

Далее настраиваем желаемое время работы агента.

Разберём на примере.

Допустим, нам нужно, чтобы агент отвечал только в нерабочее время. Т.е. с 20:00 до 10:00, тогда настройки времени будут выглядеть следующим образом:

Т.е. мы разбиваем рабочее время агента на два временных отрезка в рамках одного дня.

С 00:00 до 10:00 и с 20:00 до 23:59.

Защита от спама

  • Максимальное количество сообщений в диалоге - настройка, позволяющая ограничить длину диалога в количестве сообщений.

  • Максимальная стоимость диалога — при достижении заданной стоимости диалога, агент перестаёт отвечать на сообщения пользователя.

Опции базы знаний

  • Ключевые слова - поскольку база знаний фундаментально работает на смысловом понимании контекста (агент сам решает, когда выбрать тот или иной файл для ответа), в некоторых случаях могут возникать ситуации, когда не вызывает базу знаний. Данная настройка позволяет указать слова, при которых агент будет принудительно в обязательном порядке обращаться к базе знаний, даже если из контекста в этом нет необходимости.

  • Повышенная теплота базы знаний - настройка, которая позволяет указать степень необходимости обращения к базе знаний. Если переключатель включен, то агент будет чаще обращаться к базе знаний, нежели использовать свои собственные знания.

  • Сохранять историю вызова функций - после первого вызова функций, агент будет держать эту функцию в памяти и обращаться к ней в дальнейшем не тратя дополнительные токены на новый вызов. Эта настройка увеличивает стоимость всего диалога, но позволяет уменьшить стоимость отдельного сообщения.

Пользовательские переменные

Последнее обновление

Это было полезно?