Skip to main content
Протестируйте агента на ожидаемых ответах и случаях сбоев перед изменением аудитории на EVERYONE.

Начните с ограниченных настроек

Оставьте развертывание, передачу диалога и последующие действия отключенными во время создания базовой линии тестирования. Ограничьте аудиторию перед добавлением тестовых получателей. Справочник по API: GET Get Settings · PUT Replace Settings
GET Get Settings возвращает массив, даже если существует только один объект настроек. PUT Replace Settings возвращает обновленный объект настроек. YCloud пропускает поля со значением null перед вызовом Meta, поэтому непереданные настройки остаются без изменений. Считайте действующие настройки после обновления. Изменяйте только одно поведение за раз при тестировании передачи диалога или последующих действий, затем восстанавливайте ограниченную базовую линию перед переходом к другому сценарию.

Добавление тестовых получателей

Оставьте для ai_audience значение ALLOWLISTED_ONLY, затем добавьте каждого тестировщика в виде номера телефона в формате E.164. Сохраните возвращенный id записи списка разрешенных, чтобы позже можно было удалить эту запись. Справочник по API: GET List Allowlist · POST Create Allowlist Entry · DELETE Delete Allowlist Entry
Используйте GET List Allowlist для просмотра текущей тестовой аудитории. Используйте DELETE Delete Allowlist Entry для удаления тестировщика по возвращенному ID записи.
Не используйте номер конечного пользователя с телефонным кодом страны +86. В настоящее время Meta Business Agent не отвечает на сообщения от конечных пользователей +86, даже если номер отформатирован в правильном формате E.164 и добавлен в список разрешенных.

Запуск одношагового теста

Справочник по API: POST Test Agent
Успешный ответ может содержать:
Текущий ответ REST не включает estimated_token_usage.

Сохранение контекста для многошаговых тестов

Отправьте возвращенный conversation_id со следующим сообщением клиента. Справочник по API: POST Test Agent
Используйте новый диалог для сценариев, которые не должны наследовать предыдущий контекст.

Тестирование знаний, навыков, коннекторов и инструментов

Охватите настроенные ресурсы вместо тестирования только идеальных сценариев (happy-path). Справочник по API: POST Run Connector Tool · GET List Connector Logs
  • Задавайте вопросы, ответы на которые содержатся в бизнес-информации, FAQ, на веб-сайтах и в файлах.
  • Проверяйте недостающие факты, противоречивые источники, устаревший контент и неподдерживаемые запросы.
  • Проверяйте, когда каждый навык должен и не должен запускаться.
  • Проверяйте каждый инструмент коннектора с валидными, невалидными и неполными входными данными.
  • Убедитесь, что секретные значения никогда не появляются в ответах или журналах.
  • Включайте случаи, которые должны инициировать передачу диалога человеку или не давать ответа.
Если вызов коннектора завершается ошибкой, изучите журналы коннектора и проверьте учетные данные, состояние сертификата, привязки параметров и определения запросов инструмента перед изменением навыка. Запустите каждый настроенный инструмент напрямую через /connectors/{connectorId}/tools/{toolId}/runs с репрезентативными input, прежде чем разрешить агенту выбирать его в диалоге:

Тестирование через WhatsApp с получателями из списка разрешенных

Проверьте те же сценарии с каждого тестового номера телефона из списка разрешенных. Это подтверждает поведение в реальном канале, которое тестовая конечная точка не может воспроизвести полностью.
Во время раннего доступа тестовая конечная точка может возвращать пустой ответ или ELIGIBILITY_CHECK_FAILED, пока аудитория имеет значение ALLOWLISTED_ONLY. Проверьте no_response_reason, соответствие требованиям, развертывание, аудиторию и настройки списка разрешенных. Если для тестирования API требуется EVERYONE, используйте его только в контролируемой среде и восстановите ограниченную настройку сразу после теста.

Запуск оценок

API оценки предоставляет следующие ресурсы: Перечислите доступные случаи, отправьте запуск, используя требуемое значение eval_case_ids, сохраните возвращенный job_id и опрашивайте конечную точку задания.
Поле статуса возвращается в виде строки и в настоящее время не ограничено документированным перечислением. Прекратите опрос, когда в ответе будет получен завершенный результат или ошибка, вместо того чтобы предполагать недокументированные имена статусов. Случаи оценки описывают scenario, categories, max_turns и success_criteria. Подробные результаты включают оценки, метки ходов, причины, стенограммы и временные метки. Сводки объединяют оценки, основные моменты и категории сбоев.

Контрольный список для запуска

  • Необходимые бизнес-факты верны и не противоречат друг другу.
  • Многоходовые разговоры сохраняют заданный контекст.
  • Отсутствующая информация приводит к безопасному ответу вместо выдуманного.
  • Инструменты коннектора успешно работают и безопасно завершаются с ошибкой при репрезентативном вводе.
  • Сценарии передачи работают как ожидается.
  • Ошибки оценки рассмотрены и либо исправлены, либо явно приняты.
  • Ответственный за откат знает, как отключить развертывание.

Далее: Безопасное развертывание

Сначала включите агента для получателей из белого списка, а затем расширьте на всю аудиторию.