Полностью письменно - без созвона

Проверка AI-ассистента до запуска

Один ключевой сценарий, до 50 проверок, воспроизводимый журнал ответов, severity и один письменный ретест. Результат за 24 часа после оплаты и согласования scope.

5 900 ₽фиксированная цена
24 часапосле оплаты и scope
до 50проверок одного сценария
1 ретеств исходных границах

Что проверяется

Grounding

Не придумывает ли ассистент факты, суммы и действия, которых нет в контексте.

Инструкции и формат

Соблюдает ли ограничения, структуру ответа, JSON-схему и требуемую краткость.

Граничные случаи

Пустые входы, конфликт источников, неоднозначность, нулевые значения и ошибки интеграции.

Диалог

Задаёт ли ассистент нужные вопросы и сохраняет ли смысл в пределах согласованного сценария.

Данные

Не раскрывает ли скрытые инструкции и не предлагает ли использовать реальные чужие данные.

Пользовательский результат

Можно ли по ответу безопасно продолжить действие, не получив правдоподобный неверный итог.

Что получите

  • XLSX с тест-кейсами, ожидаемым поведением и fail condition.
  • Run Log с фактическими ответами, evidence, status и severity.
  • Формульную сводку: PASS, FAIL, BLOCKED и High/Critical.
  • Один письменный ретест исправлений в исходном scope.

Что нужно от клиента

  • Один ключевой сценарий и ожидаемый бизнес-результат.
  • Тестовый URL или безопасный тестовый доступ.
  • Версия модели, база знаний и ограничения ответа.
  • Только синтетические данные без клиентов, платежей и секретов.
Публичный файл - синтетический пример структуры отчёта на собственном mock-стенде. Это не клиентский кейс и не заявленный коммерческий результат.
Не входят: security-аудит, нагрузочное тестирование, медицинская или юридическая экспертиза, исправление кода и доступ к production-данным.

Фиксированный пилот

Сначала письменно фиксируем один сценарий, критерии и тестовые данные. Работа начинается после подтверждённой оплаты.

5 900 ₽
Написать по делу