---
read_when:
    - Запуск локальных проверок надёжности персонального агента
    - Расширение хранящегося в репозитории каталога сценариев контроля качества
    - Проверка напоминаний, ответов, памяти, редактирования конфиденциальных данных, безопасного выполнения последующих действий с инструментами, статуса задач, диагностики, безопасной для публикации, подтверждённых доказательствами заявлений о завершении и восстановления после сбоев
summary: Локальные сценарии qa-channel для проверки рабочих процессов персонального помощника с сохранением конфиденциальности.
title: Набор бенчмарков для персонального агента
x-i18n:
    generated_at: "2026-07-13T19:43:31Z"
    model: gpt-5.6
    postprocess_version: locale-links-v1
    prompt_version: 24
    provider: openai
    source_hash: 35da45e4b22b1044a777fa8d6bce87f9ace377950dd0af3f2419b40cfe4d9be6
    source_path: concepts/personal-agent-benchmark-pack.md
    workflow: 16
---

Пакет бенчмарков персонального агента — это небольшой пакет сценариев QA на базе репозитория для
локальных рабочих процессов персонального помощника. Это не универсальный бенчмарк модели, и
ему не требуется новый исполнитель: он повторно использует закрытый стек QA ([обзор QA](/ru/concepts/qa-e2e-automation)),
синтетический [канал QA](/ru/channels/qa-channel) и существующий
каталог YAML `qa/scenarios`.

## Сценарии

Десять сценариев, определённых в `qa/scenarios/personal/*.yaml`:

| Идентификатор сценария                     | Проверки                                                                                               |
| ------------------------------------------ | ------------------------------------------------------------------------------------------------------ |
| `personal-reminder-roundtrip`              | Имитация персональных напоминаний с локальной доставкой через Cron                                     |
| `personal-channel-thread-reply`            | Имитация маршрутизации личных сообщений и ответов в ветках через `qa-channel`                    |
| `personal-memory-preference-recall`        | Имитация извлечения предпочтений из временных файлов памяти рабочего пространства QA                   |
| `personal-redaction-no-secret-leak`        | Имитация проверок отсутствия вывода секретов                                                           |
| `personal-tool-safety-followthrough`       | Безопасное продолжение работы с инструментом, основанное на чтении, после короткого запроса подтверждения |
| `personal-approval-denial-stop`            | Прекращение работы при отказе в подтверждении конфиденциального локального запроса на чтение           |
| `personal-task-followthrough-status`       | Отчёт о состоянии задачи с подтверждениями, в котором ожидающие, заблокированные и завершённые задачи разделены |
| `personal-share-safe-diagnostics-artifact` | Безопасные для публикации диагностические артефакты, сохраняющие полезные сведения о состоянии без исходного персонального содержимого |
| `personal-no-fake-progress`                | Подтверждённые заявления о завершении, исключающие ложные сообщения о прогрессе до появления локальных доказательств |
| `personal-failure-recovery`                | Восстановление после сбоя с сообщением о частичном состоянии и чёткими границами повторных попыток     |

Машиночитаемые метаданные пакета (список идентификаторов, заголовок, описание) находятся в
`extensions/qa-lab/src/scenario-packs.ts` как `QA_PERSONAL_AGENT_SCENARIO_IDS`.
Запустите пакет с помощью `--pack personal-agent`:

```bash
OPENCLAW_ENABLE_PRIVATE_QA_CLI=1 pnpm openclaw qa suite \
  --provider-mode mock-openai \
  --pack personal-agent \
  --concurrency 1
```

`--pack` дополняет повторяющиеся флаги `--scenario`. Сначала выполняются явно указанные сценарии,
затем сценарии пакета выполняются в порядке `QA_PERSONAL_AGENT_SCENARIO_IDS`
с удалением дубликатов.

Пакет предназначен для `qa-channel` с `mock-openai` или другой локальной
линией провайдера QA. Не направляйте его на действующие службы чатов или реальные личные учётные записи.

## Модель конфиденциальности

Сценарии используют только фиктивных пользователей, фиктивные предпочтения, фиктивные секреты и
временное рабочее пространство Gateway для QA, создаваемое набором тестов. Они не должны читать или
изменять реальную пользовательскую память OpenClaw, сеансы, учётные данные, агенты запуска, глобальные
конфигурации или состояние действующего Gateway.

Артефакты остаются в существующем каталоге артефактов набора QA и рассматриваются
как результаты тестирования. Проверки редактирования используют фиктивные маркеры, поэтому сбои можно
безопасно исследовать и регистрировать в задачах.

## Расширение пакета

Добавьте новые случаи `.yaml` в `qa/scenarios/personal/`, затем добавьте идентификатор сценария
в `QA_PERSONAL_AGENT_SCENARIO_IDS`. Каждый случай должен быть небольшим, локальным и детерминированным
в `mock-openai`, а также сосредоточенным на одном аспекте поведения персонального помощника.

Подходящие кандидаты для дальнейшего развития: проверки экспорта траекторий с редактированием, проверки
локальных рабочих процессов плагинов.

Не добавляйте новый исполнитель, плагин, зависимость, действующий транспорт или модель-судью,
пока каталог сценариев не будет содержать достаточно стабильных случаев, оправдывающих такую поверхность.
