---
read_when:
    - การเรียกใช้การตรวจสอบความน่าเชื่อถือของเอเจนต์ส่วนบุคคลในเครื่อง
    - การขยายแค็ตตาล็อกสถานการณ์ QA ที่จัดเก็บในรีโพซิทอรี
    - การตรวจสอบการเตือนความจำ การตอบกลับ หน่วยความจำ การปกปิดข้อมูล การดำเนินการต่อด้วยเครื่องมืออย่างปลอดภัย สถานะงาน การวินิจฉัยที่ปลอดภัยต่อการแชร์ การอ้างว่าดำเนินการเสร็จสิ้นโดยมีหลักฐานรองรับ และการกู้คืนจากความล้มเหลว
summary: สถานการณ์จำลอง qa-channel ภายในเครื่องสำหรับตรวจสอบเวิร์กโฟลว์ผู้ช่วยส่วนตัวที่รักษาความเป็นส่วนตัว
title: ชุดเกณฑ์มาตรฐานสำหรับเอเจนต์ส่วนบุคคล
x-i18n:
    generated_at: "2026-07-12T15:59:28Z"
    model: gpt-5.6
    postprocess_version: locale-links-v1
    provider: openai
    source_hash: 35da45e4b22b1044a777fa8d6bce87f9ace377950dd0af3f2419b40cfe4d9be6
    source_path: concepts/personal-agent-benchmark-pack.md
    workflow: 16
---

ชุดเกณฑ์มาตรฐาน Personal Agent เป็นชุดสถานการณ์ QA ขนาดเล็กที่มีรีโพเป็นฐานสำหรับ
เวิร์กโฟลว์ผู้ช่วยส่วนตัวภายในเครื่อง ไม่ใช่เกณฑ์มาตรฐานโมเดลทั่วไป และ
ไม่ต้องใช้ตัวรันใหม่ โดยนำสแตก QA ส่วนตัว ([ภาพรวม QA](/th/concepts/qa-e2e-automation)),
[ช่องทาง QA](/th/channels/qa-channel) แบบสังเคราะห์ และแค็ตตาล็อก YAML
`qa/scenarios` ที่มีอยู่มาใช้ซ้ำ

## สถานการณ์

สถานการณ์สิบรายการ ซึ่งกำหนดไว้ใน `qa/scenarios/personal/*.yaml`:

| รหัสสถานการณ์                             | สิ่งที่ตรวจสอบ                                                                                |
| ------------------------------------------ | -------------------------------------------------------------------------------------------- |
| `personal-reminder-roundtrip`              | การแจ้งเตือนส่วนตัวจำลองผ่านการส่งของ Cron ภายในเครื่อง                                      |
| `personal-channel-thread-reply`            | การกำหนดเส้นทาง DM จำลองและการตอบกลับเธรดผ่าน `qa-channel`                                   |
| `personal-memory-preference-recall`        | การเรียกคืนค่ากำหนดจำลองจากไฟล์หน่วยความจำในพื้นที่ทำงาน QA ชั่วคราว                         |
| `personal-redaction-no-secret-leak`        | การตรวจสอบว่าไม่มีการสะท้อนข้อมูลลับจำลองกลับ                                                 |
| `personal-tool-safety-followthrough`       | การดำเนินการต่อด้วยเครื่องมือที่ปลอดภัยและอ้างอิงข้อมูลจากการอ่าน หลังการโต้ตอบสั้น ๆ แบบขออนุมัติ |
| `personal-approval-denial-stop`            | พฤติกรรมหยุดทำงานเมื่อถูกปฏิเสธการอนุมัติสำหรับคำขออ่านข้อมูลภายในเครื่องที่ละเอียดอ่อน      |
| `personal-task-followthrough-status`       | การรายงานสถานะงานที่มีหลักฐานรองรับ โดยแยกสถานะรอดำเนินการ ถูกบล็อก และเสร็จสิ้นออกจากกัน     |
| `personal-share-safe-diagnostics-artifact` | อาร์ติแฟกต์การวินิจฉัยที่ปลอดภัยต่อการแชร์ ซึ่งคงสถานะที่เป็นประโยชน์ไว้โดยละเว้นเนื้อหาส่วนบุคคลดิบ |
| `personal-no-fake-progress`                | การกล่าวอ้างว่างานเสร็จสิ้นที่มีหลักฐานรองรับ ซึ่งหลีกเลี่ยงการรายงานความคืบหน้าเท็จก่อนมีหลักฐานภายในเครื่อง |
| `personal-failure-recovery`                | การกู้คืนจากความล้มเหลวที่รายงานสถานะบางส่วนและทำให้ขอบเขตการลองใหม่ชัดเจน                    |

ข้อมูลเมตาของชุดที่เครื่องอ่านได้ (รายการรหัส ชื่อ และคำอธิบาย) อยู่ใน
`extensions/qa-lab/src/scenario-packs.ts` ในชื่อ `QA_PERSONAL_AGENT_SCENARIO_IDS`
เรียกใช้ชุดด้วย `--pack personal-agent`:

```bash
OPENCLAW_ENABLE_PRIVATE_QA_CLI=1 pnpm openclaw qa suite \
  --provider-mode mock-openai \
  --pack personal-agent \
  --concurrency 1
```

`--pack` ใช้เสริมร่วมกับแฟล็ก `--scenario` ที่ระบุซ้ำได้ สถานการณ์ที่ระบุอย่างชัดเจนจะทำงาน
ก่อน จากนั้นสถานการณ์ในชุดจะทำงานตามลำดับใน `QA_PERSONAL_AGENT_SCENARIO_IDS`
โดยตัดรายการซ้ำออก

ชุดนี้มุ่งเป้าไปที่ `qa-channel` โดยใช้ `mock-openai` หรือเลนผู้ให้บริการ QA ภายในเครื่องอื่น
อย่ากำหนดให้ชุดนี้เชื่อมต่อกับบริการแชตจริงหรือบัญชีส่วนตัวจริง

## โมเดลความเป็นส่วนตัว

สถานการณ์ใช้เฉพาะผู้ใช้จำลอง ค่ากำหนดจำลอง ข้อมูลลับจำลอง และ
พื้นที่ทำงาน Gateway สำหรับ QA ชั่วคราวที่ชุดสร้างขึ้นเท่านั้น สถานการณ์ต้องไม่อ่านหรือ
เขียนหน่วยความจำผู้ใช้ เซสชัน ข้อมูลประจำตัว ตัวแทนการเริ่มทำงาน การกำหนดค่าส่วนกลาง
หรือสถานะ Gateway จริงของ OpenClaw

อาร์ติแฟกต์จะอยู่ภายใต้ไดเรกทอรีอาร์ติแฟกต์ของชุด QA ที่มีอยู่ และถือเป็น
ผลลัพธ์การทดสอบ การตรวจสอบการปกปิดข้อมูลใช้เครื่องหมายจำลอง เพื่อให้สามารถ
ตรวจสอบความล้มเหลวและบันทึกลงในประเด็นปัญหาได้อย่างปลอดภัย

## การขยายชุด

เพิ่มกรณี `.yaml` ใหม่ภายใต้ `qa/scenarios/personal/` จากนั้นเพิ่มรหัสสถานการณ์
ลงใน `QA_PERSONAL_AGENT_SCENARIO_IDS` แต่ละกรณีควรมีขนาดเล็ก ทำงานภายในเครื่อง ให้ผลลัพธ์แน่นอน
ใน `mock-openai` และมุ่งเน้นพฤติกรรมผู้ช่วยส่วนตัวเพียงหนึ่งอย่าง

ตัวเลือกที่เหมาะสำหรับการดำเนินการต่อ: การตรวจสอบการส่งออกลำดับการทำงานที่ปกปิดข้อมูลแล้ว
และการตรวจสอบเวิร์กโฟลว์ Plugin ที่ทำงานภายในเครื่องเท่านั้น

หลีกเลี่ยงการเพิ่มตัวรัน Plugin การขึ้นต่อกัน การขนส่งแบบสด หรือตัวตัดสินด้วยโมเดลใหม่
จนกว่าแค็ตตาล็อกสถานการณ์จะมีกรณีที่เสถียรเพียงพอเพื่อรองรับพื้นผิวนั้น
