Amazon Bedrock Guardrails เจาะลึก
6 นโยบายที่ต้องรู้ เลือกใช้ให้ถูกกับโจทย์ — หัวข้อที่ออกสอบบ่อยที่สุดใน domain นี้
PII ใน output ถูก mask ส่วนเนื้อหาที่ละเมิด policy ถูก block ทั้งขาเข้าและขาออก
| Policy | ใช้กับ | ตัวอย่างโจทย์ |
|---|---|---|
Content filters | Hate, Insults, Sexual, Violence, Misconduct, Prompt attack (ปรับ strength ได้ Low–High) | กันเนื้อหาไม่เหมาะสม / jailbreak |
Denied topics | หัวข้อที่ห้ามคุย (อธิบายเป็นภาษาธรรมชาติ + ตัวอย่าง) | ห้ามให้คำแนะนำการลงทุนเฉพาะหุ้น |
Word filters | คำเฉพาะ (custom words) + profanity | ห้ามพูดถึง ชื่อคู่แข่ง |
Sensitive information filters | PII (BLOCK หรือ ANONYMIZE/mask) + regex เอง | ซ่อนเบอร์โทร, เลขบัตร, เลข medical record |
Contextual grounding check | คะแนน grounding (อิงแหล่งข้อมูล) และ relevance (ตรงคำถาม) | ลด hallucination ใน RAG |
Automated Reasoning checks | ตรวจคำตอบกับกฎ/นโยบายเชิงตรรกะที่กำหนด | ตรวจว่าคำตอบเรื่องสิทธิ์ลาตรงนโยบาย HR |
จุดที่มักถูกถาม
- ApplyGuardrail API — ใช้ guardrail ตรวจข้อความได้ โดยไม่ต้องเรียกโมเดล ใช้กับโมเดลนอก Bedrock (SageMaker, self-hosted, third-party) ได้
- ใช้ guardrail เดียวกันกับ Agents, Knowledge Bases, Flows ได้
- ดู metric
InvocationsIntervenedใน CloudWatch เพื่อดูว่า guardrail ทำงานบ่อยแค่ไหน - Guardrails ไม่ใช่ เครื่องมือวัด fairness/bias เชิงสถิติ → ใช้ SageMaker Clarify หรือ model evaluation แทน
AI ผู้ช่วยด้านการเงินต้องห้ามพูดถึงคู่แข่ง 3 บริษัททั้งใน input และ output ควรใช้ policy ใด?
การดึงความรู้ออกมาใช้ทันทีหลังอ่าน (retrieval practice) ช่วยให้จำได้นานขึ้นมาก