Sandbox và permission boundary tạo ra lớp giới hạn để AI Skill chỉ đọc, ghi hoặc gọi đúng tài nguyên cần thiết, giảm tác động khi đầu vào bị thao túng.

Sandbox trong AI Skill là gì?

Sandbox là môi trường cô lập nơi Skill xử lý tệp, mã hoặc công cụ mà không ảnh hưởng trực tiếp tới hệ thống chính.

Permission boundary hoạt động thế nào?

Permission boundary quy định tài nguyên, thao tác, thời gian và điều kiện mà từng Skill được phép sử dụng; cần kiểm tra ở phía máy chủ.

Năm nguyên tắc thiết kế quyền tối thiểu

Cấp quyền theo tác vụ; tách đọc và ghi; giới hạn mạng và dữ liệu; đặt thời hạn phiên; yêu cầu approval cho hành động khó hoàn tác.

Xử lý lỗi và thu hồi quyền

Khi công cụ lỗi, Skill không tự mở rộng quyền. Giữ boundary ban đầu, trả mã lỗi và thu hồi token khi phiên kết thúc. Xem error handling AI Skill.

Bộ kiểm thử sandbox

Kiểm thử truy cập ngoài thư mục, domain ngoài allowlist, đọc secret, ghi sai định dạng, chạy lệnh vượt quyền, timeout và retry.

Checklist triển khai

Quyền tối thiểu; tách đọc/ghi/mạng; sandbox giới hạn thư mục và thời gian; approval cho hành động nguy hiểm; lỗi không mở rộng quyền; log không ghi secret; đã test boundary và thu hồi.

Sandbox có thay thế được guardrails không?

Không. Sandbox giới hạn tác động ở cấp môi trường; guardrails kiểm tra dữ liệu và đầu ra. Hai lớp cần phối hợp.

Retry có được yêu cầu thêm quyền không?

Không tự động. Retry phải dùng cùng boundary hoặc dừng để người có thẩm quyền xem xét.

Sandbox và permission boundary giúp AI Skill an toàn hơn khi đầu vào bị thao túng hoặc công cụ gặp lỗi. Kết hợp với guardrails AI Skill.