Prompt
Prompt soát agent theo bộ ba chết người của prompt injection
Soát agent của mình theo "bộ ba chết người" (lethal trifecta) của prompt injection.
1) Liệt kê mọi tool, quyền, kết nối, biến môi trường và nguồn dữ liệu agent dùng được (đọc file, email, database, web, API, gửi mail, gọi webhook/HTTP, tạo link hoặc ảnh từ URL, commit/push...).
2) Đánh dấu mỗi mục thuộc chân nào: (A) đọc dữ liệu riêng, (B) đọc nội dung lạ không tin được (trang web, email đến, PDF, issue, comment), (C) gửi được dữ liệu ra ngoài (mail, HTTP request, link/ảnh có tham số, commit/push).
3) Chỉ ra mọi luồng mà trong cùng một phiên/cùng một ngữ cảnh agent có đủ cả A, B và C — đó là luồng một câu lệnh giấu trong nội dung lạ có thể lấy dữ liệu ra ngoài.
4) Với mỗi luồng nguy hiểm, đề xuất: cắt ít nhất một chân (tách agent đọc web ra khỏi agent cầm dữ liệu và khoá, chặn gửi ra ngoài hoặc chỉ cho phép danh sách domain), thêm bước người duyệt trước các hành động nguy hiểm (gửi mail, chuyển tiền, xoá file, deploy), và coi mọi nội dung agent đọc được là dữ liệu chứ không phải mệnh lệnh (tách rõ khỏi chỉ dẫn hệ thống, không cho nó đổi mục tiêu hay gọi tool).
5) Báo bảng: Tool/quyền | Chân A/B/C | Nằm trong luồng đủ 3 chân? | Mức rủi ro | Cách sửa | Ưu tiên.
Không in khoá, token hay dữ liệu thật ra kết quả.