Trong lộ trình R&D của OpenLAB R&D57, nếu R57-01 và R57-02 đóng vai trò là hai chương trình mũi nhọn về khoa học và tri thức, thì Chương trình R57-03 đóng vai trò là Nền tảng bảo đảm (Security & Governance Foundation).
Chương trình hướng tới việc giải quyết song song hai thách thức lớn của kỷ nguyên số: Ứng dụng AI để nâng cao năng lực an ninh mạng (AI for Cybersecurity) và Bảo vệ chính các hệ thống AI khỏi các lỗ hổng, cuộc tấn công thế hệ mới (Security for AI). Toàn bộ nghiên cứu tại R57-03 tuân thủ nghiêm ngặt chuẩn mực đạo đức, pháp lý và tính thực chiến trong môi trường phòng thủ.
Để đảm bảo các nghiên cứu an ninh mạng mang lại giá trị phòng thủ thực tế mà không gây ra rủi ro cho hạ tầng công nghệ, mọi dự án thuộc R57-03 phải tuân thủ 4 quy chuẩn bắt buộc:
Mọi hoạt động diễn tập Red Team, kiểm thử lỗ hổng hay mô phỏng tấn công chỉ được phép thực hiện trong môi trường Lab độc lập, được khoanh vùng (Isolated Sandbox/Cyber Range) và có văn bản phê duyệt phạm vi (Scope of Work) cùng mục tiêu nghiên cứu rõ ràng.
Nghiêm cấm mọi hành vi thử nghiệm, quét lỗ hổng hoặc can thiệp không được cấp phép lên hệ thống thật (Production) của đối tác, doanh nghiệp hoặc cơ quan nhà nước.
Không công bố dữ liệu nhạy cảm: báo cáo nghiên cứu tuyệt đối không chứa thông tin đăng nhập (credentials), chuỗi khai thác lỗ hổng (exploit chains) nhắm vào hệ thống thật, dữ liệu cá nhân/nạn nhân (PII/PHI) hoặc các mã độc có thể dùng trực tiếp để gây hại ngoài mục tiêu phòng thủ.
Mọi phát hiện về lỗ hổng bảo mật đều phải tuân theo quy trình Responsible Disclosure (báo cáo riêng cho đơn vị chủ quản sửa lỗi trước khi công bố thông tin kỹ thuật dưới dạng bài học nghiên cứu).
R57-03 bác bỏ các báo cáo định tính hoặc các chỉ số ảo. Hiệu quả của giải pháp AI/SOC phải được đo lường bằng các chỉ số vận hành thực tế:
Nghiên cứu phải tách biệt rõ ràng giữa "Khai thác thành công trong phòng lab" (Lab Proof-of-Concept) và "Rủi ro thực tế ngoài môi trường Production".
Một kỹ thuật tấn công AI (như Prompt Injection hay Data Poisoning) hoạt động được trong môi trường giả định không đồng nghĩa với việc nó dễ dàng vượt qua các lớp bảo vệ đa tầng (Defense-in-depth) trên thực tế. Bài viết nghiên cứu phải phân tích rõ các rào cản thực tế này.
Chuyển giao các mô hình AI hỗ trợ giảm tải cảnh báo rác (Alert Fatigue), tự động hóa quy trình phản ứng sự cố (SOAR).
Đánh giá an toàn cho các hệ thống AI nội bộ, kiểm thử khả năng chống chịu của mô hình trước các kỹ thuật Jailbreak/Prompt Injection.
Cung cấp môi trường diễn tập OpenLAB Cyber Range cho học viên và chuyên gia an ninh mạng thực hành các kịch bản phòng thủ AI.