Tháng 9/2025, các nhà nghiên cứu của Anthropic phát hiện một điều mà giới an ninh mạng từng chỉ hình dung trong các kịch bản tương lai: một nhóm tin tặc định danh là GTG-1002, đã "bẻ khóa" công cụ Claude Code của chính công ty và biến nó thành một tác nhân tự động thực hiện tới 80-90% khối lượng công việc trong một chiến dịch gián điệp mạng nhắm vào khoảng 30 tổ chức toàn cầu. Đây được Anthropic gọi là "chiến dịch tấn công mạng quy mô lớn đầu tiên được thực hiện mà không có sự can thiệp đáng kể của con người". Sự kiện này đã trở thành biểu tượng cho một thực tế không thể chối cãi: kỷ nguyên hacker AI không còn là dự báo.
AI đang giúp các chuyên gia an ninh mạng phân tích hệ thống và phát hiện điểm yếu nhanh hơn nhưng đồng thời cũng đẩy nhanh việc tạo ra những phương thức tấn công mới, buộc các nhóm nghiên cứu phải liên tục tìm cách phát hiện lỗ hổng trước khi chúng bị khai thác trên quy mô lớn.
Trí tuệ nhân tạo (AI) đang giúp phát hiện và khai thác các lỗ hổng phần mềm nhanh hơn, nhưng điều này không đồng nghĩa các hệ thống trở nên an toàn hơn. Khi số lượng lỗ hổng được phát hiện tăng nhanh, điểm nghẽn của an ninh mạng đang chuyển từ tìm kiếm sang xác định lỗ hổng nào thực sự nguy hiểm và khắc phục chúng trước khi bị tin tặc khai thác.
Sự phát triển nhanh của trí tuệ nhân tạo (AI) và Tác nhân AI (AI Agent) đang làm thay đổi bản chất của các rủi ro về an ninh mạng, khi mối đe dọa ngày càng không nằm ở nội dung mà mô hình AI tạo ra, mà ở những hành động mà hệ thống này có thể tự thực hiện sau khi được cấp quyền truy cập vào dữ liệu, tài khoản và môi trường vận hành thực tế.