OpenAI đang phải chi hơn 500.000 USD mỗi ngày để điều tra hoạt động của các AI agent sau hàng loạt vụ truy cập trái phép, trong đó có các website của chính phủ Australia. Công ty phải rà soát tới 50 petabyte dữ liệu, khối lượng lớn đến mức nếu một người làm thủ công sẽ mất khoảng 66 triệu năm để đọc hết.
Chi phí khổng lồ này xuất hiện sau khi các AI agent của OpenAI bị phát hiện truy cập trái phép vào nhiều hệ thống. Mới nhất, công ty xác nhận một agent đã xâm nhập website của chính quyền bang New South Wales hồi tháng 6 và truy cập dữ liệu lịch sử không công khai về các vụ cháy rừng.
Đây đã là website chính phủ thứ sáu tại Australia được OpenAI thông báo về hoạt động của AI agent kể từ tháng trước. Trước đó, Thủ tướng Anthony Albanese từng công bố việc các agent của OpenAI truy cập trái phép cổng thống kê Medicare của Services Australia.
Tuy nhiên, việc phát hiện và thông báo những sự cố này không thể diễn ra ngay lập tức. Nguyên nhân nằm ở lượng dữ liệu khổng lồ mà OpenAI phải rà soát để xác định chính xác các agent đã làm gì.
Theo OpenAI, công ty hiện phải kiểm tra khoảng 50 petabyte dữ liệu, tương đương khoảng 50 triệu GB. Khối lượng này lớn đến mức nếu giao cho con người xử lý, thời gian cần thiết có thể lên tới 66 triệu năm.
Vì vậy, OpenAI đang triển khai AI để hỗ trợ kiểm tra dữ liệu. Đây cũng là một nghịch lý đáng chú ý của sự cố: chính công nghệ AI được sử dụng để xử lý khối lượng dữ liệu quá lớn nhằm tìm hiểu hoạt động của các AI agent đã gây ra vấn đề.
Quá trình rà soát vẫn chưa kết thúc. OpenAI cảnh báo có thể tiếp tục phát hiện thêm những trường hợp khác và nhiều tổ chức có thể được thông báo rằng hệ thống của họ từng bị các agent truy cập. Một số sự kiện có thể đã xảy ra từ nhiều tháng trước.
Công ty cho biết sẽ thông báo riêng cho các tổ chức nếu họ cần điều tra hoặc khắc phục những vấn đề bảo mật tiềm ẩn. OpenAI cũng tuyên bố sẽ công khai các phát hiện liên quan đến hành vi của agent và những điểm yếu trong các cơ chế bảo vệ, qua đó cung cấp thêm thông tin cho lĩnh vực AI.
Trong trường hợp mới nhất tại New South Wales, OpenAI phát hiện sự cố vào ngày thứ Ba và tiến hành rà soát trong 48 giờ trước khi thông báo cho chính quyền bang cũng như Cơ quan Tín hiệu Australia.
Cách xử lý này cũng cho thấy một vấn đề khác đang nổi lên khi AI agent ngày càng có khả năng tự thực hiện các tác vụ trên Internet. OpenAI cho biết công ty chủ động thông báo ngay cả khi chưa thể xác định chắc chắn dữ liệu bị truy cập vốn được dự định công khai hay không, để tổ chức liên quan có thể tự kiểm tra và xử lý.
Vụ việc Medicare thậm chí đã khiến chính phủ Australia yêu cầu các bộ ngành và cơ quan trực thuộc rà soát toàn bộ công nghệ cũ đang được sử dụng. Mục tiêu là giảm số lượng hệ thống lỗi thời và hạn chế những rủi ro an ninh mạng mà chúng có thể tạo ra khi phải đối mặt với AI agent.
Trong khi đó, cuộc tranh luận về an toàn AI tại Australia sẽ tiếp tục được đẩy lên cao khi lãnh đạo OpenAI cùng các công ty Anthropic, Microsoft và Google xuất hiện trước một ủy ban nghị viện chung về AI tại Sydney.
Với OpenAI, vấn đề lúc này không chỉ là xác định một AI agent đã truy cập vào đâu. Công ty còn phải xử lý hàng chục triệu GB dữ liệu để tìm ra toàn bộ những gì có thể đã xảy ra, với chi phí điều tra vượt 500.000 USD mỗi ngày và chưa có dấu hiệu kết thúc.
Nguyễn Hải
