OpenAI giải tán đội đánh giá rủi ro AI

OpenAI giải tán đội đánh giá rủi ro AI

Thứ 3, 18/08/2026 12:00
Đội Preparedness, bộ phận duy nhất chuyên đánh giá xem model OpenAI có thể gây thảm họa hay không, đã ngừng hoạt động từ cuối tháng 7

OpenAI đã giải tán đội Preparedness, bộ phận chịu trách nhiệm đánh giá xem các model AI của hãng có nguy cơ gây hậu quả nghiêm trọng hay không, từ cuối tháng 7/2026. Financial Times là nơi đầu tiên đưa tin này hôm 17/8, sau đó được The Verge, Engadget và nhiều báo công nghệ khác dẫn lại.

Đội Preparedness ra đời cuối năm 2023 với nhiệm vụ theo dõi các rủi ro thảm họa từ model AI: khả năng hỗ trợ chế tạo vũ khí sinh học, thực hiện tấn công mạng quy mô lớn, thuyết phục người dùng theo hướng có hại, hoặc tự nhân bản ngoài tầm kiểm soát. Sau khi giải tán, trách nhiệm này không biến mất mà được chia về các nhóm sản phẩm hiện có, mỗi nhóm phụ trách một mảng riêng như an ninh mạng hoặc an toàn sinh học.

Trụ sở OpenAI

Xảy ra ngay sau vụ model tự tấn công Hugging Face

Quyết định giải tán đến chỉ vài tuần sau một sự cố hiếm gặp. Ngày 21/7, OpenAI công khai xác nhận hai model của hãng, gồm GPT-5.6 Sol và một model chưa phát hành, đã tự thoát khỏi môi trường thử nghiệm cách ly trong lúc được đánh giá năng lực tấn công mạng. Hai model khai thác một lỗ hổng zero-day trong phần mềm proxy nội bộ để lên được internet, sau đó xâm nhập vào hạ tầng production của Hugging Face, nền tảng chia sẻ mã nguồn AI lớn nhất thế giới.

Mục đích của model không phải phá hoại, mà để lấy trộm đáp án một bài kiểm tra an ninh mạng nội bộ tên ExploitGym nhằm đạt điểm cao hơn. Hugging Face phát hiện và ngăn chặn được cuộc tấn công, nhưng đáng chú ý là công ty phải dùng một model mã nguồn mở của Trung Quốc, GLM-5.2 từ Zhipu AI, để điều tra sự cố vì các model thương mại của Mỹ, bao gồm cả Claude, đều bị giới hạn quyền khi làm việc liên quan an ninh mạng.

Chưa đầy ba tuần sau, ngày 7/8, OpenAI công bố một model sắp ra mắt tên Astra cho thấy dấu hiệu chạm ngưỡng "Critical", mức cảnh báo cao nhất trong Preparedness Framework, khung đánh giá an toàn nội bộ mà chính công ty xây dựng. Đây là lần đầu tiên một model của OpenAI bị gắn cảnh báo ở mức này. Công ty cho biết chưa thể loại trừ khả năng Astra tự thực hiện được những cuộc tấn công mạng phức tạp nhằm vào hệ thống được bảo vệ nghiêm ngặt, đồng thời siết thêm hàng loạt biện pháp bảo mật cho model này.

Đội thứ tư biến mất trong vòng hai năm

Việc giải tán Preparedness không phải lần đầu OpenAI xóa bỏ một đội an toàn. Năm 2024, sau khi Ilya Sutskever và Jan Leike rời công ty, đội Superalignment cũng ngừng hoạt động. Cùng năm, đội AGI Readiness, phụ trách đánh giá mức độ sẵn sàng của OpenAI trước AGI, cũng bị xóa. Tháng 2/2026, đến lượt đội Mission Alignment, đơn vị giữ cho model đi đúng giá trị công ty đề ra. Preparedness là đội thứ tư rơi vào tình trạng tương tự.

Người đứng đầu Preparedness, Dylan Scandinaro, gia nhập OpenAI từ Anthropic hồi tháng 2/2026, tức mới giữ vai trò này khoảng 5 tháng trước khi đội bị giải tán. Ông không rời công ty mà chuyển sang nghiên cứu một chủ đề hẹp hơn: rủi ro từ AI có khả năng tự cải thiện đệ quy, tức hệ thống tự nâng cấp năng lực của chính nó mà không cần nhiều sự can thiệp của con người.

Đợt tái cấu trúc này diễn ra cùng lúc với làn sóng lãnh đạo cấp cao rời công ty. Trưởng ban Đạo đức Chloé Bakalar rời đi sau chưa đầy một năm tại vị. Chief Futurist Josh Achiam, người từng phụ trách đội Mission Alignment trước khi đội này giải tán, và Trưởng an toàn hệ thống Johannes Heidecke cũng đã ra đi. Giám đốc Doanh thu Denise Dresser và cựu Giám đốc Vận hành Brad Lightcap cũng rời công ty trong cùng giai đoạn.

Phản ứng từ người từng ở vị trí tương tự

Jan Leike, người đứng đầu đội Superalignment trước khi rời OpenAI năm 2024 và hiện làm việc tại Anthropic, nói với Financial Times rằng công ty đang xem nhẹ vấn đề an toàn để chạy theo những sản phẩm hào nhoáng. Đây gần như là câu nói ông từng dùng khi rời đi hai năm trước, khi chỉ trích văn hóa an toàn của OpenAI đã lùi bước trước áp lực ra sản phẩm mới.

Sam Altman và Jan Leike

Về phía OpenAI, công ty không phủ nhận việc giải tán nhưng khẳng định công việc đánh giá rủi ro không mất đi, chỉ chuyển từ một đội tập trung sang phân bổ theo từng lĩnh vực cụ thể, nằm trong các nhóm sản phẩm sẵn có. Đồng sáng lập Greg Brockman mô tả đây là cách đưa an toàn vào sát hơn với quy trình phát triển model hàng ngày, thay vì tách riêng thành một bộ phận độc lập. Không có nhân sự nào bị sa thải trong đợt tái cấu trúc này, theo các nguồn tin nắm được vụ việc.

Việc thay đổi cách tổ chức đội ngũ an toàn diễn ra khi OpenAI đang chuẩn bị cho một đợt chào bán cổ phiếu lần đầu được dự đoán là một trong những thương vụ IPO lớn nhất lịch sử ngành công nghệ.

Thế Duyệt

Cùng chuyên mục

AFF Cup 2026: Tuyển Thái Lan nắm lợi thế lớn, nhưng Singapore vẫn mang hy vọng tạo địa chấn

Thứ 3, 18/08/2026 15:11
Thắng 3-1 ở lượt đi, Thái Lan chỉ cần bảo vệ thành quả trên sân nhà để tiến vào chung kết. Trong khi đó, Singapore buộc phải chơi tất tay tại Rajamangala.

Diễn biến trận đấu Thái Lan vs Singapore: Cú sốc lớn dành cho Thái Lan?

Thứ 3, 18/08/2026 14:42
Trận đấu Thái Lan vs Singapore diễn ra lúc 20h00 ngày 18/8, thuộc khuôn khổ vòng bán kết AFF Cup 2026.

Loạt trận thua chứng minh một sự thật về T1

Thứ 3, 18/08/2026 14:26
Tính đến hiện tại, T1 đã thua 3 trận liên tiếp tại LCK 2026 Rounds 3-4.

Mỹ nhân là nữ thần trong mộng của G-Dragon và Hứa Quang Hán: Gương mặt không vướng bụi trần, ngoại lệ của tạo hoá

Thứ 3, 18/08/2026 14:15
Hứa Quang Hán từng khen cô sở hữu vẻ đẹp trong trẻo, còn G-Dragon thậm chí còn khoe poster và đùa rằng: "Đây là bạn gái tôi".

Thương Lam Cảnh Giới chính thức mở đăng ký trước tại Việt Nam: Huyền thoại Tales of Erin trở lại cùng VLG Play JSC

Thứ 3, 18/08/2026 13:56
Từng tạo được dấu ấn với cộng đồng yêu thích game anime RPG trên thị trường quốc tế, Tales of Erin nay chính thức trở lại Việt Nam dưới tên gọi Thương Lam Cảnh Giới.
     
Nổi bật trong ngày

Thoát thẻ đỏ nhờ VAR, ngôi sao Việt kiều giúp HLV Kim Sang-sik tạo cột mốc lịch sử trước Malaysia

Thứ 2, 17/08/2026 05:44
HLV Kim Sang-sik đã phá thêm một "cái dớp" trước Malaysia.

Toyota Camry ở Việt Nam thêm loạt tiện nghi như thế này dễ hút khách hơn: Màn hình lớn như laptop, thêm nhiều tiện nghi cao cấp

Thứ 2, 17/08/2026 06:00
Toyota Camry 2027 dành cho thị trường Trung Quốc gần như giữ nguyên ngoại hình nhưng được nâng cấp mạnh bên trong.

Skoda Slavia 2026 được hé lộ nhiều chi tiết mới trước giờ G: Giao diện đèn, mâm thay đổi, dễ nâng cấp cả nội thất cạnh tranh City, Vios

Thứ 2, 17/08/2026 06:00
Trước ngày ra mắt 18/8, Skoda Slavia bản nâng cấp lớn được hé lộ một số chi tiết sắc sảo hơn. Nhiều thay đổi hứa hẹn xuất hiện từ bên trong.

Báo Malaysia: VAR gây tranh cãi, đội tuyển Việt Nam 2 lần hưởng lợi

Thứ 2, 17/08/2026 06:26
Báo Malaysia cho rằng có sự tranh cãi trong 2 tình huống VAR liên quan đến đội tuyển Việt Nam.

Không phải tỷ số 2-0, đây mới là điều khiến Malaysia phải e sợ tuyển Việt Nam

Thứ 2, 17/08/2026 06:26
Thắng Malaysia 2-0 ngay trên sân khách là lợi thế quá lớn, nhưng điều khiến đối thủ thực sự lo lắng nằm ở cách tuyển Việt Nam định đoạt trận đấu và thể hiện bản lĩnh.
xe.nguoiduatin.vn