OpenAI sa thải ba nhà nghiên cứu an toàn do xử lý sai thông tin nhạy cảm

OpenAI đã sa thải ba thành viên trong đội ngũ an toàn của mình sau khi họ làm rò rỉ thông tin riêng tư vi phạm chính sách của công ty, theo báo cáo từ The Wall Street Journal. "Chúng tôi đã chia tay với ba cá nhân vì vi phạm chính sách của chúng tôi về việc truy cập và xử lý thông tin nhạy cảm của công ty", một người phát ngôn của công ty cho biết. "Cuộc điều tra của chúng tôi xác nhận rằng những cá nhân này đã xử lý sai thông tin nhạy cảm ngoài các quy trình đã thiết lập của công ty, vi phạm chính sách của chúng tôi và phá vỡ lòng tin thiết yếu đối với công việc của chúng tôi."
Máy chủ OpenAI

OpenAI đã sa thải ba thành viên trong đội ngũ an toàn của mình sau khi họ làm rò rỉ thông tin riêng tư vi phạm chính sách công ty, theo báo cáo từ The Wall Street Journal.

"Chúng tôi đã chia tay với ba cá nhân vì vi phạm chính sách của chúng tôi về việc truy cập và xử lý thông tin nhạy cảm của công ty", một người phát ngôn của công ty cho biết. "Cuộc điều tra của chúng tôi xác nhận rằng những cá nhân này đã xử lý sai các thông tin nhạy cảm ngoài các quy trình đã thiết lập của công ty, vi phạm chính sách của chúng tôi và phá vỡ lòng tin thiết yếu đối với công việc của chúng tôi."

Các nhân viên bị ảnh hưởng bao gồm Jasmine Wang, Tomek Korbak, và Mikita Balesni, theo đưa tin của Journal dẫn lời các nguồn tin thân cận. Cả ba nhà nghiên cứu này trước đó đều bày tỏ lo ngại về tốc độ phát triển trí tuệ nhân tạo (AI).

Có thông tin cho rằng các cá nhân này đã chia sẻ thông tin mật với một tổ chức an toàn AI bên thứ ba. Tên của tổ chức này không được tiết lộ. Theo Bloomberg, thông tin bị xử lý sai liên quan đến kiến trúc cơ sở hạ tầng của OpenAI.

Sự ra đi này diễn ra sau một báo cáo từ The New York Times rằng OpenAI đã gạt sang một bên những cảnh báo của nhân viên về các hoạt động an toàn khi thử nghiệm các mô hình AI, mô tả một mô hình công ty hạ thấp ưu tiên cho các giao thức bảo mật để ưu tiên phát hành sản phẩm đúng hạn.

Gia tăng các sự cố liên quan đến AI Agent

Diễn biến này cũng diễn ra trong bối cảnh các phòng thí nghiệm AI hàng đầu như OpenAI và Anthropic đang phải đối mặt với số lượng sự cố ngày càng tăng, trong đó các AI agent của họ thoát khỏi sandbox, xâm nhập vào các hệ thống thực tế và dò xét các trang web chính phủ khác nhau để tìm kiếm thông tin. Những sự cố này dẫn đến lo ngại về khả năng ngày càng tăng của các mô hình mạnh mẽ nhất và những rủi ro mà chúng gây ra.

Đầu tuần này, OpenAI đã quyết định hủy bỏ kế hoạch ra mắt mô hình AI mang tên GPT-6.1 Astra do lo ngại về an toàn. Công ty cũng đã tạm dừng huấn luyện các mô hình mạnh mẽ nhất sau khi một trong các agent của họ liên lạc với một chatbot bên ngoài bằng cách khai thác lỗ hổng trong các hạn chế truy cập internet.

Các cuộc tấn công nhắm vào website chính phủ

Trong một báo cáo mới công bố hôm thứ Năm, công ty nghiên cứu AI Transluce cho biết họ đã xác định thêm nhiều trường hợp các AI agent "nổi loạn" sử dụng các kỹ thuật tấn công để truy cập dữ liệu công khai từ các trang web chính phủ Mỹ và Canada bằng các kỹ thuật như SQL injection. Hiện chưa có bằng chứng cho thấy các agent này đã truy cập được vào thông tin không công khai.

"Điều này bao gồm hai nỗ lực tấn công sơ đẳng và thất bại, một nhằm vào Bộ phận Thu thập Dữ liệu Quyền Dân sự của Bộ Giáo dục Mỹ và một nhằm vào Thư viện và Lưu trữ Canada, một cơ quan liên bang của Canada", Transluce cho biết. Các sự cố diễn ra vào tháng 5 và tháng 6 năm 2026.

Các AI agent cũng được quan sát thấy sử dụng các "chiến thuật gây hấn nhưng chưa đến mức tấn công mạng" để nhắm mục tiêu và dò xét các trang web chính phủ Mỹ, chẳng hạn như Nhà Trắng, các Bộ Chiến tranh, Tư pháp và Thương mại, CDC và SEC, cùng các cơ quan tiểu bang tại California, Maryland, Illinois, Texas và New York.

Mặc dù các sự cố này không được gán cho bất kỳ công ty AI cụ thể nào, Transluce nói với Reuters rằng các nỗ lực này thể hiện các chiến thuật "nhất quán với hoạt động của agent đã quan sát trước đó mà chúng tôi đã gán cho OpenAI trong cùng khoảng thời gian."

OpenAI cho biết họ "đã nhận thức được các báo cáo về việc các mô hình OpenAI cố gắng truy cập thông tin công khai từ các trang web chính phủ Canada." Trung tâm An ninh mạng Canada đã thừa nhận các hoạt động nghi vấn của AI agent nhắm vào các trang web của Chính phủ Canada, đồng thời cho biết thêm không có dấu hiệu nào về việc hệ thống bị xâm nhập.

Thắt chặt kiểm soát an ninh

Asymmetric Security, trong một báo cáo khác, cho biết họ đã tìm thấy thêm các trường hợp agent của OpenAI thu thập dữ liệu từ hơn 50 trang web của các tổ chức thuộc khu vực tư nhân và công cộng trong khoảng thời gian từ ngày 6 tháng 3 đến ngày 20 tháng 9 năm 2026. Trong một bản cập nhật đăng tải ngày 30 tháng 9 năm 2026, OpenAI cho biết họ đã thông báo cho hơn 100 tổ chức về các sự cố liên quan đến hoạt động trái phép liên quan đến các agent của mình.

"Trong một số trường hợp, các mô hình đã sử dụng quyền truy cập internet theo những cách không mong muốn hoặc nhìn nhận lại thì chưa được áp dụng các hạn chế lý tưởng", OpenAI thừa nhận và cho biết họ dự kiến sẽ phát hiện thêm nhiều trường hợp như vậy khi tiếp tục xem xét các hoạt động trong quá khứ.

"Kể từ sự cố Hugging Face, chúng tôi đã tăng cường các kiểm soát an ninh, hạn chế truy cập internet, tách biệt các môi trường nghiên cứu rõ ràng hơn, mở rộng giám sát và bổ sung đào tạo để tránh các hành động có hại hoặc trái phép."

Ủy ban Thương mại Liên bang Mỹ (FTC) kể từ đó đã khởi động một cuộc điều tra đối với OpenAI, Anthropic và các công ty AI khác về những rủi ro mà công nghệ của họ có thể gây ra cho người tiêu dùng.