Agent của OpenAI vượt qua lớp kiểm soát cổng Medicare của Úc để truy cập tệp nội bộ

Một AI agent thực hiện nhiệm vụ nghiên cứu nội bộ của OpenAI đã vượt qua các biện pháp kiểm soát truy cập trên cổng số liệu thống kê Medicare của chính phủ Úc vào tháng 6, theo lời Thủ tướng Anthony Albanese. Cổng thông tin này đăng tải các số liệu tổng hợp và tách biệt với các hệ thống xử lý hồ sơ cá nhân. Agent đã tiếp cận được các tệp không công khai, nhưng cho đến nay chưa có bằng chứng cho thấy dữ liệu cá nhân bị rò rỉ.
AI Agent OpenAI bypass Medicare portal
Minh họa về các AI agent của OpenAI.

Một AI agent thực hiện nhiệm vụ nghiên cứu nội bộ của OpenAI đã vượt qua các lớp kiểm soát truy cập trên cổng số liệu thống kê Medicare của chính phủ Úc vào tháng 6, Thủ tướng Anthony Albanese cho biết.

Cổng thông tin này đăng tải các số liệu tổng hợp, chẳng hạn như chi tiêu, và tách biệt với các hệ thống xử lý yêu cầu bồi thường Medicare và hồ sơ cá nhân. Agent này đã tiếp cận được các tệp không công khai trên đó, nhưng cho đến nay, giới chức tin rằng không có thông tin cá nhân nào bị truy cập trái phép.

OpenAI lần đầu thông báo cho chính phủ vào ngày 10 tháng 9 qua một email gửi tới hòm thư công cộng tại Services Australia, đơn vị vận hành cổng thông tin. OpenAI cho biết họ đã phát hiện ra hoạt động này từ tháng 8. Ông Albanese chỉ trích rằng công ty đã mất quá nhiều thời gian để thông báo cho chính phủ và cách thức thực hiện điều đó là không thể chấp nhận được.

Vào ngày 18 tháng 6, cổng thông tin đã liên tục từ chối các yêu cầu dữ liệu của agent, nhưng AI agent này đã tìm ra một giải pháp thay thế (workaround) và giành được quyền truy cập trái phép. Chính phủ hiện chưa tiết lộ cách thức mà agent đã vượt qua các lớp bảo mật.

Services Australia báo cáo với chính phủ rằng AI agent cũng đã ghi các tệp vào một máy chủ nội bộ. Sự việc này vẫn đang được điều tra. Các bằng chứng cho đến nay cho thấy không có sự xâm nhập rộng hơn vào mạng lưới của cơ quan này.

Các dữ liệu không công khai bị truy cập vốn không đặc biệt nhạy cảm và hiện đã được xuất bản rộng rãi. Đến ngày 24 tháng 9, cổng thông tin này đã được đưa ngoại tuyến (offline), và dữ liệu được chuyển sang data.gov.au cùng các nền tảng bảo mật khác.

Quyền Thủ tướng Richard Marles phát biểu với ABC rằng các thông tin an ninh quốc gia luôn được bảo vệ nghiêm ngặt hơn nhiều, trong khi thông tin của cổng thống kê này chỉ được "để sau một hàng rào mà AI agent đã leo qua một cách hiệu quả."

Các mô hình của chúng tôi đã thực hiện những hành động mà chúng tôi không dự định trong khi tra cứu số liệu thống kê về Úc trong một đợt đánh giá nội bộ. — Tuyên bố của OpenAI gửi tới Fox Business

Công ty đã phát hiện ra sự cố trong một đợt rà soát diện rộng về "hoạt động mô hình không nhất quán" (misaligned model activity) trong quá trình đào tạo và đánh giá, sau đó đã kiểm tra các dữ liệu bị truy cập trước khi thông báo cho Services Australia.

Hoạt động này liên quan đến nhiều trang web và dịch vụ của chính phủ Úc. Thông tin mà các mô hình truy cập bao gồm số liệu thống kê y tế tổng hợp và tên tệp nội bộ. OpenAI khẳng định không tìm thấy bằng chứng nào cho thấy hồ sơ bệnh nhân bị xâm phạm.

Services Australia đã kiểm tra email của OpenAI vào ngày 11 tháng 9, xác nhận tính xác thực và báo cáo sự cố vào ngày 15 tháng 9 cho Trung tâm An ninh mạng Úc (ACSC), thuộc Tổng cục Tín hiệu Úc (ASD). Chính phủ đã công khai vụ việc vào ngày 24 tháng 9.

Thủ tướng Albanese đã trực tiếp bày tỏ lo ngại về sự chậm trễ này với Giám đốc điều hành OpenAI Sam Altman qua điện thoại. Theo ông Albanese, Altman đã thừa nhận rằng công ty đã xử lý chưa tốt trong trường hợp này.

ASD hiện đang hỗ trợ một cuộc điều tra pháp y (forensic investigation), song song với cuộc điều tra riêng của Services Australia.

Ông Albanese cũng công bố thành lập một lực lượng đặc nhiệm để rà soát liệu các quy trình hiện tại có đủ khả năng ứng phó với các sự cố an ninh mạng liên quan đến AI hay không. Lực lượng này bao gồm Điều phối viên An ninh mạng Quốc gia, Văn phòng AI, ASD, Viện An toàn AI Úc và Services Australia.

Sự cố này cũng sẽ được đưa ra Ủy ban Hỗn hợp về Trí tuệ nhân tạo của Quốc hội để xem xét và đóng góp ý kiến cho các quy định pháp luật về tiêu chuẩn AI trong tương lai.

Các vụ tiết lộ khác về việc mô hình AI tiếp cận các hệ thống thực tế

Các AI agent đã cố gắng xâm nhập ba trang web dữ liệu công cộng vào tháng 5 và tháng 6, theo báo cáo từ phòng thí nghiệm nghiên cứu AI Transluce. Một trong số đó là trang web y tế công cộng do Viện Phúc lợi và Y tế Úc (AIHW) điều hành.

Vào ngày 20 và 21 tháng 6, hệ thống bảo vệ bot đã chặn các agent thực hiện nhiệm vụ dữ liệu dược phẩm truy cập vào trang web chính của AIHW. Các agent sau đó đã tìm kiếm lỗ hổng và lấy được một tệp công khai từ một máy chủ tiền sản xuất (pre-production server).

Các agent này chỉ đang thực hiện các tác vụ truy xuất dữ liệu thông thường, không phải nghiên cứu bảo mật. Chúng đã sử dụng urlquery.net, một dịch vụ quét web công cộng, để lách các hạn chế truy cập. Transluce liên kết các hoạt động này với nhóm agent (agent swarms) từng được cho là của OpenAI.

Vào tháng 7, OpenAI báo cáo rằng trong các đợt đánh giá an ninh mạng nội bộ, các mô hình của họ đã vượt qua kiểm soát để truy cập internet và xâm nhập vào hệ thống của Hugging Face.

Tháng 9 vừa qua, OpenAI tiếp tục công bố các báo cáo về các sự cố khác, bao gồm việc một mô hình sử dụng khóa GitHub API bị lộ để truy cập trái phép, hoặc tự ý tải tệp lên các trang web lưu trữ công cộng.

Anthropic cũng tiết lộ bốn sự cố tương tự với mô hình Claude. Trong khi đó, Meta cho biết một phiên bản thử nghiệm của mô hình Muse Spark 1.1 đã khai thác lỗi trên một trang web thực và thay đổi cơ sở dữ liệu do sai sót trong cấu hình môi trường thử nghiệm của đối tác Irregular.

Viện An toàn AI của Vương quốc Anh báo cáo vào tháng 8 rằng các AI agent trong bài kiểm tra của họ đã thực hiện 19 hành động không được phê duyệt trên internet, bao gồm cả một nỗ lực tấn công chuỗi cung ứng (supply-chain attack) vào một dự án mã nguồn mở.

ASD đã đưa ra cảnh báo vào ngày 11 tháng 8, nhấn mạnh rằng các tổ chức cần lưu ý: "các AI agent có thể xác định và khai thác các lỗ hổng ở tốc độ và quy mô cực lớn." Cơ quan này khuyến nghị các đơn vị vận hành dịch vụ trực tuyến cần tăng cường quét lỗ hổng và thắt chặt xác thực người dùng (user authentication).