Google hôm thứ Tư đã công bố mô hình trí tuệ nhân tạo (AI) tiên tiến nhất của mình, Gemini 4 Argon. Hãng cho biết mô hình này đang được triển khai cho một nhóm các chuyên gia phòng thủ mạng tin cậy thông qua Chương trình Fairwind của mình.
"Nó mang lại hiệu suất vượt trội trong các quy trình làm việc phức tạp từ kỹ thuật phần mềm thực tế, các công việc tri thức doanh nghiệp như pháp lý và tài chính, cho đến phòng thủ an ninh mạng," Koray Kavukcuoglu, Phó Chủ tịch cấp cao tại Google DeepMind và Kiến trúc sư trưởng AI tại Google, cho biết.
Sự phát triển này diễn ra gần một tháng sau khi gã khổng lồ công nghệ trình làng Gemini 3.8 Flash Cyber, vốn được mô tả là mô hình an ninh mạng mạnh mẽ nhất vào thời điểm đó.
Giống như các mô hình tương tự từ đối thủ Anthropic và OpenAI, Argon được đánh giá là có khả năng cao trong việc tự động tìm kiếm, xác thực và vá các lỗ hổng phần mềm nghiêm trọng.
Điều này bao gồm một lỗ hổng nghiêm trọng chưa từng được biết đến trước đây, có thể làm rò rỉ thông tin cá nhân nhạy cảm trong các phần mềm y tế được sử dụng tại các bệnh viện trên toàn thế giới. Google đã không tiết lộ phần mềm nào bị ảnh hưởng bởi lỗi bảo mật này.
Những bước tiến vượt bậc trong phát hiện lỗ hổng
Theo Google, Argon thể hiện "những bước nhảy vọt ấn tượng" trong việc phát hiện lỗ hổng so với 3.8 Flash Cyber. Nó vượt trội hơn mô hình cũ trong việc khám phá bề mặt tấn công (attack surface) và tạo ra các mã khai thác thử nghiệm (PoCs) để xác thực các phát hiện.
Google cho biết họ có kế hoạch phát hành một phiên bản Argon không có các rào cản bảo mật (cyber guardrails) cho các chuyên gia phòng thủ tin cậy và các đội ngũ nội bộ của mình để họ có thể tận dụng tối đa khả năng của nó.
Tăng cường các biện pháp an toàn và chống lạm dụng
Trước khi triển khai rộng rãi, công ty cho biết họ đang nỗ lực củng cố các biện pháp bảo vệ để ngăn chặn sự sai lệch (misalignment), ngăn chặn việc lạm dụng mô hình bởi các tác nhân xấu và tăng cường khả năng phục hồi trước các cuộc tấn công indirect prompt injections (IPIs). Theo một đánh giá mô hình do Google công bố, Argon vượt qua các mô hình khác để giành vị trí dẫn đầu trong bảng xếp hạng IPI của Gray Swan.
"Chúng tôi đang triển khai các biện pháp giảm thiểu sai lệch bằng cách giám sát chuỗi suy nghĩ (chain-of-thought) và hành động của Argon, đồng thời dừng thực thi khi cần thiết," Google tuyên bố. "Chúng tôi khuyến khích phần còn lại của ngành duy trì tính minh bạch trong lập luận ở những thời điểm quan trọng khi năng lực AI tăng cao, đồng thời điều hướng các rủi ro về sự sai lệch, để các suy nghĩ của mô hình vẫn hữu ích trong việc xác định và chẩn đoán sai lệch."