\n Nếu bạn đang đánh giá một giải pháp agentic pentesting ngay lúc này, có lẽ bạn đã nghe thấy cùng một lời chào mời không dưới một lần: chỉ cần nhắm nó vào một mục tiêu, nó sẽ tự động khám phá, xác thực và khai thác các con đường tấn công giống như cách một kẻ tấn công thực sự sẽ làm.
\n\nLời hứa đó rất đáng để xem xét một cách nghiêm túc. Tuy nhiên, nó cũng cần được đánh giá khắt khe thông qua ba câu hỏi trọng tâm sau đây:
\n\n- \n
- Đánh giá thực sự có thể chứng minh được điều gì? \n
- Khi nào những bằng chứng đó được tạo ra? Và, \n
- Bằng chứng đó bao phủ được bao nhiêu phần trong môi trường của bạn? \n
Hầu hết các hoạt động đánh giá chỉ dừng lại ở bước đầu tiên. Tuy nhiên, chính ở bước thứ hai và thứ ba mới là nơi các chương trình xác thực (validation) quyết định sự thành bại.
\n\nLưu ý về quan điểm của chúng tôi: Picus xây dựng và cung cấp giải pháp autonomous pentesting. Đó chính là lý do tại sao chúng tôi có thể chỉ ra chính xác điểm dừng của nó, bởi vì những giới hạn này thuộc về phương pháp luận, chứ không phải do cách triển khai của bất kỳ nhà cung cấp nào, và không lộ trình phát triển (roadmap) nào có thể xóa bỏ chúng.
\n\nVấn đề nằm ở bốn con số
\n\nBốn con số từ năm nay giải thích tại sao câu hỏi thứ hai và thứ ba hiện nay lại có trọng lượng hơn câu hỏi đầu tiên.
\n\n- \n
- Khối lượng: 35.364 CVE được tìm thấy trong nửa đầu năm 2026, tăng 49,5% so với cùng kỳ năm ngoái. \n
- Ưu tiên: Chỉ có 95 trong số khoảng 39.600 CVE được công bố tính đến tháng 8 được xác nhận là có khai thác thực tế (in-the-wild exploitation), vì vậy việc ưu tiên dựa trên mức độ nghiêm trọng (severity) thực chất là đang đuổi theo một danh sách sai lầm. \n
- Tốc độ: Thời gian trung bình từ khi công bố đến khi bị khai thác đã giảm mạnh từ 21,5 ngày vào năm 2025 xuống còn 8 giờ vào năm 2026. \n
- Khả năng xử lý: Trong số hơn 26.000 lỗ hổng được phát hiện bởi AI-scale discovery, chỉ có 421 lỗ hổng được vá ở thượng nguồn (upstream). \n
Bạn không thể vá lỗi, lên lịch hay dự đoán theo cách cũ để thoát khỏi tình trạng này. Bạn cần xác thực dựa trên bằng chứng, trong vòng vài giờ kể từ khi có sự thay đổi đòi hỏi điều đó. Tuy nhiên, một đợt pentest hàng năm để lại khoảng trống mù lên đến 365 ngày giữa hai lần kiểm tra, và các đợt chạy tự động hàng tuần vẫn để lại khoảng cách lên đến bảy ngày.
\n\nSo với cửa sổ khai thác chỉ 8 giờ, cả hai đều thất bại.
\n\nGartner đã đưa ra kết luận chính thức: mô hình Continuous Offensive Security Testing (COST) của họ thay thế việc đánh giá tại một thời điểm nhất định bằng việc kiểm tra theo sự kiện (trigger-driven), phân tầng rủi ro và hoàn thành trong khung thời gian phù hợp với rủi ro, thường là vài phút hoặc vài giờ. Giả định lập kế hoạch là đến năm 2028, hơn 60% các chương trình pentest của doanh nghiệp sẽ hoạt động như một quá trình xác thực liên tục. Câu hỏi then chốt không còn là "chúng ta đã kiểm tra chưa?" mà là "chúng ta xác thực các rủi ro mới nhanh đến mức nào?"
\n\nAgentic pentesting là câu trả lời quan trọng nhất cho câu hỏi đó.
\n\nHai bằng chứng mà agentic pentesting mang lại
\n\nMọi cuộc pentest tồn tại để trả lời một câu hỏi duy nhất: chúng ta có thể bị khai thác không? Agentic pentesting trả lời câu hỏi đó bằng hai bằng chứng quan trọng. Nó chứng minh từng lỗ hổng riêng lẻ có thể bị khai thác hay không, được xác nhận bằng cách thực thi exploit một cách an toàn thay vì chỉ suy luận từ biểu ngữ phiên bản (version banner). Và nó chứng minh khả năng tấn công chuỗi (chained reach): nơi các exploit thực sự được liên kết với nhau từ quyền truy cập ban đầu qua leo thang đặc quyền và di chuyển ngang (lateral movement), với con đường được xác nhận đến một tài sản quan trọng được báo cáo làm bằng chứng.
\n\nTrên những tài sản mà nó tiếp cận được, không có gì thuyết phục hơn thế, và vì mọi bản sửa lỗi đều có thể được xác thực lại chỉ với một lần chạy nữa, việc khắc phục trở nên có căn cứ bảo vệ thay vì chỉ là hy vọng.
\n\nCụm từ then chốt ở đây là "trên những tài sản mà nó tiếp cận được." Chứng minh khả năng khai thác là câu hỏi đầu tiên được trả lời; nhưng cụm từ này cũng ngầm thừa nhận hai vấn đề còn lại: khi nào bằng chứng đến, và nó bao phủ được bao nhiêu phần của hệ thống.
\n\nKhoảng cách về tốc độ – Câu hỏi "Khi nào"
\n\nChạy một đợt agentic pentest trên toàn bộ hệ thống 250.000 thiết bị đầu cuối và toàn bộ chu kỳ mất vài tuần. Đó là một sự cải thiện đáng kể so với thời gian hàng quý mà một đợt đánh giá do con người thực hiện cần, nhưng đó vẫn là đơn vị thời gian sai lệch.
\n\nAgentic pentesting hoạt động cẩn thận từng bước: chiếm chỗ đứng (foothold), liệt kê (enumerate), chuyển hướng (pivot), chuỗi hóa (chain), chứng minh. Lặp lại điều đó trên một phần tư triệu thiết bị đầu cuối, và quá trình quét sẽ kéo dài trong khi môi trường bên dưới đã thay đổi. Vào thời điểm nó hoàn thành, phần lớn kết quả mô tả một môi trường không còn tồn tại nữa.
\n\nVài tuần có thể là nhanh đối với một cuộc pentest, nhưng so với cửa sổ 8 giờ, nó là chậm. Một đợt quét sâu đơn thuần không thể lấp đầy khoảng cách đó.
\n\nKhoảng cách về phạm vi bao phủ – Câu hỏi "Bao nhiêu"
\n\nKhoảng cách về phạm vi bao phủ quan trọng hơn. Khai thác trực tiếp (live exploitation) chỉ có thể được nhắm vào một phần của môi trường. Các hệ thống sản xuất quan trọng đối với doanh nghiệp, các phân đoạn rất lớn, và các vùng bị hạn chế hoặc air-gapped là những nơi bị cấm thực thi exploit thật vì lý do an toàn, ổn định và truy cập. Hàng ngàn CVE không có exploit hoạt động khiến công cụ không có gì để thực hiện. Và khoảng thời gian giữa lúc công bố và lúc có exploit đầu tiên – nơi mà các con số về tốc độ cho thấy toàn bộ cuộc đua đang diễn ra – chính xác là lúc một công cụ phụ thuộc vào exploit có ít điều để nói nhất.
\n\nTổng hợp lại, một mình autonomous pentesting có lẽ chỉ thấy được 20 đến 30% khả năng khai thác thực tế trong một doanh nghiệp điển hình. Việc xếp chồng công cụ thứ hai hoặc thứ ba không thay đổi được phép tính này, bởi vì mọi công cụ trong danh mục này đều chia sẻ cùng một phương pháp, và do đó có cùng một mức trần. Và phạm vi bao phủ một phần không làm giảm đi sự không chắc chắn. Nó chỉ đơn giản là chuyển dịch sự không chắc chắn đó sang những tài sản mà bạn đã bỏ qua, và kẻ tấn công chỉ cần một thứ duy nhất bạn đã bỏ qua để mọi thứ trở nên tồi tệ.
\n\nSự thay đổi quyết định phương pháp xác thực
\n\nKhoảng cách về phạm vi bao phủ được lấp đầy theo cùng một cách: hãy để sự thay đổi kích hoạt bài kiểm tra lựa chọn phương pháp trả lời nó nhanh nhất và an toàn nhất.
\n\nMột lỗ hổng mới xuất hiện trên tài sản của bạn. Câu hỏi then chốt là "nó có thể bị khai thác trong môi trường của chúng ta không?" Xác thực khả năng khai thác (Exploitability validation) trả lời câu hỏi này trong vòng vài giờ trên toàn bộ phạm vi bị ảnh hưởng, bằng cách kiểm tra các kỹ thuật của kẻ tấn công mà lỗ hổng đó phụ thuộc vào, mà không cần exploit hoạt động. Điều này trả lời cho phản bác mà chúng tôi thường nghe nhất: "chẳng phải pentest đã bao quát điều đó rồi sao?" Có, nhưng chỉ ở những nơi có thể thực thi trực tiếp; ngược lại, xác thực khả năng khai thác tiếp cận được hầu hết các tài sản và hầu hết danh sách CVE.
\n\nMột chiến dịch mới được quan sát thấy, hoặc một kiểm soát bảo mật thay đổi. Câu hỏi ở đây là "chúng ta có thể ngăn chặn điều này không?" Security control validation mô phỏng các kỹ thuật của chiến dịch đó đối với lớp phòng thủ thực tế của bạn và cho biết liệu mỗi kỹ thuật đó có bị ngăn chặn, phát hiện hay bị bỏ lỡ hay không.
\n\nMột thay đổi cơ sở hạ tầng diễn ra. Câu hỏi triệu đô là "điều này có mở ra một con đường tấn công mới không?" Agentic pentesting xác nhận điều đó bằng bằng chứng trực tiếp, liên kết theo chuỗi – điều mà chỉ nó mới có thể làm được.
\n\nBa phương pháp, một mô hình kết quả
\n\nMột cảnh báo từ lịch sử gần đây: quản lý lỗ hổng đã bị chia nhỏ thành các hòn đảo với những phát hiện trùng lặp và các ưu tiên xung đột, và quá trình xác thực sẽ tái hiện lại những hòn đảo đó nếu mỗi phương pháp đi kèm với bảng điều khiển và hàng đợi riêng của nó. Ba phương pháp này phải cùng nạp dữ liệu vào một mô hình kết quả chung, được loại bỏ trùng lặp, có bằng chứng hỗ trợ và hiểu rõ về tài sản, với một danh sách công việc tồn đọng và một trạng thái đóng duy nhất cho mỗi rủi ro.
\n\nĐây là nguyên tắc mà Nền tảng Picus được xây dựng, với Autonomous Penetration Testing, Exposure Validation và Breach and Attack Simulation tất cả đều hoạt động dựa trên bằng chứng chung.
\n\nĐối mặt với một mốc thời gian thực tế: một CVE nghiêm trọng xuất hiện.
\n\n- \n
- Giờ thứ nhất: nó được làm giàu thêm bằng thông tin tình báo về mối đe dọa (threat intelligence). \n
- Giờ thứ hai: các tài sản bị ảnh hưởng, mức độ quan trọng và các kiểm soát xung quanh được lập bản đồ. \n
- Giờ thứ tư: khả năng khai thác được đánh giá trên mọi tài sản bị ảnh hưởng, các con đường tấn công được xác nhận ở những nơi kiểm tra trực tiếp là an toàn, và các kiểm soát đã được kiểm tra đối với các kỹ thuật liên quan. \n
- Giờ thứ sáu: các biện pháp giảm thiểu rủi ro thấp được triển khai, phần còn lại đã được chuyển đến những người chịu trách nhiệm, và mọi bản sửa lỗi đã được xác thực lại trước khi đóng hồ sơ. \n
Mọi thay đổi đều được xác thực. Mọi rủi ro đều được chứng minh. Trong vòng vài giờ.
\n\nXem trực tiếp quy trình hoạt động
\n\n
\n Tại The Validation Summit 26, do Ron Eddings của Hacker Valley chủ trì, chúng tôi sẽ chạy mô hình này trực tiếp trong sản phẩm. CTO của chúng tôi, Volkan Erturk, sẽ thực hiện xử lý một CVE mới nổi từ lúc kích hoạt đến khi xác thực rủi ro và xác nhận bản sửa lỗi chỉ trong vài giờ, với phương pháp phù hợp được lựa chọn khi các điều kiện thay đổi.
\n