Chiến dịch Phishing gửi hàng triệu email sử dụng Unicode ẩn để qua mặt các bộ lọc

Microsoft đang cảnh báo về một "chiến dịch Phishing quy mô lớn" sử dụng các ký tự tag Unicode ẩn để vượt qua các bộ lọc email. Thay vì dùng các ký tự này để ẩn hướng dẫn khỏi con người trong khi vẫn hiển thị cho các mô hình AI, kẻ tấn công đã sử dụng chúng để chia cắt các từ khóa dụ dỗ tài chính như 'funding' nhằm ngăn chặn các bộ lọc email phân tích chúng.
Chiến dịch Phishing sử dụng Unicode ẩn

Microsoft đang đưa ra cảnh báo về một "chiến dịch Phishing quy mô lớn" sử dụng các ký tự tag Unicode ẩn để vượt qua các bộ lọc email.

"Thay vì sử dụng các ký tự này để ẩn hướng dẫn khỏi con người trong khi vẫn hiển thị cho các mô hình AI, kẻ tấn công đã sử dụng chúng để chia cắt các từ khóa dụ dỗ tài chính như 'funding' nhằm ngăn chặn các bộ lọc email phân tích chúng", nhóm Microsoft Security Research cho biết.

Hãng sản xuất Windows cho biết những phát hiện này cho thấy các kỹ thuật lẩn tránh trong kỷ nguyên AI có thể được các tác nhân đe dọa áp dụng vào những chiến dịch Phishing và Spam truyền thống. Các cuộc tấn công khai thác phương pháp này được cho là xuất hiện lần đầu vào đầu tháng 2 năm 2026.

ASCII Smuggling là gì?

ASCII Smuggling đề cập đến một kỹ thuật trong đó các ký tự Unicode ẩn hoặc không hiển thị được sử dụng để che giấu thông điệp hoặc hướng dẫn bên trong các văn bản có vẻ vô hại. Kết quả là, giao diện người dùng không hiển thị chúng, khiến văn bản xuất hiện hoàn toàn bình thường đối với người dùng.

Tuy nhiên, nội dung như vậy có thể được các bộ lọc email hoặc mô hình ngôn ngữ AI tiếp nhận và xử lý như văn bản thực. Điều này có thể mở ra cánh cửa cho Prompt Injection bằng cách tận dụng thực tế là các mô hình ngôn ngữ lớn (LLMs) không thể vạch ra ranh giới đáng tin cậy giữa các hướng dẫn thực của người dùng được nhập trực tiếp vào prompt và nội dung được nhúng vào văn bản trông có vẻ lành tính hoặc các nguồn bên thứ ba khác như trang web, tài liệu hoặc email.

"Dải ký tự bị lạm dụng nhiều nhất là khối Unicode Tags, từ U+E0000 đến U+E007F," Microsoft cho biết. "Khối này chứa một bản sao bóng của các ký tự ASCII có thể in được (ví dụ: U+E0041 phản chiếu chữ 'A', U+E0061 phản chiếu chữ 'a'). Khối này ban đầu được dự định để gắn thẻ ngôn ngữ và hiện tại phần lớn đã bị loại bỏ."

Quy mô chiến dịch và phương thức tấn công

Theo Microsoft, chiến dịch Phishing định hướng ASCII Smuggling đã bước vào giai đoạn khối lượng lớn trong khoảng ba tháng trước khi giảm mạnh sau ngày 15 tháng 5 năm 2026. Hoạt động này được cho là tuân theo nhịp độ hàng tuần, chiến dịch gần như im hơi lặng tiếng vào cuối tuần và hoạt động trở lại mạnh mẽ vào các ngày thứ Hai.

Khối lượng ngày trong tuần ước tính đạt từ 1 đến 2,37 triệu tin nhắn, đạt đỉnh vào ngày 26 tháng 2 năm 2026. Chiến dịch được đánh giá là có liên quan đến một chiến dịch Phishing rộng lớn hơn đã vũ khí hóa nền tảng marketing và tự động hóa ActiveCampaign để phân phối hàng nghìn email Phishing do AI tạo ra, nhắm mục tiêu vào những người nộp đơn xin vay vốn từ Small Business Administration (SBA).

Chi tiết về chiến dịch Phishing đã được nhóm Fortra Intelligence and Research Experts (FIRE) tiết lộ vào tháng 9 năm 2025, cho biết hoạt động này tập trung vào việc thu thập thông tin tài chính và kinh doanh chi tiết, có khả năng để thực hiện Spear-phishing mục tiêu cao trong các cuộc tấn công tương lai.

"Sự tinh vi và độc đáo của chiến dịch nằm ở khả năng sản xuất hàng loạt các trang web tùy chỉnh đầy thuyết phục, có thể thích ứng với các tên miền bất hợp pháp hoặc mạo danh khác nhau", Fortra lưu ý vào thời điểm đó. "Các tác nhân đe dọa có thể mở rộng quy mô Phishing tinh vi bằng cách sử dụng các tính năng tự động hóa marketing do AI hỗ trợ của ActiveCampaign để thay đổi thiết kế, nội dung và quy trình, cuối cùng tạo ra các chiến dịch Phishing thuyết phục hơn, nhanh chóng hơn."

Kỹ thuật xáo trộn từ khóa

Loạt email Phishing mới nhất, theo Microsoft, tận dụng các ký tự tag ẩn như một mô hình xáo trộn (obfuscation), chèn chúng vào bên trong các từ khóa tài chính phổ biến để chia tách chúng và vượt qua các bộ lọc email tìm kiếm từ khóa hoặc khớp chữ ký thô.

Ví dụ, một thuật ngữ dụ dỗ liên quan đến tài chính như "funding" trở thành "fun⟨U+E0020⟩ding", để nó trông bình thường với người nhận email trong khi có tác dụng phụ là bỏ qua các biện pháp kiểm soát an ninh email.

"Đối với người nhận và đối với các quy trình phân tích loại bỏ hoặc chuẩn hóa các ký tự này, từ này vẫn được đọc là funding," Microsoft giải thích. "Đối với một bộ phát hiện khớp chuỗi ký tự funding chính xác, hoặc một regex không tính đến các điểm mã ẩn xen kẽ, chuỗi byte đó không còn chứa từ khóa liên tục nữa."

Mặc dù việc sử dụng các ký tự ẩn hoặc ký tự trông giống nhau không phải là kỹ thuật mới trong Phishing và các cuộc tấn công Homoglyph, nhưng điểm mới lạ là việc lựa chọn các ký tự được sử dụng – cụ thể là khối Unicode Tags – và quy mô của chính chiến dịch, vốn đã tạo ra hàng triệu tin nhắn mỗi ngày.

Lợi dụng uy tín của nền tảng Marketing

Chiến dịch đã được phát hiện lợi dụng hàng trăm tên miền người gửi chủ đề tài chính dùng một lần, sử dụng các mồi nhử mô phỏng các mẫu Phishing về khoản vay kinh doanh, hạn mức tín dụng và ứng trước vốn, thường liên quan đến các âm mưu gian lận hoặc thu thập thông tin đăng nhập (credential-harvesting). Các email từ các tên miền chủ đề tài chính này được chuyển tiếp qua ActiveCampaign, khiến mọi liên kết đi trong nội dung thư được định tuyến qua các tên miền theo dõi nhấp chuột của chính nền tảng này ("acemlnd[.]com" và "activehosted[.]com").

Về phần mình, ActiveCampaign cho biết họ đã thử nghiệm các hệ thống kiểm duyệt nội dung của mình với các tin nhắn chứa các ký tự Unicode ẩn và những email như vậy sẽ nhận được phán quyết kiểm duyệt tương đương với các bản không bị xáo trộn. Họ cũng cho biết việc sử dụng nhiều kỹ thuật này được coi là một "tín hiệu khả nghi".

Microsoft nhận định: "Giống như bất kỳ dịch vụ gửi thư chung nào, việc kẻ tấn công lạm dụng tài khoản hoặc quy trình làm việc của khách hàng có thể làm phức tạp việc lọc dựa trên danh tiếng. Bằng cách xuất phát từ một nền tảng marketing có uy tín với danh tiếng IP và xác thực đã được thiết lập, hoạt động này có thể trông giống với lưu lượng marketing hợp pháp và có thể gây khó khăn cho các bộ lọc dựa trên danh tiếng."