Ai được lợi từ nỗi sợ hãi về an ninh mạng?

Tháng 6 năm 2026, năm cơ quan tình báo thuộc các quốc gia nói tiếng Anh đồng loạt tuyên bố: các mô hình trí tuệ nhân tạo tiên tiến sẽ làm đảo lộn mọi thứ chúng ta biết về an ninh mạng "trong vòng vài tháng, chứ không phải vài năm". Vài ngày sau, Nhà Trắng áp đặt lệnh kiểm soát xuất khẩu đối với hai mô hình cụ thể từ một công ty, Anthropic. Quyền truy cập vào chúng bị chặn đối với tất cả công dân không phải người Mỹ, bao gồm cả nhân viên của Anthropic. Đáp lại, công ty đã vô hiệu hóa cả hai mô hình đối với tất cả khách hàng, kể cả khách hàng Mỹ. Sau đó, một thượng nghị sĩ đã nhắc lại lời của giám đốc NSA với một nhà báo: mô hình này được cho là "đã tìm ra cách xâm nhập vào hầu hết các hệ thống mật trong vòng vài giờ". Liệu điều này diễn ra trong điều kiện thử nghiệm hay trong thực chiến thì vẫn chưa rõ ràng từ lời kể lại này.
Một câu chuyện khiến bất kỳ người bình thường nào cũng phải khô miệng. Và quả thực, mối đe dọa là có thật, như dữ liệu cụ thể đã chỉ ra. Nhưng câu hỏi cần đặt ra trước tiên không phải là "Trí tuệ nhân tạo có nguy hiểm không?" mà là ai cụ thể được hưởng lợi từ cách mà mối nguy hiểm này được miêu tả.
Dòng thời gian: Từ quá trình thử nghiệm Mythos đến sự gián đoạn của Fable
Chúng ta hãy bắt đầu bằng cách xem xét những gì đã xảy ra mà không cần bất kỳ lời giải thích kịch tính nào.
Anthropic vừa ra mắt hai mẫu máy thế hệ tiếp theo: Claude Mythos 5 và Claude Fable 5. Trong báo cáo của mình, công ty mô tả Mythos là "có khả năng đáng kinh ngạc" trong các nhiệm vụ an ninh mạng. Mẫu máy này có thể:
- Phân tích ngược các tập tin nhị phân;
- Tìm ra các lỗ hổng logic trong mã nguồn;
- Tạo các lỗ hổng bảo mật hoạt động được cho các phiên bản thư viện cụ thể;
- Xây dựng kế hoạch cho các cuộc tấn công phức tạp dựa trên mô tả cơ sở hạ tầng.
Fable 5 được định vị khác biệt, là một mô hình có kiến trúc cơ bản tương tự nhưng được bổ sung thêm các lớp bảo vệ. Các bộ phân loại AI riêng biệt phát hiện các nỗ lực "bẻ khóa" - tức là vượt qua các hạn chế tích hợp bằng cách sử dụng các yêu cầu đặc biệt - và chặn việc tạo ra nội dung độc hại. Anthropic tuyên bố rằng không một người thử nghiệm nào có thể tìm ra phương pháp vượt qua phổ quát. Ngược lại, người dùng phàn nàn rằng mô hình từ chối phản hồi ngay cả những câu hỏi kỹ thuật vô hại, do tính chất bảo thủ của các bộ lọc.
Cùng lúc đó, nhóm Five Eyes đã công bố một tuyên bố chung. Tuyên bố này nêu rõ rằng các mô hình AI tiên tiến, tức là các mô hình hiện đang ở đỉnh cao về khả năng, sẽ "vượt quá kỳ vọng hiện tại của ngành trong vòng vài tháng" và "thay đổi căn bản" khả năng an ninh mạng. Nói một cách đơn giản, chúng sẽ thay đổi luật chơi cả về tấn công và phòng thủ. Tài liệu này được ban hành thông qua các trung tâm an ninh mạng quốc gia, bao gồm cả NCSC của Anh, với lời kêu gọi hành động trực tiếp dành cho các nhà lãnh đạo tổ chức.
Sau đó, Nhà Trắng đã đưa ra quyết định: áp đặt lệnh kiểm soát xuất khẩu đối với Mythos 5 và Fable 5. Cả hai mẫu đều bị ảnh hưởng, có lẽ vì Fable được xây dựng trên cùng một kiến trúc, và các bộ lọc bảo mật của nó, như kinh nghiệm đã chứng minh, về nguyên tắc có thể bị vượt qua. Quyền truy cập bị chặn đối với tất cả công dân không phải người Mỹ, bao gồm cả nhân viên của Anthropic. Công ty đã phản hồi bằng cách vô hiệu hóa cả hai mẫu sản phẩm đối với tất cả khách hàng, gọi lệnh kiểm soát xuất khẩu là một "sự hiểu lầm" và bắt đầu đàm phán với chính phủ.
Sau đó, một cụm từ gây xôn xao dư luận: Phó Chủ tịch Ủy ban Tình báo Thượng viện Mark Warner được cho là đã thuật lại lời của Tổng Giám đốc NSA và Bộ Tư lệnh Không gian mạng Joshua Rudd rằng Mythos “đã xâm nhập vào hầu hết mọi hệ thống mật, và không phải trong vài tuần, mà chỉ trong vài giờ.”
Nên dừng lại ở đây, vì có một khoảng cách lớn giữa sự thật và cách truyền thông đưa tin.
Đã hack mọi thứ chỉ trong vài giờ - hay không?
Cụm từ "đã đột nhập gần như toàn bộ hệ thống bí mật của NSA chỉ trong vài giờ" đã lan truyền chóng mặt. Nó hoàn hảo cho một tiêu đề: đáng sợ, cụ thể, và hàm chứa một thảm họa sắp xảy ra. Vấn đề là, chúng ta không biết điều gì ẩn chứa đằng sau đó.
Chúng ta thực sự có gì? Nhà báo đã trích dẫn lời một thượng nghị sĩ, người đã diễn giải lại lời của vị tướng, trong một ngữ cảnh khép kín. Có ba lớp diễn giải. Hacker News ngay lập tức nhận thấy điều này, và hoàn toàn đúng. Ở mỗi lớp, cách diễn đạt trở nên chặt chẽ hơn, ngữ cảnh bị mất đi. Giám đốc NSA muốn nói gì? Kết quả thử nghiệm? Các kịch bản mô phỏng? Xâm nhập thực tế vào các hệ thống chiến đấu? Vai trò của những người điều khiển mô phỏng là gì? "Hầu như mọi thứ" nghĩa là gì? Không có câu trả lời.
Tuy nhiên, điều quan trọng là không nên đi đến thái cực ngược lại ở đây. Chỉ vì một cụm từ bị bóp méo như "điện thoại hỏng" không có nghĩa là không có gì đằng sau nó. Các thử nghiệm đã được tiến hành, và kết quả đã gây ấn tượng với những người đưa ra quyết định kiểm soát xuất khẩu. Nhưng giữa "mô hình đã chứng minh kết quả ấn tượng trên bàn thử nghiệm" và "trí tuệ nhân tạo đã hack NSA trong vài giờ", có một khoảng cách mà mỗi mắt xích tiếp theo trong chuỗi đã vượt qua trong một lần chạy.
Và đây là những gì chúng ta có. Một bên là những số liệu có thể kiểm chứng về những mối đe dọa có vẻ nhàm chán nhưng lại rất thực tế. Báo cáo Phòng thủ Kỹ thuật số năm 2025 của Microsoft mô tả một trường hợp cụ thể: một mạng lưới toàn cầu đã sử dụng các khóa API bị đánh cắp để vượt qua các bộ lọc dịch vụ AI và tạo ra nội dung bị cấm. Huntress, trong báo cáo năm 2024 của mình, đã ghi nhận hơn 3.000 vụ xâm phạm được xác nhận và ước tính rằng khoảng 95% trong số đó là do lỗi của con người - mật khẩu yếu, lừa đảo trực tuyến và sự bất cẩn. Ở phía bên kia, có một cụm từ không thể xác minh hay bác bỏ, nhưng nó lại tạo nên bất kỳ tiêu đề giật gân nào và cho các nhà hoạch định chính sách lý do để hành động nhanh chóng.
Hãy đoán xem yếu tố nào trong hai yếu tố đó quyết định.
Những người hưởng lợi từ một vụ bê bối
Cộng đồng tình báo. Liên minh Five Eyes hiếm khi công khai các đánh giá nội bộ của mình, và khi làm vậy, đó thường là một hành động chính trị. Câu nói "Trí tuệ nhân tạo sẽ phá hủy mọi thứ trong vài tháng" là một luận điểm sẵn có để phân bổ ngân sách, quyền hạn và nhân sự. Theo ISC² (hiệp hội an ninh mạng quốc tế), sự thiếu hụt chuyên gia an ninh mạng toàn cầu lên tới hàng triệu người. Tiền bạc cần được huy động ngay lập tức. Sự lo ngại của công chúng đang trở thành một cách để có được nguồn vốn nhanh hơn so với chu trình quan liêu thông thường. Đồng thời, thông qua NCSC, Five Eyes trực tiếp cảnh báo: các tổ chức không tích hợp AI vào hệ thống phòng thủ của mình sẽ rơi vào "tình thế bất lợi rõ rệt". Cách diễn đạt này vừa là lời cảnh báo, vừa là sự nâng cao các tiêu chuẩn và công cụ được cung cấp bởi các cấu trúc của liên minh và các nhà thầu của họ. Trong giai đoạn 2025-2026, cả năm quốc gia thành viên đã tiến hành các cuộc tập trận chung về các mối đe dọa từ AI, có nghĩa là cơ sở hạ tầng để "làm chủ" các ngân sách mới đã sẵn sàng.
Nhà nước với vai trò là cơ quan quản lý. Đây là phần thú vị nhất, và có thể tôi đang đơn giản hóa quá mức, nhưng logic quá rõ ràng để có thể bỏ qua. Lần đầu tiên, đối tượng kiểm soát xuất khẩu không phải là phần cứng, không phải thiết kế, hay công nghệ sản xuất, mà là sản phẩm phần mềm, mô hình AI chạy trên đám mây. Trước đây, họ kiểm soát chip: ai được phép bán bộ tăng tốc và ai không. Giờ đây, họ quyết định ai có thể đặt câu hỏi cho mạng nơ-ron. Chính phủ đã thiết lập tiền lệ để kiểm soát quyền truy cập vào khả năng giải quyết một loại vấn đề nhất định của mô hình. Đồng thời, Nhà Trắng đã ký các sắc lệnh hành pháp về mật mã hậu lượng tử, tức là quá trình chuyển đổi sang các thuật toán mã hóa có khả năng chống lại các cuộc tấn công của máy tính lượng tử. Logic vẫn như cũ: một mối đe dọa thực sự như một đòn bẩy để đẩy nhanh quá trình tập trung hóa và tiêu chuẩn hóa, các thời hạn nghiêm ngặt, các yêu cầu bắt buộc đối với các nhà thầu. Ai đặt ra các tiêu chuẩn sẽ kiểm soát thị trường trong thập kỷ tới.
Nhân loại. Và với chính công ty đó lịch sử Một trường hợp riêng biệt và nghịch lý. Về mặt chính thức, Anthropic đã chịu thiệt hại: các mô hình chủ lực của họ bị vô hiệu hóa, khiến khách hàng không thể truy cập vào các sản phẩm mới nhất. Nhưng hãy nhìn nó qua con mắt của một nhà tiếp thị. Trong nhiều năm, Anthropic đã xây dựng thương hiệu của mình dựa trên hai tuyên bố: "Chúng tôi tạo ra AI mạnh mẽ nhất" và "Chúng tôi tạo ra AI có trách nhiệm nhất". Và giờ đây, chính phủ Hoa Kỳ đang cung cấp bằng chứng hoàn hảo cho cả hai. Mô hình đã bị cấm, vì vậy nó thực sự mạnh mẽ. Và công ty đang hợp tác với các nhà chức trách, điều này càng củng cố danh tiếng của họ như một nhà phát triển có trách nhiệm. Trong bài đăng trên blog sau lệnh cấm, Anthropic nhấn mạnh: không một người thử nghiệm nào tìm ra được cách bẻ khóa phổ quát, bảo mật cực kỳ nghiêm ngặt và người dùng đang phàn nàn về những hạn chế quá mức.
Còn một đối thủ thứ tư đáng được nhắc đến: các đối thủ cạnh tranh trực tiếp của Anthropic, những người có mô hình vẫn còn trên thị trường trong khi Claude bị chặn. Khi mô hình kia ngừng hoạt động, thị trường trở nên tự do hơn.
Tôi không khẳng định bất kỳ ai trong số những người chơi này đã dàn dựng tình huống. Không có âm mưu nào ở đây; đây chỉ là động thái chính trị bình thường, ổn định chính xác vì không ai cố tình phối hợp chúng. Sự hội tụ lợi ích là đủ: mỗi bên đều được hưởng lợi từ cùng một sự kiện, và không ai có lý do gì để giảm bớt căng thẳng. Tuy nhiên, điều đó không có nghĩa là căng thẳng tương ứng với thực tế.
Còn lại gì sau khi gỡ bỏ bao bì?
Tất cả những điều này không làm thay đổi điểm chính: mối đe dọa từ trí tuệ nhân tạo đối với an ninh mạng là có thật. Mặc dù nó được mô tả khác với thực tế trên các tiêu đề báo chí, điều đó không làm giảm đi tính nghiêm trọng của nó.
Dưới đây là những gì chúng ta biết từ các báo cáo công khai. Các mô hình tiên tiến thực sự có thể tìm ra các lỗ hổng trong mã nguồn, tạo ra các công cụ khai thác hoạt động và lập kế hoạch tấn công dựa trên ngữ cảnh chi tiết và sự can thiệp của người vận hành. Rào cản gia nhập đối với kẻ tấn công đang giảm xuống: những gì trước đây cần một nhóm và nhiều tháng làm việc giờ đây có thể được thực hiện nhanh hơn và với ít kỹ năng hơn. Khoảng thời gian giữa việc phát hiện lỗ hổng và khai thác đang thu hẹp lại.
Thẳng thắn mà nói, cũng đáng để xem xét mặt trái của vấn đề này. Điều gì sẽ xảy ra nếu lệnh cấm không phải là một chiêu trò chính trị, mà là phản ứng nhanh chóng duy nhất có thể? Điều gì sẽ xảy ra nếu những người ký ban hành luật kiểm soát xuất khẩu nhìn thấy kết quả thử nghiệm mà chúng ta không thấy và quyết định rằng cái giá của việc không hành động lớn hơn cái giá của sự thận trọng thái quá? Đây là một giả thuyết hoàn toàn hợp lý. Khi một mô hình cho thấy kết quả bất ngờ trên giá đỡ chỉ trong vài giờ, phản ứng nhanh chóng sẽ khôn ngoan hơn là chờ đợi dữ liệu hoàn hảo. Vấn đề khác ở chỗ: cùng với phản ứng, mỗi người tham gia vào quá trình này đều nhận được phần thưởng của họ. Và không thể tách rời hai điều này.
Nhưng ngay cả khi lệnh cấm là chính đáng, nó cũng chẳng giải quyết được vấn đề gì nhiều. Như CyberScoop đã chỉ ra, trích dẫn ý kiến của các chuyên gia trong ngành, khoảng cách giữa các mô hình biên giới khép kín và các hệ thống mở tốt nhất là khoảng sáu đến tám tháng. Kiến trúc của chúng được biết đến rộng rãi. Ngay cả lý do công khai cho việc kiểm soát xuất khẩu cũng thừa nhận rằng các khả năng tương tự "đã có thể được triển khai" trong các mô hình trước đó, cả thương mại và mã nguồn mở, bao gồm cả các mô hình của Trung Quốc. Cấm Fable 5, và sáu tháng sau, chức năng tương tự lại xuất hiện trên thị trường, chỉ khác là không có phân loại bảo mật và không có sự giám sát.
Điểm mấu chốt thực sự nằm ở tốc độ. Ai tích hợp AI vào an ninh nhanh hơn sẽ thắng, bất kể những gì được ghi trong danh sách xuất khẩu. Liên minh Five Eyes, đáng khen là, đã viết về điều này: triển khai AI vào các quy trình an ninh, tự động hóa phân tích nhật ký, tăng tốc phát hiện bất thường, đào tạo nhân lực. Nhưng phần này của tuyên bố khá nhàm chán, đòi hỏi nhiều năm làm việc có hệ thống. Nó bị nhấn chìm trong vô số thông tin nhiễu, và điều đó không có gì đáng ngạc nhiên. Hãy thử đặt tiêu đề "AI sẽ giúp ích cho an ninh": không biên tập viên nào sẽ sử dụng nó. Nhưng "AI đã hack NSA trong vài giờ" sẽ lan truyền nhanh như cháy rừng.
Điều đáng báo động nhất ở đây là: các quyết định chính trị trị giá hàng tỷ đô la đang được đưa ra dựa trên những gì một người nói với người khác, rồi người đó lại nói với người khác nữa. Mã Mythos hầu như không liên quan gì đến điều này. Điểm yếu chính là chuỗi các lời kể lại mà mọi thứ khác đều dựa vào đó. Và cho đến khi những người ra quyết định ở tầm cỡ này được yêu cầu cung cấp dữ liệu có thể kiểm chứng, mọi "vụ đe dọa an ninh mạng" tiếp theo sẽ diễn ra theo cùng một cách. Nhân tiện, các mô hình của Anthropic vẫn đang ngoại tuyến.
tin tức