ABM - AI Business Master

Yêu Cầu Quyền Truy Cập VIP

Nội dung này chỉ dành riêng cho thành viên VIP. Vui lòng nâng cấp hoặc gia hạn gói thành viên để truy cập.

Tìm kiếm khóa học

Gõ vào ô bên trên để bắt đầu tìm kiếm trong thư viện khóa học của ABM.

Claude Mythos: Siêu Hacker AI, Rủi Ro và An Toàn

Admin admin
08/05/2026
20 phút đọc
124 lượt xem
Claude Mythos: Siêu Hacker AI, Rủi Ro và An Toàn

Claude Mythos: Siêu Hacker Không Thương Mại Hóa và Ranh Giới An Toàn của Trí Tuệ Nhân Tạo

Trong kỷ nguyên vàng của trí tuệ nhân tạo, khi mỗi ngày chúng ta chứng kiến những bước nhảy vọt đáng kinh ngạc từ các mô hình ngôn ngữ lớn, có một câu chuyện ít được biết đến hơn, nhưng lại mang ý nghĩa sâu sắc về ranh giới đạo đức và an ninh: câu chuyện về Claude Mythos của Anthropic. Đây không chỉ là một mô hình AI tiên tiến mà còn là một thực thể kỹ thuật số với khả năng "siêu hacker" đáng sợ, đến mức nhà phát triển của nó, Anthropic, đã phải kìm hãm việc thương mại hóa rộng rãi. Claude Mythos đại diện cho một bước ngoặt, một lời cảnh tỉnh về sức mạnh tiềm ẩn của AI và những thách thức chưa từng có mà nó đặt ra cho thế giới công nghệ và an ninh quốc gia.

Bình Minh của Một Khám Phá Rúng Động: Từ Bali Đến Lỗ Hổng Bảo Mật

Vào một buổi tối cuối tháng 2 tại Bali, Indonesia, nhà nghiên cứu AI danh tiếng Nicholas Carlini đã rời một đám cưới, trở về nhà và mở chiếc laptop của mình. Anh đang chuẩn bị cho một nhiệm vụ đặc biệt: kiểm tra phiên bản demo nội bộ của Claude Mythos, một mô hình AI mới từ phòng thí nghiệm Anthropic PBC. Mục tiêu của Anthropic khi chi trả cho những chuyên gia như Carlini là để kiểm tra độ an toàn của Mythos, nhằm xác định liệu những kẻ tấn công có thể lợi dụng nó cho các mục đích gián điệp, trộm cắp hay phá hoại hay không.

Những giờ tiếp theo đã đưa Carlini đi từ bất ngờ này đến bất ngờ khác. Anh phát hiện ra rằng Mythos có khả năng tự động tạo ra các công cụ đột nhập vô cùng mạnh mẽ. Điều đáng chú ý là Mythos có thể tạo ra mã nguồn mở dựa trên Linux, nền tảng của hầu hết các hệ thống máy tính hiện đại, để phục vụ mục đích tấn công. Không dừng lại ở đó, Mythos thậm chí còn dàn dựng một vụ cướp ngân hàng kỹ thuật số mô phỏng, vượt qua các giao thức bảo mật phức tạp, xâm nhập vào mạng lưới và tiếp cận các kho tiền trực tuyến.

Carlini đã chia sẻ với Bloomberg về mức độ tinh vi của AI này. Ông nhận định rằng trí tuệ nhân tạo trước đây đã thành công trong việc bẻ khóa hệ thống, nhưng giờ đây nó còn có thể thực hiện cả một vụ cướp. Mỗi ngày, Carlini và các đồng nghiệp liên tục nhận được phản hồi từ Mythos về những lỗi nghiêm trọng và nguy hiểm, những lỗi mà thông thường chỉ được phát hiện bởi những hacker giỏi nhất thế giới. Phát hiện này đã vẽ nên một bức tranh đáng lo ngại về tiềm năng của AI trong lĩnh vực an ninh mạng. Hình ảnh minh họa về một hacker Mythos lan truyền trên các diễn đàn công nghệ càng củng cố thêm những lo ngại này.

Đội Ngũ "Tiên Phong Đỏ" Xác Nhận Nguy Cơ

Song song với các thử nghiệm của Carlini, đội ngũ "Tiên phong đỏ" Frontier Red Team của Anthropic, chuyên trách đánh giá các mô hình AI để đảm bảo chúng không gây hại cho nhân loại, cũng tiến hành kiểm tra mô phỏng sau khi nhận Mythos từ phòng thí nghiệm. Logan Graham, người điều hành nhóm Frontier Red Team của Anthropic, cho biết chỉ sau vài giờ thử nghiệm, nhóm của ông đã nhận ra sự khác biệt của Mythos. Ông nhấn mạnh rằng nó có khả năng tự tìm và khai thác lỗ hổng.

Graham lập tức cảnh báo cho đội ngũ lãnh đạo Anthropic về tiềm năng rủi ro an ninh quốc gia mà mô hình AI mới này có thể gây ra. Ông cũng nhấn mạnh rằng sản phẩm này quá nguy hiểm để đưa ra thị trường đại chúng. Phát hiện của nhóm Frontier Red Team đã củng cố mạnh mẽ những gì Carlini đã chứng kiến, cho thấy Mythos không chỉ là một công cụ hỗ trợ mà còn là một tác nhân có khả năng tự chủ đáng kinh ngạc trong việc tìm kiếm và khai thác các điểm yếu bảo mật.

Anthropic Đối Mặt Với Quyết Định Khó Khăn: Giới Hạn Thay Vì Thương Mại Hóa

Đầu tháng 3, Jared Kaplan, nhà đồng sáng lập kiêm Giám đốc khoa học của Anthropic, cùng với một nhà đồng sáng lập khác là Sam McCandlish, đã trình bày về Mythos với ban giám đốc công ty. Cả hai đều thống nhất rằng mô hình AI này quá rủi ro nếu được phát hành rộng rãi. Tuy nhiên, họ cũng đề xuất một phương án khác: cho phép một số công ty khác, thậm chí cả đối thủ cạnh tranh, dùng thử trong một môi trường được kiểm soát chặt chẽ.

Sau nhiều lần cân nhắc kỹ lưỡng, đến ngày 7 tháng 4, Anthropic chính thức công bố mô hình AI mới với tên gọi "Mythos Preview". Thay vì thương mại hóa rộng rãi, công ty đã chọn cách cấp quyền truy cập hạn chế cho 12 công ty công nghệ thông qua Project Glasswing, một sáng kiến được mô tả là nỗ lực nhằm bảo vệ những phần mềm quan trọng nhất thế giới. Nhóm đối tác ban đầu này bao gồm những tên tuổi lớn như Amazon Web Services, Apple, Microsoft, Google, Nvidia, Broadcom, CrowdStrike, Mozilla, cùng với một số tổ chức khác giấu tên trong danh sách hơn 40 tổ chức chịu trách nhiệm về những phần mềm trọng yếu toàn cầu.

Trong video công bố Project Glasswing, CEO Anthropic Dario Amodei cho biết công ty đã đề nghị hợp tác với các quan chức chính phủ Mỹ nhằm giúp phòng vệ trước rủi ro từ những mô hình này. Axios cũng đưa tin rằng Cơ quan An ninh Quốc gia Mỹ NSA cùng một số bộ phận thuộc chính phủ Mỹ đã bắt đầu sử dụng Mythos Preview. Điều này cho thấy sự nghiêm trọng của vấn đề và sự cần thiết của sự hợp tác giữa các nhà phát triển AI và các cơ quan an ninh quốc gia để quản lý rủi ro.

Khả Năng Vượt Trội Của Mythos: Những Con Số Ấn Tượng

Tại sự kiện ra mắt, Anthropic đã công bố những kết quả thử nghiệm đáng kinh ngạc của Mythos. Mô hình này cho thấy kỹ năng rất cao trong các tác vụ an ninh mạng và hack, thậm chí vượt trội hơn con người. Trong phép đo CyberGym, một bài kiểm tra khả năng tìm lỗ hổng bảo mật của tác nhân AI trong các dự án phần mềm mã nguồn mở thực tế, Mythos đã đạt điểm cao kỷ lục 83,1%. Để so sánh, công cụ GLM 5.1 của Zhipu AI chỉ đạt 68,7%, còn Moonshot AI đạt 41,3%. Sự khác biệt rõ rệt này đã chứng minh năng lực vượt trội của Mythos trong việc xác định điểm yếu bảo mật.

Amodei tuyên bố rằng Mythos Preview đã phát hiện hàng nghìn lỗ hổng nghiêm trọng, bao gồm cả trong các hệ điều hành lớn và trình duyệt web. Ông cảnh báo rằng với tốc độ phát triển của AI, sẽ không mất nhiều thời gian trước khi những năng lực như vậy lan rộng, có thể vượt tầm kiểm soát của những người cam kết sử dụng chúng một cách an toàn. CEO này cũng tiết lộ rằng Mythos đã phát hiện các lỗ hổng nghiêm trọng trong các hệ thống cũ, bao gồm một lỗ hổng đã tồn tại suốt 27 năm và thậm chí còn đề xuất cách khai thác chúng.

Anthropic quyết định phát hành hạn chế Mythos vì nếu triển khai rộng rãi, AI này có thể làm thay đổi cán cân quyền lực giữa các bên trong không gian mạng. Điều này có nghĩa là các tổ chức phòng thủ sẽ phải đối mặt với những cuộc tấn công nhanh hơn, chính xác hơn và khó dự đoán hơn, đặt ra một thách thức chưa từng có cho hệ thống an ninh mạng toàn cầu.

Minh Chứng Thực Tế và Phản Ứng Trong Ngành

Khả năng của Mythos đã nhanh chóng được chứng minh trong thực tế. Mozilla, nhà phát triển trình duyệt Firefox, đã thông báo rằng bản phát hành Firefox 150 phải vá tới 271 lỗ hổng. Tất cả những lỗ hổng này đều được xác định bằng cách sử dụng quyền truy cập sớm vào Mythos Preview của Anthropic. Đây là một minh chứng hùng hồn cho hiệu quả của Mythos trong việc tìm kiếm và phát hiện các điểm yếu bảo mật một cách nhanh chóng và toàn diện.

Khả năng này đã khiến giới an ninh mạng toàn cầu lo ngại sâu sắc. Bobby Holley, Giám đốc công nghệ của Firefox, đã chia sẻ với Wired sau khi công bố vá lỗ hổng cho Firefox vào ngày 20 tháng 4. Ông nhận định rằng mình đã nói chuyện với lãnh đạo kỹ thuật tại một số công ty quy mô rất lớn và họ cho biết sẽ phải điều động hàng nghìn kỹ sư từ mọi bộ phận để ngăn chặn AI khai thác lỗ hổng trong 6 tháng tới. Holley nhấn mạnh rằng đây sẽ là một thách thức lớn đối với ngành công nghiệp, đặc biệt là đối với các dự án nhỏ và mã nguồn mở, vốn thường có nguồn lực hạn chế hơn.

Ciaran Martin, cựu lãnh đạo Trung tâm An ninh mạng quốc gia Anh, đánh giá rằng việc Mythos có thể phát hiện lỗ hổng nghiêm trọng nhanh hơn nhiều so với những mô hình AI khác là thực sự gây chấn động. Ông chia sẻ với BBC rằng ngay cả những thứ chúng ta biết tồn tại hay chưa tồn tại, Mythos vẫn phát hiện ra. Ông gọi nó đơn giản là một siêu hacker.

Trong khi đó, theo New York Times, các quan chức chính phủ cũng bày tỏ nỗi lo ngại sau khi Mythos xuất hiện. Thống đốc Ngân hàng Anh đã công khai cảnh báo rằng Anthropic có thể đã tìm ra cách phá vỡ toàn bộ thế giới rủi ro mạng. Ngân hàng Trung ương châu Âu bắt đầu âm thầm đặt câu hỏi cho các ngân hàng về khả năng phòng thủ của họ. Bộ trưởng Tài chính Canada François-Philippe Champagne thậm chí còn so sánh mối đe dọa này với việc đóng cửa eo biển Hormuz, một tuyến đường vận chuyển dầu mỏ quan trọng, cho thấy mức độ nghiêm trọng mà các nhà lãnh đạo chính trị nhìn nhận về Mythos.

Anh là quốc gia duy nhất ngoài Mỹ có đại diện được tiếp cận Mythos. Claudia Plattner, Chủ tịch cơ quan an ninh mạng của Đức, cho biết đã gặp gỡ các nhân viên của Anthropic tại San Francisco để có được cái nhìn sâu sắc về cách thức hoạt động của AI này. Bà đánh giá công cụ mới này cho thấy sự thay đổi mang tính đột phá trong bản chất của các mối đe dọa mạng.

Nghi Ngờ và Góc Nhìn Đa Chiều: Liệu Có Phải Là Sự Thổi Phồng

Dù những khả năng của Mythos gây ấn tượng mạnh, một số chuyên gia vẫn cho rằng có thể Mythos đang bị thổi phồng quá mức. Một nhà nghiên cứu đã chia sẻ với BBC rằng chúng tôi chưa thể chắc chắn liệu Mythos Preview có thể tấn công các hệ thống được bảo vệ tốt hay không. Do đó, ở những nơi có an ninh mạng tốt, về lý thuyết, mô hình này có thể sẽ bị ngăn chặn.

CEO Nvidia Jensen Huang không đề cập trực tiếp đến Mythos, nhưng tại một sự kiện tuần trước, ông cho rằng việc nhấn mạnh quá mức các rủi ro của AI có thể là cách để một số công ty định vị mình là bên duy nhất đủ khả năng phát triển trí tuệ nhân tạo một cách an toàn. Nhận định này ngụ ý rằng có thể có động cơ kinh tế hoặc chiến lược đằng sau việc phóng đại các mối đe dọa từ AI.

Một số chuyên gia khác đánh giá rằng các mô hình AI hiện tại, bao gồm cả Mythos, chưa phải là hệ thống có ý thức hay khả năng tự hành động như một hacker thực thụ. Nói cách khác, chúng chỉ là công cụ xử lý dữ liệu, hỗ trợ phát hiện lỗi, chứ chưa thể tự gây ra những cuộc tấn công phức tạp trong môi trường thực tế mà không có sự can thiệp của con người. Điều này làm giảm bớt phần nào những lo ngại về một AI hoàn toàn tự chủ, có thể gây ra hỗn loạn.

Theo ông Martin, điều quan trọng là các tổ chức nên tập trung vào đảm bảo các nền tảng an ninh mạng cơ bản để tránh việc AI tấn công. Ông bổ sung thêm rằng với một số người, đây là một sự kiện mang tính tận thế. Nhưng với những người khác, nó chỉ là sự cường điệu. Ông cũng đưa ra một góc nhìn tích cực: trong trung hạn, các công cụ này còn có thể được sử dụng để khắc phục nhiều lỗ hổng nền tảng của Internet, biến một công cụ tiềm ẩn nguy hiểm thành một lực lượng bảo vệ mạnh mẽ.

Tương Lai Của AI và An Ninh Mạng: Bài Học Từ Claude Mythos

Claude Mythos là một lời nhắc nhở mạnh mẽ về bản chất hai mặt của trí tuệ nhân tạo. Một mặt, nó mang lại tiềm năng cách mạng hóa an ninh mạng, giúp phát hiện và vá lỗi nhanh hơn bao giờ hết, góp phần bảo vệ các hệ thống quan trọng. Mặt khác, khả năng tấn công của nó lại mở ra một kỷ nguyên mới của các mối đe dọa mạng, nơi AI có thể trở thành vũ khí trong tay những kẻ xấu.

Quyết định của Anthropic khi hạn chế phát hành Mythos, thay vì thương mại hóa rộng rãi, là một minh chứng cho sự nhận thức về trách nhiệm đạo đức và xã hội của các nhà phát triển AI. Nó đặt ra câu hỏi về cách chúng ta sẽ quản lý và kiểm soát những công nghệ mạnh mẽ này trong tương lai. Sự hợp tác giữa các công ty công nghệ, chính phủ và cộng đồng nghiên cứu sẽ là chìa khóa để đảm bảo rằng AI được phát triển và sử dụng một cách an toàn, phục vụ lợi ích của nhân loại thay vì trở thành mối đe dọa.

Câu chuyện về Claude Mythos không chỉ là về một siêu hacker AI, mà còn là về cuộc tranh luận đang diễn ra về an toàn AI, sự cần thiết của quy định, và vai trò của con người trong việc định hình tương lai công nghệ. Khi AI ngày càng trở nên mạnh mẽ, khả năng tự điều chỉnh và hợp tác toàn cầu sẽ quyết định liệu chúng ta có thể khai thác tiềm năng của nó mà không rơi vào những rủi ro không lường trước được. Mythos là một bước ngoặt, định hình lại cách chúng ta suy nghĩ về an ninh mạng và vị trí của AI trong đó.

Zalo Chat