ABM - AI Business Master

Yêu Cầu Quyền Truy Cập VIP

Nội dung này chỉ dành riêng cho thành viên VIP. Vui lòng nâng cấp hoặc gia hạn gói thành viên để truy cập.

Tìm kiếm khóa học

Gõ vào ô bên trên để bắt đầu tìm kiếm trong thư viện khóa học của ABM.

Tin tặc dùng 100.000 prompt sao chép Google Gemini

Admin admin
03/03/2026
18 phút đọc
143 lượt xem
Tin tặc dùng 100.000 prompt sao chép Google Gemini

Tấn Công Chưng Cất Tri Thức: Khi Tin Tặc Dùng 100.000 Câu Lệnh Để Sao Chép Trí Tuệ Google Gemini

Trong một thế giới công nghệ không ngừng đổi mới, trí tuệ nhân tạo đặc biệt là các mô hình ngôn ngữ lớn LLM đang trở thành tâm điểm của sự chú ý và cũng là mục tiêu của nhiều hình thức tấn công phức tạp. Mới đây, một báo cáo từ nhóm chuyên gia về các mối đe dọa của Google GTIG đã hé lộ một chiến dịch tấn công đầy tinh vi, nơi tin tặc đã sử dụng tới 100.000 câu lệnh prompt để cố gắng sao chép khả năng của Google Gemini. Đây không chỉ là một lời cảnh tỉnh về những lỗ hổng tiềm ẩn trong kỷ nguyên AI mà còn là một minh chứng rõ ràng cho cuộc chiến ngầm đang diễn ra để giành lấy quyền sở hữu trí tuệ trong lĩnh vực công nghệ cao.

Báo Động Từ Google: Mối Nguy Trích Xuất Mô Hình

Ngày 13 tháng 2 vừa qua, nhóm chuyên gia về các mối đe dọa của Google GTIG đã công bố một báo cáo bảo mật quan trọng, làm dấy lên hồi chuông cảnh báo về tình trạng các mô hình ngôn ngữ lớn LLM đang đứng trước nhiều nguy cơ bị tấn công. Ngoài những mối đe dọa truyền thống như làm gián đoạn hoạt động, một trong những nguy cơ đang hiện hữu và ngày càng trở nên nghiêm trọng là tấn công trích xuất mô hình Model Extraction Attacks hay còn gọi tắt là MEA. Phương pháp chính mà kẻ tấn công sử dụng trong các chiến dịch MEA là chưng cất kiến thức Knowledge Distillation.

Báo cáo này không chỉ mang tính lý thuyết mà còn được minh chứng bằng những phát hiện cụ thể. Các chuyên gia của Google đã phát hiện tin tặc đang cố gắng sao chép Gemini, một trong những mô hình AI tiên tiến nhất của Google, thông qua một chiến thuật tấn công chưng cất kiến thức. Đáng chú ý, một trong những chiến dịch này đã sử dụng một số lượng khổng lồ lên đến 100.000 câu lệnh prompt để tìm hiểu cách Gemini hoạt động. Đây là một nỗ lực quy mô lớn, cho thấy mức độ tinh vi và quyết tâm của những kẻ tấn công trong việc khai thác các mô hình AI độc quyền.

Chưng Cất Kiến Thức: Kỹ Thuật Hai Mặt

Để hiểu rõ hơn về mối đe dọa này, chúng ta cần tìm hiểu về chưng cất kiến thức. Chưng cất kiến thức là một kỹ thuật học máy phổ biến và hoàn toàn hợp pháp, được sử dụng để huấn luyện các mô hình mới từ các mô hình đã hoàn thiện. Trong kỹ thuật này, mô hình đã hoàn thiện thường được gọi là mô hình giáo viên teacher model và mô hình mới đang được huấn luyện được gọi là mô hình học sinh student model.

Cụ thể, mô hình học sinh sẽ truy vấn mô hình giáo viên về các vấn đề trong một lĩnh vực cụ thể. Mô hình giáo viên, với kiến thức và khả năng suy luận vượt trội, sẽ cung cấp các câu trả lời hoặc kết quả đầu ra. Dựa trên các kết quả này, mô hình học sinh sẽ thực hiện tinh chỉnh có giám sát supervised fine-tuning hoặc sử dụng kết quả đó trong các quy trình huấn luyện mô hình khác để tạo ra một mô hình mới với khả năng tương tự nhưng thường là nhỏ gọn hơn, nhanh hơn và ít tốn kém hơn để vận hành. Mục tiêu ban đầu của chưng cất kiến thức là tạo ra các mô hình hiệu quả hơn mà không làm mất đi đáng kể chất lượng.

Tuy nhiên, như nhiều công nghệ khác, chưng cất kiến thức cũng có thể bị lạm dụng. Khi được sử dụng với mục đích xấu, nó trở thành một công cụ mạnh mẽ cho các cuộc tấn công trích xuất mô hình. Kẻ tấn công lợi dụng cơ chế này để khai thác thông tin từ các mô hình AI độc quyền, biến một kỹ thuật học máy hữu ích thành một mối đe dọa đối với sở hữu trí tuệ và bảo mật AI.

Cơ Chế Tấn Công Bằng 100.000 Câu Lệnh

Trong trường hợp của Google Gemini, kẻ tấn công đã sử dụng một chiến lược tinh vi. Thay vì phá vỡ hệ thống bằng các phương pháp hack truyền thống, chúng đã tận dụng quyền truy cập hợp pháp vào mô hình. Điều này có nghĩa là chúng tương tác với Gemini như một người dùng bình thường, nhưng với một mục đích khác biệt rõ ràng.

Kẻ tấn công đã đưa ra hàng nghìn, thậm chí hàng chục nghìn câu lệnh prompt nhằm "dụ" mô hình trả lời theo những cách nhất định. Mỗi câu lệnh được thiết kế một cách tỉ mỉ để khai thác một khía cạnh cụ thể trong quá trình suy luận của Gemini. Ví dụ, chúng có thể hỏi Gemini về các vấn đề phức tạp trong nhiều lĩnh vực khác nhau, từ khoa học, lịch sử đến các tác vụ lập trình hay phân tích dữ liệu. Bằng cách phân tích hàng loạt câu trả lời mà Gemini cung cấp, kẻ tấn công dần dần thu thập được dữ liệu, suy đoán về quy trình suy luận nội tại của mô hình, và từ đó áp dụng những hiểu biết này để huấn luyện một mô hình AI của riêng mình.

Chiến dịch được các chuyên gia Google phát hiện đã sử dụng hơn 100.000 prompt. Con số khổng lồ này không phải là ngẫu nhiên. Nhóm bảo mật của Google đã nhận định rằng "phạm vi câu hỏi rộng cho thấy nỗ lực tái tạo khả năng suy luận của Gemini". Điều này có nghĩa là kẻ gian không chỉ muốn sao chép một chức năng đơn lẻ mà còn muốn tái hiện toàn bộ khả năng suy luận đa dạng của Gemini trên nhiều loại nhiệm vụ khác nhau. Điều đáng chú ý là mục tiêu của chiến dịch này không chỉ dừng lại ở ngôn ngữ tiếng Anh mà còn hướng đến một loại ngôn ngữ không phải tiếng Anh, cho thấy tham vọng của kẻ tấn công trong việc tạo ra một mô hình đa ngôn ngữ với khả năng tương tự Gemini.

Kẻ Chủ Mưu và Động Cơ Đằng Sau

Mặc dù Google GTIG không tiết lộ chi tiết về thủ phạm đứng sau các cuộc tấn công này, nhưng họ đã ám chỉ rằng đó có thể là các công ty tư nhân hoặc các nhà nghiên cứu đang tìm cách giành lợi thế cạnh tranh. Điều này không gây ngạc nhiên trong bối cảnh cuộc đua AI toàn cầu đang nóng lên từng ngày. Các tập đoàn công nghệ lớn đã chi hàng tỷ USD để chạy đua phát triển chatbot AI và các mô hình ngôn ngữ lớn tiên tiến nhất. Do đó, cơ chế hoạt động bên trong của các mô hình hàng đầu của họ là thông tin độc quyền cực kỳ có giá trị.

Trong một thị trường cạnh tranh khốc liệt, việc có thể trích xuất mô hình của đối thủ cho phép kẻ tấn công đẩy nhanh quá trình phát triển mô hình AI của mình với chi phí thấp hơn đáng kể. Thay vì phải đầu tư hàng tỷ USD và nhiều năm nghiên cứu, họ có thể tận dụng trí tuệ đã được tạo ra, tinh chỉnh và tối ưu hóa bởi các công ty hàng đầu. Đây không chỉ là một hành vi đánh cắp sở hữu trí tuệ trắng trợn mà còn vi phạm nghiêm trọng các điều khoản dịch vụ của nền tảng, tạo ra một sân chơi không công bằng trong ngành công nghiệp AI.

Không phải là trường hợp cá biệt. Năm ngoái, OpenAI cũng từng cáo buộc DeepSeek, một công ty AI khác, đã thực hiện các cuộc tấn công chưng cất để cải thiện mô hình của mình. Điều này cho thấy rằng việc trích xuất mô hình không phải là một mối đe dọa mới mà là một chiến thuật đang ngày càng phổ biến và tinh vi trong ngành.

Tác Động Và Rủi Ro

Theo Google, việc tấn công trích xuất mô hình này không gây rủi ro trực tiếp đến người dùng cuối. Người dùng Gemini hoặc các sản phẩm dựa trên LLM khác không phải lo lắng về việc dữ liệu cá nhân của họ bị đánh cắp hay quyền riêng tư bị xâm phạm bởi loại hình tấn công này. Mục tiêu của kẻ tấn công không phải là truy cập thông tin người dùng mà là khai thác kiến thức của mô hình.

Tuy nhiên, đây lại là một nguy cơ nghiêm trọng cho các nhà phát triển mô hình cũng như các nhà cung cấp dịch vụ AI. Việc bị trích xuất mô hình có thể dẫn đến nhiều hậu quả tiêu cực:

  • Đánh cắp sở hữu trí tuệ: Công sức, thời gian và hàng tỷ USD đầu tư vào nghiên cứu và phát triển AI có thể bị "ăn cắp" một cách hiệu quả.
  • Mất lợi thế cạnh tranh: Nếu đối thủ có thể tái tạo khả năng của mô hình độc quyền với chi phí thấp hơn, công ty phát triển mô hình gốc sẽ mất đi lợi thế cạnh tranh quan trọng trên thị trường.
  • Suy giảm niềm tin: Mặc dù không ảnh hưởng trực tiếp đến người dùng cuối, việc lộ các lỗ hổng bảo mật hoặc các cuộc tấn công thành công có thể làm suy giảm niềm tin vào các nhà cung cấp dịch vụ AI và công nghệ của họ.
  • Phát sinh chi phí bảo mật: Các công ty phải đầu tư nhiều hơn vào các biện pháp phòng thủ và giám sát để ngăn chặn hoặc phát hiện các cuộc tấn công trích xuất mô hình.

NBC đã nhấn mạnh rằng các công ty công nghệ đã chi hàng tỷ USD để chạy đua phát triển chatbot AI và các mô hình ngôn ngữ lớn. Do đó, cơ chế hoạt động bên trong của các mô hình hàng đầu của họ là thông tin độc quyền cực kỳ có giá trị. Việc bảo vệ những tài sản trí tuệ này trở thành một ưu tiên hàng đầu, và các cuộc tấn công trích xuất mô hình đặt ra thách thức lớn cho nỗ lực đó.

Cuộc Chiến Không Hồi Kết Trong Kỷ Nguyên AI

Lời cảnh báo từ John Hultquist của nhóm GTIG rằng hoạt động chưng cất kiến thức dự kiến có thể diễn ra mạnh mẽ hơn trong thời gian tới là một điều đáng suy ngẫm. Khi công nghệ AI ngày càng phát triển và trở nên phổ biến, giá trị của các mô hình AI tiên tiến sẽ tiếp tục tăng lên, kéo theo sự gia tăng các nỗ lực nhằm khai thác chúng.

Cuộc chiến bảo mật trong kỷ nguyên AI không chỉ dừng lại ở việc ngăn chặn các cuộc tấn công truyền thống như ransomware hay lừa đảo mà còn mở rộng sang các hình thức phức tạp hơn, nhắm vào chính trí tuệ và khả năng của các mô hình AI. Các nhà phát triển AI không chỉ cần tập trung vào việc tạo ra các mô hình mạnh mẽ và hiệu quả mà còn phải xây dựng chúng với khả năng phòng thủ vững chắc trước các cuộc tấn công trích xuất.

Điều này đòi hỏi một cách tiếp cận đa chiều, bao gồm cải thiện khả năng phát hiện các hành vi truy vấn bất thường, phát triển các kỹ thuật làm nhiễu đầu ra của mô hình để ngăn chặn việc chưng cất hiệu quả, và tăng cường khung pháp lý để bảo vệ sở hữu trí tuệ trong lĩnh vực AI. Hơn nữa, sự hợp tác giữa các công ty công nghệ và các nhà nghiên cứu bảo mật là rất cần thiết để chia sẻ thông tin về các mối đe dọa và phát triển các giải pháp phòng thủ hiệu quả.

Kết Luận

Việc tin tặc sử dụng 100.000 câu lệnh để cố gắng sao chép Google Gemini thông qua tấn công chưng cất kiến thức là một hồi chuông cảnh tỉnh mạnh mẽ. Nó làm nổi bật sự phức tạp và tinh vi của các mối đe dọa trong kỷ nguyên AI, đồng thời nhấn mạnh tầm quan trọng của việc bảo vệ sở hữu trí tuệ trong một lĩnh vực đang bùng nổ. Dù người dùng cuối không bị ảnh hưởng trực tiếp, các nhà phát triển và cung cấp dịch vụ AI phải đối mặt với những rủi ro đáng kể. Khi cuộc đua AI tiếp tục tăng tốc, cuộc chiến bảo vệ các mô hình trí tuệ nhân tạo sẽ ngày càng trở nên khốc liệt, đòi hỏi sự cảnh giác cao độ và đổi mới không ngừng trong cả phát triển và bảo mật AI.

Zalo Chat