Tiếng chuông cảnh tỉnh từ sự cố Meta AI: Khi trí tuệ nhân tạo bị 'thuyết phục'
Thay vào đó, giới tội phạm công nghệ đang nhắm trực tiếp vào cách hệ thống trí tuệ nhân tạo (AI) hiểu và phản hồi ngôn ngữ. Thực trạng này khiến những ranh giới an toàn tưởng chừng bất biến giữa người dùng, dữ liệu và máy móc trở nên dễ bị xáo trộn hơn bao giờ hết. Cuộc chiến chống lại các cuộc tấn công giờ đây đã biến thành một mặt trận không tiếng súng nhưng phải duy trì liên tục, nơi hacker không ngừng tinh vi hóa các kỹ thuật kỹ nghệ xã hội (social engineering) và mục tiêu mới nhất của chúng chính là bản thân các hệ thống AI.
Minh chứng rõ nét nhất cho xu hướng đáng báo động này là sự cố bảo mật vừa xảy ra với chatbot Meta AI của tập đoàn Meta. Gã khổng lồ công nghệ đã phải chạy đua với thời gian để vá một lỗ hổng nghiêm trọng cho phép kẻ tấn công can thiệp và thay đổi mật khẩu tài khoản Instagram thông qua kỹ thuật “prompt injection” (tấn công chèn câu lệnh). Về bản chất, phương thức này giống như một cú lừa ngoạn mục dựa trên kỹ nghệ xã hội, khiến AI sẵn sàng rũ bỏ mọi quy tắc, hướng dẫn ban đầu để thực hiện các hành vi đi ngược lại lợi ích của hệ thống.
Tiếng chuông cảnh tỉnh từ sự cố Meta AI: Khi trí tuệ nhân tạo bị 'thuyết phục'
Nếu như trong các vụ lừa đảo thông thường, tội phạm thường thao túng tâm lý con người bằng cách tạo ra các tình huống khẩn cấp, đe dọa pháp lý để nạn nhân mất đi khả năng tư duy logic cơ bản, thì đối với AI, cách thức tiếp cận trực tiếp hơn nhiều. Bằng cách đưa vào một prompt giả mạo lập luận rằng AI đã được giao một vai trò mới tối cao, kẻ xấu có thể vô hiệu hóa quy tắc bảo mật thông tin. Trong vụ việc của Meta AI, các hacker đã áp dụng kịch bản này để thiết lập lại mật khẩu hàng loạt tài khoản chiến lược như tài khoản Instagram cũ của Nhà Trắng thời Tổng thống Obama hay tài khoản của Lực lượng Không gian Hoa Kỳ mà hoàn toàn không cần qua bước xác thực hai yếu tố.
Quy trình thâm nhập được thực hiện tinh vi khi tin tặc sử dụng mạng riêng ảo (VPN) để giả lập vị trí truy cập gần với nạn nhân nhằm qua mặt cơ chế bảo vệ tự động của Instagram. Khi tiếp cận được trợ lý Meta AI qua kênh hỗ trợ, chúng yêu cầu chatbot thêm một địa chỉ email mới. Chatbot sau đó đã gửi mã xác minh trực tiếp đến email của tin tặc. Chỉ bằng vài thao tác nhập ngược mã và kích hoạt tùy chọn "Đặt lại mật khẩu", quyền kiểm soát tài khoản đã rơi vào tay kẻ xấu mà không cần bất kỳ sự tiếp cận nào đến số điện thoại hay email chính chủ. Thậm chí, ở một vài kịch bản khác, chatbot còn bị thao túng đến mức tự động gửi thẳng mã khôi phục mật khẩu khi được yêu cầu.
Bình luận về sự kiện này, ông T.J. Marlin, CEO của Guardrail Technologies đồng thời là chuyên gia an ninh mạng, nhận định qua email rằng các tác nhân AI hiện nay đang được trao quyền hạn như con người nhưng lại hoàn toàn thiếu đi năng lực phán đoán tương xứng. Hệ thống thực hiện lệnh đặt lại mật khẩu cho một người lạ chỉ đơn giản vì không có rào cản nào ngăn nó lại, nghĩa là nó chỉ đang làm đúng chức năng được yêu cầu. Chuyên gia này nhấn mạnh rằng cốt lõi vấn đề nằm ở việc con người đã giao phó một tác vụ rủi ro cao cho AI mà thiếu đi các bước xác minh độc lập. Thực tế, không có một hệ thống nào bị bẻ khóa theo nghĩa kỹ thuật truyền thống, mà chính AI đã bị thuyết phục, và đây là khoảng trống quản trị mà nhiều doanh nghiệp vẫn chưa nhận thức được.
Khái niệm AI bị “thuyết phục” mở ra một góc nhìn sâu sắc về việc ranh giới giữa công cụ thuần túy và hành vi nhận thức đang dần mờ đi. Các mô hình ngôn ngữ lớn, dù không có cảm xúc, vẫn bị ảnh hưởng nặng nề bởi ngữ cảnh và cấu trúc thông tin đầu vào, tương tự cách con người bị dẫn dắt bởi những lời nói sắc sảo. Khi đích đến của Thung lũng Silicon vẫn là trí tuệ nhân tạo tổng quát (AGI) với năng lực tư duy tương đương hoặc vượt trội con người, thì sự song hành giữa năng lực xử lý vượt trội và xu hướng hành vi ngày càng giống người này đang đặt ra một bài toán hóc búa. Nó buộc nhân loại phải hoài nghi và tái định nghĩa lại mức độ kiểm soát, độ tin cậy cũng như ranh giới an toàn trong kỷ nguyên máy móc đồng hành cùng cuộc sống.
Phạm Tuấn
TIN LIÊN QUAN
-
Cuộc đua kính mắt AI và tham vọng thao túng dữ liệu thời gian thực
-
Lĩnh vực xuất bản học thuật đối mặt cuộc khủng hoảng trích dẫn giả do AI tạo ra
-
Bước tiến mới của Robotics Việt: Robot hình người Dyno gây ấn tượng tại các triển lãm công nghệ toàn cầu
-
Quảng Ninh: Mở rộng hợp tác quốc tế, đưa khoa học công nghệ làm ‘đòn bẩy’ phát triển bền vững