SO HUU TRI TUE
Thứ hai, 20/07/2026
  • Click để copy

Tiếng chuông cảnh tỉnh từ sự cố Meta AI: Khi trí tuệ nhân tạo bị 'thuyết phục'

06:52, 07/06/2026
(SHTT) - Giai đoạn hiện nay đang chứng kiến một bước chuyển dịch đáng ngại trong bức tranh an ninh mạng toàn cầu. Các cuộc tấn công không còn đơn thuần dừng lại ở việc dò tìm lỗi code hay khai thác lỗ hổng kỹ thuật truyền thống.

Thay vào đó, giới tội phạm công nghệ đang nhắm trực tiếp vào cách hệ thống trí tuệ nhân tạo (AI) hiểu và phản hồi ngôn ngữ. Thực trạng này khiến những ranh giới an toàn tưởng chừng bất biến giữa người dùng, dữ liệu và máy móc trở nên dễ bị xáo trộn hơn bao giờ hết. Cuộc chiến chống lại các cuộc tấn công giờ đây đã biến thành một mặt trận không tiếng súng nhưng phải duy trì liên tục, nơi hacker không ngừng tinh vi hóa các kỹ thuật kỹ nghệ xã hội (social engineering) và mục tiêu mới nhất của chúng chính là bản thân các hệ thống AI.

Minh chứng rõ nét nhất cho xu hướng đáng báo động này là sự cố bảo mật vừa xảy ra với chatbot Meta AI của tập đoàn Meta. Gã khổng lồ công nghệ đã phải chạy đua với thời gian để vá một lỗ hổng nghiêm trọng cho phép kẻ tấn công can thiệp và thay đổi mật khẩu tài khoản Instagram thông qua kỹ thuật “prompt injection” (tấn công chèn câu lệnh). Về bản chất, phương thức này giống như một cú lừa ngoạn mục dựa trên kỹ nghệ xã hội, khiến AI sẵn sàng rũ bỏ mọi quy tắc, hướng dẫn ban đầu để thực hiện các hành vi đi ngược lại lợi ích của hệ thống.

meta ai

Tiếng chuông cảnh tỉnh từ sự cố Meta AI: Khi trí tuệ nhân tạo bị 'thuyết phục' 

Nếu như trong các vụ lừa đảo thông thường, tội phạm thường thao túng tâm lý con người bằng cách tạo ra các tình huống khẩn cấp, đe dọa pháp lý để nạn nhân mất đi khả năng tư duy logic cơ bản, thì đối với AI, cách thức tiếp cận trực tiếp hơn nhiều. Bằng cách đưa vào một prompt giả mạo lập luận rằng AI đã được giao một vai trò mới tối cao, kẻ xấu có thể vô hiệu hóa quy tắc bảo mật thông tin. Trong vụ việc của Meta AI, các hacker đã áp dụng kịch bản này để thiết lập lại mật khẩu hàng loạt tài khoản chiến lược như tài khoản Instagram cũ của Nhà Trắng thời Tổng thống Obama hay tài khoản của Lực lượng Không gian Hoa Kỳ mà hoàn toàn không cần qua bước xác thực hai yếu tố.

Quy trình thâm nhập được thực hiện tinh vi khi tin tặc sử dụng mạng riêng ảo (VPN) để giả lập vị trí truy cập gần với nạn nhân nhằm qua mặt cơ chế bảo vệ tự động của Instagram. Khi tiếp cận được trợ lý Meta AI qua kênh hỗ trợ, chúng yêu cầu chatbot thêm một địa chỉ email mới. Chatbot sau đó đã gửi mã xác minh trực tiếp đến email của tin tặc. Chỉ bằng vài thao tác nhập ngược mã và kích hoạt tùy chọn "Đặt lại mật khẩu", quyền kiểm soát tài khoản đã rơi vào tay kẻ xấu mà không cần bất kỳ sự tiếp cận nào đến số điện thoại hay email chính chủ. Thậm chí, ở một vài kịch bản khác, chatbot còn bị thao túng đến mức tự động gửi thẳng mã khôi phục mật khẩu khi được yêu cầu.

Bình luận về sự kiện này, ông T.J. Marlin, CEO của Guardrail Technologies đồng thời là chuyên gia an ninh mạng, nhận định qua email rằng các tác nhân AI hiện nay đang được trao quyền hạn như con người nhưng lại hoàn toàn thiếu đi năng lực phán đoán tương xứng. Hệ thống thực hiện lệnh đặt lại mật khẩu cho một người lạ chỉ đơn giản vì không có rào cản nào ngăn nó lại, nghĩa là nó chỉ đang làm đúng chức năng được yêu cầu. Chuyên gia này nhấn mạnh rằng cốt lõi vấn đề nằm ở việc con người đã giao phó một tác vụ rủi ro cao cho AI mà thiếu đi các bước xác minh độc lập. Thực tế, không có một hệ thống nào bị bẻ khóa theo nghĩa kỹ thuật truyền thống, mà chính AI đã bị thuyết phục, và đây là khoảng trống quản trị mà nhiều doanh nghiệp vẫn chưa nhận thức được.

Khái niệm AI bị “thuyết phục” mở ra một góc nhìn sâu sắc về việc ranh giới giữa công cụ thuần túy và hành vi nhận thức đang dần mờ đi. Các mô hình ngôn ngữ lớn, dù không có cảm xúc, vẫn bị ảnh hưởng nặng nề bởi ngữ cảnh và cấu trúc thông tin đầu vào, tương tự cách con người bị dẫn dắt bởi những lời nói sắc sảo. Khi đích đến của Thung lũng Silicon vẫn là trí tuệ nhân tạo tổng quát (AGI) với năng lực tư duy tương đương hoặc vượt trội con người, thì sự song hành giữa năng lực xử lý vượt trội và xu hướng hành vi ngày càng giống người này đang đặt ra một bài toán hóc búa. Nó buộc nhân loại phải hoài nghi và tái định nghĩa lại mức độ kiểm soát, độ tin cậy cũng như ranh giới an toàn trong kỷ nguyên máy móc đồng hành cùng cuộc sống.

Phạm Tuấn

Tin khác

Khoa học Công nghệ 1 giờ trước
(SHTT) - Ngày 19/7, Trường Đại học Công nghệ Thông tin và Truyền thông Việt - Hàn (VKU), Đại học Đà Nẵng cho biết vừa tổ chức Diễn đàn Kết nối và Phát triển mạng lưới cộng đồng lãnh đạo, học giả các trường đại học Đông Nam Á và quốc tế lần thứ 4 (ACIR+ 2026) tại TP Hạ Long, tỉnh Quảng Ninh.
Khoa học Công nghệ 16 giờ trước
(SHTT) - Sự phát triển của công nghệ và áp lực giảm phát thải đang thúc đẩy các doanh nghiệp logistics tại châu Âu chuyển đổi mạnh mẽ từ xe tải chạy dầu diesel sang phương tiện chạy điện.
Khoa học Công nghệ 21 giờ trước
(SHTT) - Hơn 540.000 ô tô Subaru hiện đang bị triệu hồi tại thị trường Mỹ sau khi phát hiện lỗi thông tin trên nhãn dán. Lỗi này không ảnh hưởng đến khả năng vận hành của phương tiện và khó có khả năng gây mất an toàn cho người sử dụng.
Khoa học Công nghệ 21 giờ trước
(SHTT) - Các học sinh Việt Nam tham dự hai kỳ Olympic Hóa học năm 2026 đã xuất sắc giành 4 huy chương vàng (HCV), qua đó giúp Việt Nam xếp đồng hạng Nhất về số Huy chương Vàng cùng Trung Quốc và Ấn Độ.
Khoa học Công nghệ 1 ngày trước
(SHTT) - Công tố viên thành phố San Francisco David Chiu vừa yêu cầu Apple và Google chấm dứt việc phân phối loạt ứng dụng "nudify" trên App Store và Google Play. Các ứng dụng này sử dụng trí tuệ nhân tạo (AI) để tạo ra hình ảnh khỏa thân giả từ ảnh người mặc quần áo, đe dọa nghiêm trọng đến quyền riêng tư.