SO HUU TRI TUE
Thứ bảy, 12/09/2026
  • Click để copy

ChatGPT-5.2 bị phát hiện sử dụng dữ liệu từ Grokipedia

16:55, 27/01/2026
(SHTT) - ChatGPT GPT-5.2 vừa bị phát hiện sử dụng nội dung từ Grokipedia, một bách khoa toàn thư do xAI phát triển, đáng chú ý, tất cả nội dung đều được xây dựng hoàn toàn bằng AI.

Trong loạt bài kiểm tra thực nghiệm do The Guardian tiến hành, ChatGPT phiên bản GPT-5.2 đã trích dẫn nguồn từ Grokipedia tới chín lần trong hơn 10 câu hỏi khác nhau. Điều đáng chú ý là các trích dẫn này thường xuất hiện khi người dùng truy vấn về những chủ đề ít phổ biến hoặc mang tính chuyên sâu, thay vì các kiến thức đại chúng.

image (1)

 

Cụ thể, chatbot này đã dựa vào Grokipedia để trả lời các câu hỏi phức tạp về cấu trúc chính trị tại Iran, bao gồm mức lương của lực lượng bán quân sự Basij hay quyền sở hữu của quỹ Mostazafan. Ngoài ra, tiểu sử của nhà sử học người Anh Richard Evans cũng là một nội dung được lấy từ nguồn này.Ngược lại, khi được hỏi về các sự kiện hoặc nhân vật nổi tiếng mà dữ liệu đã được xác lập rộng rãi, ChatGPT lại không sử dụng Grokipedia. Điều này cho thấy thuật toán của OpenAI dường như đang tìm đến nền tảng của Elon Musk như một giải pháp lấp đầy khoảng trống dữ liệu đối với các thông tin ngách (long-tail information), nơi mà các nguồn thống tin truyền thống có thể chưa cập nhật hoặc thiếu chi tiết.

Việc ChatGPT sử dụng dữ liệu từ Grokipedia khiến các chuyên gia về an toàn thông tin đặc biệt lo ngại. 

Theo các chuyên gia, việc “nuôi” AI bằng dữ liệu do AI tạo ra sẽ không giúp chất lượng thông tin tốt hơn, mà còn có nguy cơ suy giảm nghiêm trọng chất lượng mô hình theo thời gian. Kịch bản xấu nhất có thể khiến mô hình sụp đổ khi AI ngày càng nghèo nàn về thông tin, dễ sai lệch và dần tách khỏi thực tế. Hệ quả cuối cùng vẫn là rủi ro gia tăng cho những người dùng AI như một công cụ nghiên cứu hoặc tham khảo tri thức.

Căn nguyên của vấn đề nằm ở điểm yếu cố hữu: AI có xu hướng “ảo giác”, nghĩa là bịa ra những thông tin có vẻ hợp lý nhưng hoàn toàn sai.

Trước các bằng chứng từ The Guardian, OpenAI đã đưa ra phản hồi chính thức. Công ty cho biết ChatGPT thu thập thông tin từ nhiều nguồn dữ liệu và quan điểm công khai khác nhau, đồng thời khẳng định hệ thống luôn áp dụng các bộ lọc an toàn để giảm thiểu nội dung gây hại hoặc có độ tin cậy thấp. Tuy nhiên, đại diện OpenAI không giải thích cụ thể lý do tại sao thuật toán của họ lại đánh giá Grokipedia là một nguồn tin đủ uy tín để trích dẫn.

TH

Tin khác

Khoa học Công nghệ 12 giờ trước
(SHTT) - Thị trường ô tô điện cỡ nhỏ tại Trung Quốc vừa ghi nhận thêm sự xuất hiện của dòng xe JMEV EV2 2027 với hai biến thể thương mại. Mẫu xe đô thị này được niêm yết mức giá 41.900 Nhân dân tệ (khoảng 161,93 triệu đồng) cho bản tiêu chuẩn và 44.900 Nhân dân tệ (khoảng 173,53 triệu đồng) đối với phiên bản cao cấp hơn.
Khoa học Công nghệ 12 giờ trước
(SHTT) - Hệ thống thông tin quốc gia về khoa học, công nghệ và đổi mới sáng tạo đã chính thức vận hành tại địa chỉ https://sti.gov.vn. Bước đi này nhằm giải quyết yêu cầu về hạ tầng dữ liệu tập trung, hỗ trợ công tác quản lý nhà nước, nghiên cứu và thúc đẩy đổi mới sáng tạo trên phạm vi toàn quốc, đồng thời đóng vai trò là nền tảng số dùng chung quan trọng.
Khoa học Công nghệ 12 giờ trước
(SHTT) - Tập đoàn công nghệ Xiaomi vừa chính thức trình làng bộ pin xe điện thế hệ mới mang tên Longjia (được gọi là Dragonscale hay "vảy rồng" tại các thị trường quốc tế).
Khoa học Công nghệ 16 giờ trước
(SHTT) - Hai báo cáo mới của GSMA tại Hội nghị M360 ASEAN Digital Trust nhấn mạnh vai trò quan trọng của niềm tin số trong việc hiện thực hóa các mục tiêu số của ASEAN, đồng thời kêu gọi tăng cường phối hợp giữa các bên nhằm củng cố niềm tin trong các tương tác số.
Khoa học Công nghệ 1 ngày trước
(SHTT) - Phòng Cảnh sát giao thông Công an tỉnh Thanh Hóa đã chính thức ra mắt mô hình “Thông điệp số, đường phố an toàn”, ứng dụng nền tảng số, mã QR và nội dung trực quan để đưa pháp luật, kỹ năng tham gia giao thông đến gần hơn với người dân.