Loạt nhà báo đệ đơn kiện Google sử dụng giọng nói huấn luyện AI trái phép
Một nhóm nhà báo đoạt giải thưởng, người dẫn podcast và nghệ sĩ đọc sách nói đã đệ đơn kiện Google tại tòa án liên bang bang Illinois, Mỹ, với cáo buộc tập đoàn công nghệ này sử dụng trái phép hàng nghìn giờ ghi âm giọng nói để huấn luyện các mô hình AI phục vụ cho Google Assistant, Gemini Live và nhiều hệ thống tái tạo giọng nói khác.
Theo đơn kiện tập thể được nộp hôm 19/5, các nguyên đơn cho rằng Google đã thu thập các bản ghi âm trên Internet mà không xin phép chủ sở hữu, nhằm phát triển các mô hình giọng nói AI thương mại. Nhóm nguyên đơn bao gồm nhà báo nổi tiếng tại Chicago Carol Marin, các podcaster từng đoạt giải Pulitzer như Yohance Lacour và Alison Flowers.
Đơn kiện cáo buộc Google vi phạm quyền công khai hình ảnh cá nhân và quyền riêng tư dữ liệu sinh trắc học theo luật bang Illinois. Các nguyên đơn yêu cầu bồi thường thiệt hại bằng tiền nhưng chưa công bố con số cụ thể.
Theo nội dung hồ sơ, các bản ghi âm của nguyên đơn có đặc điểm phù hợp với loại dữ liệu mà tài liệu kỹ thuật của Google đánh giá là tối ưu để huấn luyện AI giọng nói, gồm nội dung dài, chỉ có một người nói, chất lượng phòng thu chuyên nghiệp.
Vụ kiện này nằm trong làn sóng hàng chục vụ kiện nhằm vào các công ty công nghệ liên quan đến việc sử dụng tác phẩm, dữ liệu hoặc nội dung của cá nhân để huấn luyện AI mà chưa được cho phép.
Trước đó, cựu dẫn chương trình NPR David Greene cũng đã kiện Google tại California hồi tháng 1/2026 với cáo buộc tương tự. Một nhóm diễn viên lồng tiếng khác cũng đang theo đuổi vụ kiện đối với startup AI tạo giọng nói Lovo tại New York.
Ngoài Google, loạt đơn kiện mới được nộp tại tòa án liên bang Chicago còn nhắm đến nhiều “ông lớn” công nghệ như Amazon, Apple, Microsoft, Meta, Adobe, Samsung, công ty AI giọng nói ElevenLabs và nhà sản xuất chip NVIDIA.
Các nguyên đơn cho rằng những công ty này đã “đánh cắp” giọng nói để xây dựng các mô hình nền tảng AI giọng nói. Luật sư Ross Kimbarovsky thuộc hãng luật Loevy & Loevy nhận định đây là “một trong những vụ vi phạm quyền riêng tư sinh trắc học lớn nhất từng xảy ra”.
Trọng tâm của các vụ kiện là Đạo luật Bảo mật Thông tin Sinh trắc học Illinois (BIPA), được xem là một trong những đạo luật nghiêm ngặt nhất nước Mỹ về bảo vệ dữ liệu sinh trắc học. Theo luật này, doanh nghiệp phải có sự đồng ý bằng văn bản trước khi thu thập dữ liệu sinh trắc học như dấu vân tay, khuôn mặt hoặc giọng nói.
Các đơn kiện lập luận rằng dấu giọng nói kỹ thuật số (voiceprint) có tính nhận diện cá nhân tương tự dấu vân tay. Voiceprint được mô tả là biểu diễn toán học của giọng nói, bao gồm cao độ, âm sắc, độ vang cùng các đặc điểm phát âm hình thành trong suốt cuộc đời mỗi người.
Nguyên đơn cho rằng, khác với mật khẩu hay số an sinh xã hội có thể thay đổi, giọng nói là đặc điểm sinh học không thể thay thế nếu bị đánh cắp hoặc sử dụng trái phép.
Giới chuyên gia nhận định các vụ kiện liên quan đến voiceprint có thể mở ra hướng tranh tụng mới theo BIPA, đặc biệt trong bối cảnh công nghệ AI phát triển nhanh chóng và nhu cầu dữ liệu giọng nói ngày càng tăng.
Quỳnh Trang
TIN LIÊN QUAN
-
Loạt doanh nghiệp lớn bị tố vi phạm bản quyền nhiều bản nhạc kinh điển gắn với nhân vật hoạt hình Snoopy
-
Triệt phá 'đế chế' phát lậu CakhiaTV, RakhoiTV: Chiêu trò tinh vi và lời cảnh tỉnh cho cử nhân công nghệ
-
Cân bằng giữa bảo hộ bản quyền và không gian sáng tạo
-
Hà Nội: Thu hồi thuốc nhỏ mắt và thực phẩm chức năng bổ não không đảm bảo chất lượng