- Khi các cuộc gọi tự động dùng giọng AI nghe như người thật ngày càng lan rộng, FCC xem chúng là các cuộc gọi “artificial” theo TCPA và đưa vào khuôn khổ quy định bảo vệ người tiêu dùng qua điện thoại hiện hành
- Declaratory Ruling lần này xác nhận rằng Telephone Consumer Protection Act (TCPA) cũng áp dụng cho các cuộc gọi sử dụng giọng người do AI tạo ra
- Quyết định của FCC được thông qua nhất trí và nhắm trực tiếp vào việc sử dụng giọng nói do AI tạo trong robocall
- Bản gốc News Release và Declaratory Ruling được công bố ở các định dạng docx, pdf, txt, cho phép xem ngay nội dung quyết định
- Âm thanh deepfake và các liên kết video khiến robocall và tin nhắn lừa đảo khó phân biệt hơn, làm tăng nhu cầu thực tiễn đối với việc quản lý giọng nói AI
Việc áp dụng TCPA cho robocall dùng giọng nói do AI tạo
- FCC đã nhất trí thông qua Declaratory Ruling công nhận rằng các cuộc gọi được tạo bằng giọng nói do AI tạo thuộc nhóm cuộc gọi “artificial” theo Telephone Consumer Protection Act (TCPA)
- Đối tượng áp dụng là các cuộc gọi được tạo bằng AI-generated voices
- Quyết định này nhắm trực tiếp vào các trường hợp sử dụng giọng nói do AI tạo trong robocall, đồng thời xác nhận rằng TCPA cũng áp dụng cho công nghệ AI tạo ra giọng người
Các tài liệu FCC đã công bố
- Bản gốc News Release
- Declaratory Ruling nêu rằng TCPA áp dụng cho công nghệ AI tạo giọng người
Hướng dẫn người tiêu dùng liên quan đến deepfake
- Deep-Fake Audio and Video Links Make Robocalls and Scam Texts Harder to Spot cho biết âm thanh deepfake và các liên kết video khiến robocall và tin nhắn lừa đảo khó nhận diện hơn
1 bình luận
Ý kiến trên Hacker News
Có lần tôi nhận cuộc gọi từ một số lạ, và một bản ghi giọng vợ tôi nói “Hello?”
Từ đó trở đi, nếu không biết người gọi là ai, tôi không nói Hello trước khi nghe điện thoại nữa
Nếu cuộc gọi hiện số thay vì tên thì tôi đơn giản là không nghe; nếu không phải spam thì họ sẽ để lại tin nhắn thoại hoặc nhắn tin
Nếu không làm cả hai, khả năng cao đó là spam/lừa đảo, hoặc ngay từ đầu cũng không phải việc gì quá quan trọng; tôi làm vậy hơn 10 năm rồi mà chưa gặp vấn đề gì
Nếu bắt máy, tôi im lặng khoảng 3–5 giây để cho người bên kia có cơ hội nói trước nếu đó không phải bot
Nghĩ theo kiểu đa nghi thì tôi nghi họ đang ghi âm giọng tôi để dùng cho AI mạo danh
Người gọi phải nói trước thì mới biết có phải người thật hay không; còn nếu là hệ thống tự động, tôi thường im lặng với hy vọng nó không nhận ra số của tôi không phải một hệ thống tự động khác
Nguyên tắc pháp lý cho phép FCC đưa ra quyết định như thế này được gọi là Chevron Deference, và có vẻ quan trọng là nguyên tắc đó hiện đang bị công kích
https://www.scotusblog.com/2024/01/supreme-court-likely-to-d...
Việc loại bỏ nó không có nghĩa là các cơ quan sẽ rơi vào tình trạng vô chính phủ kiểu Mad Max, không làm được gì; luôn có các tiêu chuẩn cho phép ban hành quy định hành chính
Phạm vi tùy nghi rộng đến đâu là chuyện khác, nhưng việc làm rõ rằng giọng nói do AI tạo ra thuộc loại “nhân tạo” theo luật thì gần như không cần quy định gì, cũng giống như nói “đánh vào đầu bằng máy tính” là “hành hung” vậy
Nguyên tắc Chevron không phải là thứ cho phép các cơ quan như FCC đưa ra quyết định kiểu này, mà là nguyên tắc bảo vệ để tòa án không lật ngược quyết định đó
Tức là ngay cả khi các thẩm phán Tối cao Pháp viện đều nghĩ riêng rằng cách diễn giải của cơ quan có vấn đề, họ vẫn phải tôn trọng; nhưng nếu không có Chevron, trong trường hợp đó họ có thể lật ngược
Trong trường hợp này, việc coi giọng nói do AI tạo ra là “nhân tạo” khi áp dụng luật rõ ràng đến mức cá nhân tôi không nghĩ nguyên tắc Chevron có cơ hội được áp dụng
Luật cấm “giọng nói nhân tạo hoặc được ghi âm trước”, và vì agent AI theo định nghĩa là nhân tạo nên có vẻ không cần sự tôn trọng riêng nào
Cơ quan nói bạn vi phạm luật, bạn kiện cơ quan đó, rồi tòa án lại nghe theo cơ quan đó
Rốt cuộc chẳng khác nào bị tước mất cơ hội tranh tụng tại tòa
Chính xác hơn, nên hiểu là FCC đã chính thức diễn giải luật hiện hành, Telephone Consumer Protection Act, và làm rõ rằng giọng nói do AI tạo ra trong robocall vi phạm luật đó; điều này có vẻ hợp lý
Lẽ ra họ nên bắt buộc gắn nhãn nhận dạng caller ID cho robocall
Ví dụ hiển thị kiểu “Police Officers Benevolent Association [Robocall]”
Apple và Google nên cung cấp robot điện thoại cá nhân như một phần của phần mềm mặc định
Khi mua điện thoại mới, bạn ghi âm nhiều câu khác nhau trong khoảng 15 phút, rồi từ đó robot sẽ nghe điện thoại thay bạn
Robot này sẽ cố giữ chân spammer hoặc telemarketer trong cuộc gọi càng lâu càng tốt
1 phút cũng tốt, 10 phút thì càng tốt hơn
Nếu spammer cố tránh nó, Apple và Google có thể cải tiến robot để đối phó
Trong vài tháng, ngành đó sẽ chết
Vì họ không đủ khả năng dành 30 phút cho mỗi cuộc gọi để phân biệt đâu là kẻ nhẹ dạ thực sự sẽ gửi tiền mặt cho hoàng tử Nigeria, đâu là phần mềm xấu đang đánh lừa nhân viên tổng đài không nói tiếng Anh bản ngữ
Biên lợi nhuận sẽ giảm, nhu cầu về AI tinh vi hơn để phân biệt người thật sẽ tăng vọt, và mô hình này sẽ trở nên không bền vững về mặt kinh tế
Ý là FCC đã nhất trí thông qua một phán quyết tuyên bố rằng các cuộc gọi dùng giọng nói do AI tạo ra thuộc loại “nhân tạo” theo TCPA
Vì vậy, theo nghĩa robocall nhân tạo vốn đã bất hợp pháp, chúng cũng là bất hợp pháp
Những tiêu đề như thế này sẽ không giúp ích cho các vụ kiện thực tế đang diễn ra
Có vẻ như đang nhắm vào triệu chứng chứ không phải bản thân vấn đề
Một trong những vấn đề lớn của robocall là gần như không thể biết ai đã gọi, và các công cụ báo cáo spam cũng không mấy hiệu quả
Khi có cuộc gọi đến, cần phải hiển thị ai là bên chịu trách nhiệm cho cuộc gọi đó
Ví dụ, hiển thị kiểu “ [số điện thoại] được đăng ký cho [cá nhân hoặc pháp nhân]”, và nếu các báo cáo spam tích lũy lại thì khả năng sử dụng mạng điện thoại của bên đó phải bị hạn chế
Spam điện thoại quá hiệu quả về mặt chính trị
Nhắm vào những trò lừa đảo như thế này là bước đầu tốt, nhưng tôi không nghĩ các nhà cung cấp ở nước ngoài sẽ ít dùng hơn
Phần lớn các cuộc gọi spam tôi nhận được còn không tuân thủ danh sách Do Not Call, vậy tại sao họ lại tuân thủ điều này?
FCC nên đặt thời hạn cứng rắn cho STIR/SHAKEN và phạt các nhà mạng không tuân thủ
Có vậy các nhà cung cấp VoIP mới xem việc này là nghiêm túc
Tôi không biết vì sao lại mất nhiều thời gian như vậy, nhưng điện thoại di động hẳn đã có thể hiển thị liệu caller ID của cuộc gọi có được xác minh hay không
Bước tiếp theo có lẽ là cứ chặn những người gọi chưa được xác minh
Tôi nghĩ còn nhiều việc migration phải làm
https://www.fcc.gov/call-authentication
Cuộc gọi đến từ T-Mobile hay từ một công ty mà bạn mới nghe lần đầu là khác nhau rất nhiều
Với quyết định này thì hệ thống IVR cũng trở thành bất hợp pháp à?
Tôi hoan nghênh nỗ lực vì có vẻ sẽ giảm được nhiều spam, nhưng tôi thắc mắc vì giọng nói do AI tạo trong các cuộc gọi điện thoại đã hiện diện khắp nơi suốt nhiều thập kỷ rồi
Có phải họ đang kẻ một ranh giới cụ thể về chất lượng giọng nói không?
Không bao gồm IVR
Cuộc gọi tự động cũng được phép nếu có sự đồng ý
Ví dụ như trường hợp bạn đăng ký nhận thông báo thuốc đã pha chế xong hoặc sách đang chờ đặt trước đã có
Không liên quan đến chất lượng giọng nói, và giọng nói ghi âm sẵn cũng thuộc đối tượng bị cấm
Thiếu lẽ thường đến mức nào mà lại biến việc dùng giọng robot thành bất hợp pháp trong khi vẫn để mặc cuộc gọi robot tiếp diễn?
Vô lý
Giọng nói “nhân tạo” trong cuộc gọi điện thoại đã tồn tại từ năm 1971
Khi đó, một công ty tên Federal Screw Works lần đầu phát triển thiết bị tổng hợp giọng nói Votrax, phần kỹ thuật do Richard Gagnon phụ trách
Làm sao có thể thực thi điều này?
Có phải họ đã cấm mọi tin nhắn thoại tự động không?
“AI” ở đây được định nghĩa thế nào?
Việc thực thi khó, nhưng thường là lần theo khiếu nại đến nhà mạng phát cuộc gọi hoặc khách hàng phát cuộc gọi, rồi đưa ra tòa
Tin nhắn thoại tự động vốn đã bị hạn chế, và quyết định lần này chỉ xác nhận rằng giọng nói do AI tạo thuộc phân loại tin nhắn thoại tự động
Một phần văn bản quyết định liên quan như sau
Và phía sau có đoạn như sau
PDF ở đây: https://docs.fcc.gov/public/attachments/FCC-24-17A1.pdf
Một số người ghi âm cuộc gọi
Doanh nghiệp thường phải ghi âm để tuân thủ quy định trong các tình huống bán hàng trực tiếp cho người tiêu dùng
Nếu có bản ghi âm, dù không dùng thuật toán, tòa án vẫn có thể dễ dàng phán đoán theo từng vụ việc xem đó có phải giọng AI hay không