1 điểm bởi GN⁺ 2024-02-09 | 1 bình luận | Chia sẻ qua WhatsApp
  • Khi các cuộc gọi tự động dùng giọng AI nghe như người thật ngày càng lan rộng, FCC xem chúng là các cuộc gọi “artificial” theo TCPA và đưa vào khuôn khổ quy định bảo vệ người tiêu dùng qua điện thoại hiện hành
  • Declaratory Ruling lần này xác nhận rằng Telephone Consumer Protection Act (TCPA) cũng áp dụng cho các cuộc gọi sử dụng giọng người do AI tạo ra
  • Quyết định của FCC được thông qua nhất trí và nhắm trực tiếp vào việc sử dụng giọng nói do AI tạo trong robocall
  • Bản gốc News Release và Declaratory Ruling được công bố ở các định dạng docx, pdf, txt, cho phép xem ngay nội dung quyết định
  • Âm thanh deepfake và các liên kết video khiến robocall và tin nhắn lừa đảo khó phân biệt hơn, làm tăng nhu cầu thực tiễn đối với việc quản lý giọng nói AI

Việc áp dụng TCPA cho robocall dùng giọng nói do AI tạo

  • FCC đã nhất trí thông qua Declaratory Ruling công nhận rằng các cuộc gọi được tạo bằng giọng nói do AI tạo thuộc nhóm cuộc gọi “artificial” theo Telephone Consumer Protection Act (TCPA)
  • Đối tượng áp dụng là các cuộc gọi được tạo bằng AI-generated voices
  • Quyết định này nhắm trực tiếp vào các trường hợp sử dụng giọng nói do AI tạo trong robocall, đồng thời xác nhận rằng TCPA cũng áp dụng cho công nghệ AI tạo ra giọng người

Các tài liệu FCC đã công bố

Hướng dẫn người tiêu dùng liên quan đến deepfake

1 bình luận

 
GN⁺ 2024-02-09
Ý kiến trên Hacker News
  • Có lần tôi nhận cuộc gọi từ một số lạ, và một bản ghi giọng vợ tôi nói “Hello?”
    Từ đó trở đi, nếu không biết người gọi là ai, tôi không nói Hello trước khi nghe điện thoại nữa

    • Tiến thêm một bước nữa, để giảm sự khó xử và nhận nhầm, tôi lưu tất cả những người quen vào danh bạ điện thoại
      Nếu cuộc gọi hiện số thay vì tên thì tôi đơn giản là không nghe; nếu không phải spam thì họ sẽ để lại tin nhắn thoại hoặc nhắn tin
      Nếu không làm cả hai, khả năng cao đó là spam/lừa đảo, hoặc ngay từ đầu cũng không phải việc gì quá quan trọng; tôi làm vậy hơn 10 năm rồi mà chưa gặp vấn đề gì
    • Dù hiếm khi phải nghe điện thoại, tôi không cung cấp bất kỳ thông tin nào
      Nếu bắt máy, tôi im lặng khoảng 3–5 giây để cho người bên kia có cơ hội nói trước nếu đó không phải bot
    • Tôi đang nhận những cuộc gọi mà không ai nói gì khoảng 3 phút rồi mới có ai đó nói Hello
      Nghĩ theo kiểu đa nghi thì tôi nghi họ đang ghi âm giọng tôi để dùng cho AI mạo danh
    • Tôi thấy có lỗi vì phá vỡ phép lịch sự khi gọi điện, nhưng tôi cũng nghĩ như vậy
      Người gọi phải nói trước thì mới biết có phải người thật hay không; còn nếu là hệ thống tự động, tôi thường im lặng với hy vọng nó không nhận ra số của tôi không phải một hệ thống tự động khác
  • Nguyên tắc pháp lý cho phép FCC đưa ra quyết định như thế này được gọi là Chevron Deference, và có vẻ quan trọng là nguyên tắc đó hiện đang bị công kích
    https://www.scotusblog.com/2024/01/supreme-court-likely-to-d...

    • Chủ đề này đang hiểu sai khá nhiều về Chevron Deference
      Việc loại bỏ nó không có nghĩa là các cơ quan sẽ rơi vào tình trạng vô chính phủ kiểu Mad Max, không làm được gì; luôn có các tiêu chuẩn cho phép ban hành quy định hành chính
      Phạm vi tùy nghi rộng đến đâu là chuyện khác, nhưng việc làm rõ rằng giọng nói do AI tạo ra thuộc loại “nhân tạo” theo luật thì gần như không cần quy định gì, cũng giống như nói “đánh vào đầu bằng máy tính” là “hành hung” vậy
    • Tôi chỉ đọc phần được liên kết, nhưng lời giải thích đó có vẻ hơi sai
      Nguyên tắc Chevron không phải là thứ cho phép các cơ quan như FCC đưa ra quyết định kiểu này, mà là nguyên tắc bảo vệ để tòa án không lật ngược quyết định đó
      Tức là ngay cả khi các thẩm phán Tối cao Pháp viện đều nghĩ riêng rằng cách diễn giải của cơ quan có vấn đề, họ vẫn phải tôn trọng; nhưng nếu không có Chevron, trong trường hợp đó họ có thể lật ngược
      Trong trường hợp này, việc coi giọng nói do AI tạo ra là “nhân tạo” khi áp dụng luật rõ ràng đến mức cá nhân tôi không nghĩ nguyên tắc Chevron có cơ hội được áp dụng
    • Tôi đồng ý rằng Chevron Deference là quan trọng, nhưng trong quyết định này, tôi không nghĩ tòa án nào sẽ đi đến bước thứ hai của Chevron
      Luật cấm “giọng nói nhân tạo hoặc được ghi âm trước”, và vì agent AI theo định nghĩa là nhân tạo nên có vẻ không cần sự tôn trọng riêng nào
    • Nhìn bề ngoài thì Chevron cũng đã vô lý rồi
      Cơ quan nói bạn vi phạm luật, bạn kiện cơ quan đó, rồi tòa án lại nghe theo cơ quan đó
      Rốt cuộc chẳng khác nào bị tước mất cơ hội tranh tụng tại tòa
    • Tôi lo rằng trong thời đại thay đổi nhanh như hiện nay, chúng ta sẽ rơi vào tình trạng việc nhỏ nào cũng phải chờ lập pháp rõ ràng
  • Chính xác hơn, nên hiểu là FCC đã chính thức diễn giải luật hiện hành, Telephone Consumer Protection Act, và làm rõ rằng giọng nói do AI tạo ra trong robocall vi phạm luật đó; điều này có vẻ hợp lý

    • Tiêu đề nên là “FCC phán quyết giọng nói do AI tạo ra trong robocall là bất hợp pháp”
    • Quyết định này sẽ chấm dứt nhiều doanh nghiệp và startup, bao gồm cả startup do các nhà sáng lập Stanford lập ra
    • Tôi không biết thẩm quyền của FCC trong việc tạo ra án lệ pháp lý đến từ đâu
  • Lẽ ra họ nên bắt buộc gắn nhãn nhận dạng caller ID cho robocall
    Ví dụ hiển thị kiểu “Police Officers Benevolent Association [Robocall]”

    • Để làm vậy thì đúng nghĩa là phải nâng cấp 50–70 năm hạ tầng viễn thông đã được triển khai trên toàn quốc, và chuyện đó sẽ không xảy ra
    • Việc cần làm là một chuyện hoàn toàn khác
      Apple và Google nên cung cấp robot điện thoại cá nhân như một phần của phần mềm mặc định
      Khi mua điện thoại mới, bạn ghi âm nhiều câu khác nhau trong khoảng 15 phút, rồi từ đó robot sẽ nghe điện thoại thay bạn
      Robot này sẽ cố giữ chân spammer hoặc telemarketer trong cuộc gọi càng lâu càng tốt
      1 phút cũng tốt, 10 phút thì càng tốt hơn
      Nếu spammer cố tránh nó, Apple và Google có thể cải tiến robot để đối phó
      Trong vài tháng, ngành đó sẽ chết
      Vì họ không đủ khả năng dành 30 phút cho mỗi cuộc gọi để phân biệt đâu là kẻ nhẹ dạ thực sự sẽ gửi tiền mặt cho hoàng tử Nigeria, đâu là phần mềm xấu đang đánh lừa nhân viên tổng đài không nói tiếng Anh bản ngữ
      Biên lợi nhuận sẽ giảm, nhu cầu về AI tinh vi hơn để phân biệt người thật sẽ tăng vọt, và mô hình này sẽ trở nên không bền vững về mặt kinh tế
    • “Họ” là ai, và làm sao biết cuộc gọi nào hợp pháp hay không?
  • Ý là FCC đã nhất trí thông qua một phán quyết tuyên bố rằng các cuộc gọi dùng giọng nói do AI tạo ra thuộc loại “nhân tạo” theo TCPA
    Vì vậy, theo nghĩa robocall nhân tạo vốn đã bất hợp pháp, chúng cũng là bất hợp pháp

    • Cuộc gọi lừa đảo cũng đã bất hợp pháp rồi, nhưng cũng giống như chẳng có biện pháp gì đáng kể
    • Tôi không nghĩ FCC có thể biến thứ gì đó thành bất hợp pháp
      Những tiêu đề như thế này sẽ không giúp ích cho các vụ kiện thực tế đang diễn ra
    • “FCC công bố rằng giọng nói nhân tạo thực ra là giọng nói nhân tạo
  • Có vẻ như đang nhắm vào triệu chứng chứ không phải bản thân vấn đề
    Một trong những vấn đề lớn của robocall là gần như không thể biết ai đã gọi, và các công cụ báo cáo spam cũng không mấy hiệu quả
    Khi có cuộc gọi đến, cần phải hiển thị ai là bên chịu trách nhiệm cho cuộc gọi đó
    Ví dụ, hiển thị kiểu “ [số điện thoại] được đăng ký cho [cá nhân hoặc pháp nhân]”, và nếu các báo cáo spam tích lũy lại thì khả năng sử dụng mạng điện thoại của bên đó phải bị hạn chế

    • Chừng nào hơn 1% cử tri Pennsylvania còn tiếp tục bỏ phiếu dựa trên người cuối cùng nói chuyện với họ, và các Super PAC còn tiếp tục nhận tiền ẩn danh không giới hạn, thì sẽ không có kênh truyền thông nào bị hạn chế về mặt pháp lý trong việc spam mọi người
      Spam điện thoại quá hiệu quả về mặt chính trị
    • Tôi cũng nghĩ vậy
      Nhắm vào những trò lừa đảo như thế này là bước đầu tốt, nhưng tôi không nghĩ các nhà cung cấp ở nước ngoài sẽ ít dùng hơn
      Phần lớn các cuộc gọi spam tôi nhận được còn không tuân thủ danh sách Do Not Call, vậy tại sao họ lại tuân thủ điều này?
      FCC nên đặt thời hạn cứng rắn cho STIR/SHAKEN và phạt các nhà mạng không tuân thủ
      Có vậy các nhà cung cấp VoIP mới xem việc này là nghiêm túc
    • Về dài hạn, tôi hiểu SHAKEN/STIR là thứ nhằm giải quyết vấn đề này
      Tôi không biết vì sao lại mất nhiều thời gian như vậy, nhưng điện thoại di động hẳn đã có thể hiển thị liệu caller ID của cuộc gọi có được xác minh hay không
      Bước tiếp theo có lẽ là cứ chặn những người gọi chưa được xác minh
      Tôi nghĩ còn nhiều việc migration phải làm
      https://www.fcc.gov/call-authentication
    • Việc tra cứu nhà mạng của một số điện thoại hiện đã khả thi, và sẽ tốt nếu hiển thị nhà mạng đó bên dưới vị trí trên màn hình nhận cuộc gọi
      Cuộc gọi đến từ T-Mobile hay từ một công ty mà bạn mới nghe lần đầu là khác nhau rất nhiều
    • Điều này có lẽ hoàn toàn trái ngược với góc nhìn về quyền riêng tư mà nhiều người trên nền tảng này có
  • Với quyết định này thì hệ thống IVR cũng trở thành bất hợp pháp à?
    Tôi hoan nghênh nỗ lực vì có vẻ sẽ giảm được nhiều spam, nhưng tôi thắc mắc vì giọng nói do AI tạo trong các cuộc gọi điện thoại đã hiện diện khắp nơi suốt nhiều thập kỷ rồi
    Có phải họ đang kẻ một ranh giới cụ thể về chất lượng giọng nói không?

    • Quyết định này cụ thể chỉ áp dụng cho chủ thể thực hiện cuộc gọi
      Không bao gồm IVR
      Cuộc gọi tự động cũng được phép nếu có sự đồng ý
      Ví dụ như trường hợp bạn đăng ký nhận thông báo thuốc đã pha chế xong hoặc sách đang chờ đặt trước đã có
      Không liên quan đến chất lượng giọng nói, và giọng nói ghi âm sẵn cũng thuộc đối tượng bị cấm
  • Thiếu lẽ thường đến mức nào mà lại biến việc dùng giọng robot thành bất hợp pháp trong khi vẫn để mặc cuộc gọi robot tiếp diễn?
    Vô lý

    • Quyết định này nhằm đối xử các cuộc gọi có giọng nói do AI tạo giống như những robocall khác vốn đã bất hợp pháp
  • Giọng nói “nhân tạo” trong cuộc gọi điện thoại đã tồn tại từ năm 1971
    Khi đó, một công ty tên Federal Screw Works lần đầu phát triển thiết bị tổng hợp giọng nói Votrax, phần kỹ thuật do Richard Gagnon phụ trách

  • Làm sao có thể thực thi điều này?
    Có phải họ đã cấm mọi tin nhắn thoại tự động không?
    “AI” ở đây được định nghĩa thế nào?

    • Việc thực thi khó, nhưng thường là lần theo khiếu nại đến nhà mạng phát cuộc gọi hoặc khách hàng phát cuộc gọi, rồi đưa ra tòa
      Tin nhắn thoại tự động vốn đã bị hạn chế, và quyết định lần này chỉ xác nhận rằng giọng nói do AI tạo thuộc phân loại tin nhắn thoại tự động
      Một phần văn bản quyết định liên quan như sau

      II. BACKGROUND
      3. The TCPA protects consumers from unwanted calls made using an artificial or prerecorded voice. See 47 U.S.C. § 227(b)(1).
      In relevant part, the TCPA prohibits initiating “any telephone call to any residential telephone line using an artificial or prerecorded voice to deliver a message without the prior express consent of the called party” unless a statutory exception applies or the call is “exempted by rule or order by the Commission under [section 227(b)(2)(B)].” 47 U.S.C. § 227(b)(1)(B). The TCPA does not define the terms “artificial” or “prerecorded voice.”

      Và phía sau có đoạn như sau

      III. DISCUSSION
      5. Consistent with our statements in the AI NOI, we confirm that the TCPA’s restrictions on the use of “artificial or prerecorded voice” encompass current AI technologies that resemble human voices and/or generate call content using a prerecorded voice.

    • PDF ở đây: https://docs.fcc.gov/public/attachments/FCC-24-17A1.pdf

    • Một số người ghi âm cuộc gọi
      Doanh nghiệp thường phải ghi âm để tuân thủ quy định trong các tình huống bán hàng trực tiếp cho người tiêu dùng
      Nếu có bản ghi âm, dù không dùng thuật toán, tòa án vẫn có thể dễ dàng phán đoán theo từng vụ việc xem đó có phải giọng AI hay không