1 điểm bởi GN⁺ 2023-06-29 | 1 bình luận | Chia sẻ qua WhatsApp
  • Tại phiên điều trần của Ủy ban Khoa học Hạ viện Mỹ, CEO Hugging Face Clement Delangue nhấn mạnh rằng khoa học mở và AI mã nguồn mở rất phù hợp với các giá trị và lợi ích của Mỹ
  • Delangue cho rằng các công cụ mã nguồn mở xuất phát từ Mỹ như PyTorch, Tensorflow, Keras, transformers, diffusers đã hỗ trợ sự phát triển của AI và vị thế dẫn đầu của Mỹ
  • Lời chứng này được đưa ra 2 tuần sau khi các thượng nghị sĩ chất vấn về khả năng bị lạm dụng như spam, lừa đảo, mã độc, xâm phạm quyền riêng tư và quấy rối sau vụ rò rỉ LLaMA của Meta
  • Ông giải thích rằng tính mở có đạo đức trao cho xã hội dân sự, tổ chức phi lợi nhuận, giới học thuật và các nhà hoạch định chính sách năng lực để kiềm chế các tập đoàn tư nhân lớn và giảm bớt các hệ thống hộp đen
  • Hugging Face muốn kết hợp tính mở với các biện pháp an toàn thông qua model card, giới hạn truy cập, phát hành theo từng giai đoạn, điều phối cộng đồng và bộ dữ liệu opt-in/opt-out

Bảo vệ AI mã nguồn mở tại phiên điều trần của Hạ viện Mỹ

  • CEO Hugging Face Clement Delangue đã điều trần tại phiên điều trần toàn thể của Ủy ban Khoa học Hạ viện Mỹ Artificial Intelligence: Advancing Innovation Towards the National Interest
  • Cùng tham gia phiên điều trần còn có CEO RAND Corporation Jason Matheny, general partner của Lux Capital Shahin Farshchi, fellow về AI có trách nhiệm của Harvard University Rumman Chowdhury và giám đốc điều hành của Georgetown University Center for Security and Emerging Technology Dewey Murdick
  • Delangue cho rằng những tiến bộ gần đây của AI có được là nhờ khoa học mở và mã nguồn mở
    • PyTorch, Tensorflow, Keras, transformers, diffusers được nêu là các công nghệ mã nguồn mở được tạo ra tại Mỹ
    • Ông phát biểu rằng nếu không có những công nghệ này, có thể Mỹ đã không phải là quốc gia dẫn đầu về AI

Tính mở có đạo đức được nêu ra giữa tranh cãi về LLaMA

  • Lời chứng của Delangue được đưa ra 2 tuần sau khi các thượng nghị sĩ chất vấn Mark Zuckerberg về vụ rò rỉ LLaMA, LLM mã nguồn mở của Meta
    • Bức thư liên quan bày tỏ lo ngại rằng LLaMA có thể bị dùng cho spam, lừa đảo, mã độc, xâm phạm quyền riêng tư, quấy rối và các hành vi sai trái hay gây hại khác
    • Sự lan rộng của LLaMA đã làm tăng mạnh mức độ tinh vi của các mô hình AI mà công chúng phổ thông có thể tiếp cận, đồng thời cũng làm gia tăng lo ngại về khả năng bị dùng sai hoặc lạm dụng
  • Hugging Face là một startup có trụ sở tại New York, năm ngoái được định giá 2 tỷ USD và đã trở thành trung tâm cho mã nguồn mở và các mô hình
    • Tháng 4, Delangue đã thu hút hơn 5.000 người tới một buổi meetup công nghệ mã nguồn mở tại Exploratorium ở San Francisco
  • Delangue nói rằng khoa học mở và mã nguồn mở đang thúc đẩy hàng chục nghìn startup ứng dụng AI
  • Tính mở có đạo đức cung cấp cho xã hội dân sự, tổ chức phi lợi nhuận, giới học thuật và các nhà hoạch định chính sách năng lực cần thiết để kiềm chế sức mạnh của các tập đoàn tư nhân lớn
    • Ngăn chặn các hệ thống hộp đen và tăng trách nhiệm giải trình của doanh nghiệp
    • Có thể giúp giảm thiên lệch, giảm thông tin sai lệch, tăng cường bản quyền và hỗ trợ bồi đắp lợi ích cho các bên liên quan gồm nghệ sĩ và nhà sáng tạo nội dung
  • Cách tiếp cận của Hugging Face kết hợp chính sách thể chế, các biện pháp an toàn kỹ thuật và động lực cộng đồng
    • Bao gồm tài liệu hóa và model card, gồm cả model cards do Dr. Margaret Mitchell khởi xướng
    • Sử dụng giới hạn quyền truy cập vào artifact và phát hành theo từng giai đoạn như các biện pháp an toàn kỹ thuật
    • Điều phối cộng đồng và các bộ dữ liệu opt-in/opt-out cũng nằm trong cấu trúc động lực đó
  • Trong vài tháng gần đây, khi các đợt phát hành mô hình ngôn ngữ lớn liên tiếp xuất hiện và startup, các nhóm cùng giới học thuật phản đối xu hướng chuyển sang các LLM đóng và độc quyền, tranh luận về AI mã nguồn mở càng trở nên nóng hơn

1 bình luận

 
GN⁺ 2023-06-29
Ý kiến trên Hacker News
  • Đây là một mô hình thu nhỏ hoàn hảo cho thấy cách hệ thống vận hành. Người này nói đúng, nhưng đã lên tiếng quá muộn, thiếu tiền và cũng không nhận được đủ sự chú ý
    Trong khi đó, Sam Altman là gương mặt đại diện cho một sản phẩm tiêu dùng với đội ngũ marketing xuất sắc, thậm chí còn có cả các nhà vận động hành lang, nhận hàng tỷ đô la từ Microsoft, và có một sản phẩm mà ai cũng có thể dùng thử miễn phí
    Chỉ cần đi trước, rao giảng về rủi ro AI, rồi thuyết phục các nghị sĩ rằng công nghệ mới nhất là nguy hiểm. OpenAI sớm được xem gần như đồng nghĩa với công nghệ tiên tiến nhất, nên mọi người cứ đi theo người dẫn đầu ngành mà không thực sự nhìn xem họ đang hướng đến đâu, và cuối cùng chúng ta đi tới tình cảnh này
    Tôi ước phần mềm mã nguồn mở được đại diện công bằng trước tòa, nhưng ý tưởng thì không tự chi trả được, còn tiếng nói của tiền bạc thì quá lớn

    • Không phải Altman tự đi thuyết phục Quốc hội rằng “AI hiện đại là nguy hiểm”, mà là Blumenthal mời ông ta tới để tạo ra một màn thể hiện cho báo chí
      Quốc hội đang cảm thấy áp lực vì đã bỏ mặc mạng xã hội, và hiện rất nóng lòng muốn quản lý AI. Không có bất đồng thực chất nào trong phiên điều trần, và ý đồ của chính phủ với ngành công nghiệp hoàn toàn trùng khớp. Họ đang trải thảm đỏ cho sự kiểm soát tập trung, dùng quy định để loại bỏ cạnh tranh
    • Lợi ích của chính phủ có lẽ sẽ phù hợp với phía OpenAI hơn, và nếu không loại bỏ mô hình mã nguồn mở/mô hình chạy cục bộ thì ngược lại còn là điều ngớ ngẩn
      Những thứ chạy cục bộ sẽ vượt qua ranh giới mạng nơi có thể nghe lén và giám sát. Hỏi Google thì sẽ bị ghi lại, lịch sử tìm kiếm có thể bị thu thập bằng trát đòi, hồ sơ mượn sách ở thư viện công cộng cũng vậy. Một đơn vị gác cổng như OpenAI có thể đảm nhận vai trò đó và thu phí qua trạm
      Nhưng nếu làm cùng việc đó bằng thứ như Vicuna-13B-ggml thì sẽ không ai ngửi ra được bạn đang làm gì. Điều đó có vẻ tốt với người muốn được ở một mình, nhưng lại kéo theo những hàm ý đáng sợ với người muốn ngăn chặn các tác nhân ác ý hơn
      Đáng tiếc là trong các vấn đề như thế này hầu như không thể thỏa hiệp. Phương án tốt nhất có lẽ là như luật gần đây của Hà Lan, cho phép chính phủ xâm nhập thiết bị cá nhân nếu có lý do đủ mạnh, nhưng chuyện đó sẽ không xảy ra. Giải pháp thay thế duy nhất có lợi cho phía chính phủ là cấm chính các mô hình cục bộ và việc phát triển mã nguồn mở của chúng
    • Việc trong nhận thức đại chúng, OpenAI bị gắn nhầm với mã nguồn mở chỉ vì cái tên của họ cũng thật kinh khủng. Vì vậy, hai cách tiếp cận đối lập lại bị trộn lẫn trong mắt công chúng
    • Có thật là đã quá muộn không? Chẳng phải chúng ta vẫn đang ở giai đoạn đầu sao?
    • Lý do để lạc quan là các nhà vận động hành lang muốn đóng AI lại có một điểm yếu là Quốc hội dạo này làm việc rất kém, và trạng thái mặc định của vấn đề này là “không làm gì cả”
      Để vượt qua lực cản của hiện trạng thì cần sự ủng hộ lớn từ công chúng, mà điều đó không có, còn mua nó bằng tiền thì cực kỳ đắt
  • Mã nguồn mở là một thành phần thiết yếu để xây dựng một xã hội số lành mạnh gần với những giá trị mà chúng ta đề cao
    AI là quan trọng, nhưng trong toàn bộ sự chuyển đổi này thì rốt cuộc nó chỉ là một phần nhỏ. Cũng cần nhớ rằng Bitcoin, thứ đang muốn làm rung chuyển nền tảng của đời sống kinh tế, cũng là mã nguồn mở
    Quá trình tiến hóa để cấy năng lực mã nguồn mở ở quy mô xã hội không phải là tự động, cũng không hiển nhiên là tốt đẹp. Ví dụ tiền mã hóa ở trên cho thấy điều đó
    Vẫn còn rất nhiều công nghệ, thể chế và phương thức hành động cần được tưởng tượng, phát triển, thử nghiệm và phổ biến. Đây là một bài toán đáng để các kỹ sư “xã hội” số của hiện tại và tương lai xắn tay vào giải quyết
    Tôi khó hình dung ra một vũ trụ nào khác ngoài phản địa đàng. Nếu từng có ai đưa ra một tầm nhìn độc quyền vừa phù hợp về mặt đạo đức với tính chủ thể cá nhân, tự do, kiểm soát dân chủ, vừa trung thực về mặt trí tuệ đối với các động lực lợi ích của chính nó, thì tôi thật lòng muốn biết

  • CEO của Hugging Face đã làm rất tốt. Tôi đã chia sẻ một link YouTube dài 5 phút cho bạn bè và người thân, và nó giải thích cực kỳ rõ lợi ích của mô hình mở và mã nguồn mở

    • Có thể cho link video không?
  • Trường hợp này khiến tôi cảm thấy sự khác biệt giữa mã nguồn mở và phần mềm tự do trở nên khá quan trọng

    • Với LLM, tôi thực sự mong người ta ngừng gọi những mô hình bị rò rỉ mã nguồn hay trọng số là “mã nguồn mở”
      Ngay cả khi được công bố có chủ đích, điều này cũng đúng với những mô hình có giấy phép giới hạn ở “phi thương mại”, hoặc chỉ cho phép sử dụng thương mại nếu không “cạnh tranh” với công ty đã công bố nó
    • Ngay cả khi không quá sa đà vào chuyện ngữ nghĩa, điều quan trọng ở đây là sự trao đổi tự do của ý tưởng, thuật toán và một phần mã nguồn
      Tiến bộ của lĩnh vực này trong 20 năm qua đã tăng tốc khủng khiếp nhờ kiểu trao đổi đó. Thay vì các công ty ôm chặt kết quả và giữ bí kíp riêng, họ chia sẻ nhiều chi tiết, kiểm chứng bằng cách tái tạo và cải thiện kết quả của nhau
      OpenAI đã tạo ra ChatGPT, Meta tạo ra Llama, còn Google đang làm Bard. Llama phần nào đã được đưa vào cộng đồng mã nguồn mở, và giờ mọi người đang dùng nó, cải thiện nó, rồi đối chiếu với các mô hình và benchmark của riêng họ
    • Mã nguồn mở luôn quan trọng. Nếu không có mã nguồn mở thì rất khó hình thành một đường ống thu hút nhà phát triển tốt. Các ngành kỹ thuật khác cũng nên hướng tới điều tương tự. Tất nhiên điều đó không có nghĩa là phần mềm đóng không thể tồn tại
      Ít nhất trong mảng tạo ảnh, có vẻ các mô hình mở giờ đã cho kết quả tốt hơn rất nhiều nhờ việc huấn luyện được crowdsourcing
    • Thành thật mà nói tôi lại thấy ngược lại. Càng nhiều phần mềm mã nguồn mở thì càng tốt, nhưng tôi không nghĩ việc LLM trở thành mã nguồn mở sẽ làm giảm đáng kể rủi ro lớn nhất của LLM mà tôi nhìn thấy
  • Thật lạ khi thấy Hugging Face xuất hiện trên tin tức theo kiểu này. Tôi nhớ mình đã từng đóng góp một bản vá hồi khoảng mùa hè 2019 khi nó mới có chừng 4.000 sao, và ngay cả lúc đó tôi đã nghĩ đây là một dự án khá nổi tiếng

    • Hãy tưởng tượng 5 năm nữa xem ;)
  • Mục tiêu cuối cùng của Hugging Face là gì? Trở thành GitHub cho AI à?

    • Tôi là CEO của Hugging Face. Nếu điều đó có thể hỗ trợ dân chủ hóa AI theo hướng tích cực nhờ khoa học mở và mã nguồn mở, thì tôi hy vọng là vậy. Bạn thấy điều đó có hữu ích không?
    • Giao diện của họ giống GitHub đến 90%, nên điều đó có vẻ quá rõ ràng
      Họ cũng đang cố mở rộng sang phía huấn luyện mô hình AI và chạy suy luận. Nhưng về chi phí suy luận thì có vẻ họ cạnh tranh rất kém so với các nhà cung cấp GPU như CoreWeave
    • Dù trở thành gì đi nữa, tôi thật, thật, thật, thật sự hy vọng nó không rơi vào tay Microsoft hay Google. Dù vậy có lẽ cuối cùng vẫn sẽ thế thôi, rồi enshittification sẽ kéo theo
    • Chẳng phải bây giờ đã vậy rồi sao?
    • Bị AWS mua lại à?
  • Tôi thích việc ông ấy vẫn là một người khá dễ tiếp cận trên mạng xã hội

  • Tại sao Quốc hội lại can dự cả vào phần mềm, mã nguồn mở và AI?

  • Không biết mọi người có xem dự án Bittensor chưa, và có ý kiến gì không. Nó có đáng để cân nhắc tích hợp không?
    Tôi nghĩ những dự án kiểu này có thể giúp ích cho phong trào AI mã nguồn mở

  • Chẳng phải phần lớn các mô hình trên Hugging Face đều nằm dưới các giấy phép RAIL kỳ quặc chứ không phải mã nguồn mở sao?

    • Ít nhất trên GitHub thì phần lớn dự án của họ dùng giấy phép MIT hoặc Apache 2.0. Tôi có bỏ sót gì không?