CEO Hugging Face: “AI mã nguồn mở phù hợp với lợi ích của Mỹ”
(venturebeat.com)- Tại phiên điều trần của Ủy ban Khoa học Hạ viện Mỹ, CEO Hugging Face Clement Delangue nhấn mạnh rằng khoa học mở và AI mã nguồn mở rất phù hợp với các giá trị và lợi ích của Mỹ
- Delangue cho rằng các công cụ mã nguồn mở xuất phát từ Mỹ như PyTorch, Tensorflow, Keras, transformers, diffusers đã hỗ trợ sự phát triển của AI và vị thế dẫn đầu của Mỹ
- Lời chứng này được đưa ra 2 tuần sau khi các thượng nghị sĩ chất vấn về khả năng bị lạm dụng như spam, lừa đảo, mã độc, xâm phạm quyền riêng tư và quấy rối sau vụ rò rỉ LLaMA của Meta
- Ông giải thích rằng tính mở có đạo đức trao cho xã hội dân sự, tổ chức phi lợi nhuận, giới học thuật và các nhà hoạch định chính sách năng lực để kiềm chế các tập đoàn tư nhân lớn và giảm bớt các hệ thống hộp đen
- Hugging Face muốn kết hợp tính mở với các biện pháp an toàn thông qua model card, giới hạn truy cập, phát hành theo từng giai đoạn, điều phối cộng đồng và bộ dữ liệu opt-in/opt-out
Bảo vệ AI mã nguồn mở tại phiên điều trần của Hạ viện Mỹ
- CEO Hugging Face Clement Delangue đã điều trần tại phiên điều trần toàn thể của Ủy ban Khoa học Hạ viện Mỹ Artificial Intelligence: Advancing Innovation Towards the National Interest
- Cùng tham gia phiên điều trần còn có CEO RAND Corporation Jason Matheny, general partner của Lux Capital Shahin Farshchi, fellow về AI có trách nhiệm của Harvard University Rumman Chowdhury và giám đốc điều hành của Georgetown University Center for Security and Emerging Technology Dewey Murdick
- Delangue cho rằng những tiến bộ gần đây của AI có được là nhờ khoa học mở và mã nguồn mở
- PyTorch, Tensorflow, Keras, transformers, diffusers được nêu là các công nghệ mã nguồn mở được tạo ra tại Mỹ
- Ông phát biểu rằng nếu không có những công nghệ này, có thể Mỹ đã không phải là quốc gia dẫn đầu về AI
Tính mở có đạo đức được nêu ra giữa tranh cãi về LLaMA
- Lời chứng của Delangue được đưa ra 2 tuần sau khi các thượng nghị sĩ chất vấn Mark Zuckerberg về vụ rò rỉ LLaMA, LLM mã nguồn mở của Meta
- Bức thư liên quan bày tỏ lo ngại rằng LLaMA có thể bị dùng cho spam, lừa đảo, mã độc, xâm phạm quyền riêng tư, quấy rối và các hành vi sai trái hay gây hại khác
- Sự lan rộng của LLaMA đã làm tăng mạnh mức độ tinh vi của các mô hình AI mà công chúng phổ thông có thể tiếp cận, đồng thời cũng làm gia tăng lo ngại về khả năng bị dùng sai hoặc lạm dụng
- Hugging Face là một startup có trụ sở tại New York, năm ngoái được định giá 2 tỷ USD và đã trở thành trung tâm cho mã nguồn mở và các mô hình
- Tháng 4, Delangue đã thu hút hơn 5.000 người tới một buổi meetup công nghệ mã nguồn mở tại Exploratorium ở San Francisco
- Delangue nói rằng khoa học mở và mã nguồn mở đang thúc đẩy hàng chục nghìn startup ứng dụng AI
- Tính mở có đạo đức cung cấp cho xã hội dân sự, tổ chức phi lợi nhuận, giới học thuật và các nhà hoạch định chính sách năng lực cần thiết để kiềm chế sức mạnh của các tập đoàn tư nhân lớn
- Ngăn chặn các hệ thống hộp đen và tăng trách nhiệm giải trình của doanh nghiệp
- Có thể giúp giảm thiên lệch, giảm thông tin sai lệch, tăng cường bản quyền và hỗ trợ bồi đắp lợi ích cho các bên liên quan gồm nghệ sĩ và nhà sáng tạo nội dung
- Cách tiếp cận của Hugging Face kết hợp chính sách thể chế, các biện pháp an toàn kỹ thuật và động lực cộng đồng
- Bao gồm tài liệu hóa và model card, gồm cả model cards do Dr. Margaret Mitchell khởi xướng
- Sử dụng giới hạn quyền truy cập vào artifact và phát hành theo từng giai đoạn như các biện pháp an toàn kỹ thuật
- Điều phối cộng đồng và các bộ dữ liệu opt-in/opt-out cũng nằm trong cấu trúc động lực đó
- Trong vài tháng gần đây, khi các đợt phát hành mô hình ngôn ngữ lớn liên tiếp xuất hiện và startup, các nhóm cùng giới học thuật phản đối xu hướng chuyển sang các LLM đóng và độc quyền, tranh luận về AI mã nguồn mở càng trở nên nóng hơn
1 bình luận
Ý kiến trên Hacker News
Đây là một mô hình thu nhỏ hoàn hảo cho thấy cách hệ thống vận hành. Người này nói đúng, nhưng đã lên tiếng quá muộn, thiếu tiền và cũng không nhận được đủ sự chú ý
Trong khi đó, Sam Altman là gương mặt đại diện cho một sản phẩm tiêu dùng với đội ngũ marketing xuất sắc, thậm chí còn có cả các nhà vận động hành lang, nhận hàng tỷ đô la từ Microsoft, và có một sản phẩm mà ai cũng có thể dùng thử miễn phí
Chỉ cần đi trước, rao giảng về rủi ro AI, rồi thuyết phục các nghị sĩ rằng công nghệ mới nhất là nguy hiểm. OpenAI sớm được xem gần như đồng nghĩa với công nghệ tiên tiến nhất, nên mọi người cứ đi theo người dẫn đầu ngành mà không thực sự nhìn xem họ đang hướng đến đâu, và cuối cùng chúng ta đi tới tình cảnh này
Tôi ước phần mềm mã nguồn mở được đại diện công bằng trước tòa, nhưng ý tưởng thì không tự chi trả được, còn tiếng nói của tiền bạc thì quá lớn
Quốc hội đang cảm thấy áp lực vì đã bỏ mặc mạng xã hội, và hiện rất nóng lòng muốn quản lý AI. Không có bất đồng thực chất nào trong phiên điều trần, và ý đồ của chính phủ với ngành công nghiệp hoàn toàn trùng khớp. Họ đang trải thảm đỏ cho sự kiểm soát tập trung, dùng quy định để loại bỏ cạnh tranh
Những thứ chạy cục bộ sẽ vượt qua ranh giới mạng nơi có thể nghe lén và giám sát. Hỏi Google thì sẽ bị ghi lại, lịch sử tìm kiếm có thể bị thu thập bằng trát đòi, hồ sơ mượn sách ở thư viện công cộng cũng vậy. Một đơn vị gác cổng như OpenAI có thể đảm nhận vai trò đó và thu phí qua trạm
Nhưng nếu làm cùng việc đó bằng thứ như Vicuna-13B-ggml thì sẽ không ai ngửi ra được bạn đang làm gì. Điều đó có vẻ tốt với người muốn được ở một mình, nhưng lại kéo theo những hàm ý đáng sợ với người muốn ngăn chặn các tác nhân ác ý hơn
Đáng tiếc là trong các vấn đề như thế này hầu như không thể thỏa hiệp. Phương án tốt nhất có lẽ là như luật gần đây của Hà Lan, cho phép chính phủ xâm nhập thiết bị cá nhân nếu có lý do đủ mạnh, nhưng chuyện đó sẽ không xảy ra. Giải pháp thay thế duy nhất có lợi cho phía chính phủ là cấm chính các mô hình cục bộ và việc phát triển mã nguồn mở của chúng
Để vượt qua lực cản của hiện trạng thì cần sự ủng hộ lớn từ công chúng, mà điều đó không có, còn mua nó bằng tiền thì cực kỳ đắt
Mã nguồn mở là một thành phần thiết yếu để xây dựng một xã hội số lành mạnh gần với những giá trị mà chúng ta đề cao
AI là quan trọng, nhưng trong toàn bộ sự chuyển đổi này thì rốt cuộc nó chỉ là một phần nhỏ. Cũng cần nhớ rằng Bitcoin, thứ đang muốn làm rung chuyển nền tảng của đời sống kinh tế, cũng là mã nguồn mở
Quá trình tiến hóa để cấy năng lực mã nguồn mở ở quy mô xã hội không phải là tự động, cũng không hiển nhiên là tốt đẹp. Ví dụ tiền mã hóa ở trên cho thấy điều đó
Vẫn còn rất nhiều công nghệ, thể chế và phương thức hành động cần được tưởng tượng, phát triển, thử nghiệm và phổ biến. Đây là một bài toán đáng để các kỹ sư “xã hội” số của hiện tại và tương lai xắn tay vào giải quyết
Tôi khó hình dung ra một vũ trụ nào khác ngoài phản địa đàng. Nếu từng có ai đưa ra một tầm nhìn độc quyền vừa phù hợp về mặt đạo đức với tính chủ thể cá nhân, tự do, kiểm soát dân chủ, vừa trung thực về mặt trí tuệ đối với các động lực lợi ích của chính nó, thì tôi thật lòng muốn biết
CEO của Hugging Face đã làm rất tốt. Tôi đã chia sẻ một link YouTube dài 5 phút cho bạn bè và người thân, và nó giải thích cực kỳ rõ lợi ích của mô hình mở và mã nguồn mở
Trường hợp này khiến tôi cảm thấy sự khác biệt giữa mã nguồn mở và phần mềm tự do trở nên khá quan trọng
Ngay cả khi được công bố có chủ đích, điều này cũng đúng với những mô hình có giấy phép giới hạn ở “phi thương mại”, hoặc chỉ cho phép sử dụng thương mại nếu không “cạnh tranh” với công ty đã công bố nó
Tiến bộ của lĩnh vực này trong 20 năm qua đã tăng tốc khủng khiếp nhờ kiểu trao đổi đó. Thay vì các công ty ôm chặt kết quả và giữ bí kíp riêng, họ chia sẻ nhiều chi tiết, kiểm chứng bằng cách tái tạo và cải thiện kết quả của nhau
OpenAI đã tạo ra ChatGPT, Meta tạo ra Llama, còn Google đang làm Bard. Llama phần nào đã được đưa vào cộng đồng mã nguồn mở, và giờ mọi người đang dùng nó, cải thiện nó, rồi đối chiếu với các mô hình và benchmark của riêng họ
Ít nhất trong mảng tạo ảnh, có vẻ các mô hình mở giờ đã cho kết quả tốt hơn rất nhiều nhờ việc huấn luyện được crowdsourcing
Thật lạ khi thấy Hugging Face xuất hiện trên tin tức theo kiểu này. Tôi nhớ mình đã từng đóng góp một bản vá hồi khoảng mùa hè 2019 khi nó mới có chừng 4.000 sao, và ngay cả lúc đó tôi đã nghĩ đây là một dự án khá nổi tiếng
Mục tiêu cuối cùng của Hugging Face là gì? Trở thành GitHub cho AI à?
Họ cũng đang cố mở rộng sang phía huấn luyện mô hình AI và chạy suy luận. Nhưng về chi phí suy luận thì có vẻ họ cạnh tranh rất kém so với các nhà cung cấp GPU như CoreWeave
Tôi thích việc ông ấy vẫn là một người khá dễ tiếp cận trên mạng xã hội
Tại sao Quốc hội lại can dự cả vào phần mềm, mã nguồn mở và AI?
Quốc hội có quyền điều tiết thương mại với nước ngoài, giữa các bang, và với các bộ lạc thổ dân
Không biết mọi người có xem dự án Bittensor chưa, và có ý kiến gì không. Nó có đáng để cân nhắc tích hợp không?
Tôi nghĩ những dự án kiểu này có thể giúp ích cho phong trào AI mã nguồn mở
Chẳng phải phần lớn các mô hình trên Hugging Face đều nằm dưới các giấy phép RAIL kỳ quặc chứ không phải mã nguồn mở sao?