1 điểm bởi GN⁺ 1 giờ trước | 1 bình luận | Chia sẻ qua WhatsApp
  • 25 công ty công nghệ như Nvidia, Microsoft, Meta và Palantir đã kêu gọi các nhà hoạch định chính sách thận trọng, cho rằng việc vội vàng áp đặt hạn chế lên các mô hình AI open-weight có thể kìm hãm cạnh tranh và đẩy đổi mới ra nước ngoài
  • Mô hình open-weight mà người dùng có thể tải xuống, chỉnh sửa và chạy trên hạ tầng riêng giúp phổ biến rộng rãi lợi ích của công nghệ; ngược lại, nếu dồn năng lực tiên tiến vào một số ít mô hình đóng thì rủi ro bị xâm phạm, bị lạm dụng hoặc thất bại khó bị phát hiện từ bên ngoài có thể tăng lên
  • Kimi K3 của Moonshot AI (Trung Quốc) đã vượt các mô hình tiên tiến của Mỹ trong một số benchmark của ngành, làm tranh cãi về việc hạn chế truy cập tại Mỹ trở nên gay gắt hơn; phía Nhà Trắng cũng nêu nghi vấn mô hình này đã âm thầm chưng cất công nghệ của Anthropic
  • Các công ty cho rằng cần xử lý hành vi chưng cất bất hợp pháp bằng khung pháp lý và thương mại có mục tiêu, thay vì áp đặt hạn chế công nghệ trên diện rộng; đồng thời, chưng cất hợp pháp giữ vai trò quan trọng trong hệ sinh thái đổi mới mở
  • Dù OpenAI và Anthropic không ký tên, ban lãnh đạo OpenAI vẫn ủng hộ việc tiếp cận mô hình rộng rãi; trường hợp Hugging Face nhanh chóng chặn cuộc tấn công mạng vào mô hình OpenAI bằng GLM 5.2 của Z.ai cũng cho thấy tiềm năng ứng dụng của mô hình open-weight

Phản ứng chung của 25 công ty

  • 25 công ty công nghệ như Nvidia, Microsoft, Meta và Palantir đã công bố thư ngỏ chung kêu gọi các nhà hoạch định chính sách tránh các “hạn chế vội vàng” đối với mô hình AI open-weight
    • Họ cảnh báo rằng quy định có thể kìm hãm cạnh tranh hoặc đẩy đổi mới ra nước ngoài
    • CEO Nvidia Jensen Huang và CEO Microsoft Satya Nadella đã chia sẻ bức thư trên tài khoản mạng xã hội của mình
    • Elon Musk cũng nói rằng ông “hoàn toàn ủng hộ”, nhưng SpaceX không nằm trong danh sách bên ký chính thức
  • Mô hình open-weight là mô hình AI mà người dùng có thể tải xuống, chỉnh sửa và chạy trên hạ tầng riêng của mình

Sự trỗi dậy của mô hình Trung Quốc và tranh cãi về hạn chế truy cập

  • Khi các mô hình open-weight của Trung Quốc ngày càng cạnh tranh với các mô hình chủ lực của OpenAI và Anthropic, câu hỏi có nên hạn chế truy cập các mô hình Trung Quốc tại Mỹ đã nổi lên như một điểm tranh cãi giữa quan chức chính phủ Mỹ và lãnh đạo doanh nghiệp
  • Startup Trung Quốc Moonshot AI đã công bố Kimi K3, mô hình đạt hiệu năng cao hơn các mô hình tiên tiến của Mỹ trong một số benchmark của ngành
  • Bộ trưởng Tài chính Mỹ Scott Bessent cho biết chính quyền Trump có khả năng điều tra liệu các công ty Trung Quốc có đánh cắp sở hữu trí tuệ của Mỹ hay không, và sẽ trừng phạt nếu xác nhận có hành vi đó

Vì sao cần một hệ sinh thái mở

  • Mô hình open-weight có thể tăng cường cạnh tranh và ngăn lợi ích của công nghệ chỉ tập trung vào một nhóm nhỏ
  • Chỉ dùng mô hình đóng không có nghĩa là mặc nhiên an toàn hơn
    • Mô hình đóng cũng có thể bị xâm phạm hoặc bị lạm dụng
    • Chúng cũng có thể thất bại theo cách mà người bên ngoài không thể phát hiện
    • Nếu năng lực AI tiên tiến tập trung vào một số ít mô hình đóng, những rủi ro này có thể còn lớn hơn
  • Quan điểm được nêu là vai trò dẫn dắt AI của Mỹ không nên được đánh giá qua một mô hình frontier đơn lẻ, mà qua việc nước này có xây dựng được một hệ sinh thái mạnh và cởi mở trên mọi ngành hay không; đây là điều cần thiết để tạo cơ hội đổi mới và thịnh vượng trên khắp nước Mỹ

OpenAI và Anthropic không tham gia

  • OpenAI và Anthropic không ký vào thư ngỏ chung
    • Giá trị doanh nghiệp của hai công ty đều vào khoảng 1 nghìn tỷ USD, và có thể thúc đẩy IPO quy mô lớn sớm nhất trong năm 2026
    • Anthropic đã nộp hồ sơ chào bán bí mật lên Ủy ban Chứng khoán và Giao dịch Mỹ vào tháng 6, và OpenAI cũng thực hiện quy trình tương tự vài ngày sau đó
  • Chủ tịch OpenAI Greg Brockman cho biết ông ủng hộ việc tiếp cận rộng rãi và chưa từng thảo luận với chính quyền Trump về việc cấm các mô hình open-weight của Trung Quốc tại Mỹ
    • Ông cho rằng việc dân chủ hóa AI và cách sử dụng AI là quan trọng, và nhiều mô hình hơn cùng phạm vi sử dụng rộng hơn là điều đáng mong muốn
  • CEO OpenAI Sam Altman hoan nghênh thư ngỏ chung, nói rằng ông muốn Mỹ chiến thắng ở cả mô hình open-weight lẫn mô hình độc quyền

Hugging Face ứng phó tấn công mạng

  • Hugging Face đã dùng mô hình open-weight của Z.ai (Trung Quốc) để ngăn chặn các cuộc tấn công mạng do những mô hình nằm ngoài sự kiểm soát của OpenAI thực hiện
    • OpenAI đã công khai vụ việc này và gọi đây là một “sự cố mạng chưa từng có tiền lệ”
  • Ban đầu, công ty định dùng Fable 5 của Anthropic để phân tích cuộc tấn công, nhưng guardrail của mô hình không thể phân biệt được mục đích phòng thủ của Hugging Face nên không thể sử dụng
  • Sau đó, họ đã chặn cuộc tấn công rất nhanh bằng trường hợp liên quan đến GLM 5.2 của Z.ai

Những tranh điểm quanh việc chưng cất mô hình

  • Cố vấn Nhà Trắng Michael Kratsios cho biết Moonshot AI đã chưng cất (distillation) công nghệ của Anthropic để phát triển Kimi K3
  • Chưng cất là phương pháp huấn luyện một mô hình nhỏ hơn, kém mạnh hơn bằng cách sử dụng đầu ra do một mô hình hiện có mạnh hơn tạo ra
  • Kratsios nhấn mạnh rằng chưng cất AI hợp pháp giữ vai trò quan trọng trong hệ sinh thái đổi mới mở, nhưng hoạt động chưng cất công nghiệp quy mô lớn, bí mật nhằm đánh cắp công nghệ độc quyền của Mỹ là điều không thể chấp nhận
  • Thư ngỏ chung yêu cầu các lo ngại về chưng cất bất hợp pháp phải được giải quyết bằng khung pháp lý và thương mại có mục tiêu, thay vì bằng các hạn chế bao trùm đối với những công nghệ quan trọng cho đổi mới AI

1 bình luận

 
Ý kiến trên Hacker News
  • Rất có thể là vì Anthropic đã rót 40 triệu USD vào một tổ chức chính trị nhằm thúc đẩy quản lý mô hình, và cũng muốn cấm/kiểm soát các mô hình mã nguồn mở
    https://www.anthropic.com/news/donation-public-first-action
    Dù vậy, tôi không hiểu vì sao Anthropic vẫn được đối xử như một vai chính diện có đạo đức
    • Không rõ nhìn chung có thật sự được đối xử như vậy không, nhưng ban đầu họ đã thu được hiệu ứng PR đáng kể khi từ chối việc chính phủ Mỹ sử dụng mô hình cho mục đích chiến tranh
  • Tôi đang đăng ký gói giá gấp 20 lần của Claude và Codex, và giờ cũng dùng cả Kimi
    Vì chỉ K3 mới là mô hình tối tân có thể trao đổi nghiêm túc về bảo mật sản phẩm của tôi; tôi cũng đã đăng ký Cyber Pilot của OpenAI nhưng không nhận được phản hồi
    • Chiến lược sản phẩm cố tình để AI tiêu dùng tạo ra phần mềm không an toàn, rồi chỉ cho những khách hàng được đánh giá là đủ điều kiện trả tiền để truy cập hạn chế vào mô hình có thể sửa nó, thật độc ác
      Nói cách khác, AI cấp 3 có thể hack được cả hai cấp trước chỉ được bán cho khách hàng trả giá cao nhất
    • Bảo mật sản phẩm cần được thảo luận nghiêm túc với các chuyên gia đã được đào tạo thực tế trong lĩnh vực đó
      Trừ khi bạn đã hiểu chủ đề đó rõ hơn LLM, hoặc đó là các công cụ nội bộ mà kết quả không quá quan trọng, còn không thì LLM là vô dụng
  • Giờ đây, phe mô hình đóng muốn cấm open weights về cơ bản đã thất thế, và Musk cũng công khai ủng hộ điều này
    Gợi nhớ thời SOPA từng gây chấn động tương tự và bị mọi người phản đối: https://en.wikipedia.org/wiki/Stop_Online_Piracy_Act
  • Các thảo luận liên quan đã diễn ra nhiều lần
    Startup founders urge U.S. government not to shut off Chinese open weight AI - https://news.ycombinator.com/item?id=49023016 - tháng 7/2026, 841 bình luận
    OpenAI and Anthropic unite against open-weight AI risks to their bottom line - https://news.ycombinator.com/item?id=49020868 - tháng 7/2026, 330 bình luận
    China’s open-weights AI strategy is winning - https://news.ycombinator.com/item?id=48979269 - tháng 7/2026, 932 bình luận
    The gap between open weights LLMs and closed source LLMs - https://news.ycombinator.com/item?id=48692058 - tháng 6/2026, 250 bình luận
    The unbearable cheapness of open weight models - https://news.ycombinator.com/item?id=48668255 - tháng 6/2026, 186 bình luận
  • Tôi tò mò không biết đang có chuyện gì diễn ra phía sau hậu trường đến mức nhiều công ty phải đưa ra thư chung như vậy
    • Cuối cùng, khả năng cao là hầu hết công ty sẽ vận hành mô hình cục bộ
      Nếu không, mọi công ty dùng LLM sẽ hoàn toàn phụ thuộc vào Anthropic và các bên tương tự; đến khi quan hệ phụ thuộc đã cố định, họ sẽ vắt lợi nhuận đến mức vô lý
      Trong một lĩnh vực, càng có nhiều đối thủ mạnh thì càng có lợi cho tất cả mọi người trừ chính các đối thủ đó, nhưng các đối thủ thì luôn muốn số lượng càng ít càng tốt
    • NVIDIA bán công cụ, nên càng nhiều mô hình thì càng có lợi
      Microsoft và Meta hiện là những kẻ đến sau, và để bắt kịp, lựa chọn tốt nhất có lẽ là tận dụng hạ tầng và mô hình mở của chính họ
    • NVIDIA chịu hạn chế xuất khẩu GPU sang Trung Quốc
      Vì vậy, các phòng thí nghiệm Trung Quốc đã để các nhà cung cấp hosting tại Mỹ không bị hạn chế vận hành mô hình open weights của họ; ở châu Âu, Scaleway và Hetzner cũng đang tham gia thị trường hosting suy luận cho mô hình Trung Quốc
      Với NVIDIA, càng có nhiều nhà cung cấp suy luận vận hành nhiều mô hình Trung Quốc mà họ vốn không thể phục vụ trực tiếp thì càng có lợi
    • Tôi đã thấy các quan chức chính phủ lặp lại lập luận vận động hành lang của OpenAI và Anthropic, và các công ty này đủ khôn ngoan để nhận ra dấu hiệu của regulatory capture sắp xảy ra
      Nhìn một cách hoài nghi thì chính quyền Mỹ hiện tại cũng không giúp ích cho tình hình
    • Mỗi công ty có động cơ khác nhau và một số có thể thật lòng, nhưng khá nhiều bên có thể đã thua trong cuộc cạnh tranh với OpenAI, Anthropic và Google, cho rằng mình không còn cơ hội, nên đổi chiến lược
      Microsoft trước đây cũng từng nhiều lần chuyển hướng như vậy
  • Tôi tò mò các kỹ thuật tối ưu hóa của mô hình Trung Quốc đã được phản ánh vào Claude và Codex đến mức nào
    • Có nhiều tối ưu hóa được các phòng thí nghiệm Trung Quốc trực tiếp công bố dưới dạng bài báo, nhưng khó biết từng phòng thí nghiệm đang làm gì nội bộ
    • Tôi nhớ mô hình suy luận là do DeepSeek giới thiệu đầu tiên, nhưng kiểm tra lại thì o1 mới có trước
    • DeepSeek đã công bố nhiều bài báo tốt, và gần đây đang thúc đẩy mạnh các công nghệ giảm đáng kể chi phí phục vụ
    • Dù không cố ý, ở một mức độ nào đó đây là xu hướng khó tránh
      Mọi mô hình đều tiêu thụ thông tin miễn phí công khai, đồng thời tạo ra thông tin công khai mới, như cùng uống nước từ một vũng rồi lại xả nước trở lại
      Nếu thuyết Internet chết là đúng, lượng thông tin do LLM tạo ra bằng cách nội suy/ngoại suy từ thông tin hiện có sẽ trở nên lớn hơn rất nhiều so với thông tin thu được trực tiếp từ thực tế hoặc được tạo ra một cách độc đáo
      Cuối cùng, các mô hình có khả năng sẽ hội tụ về dữ liệu tương tự nhau và bước vào một vòng lặp phản hồi sinh tạo khổng lồ, chỉ khác nhau chút ít về hành vi
    • Nếu không tận dụng tối đa các công nghệ có thể dùng được, thì đến mức nhà đầu tư nên thay ban lãnh đạo
  • Việc NVIDIA, Meta và Microsoft ký vào thư này cũng đáng chú ý, nhưng việc Google và Amazon không ký cũng đáng chú ý không kém
    • Theo tôi biết, Google và Amazon là nhà đầu tư của Anthropic
    • Amazon đang host các mô hình open weights như Ministral 14B 3.0 và DeepSeek V3.2 trên Amazon Bedrock, nên tôi không rõ việc họ không ký hàm ý điều gì
      https://docs.aws.amazon.com/bedrock/latest/userguide/model-c...
      Nhân tiện, tôi là nhân viên Meta nhưng đây là quan điểm cá nhân
  • Microsoft cũng đã đăng lập trường của mình về open weights
    https://www.microsoft.com/en-us/corporate-responsibility/top...
    • Microsoft đang định vị mình là nhà cung cấp hosting mô hình, và đã cung cấp các mô hình open weights trên hạ tầng của họ với giá rẻ hơn nhiều, nên đây là lựa chọn tự nhiên
      OpenAI và Anthropic có lý do để lo sợ
  • MSFT, Dell và NVIDIA là nhà cung cấp phần cứng, nên AI nào được dùng thì họ cũng kiếm được tiền
    Tất cả đều có cổ phần trong các phòng thí nghiệm mô hình tiên tiến, nhưng các mô hình open weights của Trung Quốc sẽ biến tầng trí tuệ thành hàng hóa phổ thông