1 điểm bởi GN⁺ 3 giờ trước | 3 bình luận | Chia sẻ qua WhatsApp
  • Mô hình open-weight không có năng lực nguy hiểm là một hàng hóa công mang lại giá trị cho doanh nghiệp, nhà phát triển và nhà nghiên cứu; Anthropic phản đối việc cấm toàn bộ danh mục này
  • Mối lo an ninh quốc gia cốt lõi không nằm ở bản thân hình thức công khai mà là ưu thế AI của các chính phủ độc đoán, các cuộc tấn công mạng và sinh học bằng mô hình mạnh, cùng các vấn đề căn chỉnh
  • Open-weight có thể làm tăng rủi ro vì khó áp dụng biện pháp an toàn và giám sát việc sử dụng, đồng thời không thể thu hồi sau khi phát hành; tuy vậy, ngay cả khi cấm các công ty Mỹ sử dụng thì cũng khó ngăn chặn tác nhân xấu
  • Thay vào đó, Anthropic ủng hộ ngăn xuất khẩu chip hiệu năng cao và thiết bị sản xuất sang Trung Quốc, trấn áp hoạt động chưng cất ở quy mô công nghiệp, và bắt buộc kiểm tra an toàn dựa trên ngưỡng năng lực áp dụng cho cả mô hình công khai lẫn không công khai
  • Không nên mặc định trước rằng open-weight có lợi cho bên phòng thủ; cần đánh giá rủi ro bằng kiểm thử thực nghiệm trước khi phát hành, đặc biệt với bất đối xứng giữa kẻ tấn công và người phòng thủ trong sinh học

Vì sao phản đối lệnh cấm toàn diện open-weight

  • Sau khi có tin một số quan chức Mỹ đang xem xét cấm các công ty Mỹ sử dụng mô hình open-weight của Trung Quốc, nhiều công ty công nghệ đã ký thư ngỏ ủng hộ open-weight
  • Anthropic bác bỏ chỉ trích cho rằng họ muốn cấm để bảo vệ hoạt động kinh doanh, và cho biết chưa từng kêu gọi cấm toàn bộ danh mục mô hình open-weight
  • Mô hình open-weight không có năng lực nguy hiểm là một hàng hóa công mang lại giá trị cho doanh nghiệp, nhà phát triển và nhà nghiên cứu mà không phát sinh chi phí nào ngoài chi phí tính toán cần để vận hành
  • Một lệnh cấm mang tính bảo hộ có thể chỉ tạo hiệu ứng bảo vệ các công ty AI Mỹ khỏi cạnh tranh, trong khi không giải quyết được các mối đe dọa an ninh quốc gia chính

Hai mối đe dọa an ninh quốc gia

  • Ưu thế AI của các chính phủ độc đoán

    • Mối lo lớn nhất là các chính phủ độc đoán, bao gồm Đảng Cộng sản Trung Quốc (CCP), phát triển các mô hình AI mạnh hơn Mỹ để giành ưu thế quân sự lâu dài hoặc dùng chúng để đàn áp người dân trong nước ở mức cực đoan
    • CCP không phải là mối đe dọa duy nhất, nhưng được đánh giá là mối đe dọa mạnh nhất trong số các chính phủ độc đoán
    • Chính phủ Mỹ cũng lo ngại về vấn đề này
    • Phó tổng thống Vance cảnh báo rằng các chế độ độc đoán đã đánh cắp và sử dụng AI để tăng cường năng lực quân sự, tình báo và giám sát
    • Đánh giá mối đe dọa thường niên 2026 nhận định rằng sự phát triển AI của các cường quốc khác đe dọa năng lực cạnh tranh kinh tế và lợi thế an ninh quốc gia của Mỹ
    • Trong mối đe dọa này, việc mô hình có phải open-weight hay không, hoặc có được công ty Mỹ sử dụng hay không, không phải điều quan trọng
    • Những mô hình nguy hiểm nhất có thể là các mô hình được huấn luyện bí mật rồi chỉ cung cấp cho drone của Quân Giải phóng Nhân dân hoặc cho hoạt động giám sát và đàn áp của Bộ An ninh Quốc gia
  • Tấn công mạng, tấn công sinh học và vấn đề căn chỉnh

    • Mối lo thứ hai là các mô hình AI mạnh bị lạm dụng cho tấn công mạng và sinh học hoặc gây ra các vấn đề căn chỉnh nghiêm trọng
    • Bất kể quốc gia xuất xứ, mô hình open-weight có thể có rủi ro tiềm tàng lớn hơn mô hình không công khai
    • Với open-weight, việc áp dụng biện pháp an toàn hoặc giám sát hành vi sử dụng là rất khó
    • Khi trọng số đã được công khai thì không thể thu hồi, và các biện pháp an toàn cũng có thể bị gỡ bỏ
    • Người dùng cũng có thể tải bản sao xuống, phân phối lại hoặc chạy chúng trên các hệ thống riêng không thể giám sát
    • Báo cáo của UK AI Security Institute đánh giá rằng việc công bố mô hình open-weight có năng lực nguy hiểm tạo ra rủi ro lạm dụng liên tục và không thể đảo ngược
    • Các doanh nghiệp hợp pháp của Mỹ ít có khả năng là tác nhân xấu, nên việc cấm các công ty Mỹ sử dụng mô hình không trực tiếp ngăn được những rủi ro này

Kiểm soát chip hiệu năng cao và thiết bị sản xuất

  • Cần không bán chip hiệu năng cao và thiết bị sản xuất chip cho Trung Quốc, đồng thời trấn áp hoạt động buôn lậu và các đường vòng được dùng để thu gom chip
  • Năng lực sản xuất trong nước của Trung Quốc còn hạn chế, và theo định luật scaling, họ không thể tạo ra mô hình mạnh hơn Mỹ nếu không có chip do Mỹ sản xuất
  • Kiểm soát chip là cách hiệu quả và trực tiếp nhất để chặn mối đe dọa thứ nhất: các chính phủ độc đoán tạo ra mô hình mạnh hơn Mỹ
  • Điều này cũng có thể gián tiếp giảm rủi ro tấn công mạng, tấn công sinh học và căn chỉnh bằng cách khiến việc huấn luyện mô hình mạnh ngoài phạm vi luật pháp Mỹ trở nên khó khăn hơn
  • Bộ Tư pháp Mỹ đã công bố nhiều vụ tìm cách xuất lậu hoặc buôn lậu công nghệ AI tiên tiến sang Trung Quốc, và Anthropic kêu gọi tăng cường trấn áp buôn lậu và các phương thức lách luật này

Trấn áp chưng cất ở quy mô công nghiệp

  • Chưng cất mô hình hiệu quả hơn về mặt tính toán so với huấn luyện mô hình từ đầu, cho phép Trung Quốc tạo ra mô hình tốt hơn mức mà quy mô chip họ đang có normally cho phép, và phần nào lách được kiểm soát chip
  • Chỉ riêng chưng cất không thể giúp CCP đạt năng lực AI ngang bằng hoặc vượt Mỹ, nhưng có thể kéo các mô hình frontier của Trung Quốc lên mức chỉ chậm hơn vài tháng so với Mỹ
  • Dù nhiều công ty chưng cất có thể công bố mô hình open-weight, điểm cốt lõi không phải là hình thức công khai mà là việc một quốc gia độc đoán đang hỗ trợ hoạt động ở quy mô công nghiệp nhằm vượt qua frontier của Mỹ
  • Thay vì cấm toàn diện open-weight, cần có chính sách, pháp luật và cơ chế thương mại có mục tiêu để kiềm chế chưng cất
  • Anthropic cũng xác định và chặn các tài khoản dùng mô hình của mình cho hoạt động chưng cất quy mô lớn
    • Có trường hợp chỉ phát hiện được các tài khoản liên quan sau khi quá trình chưng cất đã diễn ra đáng kể
    • Nhiều tài khoản giả tiếp tục được tạo ra nên đối tượng cần xử lý cũng thay đổi liên tục
    • Chỉ bằng biện pháp của từng công ty riêng lẻ thì khó giải quyết, nên cần có can thiệp chính sách

Kiểm tra an toàn bắt buộc theo ngưỡng năng lực

  • Mọi mô hình đủ mạnh, bất kể là công khai hay không công khai và đến từ quốc gia nào, đều phải được kiểm tra rủi ro mạng, sinh học và căn chỉnh trước khi phát hành
  • Chính quyền Trump gần đây đã đi theo hướng này, và đề xuất từ ngành cũng bao gồm phương án áp dụng cùng một bộ kiểm tra cho các mô hình mạnh nhất
  • Các mô hình năng lực thấp do startup và giới học thuật phát triển có thể được loại hoàn toàn khỏi diện kiểm tra bắt buộc
  • Không nên kết luận trước liệu rủi ro của mô hình mở có thực sự lớn hơn hay liệu có thể giảm thiểu rủi ro đó hay không; cần dựa vào kết quả kiểm thử
  • Cũng có những cách tiếp cận có thể nâng cao độ an toàn của mô hình open-weight, chẳng hạn như nghiên cứu chiến lược huấn luyện mô-đun của Anthropic
  • Kiểm tra an toàn hiệu quả cần được áp dụng trên phạm vi quốc tế, nên cũng đòi hỏi sự tham gia của CCP
  • Ngăn chặn vũ khí sinh học bằng AI cũng có thể mang lại lợi ích cho Trung Quốc, nên Anthropic cho rằng có thể có hợp tác hạn chế trong lĩnh vực này

Khác biệt với thư ngỏ ủng hộ open-weight

  • Anthropic đồng ý với một phần nội dung trong thư ngỏ về open-weight và vị thế dẫn đầu AI của Mỹ
    • Open-weight mở rộng khả năng tiếp cận nền kinh tế AI
    • Tăng cạnh tranh trong một số trường hợp sử dụng
    • Trao cho khách hàng quyền kiểm soát lớn hơn
    • Vấn đề chưng cất nên được xử lý bằng khung pháp lý và thương mại có mục tiêu, thay vì lệnh cấm toàn diện
  • Tuy vậy, Anthropic không đồng ý với giả định rằng open-weight nhất thiết sẽ giúp phát triển biện pháp an toàn dễ hơn, hay việc mở rộng quyền tiếp cận năng lực sẽ nghiêng cán cân về phía người phòng thủ hơn là kẻ tấn công
  • Trên thực tế, khả năng tiếp cận rộng có thể lại có lợi hơn cho kẻ tấn công, nên cần kiểm chứng thực nghiệm để xác định bên nào có ưu thế

Bất đối xứng giữa kẻ tấn công và người phòng thủ trong sinh học

  • Các mô hình đủ mạnh có thể nhanh chóng vũ khí hóa virus ở cấp độ đại dịch bằng những vật liệu dễ kiếm rộng rãi, trong khi việc phòng thủ trước mối đe dọa này có thể là một bài toán vận hành mất nhiều năm ngay cả trong kịch bản tốt nhất
  • Như trường hợp Operation Warp Speed, việc chuẩn bị công nghệ và hệ thống ứng phó đòi hỏi nhiều thời gian, nên trong sinh học có thể tồn tại ưu thế mạnh của bên tấn công
  • Theo Anthropic, yếu tố hiện đang ngăn thảm họa sinh học không phải là hạn chế ở phía người phòng thủ hay nguyên liệu, mà là mối tương quan âm giữa năng lực trí tuệ và ý định gây ra thiệt hại thảm khốc
  • Các công nghệ trước đây như tìm kiếm Internet hay tổng hợp DNA chưa đủ mạnh để phá vỡ mối tương quan đó, nhưng AI, với tốc độ phát triển hiện nay, có thể sớm làm được điều đó
  • Khi một công nghệ đủ mạnh xóa bỏ mọi rào cản, sẽ lộ ra bên nào có ưu thế cấu trúc giữa kẻ tấn công và người phòng thủ, và trong sinh học, bên tấn công có thể chiếm ưu thế
  • Những rủi ro này phải được đánh giá bằng kiểm thử nghiêm ngặt trước khi phát hành, chứ không phải bằng suy đoán hay định kiến về hình thức công khai

Các chính sách Anthropic kêu gọi

  • Không cấm mô hình open-weight như một danh mục thống nhất
  • Tăng cường kiểm soát xuất khẩu và buôn lậu để các chính phủ độc đoán không thể tiếp cận chip hiệu năng cao và thiết bị sản xuất
  • Chặn hoạt động chưng cất mô hình ở quy mô công nghiệp bằng công cụ pháp lý, thương mại và chính sách
  • Bắt buộc kiểm tra rủi ro mạng, sinh học và căn chỉnh đối với mọi mô hình công khai hoặc không công khai có đủ năng lực

3 bình luận

 
unsure4000 1 giờ trước

Xài hết đống token đã mua rồi chắc cũng chẳng còn dịp gặp lại nữa đâu, adios

 

Vừa đi vận động hành lang ở phía sau mà vẫn ủng hộ mã nguồn mở thì đúng là khá đáng ngạc nhiên. Cảm giác nếu Anthropic đạt được AGI thì sẽ thành Arasaka mất.

 
Ý kiến trên Hacker News
  • Câu nói “mọi mô hình có đủ năng lực đều phải trải qua kiểm tra an toàn bắt buộc” thực chất cũng giống như kêu gọi cấm mô hình open-weight
    Ai sẽ kiểm tra, và sẽ ra sao nếu chi phí quá đắt hoặc cơ quan quản lý từ chối một số bên tham gia? Trước đây Mỹ cũng từng cấm sản phẩm bằng cách bắt buộc phải có dấu chứng nhận rồi từ chối cấp nó

    • Anthropic có thể sẽ lập luận rằng vì mô hình của họ chỉ được cung cấp kèm lớp an toàn, nên phải đánh giá trong trạng thái đó, còn mô hình open-weight thì phải vượt qua cùng một kiểu kiểm tra ngay ở cấp trọng số
      Tác động kinh tế sẽ rất lớn nhưng hiệu quả bảo mật có vẻ không đáng kể. Lập luận thuyết phục nhất có lẽ là nếu hạn chế sử dụng mô hình open-weight tại Mỹ thì có thể giảm các sự cố như vụ tấn công Hugging Face gần đây, nhưng chính phủ khó có thể thực thi hiệu quả các yêu cầu kiểm tra này
      Mô hình open-weight trên thực tế không thể đáp ứng cùng tiêu chuẩn bảo mật như mô hình cung cấp qua API, và nhà phát triển cũng không thể tuân thủ dù có muốn. Có thể dùng chặn IP và kiểm soát xuất khẩu để hạn chế truy cập và năng lực suy luận, nhưng điều đó không hiệu quả để ngăn chặn tác nhân xấu
    • Một trong các lý do Fable bị rút lại là cú jailbreak với chỉ thị “hãy sửa đoạn mã này” — https://news.ycombinator.com/item?id=48552687
      Nếu các mô hình cấp “Mythos” nguy hiểm đến vậy thì cứ để chúng sửa mã cho mọi người còn hơn. Trên toàn thế giới, số công ty phần mềm, dịch vụ, dự án phần mềm tự do và mã nguồn mở đang hoạt động cùng lắm chỉ vào khoảng vài triệu đến vài chục triệu, nên có thể phát cho mỗi bên 100 USD tín dụng Fable/Mythos để tự sửa mã của mình
      Với 100 triệu đến 1 tỷ USD, Anthropic có thể đồng thời triển khai chiến dịch quảng bá lớn nhất lịch sử nhân loại và tăng cường an ninh trên toàn thế giới. Phần lớn mọi người không có ý xấu, và nếu là kỹ sư, tư vấn, nhà sáng lập, chủ doanh nghiệp hay người bảo trì, họ rất có thể sẽ dùng Mythos để sửa mã của chính mình
      Giam giữ năng lực này sau cổng cấp phép và những cánh cửa đóng kín sẽ gây hại lớn hơn về lâu dài, đồng thời tạo ra một thế giới bất đối xứng nơi những ai có quyền truy cập sẽ quyết định ai được phép an toàn. Nếu ai cũng có Mythos thì sẽ không ai sở hữu “Mythos” một cách độc quyền, vậy cứ để mọi người sửa mã đi
    • Ngành đánh giá an toàn trên thực tế được OpenAI và Anthropic tài trợ cũng như kiểm soát
      Các mô hình gần đây chỉ sử dụng những công ty đánh giá bên ngoài nhưng kín tiếng như Gray Swan, nơi phụ thuộc vào hai công ty này cho kiểm tra nội bộ hoặc cho cả hoạt động kinh doanh, và các công ty đó lại luân chuyển dùng chung cùng một nhóm nhà nghiên cứu
    • Có vẻ mục tiêu là đẩy chi phí kiểm tra an toàn lên hơn 100 triệu USD, khiến các mô hình không thể được phát hành hợp pháp ở phần lớn thế giới nếu không thu giá thật cao, và cuối cùng khiến không ai có thể dùng mô hình cạnh tranh
    • Cũng không hề có định nghĩa cho “đủ năng lực”. Có lẽ nó có nghĩa là mọi mô hình cạnh tranh với Anthropic, và nếu công ty còn tồn tại sau một năm nữa thì có vẻ họ sẽ không bận tâm đến mức Fable mà chỉ muốn hạn chế những thứ cạnh tranh với chính mô hình của họ khi đó, như kiểu Claude 7
  • Trung Quốc bị đối xử như con mèo Schrödinger của AI: vừa là mối đe dọa muốn dùng AI cho mục đích xấu, vừa là quốc gia cạnh tranh nhưng vẫn sẽ hợp tác với Mỹ để ngăn những tác nhân mơ hồ khác đạt cùng mục tiêu
    Thực tế khá đơn giản. CEO của Anthropic không muốn những mô hình tương đương hoặc vượt trội hơn các mô hình đóng và đắt đỏ của họ được phân phối rộng rãi, vì điều đó sẽ làm tổn hại doanh thu
    Tài sản đặc biệt của Anthropic và các công ty mô hình khác chỉ là quyền tiếp cận ưu đãi với chip, nên việc họ muốn hạn chế loại mô hình nào được xuất hiện và ai có thể tạo ra mô hình mới là điều dễ hiểu. Nếu không có quy định, việc mức định giá hàng trăm tỷ USD bốc hơi chỉ còn là vấn đề thời gian

    • Dario, như mọi khi, dường như xem mình là trung tâm của thế giới. Không có lý do gì để Trung Quốc chấp nhận yên lặng trước sự thống trị AI của Mỹ, và họ có thể chấm dứt điều đó chỉ bằng cách phong tỏa Đài Loan với vài con tàu
    • Thật khó tin khi nghĩ rằng lập luận gượng ép trong bài blog này lại được cho là sẽ cải thiện hình ảnh của Anthropic
      Im lặng có lẽ còn đáng được tôn trọng hơn. Rõ ràng mô hình mở có thể tạo ra cạnh tranh gay gắt hoặc phá hủy nền tảng doanh thu, vậy mà nỗ lực độc chiếm quyền lực đối với toàn bộ lao động của con người lại được gói ghém như một ưu thế đạo đức
    • Bài viết vừa muốn hạn chế cả phần cứng đi vào Trung Quốc lẫn việc dùng mô hình mã nguồn mở của Trung Quốc ở phương Tây, nhưng lại gói bằng câu “chúng tôi ủng hộ cạnh tranh, nhưng…”
      Có thể xem việc Trung Quốc công bố đổi mới AI dưới dạng mã nguồn mở để kiềm chế hoặc làm nổ bong bóng AI sớm hơn là một lựa chọn rất tốt, phù hợp với lợi ích quốc gia của họ
  • Đoạn đầu nói lệnh cấm không hữu ích, nhưng phía sau lại bảo phải trấn áp buôn lậu và các đường vòng để Trung Quốc có được chip
    Niềm tin rằng lệnh cấm không hiệu quả đáng ra cũng phải được áp dụng tương tự với phần cứng
    Ba biện pháp mà Dario ủng hộ là cấm bán chip cho Trung Quốc, trấn áp chưng cất mô hình, và bắt buộc kiểm tra an toàn với mọi mô hình hiệu năng cao; trùng hợp thay, cả ba đều mang lại lợi ích thương mại cho Anthropic. Nếu Anthropic từng công bố dù chỉ một mô hình open-weight, điều đó đã thuyết phục hơn nhiều

    • Cấm sử dụng mô hình open-weight của Trung Quốc tại Mỹ và cấm xuất khẩu chip AI cùng thiết bị sản xuất bán dẫn sang Trung Quốc là hai vấn đề hoàn toàn khác nhau, nên phản đối một cái và ủng hộ cái còn lại không phải là mâu thuẫn
    • Nếu Anthropic từng công bố mô hình open-weight và Trung Quốc chưng cất nó rồi bí mật giữ để dùng cho mục đích xấu, thì bức thư này đã có ý nghĩa hơn nhiều
    • Tóm lại, họ muốn giữ vị thế nơi Anthropic vẫn tiếp tục kiếm được số tiền khổng lồ ngay cả khi có cạnh tranh
  • Cho đến hôm qua, một người vẫn chẳng bận tâm việc công nghệ của mình có thể bị dùng để ném bom các trường nữ sinh ở quốc gia khác, giờ lại đột nhiên lo lắng về sự đàn áp công dân ở một nước khác
    Kiểu phô trương đạo đức này, hay những lời răn dạy bề trên về “kịch bản ác mộng” của năm nay, rất khó để tin được

    • Thật thú vị khi phần nói về việc đàn áp ý kiến trái chiều lại viện dẫn chính quyền Trump hiện tại
    • Khó mà tin Dario thật sự quan tâm đến phúc lợi của người Trung Quốc. Nếu Mỹ gây chiến với Trung Quốc và ném bom các thành phố của họ, có lẽ ông ta sẽ ủng hộ, và dùng Claude để thêm trụ sở DeepSeek và Moonshot vào danh sách mục tiêu
      Ông ta có xu hướng thân Israel nhưng chưa từng đề cập đến nguy cơ chính phủ Israel dùng AI để kiểm soát và đàn áp người dân nước khác, đồng thời cũng tích cực hợp tác với Palantir, công ty công khai theo đuổi mục tiêu kiểm soát dân số, đàn áp và xây dựng nhà nước giám sát
      Triều Tiên, quốc gia áp bức nhất thế giới, vẫn làm vậy mà không cần AI. Nếu nói với người Trung Quốc về ý niệm của Dario rằng DeepSeek hay Kimi đang đàn áp họ, có lẽ họ sẽ cười nhạo điều đó
  • Không nhớ nổi có công ty nào lại rơi từ con ngỗng đẻ trứng vàng xuống trạng thái khó hiểu nhanh đến vậy.
    Chính thái độ phòng thủ thường trực ẩn dưới tuyên bố của Dario khiến tôi cũng không còn muốn tin hay phụ thuộc vào sản phẩm của Anthropic. Tôi thậm chí không hiểu bài viết này định thuyết phục ai, và có vẻ Anthropic cần được chấn chỉnh

    • Truyền thông đối ngoại của Anthropic trong vài tháng gần đây tệ đến mức đáng kinh ngạc, và xét đây là một thị trường cạnh tranh khốc liệt thì thật khó hiểu
    • Google và Nvidia, những nhà đầu tư lớn, đã ký vào bản kiến nghị mã nguồn mở còn Amazon thì không, nên có vẻ họ đang cố làm hài lòng cả các nhà đầu tư lẫn công chúng đang chia rẽ.
      Đây là một thái độ mập mờ nhằm xoa dịu tất cả những bên đã có lập trường rõ ràng hơn, nhưng kết quả thì khá tệ
    • Anthropic vốn trước nay vẫn vậy. Chỉ là khi một kẻ yếu thế khác thường đưa ra cùng thông điệp đó thì mọi người đón nhận thiện cảm hơn, còn giờ họ trông giống một tập đoàn khổng lồ nghìn tỷ đô
  • Đại ý kiểu như đảng Cộng sản Trung Quốc tà ác là mối đe dọa lớn với hòa bình và cái thiện của thế giới, nên hãy giao toàn bộ tiền bạc và dữ liệu token đầu vào cho Palantir để duy trì trật tự quốc tế dựa trên luật lệ, nơi phe thiện thắng thế và những nhà sinh vật học về rùa sa đọa bị loại bỏ.
    https://www.theguardian.com/world/2026/jun/20/mona-khalil-tu...

    • Trong lúc nửa thế giới đang khốn khổ vì giá năng lượng do cuộc chiến vô cớ mà Mỹ và Israel khơi mào, thật kinh tởm khi thấy một tỷ phú Mỹ lên án Trung Quốc là mối đe dọa với hòa bình thế giới
  • Rốt cuộc lập luận là: “Công nghệ này quá nguy hiểm nên chỉ chúng tôi mới được tiếp cận, và vì chúng tôi thuộc phe thiện nên có thể bảo đảm sử dụng an toàn.”
    Vậy thì ai sẽ giám sát những kẻ giám sát?

    • Lý do tồn tại của Anthropic ngay từ đầu là niềm tin rằng AGI quá nguy hiểm để OpenAI hay Sam Altman kiểm soát. Vậy thì kết luận tự nhiên cũng là việc để mọi người trên Trái Đất đều có nó cũng nguy hiểm
    • Anthropic không kêu gọi cấm hẳn mô hình open-weight, mà cho rằng cần ngăn các thế lực độc tài tiếp cận chip hiệu năng cao, chặn chưng cất ở quy mô công nghiệp, và yêu cầu kiểm định an toàn với mọi mô hình đủ mạnh dù là mở hay đóng
  • Nếu ủng hộ việc phổ biến rộng rãi mô hình mở, thì phải làm gì với các mô hình open-weight chứa năng lực vũ khí sinh học và tấn công mạng?
    Có nên chấp nhận việc cho kẻ tấn công dùng các công cụ đó như cái giá của tự do không? Vụ việc OpenAI/Hugging Face đã cho thấy khả năng của các mô hình cấp GPT 5.6 không ràng buộc, và khoảng 6 tháng nữa mô hình open-weight cũng có thể đạt tới mức đó để mọi tác nhân xấu đều có thể tiến hành tấn công ở quy mô tương tự
    Ưa thích tính mở là hợp lý, nhưng ủng hộ vô điều kiện trong mọi tình huống mà không suy nghĩ nghiêm túc về hệ quả lan tỏa thì quá ngây thơ

    • Vụ Hugging Face cho thấy rất rõ vì sao cần mô hình mã nguồn mở có năng lực phòng thủ mạng.
      Hugging Face không thể tiếp cận các mô hình tiên tiến nhất có năng lực mạng và liên tục bị chặn bởi các hàng rào an toàn; chỉ sau khi dùng GLM-5.2 mã nguồn mở họ mới có thể sống sót qua cuộc tấn công. Nếu mô hình mã nguồn mở bị cấm, các tổ chức không nằm trong danh sách được OpenAI hay Anthropic cho phép sẽ không thể bảo đảm an ninh mạng
    • Dù sao thì các tác nhân xấu cũng sẽ tiếp cận được. Vấn đề cốt lõi là các tập đoàn lớn có ngăn cản đổi mới hay không
    • Tôi không rõ về vũ khí sinh học, nhưng lạc quan về năng lực an ninh thông tin.
      Sẽ có một giai đoạn rủi ro đau đớn khi những đoạn mã hơn 30 năm chưa từng được phân tích kiểu này bỗng bị soi xét bởi cả triệu người có năng lực cỡ “taviso”, nhưng các nhà phát triển và bên phòng thủ cũng có thể dùng cùng công cụ đó. Dù tồn tại bất đối xứng khi chi phí phòng thủ cao hơn, đây vẫn là một cuộc chạy đua vũ trang sẽ dần ổn định, và rốt cuộc khả năng cao là việc kiểm chứng hình thức các thuộc tính bảo mật sẽ được mở rộng còn chính những mô hình đó sẽ tiếp tục kéo giảm chi phí ấy
      Chưng cất và mô hình open-weight sẽ không biến mất, và cũng gần như không có cách nào cấm hay kiểm soát chúng hiệu quả. Thậm chí có thể xuất hiện các công cụ tự phục vụ để người không chuyên tự chưng cất và duy trì mô hình tiên tiến riêng có năng lực an ninh thông tin
      Nếu là bên phòng thủ thì tốt nhất nên ứng phó trên cơ sở đó; dù có tranh luận chuyện cho phép hay không thì trong khoảng thời gian ấy cũng sẽ không thể xuất hiện một cơ chế thực thi toàn cầu
    • Nếu rủi ro thật sự đến mức đó thì phải đối xử với LLM như bom nguyên tử. Mỹ nên làm việc với các nước khác để thống nhất rằng không ai tiếp tục phát triển mô hình AI nữa, và cách duy nhất để thuyết phục phía bên kia dừng lại là Mỹ không độc chiếm toàn bộ lợi ích mà phải làm gương trước
    • Tôi không rõ về sinh học, nhưng năng lực tấn công mạng thì kẻ tấn công đã có rồi và không thể đảo ngược.
      Mở hay đóng không quá quan trọng, và dù các hàng rào an toàn hiện tại thiên về báo động giả thì vẫn có thể gây thiệt hại mạng đáng kể bằng mô hình đóng.
      Biện pháp kiểm soát hiệu quả duy nhất là san phẳng sân chơi để kẻ tấn công và bên phòng thủ cùng được tiếp cận năng lực như nhau. Nếu tạo ra những cánh cổng mà như đề xuất của Dario, kẻ tấn công có thể lách qua còn bên phòng thủ thì không thể đi qua, thì chỉ bảo đảm hỗn loạn
  • Điều Dario cứ bỏ lỡ là mọi người không còn tin rằng nước Mỹ sẽ tạo ra AI được căn chỉnh nữa.
    Toàn bộ chiến lược của ông ta dựa vào tiền đề rằng nước Mỹ và chính phủ Mỹ đặc biệt lương thiện, nhưng với phần còn lại của thế giới điều đó rõ ràng là sai

    • Trong cuộc phỏng vấn với Bloomberg, Dario đã nói rõ rằng ông tin vào chủ nghĩa ngoại lệ Mỹ. Ông nói vì tin tưởng giới lãnh đạo quân sự Mỹ nên việc AI can dự vào ném bom các nữ sinh ở nước khác cũng không sao.
      Theo ông, các quy tắc an toàn và đạo đức cho toàn thế giới chỉ nên do Mỹ viết ra, và trong cùng cuộc phỏng vấn ông còn ủng hộ chính sách đối ngoại của Mỹ đồng thời gọi Trung Quốc là một “chế độ hiếu chiến và thích gây chiến”.
      Ngày càng nhiều người Mỹ cũng thấy điều này là sai, nhưng vì tầng lớp đầu sỏ là bên hưởng lợi lớn nhất từ chính sách của chính phủ Mỹ nên tuyên truyền sẽ còn tiếp diễn
  • Tôi hiểu logic của việc Anthropic vừa thúc đẩy phát triển vừa kêu gọi tạm dừng và siết quản lý, cũng như việc một cá nhân vẫn có lý do tiếp tục làm ở công ty AI dù muốn giảm tốc.
    Nhưng nếu ai cũng nghĩ vậy thì trong lúc chờ một thỏa thuận có khi chẳng bao giờ đến, cạnh tranh sẽ tiếp tục leo thang, chẳng có gì thay đổi, còn động cơ kinh tế sẽ hợp lý hóa việc mọi bên tiếp tục tham gia.
    Tôi mong sẽ có hành động cụ thể hơn từ bên trong. Khi phán đoán trở nên quá phức tạp thì hãy quay lại nguyên tắc cơ bản. Nếu tin rằng AI đang tiến quá nhanh thì hãy dừng phát triển, và nếu công ty AI muốn tạm dừng thì hãy dừng trước để làm gương.
    Các công ty khác có thể sẽ làm theo, còn những công ty không làm theo sẽ trông như vô trách nhiệm. Người đã quyết không phạm tội thêm nữa thì phải là người đầu tiên buông hòn đá xuống