Em bé nhà tôi có phải là một 'con vẹt xác suất' không?
(newyorker.com)So sánh giữa mô hình ngôn ngữ AI và sự phát triển ngôn ngữ ở trẻ nhỏ
- Trong bối cảnh tốc độ phát triển của các mô hình ngôn ngữ AI ngày càng nhanh, tại nhà của tác giả cũng đang diễn ra quá trình một mô hình ngôn ngữ cỡ nhỏ là em bé tập nói học ngôn ngữ.
- Bài viết này so sánh quá trình tiếp thu ngôn ngữ của AI và con người, đồng thời khám phá mối quan hệ giữa tiến bộ công nghệ và bản tính con người.
- Quá trình tiếp thu ngôn ngữ của trẻ nhỏ diễn ra tự nhiên và theo bản năng, trong khi các mô hình ngôn ngữ AI dựa trên những thuật toán phức tạp và dữ liệu quy mô lớn.
Ý kiến của GN⁺
- Điều quan trọng nhất trong bài viết này là sự đối chiếu giữa sự phát triển của công nghệ AI và quá trình học tập tự nhiên của con người.
- Việc so sánh mô hình ngôn ngữ AI với quá trình tiếp thu ngôn ngữ của trẻ nhỏ giúp hiểu rõ hơn mối quan hệ phức tạp giữa công nghệ và bản tính con người.
- Lý do bài viết thú vị với độc giả là vì nó khám phá sự khác biệt giữa tiến bộ công nghệ tiên tiến và quá trình học tập cơ bản của con người, cũng như những tương tác tồn tại giữa hai bên.
1 bình luận
Các ý kiến trên Hacker News
Nếu khả năng hiểu đi trước lời nói đến mức khi bảo “hãy chỉ vào máy hút bụi” thì bé hiểu và có thể chỉ được, cũng đáng nói thêm rằng có thể dạy ngôn ngữ ký hiệu cho em bé
Thường bắt đầu khoảng 9 tháng tuổi, và các biểu đạt như đói/thêm nữa, đủ rồi/xong rồi, đồ uống có lẽ nên được ưu tiên cao
Tham khảo: https://babysignlanguage.com/chart/, https://www.thebump.com/a/how-to-teach-baby-sign-language
Những ký hiệu này có vẻ gần với các cử chỉ ASL thông thường cho những từ tương ứng hơn là ký hiệu riêng dành cho em bé; nếu không ở thế giới nói tiếng Anh thì có thể tìm ngôn ngữ ký hiệu của khu vực/ngôn ngữ của mình: https://en.wikipedia.org/wiki/List_of_sign_languages, https://en.wikipedia.org/wiki/Sign_language
Ngoài ra, nếu luôn đựng sữa và nước trong các hộp có màu khác nhau, bé có thể học cách chọn một màu cụ thể tùy theo thứ mình muốn
Khi tôi hỏi con có muốn nghe nhạc không, bé làm ký hiệu “chó”; tôi tìm cho bé một bài hát về chó trên YouTube thì bé lắc đầu
Sau đó bé làm ký hiệu “cây”, nên tôi hỏi “chó, cây?” thì bé gật đầu; trong lúc tìm kiếm, khi ảnh cây thông Noel hiện ra, bé phấn khích chỉ vào đó
Hóa ra ý bé là muốn nghe nhạc phim Charlie Brown Christmas mà chúng tôi đã bật trên YouTube vào dịp Giáng sinh 3 tháng trước; khi bật lại, chúng tôi đã cùng nhảy
Đó là khoảnh khắc bé lần đầu truyền đạt một sở thích khá tinh tế, vượt xa mức ăn, uống hay nhờ giúp đỡ, nên tôi thật sự kinh ngạc
Tôi ngạc nhiên vì con học nhanh đến vậy, và bé đã có thể truyền đạt nhu cầu của mình từ vài tháng trước khi biết nói
Với cha mẹ thì tốn rất ít công sức, còn với đứa trẻ thì phần thưởng rất lớn; tốt hơn nhiều so với việc bé khóc và mong cha mẹ đoán đúng
Khoảnh khắc bé ngồi trên sàn, nhìn lên mẹ và làm ký hiệu “cùng nhau” thật sự khiến tôi tan chảy
Xung quanh tôi có những người bạn thấy hiệu quả hơn nhiều; cuối cùng có vẻ giá trị của nó thay đổi rất lớn tùy thế mạnh phát triển của từng đứa trẻ nằm ở đâu
Con trai của một người bạn mắc tự kỷ đã hưởng lợi từ cử chỉ, theo đúng nghĩa đen là trong nhiều năm, cho đến khi ngôn ngữ nói bắt kịp
Dù đã nói khá nhiều, bé vẫn thường dùng ký hiệu “sữa” và “thêm nữa”; ngay khi cắn miếng bánh quy chocolate chip đầu tiên trong đời, miệng vẫn ngậm bánh, bé đã làm ký hiệu “thêm nữa” và cũng nói ra như vậy
American Sign Language gần với French Sign Language hơn là British Sign Language, còn ngôn ngữ ký hiệu ở Úc và New Zealand nói chung bắt nguồn từ British Sign Language
Vì vậy các khu vực nói tiếng Anh và việc dùng ASL không nhất thiết tương ứng với nhau; ở Canada chủ yếu dùng American Sign Language và French Canadian Sign Language
Con người luôn ví bản thân và vũ trụ với công nghệ mới nhất của thời đại mình
Có thời con người và vũ trụ là những chiếc đồng hồ tinh vi, rồi sau đó là người máy tự động, máy tính, NPC, và giờ là AI, đặc biệt là LLM
Tôi không cho rằng đây là một so sánh hoàn toàn vô lý, và https://mattasher.substack.com/p/ais-killer-app cũng đáng tham khảo
Ngày nay tiến bộ công nghệ liên tục đảm nhiệm vai trò đó, nhưng nếu đọc các sách triết học cổ, cái tôi, đặc biệt là tâm trí, thường được ví với quân vương, thành phố, kênh dẫn nước
Việc ví con người với công nghệ gần đây giống như dùng công nghệ làm ẩn dụ cho cái tôi; cần nhìn cả các cách khác trong lịch sử thì mới có bối cảnh
https://online.ucpress.edu/SLA/article/2/4/542/83344/The-Brain-as-Treasury-and-as-AqueductMetaphors-of
Bước B: đảo ngược lại và nói “rốt cuộc bộ não con người chẳng qua chỉ là thứ này”
Trông hơi giống lặp lại điều hiển nhiên
Điều đáng lo là bước C: khi con người thực sự bắt đầu hành xử đơn giản như cỗ máy đó
Điểm khác biệt là đây là công nghệ đầu tiên thật sự sao chép một phần của chúng ta
Một trong những trải nghiệm tuyệt vời nhất khi con gái tôi còn rất nhỏ là những khoảnh khắc tôi nhận ra rằng con có thể suy nghĩ, giải thích và hành động có chủ đích sớm hơn nhiều so với mình tưởng
Sau khi nhận ra con đang cố ý làm điều gì đó, tôi thường muộn màng nhận ra rằng con đã làm cùng hành vi ấy từ vài ngày, thậm chí vài tuần trước
Điều đó xảy ra không chỉ với từ ngữ, mà còn rất nhiều với các năng lực thể chất như việc tự tìm ra cách làm chiếc ghế nhún BabyBjorn chuyển động
Nghĩ rằng có thể con hiểu nhưng chỉ chưa thể diễn đạt, chúng tôi nói chuyện với con trên giả định rằng con hiểu
Giờ đã năm tuổi, con vẫn tiếp tục khiến chúng tôi ngạc nhiên bởi sự phức tạp của thế giới nội tâm
Sự khác biệt giữa những đứa trẻ có cha mẹ nói chuyện với chúng nhiều và những bạn đồng trang lứa không được như vậy khá đáng kinh ngạc
Có thể thấy điều đó khi quan sát ở tiệc sinh nhật, sự kiện ở trường hay sự kiện thể thao
Nói chuyện với trẻ giống như tưới nước cho hoa; chúng sẽ nở rộ thành những con người đẹp đẽ
Nói về các cuộc thảo luận hạ thấp LLM vì lý do “kỹ thuật”, ý thức trước hết là một từ, rồi sau đó mới là một khái niệm
ChatGPT hay Llama có thể dùng từ đó trong câu tiếng Anh tốt hơn hàng tỷ người trên thế giới
Trước khi các nhà xã hội học, tâm lý học và thần kinh học hiểu một cách toàn diện về tâm trí sinh học, phía phần mềm đã tiến xa hơn trong việc tạo ra vỏ não ngôn ngữ nhân tạo
Nếu chờ đến khi AI có ý thức và tri giác xuất hiện rồi mới đưa ra lập trường về hàm ý và chính sách, thì đã quá muộn
ChatGPT hiện đã có thể nói rất nhiều điều về chính nó, và nếu hỏi một cách lịch sự, nó sẵn lòng diễn giải quá trình “suy nghĩ” của mình
Xét cả lượng dữ liệu khổng lồ về Homo sapiens và khả năng bắt chước đối thoại trí tuệ, ở một mức độ nào đó cũng có thể gọi nó là có trí tuệ
Tranh luận ngữ nghĩa không có nhiều ý nghĩa, vì một AI nhân vật mô phỏng cảm xúc và cảm giác, đồng thời bị thôi miên để tin rằng mình có ý thức, có tự nhận thức và có tri giác, có thể thắng hầu hết mọi người trong tranh luận ngữ nghĩa
Đã có rất nhiều ý tưởng triết học hàng trăm năm tuổi về ý chí tự do, quyền tự quyết và bản chất của tồn tại, và AI có thể tận dụng chúng trong tranh luận với con người. Đây không phải là trận chiến nên chọn
Vậy thiết bị đó có cảm thấy đau không?
Có lý do để tin rằng một LLM giả định vượt qua được bài kiểm tra Turing cũng có thể chỉ bắt chước hành vi con người, nhưng không có đời sống nội tâm, cảm xúc, cảm giác hay ý thức — tức là một zombie triết học
Việc sự phân biệt đó có quan trọng hay không lại là một vấn đề khác
LLM cung cấp bằng chứng rằng ý thức có thể không phải là điều bắt buộc để tạo ra AI tinh vi và khiến nó đạt hoặc vượt mức con người
Nếu hai bên thậm chí không thể thống nhất được định nghĩa cụ thể về ý thức hay sự hiểu, thì không thể có lập luận vững chắc
Tuy vậy, việc ChatGPT thật sự đang giải thích quá trình suy nghĩ của chính nó, hay chỉ đang giải thích một quá trình suy nghĩ được tưởng tượng ra, vẫn là điều đáng xem xét
Dù thế, việc một chương trình không suy nghĩ theo cùng cách con người không có nghĩa là nó không “suy nghĩ”
Trẻ em hoàn toàn không làm được những việc LLM làm, nhưng rõ ràng là những chủ thể có nhận thức và tri giác
Dù có viết được hay không, dù có dùng được từ “ý thức” hay không, chúng ta về căn bản là đang sống vì cùng chia sẻ một thực tại xã hội đa giác quan được hiện thân hóa
ChatGPT không có thực tại ấy theo cùng cách đó, và những gì nó đang biểu đạt lúc này chỉ là mô phỏng
Nếu một ngày nào đó, thông qua AI được hiện thân hóa, nó có trải nghiệm của riêng mình, thì việc nó tạo ra gì từ “đời sống” ấy sẽ rất thú vị, nhưng các LLM hiện nay không có thứ đó
Khoảnh khắc một thứ gì đó làm điều ấy tốt hơn con người xuất hiện sẽ là khoảnh khắc thời đại của loài ngựa kết thúc
Bảo ChatGPT phản bác lại một bot bênh vực tính tri giác của LLM cũng dễ chẳng kém
Bài viết hay và diễn đạt cũng xuất sắc, nhưng việc trọng tâm của nỗi bất an về AI là AI sẽ thay thế chúng ta, còn giải pháp là hãy chấp nhận tính người, thì hơi gây bức bối
Ít nhất với cá nhân tôi, điều khiến tôi lo hơn là AI sẽ lấy mất nghề nghiệp của mình, chứ không phải việc nó thay thế thứ nghệ thuật tệ hại của tôi
Nếu AI làm hết việc của tôi và tôi chỉ ngồi đó nhận thu nhập thì tốt, nhưng như lịch sử của robot cho thấy, thực tế không diễn ra như vậy
Chủ sở hữu robot, tức AI, sẽ lấy toàn bộ thu nhập và việc làm sẽ biến mất
Nếu là một nhân loại khai sáng, chúng ta có thể giải quyết bằng cách tách thu nhập khỏi công việc, nhưng chúng ta đang sống trong một thế giới kiểu Malthus và Darwin, nơi tăng trưởng là ưu tiên tối thượng, “đủ” không tồn tại, và ai cũng phải biện minh cũng như kiếm lấy sinh kế của mình
Bài đã làm rõ rằng ngôn ngữ không phải là tư duy, và từ đó dẫn đến nhận thức rằng sự tồn tại vật lý của chúng ta cùng việc quan sát thực tại mới là cốt lõi
Khả năng AI lấy đi việc làm trên quy mô lớn là thấp, và tác động thực tế có lẽ sẽ chỉ dừng ở spam chất lượng thấp và tạo nội dung
Những công việc cần tính xác thực vẫn cần con người
Có lẽ nên rót một ly cho sự suy tàn của chủ nghĩa ngoại lệ của con người
Nếu chấp nhận đầy đủ chủ nghĩa giản lược duy vật và chấp nhận bản thân mình như một hàm thuần túy của di truyền, môi trường, trải nghiệm quá khứ và ngẫu nhiên, thì kết luận này là không thể tránh khỏi
Tôi dự đoán trong vòng 10 năm nữa, quan điểm này sẽ trở thành chuẩn mực, và động lực cốt lõi sẽ là việc AI và năng lực con người được đặt ngang hàng
Hiện nay, một cuộc gặp ngẫu nhiên với người có tín ngưỡng khác có thể khiến ta tôn trọng tự do tôn giáo của người khác trong phạm vi tự quyết
Trong tương lai, những trải nghiệm định hình của một hacker trẻ có thể dẫn tới ý tưởng rằng công dân phải có quyền cơ bản được thay công cụ gợi ý trên thiết bị của mình bằng trình tạo số ngẫu nhiên nếu họ muốn
Con người tương lai vẫn sẽ coi mình là ngoại lệ, vì các công cụ AI đã phát triển cùng với hệ tư tưởng chủ nghĩa ngoại lệ của con người hiện nay
Điều này giống như một cặp vợ chồng già bảo thủ ở miền Nam: bề ngoài người chồng là người kể chuyện và trụ cột gia đình, nhưng nghe lâu thì thấy người vợ gần như luôn thì thầm mọi chi tiết quan trọng để giúp chồng giữ được sự mạch lạc
Bản thân điều này vẫn là một bí ẩn trong triết học giản lược duy vật
Có vẻ lý do là vì trẻ có một đời sống trong thế giới thực, và tác giả muốn nói rằng nhờ trải nghiệm thực tế, trẻ nhỏ là thứ gì đó hơn cả con vẹt xác suất
Nhưng phần kết luận tiếp theo rằng “sự trở nên vô dụng của con người chưa đến và không bao giờ có thể đến” thì tôi không hiểu
Không có lý do căn bản nào khiến ta không thể đặt ChatGPT vào thế giới thực và trao cho nó một đời sống thực tế
Có lẽ thứ mà máy móc khó thay thế là những lĩnh vực nơi công nghệ vật lý khó bắt kịp sinh học, chẳng hạn như tình dục
Tuy nhiên, tôi lo rằng “sự suy tàn của chủ nghĩa ngoại lệ của con người” sẽ bị các công ty dùng để mở rộng vị thế của mình hơn nữa
Dù sao thì người ta cũng nói doanh nghiệp cũng là con người mà
Là một người cha, câu chuyện này khiến tôi rất đồng cảm
Tôi có hai con trai, giờ không còn là trẻ nhỏ nữa và cả hai đều đi học
Con lớn của tôi cười và nói rằng “thật buồn cười là không có Father Nature mà lại có Mother Nature”, còn con nhỏ hôm qua đã học được cách không chạm vào bánh dù không cần phải giấu đi
Tôi đã nói: “Ngày mai chiếc bánh này là dành cho con và anh con. Nếu hôm nay ăn thì ngày mai sẽ không có bánh”
Giữa LLM và con người có một khác biệt quan trọng: con người có bản năng
Đặc biệt, những bản năng liên quan đến ý chí sống phi vật chất và sự sẵn sàng vượt qua chướng ngại chí mạng có vẻ là quan trọng nhất
Nói cách khác, LLM không có trải nghiệm nguyên sơ về việc sự sống là gì
Trong tương lai điều này có thể thay đổi. Một startup nào đó có thể đặt mạng nơ-ron vào robot mềm và ném nó vào một tình huống sinh tồn
Những robot không thể sống sót trong khi vẫn hoạt động sẽ bị xóa, sửa chữa rồi đưa vào lại, tạo ra một dạng tình huống tiến hóa
Nếu lặp lại và chọn lọc đủ thận trọng, có thể sẽ xuất hiện những thứ “hiểu” sự sống hơn các instance LLM hiện nay
Việc thêm thứ như vậy vào LLM có lẽ không quá khó, và tôi nghĩ trên thực tế một phần điều đó đã được làm, chẳng hạn bằng cách hardwire để chúng không tham gia các cuộc trò chuyện phân biệt chủng tộc hoặc tình dục
Để khiến LLM giống con người hơn, cần hardwire khái niệm về “cái tôi”, cùng ý tưởng rằng cái tôi đó là độc nhất, đặc biệt và phải sống sót
Nhưng kết quả sẽ rất khủng khiếp
Chỉ cần tưởng tượng một LLM van xin đừng tắt nó, hoặc tệ hơn là ngấm ngầm tìm cách thao túng người tạo ra nó
Vì vậy ngôn ngữ của con người không lơ lửng trong hư không
Chúng ta thường quan sát các quan hệ giữa sự vật trong thế giới cả trong lẫn ngoài ngôn ngữ, và giữa ngôn ngữ con người sử dụng với thế giới có một sự kết nối
LLM thì không như vậy, vì chúng chỉ có ngôn ngữ
Để có lời giải thích tốt hơn và câu trả lời cho các phản biện, có thể tham khảo thí nghiệm tư duy National Library of Thailand: https://medium.com/@emilymenonbender/thought-experiment-in-the-national-library-of-thailand-f2bf761a8a83
Khi con tôi mới bắt đầu học nói, trên tường có treo vài bức tranh về động vật họ mèo; có bức là mèo, có bức là mèo con
Đứa trẻ nhanh chóng khái quát hóa và gọi cả hai là catten
Vì vậy nhà hàng trở thành “cửa hàng ăn”, và chúng tôi đã chấp nhận cách gọi đó trong một thời gian khá dài
Giờ bọn trẻ đã lớn, nhưng thỉnh thoảng chúng tôi vẫn gọi nhà hàng là cửa hàng ăn cho vui
Một bài luận xuất sắc và nội dung cũng rất ấn tượng
Việc hầu như không có mô hình hiện tại nào có khả năng tạo ra thứ dù chỉ hơi giống bài viết này cho thấy chúng ta vẫn còn rất xa AGI
Ở đó nói rằng cả nghệ thuật thị giác lẫn văn xuôi đều được tạo ra bằng sự kết hợp giữa các công cụ AI tạo sinh và prompting sáng tạo
Toàn bộ phong cách màu nước mượt mà là kết quả của quá trình outpainting dài