3 điểm bởi GN⁺ 2024-07-12 | 1 bình luận | Chia sẻ qua WhatsApp
  • Đơn giản hóa việc chọn tên em bé thành một bài toán ra quyết định mang tính cạnh tranh, và dùng lý thuyết trò chơi để xem phân bố nào xuất hiện khi cha mẹ chỉ hành động dựa trên tính độc nhất của cái tên
  • Giả định cha mẹ là các tác nhân cận thị (myopic) và có đầy đủ thông tin, từ đó xây dựng một mô hình đặt tên có thể phân tích được
  • Trong khi hình thức hóa thiết lập cơ bản, các tham số và cấu trúc khuyến khích của cha mẹ, bài viết chỉ ra rủi ro của hành vi cận thị xuất hiện trong những cách diễn giải đơn giản
  • Thí nghiệm số cho thấy phân bố tên gọi và kết quả chiến lược có thể thay đổi theo sự biến thiên của các tham số
  • Bài viết cũng bao gồm phân tích về công cụ mô hình ngôn ngữ lớn và các hướng nghiên cứu trong tương lai; phần nghiên cứu liên quan liệt kê các công trình về đặt tên theo kiểu đùa vui

Trò chơi xoay quanh tính độc nhất của cái tên

  • Tên của một đứa trẻ được xác định ngay sau khi sinh mà không có ý kiến hay sự chấp thuận của chính đứa trẻ, theo truyền thống sẽ được giữ suốt đời và được giả định là có ảnh hưởng lớn đến quỹ đạo cuộc sống sau này
  • Cha mẹ phải đưa ra quyết định trong lĩnh vực cạnh tranh là đặt tên, hầu như không được đào tạo về lý thuyết trò chơi
  • Trong mô hình, cha mẹ được đơn giản hóa như sau
    • Tác nhân cận thị
    • Tác nhân có đầy đủ thông tin
    • Tác nhân chỉ chọn dựa trên tính độc nhất của cái tên
  • Dựa trên thiết lập này, bài viết hình thức hóa cấu trúc cơ bản của trò chơi đặt tên, các tham số, cũng như những thuộc tính và động lực của cái tên mà cha mẹ mong muốn
  • Trong cách diễn giải mô hình đơn giản nhất, vấn đề cốt lõi là lựa chọn cận thị của cha mẹ có thể tạo ra những cạm bẫy nào cho chiến lược đặt tên

Thí nghiệm và thảo luận mở rộng

  • Các thí nghiệm số đóng vai trò xác nhận phân bố tên gọi dịch chuyển như thế nào bên trong mô hình
  • Khi thay đổi các tham số, kết quả của chiến lược đặt tên cũng có thể thay đổi, nên việc theo đuổi tính độc nhất một cách đơn thuần không phải lúc nào cũng dẫn đến cùng một kết quả
  • Ngoài các thí nghiệm số, bài viết còn đề cập đến phân tích về công cụ mô hình ngôn ngữ lớn
  • Phần cuối cùng tổng hợp các hướng nghiên cứu trong tương lai
  • Phần nghiên cứu liên quan có cấu trúc đùa vui: sau khi nói rằng “hoàn toàn không có nghiên cứu nào trước đó”, tác giả liệt kê nhiều công trình đi trước với điều kiện rằng chúng được “thuận tiện bỏ qua”

1 bình luận

 
GN⁺ 2024-07-12
Ý kiến trên Hacker News
  • Danh sách tác giả là Katy Blumer, Kate Donahue, Katie Fritz, Kate Ivanovich, Katherine Lee, Katie Luo, Cathy Meng, Katie Van Koevering; nói cho những ai không quen với tên gọi trong thế giới nói tiếng Anh thì tất cả đều là những cái tên giống Katherine hoặc bắt nguồn từ đó

    • Phần buồn cười nhất là bài báo tự trích dẫn một cách đệ quy như bằng chứng cho việc có quá nhiều phụ huynh chọn cùng một cái tên phổ biến
      “Ví dụ, có phụ huynh có thể kỳ vọng rằng tên ‘Kate’ vừa mang cảm giác truyền thống dễ chịu, vừa độc đáo, lại có mức độ phổ biến vừa phải. Họ đã sai [6].” Ở đây tài liệu tham khảo số 6 chính là bài báo này
    • Tựa bài báo cũng là một cách nhắc tới tiểu thuyết tuổi teen nổi tiếng của John Green "An Abundance of Katherines"
    • Một trường hợp tương tự là A Few Goodmen: Surname-Sharing Economist Authors của Goodman, Goodman, Goodman, Goodman: https://scholar.harvard.edu/files/joshuagoodman/files/goodma...
      Ngoài ra còn có (Para)bosons, (para)fermions, quons and other beasts in the menagerie of particle statistics của O.W. Greenberg, D.M Greenberger, T.V. Greenbergest: https://arxiv.org/abs/hep-ph/9306225
      Theo lời tôi nghe từ Wally Greenberg thì T.V. là viết tắt của “the very”. Và cũng cần lưu ý rằng bài viết gốc là bài đăng ngày 1 tháng 4
    • Vài năm trước có KatieConf, một sự kiện nhằm làm nổi bật tình trạng thiếu diễn giả nữ tại các hội nghị công nghệ
      https://2019.katieconf.xyz/
    • Tôi chợt thắc mắc liệu “Katerina” có liên quan không; thường được rút gọn thành “Kat”, và phần từ nguyên tôi thấy ở đây khá thú vị: https://www.behindthename.com/name/katherine
  • Có khá nhiều chi tiết gây cười rất hợp lý
    “Bài báo này được viết vào năm 2024, vì vậy nó có kèm theo phần bắt buộc nói về generative AI và LLM.”
    “Một ERA khác là giả định phụ huynh phù du, trong đó mọi phụ huynh đều chết ngay sau khi đặt tên cho con, điều này khiến toán học trở nên dễ hơn đáng kể.”
    “Ai cũng biết rõ rằng các bậc phụ huynh luôn hoàn toàn đồng thuận về việc họ muốn đặt tên gì cho đứa trẻ mới sinh.”

    • Tôi cũng thích câu “Chúng tôi khẳng định không có cơ sở rằng phân phối log-normal là hợp lý...”, và đặc biệt thích ảnh chụp màn hình ChatGPT bị cắt hơi cụt ở hình 8 với dòng “Can you write me a paper on the game theory of names”
    • Biểu đồ phân phối hình khủng long và mực ống cũng rất buồn cười
    • Danger 5 đúng là đỉnh nhất: https://imgur.com/P80uqLB
  • Nhìn vào tài liệu tham khảo [12], có vẻ tiêu đề bài báo được lấy cảm hứng từ tác phẩm trước đó: https://en.wikipedia.org/wiki/An_Abundance_of_Katherines
    Xét ngày nộp là 31 tháng 3 năm 2024 thì có lẽ họ định phát hành nó như một bài báo Cá tháng Tư

  • Tôi nghĩ Wait But Why đã phân tích lý thuyết đặt tên cho em bé cực kỳ hay: https://waitbutwhy.com/2013/12/how-to-name-baby.html

    • Tôi cho rằng việc một số tên em bé bị xem là nhàm chán là một hiểu lầm
      Ít có gì bớt nhàm chán hơn một cái tên được một con người nhỏ bé, đầy năng lượng, tự tin tiếp nhận như thể “đây là tôi”. Với tên đồ chơi thì bạn có thể muốn một cái tên nổi bật để tự thuyết phục mình, nhưng với một đứa trẻ thì hoàn toàn không thành vấn đề
    • Freakonomics cũng từng nói về chuyện này: [0]
      “Một trong những mô thức dễ dự đoán nhất liên quan đến tên gọi là hầu như mọi cái tên trở nên phổ biến đều ban đầu xuất phát từ tầng lớp thượng lưu hoặc nhóm có học vấn cao. Trong dữ liệu California, chúng tôi có thể xem trình độ học vấn của cha mẹ, và ngay cả những cái tên về sau bị xem là ‘sến sẩm nhất’ như Tiffany, Brittany, Caitlyn cũng bắt đầu ở phần trên của phân bố thu nhập, rồi trong 20, 30, 40 năm dần trôi xuống dưới và ngày càng phổ biến hơn trong nhóm ít học hơn.”
      Mabel trong bài báo có vẻ là một ví dụ về việc tên thịnh hành quay trở lại. Hipster khôi phục nó, rồi các bậc phụ huynh thượng lưu có gu kiểu hipster lan truyền nó, sau đó nó khuếch tán ra đại chúng. Mẹo là chọn một cái tên nghe cũ hoặc lạ nhưng sẽ trở nên phổ biến trong quãng đời của đứa trẻ. Nếu là bây giờ, tôi có thể chọn những cái tên như Linda hoặc Iris
      Tôi cũng muốn xem phân tích về số âm tiết. Khi nào những tên hai âm tiết kiểu thế hệ baby boomer sẽ thịnh hành trở lại?
      [0] https://freakonomics.com/podcast/how-much-does-your-name-mat...
    • Phòng khi có ai thắc mắc: chữ why ở đây không phải là why này: https://viewsourcecode.org/why/
  • Cũng có bài báo của Jinseok Kim, Jenna Kim, Jinmo Kim mang tên “Effect of Chinese characters on machine learning for Chinese author name disambiguation: A counterfactual evaluation”
    Dù các tác giả không mang tên tiếng Trung, cá nhân tôi nghĩ nếu ai đó có một cái tên cần phân biệt người trùng tên thì cũng dễ quan tâm đến lĩnh vực nghiên cứu này. Bài báo cũng nói rằng tên tiếng Hàn gặp cùng một vấn đề
    https://journals.sagepub.com/doi/full/10.1177/01655515211018...

    • Thói quen chỉ ghi họ hoạt động tốt ở những nền văn hóa mà họ dài, dễ phân biệt và tên riêng thì phổ biến, nhưng ở những nơi họ ngắn, phổ biến, còn phần lớn thông tin nằm ở tên riêng thì đó là một cách làm khá lố bịch
  • Đọc câu “...chúng tôi xây dựng một mô hình không chỉ dễ xử lý và gọn gàng mà còn nắm bắt hoàn hảo thế giới thực” là biết ngay bầu không khí kiểu gì
    Khiếu hài hước của các tác giả rất tốt

  • “Mô hình trên bao gồm một số giả định cực kỳ hợp lý (ERA). [...] Một ERA khác là giả định cha mẹ phù du, theo đó mọi bậc cha mẹ đều chết ngay lập tức sau khi đặt tên cho con, điều này khiến toán học trở nên đơn giản hơn đáng kể.”
    Bài báo này đầy những câu hài hước như vậy

  • Nghe như An Abundance of K8s chứ không phải “An Abundance of Katherines”

    • Kubernetes đúng là một cái tên con gái rất đáng yêu
    • Có phiên bản bi kịch hơn là Keighty
    • KT’s cũng được
  • Đêm nằm không ngủ và nghĩ về bài toán đặt tên em bé
    Tôi muốn tên con nằm ở một điểm vừa phải. Không quá phổ biến, cũng không quá độc lạ, và đặc biệt không phải kiểu chỉ thịnh hành trong một giai đoạn ngắn đến mức chỉ nghe tên là đoán được gần đúng tuổi của người đó[0]
    Nhưng những người nghĩ theo kiểu này cuối cùng lại dồn vào cùng một số ít cái tên, vô tình tạo ra đúng hiệu ứng “quá nổi trong một thời gian ngắn” mà họ muốn tránh. Tôi đã thất bại một lần rồi: tên con mèo của tôi là Olivia, và hóa ra đó lại là tên bé gái phổ biến của thập niên 2010
    [0] Tên tôi cũng là một trong những kiểu như vậy nên khá bực mình

    • Tôi chưa từng định có con, nhưng nếu có thì tôi có vài quy tắc đặt tên
      1. Đặt luôn cái tên mà bạn thực sự sẽ gọi. Nếu muốn gọi là “Kate” thì đừng đặt là “Katherine”, nếu muốn gọi là “Sam” thì đừng đặt là Samuel
      2. Đừng đặt trùng tên với người thân gần
      3. Đừng lấy một cái tên phổ biến rồi viết chính tả kiểu độc lạ. Như vậy chỉ khiến người đó phải đánh vần tên mình suốt đời mỗi khi nói tên ra
        Bố mẹ tôi đã vi phạm hai quy tắc đầu khi đặt tên cho tôi, và điều đó gây ra không ít phiền toái khi tôi lớn lên. Khi tôi thực tập ở Intel cũng xảy ra vấn đề vì bố tôi đã làm ở đó suốt 15 năm, nên có email đáng lẽ gửi cho bố lại đến chỗ tôi và ngược lại
    • Có lý do gì để không để đứa trẻ mang dấu ấn của thời đại nó sinh ra không? Dù chọn tên gì thì chắt của họ cũng sẽ chẳng nhìn tên bà cố rồi nghĩ rằng đó là một cái tên thật ngầu và đúng thời
    • Tôi có thể đề xuất https://www.fantasynamegenerators.com không?
      Khác với tên fantasy, danh mục tên ngoài đời thực cũng khá lớn. Tôi nói nghiêm túc đấy. Danh sách tên em bé là kiểu quá tải thông tin điển hình với hàng nghìn lựa chọn, còn dùng trình tạo ngẫu nhiên thì bạn có thể xem 10 cái tên, không thích thì bốc thêm 10 cái nữa
    • Tôi đề xuất trang của Social Security Administration: https://www.ssa.gov/oact/babynames/
      Bạn có thể lùi về 100 năm trước hoặc bất kỳ giai đoạn nào muốn để xem danh sách, rồi nếu tìm được một cái tên mình thích mà hiện giờ không còn nằm trong top X thì khá an toàn. Bạn sẽ có một cái tên hợp lý nhưng không quá kỳ quặc, và phần lớn cũng không có nhiều người cùng thế hệ hiện nay mang tên đó. Trang này cũng có dữ liệu các năm gần đây, và tên thường không bật từ ngoài bảng xếp hạng lên thành tên cực hot chỉ sau một đêm
      Việc nó là “tên bé gái phổ biến của thập niên 2010” cũng cần tính đến chuyện rằng trong thời đại Internet, một cái tên phổ biến nhưng không tối ưu cho tìm kiếm đôi khi lại là điều tốt. Tất nhiên điều đó còn phụ thuộc nhiều vào họ
    • Tôi thích việc có một cái tên như vậy. Vì từng phổ biến nên đó là cái tên quen thuộc, nhưng tôi chỉ gặp vài người có cùng tên với mình
      Điều thú vị là khi kết hợp với một họ có mức độ phổ biến tương tự, ở Mỹ chỉ có khoảng 30 người trùng cả họ lẫn tên với tôi
  • “Nộp ngày 31 tháng 3 năm 2024” nên trông gần như là một trò đùa Cá tháng Tư
    “Mô hình trên bao gồm một số giả định cực kỳ hợp lý (ERA). Giả định cực kỳ hợp lý đầu tiên là một giả định rất bảo thủ: chỉ có một giới tính duy nhất, và mọi đứa trẻ cùng mọi cái tên đều thuộc cùng giới tính đó. Vì vậy, bất kỳ cái tên nào, miễn là tồn tại trong danh sách, đều có thể gán cho bất kỳ đứa trẻ nào. Một ERA khác là giả định cha mẹ phù du, theo đó mọi bậc cha mẹ đều chết ngay lập tức sau khi đặt tên cho con, điều này khiến toán học trở nên đơn giản hơn đáng kể.”

    • Ở New Zealand và Australia thì khi đó đã là Cá tháng Tư rồi, chỉ là các múi giờ GMT-XX theo sau hơi chậm thôi
    • SIGBOVIK lúc nào cũng diễn ra rất gần Cá tháng Tư :)