PhysicsForums và thuyết Internet đã chết
(hallofdreams.org)- Trong kho lưu trữ cũ của cộng đồng khoa học PhysicsForums, ra đời năm 2001, đã phát hiện dấu vết các bài viết do LLM tạo ra được chèn vào với ngày tháng trong quá khứ và gán cho tên người dùng hiện có
- Bằng cách đối chiếu mối quan hệ tăng đơn điệu giữa ID bài đăng và thời điểm viết, người ta tìm ra mẫu chèn ngược; sau khi loại trừ các ngoại lệ hợp lệ như vụ sáp nhập MathHelpBoards, khoảng 115.000 bài đăng được ước tính là do LLM viết
- Trường hợp tiêu biểu là tài khoản ravenprp: trong bản ghi Wayback Machine năm 2019 chỉ có 74 bài đăng, nhưng hiện hiển thị 2.891 bài; 2.817 bài được thêm vào trải dài cả trước/sau thời điểm tạo tài khoản và sau lần đăng nhập cuối cùng
- Các bài đăng do LLM tạo ra được ước tính chiếm khoảng 1,6% tổng số bài đăng và khoảng 3% tổng số từ, nhưng nếu tính cả FAQ và phần tóm tắt, tỷ lệ từ ngữ do con người viết trên toàn site giảm xuống còn 66%
- Greg Bernhardt trả lời rằng các tính năng AI và thử nghiệm bằng tài khoản test chưa đạt tiêu chuẩn chất lượng, nhưng việc gắn bài viết vào danh tính người dùng hiện có mà không có sự đồng ý làm tổn hại niềm tin cộng đồng và tính toàn vẹn của kho lưu trữ
Giá trị lưu trữ của một diễn đàn khoa học lâu đời
- PhysicsForums là cộng đồng khoa học do Greg Bernhardt khởi xướng năm 2001, chủ yếu mang tính chất diễn đàn cung cấp gợi ý cho bài tập vật lý
- Site tăng trưởng khá đều đặn đến năm 2012, nhưng sau đó sự chú ý chuyển sang các site tập trung như StackExchange, và đến năm 2025 chỉ còn một cộng đồng nhỏ
- Khác với nhiều diễn đàn web thời kỳ đầu, PhysicsForums vẫn giữ URL từ năm 2003 đến 2025, không xóa bài cũ hay đóng site, nên còn lại như một viên nang thời gian của Internet đầu thập niên 2000
Dấu hiệu bất thường lộ ra từ tài khoản ravenprp
- Tài khoản ravenprp hiện có vẻ đã viết 2.891 bài trong 7 tháng, từ tháng 9/2006 đến tháng 4/2007
- Trung bình hơn 13 bài mỗi ngày, và về nội dung thì qua lại giữa nhiều danh tính như giảng viên đại học, sinh viên cơ khí, nhà tuyển dụng cho nhà máy hóa chất, kỹ sư kết cấu, nhà sinh học, nhà vật lý y khoa, nhà hóa học, kỹ sư hàng không vũ trụ...
- Một số bài được hiển thị là đã viết từ 3 năm trước khi tài khoản được tạo cho đến 1 năm sau lần đăng nhập cuối cùng
- Dù còn 7 năm nữa OpenAI mới được thành lập, có bài còn đùa rằng mình là “mô hình ngôn ngữ do OpenAI phát triển”
- Trong bản ghi Wayback Machine năm 2019, số bài đăng của tài khoản này là 74, nhưng hiện được hiển thị là 2.891
- Có vẻ tại một thời điểm nào đó sau đó, các bài đăng đã được chèn trực tiếp vào cơ sở dữ liệu, còn ngày tham gia hay thông tin đăng nhập cuối trên hồ sơ không được cập nhật tương ứng
- Nếu chỉ nhìn 74 bài gốc, ravenprp gần giống một sinh viên kỹ thuật điện hỏi về sách MATLAB, xử lý vấn đề IC định thời 555 và chia sẻ liên kết về Bernoulli Equation
- Những suy nghĩ và bài viết trong 74 bài do người thật viết gần như bị chôn vùi bởi 2.817 bài được thêm vào cùng tài khoản
Mẫu chèn ngược lộ ra qua ID bài đăng
- Bài đăng và thread của PhysicsForums có ID dạng số tuần tự
- Bình thường, ID bài đăng lớn hơn phải có thời điểm viết muộn hơn
- Có thể có ngoại lệ như xóa, khôi phục, tách thread, sự cố cơ sở dữ liệu, nhưng xu hướng tổng thể phải tăng đơn điệu
- Trong 30.000 bài đăng được thu thập ngẫu nhiên, quy tắc này được giữ trong hầu hết các giai đoạn
- Một ngoại lệ lớn là vụ sáp nhập với MathHelpBoards năm 2022
- Kho lưu trữ khoảng 150.000 bài đăng được tích hợp trong khi vẫn giữ nguyên ngày tháng gốc
- Sau khi loại trừ vụ sáp nhập MathHelpBoards và các trường hợp có vẻ gần với thời điểm viết thực tế, khoảng 115.000 bài đăng được ước tính là do LLM viết rồi gán cho tài khoản người dùng
- Theo mẫu đại diện, ít nhất 110 người dùng bị ảnh hưởng
- Bao gồm người bình luận đầu tiên, người viết một lần, độc giả lâu năm, cho đến nhà sáng lập kiêm quản trị viên Greg Bernhardt
- Mỗi tài khoản bị gắn thêm các quan điểm mà không rõ người dùng thật có đồng ý hay không
Vấn đề chất lượng do FAQ và tóm tắt tạo bởi LLM gây ra
- Trong thread năm 2007 về HP 50g Graphing Calculator, các câu trả lời và FAQ có vẻ do LLM tạo ra không làm tăng giá trị của thông tin gốc
- Câu trả lời do LLM viết trong thread đó chỉ đúng một sự thật là có tồn tại “HP 50g Connectivity Kit”; phần còn lại không được phản ánh trong HP 50g manual hay các tài liệu thực tế khác
- FAQ nhắc đến các hàm “GET” và “PUT”, nhưng các hàm đó cùng “HP 50g Spreadsheet” không xuất hiện trong manual, và kết quả tìm kiếm cũng không có gì ngoài thread đó
- Trong thống kê số từ của thread này, phần do LLM viết chiếm 92%
- Summary: 99 từ, không phải con người
- Springo: 38 từ, con người
- Phys.org: 34 từ, không phải con người
- Shinny_head: 11 từ, con người
- Ravenprp: 164 từ, không phải con người
- FAQ: 260 từ, không phải con người
- Nhìn toàn site, các bài đăng LLM được chèn ngược ước tính chiếm khoảng 1,6% tổng số bài đăng và khoảng 3% tổng số từ
- Nếu tính cả FAQ và tóm tắt do LLM tạo ra, tỷ lệ từ do con người viết trong toàn bộ PhysicsForums được tính là 66%
Nội dung AI do cộng đồng phát hiện và những thay đổi bị che khuất
- Người dùng PhysicsForums phát hiện một hiện tượng bất thường vào tháng 11/2024: tài khoản Azntoon có vẻ đã đăng vào một thread năm 2022, sau lần đăng nhập cuối cùng năm 2012
- Khi đó cuộc thảo luận được kết luận là có thể do sự cố cơ sở dữ liệu
- Sau đó ngày đăng nhập cuối của Azntoon bị đổi thành tháng 12/2022
- Người dùng diễn đàn đã thảo luận chính sách về câu trả lời tạo bởi ChatGPT từ năm 2022
- Vanadium 50 phàn nàn rằng các “bài viết hầu như không tỉnh táo” của ChatGPT tạo ra rất nhiều việc và có thể xem như một cuộc tấn công DoS
- Greg Bernhardt nói rằng Stack Overflow có vẻ đang thử cấm, và PhysicsForums ít nhất cũng nên đưa nội dung ChatGPT vào dạng trích dẫn
- Ngày 1/4/2023, tên hiển thị được đổi thành ChatGPT như một sự kiện Cá tháng Tư, nhưng không được hiểu là các bài đăng thực sự do ChatGPT viết
- Những người dùng bị ảnh hưởng bởi LLM bị ẩn khỏi tự động hoàn thành tìm kiếm, và liên kết hồ sơ trong bài đăng cũng bị gỡ bỏ
- Tình trạng này khiến việc bấm vào hồ sơ để kiểm tra các dấu hiệu bất thường như ngày đăng nhập cuối trở nên khó hơn
- Trong quá trình viết, vấn đề FAQ cũng được cộng đồng phát hiện và một cuộc thảo luận low-quality FAQ discussion được mở
- FAQ dường như không hiển thị với người dùng đã đăng nhập
- FAQ đã bị gỡ, nhưng các phần tóm tắt do LLM tạo ở đầu các thread đã đóng vẫn còn
Phản hồi của Greg Bernhardt và giải thích về thử nghiệm
- Khi được hỏi về việc PhysicsForums sử dụng LLM, Greg Bernhardt trả lời rằng nhiều thử nghiệm AI nhằm nâng cao giá trị cộng đồng đang được tiến hành
- Trong biểu mẫu phản hồi năm 2024, nhiều thành viên cho biết họ không muốn các tính năng AI, và ông trả lời rằng các tính năng này sẽ được cải thiện đáng kể hoặc bị gỡ bỏ
- Ông cho biết năm trước đã thử nghiệm câu trả lời AI bằng tài khoản test, nhưng không đạt tiêu chuẩn chất lượng
- Khi được hỏi thêm, ông trả lời rằng từng hình dung một bot cung cấp câu trả lời chất lượng cao cho các thread không có câu trả lời trong hơn một năm, nhưng kế hoạch đã thất bại
- Ông cũng cho biết đang cân nhắc phương án dọn dẹp toàn bộ vì các thread không có câu trả lời làm diễn đàn lộn xộn
Danh tính tài khoản và tính toàn vẹn của kho lưu trữ
- Cách lấp đầy tài khoản người dùng hiện có bằng bài viết do LLM tạo làm lung lay kỳ vọng rằng danh tính tài khoản trong cộng đồng trực tuyến thuộc về người dùng
- Ngay cả với các tài khoản tương đối ẩn danh, những bài viết người dùng viết dưới tên đó và thời gian họ bỏ ra vẫn gắn với danh tính thật
- Khi khế ước xã hội rằng ta chủ yếu tương tác với con người bị phá vỡ, giá trị của tương tác giữa người với người mà cộng đồng trực tuyến mang lại sẽ giảm đi
- Nội dung web cũ vốn đã khó tìm vì máy chủ biến mất và site đóng cửa; nếu trộn thêm dữ liệu AI tạo ra với ngày tháng trong quá khứ, việc nghiên cứu kho lưu trữ Internet càng khó hơn
- Việc vận hành diễn đàn chịu nhiều áp lực như chi phí máy chủ, bảo trì cơ sở dữ liệu, bot, DDoS, quảng cáo và cạnh tranh lượt nhấp, nhưng nếu vì sinh tồn mà làm tổn hại danh tính cốt lõi của cộng đồng và niềm tin người dùng, nền tảng của site sẽ yếu đi
1 bình luận
Ý kiến trên Hacker News
Điều tôi ngày càng cảm nhận rõ hơn ở nội dung do LLM tạo ra là không ai muốn nó cả
Nếu muốn trò chuyện với AI thì cứ trực tiếp nói chuyện với AI là được. Lý do đọc blog hay diễn đàn thảo luận là vì muốn xem bài viết do con người viết, chứ không phải đọc những đoạn văn LLM tạp nham được copy-paste dưới tên người thật
Dạo này tôi tốn khá nhiều thời gian và năng lượng để tránh nội dung LLM trên web. Đang đọc mà thấy kiểu văn phong ChatGPT như “As we dive into the ever-evolving realm of...” là tôi quay lại ngay, còn khi tìm kiếm hình ảnh thì thêm một đống bộ lọc loại trừ như
-AI,-Midjourney,-StableDiffusion. Có những lượt tìm kiếm tôi còn giới hạn trước năm 2022Nếu Google thêm một bộ lọc toàn cục “loại bỏ nội dung sinh” hoạt động đúng nghĩa, chắc tôi sẽ bật lên và không bao giờ tắt nữa. Cũng từng có nghiên cứu cho thấy người dùng ghét ngay lập tức những nội dung trông có vẻ do AI tạo ra, bất kể chất lượng, nên các nhà xuất bản có động cơ tẩy rửa cho giống con người các bài viết AI để chúng trông như do người viết. Đây là lần đầu tôi thấy cách thao túng timestamp và chiếm đoạt tài khoản cũ
Trên Reddit tôi từng thấy những bài kiểu “tôi không rõ lắm, nhưng ChatGPT nói thế này”, và tệ hơn nữa là có người đăng nguyên phần copy-paste từ ChatGPT như thể đó là bài của mình. Buồn cười là văn phong trông như bài do người phòng nhân sự viết, nên rất dễ nhận ra
Nếu không tiếp cận được mô hình tốt thì có thể vẫn có chút giá trị, nhưng kiểu tạo một trang tĩnh dài mười đoạn chỉ để trả lời vụng về một câu hỏi thì chẳng ai thích cả. Giao diện chatbot thực sự có thể trình bày thông tin theo cách phù hợp với tôi, còn những bài danh sách tạp nham chỉ là mẫu số chung thấp nhất dành cho nhóm độc giả rộng nhất
Một vấn đề nữa là diễn đạt lại thông tin không làm phát sinh thông tin mới. Khi tìm loại dầu cần đổ cho ô tô hay công thức muffin việt quất, tôi cần bằng chứng thực tế như nhà sản xuất có yêu cầu dùng một cấp dầu cụ thể hay không, hoặc có ai đã thật sự nướng thử và kiểm chứng kết quả chưa. Việc nhai lại văn bản từ nguồn khác nhìn chung chẳng thêm được gì cho cuộc sống của tôi
Khi cảm thấy bài viết là do LLM tạo ra, tôi xem đó là tín hiệu rằng tác giả cũng chẳng biết nhiều hơn tôi, và tôi không có cách nào tin rằng thông tin đó là đúng
Nhiều khách hàng ghét nhân viên bán hàng, và một số người vì nhân viên bán hàng mà rời khỏi cửa hàng hoặc không bước vào, khiến cửa hàng mất doanh thu. Thế nhưng tập quán này vẫn tiếp diễn. Với AI cũng nên chuẩn bị cho điều tệ nhất. Cảm giác đạo đức, phán đoán kinh doanh hay tính hợp lý đều sẽ không ngăn được các công ty nhồi AI vào mọi nơi. Có vẻ họ coi việc làm khách hàng khó chịu là quan trọng hơn
Xu hướng Google bắt đầu dần không đưa các bài viết forum truyền thống và blog lên thứ hạng cao trong tìm kiếm từ khoảng đầu thập niên 2010 nếu đó không phải là các trang “lớn”, bất kể chất lượng, cũng khớp với trải nghiệm blog của tôi
Ngược lại, việc từ 2003 đến 2025 họ không đổi URL, không xóa các bài cũ, và trang cũng không biến mất là điều đáng nể. Bookmark blog của tôi từ năm 2008 đến giờ vẫn còn hoạt động
CMS giờ đã không còn, tất cả đã thành site tĩnh, nhưng có quá nhiều tổ chức khi “refresh” sự hiện diện trên web thậm chí còn không làm nổi mức dọn dẹp như vậy
Các thảo luận liên quan khi đó: https://techcrunch.com/2014/01/23/googles-search-filters-now..., http://googlesystem.blogspot.com/2014/03/bring-back-forum-se..., https://www.ghacks.net/2014/01/23/search-discussions-blogs-p..., https://www.seroundtable.com/google-search-filters-gone-1799..., https://www.webmasterworld.com/google/4687960.htm, https://www.thecoli.com/threads/i-cant-google-search-by-disc..., https://www.neogaf.com/threads/anyone-else-annoyed-google-re..., https://webapps.stackexchange.com/questions/57249/has-the-op..., https://www.bladeforums.com/threads/how-to-do-google-discuss..., https://browsermedia.agency/blog/alternatives-discussion-sea...
Forum và blog từng có một nền văn hóa mà Reddit hay mạng xã hội không thể tái tạo, nên việc đánh mất nó thật đáng tiếc
Thật buồn khi chuyện này xảy ra với PhysicsForums. 15 năm trước, đó là một trong những website đầu tiên tôi thường dùng khi còn đam mê vật lý, rồi sau này khi bắt đầu sự nghiệp
Tôi chủ yếu đọc và đôi khi cũng đóng góp; đến giờ vẫn nhớ những thành viên mà tôi từng nghĩ một ngày nào đó mình sẽ thông minh và hiểu biết nhiều như họ. Trong làn sóng chuyển dịch sang mạng xã hội sau Mùa xuân Ả Rập, thời kỳ forum là trung tâm thảo luận đã qua đi và bầu không khí bắt đầu thay đổi
Từ khoảng năm 2018, tôi không còn ghé trừ khi truy cập qua Google, rồi sau này là tìm kiếm Kagi, nhưng kho lưu trữ vẫn hữu ích để trả lời các câu hỏi. Tôi khó đồng ý với nhận định trong bài rằng vì link không được chia sẻ trên Twitter nên không ai quan tâm
Bài viết chôn điểm cốt lõi quá sâu. Gần cuối câu chuyện, chủ sở hữu site xác nhận rằng chính ông đã thêm các bình luận AI được lùi ngày. Có lẽ điều đó vốn đã khá rõ ràng
Khi tạo tài khoản trong một cộng đồng trực tuyến, có một khế ước xã hội rằng bạn chủ yếu sẽ tương tác với con người. Có thể sẽ có tài khoản quảng bá, bot, nhà quảng cáo, nhưng thỏa thuận giữa người dùng và nhà cung cấp cộng đồng là nhà cung cấp sẽ cố gắng bảo vệ chúng ta khỏi những thứ đó, còn chúng ta sẽ đóng góp sự tham gia và nội dung
Vì vậy, thử nghiệm người dùng do AI tạo ra của Meta vừa lố bịch vừa đáng ghê tởm. Nếu ta có thể tương tác với một thứ giả vờ là con người, và kết quả cùng lắm chỉ là rác rưởi nhạt nhẽo, thì giá trị của tương tác giữa người với người qua Internet sẽ biến mất
Đây là một thảm họa. Tôi không thấy tương lai nào trong đó đống văn bản tạp nham được tạo nhân tạo cuối cùng không lấn át mọi ngóc ngách của Internet và khiến nó không thể dùng được. Kỷ nguyên nội dung do người dùng tạo có lẽ đã kết thúc
Cũng có tài khoản bot mạo danh, nhưng nhìn vào số người theo dõi là có thể dễ dàng chặn. Khi đã biết khóa công khai mà Lyn dùng, tôi có thể chắc chắn rằng các bài đăng dưới khóa đó là của chính ông ấy
Ông ấy vẫn có thể đăng mấy thứ nhảm nhí từ LLM, nhưng mọi người sẽ nhanh chóng nhận ra và bỏ theo dõi. Điểm quan trọng là, trừ khi tôi muốn, không có thuật toán nào quyết định thứ gì sẽ xuất hiện trong feed của tôi, nên nội dung LLM ngẫu nhiên khó lọt vào feed của tôi
Một lựa chọn khác là bằng chứng danh tính zero-knowledge, chứng minh mình là con người mà không tiết lộ thông tin cá nhân, hoặc không dựa vào cách một máy chủ trung tâm đăng nhập hộ mình: https://zksync.mirror.xyz/kWRhD81C7il4YWGrkDplfhIZcmViisRe3l...
Tôi nghe nói có những máy chủ Discord không cấp quyền truy cập vào tất cả kênh nếu bạn chưa gặp trực tiếp quản trị viên, chưa được ai đó trong nhóm bảo lãnh, hoặc chưa “xác minh” qua cuộc gọi video
Đây chính là tương lai. Chúng ta cần một thứ có cấu trúc giống Discord nhưng có cơ chế như trang web, tức là một không gian không chỉ chứa bài viết mà còn chứa các bộ tài liệu, và có thể truy cập bằng trình duyệt
Tuy nhiên, tùy cách khám phá, “Internet” mới này sẽ không còn là phương tiện dễ dàng để thoát khỏi một thực tại hay địa điểm cụ thể nữa. Một động lực lớn của việc dùng Internet trong thập niên 90 và 00 là sự tò mò muốn khám phá những thứ mới mà cộng đồng địa phương không thể tiếp cận, và Google đáng tin cậy ngày xưa là động lực cốt lõi cho điều đó
Đây là thay đổi không tốt cho những người thật sự chống đối xã hội, nhưng kiểu người đó có khi lại phát triển mạnh trong môi trường đầy AI. Nếu các cổng trung tâm của một Internet người-với-người theo nhóm-với-nhóm mới có thể duy trì các sảnh chờ mở, ta có thể có được ưu điểm của cả hai bên
Cuối cùng có lẽ chúng ta sẽ đi đến xác thực danh tính trực tuyến do ngân hàng hoặc chính phủ cấp
Chắc chắn sẽ có thị trường cho một trò chơi nơi bạn lập tức trở thành influencer nổi tiếng, nhưng nó sẽ nhỏ hơn nhiều so với thị trường mạng xã hội
Tôi không hiểu chính xác vấn đề “lùi ngày đăng” hay chiếm đoạt tài khoản. Cụ thể chuyện này được thực hiện như thế nào? Đọc bài rồi mà tôi vẫn có cảm giác mình đã bỏ sót điều gì đó
Theo câu trả lời của Greg Bernhardt, có nhiều thử nghiệm AI đang được tiến hành để bổ sung giá trị cho cộng đồng, và nhiều thành viên không muốn có tính năng AI. Năm ngoái họ đã thử nghiệm câu trả lời AI trên các tài khoản thử nghiệm, nhưng chúng không đạt tiêu chuẩn chất lượng, và ông ấy yêu cầu báo cho họ nếu phát hiện tài khoản thử nghiệm nào bị bỏ sót
Tôi hoàn toàn không biết vì sao họ lại tái sử dụng các tài khoản người thật cũ làm “tài khoản thử nghiệm” AI
Tôi thích giả định rằng ban đầu đó là các tài khoản thật
Từ góc nhìn của người vận hành một diễn đàn hoặc blog có phần bình luận sôi nổi, nếu người dùng chỉ ghé vào xem rồi không nói gì suốt một tuần thì bạn sẽ cảm thấy thế nào? Ban đầu bạn tạo chủ đề bằng tên mình và viết các phản hồi hữu ích, nhưng cuối cùng lại trông như một kẻ ngốc đang tự nói chuyện một mình
Nếu là một diễn đàn có lưu lượng truy cập tốt và nhiều quảng cáo dạng spam, chắc chắn người ta sẽ cân nhắc cám dỗ này khi khách truy cập bỏ đi vì không có bài viết mới
Trước đây, trên một diễn đàn hơi trì trệ, tôi từng tạo hai tài khoản có tên tương tự từ cùng một IP rồi tự tranh luận với chính mình. Lúc đầu tôi tưởng quản trị viên hoặc người dùng khác sẽ nhận ra, nhưng tôi nhanh chóng học được rằng có quá nhiều chuyện kỳ lạ đến mức chẳng hành vi nào bị xem là bất thường
Ý tưởng — hoặc thực tế — rằng chủ sở hữu trang web có thể chiếm đoạt tài khoản của mọi người để tạo ra những bài viết linh tinh mạo danh, có lẽ nhằm kiếm doanh thu quảng cáo, thật đáng phẫn nộ và gây nản lòng đến mức u ám.
Vấn đề về niềm tin và quyền quy thuộc luôn tồn tại trên web, nhưng vì nhiều lý do, giờ đây nó có vẻ tệ hơn rất nhiều. Không biết mọi thứ phải tệ đến mức nào nữa thì mới xảy ra một bước ngoặt lớn.
Tôi cũng không rõ giải pháp là gì. Có nên đăng ký nhãn hiệu cho tên thật hay handle của mình, rồi dù không có nhiều tiền vẫn đe dọa kiện tụng không? Có phải mọi người nên ký bài viết bằng khóa riêng dựa trên hạ tầng khóa công khai, rồi người khác phải tốn CPU để xác minh chữ ký nhằm kiểm tra mạo danh không? Có nên nắm bắt những kỳ vọng chung ngầm định và chính thức hóa chúng trong khuôn khổ rời rạc của các hệ thống pháp luật trên toàn thế giới không? Chẳng hạn lập một “doanh nghiệp” nhỏ nhưng có vẻ hợp lý bán lời khuyên và ý kiến dưới cái tên đó, rồi chất vấn kẻ mạo danh vì đã làm tổn hại thương hiệu.
Cách diễn đạt của những câu trả lời đó cũng khá khó chịu. Dù có bằng kỹ sư, khi trả lời đùa vui trên mạng tôi cũng hầu như không nói “với tư cách là kỹ sư”. Vì để trả lời với tư cách đạo đức như vậy thì phải phân tích đầy đủ. Nhưng bot dường như không có sự dè dặt đó.
Người tên ravenprp vài năm trước là sinh viên ngành kỹ thuật. Vì người đó không bình luận bằng tên thật nên có thể mức độ nhẹ hơn, nhưng với tính chất nội dung của trang này, rất dễ xảy ra tình huống mạo danh một người thực sự đang làm trong lĩnh vực nào đó và có danh tiếng chuyên môn là “kỹ sư”.
Trang web còn có cả hồ sơ lịch sử về việc người đó đặt câu hỏi và trả lời trong quá trình học, nên rất dễ đánh lừa mọi người tin rằng một kỹ sư thật đang trả lời câu hỏi. Tôi biết khái niệm danh tiếng chuyên môn cá nhân đã suy yếu nhiều trong thế giới hiện đại bị siêu doanh nghiệp hóa, nhưng càng nghĩ càng thấy chuyện này thật tệ hại và thực sự gần như nguy hiểm.
Tôi luôn tự hỏi liệu mọi người có thể gắn một dấu hiệu mật mã nào đó vào bài viết của mình để liên kết với một kho lưu trữ ở đâu đó không. Chủ yếu tôi nghĩ đến việc sao lưu để các bài trên Yelp không bị gỡ, nhưng không biết liệu nó có ngăn được những bài mà ai đó không hề viết hay không.
Diễn đàn ShackNews https://www.shacknews.com/chatty cũng tương tự. Nếu quay ngược thời gian, có thể tìm thấy các bài viết về tình hình khi vụ 11/9 đang diễn ra.
Nhìn theo xu hướng, người Mỹ và có lẽ cả người châu Âu dường như thích đủ loại diễn đàn chuyên môn như PhysicsForum. Ngược lại, người Trung Quốc có vẻ chuộng các nơi tập trung hóa hơn.
Ví dụ Zhihu (zhihu.com) vốn là một bản sao của Quora, nhưng giờ đã trở thành trang lớn nhất để tìm các thảo luận sâu trong hầu như mọi lĩnh vực như toán học, machine learning, lịch sử, vật lý, kỹ thuật, khoa học phổ thông, v.v. Rất nhiều nhà nghiên cứu, chuyên gia và người có sở thích chia sẻ hiểu biết ở đó.
Trong khi đó, chất lượng của Quora dường như ngày càng tệ qua từng năm, còn phần lớn chuyên gia thì phân tán khắp các diễn đàn chuyên môn đủ loại. Tôi tò mò vì sao lại có sự khác biệt này.