Vesuvius Challenge 2023 trao giải lớn: đọc thành công cuộn giấy đầu tiên
(scrollprize.org)- Vesuvius Challenge 2023 đã đọc được Herculaneum Papyri bị than hóa do vụ phun trào núi lửa Vesuvius năm 79 mà không cần mở cuộn, qua đó khôi phục một phần văn bản đã không thể nhìn thấy suốt 2.000 năm
- Nhóm Youssef Nader, Luke Farritor, Julian Schilliger đã đáp ứng tiêu chí 4 đoạn, mỗi đoạn 140 ký tự và tỷ lệ khôi phục ký tự trên 85%, qua đó nhận giải lớn $700,000; bài nộp còn bao gồm 15 cột và hơn 2.000 ký tự văn bản
- Cuộn giấy được phục dựng dường như không phải bản sao của tác phẩm đã biết mà là văn bản cổ chưa từng công bố, được giải đọc là một văn bản triết học Epicurean bàn về âm nhạc, đồ ăn, cảm giác và khoái lạc
- Công nghệ cốt lõi kết hợp chụp cắt lớp X-quang, phân đoạn các lớp papyrus 3D và phát hiện mực bằng máy học; mã nguồn đoạt giải và dữ liệu huấn luyện đã được công khai để có thể tái hiện và kiểm chứng
- Mục tiêu năm 2024 là mở rộng từ mức giải đọc khoảng 5% của cuộn đầu tiên lên 90% của 4 cuộn đã được quét; nút thắt lớn nhất là tự động hóa phân đoạn vốn có chi phí thủ công rất cao
Đọc cuộn giấy 2.000 năm tuổi mà không cần mở ra
- Herculaneum Papyri là những cuộn papyrus bị than hóa bởi vụ phun trào Mount Vesuvius năm 79; sau khi được phát hiện vào thế kỷ 18, hiện có hàng trăm mẫu đang được lưu giữ tại một thư viện ở Naples, Italy
- Vì chúng ở dạng khối tro than hóa nên nếu mở ra bằng vật lý có thể bị hư hại nặng; do đó cần phương pháp không phá hủy để đọc chữ bên trong
- Nat Friedman, Daniel Gross và Brent Seales đã khởi động Vesuvius Challenge vào ngày 15/3/2023
- Các cuộn của Institut de France được chụp CT độ phân giải cao tại máy gia tốc hạt Diamond Light Source gần Oxford
- Dựa trên các bản quét CT được công bố, người tham gia trên toàn thế giới đã kết hợp computer vision, machine learning và thao tác thủ công để giải bài toán
- Tổng giải thưởng vượt quá 1 triệu USD do nhiều nhà tài trợ đóng góp
- Tháng 12/2023, những người tham gia đã thành công trong việc đọc một phần cuộn đầu tiên
- Văn bản đã bị che khuất suốt 2.000 năm được hé lộ từ PHerc.Paris. 4
- Hiện vẫn còn khoảng 95% cuộn giấy chưa được đọc
Kết quả giải Grand Prize 2023
- Các bài nộp cho Grand Prize được gửi đến sát hạn chót nửa đêm ngày 1/1/2024, sau đó được nhóm papyrology và nhóm kỹ thuật xem xét trong tháng 1
- Nhóm papyrology đã xem xét văn bản của 15 cột trong các bài nộp đã được ẩn danh
- Nhóm kỹ thuật đã kiểm tra và tái hiện mã nguồn cùng phương pháp được nộp
- Giải lớn thuộc về nhóm Youssef Nader, Luke Farritor, Julian Schilliger
- Tiền thưởng là $700,000
- Tiêu chí là 4 đoạn, mỗi đoạn 140 ký tự, với xác suất khôi phục ký tự tối thiểu 85%
- Nhiều thành viên ban tổ chức khi công bố tiêu chí cho rằng xác suất thành công dưới 30%
- Bài nộp đoạt giải còn bao gồm thêm 11 cột và tổng cộng hơn 2.000 ký tự văn bản
- Cả ba đã đóng góp cho cộng đồng ngay từ giai đoạn đầu của Vesuvius Challenge
- Youssef Nader là nghiên cứu sinh tiến sĩ người Ai Cập tại Berlin, đã đọc được vài cột vào tháng 10/2023 và giành hạng 2 First Letters Prize
- Luke Farritor là sinh viên đại học 21 tuổi đến từ Nebraska và thực tập sinh tại SpaceX, người đầu tiên đọc được trọn vẹn từ ΠΟΡΦΥΡΑϹ (“purple”) bên trong cuộn Herculaneum và giành hạng 1 First Letters Prize
- Julian Schilliger là sinh viên robotics người Thụy Sĩ tại ETH Zürich, đã nhận 3 giải Segmentation Tooling nhờ công việc với Volume Cartographer
Cấu trúc kỹ thuật của bài nộp đoạt giải
- Bài nộp bao gồm kết quả từ ba kiến trúc mô hình hỗ trợ lẫn nhau
- Các hình ảnh mạnh nhất thường đến từ mô hình dựa trên TimeSformer
- Để tránh overfitting và hallucination, nhóm đã dùng kết quả từ nhiều kiến trúc, nghiên cứu kích thước cửa sổ input/output, label smoothing và thay đổi validation fold
- Mã nguồn phát hiện mực đã được open source trên GitHub
- Ngoài phát hiện mực mạnh, bài nộp còn đi kèm phương pháp auto-segmentation mạnh nhất
- ThaumatoAnakalyptor của Julian tạo ra các phân đoạn papyrus lớn trên nhiều cuộn
- Công cụ này tái phân đoạn các vùng đã được biết rõ để xác minh các phát hiện mực trước đó
- Nó cũng làm lộ chữ ở những vùng mới như lớp cuộn ở rìa ngoài cùng
- Đây là công cụ đầy hứa hẹn, nhưng vẫn còn rất nhiều việc cải thiện
Các đội á quân và phương pháp được công bố
- Trong các bài nộp còn lại, theo điểm của nhóm papyrology thì ba đội đồng hạng á quân
- Mỗi đội nhận $50,000
- Cả ba bài nộp cho thấy mức độ dễ đọc tương đương nhau và dễ đọc hơn đáng kể so với các bài còn lại
- Các bài nộp á quân đã được công bố:
- Các đội á quân đã mang đến cách tiếp cận mới cho những vấn đề chi tiết trong gán nhãn mực và lấy mẫu
- Trong cộng đồng Discord, có thể truy cập dữ liệu CT và hình ảnh bổ sung theo thỏa thuận dữ liệu, và việc khám phá cũng như hợp tác giữa các người tham gia vẫn đang tiếp tục
Nội dung của văn bản được phục dựng
- Đến nay, khoảng 5% của cuộn đầu tiên đã được mở ảo và đọc
- Nhóm papyrology đã tạo bản chép sơ bộ cho tất cả các cột đã lộ ra
- Cuộn này không phải bản sao của một tác phẩm đã biết mà là văn bản cổ chưa từng thấy trước đây
- Theo cách giải đọc ban đầu, chủ đề tổng thể là khoái lạc, điều được xem là thiện tối cao trong triết học Epicurean
- Một phần của hai cột liên tiếp bàn về việc khả năng tiếp cận các vật phẩm như đồ ăn ảnh hưởng thế nào đến khoái lạc
- Tác giả viết theo ý rằng “không nên vội tin rằng thứ hiếm hơn nhất thiết dễ chịu hơn thứ dồi dào”
- Sau đó mạch văn tiếp tục rằng “những câu hỏi như vậy sẽ còn được xem xét thường xuyên”
- Vì đây là phần cuối của cuộn, có khả năng cuộc thảo luận được tiếp tục trong quyển tiếp theo của cùng tác phẩm
- Ở phần đầu của văn bản đầu tiên có nhắc đến một nhân vật tên Xenophantus
- Đây có thể là một người có vẻ là nhạc công, cũng được nhắc đến trong On Music của Philodemus
- Philodemus là một nhân vật của trường phái Epicurean, được cho là triết gia hoạt động trong thư viện nhỏ của biệt thự nơi các cuộn giấy được tìm thấy
- Richard Janko cho rằng rất có khả năng tác giả là Philodemus, triết gia và thi sĩ, thầy của Virgil
- Ông cho rằng đây khá có thể là văn bản so sánh tác động của âm nhạc lên người nghe với các khoái lạc khác như thức ăn và đồ uống
- Nó cũng có thể là văn bản thuộc bộ luận văn bốn phần về âm nhạc, trong đó Book 4 đã được biết đến
- Federica Nicolardi xem đây là một văn bản Epicureanism đầy âm nhạc, đồ ăn, cảm giác và khoái lạc
- Bob Fowler cho rằng Philodemus đánh giá cao khoái lạc, nhưng đó không phải sự buông thả đơn thuần mà là khoái lạc được hiểu đúng đắn
Cách kiểm chứng độ chính xác của các hình ảnh kết quả
- Khả năng hallucination của mô hình machine learning, tức tạo ra ký tự hoặc hình ảnh giống dữ liệu huấn luyện, là một hạng mục cần kiểm chứng
- Nhóm rà soát kỹ thuật của Vesuvius Challenge đã tái hiện thủ công bài nộp đoạt giải
- Họ hiểu từng phần của mã nguồn và xác nhận rằng khi chạy độc lập sẽ cho ra các ảnh đầu ra tương tự
- Mã nguồn và dữ liệu huấn luyện đều đã được công bố, nên người khác cũng có thể thực hiện cùng phép kiểm chứng
- Nhiều bài nộp cho ra kết quả rất giống nhau trên cùng một vùng của cuộn
- Nhóm segmentation của ban tổ chức đã công bố các segment, tức các tờ papyrus được ánh xạ 3D trong bản quét CT
- Những người tham gia dùng các mô hình ML và nhãn huấn luyện khác nhau nhưng tạo ra ảnh đầu ra tương tự
- Sự trùng khớp này xuất hiện không chỉ ở đội thắng và các đội á quân mà còn ở các bài nộp khác
- Mô hình phát hiện mực không dựa trên chữ cái Hy Lạp, OCR hay language model
- Nó phát hiện độc lập các chấm mực cực nhỏ trong bản quét CT
- Ký tự chỉ xuất hiện về sau khi các kết quả phát hiện nhỏ đó được ghép lại
- Trong một số trường hợp, đầu ra chỉ là giá trị nhị phân “có mực” hoặc “không có mực”
- Vì cấu trúc này, khả năng mô hình hallucinate ra hình dạng giống ký tự được xem là rất thấp
Ba giai đoạn của việc mở cuộn ảo
- Mở cuộn ảo về cơ bản gồm quét, phân đoạn và phát hiện mực
-
Quét
- Cuộn giấy hoặc mảnh vỡ được quét 3D bằng chụp cắt lớp X-quang
- Diamond Light Source cho phép chụp ảnh độ phân giải cao nhanh và chính xác nhờ chùm tia X song song có thông lượng cao
- Ảnh X-quang được chuyển thành thể tích 3D dựa trên voxel thông qua thuật toán tái tạo lát cắt, rồi tạo ra một chồng ảnh slice
-
Phân đoạn
- Theo dõi các lớp papyrus riêng lẻ bị cuộn và vò trong không gian 3D, sau đó mở phẳng chúng
- Chủ yếu sử dụng Volume Cartographer do Seth Parker cùng những người khác tại phòng thí nghiệm của Brent Seales tạo ra
- Julian Schilliger, Philip Allgaier và những người khác đã mở rộng công cụ này
- Một nhóm segmentation toàn thời gian gồm Ben Kyles, David Josey và Konrad Rosenberg đã kết hợp thuật toán tự động với hiệu chỉnh thủ công
- Việc phân đoạn toàn bộ cuộn vẫn là một quá trình cực kỳ vất vả và còn nhiều dư địa cải thiện
-
Phát hiện mực
- Stephen Parsons từng cho thấy về mặt lý thuyết mực Herculaneum có thể được phát hiện trong bản quét CT, nhưng trước đây chỉ làm được trên các mảnh nhỏ
- Việc phát hiện mực trên các bản quét lớn của cuộn hoàn chỉnh vẫn chưa từng đạt được
Đột phá trong phát hiện mực
- Đột phá đầu tiên là phát hiện crackle pattern
- Casey Handmer vào mùa hè 2023 đã quan sát dữ liệu thể tích bề mặt đã được làm phẳng và nhận ra một crackle pattern đặc biệt trông giống chữ
- Phát hiện này giúp anh nhận First Ink Prize và được chia sẻ với cộng đồng
- Luke Farritor tiếp tục tìm thêm crackle trong các thể tích bề mặt đã làm phẳng do nhóm segmentation tạo ra, huấn luyện mô hình và dẫn tới chiến thắng First Letters Prize vào tháng 10
- Hướng thứ hai là Kaggle competition
- Hàng trăm đội đã xây dựng mô hình machine learning để phát hiện mực trên các mảnh đã mở
- Những mảnh này là phần rời ra trong quá trình mở vật lý nhiều thế kỷ trước
- Người tham gia có thể dùng dữ liệu ground truth lấy từ ảnh chụp các mảnh
- Hiệu năng mô hình rất tốt, nhưng ban đầu có vẻ chúng không hoạt động tốt trên các segment đã làm phẳng do nhóm segmentation tạo ra
- Khi Youssef Nader áp dụng kỹ thuật domain adaptation, anh đã đạt thành tích hạng 2 First Letters Prize
- Sau First Letters Prize, mục tiêu Grand Prize đã trở nên trong tầm tay và Youssef, Luke, Julian lập thành một đội
Cách vận hành góp phần tạo nên thành công năm 2023
- Dự án thu hút truyền thông ban đầu, tài trợ và một cộng đồng có động lực nội tại mạnh nhờ mục tiêu rõ ràng và khác thường
- Nền tảng được Brent Seales và đội ngũ xây dựng suốt 20 năm là yếu tố quan trọng
- Quét cuộn đầu tiên
- Xây dựng Volume Cartographer
- Những ca thành công đầu tiên của mở cuộn ảo
- Chứng minh mực Herculaneum có thể phát hiện trong CT
- Để kết hợp cạnh tranh và hợp tác, dự án triển khai progress prizes
- Cứ khoảng 2 tháng lại có các giải nhỏ từ $1,000 đến $10,000
- Để nhận progress prize, người tham gia phải công bố mã nguồn hoặc nghiên cứu dưới dạng open source
- Cách làm này giúp nâng mặt bằng chung của cộng đồng, thúc đẩy đầu tư vào thiết bị, compute, thời gian và việc hình thành đội nhóm
- Quyết định thuê một nhóm segmentation toàn thời gian cũng mang tính then chốt
- Nhóm nội bộ đảm nhiệm công việc truy vết papyrus, vốn là nút thắt, để tăng xác suất có người đoạt giải
- Chất lượng segmentation khó đánh giá trước khi phát hiện được mực, và thưởng theo số lượng có thể làm giảm chất lượng
- Công việc gán nhãn vừa tẻ nhạt vừa tốn thời gian, với đường cong học tập dài, nên khó bù đắp chỉ bằng tiền thưởng
- Quyết định này đã trực tiếp dẫn tới phát hiện crackle pattern của Casey Handmer, đồng thời góp phần tạo ra phần mềm segmentation tốt hơn cùng cộng đồng
- Thành công là kết quả từ nhiều đột phá nhỏ của nhiều người, và cần rất nhiều đóng góp để tìm ra ý tưởng hiệu quả trong một không gian khám phá rộng lớn
Mục tiêu Stage 2 năm 2024
- Trong năm 2023, dự án đã đi từ 0% lên 5% trên một cuộn
- Mục tiêu năm 2024 là đọc được 90% của toàn bộ 4 cuộn đã quét, và đội đầu tiên đạt được sẽ nhận 2024 Grand Prize
- Tiêu chí chấm cụ thể sẽ được công bố vào tháng 3
- Nút thắt lớn nhất hiện tại là quá trình truy vết bề mặt papyrus bên trong cuộn
- Để tạo ra lượng văn bản có thể đọc được hôm nay, chi phí thao tác thủ công đã vượt quá 100 USD trên mỗi centimet vuông
- Với cấu trúc chi phí này, việc phân đoạn toàn bộ các cuộn có thể tiêu tốn hàng trăm triệu hoặc hàng tỷ USD
- Dù công cụ đã hiệu quả hơn, quy trình vẫn quá thủ công và quá đắt đỏ
- Mục tiêu cốt lõi của Stage 2 là hoàn thiện auto-segmentation
- Nếu hoạt động đúng, nó có thể đọc được cả những vùng khó bị nén mạnh, nứt vỡ, bong tách hoặc hư hại
- Cả những vùng mà công cụ hiện tại không thể tiếp cận cũng sẽ trở thành mục tiêu
- Trong năm 2024, dự án dự định vẫn giữ Grand Prize nhưng tăng tỷ trọng giải thưởng cho các đóng góp của cộng đồng
- Ngoài nhóm segmentation toàn thời gian, dự án cũng có kế hoạch thuê một nhóm nhỏ về software và ML để hợp tác công khai cùng cộng đồng
Mục tiêu lớn hơn và những khả năng còn lại
- Mục tiêu tiếp theo là quét và đọc toàn bộ các cuộn
- Các cuộn ở Naples được ước tính chứa hơn 16MB văn bản
- Một số thành viên của nhóm papyrology cho rằng việc công bố các văn bản này có thể là cuộc cách mạng lớn nhất của ngành cổ điển học kể từ thời Phục Hưng
- Tại Villa of the Papyri vẫn còn hai tầng chưa được khai quật
- Ít nhất có khả năng còn thêm papyrus trong tủ và các hộp đựng vận chuyển
- Thư viện chính của biệt thự vẫn chưa được phát hiện
- Thư viện đó có thể chôn vùi phạm vi văn liệu Hy Lạp và Latin rộng hơn cùng hàng nghìn hoặc hàng chục nghìn cuộn giấy
- Chi tiết về kế hoạch tiếp theo có trong Master Plan
1 bình luận
Ý kiến trên Hacker News
Khi lần đầu thấy dự án này trên HN vào đầu năm ngoái, tôi đã nghĩ nó gần như bất khả thi và ngạc nhiên trước việc những người tham gia thông minh đến mức nào
Dù có thấy vài cái tên xuất sắc, tôi vẫn vô thức nghĩ rằng phải mất ít nhất 5~10 năm mới có đột phá
Hôm nay tôi lại có cùng cảm giác thán phục, và một lần nữa kinh ngạc vì chuyện này ngầu đến mức phi lý. Xin chúc mừng những người đoạt giải và tất cả những ai đã tham gia
Tôi cũng từng nghĩ phải 20 năm nữa máy tính mới có thể viết văn bản thay thế cho ảnh của tôi với độ chính xác đáng sợ, lại còn văn vẻ nữa, vậy mà giờ chuyện đó đã xảy ra
Trong machine learning, toán học và các lĩnh vực lân cận đã có nhiều con đường sự nghiệp lương cao, nên rất khó giữ được sự chú ý của các chuyên gia giỏi nhất cho một việc có thể kết thúc bằng thất bại
Không chỉ là tiền thưởng bằng tiền mặt, một thử thách có giải lớn còn nâng cả danh tiếng của việc tìm ra lời giải. Nobel rốt cuộc cũng đi kèm khoảng 1 triệu USD
Nếu ai đó treo 100 triệu USD cho việc giải mã bản thảo Voynich hoặc Linear A, tôi khá tin là trong 3 năm sẽ có lời giải
Khoảng tháng 10 năm ngoái, khi những kết quả đầu tiên bắt đầu xuất hiện, tôi đã đọc và cực kỳ phấn khích. Phương pháp luận đặc biệt cuốn hút
Quá trình trước tiên mở cuộn giấy theo cách số hóa, rồi nhận ra các vết như vết nứt trên giấy chính là tín hiệu của mực, sau đó xây dựng mô hình để phát hiện điều đó từng mảnh một thật sự rất ấn tượng
Tôi sẽ phải xem kho lưu trữ cuối cùng mới biết chính xác họ đã làm gì, nhưng có vẻ như họ đã dùng TimeSFormer. Tôi cứ nghĩ thứ này dành cho video nên rất tò mò họ áp dụng nó vào ảnh như thế nào
Dù sao thì đây thực sự là một ngày tuyệt vời cho khảo cổ học, và những tài năng trẻ này xứng đáng nhận được tràng pháo tay lớn cho thành tựu của mình
Theo cách tôi hiểu thì kết quả quét cuộn giấy dường như trả về chính các lớp
Cấu trúc đại khái như sau:
Vì vậy nếu chia ảnh bề mặt thành các tile thì sẽ có dữ liệu kích thước
size_x * size_y * n_layersTức là có thể xem nó như một luồng video dạng
size_x * size_y * 1 channel * n_layers, trong đó các lớp đóng vai trò thay cho chiều thời gianCâu “bất kỳ công nghệ nào đủ phát triển cũng không thể phân biệt với phép màu” đúng là quá chuẩn
Khả năng ma thuật biến một khối cuộn giấy cháy sém thành văn bản có thể đọc được thật sự quá điên rồ
Tôi chỉ biết rất hời hợt về machine learning, nên khá tò mò liệu các kỹ thuật trong bài là thứ chỉ mới được phát hiện gần đây, hay thực ra đã tồn tại từ khá lâu
Cũng tò mò liệu có phải các thuật toán này đã đạt tới điểm bẻ ngoặt nên được dùng rộng rãi hơn, và vì thế ngày càng có nhiều trường hợp áp dụng cách tiếp cận mới cho các vấn đề cũ hay không
Biết đâu 10.000 năm nữa chúng ta sẽ tái dựng cả hình nón ánh sáng. Có khi chính lúc này chúng ta cũng là kiểu thực thể đó. Không phải ý nghiêm túc gì, nhưng là một phép thử tư duy khá vui
Có link tới “master plan” để đọc toàn bộ các cuộn giấy đã được khai quật: https://scrollprize.org/master_plan
Có vẻ có hai nút thắt chính để đọc được nhiều hơn: cần can thiệp thủ công khi phân đoạn các cuộn giấy đã quét, và chi phí quét các cuộn giấy mới thì rất cao
Có vẻ như ai đó có thể tài trợ khoản đó, rồi chuyển các cuộn giấy đến gần máy gia tốc hạt cùng lúc hoặc theo vài lô lớn. Thêm 1 triệu USD nữa chắc còn có thể làm kiểu container kiểm soát nhiệt độ và độ ẩm để vận chuyển một lượt
Nếu tôi có 30 triệu USD, tôi chắc chắn sẽ quyên góp cho việc này. Đây có vẻ là một trong những cách tốt nhất để dùng số tiền đó. Như vậy có thể bỏ qua nhu cầu R&D máy quét để bàn hay các lời giải khác, và crowdfunding cũng có vẻ khả thi
Còn việc phân đoạn thì có thể làm theo kiểu giải quyết tập thể như Seti@Home. Chỉ là thay vì dùng máy tính thì dùng những người đang chán chường và lướt Reddit hay Twitter cả ngày
Thậm chí có thể làm như CAPTCHA để xử lý miễn phí. Nếu có thể, tôi sẵn sàng tự làm vài giờ phân đoạn mỗi tháng
Dự án này đã đi được đến đây là nhờ một nỗ lực cộng đồng tuyệt vời, và không có lý do gì không tiếp tục mở rộng tập thể con người đang cố gắng hiểu các cuộn giấy. Nếu kéo được hàng triệu người vào, ta không nhất thiết phải chỉ dựa vào nạng công nghệ và phát triển. Tất nhiên phát triển công nghệ cũng không phải hướng đi tệ
Nếu bạn biết ai có thể đóng góp cho giai đoạn 2 của dự án, tức giai đoạn mở rộng, thì hãy báo cho Nat. Tôi không liên quan trực tiếp tới đội vận hành dự án, chỉ là đang chỉ tới đầu mối đó như một người rất phù hợp
Khi đi du lịch Ý cùng vợ, Herculaneum là một trong những nơi gây ấn tượng nhất với tôi
Tôi đã không thực sự hình dung được phải dọn đi bao nhiêu tro và đất để khai quật, hóa ra là hàng chục mét [1]
Thật đáng tiếc khi nơi này chỉ nhận được một phần sự chú ý mà Pompeii có. Tình trạng bảo tồn ở đây tốt hơn nhiều và thực sự tạo cảm giác choáng ngợp [2]
Tôi rất khuyến khích dành vài giờ đi bộ quanh khu di chỉ. Thật sự là một nơi đáng kinh ngạc
1: https://www.icloud.com/photos/#08dJAA5eM9jpbhlEa3fzkl5ng
2: https://www.icloud.com/photos/#076Pof4FziA7WgcI8hZrGZmzg
Trò chơi bắt đầu với việc bạn vào vai một nô lệ phải trốn thoát khỏi Herculaneum trước khi Vesuvius phun trào. Đó là trò tôi cực kỳ thích khi còn nhỏ, gần giống một game mô phỏng nhập vai góc nhìn đẳng cự với giao diện khá thô
Chính trò chơi đó đã khiến tôi quan tâm đến La Mã cổ đại, và tôi muốn một ngày nào đó được đến Herculaneum
Cho đến nay mới chỉ khai quật được khoảng một phần tư, trái ngược với Pompeii nơi khoảng hai phần ba đã được lộ ra
Đây là điều tuyệt nhất tôi đọc được trong năm nay. Gần như đọc như khoa học viễn tưởng
Ai mà tưởng tượng nổi có thể đọc được chữ trên một cuộn giấy 2.000 năm tuổi, bị cháy đen và vẫn còn cuộn lại như vậy chứ
Toàn bộ sự tích lũy của cách mạng công nghiệp, khoa học, kỹ thuật và năng lực chế tạo đã giúp con người tìm thấy, bảo quản và quét các cuộn giấy; rồi ở đoạn cuối, cuộc cách mạng AI hiện tại như một nét điểm xuyết, tạo ra những suy luận và kết nối vượt ngoài năng lực hiểu biết thông thường của con người
Và rồi trí tuệ cổ xưa 2.000 năm tuổi bật ra từ đó
Thực ra nghiên cứu về việc mở cuộn giấy theo cách ảo đã diễn ra từ năm 2007 (https://en.wikipedia.org/wiki/Herculaneum_papyri#Virtual_unr...), nhưng tôi hoàn toàn không ngờ chuyện này lại đến nhanh như vậy
Một lần nữa cho thấy sự tăng tốc theo hàm mũ của công nghệ là có thật
Cuốn sách bị cắt nhỏ, các mảnh bị hút vào và được quét trong lúc đang chảy qua, sau đó kết quả quét được ghép lại như một trò xếp hình để phục dựng nguyên văn
Đó là một tuyến truyện phụ, nhưng tôi không tài nào nhớ ra tên sách
Nếu có một tiểu thuyết khoa học viễn tưởng với tiền đề như thế này thì tôi sẽ thấy khá hấp dẫn
Một tỷ phú nào đó thay vì phụ thuộc vào máy móc đã yêu cầu đông khô chính cơ thể mình và cất nó trong một miệng núi lửa ở cực nam Mặt Trăng. Sau đó ông ta lập quỹ để tài trợ nghiên cứu động cơ liên sao, nhằm di chuyển cơ thể mình qua những nơi lạnh và ổn định nhất được tìm thấy trên đường đến điểm 1 kelvin của Boomerang Nebula, đồng thời tiếp tục nghiên cứu việc hồi sinh từ trạng thái cháy đen
Chính mục tiêu kiểu Don Quixote muốn hoàn thành sứ mệnh đó đã kích hoạt hàng loạt tiến bộ như nhiệt hạch thực dụng, các dạng tạo năng lượng kỳ lạ hơn, trí tuệ nhân tạo tổng quát, điều khiển hấp dẫn, công nghệ nano kiểu Drexler, Dyson swarm, star wisps, cơ thể tự biến đổi và đủ mọi phát triển khác
Một trong những điều thực sự hấp dẫn của khảo cổ học là thông lệ cố ý để lại một số hiện vật mà chưa thăm dò đến
Những người đầu tiên phát hiện ra các cuộn giấy dường như đã thử mở vài cuộn, rồi nhận ra rằng không thể làm vậy mà không phá hủy hoàn toàn chúng, nên đã để nguyên phần còn lại
Thay vì cố ép tiếp và phá hỏng tất cả, họ đã để chúng lại như một bí ẩn dành cho thời đại tương lai
Phải đến hai thế kỷ sau, cuối cùng chúng ta mới bắt đầu có thể hiểu được chúng với sự trợ giúp của những công nghệ mà họ hoàn toàn không thể tưởng tượng ra
Tôi còn khâm phục những người vào thập niên 1990 hay đầu những năm 2000 hơn. Khi đó có thể đã có chút hy vọng, nhưng rủi ro vẫn quá lớn nên họ đã chờ đến khi xác suất an toàn cao hơn
Phần lớn giáo dục thời đó là học tiếng Latin, đồng thời họ cũng rất rõ rằng chỉ có một phần cực nhỏ văn bản cổ điển còn được lưu giữ
Vì vậy rất có khả năng họ hiểu việc bảo tồn những cuộn giấy này và giúp chúng có thể được mở ra vào một ngày nào đó là quan trọng đến mức nào
Thật là một thành tựu đáng kinh ngạc khi người ta ước tính các cuộn giấy ở Naples chứa hơn 16MB văn bản
Một số thành viên của nhóm papyrology cho rằng nếu số văn bản này được công bố, đó sẽ là cuộc cách mạng lớn nhất của ngành cổ điển học kể từ thời Phục Hưng; tôi hy vọng chính phủ Ý sẽ cho phép khai quật thêm khu Villa
Chỉ là hiện tại chúng ta mới đọc được 5% số cuộn giấy, và riêng những thứ đã khai quật được cũng đã rất nhiều, nên có lẽ sẽ mất vài năm chỉ để xử lý những gì đang có
Điều đó không có nghĩa là không thể khai quật nếu không phá dỡ, vẫn có những trường hợp như Scavi bên dưới Vương cung thánh đường Thánh Peter, nhưng chắc chắn sẽ khó hơn nhiều
Đây thực sự là một công trình đáng kinh ngạc, kể cả việc mô hình tạo ra bước đột phá ban đầu được huấn luyện trên GTX 1070: https://twitter.com/LukeFarritor/status/1754532281690243339
Các bài liên quan:
First word discovered in unopened Herculaneum scroll by CS student - https://news.ycombinator.com/item?id=37857417 - Tháng 10 năm 2023, 207 bình luận
The Vesuvius Challenge - https://news.ycombinator.com/item?id=35322809 - Tháng 3 năm 2023, 32 bình luận
Vesuvius Challenge - https://news.ycombinator.com/item?id=35169869 - Tháng 3 năm 2023, 32 bình luận
Can AI Unlock the Secrets of the Ancient World? - https://news.ycombinator.com/item?id=39261465 - Tháng 2 năm 2024, 1 bình luận
Và cũng có một tweet có lẽ đề cập cùng nội dung với OP
The $700k Vesuvius Challenge prize has been won - https://news.ycombinator.com/item?id=39261933 - Tháng 2 năm 2024, 2 bình luận