Prêmio principal do Vesuvius Challenge 2023 concedido: conseguimos ler o primeiro rolo
Machine learning e imagem avançada por raios X revelaram com sucesso texto grego substancial de um rolo carbonizado enterrado pela erupção do Vesúvio em 79 EC, um avanço alcançado por meio do Vesuvius Challenge de US$ 1 milhão. Comentaristas destacam a engenhosidade técnica de virtualmente desenrolar e ler os rolos, a importância histórica de desbloquear potencialmente megabytes de filosofia antiga perdida e o cuidado dos arqueólogos ao deixar artefatos frágeis fechados para tecnologias futuras. A atenção também se volta para os próximos passos: ampliar o escaneamento e a segmentação, limitações de financiamento, o papel da IA tanto na análise de imagens quanto na futura interpretação textual, e as implicações mais amplas para artefatos ilegíveis como outros papiros e códices no mundo todo.
Reação geral
- Muitos comentaristas expressam espanto, chamando o resultado de “algo saído de ficção científica” e um destaque do ano.
- As pessoas enfatizam o arco de 270 anos: da descoberta no século XVIII, passando por avanços industriais e científicos, até o ML moderno como o “desbloqueio” final.
- Vários observam a importância da contenção anterior: muitos artefatos foram historicamente arruinados por manuseio agressivo; aqui, a espera valeu a pena.
Abordagem técnica e validação
- A discussão esclarece que isso é visão computacional em dados de CT, não modelos generativos de linguagem; os modelos detectam características semelhantes a tinta em volumes 3D.
- A estrutura dos dados (pilhas de camadas / volumes) torna natural reutilizar arquiteturas de vídeo (por exemplo, transformers sobre “camadas como tempo”).
- Preocupações com alucinação são comuns. Outros respondem:
- Os métodos foram reproduzidos de forma independente a partir de código e dados abertos.
- Várias equipes, com modelos e rótulos diferentes, convergiram para leituras quase idênticas.
- Os modelos funcionam em pequenas regiões locais, detectando tinta em vez de letras ou palavras inteiras.
- Um objeto de teste “scroll de fogueira” foi criado e escaneado; ainda há debate sobre o quão convincente é a comparação antes/depois.
Bottlenecks e escala
- A thread destaca dois principais gargalos técnicos: o caro escaneamento síncrotron em alta resolução e a segmentação trabalhosa das camadas do rolo.
- Ideias propostas: construir ou deslocar scanners para perto de Nápoles, fazer crowdfunding ou financiar o escaneamento por filantropia (na ordem de dezenas de milhões), e usar segmentação distribuída por voluntários (estilo captcha ou SETI@home).
- As pessoas debatem se o prêmio é grande ou pequeno em relação ao esforço; muitos veem o enquadramento do prêmio como crucial para atrair talentos.
Conteúdo e impacto acadêmico
- O primeiro texto recuperado gira em torno da filosofia epicurista do prazer e da escassez; alguns acham decepcionante, outros observam que até textos “mundanos” são ouro para historiadores.
- As expectativas variam: alguns temem “mais do mesmo” de um círculo filosófico; outros argumentam que mesmo a biblioteca completa de uma única mente é historicamente transformadora.
- Comentaristas relacionam isso a esperanças mais amplas de recuperar literatura perdida, história e documentos cotidianos (incluindo registros fiscais).
Arqueologia, preservação e reflexões mais amplas
- Há forte apreciação pela não escavação deliberada (áreas de Herculano, outros grandes sítios) para evitar danos irreversíveis até que a tecnologia melhore.
- A discussão aborda obstáculos para escavações adicionais: cidade moderna sobre a vila, resistência local, interferência criminosa e prioridades de financiamento.
- Vários usam o projeto para refletir sobre:
- Quanto de computação e engenharia sustenta o ML moderno.
- A fragilidade dos dados digitais modernos versus a surpreendente recuperabilidade de materiais antigos.
- O papel de patronos ricos versus o financiamento público coletivo, e que tipos de problemas grandes incentivos poderiam desbloquear.