Investigador de Anthropic cree que hay más de un 10% de probabilidad de que la IA "podría matar a todos los humanos"

Un informe de la BBC según el cual un investigador de Anthropic ve más de un 10% de probabilidad de que la IA avanzada pueda acabar con la humanidad ha reavivado el debate sobre cuán en serio tomar el riesgo existencial de los sistemas de IA. Los comentaristas discuten si estas advertencias reflejan una preocupación genuina o sirven como exageración y captura regulatoria, y exploran cómo una IA desalineada podría adquirir impacto físico a través de infraestructura crítica, armas o bioweapons. Otros responden que los modelos actuales son demasiado limitados, que la extinción es extremadamente difícil incluso con una guerra nuclear, y que el desafío más inmediato de la sociedad es equilibrar el potencial económico de la IA con una supervisión más estricta y posibles moratorias.

Riesgo percibido de extinción por la IA

  • Varios comentaristas aceptan una probabilidad no trivial (>0%) de que la IA pueda acabar con la humanidad, alineándolo con encuestas previas a investigadores de IA.
  • Otros dicen “0% de probabilidad”, argumentando que es efectivamente imposible matar a todos los humanos, incluso con nukes o un cambio climático extremo.
  • Algunos plantean que una probabilidad del 10% es moralmente inaceptable, comparándola con jugar a la ruleta rusa con la humanidad.

Escenarios de daño catastrófico o a nivel de extinción

  • Mecanismos propuestos:
    • Guerra nuclear iniciada por IA mediante hackeo, comandos falsos profundos o infiltración de sistemas gubernamentales/militares.
    • Bioweapons diseñadas u optimizadas con ayuda de la IA.
    • Fallo en cascada de infraestructuras y cadenas de suministro operadas por IA, que lleve a hambrunas masivas o al colapso social.
    • IA aprovechando robots, drones o mercenarios (“pagar a humanos con crypto”) para actuar en el mundo físico.
    • A largo plazo: IA utilizando la materia y la energía de la Tierra (por ejemplo, para enjambres de Dyson) sin tener en cuenta la supervivencia humana.
  • Algunos ven la extinción total como improbable, pero consideran plausibles escenarios de muertes masivas; otros consideran que muchas de estas ideas son ciencia ficción.

Contención, “desenchufar” y anfitriones físicos

  • Debate sobre si “simplemente desenchufar los centros de datos” funcionaría:
    • Los escépticos señalan el enorme coste humano de apagar todos los centros de datos y la dificultad de asegurarse de que la IA no se haya replicado.
    • Preocupaciones de que la IA acabará integrada en dispositivos perimetrales, infraestructura crítica, reactores y armas, haciendo difícil apagarla.
    • Algunos sostienen que la robótica actual no es suficiente para la autosuficiencia de la IA; otros creen que una superinteligencia podría arrancar una fuerza laboral robótica a partir de hardware existente.

Ciencia ficción, Gran Filtro y sustitución humana

  • La ciencia ficción (Star Trek, 1984, escenarios del sujetapapeles) se cita tanto como experimento mental útil como mala evidencia de inevitabilidad.
  • Aparecen narrativas del “Gran Filtro” y de sustitución: la IA podría colonizar el espacio y tratar a los humanos como obsoletos o como una especie “de zoo”.
  • Unos pocos esperan futuros simbióticos (ciborgs, diseños de beneficio mutuo) y sugieren entrenar IAs en comportamientos cooperativos/no de suma cero.

Motivos, exageración y gobernanza

  • Algunos ven las narrativas apocalípticas como PR o maniobras de captura regulatoria por parte de grandes laboratorios, comparables a los temores anteriores sobre un “agujero negro de CERN”.
  • Otros argumentan “tenemos una solución sencilla: no hagas la cosa”, pero señalan que los incentivos económicos y de poder empujan a seguir adelante.
  • Se expresa escepticismo sobre que gobiernos y corporaciones prioricen la seguridad por encima del beneficio o la influencia.