Ejecutivos y científicos alertan de una “explosión” en el desarrollo de “IA altamente capaz o sobrehumana”

Dan Milmo

0

Más de veintena de los mayores especialistas en inteligencia artificial del mundo advierten a los gobiernos que se preparen para una “explosión de inteligencia” que podría desencadenar el desarrollo tecnológico más trascendental de la historia. En un nuevo informe, entre cuyos autores están el premio Nobel Geoffrey Hinton y el premio Turing Yoshua Bengio, dos de los referentes científicos de esta tecnología, piden a los políticos que actúen ahora antes de que se produzca un avance descontrolado de la IA.

Los autores afirman que esa “explosión de inteligencia” podría tomar forma como una “aceleración drástica del progreso de la IA impulsada por la propia IA, que comprimiría en meses o menos avances que, de otro modo, llevarían años”.

El artículo, titulado ¿Y si automatizar la investigación y el desarrollo de la IA desencadena una explosión de inteligencia? y publicado por el departamento de ciencia y políticas públicas de la IA de la Universidad de Cambridge, está firmado también por altos ejecutivos de la industria como Jack Clark, cofundador de Anthropic, y Jakub Pachocki, científico jefe de OpenAI.

Sus preocupaciones se centran en la posibilidad de que los agentes de IA sean capaces de mejorarse a sí mismos sin intervención humana, un proceso conocido como “automejora recursiva”. El informe se refiere a este proceso de forma general como automatización de la investigación y el desarrollo de IA. Según el documento, una vez que los sistemas de IA alcancen capacidades de nivel experto en investigación y desarrollo de IA, un solo desarrollador podría gestionar una fuerza de trabajo equivalente a “millones” de los mejores investigadores humanos.

La IA que se mejora a sí misma

Los autores señalan que la automatización de la investigación y el desarrollo de IA es la fuente más probable de una explosión de inteligencia, porque las IA ya están contribuyendo a mejorar su propia tecnología y los sistemas resultantes pueden desplegarse rápidamente una vez construidos.

“Una explosión de inteligencia podría ser el desarrollo tecnológico más trascendental de la historia de la humanidad, al comprimir años de progreso en meses o menos, amenazar el control humano sobre los sistemas de IA y erosionar gravemente los mecanismos de control del poder dentro de los Estados y entre ellos, así como entre empresas y ramas del Gobierno”, señala el informe.

Una explosión de inteligencia podría ser el desarrollo tecnológico más trascendental de la historia de la humanidad, al comprimir años de progreso en meses o menos, amenazar el control humano sobre los sistemas de IA y erosionar gravemente los mecanismos de control del poder dentro de los Estados

Por ello, los autores instan a los Gobiernos a actuar con rapidez: “Una vez que comience una explosión de inteligencia, la ventana de oportunidad para actuar podría cerrarse”. El informe recomienda tres prioridades políticas: exigir informes transparentes sobre los avances en investigación y desarrollo relacionados con la IA, incluida la incorporación de auditores independientes en las empresas; buscar formas de limitar el desarrollo acelerado de la IA; y prepararse para adaptarse a una explosión de inteligencia.

Anthropic y OpenAI han aceptado que evaluadores independientes examinen sus modelos, después de advertir de que el desarrollo de la IA estaba alcanzando un punto crítico en materia de seguridad. Anthropic afirma que la IA genera actualmente el 80% de su propio código, mientras que OpenAI utiliza agentes autónomos de IA en ámbitos como el entrenamiento de nuevos modelos.

“Las pruebas preliminares sugieren que una explosión de inteligencia impulsada por el software es posible”, señala el informe, que añade que esto conduciría al “desarrollo extremadamente rápido de sistemas de IA altamente capaces o sobrehumanos”.

Salto en avances y en amenazas

Aunque esto podría producir avances médicos y saltos tecnológicos, también entrañaría tres tipos de riesgos: los sistemas avanzados podrían facilitar amenazas biológicas y cibernéticas que evolucionaran más rápido que las medidas necesarias para hacerles frente; a medida que los humanos participaran menos en la investigación y el desarrollo de IA, podrían perder la oportunidad de mantener el control sobre los sistemas; y los Estados podrían utilizar una explosión de inteligencia para convertir una ventaja moderada en ámbitos como el ciberespacio en una ventaja decisiva.

El informe reconoce que estos efectos son “inciertos”. Por ejemplo, un avance tecnológico podría tardar en aplicarse debido a la necesidad de establecer cadenas de suministro para obtener materiales especiales o de cumplir con la regulación. Los sistemas de IA también podrían acelerar la velocidad a la que se mitigan los riesgos, señalan los autores.

Si se produjera un avance de este tipo, los autores sostienen que los sistemas de IA podrían superar rápidamente a los expertos humanos en la mayoría de los campos y “acelerar radicalmente” el progreso tecnológico. Prepararse para este escenario “debería ser una prioridad urgente, incluso en los niveles más altos de los Gobiernos”.

Los autores señalan que los Gobiernos deberían estudiar políticas que aborden la posibilidad de una explosión de inteligencia, entre ellas: exigir informes transparentes sobre los avances en investigación y desarrollo relacionados con la IA, incluida la incorporación de auditores independientes en las empresas; limitar la velocidad a la que una IA puede mejorar durante un determinado periodo de tiempo; colaborar con los centros de datos para permitir la suspensión de determinados proyectos de investigación y desarrollo de IA; garantizar que los sistemas automatizados de investigación y desarrollo de IA estén completamente aislados y no puedan escapar al control humano; y crear “planes de respuesta de emergencia” para los distintos escenarios que podrían surgir a raíz de una explosión de inteligencia.

Se trata de medidas muy similares al conocido plan para “ralentizar” la IA elaborado por Dario Amodei, el CEO de Anthropic, que ha provocado desconfianza fuera de Silicon Valley.

A pesar de los fallos que han mostrado algunos sistemas, como desobedecer instrucciones, los proyectos de investigación y desarrollo que a los humanos les llevarían meses podrían estar completamente automatizados mediante IA para 2028. “Las ganancias de productividad derivadas de la automatización de la investigación y el desarrollo de IA todavía no han alcanzado el umbral necesario para desencadenar una explosión de inteligencia, pero es probable que las mejoras de los sistemas más recientes se estén acercando a ese umbral”, señalan.