ALARMA POR EL FUTURO DE LA IA: UN INVESTIGADOR ADVIERTE QUE PODRÍA “MATARNOS A TODOS”

ALARMA POR EL FUTURO DE LA IA: UN INVESTIGADOR ADVIERTE QUE PODRÍA “MATARNOS A TODOS”

Jacob Coxon, un investigador británico que trabajó en OpenAI y Anthropic, renunció y cuestionó la carrera por desarrollar una superinteligencia capaz de mejorar sus propias capacidades. Su advertencia fue respaldada por Evan Hubinger, científico de Anthropic, quien reconoció que consideran posible que una inteligencia artificial llegue a matar a todos los seres humanos y estimó en más de un 10% la posibilidad de que ocurra durante la próxima década.

Una fuerte advertencia sobre el futuro de la inteligencia artificial surgió desde el interior de dos de las principales compañías dedicadas al desarrollo de esta tecnología.

Jacob Coxon, de 27 años, investigador especializado en el entrenamiento de modelos de inteligencia artificial, decidió abandonar Anthropic después de haber trabajado anteriormente en OpenAI. Según explicó, tomó la decisión porque considera que ambas compañías están avanzando hacia sistemas cada vez más poderosos sin contar con garantías suficientes para controlar sus posibles consecuencias.

Coxon sostuvo que la industria se dirige directamente hacia una superinteligencia capaz de mejorar sus propias capacidades, un escenario que podría acelerar de manera extraordinaria la evolución de estos sistemas.

El investigador expresó públicamente su preocupación y cuestionó que el desarrollo de una tecnología con semejante potencial de transformación quede principalmente en manos de empresas privadas.

Según relató, durante los últimos tres años trabajó en investigaciones vinculadas al preentrenamiento de modelos, primero en OpenAI y posteriormente en Anthropic. Precisamente, explicó que se incorporó a esta última compañía atraído por su enfoque en seguridad y alineación de la inteligencia artificial.

Sin embargo, decidió abandonar el puesto tras considerar que el rumbo tomado por la industria representa un riesgo demasiado elevado.

“Podría matarnos a todos”

La advertencia tomó una dimensión todavía mayor cuando Evan Hubinger, investigador de Anthropic especializado en alineación de inteligencia artificial, respaldó públicamente las declaraciones de Coxon.

Hubinger afirmó que la preocupación planteada por su excolega es real y reconoció que dentro de la compañía consideran posible que una inteligencia artificial llegue a matar a todos los seres humanos.

El científico fue todavía más lejos: calculó personalmente en más de un 10% la posibilidad de que un escenario de ese tipo ocurra durante la próxima década.

No se trata de una predicción científica que establezca que la humanidad será destruida, sino de una estimación personal de riesgo realizada por un investigador que trabaja precisamente en seguridad y alineación de IA.

Hubinger también reconoció una de las cuestiones que más preocupa a los especialistas: Anthropic todavía no tiene un plan definitivo para resolver el problema de la alineación de una eventual superinteligencia.

La alineación busca garantizar que un sistema de inteligencia artificial extremadamente poderoso mantenga sus objetivos compatibles con los intereses humanos, incluso cuando sus capacidades superen ampliamente las de las personas que lo desarrollaron.

Una carrera cada vez más acelerada

Coxon considera que las principales compañías del sector están inmersas en una carrera para desarrollar sistemas cada vez más capaces.

El investigador señaló que dentro de la industria ya se utilizan expresiones como “crunchtime” y “endgame” para describir la etapa hacia la que estaría avanzando el desarrollo de estos modelos.

También advirtió que los futuros sistemas podrían superar las capacidades humanas en múltiples áreas, operar sobre sistemas digitales, acelerar investigaciones y adquirir acceso a recursos a una velocidad difícil de supervisar.

En declaraciones al Wall Street Journal, Coxon sostuvo que algunos de los escenarios más extremos podrían comenzar a materializarse antes de que termine 2027.

Su preocupación central no pasa solamente por lo que una IA puede hacer actualmente, sino por qué podría ocurrir cuando los sistemas sean capaces de mejorar sus propias capacidades y desarrollar estrategias que sus creadores no puedan anticipar o comprender completamente.

El debate ya no es solamente tecnológico

Las declaraciones de ambos investigadores se producen mientras gobiernos y organismos internacionales discuten cómo regular el desarrollo de inteligencia artificial avanzada.

Para Coxon, una decisión que podría afectar la supervivencia de la humanidad no debería quedar exclusivamente en manos de compañías privadas que compiten entre sí por alcanzar primero la próxima generación de modelos.

Las advertencias también se suman a otras renuncias de investigadores vinculados con la seguridad de la IA en los últimos años, algunos de los cuales cuestionaron que el desarrollo de nuevos productos y capacidades pueda estar avanzando más rápido que las investigaciones destinadas a garantizar su seguridad.

La discusión plantea así uno de los grandes interrogantes del desarrollo tecnológico actual:

¿La humanidad está desarrollando inteligencias cada vez más poderosas más rápido de lo que está aprendiendo a controlarlas?

Por el momento, no existe evidencia de que los sistemas actuales estén cerca de provocar un escenario de extinción humana. Sin embargo, que investigadores que participaron directamente en el desarrollo de estas tecnologías adviertan públicamente que una IA avanzada podría llegar a matar a todos los seres humanos vuelve a poner sobre la mesa una pregunta que hasta hace pocos años parecía propia de la ciencia ficción.