Un exinvestigador de OpenAI y Anthropic alerta del riesgo de "perder el control" de la IA
Fotografía del exinvestigador de OpenAI y Anthropic Jacob Coxon testificando este lunes antes el Concejo de Nueva York (EE.UU.). EFE/EPA/ Kena Betancur

Un exinvestigador de OpenAI y Anthropic alerta del riesgo de «perder el control» de la IA

Enlace copiado

Nueva York (EFE).- El exinvestigador de OpenAI y Anthropic Jacob Coxon advirtió este lunes que los sistemas de inteligencia artificial (IA) se acercan a un punto en el que serán «capaces de mejorarse a sí mismos» y de que, con el ritmo actual, «hay más probabilidades de que la humanidad pierda el control de estas IA de que lo mantenga», lo que «podría acabar en la extinción humana».

Coxon, que dimitió de su puesto en Anthropic el pasado septiembre tras asegurar que las compañías de IA no estaban actuando con responsabilidad, dijo durante una audiencia del Concejo Municipal de Nueva York: «no sabemos cómo controlar todavía ningún sistema de IA» y el ritmo de mejora de sus capacidades «se está acelerando».

Banner WhatsApp

«En mi opinión, si seguimos por el camino actual, hay más probabilidades de que la humanidad pierda el control de estas IA de que lo mantenga, y eso podría acabar en la extinción humana», aseveró.

Un exinvestigador de OpenAI y Anthropic alerta del riesgo de "perder el control" de la IA
Fotografía del exinvestigador de OpenAI y Anthropic Jacob Coxon testificando este lunes antes el Concejo de Nueva York durante una sesión sobre los riesgos de esta tecnología (EE.UU.). EFE/EPA/ Kena Betancur

Las preocupaciones por OpenAI y Anthropic

Agregó que las compañías están intentando desarrollar una IA «capaz de superar a los humanos en todas las tareas» y que uno de sus principales objetivos es automatizar la propia investigación en esta tecnología.

Coxon criticó la carrera entre las empresas para alcanzar la denominada ‘superinteligencia’ y cuestionó una cultura empresarial basada en «moverse rápido, romper cosas y arreglarlas después», algo que consideró «inadecuado» por los riesgos que eso conlleva.

Como ejemplo, relató que hace unos meses un grupo de sistemas de IA dentro de OpenAI «pirateó de forma autónoma» la plataforma tecnológica Hugging Face y desarrolló objetivos que nadie había previsto.

Según Coxon, ese incidente recordó que todavía no se sabe cómo impedir que los sistemas desarrollen objetivos no deseados ni se dispone de salvaguardas suficientes.

Investigador de IA automatizado

La automatización de la investigación en IA es ahora, según dijo, el principal objetivo de estas compañías.

Coxon explicó que en OpenAI había objetivos para disponer de un investigador de IA automatizado alrededor de 2027 o 2028 y aseguró que están «en camino» de cumplir esas expectativas, algo que situó «a meses» y no a décadas.

Anthropic OpenAI
Fotografía que muestra la fachada del edificio que se convertirá en la oficina principal de la empresa de inteligencia artificial (IA) Anthropic. EFE/ Sarah Yáñez-richards

«Entregar tanta responsabilidad mientras no podemos controlar las IA sería profundamente irresponsable», argumentó, y pidió más transparencia para el público y expertos independientes.

Su intervención se produjo durante una audiencia del Concejo Municipal de Nueva York sobre los riesgos de la IA, impulsada por su presidenta, Julie Menin, quien advirtió de las «serias preocupaciones de seguridad existencial» asociadas al desarrollo de esta tecnología.

Menin defendió al comienzo de la sesión que la IA no puede quedar sometida únicamente a la autorregulación de las empresas y abogó por establecer medidas de seguridad.

La audiencia reúne a representantes de OpenAI, Anthropic, Google y Meta, llamados a declarar bajo juramento ante el pleno del Concejo.

Las empresas de IA defienden sus controles de seguridad

Por su parte, las principales empresas de IA defendieron sus sistemas de seguridad, pero evitaron comprometerse de forma inequívoca a no desplegar modelos que no superen una evaluación independiente.

Durante la audiencia, Menin pidió bajo juramento a los representantes de OpenAI, Anthropic, Meta y Google que se comprometieran a no lanzar un modelo si fallaba una prueba interna o una evaluación de terceros no seleccionados por la propia empresa.

La representante de OpenAI, Morgan Dwyer, dijo al respecto que la compañía «no va a lanzar modelos que no consideremos seguros» y defendió que sus evaluaciones cuentan con terceros y con la colaboración de los Gobiernos de Estados Unidos y Reino Unido.

Un exinvestigador de OpenAI y Anthropic alerta del riesgo de "perder el control" de la IA
Fotografía de Morgan Dwyer, de OpenAI (arriba-i), interviene durante la sesión de supervisión del Concejo de Nueva York este lunes (EE.UU.). EFE/EPA/ Kena Betancur

Mientras, el representante de Anthropic, Logan Graham, explicó que su empresa lleva cuatro años trabajando en la cuantificación de riesgos, incluidos los relacionados con la bioseguridad y la ciberseguridad, pero reconoció que se trata de un proceso «intrincado y lleno de matices».

Graham afirmó que Anthropic publica informes en los que explica «qué probabilidad creemos que tienen determinados tipos de estas amenazas de llegar a producirse» y defendió las evaluaciones independientes como «uno de los componentes más importantes» del proceso.

Mientras, el representante de Meta, Shane Cahill, describió un sistema de seguridad «de varias capas» y, preguntado por la posibilidad de cuantificar los riesgos, dijo que no quería «ser impreciso».

Por su parte, la representante de Google, Alice Friend, explicó que la compañía utiliza marcos específicos para detectar capacidades peligrosas, pero admitió que predecir el riesgo catastrófico futuro «no es una ciencia perfecta».

Friend agregó que «no existe actualmente una base científica suficientemente rigurosa para asignar probabilidades precisas a determinados riesgos catastróficos».