OpenAI Propone Estándares Globales para la Inteligencia Artificial de Frontera y la Protección del Control Humano

Tecnologia
OpenAI ha presentado una iniciativa para establecer estándares técnicos comunes en el desarrollo de modelos de inteligencia artificial de frontera, buscando garantizar que esta tecnología beneficie a la humanidad y que el control humano permanezca intacto. La propuesta surge en un contexto de creciente preocupación por la rápida evolución de la IA y el potencial de la automejora recursiva. Se enfatiza la necesidad de una supervisión neutral y la cooperación internacional para mitigar riesgos.

“Nuestro objetivo es garantizar que la inteligencia artificial (IA) general beneficie a toda la humanidad”. Así comienza el artículo “Desarrollar los estándares para la próxima fase de la IA”, publicado recientemente por OpenAI. Sam Altman, director general de este laboratorio, y Jakub Pachocki, su científico jefe, han expresado públicamente su inquietud por el vertiginoso avance de la IA en los últimos días. El artículo “Una mente alienígena”, que Pachocki publicó el 6 de septiembre, destaca la relevancia de esta preocupación.

Algo está transformándose en los principales laboratorios de IA de Estados Unidos. Hasta hace poco, se encontraban en una carrera desenfrenada por liderar el desarrollo de los modelos de frontera. Ahora, estas mismas corporaciones buscan moderar el ritmo. Además, están comenzando a proponer estrategias que, en teoría, buscan minimizar los riesgos asociados a la posible llegada de un modelo de IA tan avanzado que pueda desarrollar por sí mismo modelos aún más sofisticados. Este concepto se conoce como mejora recursiva.

La solución a este escenario, propuesta por OpenAI en su reciente artículo, requiere el establecimiento de estándares técnicos comunes para los modelos de IA de frontera. De esta manera, la seguridad, las evaluaciones y la gestión de incidentes no dependerán exclusivamente de los laboratorios involucrados y sus países de origen. Se prevé una supervisión neutral y superior que aprovechará el trabajo ya realizado por los institutos de seguridad de la IA.

El verdadero desafío radica en proteger el control humano sobre los modelos de IA. El punto de partida de la estrategia de OpenAI consiste en asegurar que el desarrollo de los modelos de frontera vaya acompañado de un desarrollo comparable en la investigación de alineamiento. El propósito del alineamiento es garantizar que los modelos de IA más capaces y autónomos se comporten de acuerdo con los objetivos humanos y permanezcan bajo su supervisión en todo momento. En este contexto, la principal amenaza, según los laboratorios estadounidenses que se han manifestado, es la automejora recursiva.

La automejora recursiva completamente autónoma aún no existe. Si un modelo de frontera adquiriera la capacidad de mejorar sus propias habilidades generando nuevas versiones de sí mismo u otros modelos aún más avanzados sin la intervención y supervisión de sus creadores, el ser humano podría perder el control de su invención. Además, OpenAI advierte que a medida que aumenta el grado de automatización, también lo hace la velocidad de progreso de la IA. Sin embargo, reconoce que la automejora recursiva completamente autónoma todavía no existe. De hecho, este laboratorio sostiene que esta capacidad no debe buscarse hasta que pueda implementarse de forma segura.

La preocupación por el correcto alineamiento de la IA está presente en todo el artículo de OpenAI, pero sus propuestas no se limitan solo a este desafío. Altman y sus colegas defienden la necesidad de crear un protocolo que identifique los incidentes causados por los modelos de IA de frontera que deben ser notificados a las autoridades. Además, consideran que es fundamental la cooperación entre países para elaborar mecanismos de actuación conjunta ante este escenario.

Esta propuesta de OpenAI llega en un momento en que el debate sobre la gestión de los riesgos derivados del desarrollo de sistemas de IA avanzados parece alcanzar su punto álgido. Es posible que las iniciativas de Anthropic, OpenAI y otros laboratorios estadounidenses no sean en vano y prosperen, pero no es suficiente. A Estados Unidos probablemente no le costará conseguir la complicidad de sus aliados, pero lo más importante es que se alinee en este ámbito con China para que los laboratorios de IA de ambos países estén sujetos a los mismos estándares de seguridad y protocolos de actuación. Actualmente, nada indica que este acuerdo sea posible a corto plazo.