Anthropic desarrolla el "Model 2", un potente sistema de IA no disponible para el público

Tecnologia
Anthropic ha desarrollado un nuevo modelo de inteligencia artificial, denominado "Model 2", que supera a su predecesor, Mythos 5. Aunque la compañía lo considera demasiado potente para su lanzamiento público, ya está siendo utilizado internamente para impulsar la ingeniería de software y el desarrollo de futuras tecnologías. La decisión de mantenerlo privado refleja una creciente cautela en la industria ante los riesgos potenciales de modelos de IA avanzados.

Anthropic ha creado un modelo de inteligencia artificial, conocido simplemente como "Model 2", que no está disponible para el público. Este modelo es más potente que Mythos 5 y, según la propia compañía, ofrece una "mejora apreciable" en diversas tareas internas. Si bien no representa un salto tan grande como el de Mythos Preview, sus desarrolladores consideran que es demasiado avanzado para ser lanzado públicamente. Esta situación evoca un escenario ya visto en el ámbito de la IA.

Anthropic utiliza intensivamente tanto Mythos 5 como Model 2 en áreas como la ingeniería de software, la programación, la generación de datos y el uso de agentes de IA persistentes en sus flujos de trabajo empresariales. Un informe de la compañía revela que Claude ya genera la mayor parte del código que se integra en los repositorios de producción de Anthropic. Aunque Model 2 no es accesible al público, ya está contribuyendo a la creación de futuras innovaciones.

Anthropic evalúa el riesgo global de que Model 2 cause daños graves en un nivel bajo. De hecho, durante la fase de aprobación para uso interno, no se encontró que Model 2 presentara un peor alineamiento que Mythos 5. No obstante, la estimación general de riesgo de "desalineamiento" en situaciones de alto impacto se elevó de "muy bajo" a "bajo". Esto se atribuye en parte a la incertidumbre generada por los recientes incidentes de ciberseguridad que han afectado tanto a sus modelos como a los de OpenAI.

La empresa también admite tener menos confianza que antes al extraer conclusiones sobre los riesgos derivados de estos nuevos modelos. Esto se debe a que varias evaluaciones específicas están saturadas, ya que los modelos han mejorado tanto que los puntos de referencia ya no son tan útiles. Con Model 2, Anthropic ni siquiera ha ejecutado toda su batería de pruebas, precisamente porque no tienen la intención de lanzarlo públicamente.

En su informe, Anthropic plantea una situación igualmente interesante e inquietante: sus modelos están acelerando la velocidad de la investigación y el desarrollo de productos. Esto no se limita al software, sino que se extiende a otras áreas como la robótica, la biotecnología, la energía o los semiconductores. Aunque no creen que Mythos 5 ni Model 2 puedan reemplazar a sus investigadores, cuanto más trabajo de investigación realizan estos modelos, más plausible parece que, tarde o temprano, un nuevo modelo ayudará a entrenar y mejorar al siguiente.

OpenAI también está retrasando el lanzamiento de su modelo de próxima generación, Astra, al no poder descartar que sea demasiado capaz en el ámbito de la ciberseguridad. Esta tendencia es notable: las startups de IA están llegando a una fase en la que, tras entrenar un modelo, deben decidir si es conveniente o no publicarlo. Si bien antes solían lanzar los modelos en cuanto los desarrollaban, ahora existe una fase (necesaria) de evaluación para comprender el alcance del modelo antes de su lanzamiento.

Anthropic no ha detenido el desarrollo y continúa entrenando modelos más avanzados. Sin embargo, las noticias de las últimas semanas reflejan una situación paradójica. Aun considerando que el riesgo de desplegar un modelo es bajo, como en este caso, las empresas ya no están tan seguras de que deban lanzarlos, por si acaso provocan algún problema. Esto subraya una nueva necesidad: es cada vez más crucial saber con certeza que los modelos no excederán los límites antes de ser lanzados.