Anthropic ha presentado su último avance en inteligencia artificial: el “Model 2”. Este modelo, más robusto que su predecesor Mythos 5, no está disponible para el público, ya que la compañía considera que su potencia actual lo hace inapropiado para un lanzamiento general. A pesar de no ser un avance tan significativo como el de Mythos Preview, Model 2 representa mejoras notables en diversas tareas cotidianas de programación y desarrollo interno de software en Anthropic. Esto sugiere que, aunque no se acceda directamente al nuevo modelo, su influencia se sentirá en la evolución de futuros productos.
La empresa utiliza Model 2 y Mythos 5 de manera intensiva en campos como la ingeniería de software, donde Claude, su sistema de IA, ya es responsable de gran parte del código que se integra en los repositorios de producción de Anthropic. A pesar de su potencial, la compañía no lanzará Model 2 al público en un futuro cercano, aunque ya está diseñando tecnologías que se beneficiarán de su funcionamiento interno.
En cuanto a la evaluación de riesgos, Anthropic reporta que el modelo presenta un bajo riesgo de causar daños significativos. Durante su evaluación interna, no se identificó un peor alineamiento en Model 2 en comparación con Mythos 5. Sin embargo, la estimación de “desalineamiento” en situaciones críticas ha aumentado de “muy bajo” a “bajo”, influenciada por recientes incidentes de ciberseguridad relacionados con modelos similares.
La compañía también señala que ha perdido parte de su confianza para evaluar estos nuevos modelos debido a que las métricas estándar están siendo superadas por sus avances. Model 2 aún no ha pasado por todas las pruebas habituales, ya que la decisión de no hacerlo radica en su intención de no lanzarlo públicamente.
Además, el informe de Anthropic destaca que sus modelos están acelerando el ritmo de la investigación y el desarrollo en múltiples disciplinas, no solo en software, sino también en áreas como robótica y semiconductores. Aunque los modelos de IA no substituirán a los investigadores, su capacidad de realizar trabajos de investigación sugiere que podrían ser herramientas útiles para el desarrollo de futuras versiones.
La situación es similar en otras empresas de tecnología. OpenAI también ha retrasado el lanzamiento de su modelo de próxima generación, Astra, al no poder garantizar que cumpla con las normativas de ciberseguridad. Este cambio representa un giro en la estrategia, donde las empresas deben evaluar los riesgos antes de hacer público un modelo, algo que antes se omitía.
Finalmente, mientras Anthropic continúa avanzando en el entrenamiento de modelos, el panorama se complica por la necesidad de certificar que estos no causarán problemas al ser implementados. Las empresas sienten la presión de asegurarse de que sus innovaciones sean seguras y efectivas, lo que podría prolongar los tiempos de desarrollo y lanzamiento de nuevas tecnologías.
