Anthropic dice que tiene un nuevo modelo de IA teóricamente superior en todo a Mythos 5


Lo usan de manera interna para programación y agentes pero no tienen planes de lanzarlo de manera pública

 


Categoría: TECNOLÓGICAS

Buenos Aires-(Nomyc)-Anthropic, la empresa norteamericana de IA, tiene disponible un modelo de IA que no se pude probar, se llama “Model 2”, es aún más potente que “Mythos 5” y según la propia compañía, ofrece una “mejora apreciable”, en muchas de las tareas que realizan de manera interna y según afirman, el modelo, es un salto tan grande como el que hubo al lanzar Mythos Preview, pero para los responsables del mismo, es “demasiado potente” para lanzarlo de manera pública y si esa historia resuena, es porque tenía que resonar.

 

Un modelo que construye el futuro: Anthropic indica que utiliza tanto Mythos 5 como Model 2, de forma intensiva en el ámbito de la ingeniería software, la programación, la generación de datos o el uso de agentes de IA persistentes dentro de sus flujos de trabajo empresariales. 

 

Su informe permite descubrir que Claude, ya escribe la mayoría del código que se fusiona en los repositorios de producción de Anthropic, pero aunque Model 2, pero no está disponible de manera pública, ya está ayuda a crear lo que vendrá en el futuro. 

 

Sin monstruos a la vista: la evaluación global de Anthropic situa el riesgo de que el modelo cause daños graves en un nivel bajo, e incluso, durante la fase de aprobación para su uso interno, Anthropic no encontró que Model 2 tuviera peor alineamiento que Mythos 5. 

 

Aun así, su estimación general de riesgo de “desalineamiento” en situaciones de alto impacto pasó de “muy bajo” a “bajo”, en parte por la incertidumbre que generaron los últimos escándalos de ciberseguridad que hemos conocido en sus modelos o los de OpenAI.

 

Mejores pruebas: la empresa, también reconoce que tiene menos confianza que antes, a la hora de sacar conclusiones sobre los riesgos que se derivan de estos nuevos modelos debido a que varias evaluaciones concretas, ya están saturadas: los modelos mejoraron tanto, que esos benchmarks ya no sirven de mucho, pero con Model 2 ni siquiera ejecutaron toda su batería de pruebas porque, no pretenden lanzarlo de manera pública.

 

Modelos de IA que engendran modelos de IAen ese informe, Anthropic también plantea algo interesante e inquietante a partes iguales, ya que sus modelos están acelerando y hacen que la velocidad a la que marchan, tanto en la investigación, como en el desarrollo de productos, se incremente. 

 

No solo en software, sino en otras áreas como robótica, biotecnología, energía o semiconductores, ni Mythos 5 ni Model 2 puedan sustituir a sus investigadores , pero cuanto más trabajo de investigación hacen estos modelos, más fácil parece pensar que antes o después un nuevo modelo ayudará a entrenar y mejorar al siguiente.

 

El dilema de los modelos demasiado potentes: OpenAI está retrasando, también, su modelo de próxima generación, Astraporque no pudo descartar que sea demasiado capaz en el ámbito de la ciberseguridad. 

 

La tendencia es, desde luego, llamativa: las startups de IA ingresan en una fase en la que terminan de entrenar un modelo y luego, tienen que decidir si conviene o no publicarlo y 

hasta ahora, en cuanto desarrollaban un nuevo modelo lo lanzaban, pero ahora aparece esa necesaria fase, de evaluar y saber hasta dónde puede llegar el modelo, antes de lanzarlo. 

 

Todo va demasiado rápido: Anthropic, no frenó el desarrollo y continúa con el entrenamiento de modelos más avanzados, pero las noticias de las últimas semanas, reflejan una situación paradójica. 

 

Aun, si se considera que el riesgo de desplegar un modelo es bajo, como en este caso, las empresas ya no tienen tan claro que deban lanzarlos por si acaso rompen algo y aquí, aparece una nueva necesidad: se necesitan cada vez más saber con certeza que los modelos no van a pasarse de la raya antes de lanzarlos.

Nomyc-20-8-26

 

Consultá por este producto
@

*Los campos son obligatorios

Cargando
¡Contactanos!
clave

NOTICIAS
con contraseña