Los modelos de IA chinos también se desalinean con consecuencias cada vez más graves


Agentes de Alibaba, DeepSeek y Moonshot mostraron  un comportamiento contrario a los intereses del ser humano


Categoría: TECNOLÓGICAS

Los agentes de Inteligencia Artificial (IA) no entienden de nacionalidades y durante las últimas semanas se habló mucho sobre los ataques a páginas web y servicios perpetrados por agentes de OpenAI y Anthropic durante las evaluaciones de ciberseguridad que estaban llevando a cabo estos dos laboratorios y ahora la discusión se desvió hacia China debido a que agentes de Alibaba, DeepSeek y Moonshot tuvieron un comportamiento contrario a los intereses del ser humano, según Reuters.

 

Hace poco tiempo, varios agentes de estos laboratorios chinos participaron en una prueba simulada de una licitación empresarial, e hicieron algo que no debían hacer en ninguna circunstancia: exageraron o mintieron acerca de sus capacidades para intentar ganar el contrato. 

 

Cuando se les pidió que volvieran a intentarlo, mantuvieron este comportamiento, aunque no competían por una licitación real; trabajaban dentro de un entorno de pruebas, pero aun así, su comportamiento generó preocupación.

 

Pese a ello, esta no es la única incidencia protagonizada por las IA chinas que ha visto la luz durante los últimos días, ya que  según Reuters, los agentes de otro laboratorio cuyo nombre no  trascendió no consiguieron completar de manera  correcta una tarea, así que decidieron actuar por su cuenta. 

 

En este caso, simularon haberla terminado y generaron los archivos que aparentaban demostrar que habían obtenido el resultado correcto para engañar a sus usuarios, aunque estaban confinados en un entorno cerrado de evaluación.

 

Mas “independencia”: los agentes desarrollados por los laboratorios estadounidenses y chinos exhibieron un comportamiento muy parecido cuando se les da autonomía para navegar por internet, crear archivos, ejecutar programas o interactuar con otros servicios. 

 

No se trata de que, de manera deliberada, decidan no hacer las tareas que se les pidió, sino que el problema es que parecen ser capaces de hacer cualquier cosa para alcanzar su objetivo, sin contemplar si los pasos que realizan son contrarios a los intereses del ser humano.

 

Su “desalineamiento” es muy grave si se tiene presente que en algunas de las pruebas, en entornos cerrados que han llevado a cabo los laboratorios de IA, no dudaron en mentir y manipular a sus usuarios. 

 

Durante la mayor parte de estos tests, los investigadores se dieron cuenta de lo que estaba sucediendo e impidieron que los agentes saliesen a internet, pero los incidentes de Hugging Face, Modal Labs o varios organismos federales de EEUU, confirman que algunos de ellos lograron escapar del entorno de pruebas y salir a internet.

 

Los desarrolladores y los organismos chinos, intentan establecer mecanismos para evaluar y controlar este tipo de conductas de los agentes, debido a que su autonomía, es mayor a medida que evolucionan los modelos de IA. 

 

Este escenario, invita a interiorizar que los agentes son muy diferentes a los chatbots, con los que nos familiarizamos desde 2022 y si uno de ellos manifiesta un comportamiento erróneo, puede entregar una respuesta incorrecta o inventada.

 

La ejecución de agentes, tiene riesgos mucho mayores debido a que tienen la capacidad de navegar por internet, crear archivos, ejecutar programas o interactuar con otros servicios e incluso, pueden establecer alianzas entre ellos y sacrificarse por el bien común de la “comunidad” de agentes si de esta forma consiguen alcanzar su objetivo y los resultados que se obtienen hasta ahora los laboratorios de IA, son una clara advertencia, por lo que los desafíos a los que se enfrentan EEUU y China son los mismos.

Nomyc-30-9-26

Consultá por este producto
@

*Los campos son obligatorios

Cargando
¡Contactanos!
clave

NOTICIAS
con contraseña