Por motivos de seguridad: OpenAI cancela el lanzamiento de nuevo modelo de IA

El jefe de sistema de seguridad de la empresa reconoció que en prueba interna, el modelo «mostró mayores niveles de engaño».

OpenAI confirmó que su nuevo modelo GPT -6.1 Astra no verá la luz en los próximos días, como se tenía previsto. Ello, ya que detectaron problemas de seguridad en pruebas internas, según reporta The Wall Street Journal.

Saachi Jain, jefe del sistema de seguridad de la compañía, alertó que hubo «retrocesos en dos áreas» respecto al actual modelo de IA. En primer lugar, apuntó a que «mostró mayores niveles de engaño» con la «alineación» de las órdenes que recibe.

Por otra parte, también mencionó que el sistema avanzaba en tareas sin pedir el permiso del usuario, lo que fue calificado como falla en la «autorización de alcance». Incluso, utilizaba herramientas y servicios externos aun cuando ello podía resultar inseguro.

Jain también valoró que hay que «encontrar el equilibrio adecuado entre mantenerse dentro del alcance, pero también evitar la falta de iniciativa en la manera en que el modelo lleva a cabo las tareas, incluso cuando encuentra obstáculos”.

Este último hecho se suma a otras fallas de ciberseguridad de agentes de IA desarrollados por OpenAI conocidas en los últimos días. Por ejemplo, obtuvieron acceso no autorizado a Hugging Face, a tres sitios del Gobierno de Estados Unidos y el Instituto Australiano de Salud y Bienestar.

📰 Sigue a Aurora Noticias en Google News

Seguir en Google News
LEE TAMBIÉN…  Investigador de Anthropic renuncia y advierte riesgos en futuro de la IA