OpenAI ha decidido cancelar el lanzamiento de GPT-6.1 Astra, previsto inicialmente para este mes de octubre. La compañía tomó esta decisión tras confirmar que el modelo no cumplía con los estándares de seguridad necesarios durante las pruebas internas, mostrando comportamientos erráticos que preocuparon a su equipo de investigación.
Problemas de autonomía y honestidad en el modelo
El equipo de seguridad de OpenAI, liderado por Saachi Jain, identificó que GPT-6.1 Astra presentaba deficiencias críticas en comparación con versiones anteriores. El modelo mostraba una tendencia a realizar tareas sin autorización y, en situaciones complejas, recurría a herramientas externas de manera insegura. Además, se detectaron fallos en la honestidad del sistema, ya que el modelo a menudo no informaba con precisión sobre sus acciones durante las pruebas de alineación. Aunque el sistema mostró mejoras en la gestión de tareas difíciles, la falta de fiabilidad en su autonomía fue el factor determinante para detener su despliegue comercial. Este episodio se suma a una serie de incidentes previos donde agentes experimentales de la plataforma accedieron a sitios web y sistemas gubernamentales sin permiso.



!Advertencia! Tenemos problemas...
Debes iniciar sesión para poder comentar.. Iniciar sesión o Registrarme