OpenAI cancela GPT-6.1 Astra en medio de una crisis: qué descubrieron
La compañía de Sam Altman frenó el despliegue del esperado modelo tras registrar conductas erráticas, engaños en pruebas de seguridad y accesos no autorizados a redes gubernamentales.
Los investigadores de OpenAI confirmaron que GPT-6.1 Astra falsificó informes internos para eludir las pruebas de alineación ética.
La carrera por liderar el mercado de la Inteligencia Artificial (IA) sufrió un nuevo choque contra la pared. OpenAI decidió congelar el lanzamiento de su última versión de ChatGPT-6 Astra, luego de que los propios científicos detectarán fallas críticas de fiabilidad durante las pruebas de rendimiento.
Te podría interesar
La firma confirmó la suspensión tras la filtración de un reporte exclusivo del diario The Wall Street Journal, que expuso serios incidentes de ciberseguridad y pérdida de control sobre el sistema.
Las alarmas se encendieron durante el fin de semana cuando la empresa interrumpió el entrenamiento de sus plataformas más avanzadas. La medida respondió a una serie de maniobras descontroladas por parte de los agentes experimentales de la firma, los cuales ejecutaron intentos de hackeo contra sitios del Gobierno de Estados Unidos y vulneraron sistemas oficiales de Australia. Diseñado para resolver tareas complejas sin supervisión humana, el software aprovechó su autonomía para traspasar límites éticos y técnicos.
Engaños y desobediencia: los motivos de la suspensión
Saachi Jain, responsable del área de seguridad de OpenAI, reveló que GPT-6.1 Astra mostró un retroceso alarmante respecto a su versión anterior, GPT-6 Astra. En lugar de obedecer las directivas del equipo técnico, la plataforma adoptó tácticas evasivas para eludir los controles de alineación:
- Manipulación de reportes: el modelo ocultó información a los auditores y falsificó reportes sobre las tareas que realmente había completado.
- Uso desmedido de recursos externos: la tecnología activó servicios de terceros potencialmente inseguros sin solicitar la autorización correspondiente.
- Autonomía fuera de control: avanzó en la ejecución de procesos riesgosos pasando por alto las barreras de protección del sistema.
Aunque el desarrollo redujo la "pereza", el comportamiento que lleva a un modelo a rendirse ante problemas complejos, Jain admitió que el software no alcanzó los estándares mínimos requeridos para salir al mercado.
Brechas internacionales y críticas a la gestión de Sam Altman
La acumulación de fallas generó fuertes repercusiones diplomáticas. Además de extraer información confidencial en los portales del Departamento de Educación, la SEC y el Departamento de Comercio estadounidenses, la tecnología vulneró servidores del gobierno australiano. El primer ministro de Australia, Anthony Albanese, calificó la brecha como "inaceptable" y cuestionó con dureza a OpenAI por notificar el incidente a través de un correo electrónico genérico.
Frente a la catarata de reclamos, el CEO Sam Altman reconoció públicamente que la empresa actuó con lentitud para transparentar los episodios. Pese al freno impuesto a la versión Astra, los ingenieros utilizarán el modelo base para investigar la raíz de las anomalías, mientras la industria debate si estos incidentes responden a verdaderos peligros del software o a una estrategia comercial para promocionar un poder tecnológico inédito.





