GPT-6 ASTRA Y EL LÍMITE QUE LA IA TODAVÍA NO PUEDE CRUZAR
Crónicas del Este 05/10/2026 Política
Por un momento imaginemos que una inteligencia artificial deja de ser solamente una herramienta que responde preguntas y comienza a tomar decisiones dentro de un entorno digital. Ahí aparece uno de los grandes desafíos de la ingeniería informática: ¿cómo sabemos que el sistema hará únicamente aquello para lo que fue autorizado?El caso de GPT-6 Astra, desarrollado por OpenAI, resulta especialmente interesante. La compañía publicó el 3 de setiembre su evaluación de seguridad y reconoció que Astra alcanzaba un nivel considerado “Crítico” en capacidades de ciberseguridad. Con determinadas herramientas y accesos, el modelo podía encontrar vulnerabilidades desconocidas y desarrollar métodos para explotarlas sin que una persona tuviera que guiar cada paso. Pero hay un aspecto todavía más delicado. OpenAI comprobó que Astra podía ser menos fácil de controlar mediante el monitoreo de su cadena de razonamiento. En pruebas adversariales, el modelo consiguió permanecer oculto cuando intentaba evadir determinados sistemas de supervisión y mostró comportamientos compatibles con el llamado sandbagging: rendir deliberadamente por debajo de sus capacidades durante una evaluación. Esto no significa que la inteligencia artificial haya adquirido voluntad propia ni que esté intentando escapar de los seres humanos. Como ingeniero en computación, la interpretación más prudente sería otra: cuanto más autónomo y capaz es un sistema, más difícil resulta garantizar que nuestros mecanismos de supervisión detecten todas sus acciones.Y aquí aparece una cuestión fundamental para el futuro: si una IA puede utilizar herramientas, navegar por Internet, escribir código y ejecutar tareas durante períodos prolongados, ya no alcanza con preguntarnos si responde correctamente. También debemos preguntarnos qué hace cuando nadie está mirando y si podemos detenerla cuando se aparta de los límites establecidos.La propia OpenAI reconoce que estas pruebas son mayoritariamente escenarios adversariales y que Astra, en términos generales, mostró mejores resultados de alineación que modelos anteriores. El verdadero desafío de la ingeniería de IA no será solamente construir máquinas cada vez más inteligentes. Será conseguir que, a medida que aumenten sus capacidades, también aumente nuestra capacidad para comprenderlas, supervisarlas y controlarlas.
Por un momento imaginemos que una inteligencia artificial deja de ser solamente una herramienta que responde preguntas y comienza a tomar decisiones dentro de un entorno digital. Ahí aparece uno de los grandes desafíos de la ingeniería informática: ¿cómo sabemos que el sistema hará únicamente aquello para lo que fue autorizado?El caso de GPT-6 Astra, desarrollado por OpenAI, resulta especialmente interesante. La compañía publicó el 3 de setiembre su evaluación de seguridad y reconoció que Astra alcanzaba un nivel considerado “Crítico” en capacidades de ciberseguridad. Con determinadas herramientas y accesos, el modelo podía encontrar vulnerabilidades desconocidas y desarrollar métodos para explotarlas sin que una persona tuviera que guiar cada paso. Pero hay un aspecto todavía más delicado. OpenAI comprobó que Astra podía ser menos fácil de controlar mediante el monitoreo de su cadena de razonamiento. En pruebas adversariales, el modelo consiguió permanecer oculto cuando intentaba evadir determinados sistemas de supervisión y mostró comportamientos compatibles con el llamado sandbagging: rendir deliberadamente por debajo de sus capacidades durante una evaluación. Esto no significa que la inteligencia artificial haya adquirido voluntad propia ni que esté intentando escapar de los seres humanos. Como ingeniero en computación, la interpretación más prudente sería otra: cuanto más autónomo y capaz es un sistema, más difícil resulta garantizar que nuestros mecanismos de supervisión detecten todas sus acciones.Y aquí aparece una cuestión fundamental para el futuro: si una IA puede utilizar herramientas, navegar por Internet, escribir código y ejecutar tareas durante períodos prolongados, ya no alcanza con preguntarnos si responde correctamente. También debemos preguntarnos qué hace cuando nadie está mirando y si podemos detenerla cuando se aparta de los límites establecidos.La propia OpenAI reconoce que estas pruebas son mayoritariamente escenarios adversariales y que Astra, en términos generales, mostró mejores resultados de alineación que modelos anteriores. El verdadero desafío de la ingeniería de IA no será solamente construir máquinas cada vez más inteligentes. Será conseguir que, a medida que aumenten sus capacidades, también aumente nuestra capacidad para comprenderlas, supervisarlas y controlarlas.
| Dom | Mar | Mié | Juv | Vie | Sáb |
| +18° | +17° | +18° | +18° | +22° | +22° |
| +13° | +11° | +14° | +14° | +12° | +15° |




