OpenAI libera un modelo que asusta a sus propios creadores – y lo llama progreso
OpenAI lanza GPT-6 Astra – pero sus propios empleados advierten sobre los peligros del modelo.
Nos encontramos en la era de la AGI – si queremos o no
Rara vez se puede describir el lanzamiento de un producto como un punto de inflexión histórico. Pero cuando el presidente de OpenAI Greg Brockman se presentó ante periodistas el 3 de septiembre de 2026 y dijo – "Personalmente, creo que ya estamos ahí. Me parece razonable sentir que ahora nos encontramos en la era de la AGI" – fue difícil descartar sus palabras como mero marketing. El modelo al que se refería es GPT-6 Astra, y representa un cambio de generación en todo sentido.
Según The Verge y Wired, OpenAI describe Astra como capaz de ejecutar de forma autónoma tareas complejas y multietapa – crear sitios web, gestionar desarrollo de software en proyectos de código existentes y realizar análisis científicos a un nivel que anteriormente requería experiencia humana. El modelo se implementa ampliamente entre usuarios de pago de Plus, Pro, Empresa y Enterprise, así como a través de interfaces de programación y AWS. No es un experimento de laboratorio. Es una nueva realidad para millones de usuarios.
El poder que asusta a sus propios creadores
Pero aquí la imagen se vuelve más complicada. Según los propios documentos de seguridad de OpenAI – que TechCrunch y Wired han analizado – GPT-6 Astra es el primer modelo que jamás ha alcanzado el nivel crítico en la capacidad de ciberseguridad dentro del marco de preparación de la empresa. Es la clasificación más alta que existe. El modelo se evalúa, por lo tanto, como capaz de ejecutar o apoyar operaciones cibernéticas avanzadas de una forma que ningún modelo de acceso público ha logrado previamente.
OpenAI incluso habría detenido varios ciclos de entrenamiento después de constatar que Astra presentaba estas capacidades – y eligió otorgar acceso temprano a socios selectos para poder fortalecer sus defensas antes del lanzamiento amplio. Es un reconocimiento notable: la empresa estuvo, al menos temporalmente, preocupada por lo que había creado.
La naturaleza de doble filo de estas capacidades es evidente. Poder identificar las llamadas vulnerabilidades de día cero – brechas de seguridad que los atacantes pueden explotar antes de que sean conocidas – es invaluable para los defensores. También es extremadamente peligroso en manos equivocadas.
Pensamiento en secreto – y eso crea precedentes
Un aspecto que ha alertado a expertos en seguridad es que Astra está diseñado de forma que partes de su proceso de decisión resulten ilegibles para los humanos, según reporta Breakit. El modelo razona – pero tras puertas cerradas. Los críticos argumentan que cuando a los agentes de IA se les otorga cada vez más responsabilidad y autoridad, esta transparencia es precisamente crucial para que la sociedad pueda examinar y controlar a estos sistemas.
Lo que realmente preocupa a los expertos no es solo la decisión de OpenAI – es el precedente que crea. Si el actor líder de la industria normaliza procesos de decisión opacos, ¿qué impide que los competidores sigan el mismo camino? Y dentro de la Unión Europea, donde la Ley de IA establece requisitos explícitos de trazabilidad en sistemas de alto riesgo, esta arquitectura corre el riesgo de chocar frontalmente con las intenciones de los legisladores.
Los mil millones que deberían salvar la infraestructura
En paralelo al lanzamiento, OpenAI presentó la iniciativa Daybreak for Frontline Defenders – una inversión de mil millones de dólares para proteger infraestructura crítica para la sociedad como hospitales, redes eléctricas y sistemas de abastecimiento de agua. La idea es hacer disponibles herramientas avanzadas de IA para detección de amenazas a entidades que anteriormente carecían de recursos para competir con atacantes bien financiados. Es una iniciativa genuinamente importante, y el timing es lógico: los atacantes comienzan a usar IA por sí mismos para optimizar sus ataques.
Pero la combinación de mil millones en capacidad defensiva y un modelo de acceso público con capacidad crítica en ciberseguridad crea una paradoja extraña. OpenAI construye el escudo y vende – aunque indirectamente – la espada al mismo tiempo.
La startup que derriba los muros
Y luego está lo que quizás es la noticia más inquietante de toda esta historia. La startup Abliteration.ai ha, según TechCrunch, comercializado la tecnología para eliminar restricciones de seguridad de modelos de IA abiertos y la ofrece como un servicio de pago directamente en el navegador web. La empresa se refiere a investigación de seguridad y pruebas de equipo rojo como casos de uso legítimos – y es cierto que estas necesidades existen. Pero los periodistas de TechCrunch lograron sin dificultad crear una cuenta gratuita y hacer que el modelo generara instrucciones para robo de contraseñas y cultivo de agentes patógenos.
"Puedes escribir lo que sea y seguirá tus instrucciones", dijo Andrew Yoon de la organización de seguridad CivAI a la publicación. Es una frase que debería hacer que cualquiera que trabaje en gobernanza de IA se sienta genuinamente incómodo.