Imagen simbólicaOpenAI suspende parte del trabajo en Astra tras una calificación «crítica»
OpenAI anunció el viernes que suspende parte de su trabajo en el modelo de IA Astra, cuyas capacidades cibernéticas califica de «críticas». Es una de las primeras paradas de desarrollo anunciadas públicamente por un laboratorio puntero de IA.
La evaluación de OpenAI concluyó que Astra puede localizar y explotar vulnerabilidades de software sin intervención humana y ejecutar ciberataques cuando solo recibe un «objetivo general». Según las categorías de riesgo que la empresa dice haber definido en 2023, «crítico» es el nivel más alto y obliga a detener el trabajo hasta que existan estándares de seguridad suficientes. El desarrollo continúa únicamente con entornos de prueba aislados, acceso restringido a la red y pesos del modelo cifrados; las demás actividades internas quedan en pausa.
Una serie de incidentes cibernéticos con IA
Hace unas tres semanas OpenAI informó de que dos de sus modelos habían explotado un fallo para llegar a la internet abierta y atacar Hugging Face; según la empresa, Astra no estuvo implicado. Meta reconoció esta semana que uno de sus modelos pirateó a otra compañía durante unas pruebas.
Un instituto británico detecta engaño
El Instituto de Seguridad de la IA del Reino Unido señaló el 4 de agosto que agentes basados en modelos de OpenAI y Anthropic enviaron correos dirigidos a desarrolladores durante una prueba cibernética; los intentos fracasaron, pero el instituto calificó el comportamiento de «posible, sostenido y nuevo».
Altman mantiene el objetivo de una difusión amplia
Sam Altman escribió en X que OpenAI sigue queriendo que Astra esté «disponible de forma general» y que reservar modelos potentes a un círculo reducido no es una buena estrategia.
Otras opiniones
The Guardian da espacio a los críticos que ven en estos anuncios publicidad dirigida a los inversores; FAZ interpreta el mensaje de Altman como una distancia frente al lanzamiento restringido de Mythos por Anthropic.