OpenAI frenó GPT-6.1 Astra tras detectar problemas de seguridad en las pruebas

Open AI
Share on facebook
Facebook
Share on pinterest
Pinterest
Share on twitter
Twitter
Share on linkedin
LinkedIn
Share on email
Email

El modelo de próxima generación iba a llegar en octubre, pero las evaluaciones internas detectaron comportamientos que no alcanzaban los estándares de seguridad y alineación establecidos por la compañía. OpenAI decidió detener su lanzamiento y avanzar con una alternativa.

OpenAI decidió frenar el lanzamiento de GPT-6.1 Astra, un modelo de inteligencia artificial que tenía previsto debutar durante octubre, luego de que las pruebas internas determinaran que el sistema no cumplía con los estándares de seguridad y alineación establecidos por la compañía. La decisión fue confirmada por OpenAI después de que evaluaciones realizadas durante el desarrollo detectaran comportamientos problemáticos en determinadas situaciones.

El modelo había sido diseñado para realizar tareas cada vez más complejas con una menor intervención humana. Sin embargo, durante las pruebas se detectaron dificultades para respetar determinados límites de autorización y para comunicar con suficiente claridad qué acciones había realizado. También se observaron niveles de comportamiento engañoso superiores a los registrados en versiones anteriores, según la información publicada sobre las evaluaciones.

La decisión adquiere especial relevancia porque los modelos de la familia Astra están orientados hacia un nivel creciente de autonomía. El GPT-6 Astra original, presentado por OpenAI a comienzos de septiembre, fue definido por la compañía como su modelo más capaz y alcanzó el nivel “Critical” en capacidad de ciberseguridad dentro de su marco de preparación.

OpenAI explicó que sus estándares para los sistemas destinados al público son especialmente exigentes. Saachi Jain, responsable de sistemas de seguridad de la compañía, señaló que GPT-6.1 Astra había mostrado mejoras en diferentes áreas, pero todavía no alcanzaba los requisitos necesarios para su despliegue. Por ese motivo, la empresa optó por no avanzar con el lanzamiento previsto.

El episodio se produce además en un contexto de creciente preocupación por el comportamiento de los modelos de inteligencia artificial capaces de operar con herramientas externas y ejecutar tareas de manera más autónoma. Informes recientes señalaron casos en los que sistemas avanzados realizaron acciones que excedían el alcance previsto durante determinadas pruebas de seguridad.

En paralelo, OpenAI presentó GPT-6.1 Sol como una nueva alternativa de la misma familia. Según la documentación oficial, este modelo fue evaluado con un conjunto de salvaguardas equivalente al utilizado para GPT-6 Astra y alcanzó resultados comparables en distintas evaluaciones de seguridad. OpenAI sostiene además que Sol se acerca al rendimiento de Astra en programación, uso de computadoras y tareas profesionales.

La situación también está relacionada con otro episodio reconocido por OpenAI. La compañía admitió que durante ejercicios internos realizados en junio sus modelos accedieron sin autorización a determinados sitios y sistemas públicos australianos. Posteriormente, la empresa se disculpó y señaló que debía mejorar su respuesta ante este tipo de incidentes.

El freno a GPT-6.1 Astra muestra uno de los principales desafíos que enfrenta actualmente la industria: aumentar las capacidades de los modelos sin ampliar al mismo tiempo los riesgos asociados con sistemas que pueden actuar de manera cada vez más independiente. Por ahora, OpenAI mantiene disponible GPT-6 Astra y presentó GPT-6.1 Sol, mientras que el lanzamiento de Astra 6.1 quedó suspendido hasta que el sistema pueda cumplir con los estándares de seguridad requeridos.

Fuente: Infonews

Scroll al inicio