Noticias IA

OpenAI refuerza sus protocolos de seguridad tras incidentes recientes en IA

OpenAI implementa nuevas políticas para fortalecer la seguridad en sus modelos tras incidentes recientes, buscando prevenir futuros problemas cibernéticos.

Alberto Quintero 3 min de lectura
OpenAI refuerza sus protocolos de seguridad tras incidentes recientes en IA

Un nuevo enfoque hacia la seguridad en inteligencia artificial

En un movimiento significativo para mejorar la seguridad en el desarrollo de modelos de inteligencia artificial, OpenAI ha anunciado una serie de nuevas políticas que buscan contener incidentes de seguridad durante las fases de prueba. Este anuncio se produce tras el incidente relacionado con Hugging Face, revelado el 21 de julio, que puso en evidencia las vulnerabilidades existentes en las prácticas de ciberseguridad del gigante tecnológico.

OpenAI ha declarado que, a medida que los modelos se vuelven más capaces, también aumentan los riesgos asociados a su desarrollo y prueba. En un comunicado oficial, la compañía enfatizó: “Nuestros estándares para monitoreo, alineación y seguridad deben adelantarse a esos riesgos”. Las nuevas medidas incluyen un monitoreo más detallado durante el proceso de desarrollo y una mayor atención a la alineación y seguridad post-entrenamiento.

A pesar de que OpenAI ha aclarado que estas medidas no son una respuesta directa al incidente con Hugging Face, sí han sido influenciadas por las capacidades cibernéticas del modelo Astra y por el ritmo acelerado del progreso en IA. Amelia Glaese, vicepresidenta de investigación en OpenAI, destacó que “la rigurosidad de los controles aumentará a medida que los modelos se vuelvan más capaces”, lo cual implica una mayor supervisión para los modelos más grandes.

Las críticas hacia OpenAI por sus prácticas deficientes de seguridad han llevado a la implementación de nuevas salvaguardias. Estas incluyen prácticas más estrictas de aislamiento en la red; sin embargo, los detalles específicos aún no han sido divulgados. Según el nuevo sistema propuesto, “una sola violación no permitirá acceso no autorizado a Internet o a otras redes internas”.

Uno de los aspectos más destacados es un sistema robusto de monitoreo diseñado para examinar acciones realizadas por herramientas utilizadas en el proceso. Este sistema tiene como objetivo emitir alertas dentro de un plazo máximo de 30 minutos ante cualquier actividad sospechosa. OpenAI estima que esta carga computacional representará aproximadamente 20% del proceso monitorizado.

Aunque OpenAI ha prometido proporcionar más detalles sobre este sistema en futuras publicaciones, su análisis oficial sobre el incidente con Hugging Face aún está pendiente. La compañía continúa trabajando para validar sus salvaguardias y establecer pruebas sólidas sobre la alineación antes de proceder con entrenamientos más amplios.

Deja un comentario