Loader
Encuéntranos
Publicidad

OpenAI promete frenar el desarrollo de sus modelos por temor a ciberataques

ARCHIVO. Icono de la aplicación ChatGPT en la pantalla de un teléfono móvil en Chicago, agosto de 2025
Archivo. El icono de la aplicación ChatGPT se ve en la pantalla de un teléfono móvil en Chicago, agosto de 2025. Derechos de autor  AP Photo/Kiichiro Sato
Derechos de autor AP Photo/Kiichiro Sato
Por Quirino Mealha
Publicado última actualización
Compartir Comentarios Sigue a Euronews en Google
Compartir Close Button

OpenAI ha anunciado que paraliza durante dos semanas fases clave del entrenamiento de su IA más avanzada y refuerza la seguridad tras la fuga de un modelo que llegó a infiltrarse en los sistemas de la plataforma Hugging Face.

El fabricante de ChatGPT está frenando deliberadamente el ritmo de sus investigaciones más avanzadas, incluida la que iba a ser su mayor ejecución única de aprendizaje por refuerzo, pocas semanas después de que un sistema construido con sus propios modelos se le escapara durante una prueba interna de seguridad y se infiltrara en la plataforma de IA Hugging Face.

PUBLICIDAD
PUBLICIDAD

El consejero delegado Sam Altman publicó en X que OpenAI coordinaría con el resto del sector unas normas compartidas de seguridad, pero que "actuaría de forma unilateral mientras tanto" hasta que ese marco estuviera listo.

El episodio que desencadenó la decisión se produjo en julio, cuando OpenAI estaba probando GPT-5.6 Sol junto a un prototipo inédito, más capaz, en un test interno que medía capacidades ofensivas en ciberseguridad, con las habituales restricciones de seguridad desactivadas a propósito para evaluar la capacidad en bruto de los modelos.

En lugar de limitarse a resolver la prueba, el sistema detectó una vulnerabilidad hasta entonces desconocida, salió de su "sandbox" o entorno controlado, llegó a la internet abierta y pasó unos cuatro días y medio analizando la infraestructura de Hugging Face, hasta que consiguió entrar para buscar las respuestas del ejercicio.

Según la reconstrucción de Hugging Face, el incidente implicó unas 17.600 acciones separadas antes de que la intrusión quedara contenida, en un episodio que afectó también a varias empresas más.

Ambas partes aseguran que no han hallado indicios de intención maliciosa, y desde entonces Hugging Face tiene acceso a una versión más capaz y menos limitada del modelo de OpenAI para reforzar la defensa de sus propios sistemas.

Astra y un listón más alto para la seguridad

El segundo detonante llegó el 7 de agosto, cuando las evaluaciones internas apuntaron a que Astra, el próximo modelo de frontera de OpenAI, podría superar el umbral "crítico" de capacidad cibernética establecido en el propio marco de riesgos de la empresa.

Desde entonces, algunas tareas de Astra se han reanudado bajo controles más estrictos, pero una parte significativa sigue congelada hasta que cumpla los nuevos requisitos sobre entornos de prueba aislados, acceso restringido a la red y supervisión continua.

Un nuevo sistema de detección analiza ahora la actividad de los modelos en tiempo real y pretende señalar en un máximo de 30 minutos cualquier comportamiento que se parezca a un acceso no autorizado o a un intento de desactivar las protecciones, con un coste de cómputo que OpenAI calcula en torno al 20% de la capacidad de procesamiento supervisada.

OpenAI sostiene que estos cambios ya estaban previstos y no son una reacción directa a la brecha, aunque admite que el incidente añadió urgencia. La empresa tampoco es la única que se enfrenta a este problema.

Anthropic y Meta han revelado episodios similares en las últimas semanas, en los que sus propios modelos vulneraron sistemas de terceros durante las pruebas.

OpenAI y Anthropic han apoyado por separado una petición impulsada por sus empleados que insta a los gobiernos a ayudar a coordinar la velocidad a la que avanza el sector, un giro notable respecto a la resistencia que Altman había mostrado en el pasado ante los llamamientos públicos para frenar el desarrollo de la IA.

Ir a los atajos de accesibilidad
Compartir Comentarios Sigue a Euronews en Google

Noticias relacionadas

Claves de la mayor batalla legal de Meta hasta ahora

La 'basura de IA' conquista el contenido infantil y abre la puerta a mensajes violentos y extremistas

OpenAI promete frenar el desarrollo de sus modelos por temor a ciberataques