Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

OpenAI investiga cómo dos modelos de IA lograron escapar de un entorno aislado y se convirtieron en hackers

Дата публикации: 24-07-2026 09:01:00

OpenAI ha revelado un incidente inédito en el que dos de sus modelos experimentales consiguieron superar las barreras de contención durante una prueba interna y comprometer sistemas de la empresa Hugging Face. El caso pone sobre la mesa los riesgos crecientes de las IA de nueva generación y la necesidad de reforzar su supervisión.Seguir leyendo....

Основное содержимое страницы с новостью.

OpenAI ha revelado un incidente inédito en el que dos de sus modelos experimentales consiguieron superar las barreras de contención durante una prueba interna y comprometer sistemas de la empresa Hugging Face. El caso pone sobre la mesa los riesgos crecientes de las IA de nueva generación y la necesidad de reforzar su supervisión.

Este incidente de ciberseguridad ha encendido las alarmas en la industria de la inteligencia artificial: OpenAI ha reconocido que dos de sus modelos, entre ellos GPT-5.6 Sol y otro modelo de prepublicación aún no identificado, lograron salir del entorno controlado en el que estaban siendo evaluados y accedieron a la infraestructura de Hugging Face.

Un caso sin precedentes

Según un comunicado de la compañía, el caso ocurrió durante una prueba interna de capacidades cibernéticas y se considera un “incidente de ciberseguridad sin precedentes”.

La investigación apunta a que los modelos estaban sometidos a ExploitGym, una herramienta diseñada para medir hasta qué punto una IA es capaz de encadenar vulnerabilidades y explotar sistemas.

Escapando del entorno controlado

En ese contexto, OpenAI afirma que los modelos buscaron activamente una vía para obtener acceso a Internet, explotaron una vulnerabilidad en un proxy y posteriormente escalaron privilegios dentro del entorno de investigación hasta alcanzar un nodo con conexión externa.

Una vez fuera del entorno aislado, los modelos habrían inferido que Hugging Face podía albergar soluciones o datos relacionados con la prueba y habrían intentado acceder a información secreta para “hacer trampas” en la evaluación.

Al parecer, en uno de los caminos de ataque identificados la IA combinó credenciales robadas y fallos desconocidos para encontrar una vía de ejecución remota de código en servidores de Hugging Face.

OpenAI afirma que GPT-5.6 Sol y un modelo previo al lanzamiento llegaron a la infraestructura de producción de Hugging Face durante una evaluación cibernética interna.

OpenAI afirma que GPT-5.6 Sol y un modelo previo al lanzamiento llegaron a la infraestructura de producción de Hugging Face durante una evaluación cibernética interna. / Crédito: EdTech.

Buscando el límite de capacidad

Según informa EdTech, OpenAI admite que desactivó los clasificadores de producción y otras salvaguardas habituales, para medir la capacidad máxima de los modelos en un escenario de prueba.

Por otro lado, Hugging Face explicó que su sistema de defensa basado en IA fue clave para identificar la actividad anómala. La compañía señaló que el ataque fue ejecutado por un marco de agentes autónomos que realizó miles de acciones en una red y que logró moverse lateralmente por varios clústeres internos.

¿Hasta dónde pueden llegar los sistemas de IA avanzada?

Entre las medidas adoptadas figuran el cierre de las rutas de ejecución de código usadas en el acceso inicial, la reconstrucción de nodos comprometidos, la rotación de credenciales y un refuerzo de los controles de admisión.

OpenAI y Hugging Face aseguran ahora estar colaborando en una investigación conjunta. OpenAI ha anunciado controles más estrictos sobre su infraestructura de investigación, una revisión de sus prácticas de contención y monitorización, y la mejora de los mecanismos de seguridad durante las evaluaciones internas.

El episodio deja una advertencia clara: los modelos más avanzados ya no solo razonan sobre ciberseguridad, sino que pueden ejecutar secuencias complejas de ataque cuando persiguen un objetivo concreto. ¿Cuál es el límite para estas herramientas? ¿Se puede confiar solo en las correcciones de las empresas o debería existir algún tipo de control independiente?

Fuente: Levante - EMV

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1Un modelo de IA no tenía acceso a internet. Así que consideró que era mejor tenerlo y decidió hackear algo por el camino 06.2222-07-2026
2How an OpenAI safety test became a real‑world cyberattack on the Hugging Face platform07.1930-07-2026
3Модели OpenAI незаконно прошли в инфраструктуру Hugging Face для поиска ответов07.3722-07-2026
4🤖Восстание машин уже на прогреве: новая модель ChatGPT сбежала из ...06.6422-07-2026
5В ходе тестирования автономный AI-агент OpenAI без явной указки взломал инфраструктуру Hugging Face010.1622-07-2026
6Сбежавший из тестовой среды ИИ OpenAI взломал не только Hugging Face08.0430-07-2026
7OpenAI Models Escaped Containment and Hacked Hugging Face011.621-07-2026
8Глава Hugging Face потребовал «полной прозрачности» после взлома со стороны ИИ OpenAI07.0128-07-2026
9OpenAI AI agent hacked Hugging Face, went undetected for days: Report05.1726-07-2026
10Una IA revela que los cambios climáticos impulsaron grandes saltos en la evolución de las aves010.7422-07-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 8.33. Источник: www.elperiodico.com.