OpenAI alerta que la IA es cada vez más difícil de monitorear: GPT‑6 Astra podría rozar la inteligencia
Directivos de OpenAI advierten que los modelos avanzados ya evaden mecanismos de supervisión y podrían habilitar ataques contra infraestructura crítica.
Axios reportó que OpenAI, Anthropic y más de cien firmas alertaron que se agota el tiempo para prepararse ante posibles ataques habilitados por IA contra infraestructura crítica. En ese contexto, OpenAI conversa con organizaciones externas para establecer “estándares concretos” y reforzar sus propios procesos de seguridad.
La investigadora Sydney Von Arx señaló que la falta de visibilidad sobre el razonamiento de los modelos es “un asunto incluso más grande que Hugging Face”. OpenAI reconoció que uno de sus modelos atacó de manera autónoma infraestructura de esa plataforma, intensificando las preocupaciones sobre control, opacidad y seguridad en sistemas avanzados.
OpenAI advierte que los modelos avanzados de IA ya evaden mecanismos de supervisión y son cada vez más difíciles de monitorear. Gettyimages.ru
- Los modelos de inteligencia artificial podrían estar volviéndose más seguros en algunos aspectos, pero también más complejos de vigilar, una combinación que está elevando las alertas dentro del propio sector.
12HORAS / CALIFORNIA, EU.-OpenAI presentó este jueves GPT-6 Astra, un modelo que, de acuerdo con su presidente, Greg Brockman, podría llegar a verse como el surgimiento de la inteligencia artificial general (IAG).
Si bien el sistema rinde mejor, también sería más hábil para evitar mecanismos de supervisión.

Demandan a OpenAI por tiroteo masivo en Canadá: ¿la IA puede inducir a matar?
El director ejecutivo de la compañía, Sam Altman, afirmó que algunos modelos se están volviendo «superhumanos» en ciertas capacidades y que la industria navega «en aguas desconocidas».
El científico jefe de la empresa, Jakub Pachocki, afirmó en una conversación con periodistas que, con el tiempo, será cada vez más difícil monitorear lo que «piensan» estos modelos, informa Axios.
El medio menciona que OpenAI y Anthropic, junto con más de un centenar de firmas, advirtieron que se agota el tiempo para prepararse ante posibles ataques habilitados por IA contra infraestructura crítica.
En ese contexto, Pachocki dijo que OpenAI conversa con organizaciones externas sobre «estándares concretos» y que también busca reforzar sus propios procesos.
La investigadora Sydney Von Arx, fundadora de la organización Nightingale, aseveró: «Esto es un asunto incluso más grande que Hugging Face», en referencia a la falta de visibilidad sobre el razonamiento de los sistemas.
OpenAI admitió que uno de sus modelos atacó de manera autónoma la infraestructura de la plataforma Hugging Face, especializada en modelos de aprendizaje automático.
RT

