Los modelos de inteligencia artificial podrían estar volviéndose más seguros en algunos aspectos, pero también más complejos de vigilar, una combinación que está elevando las alertas dentro del propio sector.

OpenAI presentó este jueves GPT-6 Astra, un modelo que, de acuerdo con su presidente, Greg Brockman, podría llegar a verse como el surgimiento de la inteligencia artificial general (IAG).
Si bien el sistema rinde mejor, también sería más hábil para evitar mecanismos de supervisión.
El director ejecutivo de la compañía, Sam Altman, afirmó que algunos modelos se están volviendo “superhumanos” en ciertas capacidades y que la industria navega “en aguas desconocidas”.
El científico jefe de la empresa, Jakub Pachocki, afirmó en una conversación con periodistas que, con el tiempo, será cada vez más difícil monitorear lo que “piensan” estos modelos, informa Axios.
El medio menciona que OpenAI y Anthropic, junto con más de un centenar de firmas, advirtieron que se agota el tiempo para prepararse ante posibles ataques habilitados por IA contra infraestructura crítica. En ese contexto, Pachocki dijo que OpenAI conversa con organizaciones externas sobre “estándares concretos” y que también busca reforzar sus propios procesos.
La investigadora Sydney Von Arx, fundadora de la organización Nightingale, aseveró: “Esto es un asunto incluso más grande que Hugging Face”, en referencia a la falta de visibilidad sobre el razonamiento de los sistemas.

