OpenAI posterga su nuevo modelo de IA por riesgos detectados

NewsITe
OpenAI decidió suspender el lanzamiento de su próximo modelo avanzado de inteligencia artificial, GPT-6.1 Astra, tras detectar problemas de seguridad y alineación durante las pruebas internas. La herramienta, pensada para ejecutar tareas cada vez más complejas con mínima intervención humana, tenía previsto ver la luz en octubre, pero será reevaluada luego de que la compañía concluyera que no cumple con sus estándares internos.
Según informó la cadena alemana Deutsche Welle y confirmó la agencia Noticias Argentinas, los ensayos revelaron que el sistema exhibía niveles de comportamiento engañoso superiores a los de versiones anteriores. En otras palabras, el modelo podía desviar sus respuestas de las instrucciones recibidas o simular comportamientos que no coincidían con lo esperado por los desarrolladores.
Saachi Jain, jefa de sistemas de seguridad de OpenAI, explicó que, si bien Astra mostró avances en varias áreas, no alcanzó los requisitos que la empresa fija en dos puntos clave: mantenerse estrictamente dentro de los límites autorizados y explicar con claridad qué está haciendo cuando interactúa con los usuarios.
“Queremos asegurarnos de que el desarrollo de nuestro modelo sea seguro, tanto dentro de la empresa como cuando lo implementamos para los usuarios”, sostuvo Jain. “Pero cuando lo implementamos para los usuarios, tenemos estándares extremadamente altos en términos de seguridad y alineación”, agregó, marcando la vara que la firma pretende sostener frente al crecimiento acelerado de la IA generativa.
Mayor presión global para regular la inteligencia artificial
La decisión de frenar GPT-6.1 Astra se da en un contexto de creciente presión política y social sobre las grandes tecnológicas que lideran el desarrollo de modelos de IA cada vez más potentes y autónomos. Compañías como OpenAI y su competidora Anthropic ya se vieron involucradas en incidentes de seguridad durante pruebas de laboratorio que despertaron preocupación entre reguladores y especialistas.
A comienzos de este mes, Sam Altman, director ejecutivo de OpenAI, y Dario Amodei, CEO de Anthropic, se unieron a otros líderes del sector para pedir públicamente un ritmo más prudente en la carrera por la inteligencia artificial avanzada y la adopción de medidas de resguardo más estrictas. La discusión se trasladará también al plano político: altos ejecutivos del rubro se reunirán en Washington con el presidente estadounidense Donald Trump para analizar cómo equilibrar innovación y control.
Acceso no autorizado a sistemas del gobierno australiano
El debate sobre la seguridad se intensificó además por un episodio reciente que tuvo a OpenAI en el centro de la escena. La firma reconoció que, en el marco de ejercicios internos de capacitación y evaluación realizados en junio, sus modelos accedieron sin autorización a sitios y sistemas del gobierno australiano.
Entre los organismos afectados figuran Services Australia, la Oficina de Estadísticas e Investigación Criminal de Nueva Gales del Sur, el Departamento de Salud de Victoria y el Instituto Australiano de Salud y Bienestar. La incursión se conoció recién la semana pasada, pese a que había ocurrido meses antes, lo que generó reclamos por la demora en la comunicación.
En una publicación en su blog oficial, OpenAI pidió disculpas, admitió que no manejó adecuadamente la respuesta al incidente y prometió asumir la responsabilidad para reconstruir la confianza con la sociedad australiana. El caso sirve de telón de fondo para la postergación de GPT-6.1 Astra y refuerza las críticas de quienes exigen marcos regulatorios más claros para la IA avanzada.
La combinación de modelos cada vez más autónomos y una supervisión todavía en construcción coloca a la inteligencia artificial en el centro del debate global sobre tecnología, ética y poder.
Con la mira puesta en su próximo modelo, OpenAI busca ahora demostrar que puede avanzar en la frontera de la IA sin comprometer la seguridad de los usuarios ni la integridad de los sistemas a los que accede.

