Desde el inicio de la revolución que ha supuesto la inteligencia artificial generativa, se ha debatido ampliamente sobre los límites éticos y morales que deben establecerse. Pero, ¿y si esos límites los definiera la propia inteligencia artificial? Aunque parezca una premisa sacada de una película de ciencia ficción, OpenAI está apostando por esta vía.
La compañía, pionera en el desarrollo de modelos avanzados de inteligencia artificial, ha utilizado un formato de calendario de adviento para presentar novedades durante doce días consecutivos. El último de estos anuncios es su nuevo modelo o3, que sigue al actual o1, aunque se ha decidido omitir la denominación o2 para evitar problemas de marca con la empresa de telecomunicaciones británica.
¿Qué hace único a este avance? Se trata de un enfoque innovador denominado «deliberative alignment» (alineación deliberativa), que no solo busca incrementar la seguridad en las respuestas de la IA, sino también mejorar la calidad del razonamiento.
Sin embargo, este enfoque no está exento de críticas. La principal preocupación radica en si es posible entrenar a un modelo para que deliberé sobre principios humanos sin caer en la censura o los sesgos, y si esto podría resultar peligroso a medio o largo plazo.
El avance en los modelos de razonamiento autónomos de IA
Los modelos de razonamiento de OpenAI, desde el o1 hasta el o3, marcan un hito en la forma en que las máquinas procesan la información. A diferencia de los modelos anteriores que simplemente predicen palabras o generan texto, estos modelos imitan una cadena de pensamiento humana, conocida como «chain-of-thought». Este enfoque permite descomponer problemas complejos en pasos más sencillos y manejables.
El modelo o3 destaca por su capacidad para autoformular preguntas, un comportamiento que imita el proceso de deliberación humana y resulta útil en tareas que requieren decisiones éticas o contexto específico.
Deliberative alignment: un nuevo enfoque para la seguridad en la IA
La alineación deliberativa introduce un enfoque innovador: entrenar a los modelos de IA para que consulten activamente políticas de seguridad durante el proceso de inferencia. En lugar de aplicar filtros predefinidos de manera automática, el modelo «piensa» y evalúa cómo responder de forma segura.
Por ejemplo, si se solicita la creación de un documento falso, el modelo citaría las directrices de OpenAI y rechazaría la solicitud. Esta capacidad de actuar en función de políticas predeterminadas es un avance importante en el diseño de sistemas de IA responsables.
Desafíos éticos y técnicos del alineamiento en IA
Sin embargo, este enfoque plantea importantes cuestiones. ¿Serán las políticas de seguridad realmente objetivas? ¿Cómo evitar que se perciban como censura? Críticos como Elon Musk han advertido que los intentos de controlar la IA pueden resultar en restricciones innecesarias.
Además, implementar la alineación deliberativa no es tarea fácil. Aún no está disponible al público y, durante la fase de desarrollo, OpenAI enfrentó problemas de latencia debido al intensivo proceso de deliberación interna de los modelos. Para solucionarlo, la compañía utilizó datos sintéticos en lugar de humanos para entrenar los modelos, mejorando la eficiencia sin sacrificar calidad.
El futuro de la alineación ética en IA
Con el lanzamiento previsto del modelo o3 en 2025, será interesante ver cómo se implementan estos avances en aplicaciones reales. OpenAI ha posicionado la alineación deliberativa como un enfoque escalable para abordar los complejos problemas éticos y de seguridad en la inteligencia artificial.
En un futuro donde las IAs serán cada vez más autónomas, estas medidas podrían ser clave para evitar usos indebidos y mantener la confianza pública. No obstante, la verdadera prueba será si estas tecnologías logran equilibrar seguridad y funcionalidad sin comprometer la creatividad y libertad de los usuarios.
Los 12 días de anuncios de OpenAI: un resumen de sus lanzamientos
El o3 marca el final de una serie de doce días consecutivos en los que OpenAI ha revelado varias novedades. A continuación, se resumen las actualizaciones más importantes:
Estos anuncios no solo subrayan la innovación técnica, sino también el esfuerzo de OpenAI por integrar sus avances en herramientas útiles para los usuarios, ampliando la capa gratuita. Habrá que ver qué más tienen preparado para el futuro.
Actualidad
15 Septiembre 2026
Podcast de Cyberlideria MGZN.
Todos los jueves, a partir de las 22:00, estará disponible en CyberLideria MGZN una nueva entrevista, donde un prestigioso CISO colaborador charlará con una personalidad inspiradora, importante, y líder empresarial, tanto del ámbito privado como público.
Manténgase informado sobre la ciberseguridad, tecnología, las tendencias y las noticias que afectan a los líderes de TI.
Suscríbete GRATIS y disfruta de contenido ilimitado sobre ciberseguridad y personas