OpenIA

OpenAI presenta su modelo o3: un avance en IA con alineación deliberativa para mejorar la seguridad y el razonamiento ético

Sin categoría

Desde el inicio de la revolución que ha supuesto la inteligencia artificial generativa, se ha debatido ampliamente sobre los límites éticos y morales que deben establecerse. Pero, ¿y si esos límites los definiera la propia inteligencia artificial? Aunque parezca una premisa sacada de una película de ciencia ficción, OpenAI está apostando por esta vía. La compañía, pionera en el desarrollo de modelos avanzados de inteligencia artificial, ha utilizado un formato de calendario de adviento para presentar novedades durante doce días consecutivos. El último de estos anuncios es su nuevo modelo o3, que sigue al actual o1, aunque se ha decidido omitir la denominación o2 para evitar problemas de marca con la empresa de telecomunicaciones británica. ¿Qué hace único a este avance? Se trata de un enfoque innovador denominado "deliberative alignment" (alineación deliberativa), que no solo busca incrementar la seguridad en las respuestas de la IA, sino también mejorar la calidad del razonamiento. Sin embargo, este enfoque no está exento de críticas. La principal preocupación radica en si es posible entrenar a un modelo para que deliberé sobre principios humanos sin caer en la censura o los sesgos, y si esto podría resultar peligroso a medio o largo plazo. El avance en los modelos de razonamiento autónomos de IALos modelos de razonamiento de OpenAI, desde el o1 hasta el o3, marcan un hito en la forma en que las máquinas procesan la información. A diferencia de los modelos anteriores que simplemente predicen palabras o generan texto, estos modelos imitan una cadena de pensamiento humana, conocida como "chain-of-thought". Este enfoque permite descomponer problemas complejos en pasos más sencillos y manejables. El modelo o3 destaca por su capacidad para autoformular preguntas, un comportamiento que imita el proceso de deliberación humana y resulta útil en tareas que requieren decisiones éticas o contexto específico. Deliberative alignment: un nuevo enfoque para la seguridad en la IALa alineación deliberativa introduce un enfoque innovador: entrenar a los modelos de IA para que consulten activamente políticas de seguridad durante el proceso de inferencia. En lugar de aplicar filtros predefinidos de manera automática, el modelo "piensa" y evalúa cómo responder de forma segura. Por ejemplo, si se solicita la creación de un documento falso, el modelo citaría las directrices de OpenAI y rechazaría la solicitud. Esta capacidad de actuar en función de políticas predeterminadas es un avance importante en el diseño de sistemas de IA responsables. Desafíos éticos y técnicos del alineamiento en IASin embargo, este enfoque plantea importantes cuestiones. ¿Serán las políticas de seguridad realmente objetivas? ¿Cómo evitar que se perciban como censura? Críticos como Elon Musk han advertido que los intentos de controlar la IA pueden resultar en restricciones innecesarias. Además, implementar la alineación deliberativa no es tarea fácil. Aún no está disponible al público y, durante la fase de desarrollo, OpenAI enfrentó problemas de latencia debido al intensivo proceso de deliberación interna de los modelos. Para solucionarlo, la compañía utilizó datos sintéticos en lugar de humanos para entrenar los modelos, mejorando la eficiencia sin sacrificar calidad. El futuro de la alineación ética en IACon el lanzamiento previsto del modelo o3 en 2025, será interesante ver cómo se implementan estos avances en aplicaciones reales. OpenAI ha posicionado la alineación deliberativa como un enfoque escalable para abordar los complejos problemas éticos y de seguridad en la inteligencia artificial. En un futuro donde las IAs serán cada vez más autónomas, estas medidas podrían ser clave para evitar usos indebidos y mantener la confianza pública. No obstante, la verdadera prueba será si estas tecnologías logran equilibrar seguridad y funcionalidad sin comprometer la creatividad y libertad de los usuarios. Los 12 días de anuncios de OpenAI: un resumen de sus lanzamientosEl o3 marca el final de una serie de doce días consecutivos en los que OpenAI ha revelado varias novedades. A continuación, se resumen las actualizaciones más importantes: Día 1: El modelo o1 revisado y ChatGPT Pro, mejorando la precisión y velocidad en preguntas complejas y ofreciendo suscripción exclusiva para profesionales. Día 2: Introducción del "Reinforcement Fine-Tuning", una técnica de aprendizaje iterativo para perfeccionar las capacidades de razonamiento. Día 3: Presentación de Sora, un modelo que convierte texto en vídeo (aunque no estará disponible en España a corto plazo). Día 4: Expansión de Canvas, ahora accesible para todos los usuarios de ChatGPT, facilitando la colaboración en proyectos. Día 5: Integración con Apple Intelligence, mejorando la experiencia en dispositivos iOS, iPadOS y macOS, con especial atención a la privacidad. Día 6: Nuevas funciones de llamadas y videollamadas avanzadas, con soporte para pantalla compartida. Día 7: Lanzamiento de "Proyectos", una herramienta que organiza conversaciones y archivos, con integración futura en la nube con Google Drive y Microsoft OneDrive. Día 8: SearchGPT, la nueva función de búsqueda avanzada, que mejora la experiencia móvil y añade funcionalidades de voz. Día 9: API del modelo o1, permitiendo a los desarrolladores integrar características avanzadas como procesamiento visual y reducción de costes en audio GPT-4. Día 10: ChatGPT en WhatsApp, facilitando el acceso a la IA en EE. UU. y otras regiones con conectividad limitada. Día 11: Integración con herramientas de escritorio como Jetbrains, Apple Notes y Notion. Día 12: Presentación de los modelos o3 y o3-mini, con capacidades avanzadas en razonamiento y matemáticas complejas. Estos anuncios no solo subrayan la innovación técnica, sino también el esfuerzo de OpenAI por integrar sus avances en herramientas útiles para los usuarios, ampliando la capa gratuita. Habrá que ver qué más tienen preparado para el futuro.

27 Diciembre 2024

Este contenido es exclusivo para suscriptores

Suscríbete GRATIS y disfruta de contenido ilimitado sobre ciberseguridad y personas

Suscribirme Ya soy suscriptor
CyberLideria MGZN
Política de privacidad

Esta web utiliza cookies para que podamos ofrecerte la mejor experiencia de usuario posible. La información de las cookies se almacena en tu navegador y realiza funciones tales como reconocerte cuando vuelves a nuestra web o ayudar a nuestro equipo a comprender qué secciones de la web encuentras más interesantes y útiles.

Mas informacion sobre la política de privacidad