OpenAI o3 es un modelo transformador generativo preentrenado (GPT) desarrollado por OpenAI como sucesor de OpenAI o1 para ChatGPT . Está diseñado para dedicar tiempo adicional de deliberación al abordar preguntas que requieren razonamiento lógico paso a paso . [ 1 ] [ 2 ] El 31 de enero de 2025, OpenAI lanzó un modelo más pequeño, o3-mini, [ 3 ] seguido el 16 de abril por o3 y o4-mini . [ 4 ]
Historia
El modelo OpenAI o3 se anunció el 20 de diciembre de 2024. Se le llamó "o3" en lugar de "o2" para evitar conflictos de marca registrada con la marca de operador móvil O2 . [ 1 ] OpenAI invitó a investigadores de seguridad a solicitar acceso anticipado a estos modelos hasta el 10 de enero de 2025. [ 5 ] Al igual que o1, existen dos modelos diferentes: o3 y o3-mini. [ 3 ]
El 31 de enero de 2025, OpenAI lanzó o3-mini para todos los usuarios de ChatGPT (incluidos los de la versión gratuita) y algunos usuarios de la API . OpenAI describe o3-mini como una "alternativa especializada" a o1 para "dominios técnicos que requieren precisión y velocidad". [ 6 ] o3-mini cuenta con tres niveles de esfuerzo de razonamiento: bajo, medio y alto. La versión gratuita utiliza el nivel medio. La variante que utiliza más capacidad de cómputo se llama o3-mini-high y está disponible para los suscriptores de pago. [ 3 ] [ 7 ] Los suscriptores de la versión Pro de ChatGPT tienen acceso ilimitado tanto a o3-mini como a o3-mini-high. [ 6 ]
El 2 de febrero, OpenAI lanzó OpenAI Deep Research , un servicio ChatGPT que utiliza una versión de o3 que genera informes completos en un plazo de 5 a 30 minutos, basados en búsquedas web . [ 8 ]
El 6 de febrero, en respuesta a la presión de rivales como DeepSeek R1, OpenAI anunció una actualización destinada a mejorar la transparencia del proceso de pensamiento en su modelo o3-mini. [ 9 ]
El 12 de febrero, OpenAI aumentó aún más los límites de velocidad para o3-mini-high a 50 solicitudes por día (desde 50 solicitudes por semana) para los suscriptores de ChatGPT Plus, e implementó la compatibilidad con la carga de archivos/imágenes. [ 10 ]
El 16 de abril de 2025, OpenAI lanzó o3 y o4-mini , sucesor de o3-mini. [ 4 ]
El 10 de junio, OpenAI lanzó o3-pro, que según la compañía es su modelo más capaz hasta la fecha. [ 11 ] OpenAI declaró: «Recomendamos usarlo para preguntas complejas donde la fiabilidad importa más que la velocidad, y esperar unos minutos compensa la diferencia». [ 12 ]
El 28 de mayo de 2026, OpenAI anunció que o3 dejaría de utilizarse en ChatGPT el 26 de agosto de 2026, tras un período de transición de 90 días. La empresa declaró que el cambio solo afectaba a ChatGPT y no a la API. [ 13 ]
Capacidades
Se utilizó el aprendizaje por refuerzo para enseñar a o3 a "pensar" antes de generar respuestas, empleando lo que OpenAI denomina una " cadena de pensamiento privada ". [ 14 ] Este enfoque permite al modelo planificar con anticipación y razonar sobre las tareas, realizando una serie de pasos de razonamiento intermedios para ayudar a resolver el problema, a costa de una mayor potencia de cálculo y una mayor latencia en las respuestas. [ 15 ]
o3 demuestra un rendimiento significativamente mejor que o1 en tareas complejas, incluyendo codificación , matemáticas y ciencias . [ 1 ] OpenAI informó que o3 alcanzó una puntuación del 87,7 % en el benchmark GPQA Diamond, que contiene preguntas científicas de nivel experto no disponibles públicamente en línea. [ 16 ]
En SWE-bench Verified, una prueba de ingeniería de software que evalúa la capacidad de resolver problemas reales de GitHub , o3 obtuvo una puntuación del 71,7 %, en comparación con el 48,9 % de o1. En Codeforces , o3 alcanzó una puntuación Elo de 2727, mientras que o1 obtuvo 1891. [ 16 ]
En el conjunto de datos de referencia Abstraction and Reasoning Corpus for Artificial General Intelligence (ARC-AGI), que evalúa la capacidad de una IA para manejar nuevos problemas lógicos y de adquisición de habilidades, o3 alcanzó una precisión tres veces mayor que o1. [ 1 ] [ 17 ]
Rendimiento del o3-mini
Según el informe de OpenAI de enero de 2025 sobre o3-mini, ajustar el "esfuerzo de razonamiento" afecta significativamente el rendimiento, especialmente en tareas STEM . Pasar de un esfuerzo de razonamiento bajo a uno alto aumenta la precisión en AIME 2024 de OpenAI (distinto del benchmark AIME de MathArena), GPQA Diamond y Codeforces , generalmente entre un 10 y un 30 %. Con un esfuerzo alto, o3-mini (alto) alcanzó un 87,3 % en AIME 2024, un 79,7 % en GPQA Diamond, 2130 Elo en Codeforces y 49,3 en SWE-bench Verified. [ 6 ]
Véase también
Referencias
- 1 2 3 4 Knight, Will (20 de diciembre de 2024). "OpenAI actualiza su modelo de IA más inteligente con habilidades de razonamiento mejoradas" . Wired .
- ↑ Metz, Cade (20 de diciembre de 2024). "OpenAI presenta una nueva IA que puede 'razonar' a través de problemas matemáticos y científicos" . The New York Times .
- 1 2 3 Franzen, Carl (31 de enero de 2025). "Ya está aquí: el modelo de razonamiento avanzado o3-mini de OpenAI llega para contrarrestar el ascenso de DeepSeek" . VentureBeat . Consultado el 1 de febrero de 2025 .
- 1 2 "Presentación de OpenAI o3 y o4-mini" . openai.com . Consultado el 16 de abril de 2025 .
- ↑ "Acceso anticipado para pruebas de seguridad" . OpenAI . 20 de diciembre de 2024.
- 1 2 3 "Presentación de OpenAI O3 Mini" . OpenAI . 13 de febrero de 2025. Consultado el 13 de febrero de 2025 .
- ↑ "OpenAI o3-mini" . OpenAI . 31 de enero de 2025. Consultado el 3 de febrero de 2025 .
- ↑ Ha, Anthony (3 de febrero de 2025). "OpenAI presenta un nuevo agente ChatGPT para 'investigación profunda'"" . TechCrunch . Consultado el 4 de febrero de 2025 .
- ↑ Wiggers, Kyle (6 de febrero de 2025). "OpenAI ahora revela más sobre el proceso de pensamiento de su modelo o3-mini" . TechCrunch . Consultado el 7 de febrero de 2025 .
- ↑ @OpenAI (13 de febrero de 2025). "Dos actualizaciones que te gustarán: OpenAI o1 y o3-mini ahora admiten la carga de archivos e imágenes en ChatGPT. Aumentamos los límites de o3-mini-high en 7 veces para los usuarios Plus hasta 50 por día" ( Tweet ) . Recuperado el 13 de febrero de 2025 – vía X (anteriormente Twitter) .
- ↑ Wiggers, Kyle (10 de junio de 2025). "OpenAI lanza o3-pro, una versión mejorada de su modelo de razonamiento de IA o3" . TechCrunch . Consultado el 11 de junio de 2025 .
- ↑ Washenko, Anna (6 de junio de 2025). "OpenAI añade hoy el modelo o3-pro a ChatGPT" . Engadget . Consultado el 11 de junio de 2025 .
- ↑ "ChatGPT — Notas de la versión" . Centro de ayuda de OpenAI . OpenAI. 28 de mayo de 2026. Consultado el 30 de mayo de 2026 .
- ↑ Tarjeta del sistema OpenAI O3 Mini (PDF) (Informe). OpenAI. 13 de enero de 2025. Consultado el 13 de febrero de 2025 .
- ↑ Zeff, Maxwell; Wiggers, Kyle (20 de diciembre de 2024). "OpenAI anuncia nuevos modelos o3" . TechCrunch . Consultado el 22 de diciembre de 2024 .
- 1 2 Franzen, Carl; David, Emilia (20 de diciembre de 2024). "OpenAI confirma los nuevos modelos fronterizos o3 y o3-mini" . VentureBeat . Recuperado el 26 de diciembre de 2024 .
- ↑ Hsu, Jeremy (20 de diciembre de 2024). "El modelo o3 de OpenAI superó con éxito una prueba de razonamiento de IA, pero aún no es IAG" . New Scientist . Consultado el 22 de diciembre de 2024 .
Enlaces externos
- Presentamos OpenAI o3 y o4-mini.
- O3 es un 80% más barato y presentamos o3-pro.
- Modelos de lenguaje a gran escala
- Software 2024
- transformadores generativos preentrenados
- OpenAI
- ChatGPT
- 2025 en inteligencia artificial