CUALQUIERAPenai presentó O3 y O4-Mini, Dos modelos de inteligencia artificial que inauguran un Nueva era para chatgptcon capacidades que van desde el razonamiento visual avanzó hasta Uso autónomo de herramientas. Ambos destacan por ofrecer respuestas más precisas, útiles y verificablescon un mejor monitoreo de instrucciones y un estilo más conversacional y personalizado, respaldado por el uso de memoria y contexto anterior.
Él Modelo O3él Más poderoso lanzado hasta ahora por OpenAiEl es capaz Para integrar imágenes directamente en su proceso de razonamiento, que le permite analizar y manipular imágenes como diagramas o gráficos para mejorar su comprensión y respuestas. Por su parte, O4-Mini Ofrece un rendimiento competitivo optimizado para la velocidad y la eficiencia, ideal para entornos que requieren un alto costo a bajo costo.
Ambos están disponibles para usuarios de chatgpt en Además, planes profesionales y de equipo. Con el lanzamiento de estos modelos, la compañía dirigida por Sam Altman planea retirar a sus predecesores, O1 y 03-Mini, consolidando así su oferta en las versiones más avanzadas y eficientes.
https://www.youtube.com/watch?v=sq8gbpub3rk
Lo que ha cambiado con los modelos anteriores
Los modelos O3 y O4-Mini marcan una evolución clara con respecto a sus versiones anteriores, O1 y O3-Mini. La principal innovación es su capacidad para Use herramientas integradas de forma completamente autónoma. Mientras que en versiones anteriores, el usuario tenía que activar manualmente funciones como la navegación, el intérprete de código o la generación de imágenes, ahora los modelos deciden cuándo y cómo usarlas, lo que permite una interacción mucho más fluida y natural.
Como explica la misma compañía en su blog oficial, «Estos modelos están entrenados para razonar cuándo y cómo usar las herramientas para producir respuestas detalladas y bien pensadas en los formatos de salida apropiados, generalmente en menos de un minuto, para resolver problemas más complejos».
También ha trabajado para mejorar el monitoreo de instrucciones largas y rendimiento en tareas complejasEspecialmente en matemáticas, programación y análisis visual, áreas en las que GPT-4 comenzó a mostrar límites.
Finalmente, filtros de moderación y Se redujeron las alucinaciones (respuestas falsas), haciendo que los modelos O3 y O4-Mini sean más confiables y seguros para aplicaciones profesionales.
O3, el modelo más avanzado de Openai
OpenAi O3 representa el Modelo de razonamiento más avanzado de la empresa, diseñada para transformar áreas como programaciónel matemáticasel ciencias y el Percepción visual.
Su rendimiento ha marcado nuevos estándares en la tecla de puntos de referencia, como:
- CodeForces: Una plataforma de competencia de programación algorítmica que mide la capacidad de resolver problemas complejos bajo presión.
- Swe-Bench: Evaluación de tareas reales de ingeniería de software extraídas de GitHub, que mide la capacidad del modelo para resolver errores o implementar funciones.
- MMMU (subestimación multilingüe multitarea masiva): Un punto de referencia que agrupa las tareas académicas de diversas disciplinas, evaluando la comprensión generalista del modelo.
O3 es Ideal para abordar preguntas complejas que requieren un análisis multifacético y cuya respuesta no es inmediatamente evidente. Además, es especialmente efectivo en tareas visuales, como la interpretación de imágenes, gráficos y diagramas.
Las evaluaciones externas muestran que O3 cometió un 20% menos errores graves que su predecesor O1 en las tareas del mundo real, que se destacan en campos como ingeniería, biología, negocios y creatividad aplicada. Los evaluadores lo describen como un socio riguroso para el pensamiento crítico y la generación de hipótesis innovadoras.
Además, el modelo obtuvo un 69.1% en el banco de referencia SWE verificadoconvirtiéndose en el modelo más efectivo en las tareas de codificación de acuerdo con este estándar. Sin embargo, un informe de TechCrunch dijo que su puntaje en el Frontiermath de referencia era inferior al anunciado inicialmente por OpenAI (50.4% en comparación con el 52.9% publicado antes), generando cierta controversia sobre la transparencia de los resultados.
Razonamiento con imágenes
Una de las características más innovadoras de O3 es su Capacidad para pensar con imágenes «. Esto le permite analizar gráficos, mapas, diagramas e incluso capturas de pantalla como parte de su proceso de razonamiento. Puede cargar una foto de un tablero, un diagrama de un libro de texto o un boceto hecho a mano, y el modelo puede interpretarla, incluso si la imagen es borrosa, invertida o de baja calidad.


Por ejemplo, un usuario puede plantear una tabla de ventas y pedirle al modelo que identifique tendencias, compare meses o haga recomendaciones basadas en datos visuales.
Esta función es especialmente útil en campos como educación, diseño, marketing o análisis de datos, y representa una clara ventaja competitiva sobre otros modelos generativos.
04-Mini, la versión más ligera y más rentable
Por otro lado, O4-Mini es una versión más ligero y rentableoptimizado para razonamiento ágil sin sacrificar la precisión. Brilla en las tareas de matemáticas, programación y análisis visual, y ha logrado un rendimiento líder en AIME 2024 y 2025 (que mide las capacidades matemáticas), alcanzando el 99.5% de las respuestas correctas con acceso a herramientas como el intérprete Python.
Además, O4-Mini Suponga O3-Mini en tareas que no son STAD (acrónimo en inglés que abarca las 4 disciplinas de conocimiento: ciencia, tecnología, ingeniería, matemáticas) y dominios como la ciencia de datos, siendo Ideal para flujos de trabajo intensivos por su alta eficiencia y Límites de uso más amplios.
Hacia agentes autónomos: la nueva visión de Openai
El lanzamiento de estos modelos es parte de una estrategia más amplia que apunta hacia el desarrollo de agentes autónomos. Estos agentes no solo hablan, sino que comprenden contextos complejos, planifican tareas, herramientas de acceso, manipulan entornos y toman decisiones.
Para ilustrar esta visión, OpenAi ha desarrollado un experimento llamado Codex CLI, una interfaz de comando en línea donde O3 puede operar un entorno Linux simulado. En él, el modelo instala paquetes, edita archivos o navegación de carpetas de forma autónoma, lo que le permite intentar desarrollar aplicaciones futuras donde la IA actúa como administrador de sistemas, desarrollador o asistente técnico.
Este enfoque modular, basado en agentes, está alineado con la tendencia del sector a avanzar hacia los modelos que «piensan, deciden y actúan», y no solo generan texto. Esto puede transformar radicalmente sectores como el comercio electrónico, la educación, el marketing digital o la ingeniería.
Cómo acceder a los modelos O3 y O4-Mini
El Chatgpt Plus, PRO y usuarios de equipo Ya pueden acceder a modelos O3, O4-Mini y O4-Mini-High En el selector de modelos. Los usuarios de ChatGPT Enterprise y EDU tendrán acceso en una semana. Los usuarios gratuitos pueden probar O4-Mini seleccionando «Piense» del editor antes de enviar su consulta.
Operai planea lanzar una versión aún más potente, O3-Pro, y eliminar progresivamente modelos anteriores como O1 y sus mini variantes. Además, la interfaz CHATGPT es anunciada por el GPT-4 Lanzamiento para el 30 de abril.


El cambio de nomenclatura-de GPT-4 a O3/O4- responde a una estrategia de lanzamiento más rápida y nombres más simples, alejándose de la lógica de versiones secuenciales (GPT-3, 3.5, 4). Esta nueva convención busca reflejar mejor el propósito o las características del modelo, lo que permite a OpenAi innovar con más agilidad y claridad.
Foto: OpenAI
Versión Completa OpenAI presenta 03 y 04 mini, sus modelos de IA más avanzados





