Ir al contenido principal
OpenAI

16 de diciembre de 2025

ProductoLanzamiento

La nueva función de Imágenes de ChatGPT ya está aquí

Cargando…

Hoy lanzamos una nueva versión de ChatGPT Imágenes, impulsada por nuestro modelo insignia de generación de imágenes. Tanto si partes de cero como si editas una foto, ahora puedes conseguir exactamente el resultado que tienes en mente. Realiza ediciones precisas sin perder detalles importantes, como la apariencia de las personas, y genera imágenes hasta cuatro veces más rápido. Además, presentamos una nueva experiencia de imágenes dentro de ChatGPT, diseñada para que crear imágenes sea más agradable, para despertar nuevas ideas y facilitar la exploración creativa.

El nuevo modelo de imágenes y la función ya están disponibles desde hoy en ChatGPT para todos los usuarios y en la API bajo el nombre GPT‑image‑1.5.

Ediciones precisas que cuidan los detalles que importan

Ahora, cuando solicitas editar una imagen que has subido, el modelo sigue tu intención creativa de manera más fiable, incluso en los detalles más pequeños. Solo modifica lo que pides y mantiene elementos consistentes, como la iluminación, la composición y la apariencia de las personas, tanto en las imágenes que subes como en los resultados y en las ediciones posteriores.

Esto te permite obtener resultados que se ajustan a tu intención: ediciones de fotos más útiles, pruebas de vestuario y peinados más realistas, junto con filtros estilísticos y transformaciones conceptuales que conservan la esencia de la imagen original. En conjunto, estas mejoras convierten a ChatGPT en un estudio creativo en tu bolsillo, capaz de realizar tanto ediciones prácticas como reinterpretaciones expresivas.

Edición

El modelo destaca en distintos tipos de edición, como agregar, eliminar, combinar, mezclar y transponer, para que consigas los cambios que deseas sin perder lo que hace especial a la imagen.

chatgpt-images-example-1-input-2chatgpt-images-example-1-input-1chatgpt-images-example-1-input-2

Combine the two men and the dog in a 2000s film camera-style photo of them looking bored at a kids birthday party.

chatgpt-images-example-1-output-1

Add chaotic kids in the background throwing things and screaming.

chatgpt-images-example-1-output-2

Change the man on the left to a hand-drawn retro anime style, the dog to plushie style, keep the man on the right and background scenery the way they are.

chatgpt-images-example-1-output-3
Screenshot 2025-12-12 at 10.23.01 AM

Put them all in OpenAI sweaters that look like this.

chatgpt-images-example-1-output-4

Now remove the two men, just keep the dog, and put them in an OpenAI livestream that looks like the attached image.

chatgpt-images-example-1-output-5

Transformaciones creativas

La creatividad del modelo se refleja en las transformaciones que modifican o añaden elementos, como texto y diseño, dando vida a tus ideas sin perder los detalles importantes. Estas transformaciones funcionan tanto con conceptos simples como con los más complejos y se pueden probar fácilmente con los estilos y las ideas predeterminadas en la nueva función de ChatGPT Imágenes(se abre en una ventana nueva), sin necesidad de prompts escritos.

chatgpt-images-example-3-output-1

Make an old school golden age hollywood movie poster of a movie called 'codex' from the image of these two men. feel free to change their costumes to fit the times

Change the names of the actors to Wojciech Zaremba (left) and Greg Brockman (right) 

Directed by Sam Altman, produced by Fidji Simo. A Feel the AGI Pictures Production.

chatgpt-images-example-3-output-2

Seguir instrucciones

Este modelo sigue las instrucciones de forma más confiable que nuestra versión inicial. Lo que permite realizar ediciones más precisas y composiciones originales más complejas, manteniendo las relaciones entre los elementos tal como se pretendía.

Nuevo

draw a 6x6 grid

Make a 6 (columns) by 6 (rows) grid grid of:

Row 1: the Greek letter beta, a beach ball, a lemon, a robot, a fish tank, a frog

Row 2: a praying mantis, an expensive watch, a baththub, a pair of sunglasses, a colorful butterfly, an envelope

Row 3: a stamp, a picture frame, a steaming dumpling, the word "miracle", a pair of skis, the letter Z

Row 4: a toilet, a subway token, a mute icon, a bottle of perfume, a dragonfly, a skateboard helmet

Row 5: a Bluetooth icon, the number 13, a green heart, a rubik's cube, a Canada goose, a soldier's helmet

Row 6: a white dog, a life jacket, a knot, a keyboard, a tissue box, the number 14

chatgpt-images-instruction-following-new

Anterior

draw a 6x6 grid

Make a 6 (columns) by 6 (rows) grid grid of:

Row 1: the Greek letter beta, a beach ball, a lemon, a robot, a fish tank, a frog

Row 2: a praying mantis, an expensive watch, a baththub, a pair of sunglasses, a colorful butterfly, an envelope

Row 3: a stamp, a picture frame, a steaming dumpling, the word "miracle", a pair of skis, the letter Z

Row 4: a toilet, a subway token, a mute icon, a bottle of perfume, a dragonfly, a skateboard helmet

Row 5: a Bluetooth icon, the number 13, a green heart, a rubik's cube, a Canada goose, a soldier's helmet

Row 6: a white dog, a life jacket, a knot, a keyboard, a tissue box, the number 14

chatgpt-images-instruction-following-old

Renderizado de texto

El modelo mejora su manejo del texto y ofrece precisión incluso en los caracteres más pequeños y densos.

There is a newspaper on a desk. The newspaper shows the markdown below laid out as a **natural** newspaper article. Preserve all content, formatting, and numbers exactly. The image should be tall.

# Introducing GPT‑5.2

### *The most advanced frontier model for professional work and long-running agents*

**December 11, 2025**

---

We are introducing **GPT‑5.2**, the most capable model series yet for professional knowledge work.

Already, the average ChatGPT Enterprise user says AI saves them 40–60 minutes a day, and heavy users say it saves them more than 10 hours a week. We designed GPT‑5.2 to unlock even more economic value for people; it’s better at creating spreadsheets, building presentations, writing code, perceiving images, understanding long contexts, using tools, and handling complex, multi-step projects.

GPT‑5.2 sets a new state of the art across many benchmarks, including GDPval, where it outperforms industry professionals at well-specified knowledge work tasks spanning 44 occupations.

---

## Benchmark highlights

| Benchmark | Domain | GPT‑5.2 Thinking | GPT‑5.1 Thinking |

|---|---|---:|---:|

| GDPval (wins or ties) | Knowledge work tasks | **70.9%** | 38.8% (GPT‑5) |

| SWE-Bench Pro (public) | Software engineering | **55.6%** | 50.8% |

| SWE-bench Verified | Software engineering | **80.0%** | 76.3% |

| GPQA Diamond (no tools) | Science questions | **92.4%** | 88.1% |

| CharXiv Reasoning (w/ Python) | Scientific figure questions | **88.7%** | 80.3% |

| AIME 2025 (no tools) | Competition math | **100.0%** | 94.0% |

| FrontierMath (Tier 1–3) | Advanced mathematics | **40.3%** | 31.0% |

| FrontierMath (Tier 4) | Advanced mathematics | **14.6%** | 12.5% |

| ARC-AGI-1 (Verified) | Abstract reasoning | **86.2%** | 72.8% |

| ARC-AGI-2 (Verified) | Abstract reasoning | **52.9%** | 17.6% |

---

Notion, Box, Shopify, Harvey, and Zoom observed that GPT‑5.2 demonstrates state-of-the-art long-horizon reasoning and tool-calling performance. Databricks, Hex, and Triple Whale found GPT‑5.2 to be exceptional at agentic data science and document analysis tasks. Cognition, Warp, Charlie Labs, JetBrains, and Augment Code report that GPT‑5.2 delivers state-of-the-art agentic coding performance, with measurable improvements in areas such as interactive coding, code reviews, and bug finding.

In ChatGPT, GPT‑5.2 Instant, Thinking, and Pro will begin rolling out today, starting with paid plans. In the API, they are available now to all developers.

Overall, GPT‑5.2 brings significant improvements in general intelligence, long-context understanding, agentic tool-calling, and vision—making it better at executing complex, real-world tasks end-to-end than any previous model.

chatgpt-images-text-rendering-2

Now change the article to the markdown below:

# Introducing GPT‑Image‑1.5

### *The new and improved ChatGPT Images*

**December 16, 2025**

---

Today, we’re introducing a new and improved version of ChatGPT Images, powered by our best image generation model yet. With stronger instruction following and more precise editing, ChatGPT Images delivers the changes you ask for while keeping important details like facial likeness consistent across edits—now with generation speeds up to **4× faster**, making it easier to iterate and explore ideas with less waiting.

This is our most capable general-purpose text-to-image model to date, with more expressive transformations, improved dense text rendering, and more natural-looking results. Whether you’re making a tiny fix or a total reinvention, you can simply say what you want—or choose from preset styles and ideas in the new Images experience—and ChatGPT handles the rest, delivering results that are both useful and compelling, and better match your intent.

The new Images model and experience is beginning to roll out today in ChatGPT for all users, and in the API as **GPT‑Image‑1.5**.

---

## Results that match your intent

The model now follows instructions more reliably—down to the small details—changing what you ask for while able to keep elements like lighting, composition, and likeness consistent across inputs, outputs, and subsequent edits.

This unlocks results that match your intent—more useful photo edits, more believable clothing and hairstyle try-ons, alongside stylistic filters and conceptual transformations that retain the essence of the original image. Together, these improvements mean ChatGPT can act as a creative studio in your pocket, capable of both practical edits and expressive reimaginings.

### Editing

The model excels at different types of editing so you get the changes you want without losing what makes the image special.

### Creative Transformations

The model’s creativity shines with creative transformations, changing and adding elements—like text and layout—that help the concept come to life while maintaining important details.

### Instruction Following

The model is able to better follow instructions versus GPT Image 1.0.

### Text Rendering

The model takes another step ahead in text rendering, capable of handling denser and smaller text.

---

## A new creation space

In addition to asking for images through ChatGPT by describing what you’d like to see, we’re also introducing a dedicated Images experience in the ChatGPT sidebar to make exploring and trying images easier and quicker. This includes preset filters and trending prompts to jump-start inspiration, as well as a one-time likeness upload so you can reuse your appearance across future creations without the need to go through your camera roll again.

Together, these upgrades let you create images that better match your vision, from small edits to full reimaginings. Images now render up to four times faster, and you can continue generating new images while others are still in progress—so you can explore more ideas without waiting.

chatgpt-images-text-rendering-3

Mejoras de calidad adicionales

El modelo también mejora en otras dimensiones y entrega resultados más listos para usar, como la forma en que se muestran múltiples caras pequeñas y el aspecto más natural de las imágenes.

Nuevo

make a scene in chelsea, london in the 1970s, photorealistic, everything in focus, with tons of people, and a bus with an advertisement for "ImageGen 1.5" with the OpenAI logo and subtitle "Create what you imagine". Hyper-realistic amateur photography, iPhone snapshot quality…

chatgpt-images-quality-1

Anterior

make a scene in chelsea, london in the 1970s, photorealistic, everything in focus, with tons of people, and a bus with an advertisement for "ImageGen 1.5" with the OpenAI logo and subtitle "Create what you imagine". Hyper-realistic amateur photography, iPhone snapshot quality…

chatgpt-images-quality-2

Un nuevo espacio de creación

Además de generar imágenes con solo describir lo que quieres ver, presentamos un espacio dedicado a Imágenes(se abre en una ventana nueva) en ChatGPT, disponible en la barra lateral de la app móvil y en chatgpt.com. Explorar y probar imágenes ahora es más rápido y sencillo. Incluye decenas de filtros y prompts predefinidos que estimulan la creatividad, actualizados regularmente para reflejar las tendencias emergentes.

Estas mejoras te permiten crear imágenes que se ajusten mejor a tu visión, desde pequeñas ediciones hasta transformaciones completas.

Imágenes de ChatGPT para el trabajo

Este modelo mejora los flujos de trabajo empresariales al ofrecer generación de imágenes más rápida, ediciones precisas y resultados visuales consistentes en cada versión. Los equipos pueden explorar ideas, realizar cambios puntuales y visualizar conceptos complejos o abstractos, apoyando casos de uso en marketing, diseño, comercio electrónico y comunicación interna.

Mejoras y limitaciones

Volvimos a probar muchos de los ejemplos de nuestro lanzamiento inicial de generación de imágenes para evaluar el rendimiento. El modelo muestra mejoras claras en una variedad de casos, aunque los resultados aún no son perfectos. Este lanzamiento supone un avance significativo, pero todavía queda un amplio margen de mejora para las versiones futuras.

Nuevo

create a poster of deep sea creatures at different depths, with a vertical ocean cutaway, styled in a beautiful japanese detailed anime style

chatgpt-images-output-1

Anterior

create a poster of deep sea creatures at different depths, with a vertical ocean cutaway, styled in a beautiful japanese detailed anime style

chatgpt-images-output-2

Aún existen algunas inexactitudes científicas, pero el modelo acierta alrededor del 70 % de las veces y genera gráficos mucho más vivos, evitando recortes prematuros.

GPT imagen 1.5 en la API

GPT‑image‑1.5 en la API ofrece todas las mismas mejoras que ChatGPT Imágenes: es más eficaz para preservar y editar imágenes que GPT Image 1.

Notarás una preservación más consistente de los logotipos de marca y otros elementos visuales clave en las ediciones, lo que lo hace ideal para trabajos de marketing y branding, como la creación de gráficos y logotipos, así como para equipos de comercio electrónico que generan catálogos completos de imágenes de productos (variantes, escenas y ángulos) a partir de una sola imagen fuente.

Las imágenes de entrada y salida ahora cuestan un 20 % menos en GPT Image 1.5 que en GPT Image 1, lo que te permite generar y ajustar más imágenes con el mismo presupuesto.Puedes probar el nuevo modelo en el OpenAI Playground(se abre en una ventana nueva) o consultar la guía de prompts(se abre en una ventana nueva) para inspirarte.

Empresas y startups de distintos sectores, como herramientas creativas, comercio electrónico, software de marketing y más, ya están usando GPT Image 1.5. Nos entusiasma compartir algunos de estos ejemplos a continuación.

Nuevo

chatgpt-images-API-output-1

Anterior

chatgpt-images-API-output-2

«GPT Imagen 1.5 genera imágenes de alta fidelidad que siguen fielmente los prompts, preservando la composición, la iluminación y los detalles minuciosos. Los resultados son limpios, realistas y fiables, lo que facilita flujos de trabajo de concepto a producción más rápidos en plataformas como Wix. Según nuestras pruebas y los principales casos de uso observados en Wix, la consistencia y la calidad hacen de este uno de los modelos de generación de imágenes insignia en la actualidad».

— Hila Gat, jefa de investigación de IA y ciencia de datos en Wix

Disponibilidad

La nueva ChatGPT Imágenes se está desplegando ahora para todos los usuarios de ChatGPT y de la API a nivel mundial hoy en todas las plataformas. Funciona en todos los modelos, así que no necesitas seleccionar nada para usarlo.

Creemos que todavía estamos al principio de lo que la generación de imágenes puede habilitar. La actualización de hoy es un paso significativo hacia adelante, con más por venir, desde ediciones más precisas hasta resultados más ricos y detallados en todos los idiomas.

Autor

OpenAI

Contributors

Project Leadership

Gabriel Goh — Research Lead

Adele Li — Product Lead

Bill Peebles — Sora Lead 

Aditya Ramesh — World Simulation Lead

Mark Chen — Chief Research Officer

Prafulla Dhariwal — Multimodal Lead

Core Team 

Alex Fang, Alex Yu, Ben Wang, Bing Liang, Boyuan Chen, Charlie Nash, David Medina, Dibya Bhattacharjee, Jianfeng Wang, Kenji Hata, Kiwhan Song, Mengchao Zhong, Mike Starr, Yuguang Yang

Research Contributors

Bram Wallace, Dmytro Okhonko, Haitang Hu, Kshitij Gupta, Li Jing, Lu Liu, Peter Zhokhov, Qiming Yuan, Senthil Purushwalkam, Yizhen Zhang

Core Inference

Adam Tart, Alyssa Huang, Andrew Braunstein, Jane Park, Karen Li, Tomer Kaftan

Research Collaborators

Aditya Ramesh, Alex Nichol, Andrew Kondrich, Andrew Liu, Benedikt Winter, Bill Peebles, Connor Holmes, Cyril Zhang, Daniel Geng, Eric Mintun, James Betker, Jamie Kiros, Manuka Stratta, Martin Li, Raoul de Liedekerke, Ricky Wang, Ruslan Vasilev, Vladimir Chalyshev, Welton Wang, Wyatt Thompson, Yaming Lin

Inference Collaborators

Jiayu Bai, Kevin King, Stanley Hsieh, Weiyi Zheng

Data & Evaluation

Alexandra Barr, Aparna Dutta, Arshi Bhatnagar, Chao Yu, Charlotte Cole, Dragos Oprica, Emma Tang, Gowrishankar Sunder, Henry Baer, Ian Sohl, James Park Lennon, Jason Xu, Peilin Yang, Somay Jain, Szi-chieh Yu, Wesam Manassra, Xiaolei Zhu, Yilei Qian

Applied

Affonso Reis, Alan Gou, Alexandra Vodopianova, Amandeep Grewal, Andi Liu, Andrew Sima, Angus Fletcher, Antonia Woodford, Arun Eswara, Benny Wong, Bharat Rangan, Boyang Niu, Bridget Collins, Bryan Brandow, Callie Riggins Zetino, Chris Wendel, Ethan Chang, Gilman Tolle, Greg Hochmuth, Ibrahim Okuyucu, Jesse Chand, Jesse Hendrickson, Jiayu Bai, Jimmy Lin, Johan Cervantes, Kan Wu, Liam Esparraguera, Maja Wichrowska, Matthew Ferrari, Murat Yesildal, Nikunj Handa, Nithanth Kudige, Ola Okelola, Osman Khwaja, Peter Argany, Peter Bakkum, Peter Vidani, Richard Zadorozny, Rohan Sahai, Savelii Bondini, Sean Chang, Vickie Duong, Victoria Huang, Xiaolin Hao, Xueqing Li

Safety, Safety Systems, Integrity, Policy & Trust

Abby Fanlo Susk, Adam Wells, Aleah Houze, Annie Cheng, Artyi Xu, Carolina Paz, David Abelman, Femi Alamu, Jay Wang, Jeremiah Currier, Jesika Haria, Mariya Guryeva, Max Burkhardt, Paige Walker, Pedro Aguilar, Rutsu Koshimizu, Sam Toizer, Savannah Heon, Tom Rubin, Tonia Osadebe, Willow Primack, Zoe Stoll

Product Operations, Program Management and Governance

Antonio Di Francesco, Filippo Raso, Grace Wu, Josh Metherd, Ruth Costigan

Legal

Ally Bennett, Tony Song, Tyce Walters

Communications, Marketing, Community, Design & Creative

Akash Iyer, Alex Baker-Whitcomb, Angie Luo, Anne Oburgh, Antonia Richmond, Annie Tsang, Ashley Tyra, Bailey Richardson, Brandon McGraw, Cary Hudson, Dana Palmie, Evan Corrigan, Gaby Raila, Indgila Samad Ali, James Anderson, Jeremy Schwartz, Jordan Liss, Juan Garza, Julie Steele, Kara Zichittella, Karn Piluntanadilok, Kendal Peirce, Kim Baschet, Leah Anise, Livvy Pierce, Maria Clara M. Fleury Osorio, Minnia Feng, Nick Ciffone, Nick Forland, Niko Felix, Paige Ford, Rachel Puckett, Rishabh Aggarwal, Rusty Rupprecht, Souki Mansoor, Tasia Potasinski, Taya Christianson, Vasundhara Mudgil, Whitney Ferris, Yara Khakbaz, Zach Brock, Zoë Silverman

Special Thanks

Amy Yang, Arvin Wu, Avital Oliver, Brandon McKinzie, Chak Li, Chris Lu, David Duxin, Dian Ang Yap, Gabriel Petersson, Guillaume Leclerc, Hazel Byrne, Henry Aspegren, Jennifer Luckenbill, Ji Lin, Joseph Mo, Julius Hochmuth, Liunian (Harold) Li, Long Ouyang, Mariano López, Michael Zhang, Ravi Teja Mullapudi, Suvansh Sanjeev, Varun Shetty, Wenda Zhou

Exec

Fidji Simo, Hannah Wong, Jakub Pachocki, Jason Kwon, Johannes Heidecke, Kate Rouch, Lauren Itow, Mark Chen, Mia Glaese, Nick Ryder, Nick Turley, Prafulla Dhariwal, Sam Altman, Sulman Choudhry