Անցնել հիմնական բովանդակությանը
OpenAI

16 դեկտեմբերի, 2025 թ.

ԱրտադրանքԹողարկում

Նոր ChatGPT Images-ը այստեղ է

This post covers an image-generation launch.

Բեռնվում է…

Այսօր մենք թողարկում ենք ChatGPT Images-ի նոր տարբերակը, որը սնուցվում է մեր նոր առաջատար պատկերների գեներացման մոդելով։ Այժմ, անկախ նրանից՝ դուք ստեղծում եք ինչ-որ բան զրոյից, թե խմբագրում եք լուսանկար, դուք կստանաք այն արդյունքը, որը պատկերացնում եք։ Այն կատարում է ճշգրիտ խմբագրումներ՝ պահպանելով մանրամասները, ինչպիսիք են մարդկանց արտաքին տեսքը, և ստեղծում է պատկերներ մինչև 4 անգամ ավելի արագ։ Միաժամանակ, մենք ներկայացնում ենք ChatGPT Images-ի նոր ֆունկցիան, որը նախատեսված է պատկերների գեներացումը հաճելի դարձնելու համար՝ ոգեշնչում առաջացնելու և ստեղծագործական ուսումնասիրությունը հեշտացնելու համար։

Images-ի նոր մոդելը և հնարավորությունը այսօր սկսում են գործարկվել ChatGPT‑ում բոլոր օգտատերերի համար, և API-ում՝ որպես gpt-image-1.5։

Ճշգրիտ խմբագրումներ, որոնք պահպանում են այն, ինչ կարևոր է։

Այժմ, երբ դուք խնդրում եք խմբագրումներ կատարել վերբեռնված պատկերի համար, մոդելն ավելի հուսալիորեն է հետևում ձեր մտադրությանը՝ մինչև փոքր մանրամասները՝ փոխելով միայն այն, ինչ դուք խնդրել եք, միաժամանակ պահպանելով լուսավորության, կոմպոզիցիայի և մարդկանց տեսքի նման տարրերի համապատասխանությունը մուտքային, ելքային տվյալների և հետագա խմբագրումների ընթացքում։

Սա կբացի ձեր մտադրությանը համապատասխանող արդյունքներ՝ ավելի օգտակար լուսանկարների խմբագրումներ, ավելի հավաստի հագուստի և սանրվածքի փորձարկումներ, ինչպես նաև ոճական ֆիլտրեր և հայեցակարգային փոխակերպումներ , որոնք պահպանում են սկզբնական պատկերի էությունը։ Միասին, այս բարելավումները նշանակում են, որ ChatGPT‑ը կարող է գործել որպես ստեղծագործական ստուդիա ձեր գրպանում՝ ունակ լինելով ինչպես գործնական խմբագրումների, այնպես էլ արտահայտիչ վերաիմաստավորումների։

Խմբագրում

Մոդելը գերազանց է խմբագրման տարբեր տեսակների մեջ, ներառյալ գումարումը, հանումը, համադրությունը, խառնումը և տեղափոխումը, այնպես որ դուք ստանում եք ձեր ուզած փոփոխությունները առանց կորցնելու այն, ինչը դարձնում է պատկերը յուրահատուկ։

Ստեղծագործական փոխակերպումներ

Մոդելի ստեղծագործականությունն արտահայտվում է այնպիսի փոխակերպումների միջոցով, որոնք փոխում և ավելացնում են տարրեր, ինչպիսիք են տեքստը և դասավորությունը՝ գաղափարները կյանքի կոչելու համար՝ միաժամանակ պահպանելով կարևոր մանրամասները։ Այս փոխակերպումները գործում են ինչպես պարզ, այնպես էլ ավելի բարդ գաղափարների համար և հեշտ է փորձել՝ օգտագործելով նախապես սահմանված ոճեր և գաղափարներ նոր ChatGPT Images(բացվում է նոր պատուհանում) գործառույթում՝ գրավոր հարցում անհրաժեշտ չէ։

Հրահանգի հետևում

Մոդելը ավելի հուսալիորեն է հետևում հրահանգներին, քան մեր նախնական տարբերակը։ Սա միացնում է ավելի ճշգրիտ խմբագրումներ, ինչպես նաև ավելի բարդ բնօրինակ ստեղծագործություններ, որտեղ տարրերի միջև հարաբերությունները պահպանվում են այնպես, ինչպես նախատեսված է։

Նոր

draw a 6x6 grid

Make a 6 (columns) by 6 (rows) grid grid of:

Row 1: the Greek letter beta, a beach ball, a lemon, a robot, a fish tank, a frog

Row 2: a praying mantis, an expensive watch, a baththub, a pair of sunglasses, a colorful butterfly, an envelope

Row 3: a stamp, a picture frame, a steaming dumpling, the word "miracle", a pair of skis, the letter Z

Row 4: a toilet, a subway token, a mute icon, a bottle of perfume, a dragonfly, a skateboard helmet

Row 5: a Bluetooth icon, the number 13, a green heart, a rubik's cube, a Canada goose, a soldier's helmet

Row 6: a white dog, a life jacket, a knot, a keyboard, a tissue box, the number 14

chatgpt-images-instruction-following-new

Նախորդ

draw a 6x6 grid

Make a 6 (columns) by 6 (rows) grid grid of:

Row 1: the Greek letter beta, a beach ball, a lemon, a robot, a fish tank, a frog

Row 2: a praying mantis, an expensive watch, a baththub, a pair of sunglasses, a colorful butterfly, an envelope

Row 3: a stamp, a picture frame, a steaming dumpling, the word "miracle", a pair of skis, the letter Z

Row 4: a toilet, a subway token, a mute icon, a bottle of perfume, a dragonfly, a skateboard helmet

Row 5: a Bluetooth icon, the number 13, a green heart, a rubik's cube, a Canada goose, a soldier's helmet

Row 6: a white dog, a life jacket, a knot, a keyboard, a tissue box, the number 14

chatgpt-images-instruction-following-old

Տեքստի արտապատկերում

Մոդելը ևս մեկ քայլ առաջ է կատարում տեքստի արտապատկերման մեջ՝ կարողանալով մշակել ավելի խիտ և փոքր տեքստեր։

Լրացուցիչ որակի բարելավումներ

Մոդելը նաև բարելավվում է լրացուցիչ չափումներով, որոնք վերածվում են ավելի անմիջապես կիրառելի արդյունքների, ինչպես փոքր դեմքերի պատկերումը և բնական արդյունքների տեսքը։

Նոր ստեղծագործական տարածք

Բացի հաղորդագրության մեջ նկարագրելով այն, ինչ ցանկանում եք տեսնել՝ պատկերներ գեներացնելով, մենք ներկայացնում ենք Images(բացվում է նոր պատուհանում) -ի համար նվիրված բաժին ChatGPT‑ում՝ հասանելի կողագոտու միջոցով բջջային հավելվածում և chatgpt.com-ում՝ պատկերների ուսումնասիրությունն ու փորձարկումն ավելի արագ և հեշտ դարձնելու համար։ Այն ներառում է տասնյակ նախապես սահմանված զտիչներ և հարցումներ՝ ոգեշնչումը խթանելու համար, որոնք պարբերաբար թարմացվում են՝ արտացոլելու նոր զարգացող միտումները։

Միասին, այս բարելավումները թույլ են տալիս ձեզ ստեղծել պատկերներ, որոնք ավելի լավ են համապատասխանում ձեր տեսլականին՝ փոքր խմբագրումներից մինչև ամբողջական վերաիմաստավորումներ։

ChatGPT Images աշխատանքի համար

Այս մոդելը հեշտացնում է բիզնեսի աշխատանքային հոսքերը՝ ապահովելով պատկերների ավելի արագ ստեղծում, ճշգրիտ խմբագրումներ և հետևողական տեսողական մանրամասներ բոլոր իտերացիաներում։ Թիմերը կարող են ուսումնասիրել գաղափարները, կատարել նպատակային փոփոխություններ և վիզուալացնել բարդ կամ չոր հասկացությունները՝ աջակցելով կիրառման դեպքերին մարքեթինգի, դիզայնի, էլեկտրոնային առևտրի և ներքին հաղորդակցությունների ոլորտներում։

Բարելավումներ և սահմանափակումներ

Մենք նորից գործարկեցինք մեր նախնական պատկերների գեներացման մեկնարկի բազմաթիվ օրինակներ՝ արդյունավետությունը գնահատելու համար։ Մոդելը ցույց է տալիս հստակ բարելավումներ տարբեր դեպքերում, թեև արդյունքները մնում են անկատար։ Թեև այս թողարկումը ներկայացնում է նշանակալի առաջընթաց, ապագա կրկնությունների մեջ դեռևս կա զգալի բարելավման հնարավորություն։

GPT Image 1.5-ը API-ում

gpt-image-1.5-ը API-ում ապահովում է նույն բարելավումները, ինչ ChatGPT Images-ը. այն ավելի ուժեղ է պատկերների պահպանման և խմբագրման մեջ, քան GPT Image 1-ը։

Դուք կտեսնեք ավելի համահունչ պահպանություն բրենդային լոգոների և հիմնական վիզուալների խմբագրումների ընթացքում՝ դարձնելով այն հարմար մարքեթինգի և բրենդային աշխատանքի համար, ինչպիսիք են գրաֆիկան և լոգոների ստեղծումը, ինչպես նաև էլեկտրոնային առևտրի թիմերի համար, որոնք գեներացնում են ամբողջական ապրանքային պատկերների կատալոգներ (տարբերակներ, տեսարաններ և անկյուններ) մեկ աղբյուր պատկերից։

Պատկերների մուտքագրումներն ու արտածումները այժմ 20% ավելի էժան են GPT Image 1.5-ում՝ համեմատած GPT Image 1-ի հետ, այնպես որ դուք կարող եք գեներացնել և կատարելագործել ավելի շատ պատկերներ նույն բյուջեով։

Դուք կարող եք փորձարկել նոր մոդելը
OpenAI Playground(բացվում է նոր պատուհանում) -ում կամ կարդալ հարցման ուղեցույցը(բացվում է նոր պատուհանում) ոգեշնչման համար։

Ձեռնարկությունները և ստարտափները տարբեր ոլորտներում, ներառյալ ստեղծագործական գործիքները, էլեկտրոնային առևտուրը, մարքեթինգային ծրագրային ապահովումը և ավելին, արդեն օգտագործում են GPT Image 1.5-ը: Մենք ոգևորված ենք կիսվել այս օրինակներից մի քանիսով ստորև։

Հասանելիություն

Նոր ChatGPT Images-ը այսօր սկսում է հասանելի դառնալ բոլոր ChatGPT‑ի և API օգտատերերին ամբողջ աշխարհում ։ Այն աշխատում է բոլոր մոդելների հետ, այնպես որ ձեզ հարկավոր չէ որևէ բան ընտրել՝ այն օգտագործելու համար։

Մենք հավատում ենք, որ մենք դեռևս գտնվում ենք այն բանի սկզբում, ինչ կարող է միացնել պատկերների ստեղծումը։ Այսօրվա թարմացումը նշանակալի առաջընթաց է՝ ավելի մանրամասն խմբագրումներից մինչև ավելի հարուստ, ավելի մանրամասն արդյունքներ տարբեր լեզուներով։

Հեղինակ

OpenAI

Contributors

Project Leadership

Gabriel Goh — Research Lead

Adele Li — Product Lead

Bill Peebles — Sora Lead 

Aditya Ramesh — World Simulation Lead

Mark Chen — Chief Research Officer

Prafulla Dhariwal — Multimodal Lead

Core Team 

Alex Fang, Alex Yu, Ben Wang, Bing Liang, Boyuan Chen, Charlie Nash, David Medina, Dibya Bhattacharjee, Jianfeng Wang, Kenji Hata, Kiwhan Song, Mengchao Zhong, Mike Starr, Yuguang Yang

Research Contributors

Bram Wallace, Dmytro Okhonko, Haitang Hu, Kshitij Gupta, Li Jing, Lu Liu, Peter Zhokhov, Qiming Yuan, Senthil Purushwalkam, Yizhen Zhang

Core Inference

Adam Tart, Alyssa Huang, Andrew Braunstein, Jane Park, Karen Li, Tomer Kaftan

Research Collaborators

Aditya Ramesh, Alex Nichol, Andrew Kondrich, Andrew Liu, Benedikt Winter, Bill Peebles, Connor Holmes, Cyril Zhang, Daniel Geng, Eric Mintun, James Betker, Jamie Kiros, Manuka Stratta, Martin Li, Raoul de Liedekerke, Ricky Wang, Ruslan Vasilev, Vladimir Chalyshev, Welton Wang, Wyatt Thompson, Yaming Lin

Inference Collaborators

Jiayu Bai, Kevin King, Stanley Hsieh, Weiyi Zheng

Data & Evaluation

Alexandra Barr, Aparna Dutta, Arshi Bhatnagar, Chao Yu, Charlotte Cole, Dragos Oprica, Emma Tang, Gowrishankar Sunder, Henry Baer, Ian Sohl, James Park Lennon, Jason Xu, Peilin Yang, Somay Jain, Szi-chieh Yu, Wesam Manassra, Xiaolei Zhu, Yilei Qian

Applied

Affonso Reis, Alan Gou, Alexandra Vodopianova, Amandeep Grewal, Andi Liu, Andrew Sima, Angus Fletcher, Antonia Woodford, Arun Eswara, Benny Wong, Bharat Rangan, Boyang Niu, Bridget Collins, Bryan Brandow, Callie Riggins Zetino, Chris Wendel, Ethan Chang, Gilman Tolle, Greg Hochmuth, Ibrahim Okuyucu, Jesse Chand, Jesse Hendrickson, Jiayu Bai, Jimmy Lin, Johan Cervantes, Kan Wu, Liam Esparraguera, Maja Wichrowska, Matthew Ferrari, Murat Yesildal, Nikunj Handa, Nithanth Kudige, Ola Okelola, Osman Khwaja, Peter Argany, Peter Bakkum, Peter Vidani, Richard Zadorozny, Rohan Sahai, Savelii Bondini, Sean Chang, Vickie Duong, Victoria Huang, Xiaolin Hao, Xueqing Li

Safety, Safety Systems, Integrity, Policy & Trust

Abby Fanlo Susk, Adam Wells, Aleah Houze, Annie Cheng, Artyi Xu, Carolina Paz, David Abelman, Femi Alamu, Jay Wang, Jeremiah Currier, Jesika Haria, Mariya Guryeva, Max Burkhardt, Paige Walker, Pedro Aguilar, Rutsu Koshimizu, Sam Toizer, Savannah Heon, Tom Rubin, Tonia Osadebe, Willow Primack, Zoe Stoll

Product Operations, Program Management and Governance

Antonio Di Francesco, Filippo Raso, Grace Wu, Josh Metherd, Ruth Costigan

Legal

Ally Bennett, Tony Song, Tyce Walters

Communications, Marketing, Community, Design & Creative

Akash Iyer, Alex Baker-Whitcomb, Angie Luo, Anne Oburgh, Antonia Richmond, Annie Tsang, Ashley Tyra, Bailey Richardson, Brandon McGraw, Cary Hudson, Dana Palmie, Evan Corrigan, Gaby Raila, Indgila Samad Ali, James Anderson, Jeremy Schwartz, Jordan Liss, Juan Garza, Julie Steele, Kara Zichittella, Karn Piluntanadilok, Kendal Peirce, Kim Baschet, Leah Anise, Livvy Pierce, Maria Clara M. Fleury Osorio, Minnia Feng, Nick Ciffone, Nick Forland, Niko Felix, Paige Ford, Rachel Puckett, Rishabh Aggarwal, Rusty Rupprecht, Souki Mansoor, Tasia Potasinski, Taya Christianson, Vasundhara Mudgil, Whitney Ferris, Yara Khakbaz, Zach Brock, Zoë Silverman

Special Thanks

Amy Yang, Arvin Wu, Avital Oliver, Brandon McKinzie, Chak Li, Chris Lu, David Duxin, Dian Ang Yap, Gabriel Petersson, Guillaume Leclerc, Hazel Byrne, Henry Aspegren, Jennifer Luckenbill, Ji Lin, Joseph Mo, Julius Hochmuth, Liunian (Harold) Li, Long Ouyang, Mariano López, Michael Zhang, Ravi Teja Mullapudi, Suvansh Sanjeev, Varun Shetty, Wenda Zhou

Exec

Fidji Simo, Hannah Wong, Jakub Pachocki, Jason Kwon, Johannes Heidecke, Kate Rouch, Lauren Itow, Mark Chen, Mia Glaese, Nick Ryder, Nick Turley, Prafulla Dhariwal, Sam Altman, Sulman Choudhry