स्किप करके मेन कंटेंट पर जाऍं
OpenAI
लोड किया जा रहा है...

आज हम अपनी नई प्रमुख इमेज जेनरेशन मॉडल द्वारा संचालित ChatGPT इमेजेस का नया संस्करण जारी कर रहे हैं. अब, चाहे आप कुछ बिल्कुल शुरू से बना रहे हों या किसी फोटो को एडिट कर रहे हों, आपको वही आउटपुट मिलेगा जिसकी आप कल्पना कर रहे हैं. यह लोगों की अपीयरेंस जैसी डिटेल्स को बरकरार रखते हुए प्रिसाइज़ एडिट्स करता है, और इमेजेस को चार गुना तक तेज़ी से जनरेट करता है. इसके साथ ही, हम ChatGPT के भीतर एक नया इमेजेस फीचर पेश कर रहे हैं, जिसे इमेज जनरेशन को मज़ेदार बनाने, इंस्पिरेशन जगाने और क्रिएटिव एक्सप्लोरेशन को आसान बनाने के लिए डिज़ाइन किया गया है.

नया इमेजेस मॉडल और फीचर आज ChatGPT में सभी यूज़र्स के लिए रोलआउट हो रहा है, और API में gpt-इमेज-1.5 के रूप में उपलब्ध है.

जो ज़रूरी है उसे बरकरार रखते हुए प्रिसाइज़ एडिट्स

अब जब आप किसी अपलोड की गई इमेज में एडिट्स के लिए कहते हैं, तो मॉडल आपकी मंशा को ज़्यादा भरोसेमंद तरीके से फॉलो करता है—छोटी से छोटी डिटेल तक—सिर्फ वही बदलता है जो आप कहते हैं, और लाइटिंग, कंपोज़िशन और लोगों की अपीयरेंस जैसे एलिमेंट्स को इनपुट्स, आउटपुट्स और बाद के एडिट्स में कंसिस्टेंट रखता है.

इससे ऐसे नतीजे मिलते हैं जो आपकी मंशा से मेल खाते हैं—ज़्यादा उपयोगी फोटो एडिट्स, कपड़ों और हेयरस्टाइल के ज़्यादा भरोसेमंद ट्राय-ऑन्स, साथ ही स्टाइलिस्टिक फिल्टर्स और कॉन्सेप्चुअल ट्रांसफ़ॉर्मेशन्स जो ओरिजिनल इमेज का सार बनाए रखते हैं. मिलकर, ये सुधार ChatGPT को आपकी जेब में मौजूद एक क्रिएटिव स्टूडियो की तरह काम करने में सक्षम बनाते हैं, जो प्रैक्टिकल एडिट्स के साथ-साथ एक्सप्रेसिव री-इमैजिनिंग्स भी कर सकता है.

एडिटिंग

मॉडल अलग-अलग तरह की एडिटिंग में बेहतरीन है—जैसे ऐड करना, सब्ट्रैक्ट करना, कंबाइन करना, ब्लेंड करना और ट्रांसपोज़ करना—ताकि आपको मनचाहे बदलाव मिलें, बिना उस खासियत को खोए जो इमेज को खास बनाती है.

क्रिएटिव ट्रांसफ़ॉर्मेशन्स

मॉडल की क्रिएटिविटी उन ट्रांसफ़ॉर्मेशन्स में साफ़ दिखती है जो टेक्स्ट और लेआउट जैसे एलिमेंट्स को बदलते और जोड़ते हैं, ताकि आइडियाज़ को ज़िंदगी मिल सके, साथ ही ज़रूरी डिटेल्स भी बनी रहें. ये ट्रांसफ़ॉर्मेशन्स साधारण और ज़्यादा जटिल, दोनों तरह के कॉन्सेप्ट्स पर काम करते हैं, और नए ChatGPT इमेजेस(एक नई विंडो में खुलेगा) फीचर में मौजूद प्रीसेट स्टाइल्स और आइडियाज़ का इस्तेमाल करके इन्हें आसानी से आज़माया जा सकता है—लिखित प्रॉम्प्ट की ज़रूरत नहीं है.

निर्देशों का पालन करना

मॉडल हमारी शुरुआती वर्ज़न की तुलना में इंस्ट्रक्शन्स को ज़्यादा भरोसेमंद तरीके से फॉलो करता है. इससे ज़्यादा प्रिसाइज़ एडिट्स के साथ-साथ और भी जटिल ओरिजिनल कंपोज़िशन्स संभव होते हैं, जहाँ एलिमेंट्स के बीच के रिलेशन्स को इंटेंडेड तरीके से बरकरार रखा जाता है.

नया

draw a 6x6 grid

Make a 6 (columns) by 6 (rows) grid grid of:

Row 1: the Greek letter beta, a beach ball, a lemon, a robot, a fish tank, a frog

Row 2: a praying mantis, an expensive watch, a baththub, a pair of sunglasses, a colorful butterfly, an envelope

Row 3: a stamp, a picture frame, a steaming dumpling, the word "miracle", a pair of skis, the letter Z

Row 4: a toilet, a subway token, a mute icon, a bottle of perfume, a dragonfly, a skateboard helmet

Row 5: a Bluetooth icon, the number 13, a green heart, a rubik's cube, a Canada goose, a soldier's helmet

Row 6: a white dog, a life jacket, a knot, a keyboard, a tissue box, the number 14

chatgpt-images-instruction-following-new

पिछला

draw a 6x6 grid

Make a 6 (columns) by 6 (rows) grid grid of:

Row 1: the Greek letter beta, a beach ball, a lemon, a robot, a fish tank, a frog

Row 2: a praying mantis, an expensive watch, a baththub, a pair of sunglasses, a colorful butterfly, an envelope

Row 3: a stamp, a picture frame, a steaming dumpling, the word "miracle", a pair of skis, the letter Z

Row 4: a toilet, a subway token, a mute icon, a bottle of perfume, a dragonfly, a skateboard helmet

Row 5: a Bluetooth icon, the number 13, a green heart, a rubik's cube, a Canada goose, a soldier's helmet

Row 6: a white dog, a life jacket, a knot, a keyboard, a tissue box, the number 14

chatgpt-images-instruction-following-old

टेक्स्ट रेंडरिंग

मॉडल टेक्स्ट रेंडरिंग में एक और कदम आगे बढ़ाता है, और अब ज़्यादा घना और छोटे साइज़ का टेक्स्ट भी संभाल सकता है.

अतिरिक्त क्वालिटी इम्प्रूवमेंट्स

मॉडल कुछ अतिरिक्त डाइमेंशन्स पर भी बेहतर हुआ है, जिससे आउटपुट्स ज़्यादा तुरंत उपयोगी बनते हैं—जैसे कई छोटे चेहरों की रेंडरिंग और आउटपुट्स का कितना नैचुरल दिखना.

एक नया क्रिएशन स्पेस

मैसेज में यह बताते हुए कि आप क्या देखना चाहते हैं इमेजेस जनरेट करने के अलावा, हम ChatGPT में इमेजेस(एक नई विंडो में खुलेगा) के लिए एक डेडिकेटेड होम भी पेश कर रहे हैं—जो मोबाइल ऐप के ज़रिए साइडबार में और chatgpt.com पर उपलब्ध होगा—ताकि. इमेजेस को एक्सप्लोर करना और आज़माना और भी तेज़ व आसान बनाता है. इसमें दर्जनों प्रीसेट फिल्टर्स और प्रॉम्प्ट्स शामिल हैं, जो इंस्पिरेशन को तुरंत शुरू करने में मदद करते हैं, और उभरते ट्रेंड्स को दिखाने के लिए इन्हें नियमित रूप से अपडेट किया जाता है.

मिलकर, ये अपग्रेड्स आपको छोटी एडिट्स से लेकर पूरी री-इमैजिनिंग्स तक, आपकी विज़न से बेहतर मेल खाने वाली इमेजेस बनाने में मदद करते हैं.

काम के लिए ChatGPT इमेजेस

यह मॉडल तेज़ इमेज जनरेशन, प्रिसाइज़ एडिट्स और हर इटरेशन में कंसिस्टेंट विज़ुअल डिटेल्स के ज़रिए बिज़नेस वर्कफ़्लोज़ को सरल बनाता है. टीम्स आइडियाज़ को एक्सप्लोर कर सकती हैं, टार्गेटेड बदलाव कर सकती हैं, और जटिल या ड्राय कॉन्सेप्ट्स को विज़ुअलाइज़ कर सकती हैं, जिससे मार्केटिंग, डिज़ाइन, ई-कॉमर्स और इंटरनल कम्युनिकेशन्स जैसे यूज़ केसेज़ को सपोर्ट मिलता है.

सुधार और लिमिटेशन्स

परफ़ॉर्मेंस का आकलन करने के लिए हमने अपनी शुरुआती इमेज जनरेशन लॉन्च के कई उदाहरणों को दोबारा चलाया. मॉडल कई तरह के मामलों में साफ़ सुधार दिखाता है, हालांकि नतीजे अभी भी पूरी तरह परफ़ेक्ट नहीं हैं. हालाँकि यह रिलीज़ अहम प्रगति को दर्शाती है, लेकिन आने वाली इटरेशन्स में सुधार की अभी भी काफ़ी गुंजाइश है.

API में GPT इमेज 1.5.

API में gpt-image-1.5, ChatGPT इमेजेस जैसे ही सभी सुधार देता है: यह GPT इमेज 1 की तुलना में इमेज प्रिज़र्वेशन और एडिटिंग में ज़्यादा मज़बूत है.

एडिट्स के दौरान ब्रांडेड लोगो और की विज़ुअल्स को ज़्यादा कंसिस्टेंट तरीके से बरकरार रखा जाता है—जिससे यह ग्राफ़िक्स और लोगो क्रिएशन जैसे मार्केटिंग और ब्रांड वर्क के लिए, और ईकॉमर्स टीम्स के लिए भी बेहतरीन बनता है जो एक ही सोर्स इमेज से पूरा प्रॉडक्ट इमेज कैटलॉग (वेरिएंट्स, सीन्स और एंगल्स) जनरेट करती हैं.

अब GPT इमेज 1 की तुलना में GPT इमेज 1.5 में इमेज इनपुट्स और आउटपुट्स 20% सस्ते हैं, जिससे आप उसी बजट में ज़्यादा इमेजेस जनरेट कर सकते हैं और उन पर इटरेट कर सकते हैं.

आप नए मॉडल को
OpenAI Playground(एक नई विंडो में खुलेगा) में आज़मा सकते हैं, या इंस्पिरेशन के लिए प्रॉम्प्ट गाइड(एक नई विंडो में खुलेगा) पढ़ सकते हैं.

क्रिएटिव टूल्स, ई-कॉमर्स, मार्केटिंग सॉफ़्टवेयर और अन्य इंडस्ट्रीज़ में एंटरप्राइज़ेज़ और स्टार्टअप्स पहले से ही GPT इमेज 1.5 का इस्तेमाल कर रहे हैं. हम नीचे इनमें से कुछ उदाहरण साझा करने को लेकर उत्साहित हैं.

उपलब्‍धता

नया ChatGPT इमेजेस आज सभी प्लेटफ़ॉर्म्स पर दुनिया भर के सभी ChatGPT यूज़र्स और API यूज़र्स के लिए रोलआउट हो रहा है. यह सभी मॉडल्स में काम करता है, इसलिए इसे इस्तेमाल करने के लिए आपको कुछ भी सेलेक्ट करने की ज़रूरत नहीं है.

हमें लगता है कि इमेज जनरेशन क्या-क्या संभव बना सकता है, इसकी हम अभी बस शुरुआत में ही हैं. आज का अपडेट एक अहम कदम आगे है, और आगे भी बहुत कुछ आने वाला है—ज़्यादा फाइन-ग्रेन्ड एडिट्स से लेकर अलग-अलग भाषाओं में और भी रिच, ज़्यादा डिटेल्ड आउटपुट्स तक.

लेखक

OpenAI

Contributors

Project Leadership

Gabriel Goh — Research Lead

Adele Li — Product Lead

Bill Peebles — Sora Lead 

Aditya Ramesh — World Simulation Lead

Mark Chen — Chief Research Officer

Prafulla Dhariwal — Multimodal Lead

Core Team 

Alex Fang, Alex Yu, Ben Wang, Bing Liang, Boyuan Chen, Charlie Nash, David Medina, Dibya Bhattacharjee, Jianfeng Wang, Kenji Hata, Kiwhan Song, Mengchao Zhong, Mike Starr, Yuguang Yang

Research Contributors

Bram Wallace, Dmytro Okhonko, Haitang Hu, Kshitij Gupta, Li Jing, Lu Liu, Peter Zhokhov, Qiming Yuan, Senthil Purushwalkam, Yizhen Zhang

Core Inference

Adam Tart, Alyssa Huang, Andrew Braunstein, Jane Park, Karen Li, Tomer Kaftan

Research Collaborators

Aditya Ramesh, Alex Nichol, Andrew Kondrich, Andrew Liu, Benedikt Winter, Bill Peebles, Connor Holmes, Cyril Zhang, Daniel Geng, Eric Mintun, James Betker, Jamie Kiros, Manuka Stratta, Martin Li, Raoul de Liedekerke, Ricky Wang, Ruslan Vasilev, Vladimir Chalyshev, Welton Wang, Wyatt Thompson, Yaming Lin

Inference Collaborators

Jiayu Bai, Kevin King, Stanley Hsieh, Weiyi Zheng

Data & Evaluation

Alexandra Barr, Aparna Dutta, Arshi Bhatnagar, Chao Yu, Charlotte Cole, Dragos Oprica, Emma Tang, Gowrishankar Sunder, Henry Baer, Ian Sohl, James Park Lennon, Jason Xu, Peilin Yang, Somay Jain, Szi-chieh Yu, Wesam Manassra, Xiaolei Zhu, Yilei Qian

Applied

Affonso Reis, Alan Gou, Alexandra Vodopianova, Amandeep Grewal, Andi Liu, Andrew Sima, Angus Fletcher, Antonia Woodford, Arun Eswara, Benny Wong, Bharat Rangan, Boyang Niu, Bridget Collins, Bryan Brandow, Callie Riggins Zetino, Chris Wendel, Ethan Chang, Gilman Tolle, Greg Hochmuth, Ibrahim Okuyucu, Jesse Chand, Jesse Hendrickson, Jiayu Bai, Jimmy Lin, Johan Cervantes, Kan Wu, Liam Esparraguera, Maja Wichrowska, Matthew Ferrari, Murat Yesildal, Nikunj Handa, Nithanth Kudige, Ola Okelola, Osman Khwaja, Peter Argany, Peter Bakkum, Peter Vidani, Richard Zadorozny, Rohan Sahai, Savelii Bondini, Sean Chang, Vickie Duong, Victoria Huang, Xiaolin Hao, Xueqing Li

Safety, Safety Systems, Integrity, Policy & Trust

Abby Fanlo Susk, Adam Wells, Aleah Houze, Annie Cheng, Artyi Xu, Carolina Paz, David Abelman, Femi Alamu, Jay Wang, Jeremiah Currier, Jesika Haria, Mariya Guryeva, Max Burkhardt, Paige Walker, Pedro Aguilar, Rutsu Koshimizu, Sam Toizer, Savannah Heon, Tom Rubin, Tonia Osadebe, Willow Primack, Zoe Stoll

Product Operations, Program Management and Governance

Antonio Di Francesco, Filippo Raso, Grace Wu, Josh Metherd, Ruth Costigan

Legal

Ally Bennett, Tony Song, Tyce Walters

Communications, Marketing, Community, Design & Creative

Akash Iyer, Alex Baker-Whitcomb, Angie Luo, Anne Oburgh, Antonia Richmond, Annie Tsang, Ashley Tyra, Bailey Richardson, Brandon McGraw, Cary Hudson, Dana Palmie, Evan Corrigan, Gaby Raila, Indgila Samad Ali, James Anderson, Jeremy Schwartz, Jordan Liss, Juan Garza, Julie Steele, Kara Zichittella, Karn Piluntanadilok, Kendal Peirce, Kim Baschet, Leah Anise, Livvy Pierce, Maria Clara M. Fleury Osorio, Minnia Feng, Nick Ciffone, Nick Forland, Niko Felix, Paige Ford, Rachel Puckett, Rishabh Aggarwal, Rusty Rupprecht, Souki Mansoor, Tasia Potasinski, Taya Christianson, Vasundhara Mudgil, Whitney Ferris, Yara Khakbaz, Zach Brock, Zoë Silverman

Special Thanks

Amy Yang, Arvin Wu, Avital Oliver, Brandon McKinzie, Chak Li, Chris Lu, David Duxin, Dian Ang Yap, Gabriel Petersson, Guillaume Leclerc, Hazel Byrne, Henry Aspegren, Jennifer Luckenbill, Ji Lin, Joseph Mo, Julius Hochmuth, Liunian (Harold) Li, Long Ouyang, Mariano López, Michael Zhang, Ravi Teja Mullapudi, Suvansh Sanjeev, Varun Shetty, Wenda Zhou

Exec

Fidji Simo, Hannah Wong, Jakub Pachocki, Jason Kwon, Johannes Heidecke, Kate Rouch, Lauren Itow, Mark Chen, Mia Glaese, Nick Ryder, Nick Turley, Prafulla Dhariwal, Sam Altman, Sulman Choudhry