OpenAI

8 հուլիսի, 2026 թ.

ԱրտադրանքԹողարկում

Ներկայացնում ենք GPT‑Live‑ը

Ձայնային մոդելների նոր սերունդ՝ բնական մարդ-AI փոխազդեցության համար, որն այժմ սնուցում է ChatGPT Voice-ը։

Բեռնվում է…

2026 թ. հուլիսի 31-ի թարմացում․ ChatGPT Voice-ի և OpenAI API-ի միջոցով GPT‑Live‑ով ստեղծված աջակցվող աուդիոն այժմ պարունակում է SynthID ջրանշում։ Հանրային ստուգման մեր գործիքը այժմ կարող է հայտնաբերել OpenAI-ի ծագման ազդանշանները աջակցվող աուդիո ֆայլերում, և մենք ներկայացրել ենք ստուգման API հասանելիություն, որպեսզի ծրագրավորողները և կազմակերպությունները կարողանան ծագման ստուգումներ ներառել իրենց սեփական աշխատանքային հոսքերում։ Այս թարմացումները հիմնվում են ստորև նկարագրված անվտանգության մոտեցման և OpenAI-ի կողմից ստեղծված բովանդակությունն ավելի հեշտ նույնականացնելու մեր ավելի լայն աշխատանքի վրա։

Մենք թողարկում ենք GPT‑Live‑ը՝ ձայնային մոդելների նոր սերունդ, որի շնորհիվ AI-ի հետ խոսելը շատ ավելի նման է իրական զրույցի։

GPT‑Live‑ը կառուցված է լրիվ դուպլեքս ճարտարապետության վրա, ինչը նշանակում է, որ այն կարող է միաժամանակ լսել և խոսել։ Զրույցների ընթացքում GPT‑Live‑ը կարող է ցույց տալ, որ ուշադիր լսում է՝ «ըհը» կամ «հա» նման արտահայտություններով, արագ երկխոսության մեջ մտնել կամ պարզապես լուռ մնալ, երբ ձեզ մտածելու պահ է պետք։ Արդյունքում ստացվում է ձայնային փորձառություն, որի հետ խոսելը զարմանալիորեն հեշտ է։

GPT‑Live‑ը նաև մեր ամենախելացի ձայնային մոդելն է մինչ այժմ։ Այն հարցերի համար, որոնք պահանջում են վեբ որոնում, ավելի խոր հիմնավորում կամ ավելի բարդ աշխատանք, այն հետին պլանում պատվիրակում է աշխատանքը մեր վերջին առաջադեմ մոդելին և արդյունքը վերադարձնում է զրույց, երբ այն պատրաստ է։ Մինչ այն աշխատում է, GPT‑Live‑ը կարող է շարունակել խոսել ձեզ հետ և պահպանել զրույցի ընթացքը։ Թողարկման պահին GPT‑Live‑ը հետին պլանում կօգտագործի GPT‑5.5‑ը։ Նոր առաջադեմ մոդելներ թողարկելուն զուգահեռ՝ մենք շարունակաբար կթարմացնենք GPT‑Live‑ի օգտագործած մոդելը։

Այս առաջընթացներն ապահովում են ChatGPT Voice-ի նոր փորձառություն, որն ավելի խելացի և բնական է օգտագործման մեջ։ Ժամանակի ընթացքում կարծում ենք, որ այս հետազոտությունը նաև կբացի ձայնն ավելի ու ավելի բարդ, երկարատև և ավելի ագենտային աշխատանքի համար օգտագործելու հնարավորությունը։

Այսօրվանից սկսում ենք GPT‑Live‑ի երկու տարբերակների՝ GPT‑Live‑1-ի և GPT‑Live‑1 mini-ի գլոբալ թողարկումը ChatGPT‑ի օգտատերերի համար։ Նախատեսում ենք նաև շուտով դրանք բերել API, իսկ մշակողներն ու ձեռնարկությունները կարող են գրանցվել ծանուցում ստանալու համար՝ օգտագործելով այս ձևը։

Մարդ-AI փոխազդեցության նոր դարաշրջան

Մեր տեսլականն է հնարավոր դարձնել իսկապես բնական մարդ–AI փոխազդեցություն՝ մի աշխարհ, որտեղ AI-ի հետ համագործակցելը նույնքան սահուն և արձագանքող է, որքան մեկ այլ մարդու հետ աշխատելը, իսկ հիմնավորումը և բարդ առաջադրանքների կատարումը աննկատ տեղի են ունենում հետին պլանում։

Նախորդ մոտեցումներ

Ձայնային AI համակարգերի հին սերունդները մեզ մոտեցրին այդ տեսլականին, բայց կարևոր փոխզիջումներով։

Կասկադային ձայնային համակարգեր

Կասկադային ձայնային համակարգերը յուրաքանչյուր հերթափոխ մշակելու համար ապավինում են միմյանց հաջորդող մի շարք մոդելների։ Սկզբնական ChatGPT Voice-ը իրար էր կապում երեք մոդել՝ խոսքը տեքստի վերածող մոդել՝ ձեր խոսքը տառադարձելու համար, մեծ լեզվական մոդել՝ պատասխան ստեղծելու համար, և տեքստը խոսքի վերածող մոդել՝ այն կրկին խոսքի փոխակերպելու համար։ Այս մոտեցումը մեզ առաջին անգամ թույլ տվեց խոսել առաջադեմ AI մոդելների հետ, բայց բարդությունը գին ուներ՝ տեղեկատվությունը կարող էր կորչել մոդելների միջև, իսկ պատասխանները դանդաղ և կտրուկ էին։

Կասկադային ձայնային համակարգ

Դանդաղ և անբնական պատասխաններ, երկար դադարներ

Տառադարձություն
Ստանդարտ ձայնի ռեժիմով զրույցի օրինակ՝ GPT-5.5 Ակնթարթայինի կիրառմամբ

Հերթափոխով աշխատող ձայնային մոդելներ

Հերթափոխով աշխատող ձայնային մոդելները, օրինակ՝ ChatGPT‑ի ընդլայնված ձայնային ռեժիմը, աուդիոն մշակում և գեներացնում էին մեկ մոդելի ներսում՝ նվազեցնելով ուշացումը և զրույցները դարձնելով ավելի սահուն, բայց դրանք դեռ գործում էին առանձին հերթափոխերի միջոցով։ Մոդելը պետք է սպասեր, մինչև օգտատերը դադարեր խոսել, հետո միայն պատասխաներ, ինչի հետևանքով երկխոսությունը կոշտ էր ստացվում։ Բացի այդ, քանի որ հերթափոխի հայտնաբերումը հիմնված է լռության վրա, նույնիսկ կարճ դադարը կամ ֆոնային աղմուկը կարող էին սխալմամբ ընկալվել որպես հերթափոխի ավարտ, ինչի պատճառով մոդելը կարող էր ընդհատել ոչ բնական պահերին։

Ձայնային մոդել, որը աշխատում է հերթերով

Պատասխանները փոքր-ինչ ավելի արագ և սահուն են, բայց մոդելի հետ փոխադարձ շփումը դեռևս անբնական է թվում

Տառադարձություն
Զրույցի օրինակ՝ ChatGPT-ի ընդլայնված ձայնային ռեժիմով

Մեր նոր մոտեցումը

GPT‑Live-ը լուծում է այս սահմանափակումները երկու ճարտարապետական փոփոխության միջոցով։

Շարունակական փոխազդեցություն

Նախ, մենք GPT‑Live‑ը կառուցել ենք շարունակական փոխազդեցության համար՝ օգտագործելով լրիվ դուպլեքս ճարտարապետություն։ Առանձին հաղորդագրությունների հաջորդականություն մշակելու փոխարեն GPT‑Live‑ը շարունակաբար մշակում է մուտքագրվող տվյալները՝ ելքը գեներացնելու ընթացքում։ Ուստի մոդելը կարող է վայրկյանում բազմաթիվ անգամներ փոխազդեցության որոշումներ կայացնել՝ խոսե՞լ, շարունակե՞լ լսել, դադա՞ր տալ, ընդհատե՞լ, թե՞ գործիք կանչել։

Սա թույլ է տալիս մոդելին ավելի բնական երկխոսություն վարել, ժամանակի ավելի լավ զգացում պահպանել և նույնիսկ կենդանի թարգմանություն կատարել։

Շարունակական փոխգործակցություն

Արագ, բնական, արտահայտիչ պատասխաններ և ավելի ակտիվ ունկնդրում

Տառադարձություն
GPT-Live-1-ի հետ զրույցի օրինակ՝ GPT-5.5 Ակնթարթայինի կիրառմամբ

Պատվիրակում՝ ավելի խոր աշխատանքի համար

Երկրորդ, մենք GPT‑Live‑ը, որը կառավարում է շարունակական փոխազդեցությունը, առանձնացրել ենք ավելի խոր աշխատանքից։ Երբ հարցը պահանջում է որոնում, հիմնավորում կամ ավելի ագենտային հնարավորություններ, GPT‑Live‑ը կարող է առաջադրանքը պատվիրակել մեկ այլ մոդելի, օրինակ՝ GPT‑5.5‑ին։ Սա թույլ է տալիս շարունակել զրույցը, նույնիսկ երբ հետին պլանում մի քանի առաջադրանք է կատարում։

Այս ճարտարապետական փոփոխությունը նաև թույլ է տալիս GPT‑Live‑ին շարունակաբար օգտագործել վերջին մոդելներն ու ագենտները՝ համադրելով առաջադեմ բանականությունը բնական փոխազդեցության հետ։

Ավելի բարդ աշխատանքի պատվիրակում

GPT-Live-ը տրամադրում է արագ, բնական պատասխաններ, մինչ GPT-5.5-ը ֆոնային ռեժիմում կատարում է որոնումը

Տառադարձություն
GPT-Live-1-ի հետ զրույցի օրինակ՝ GPT-5.5 Ակնթարթայինի կիրառմամբ

Գնահատումներ

Մենք ստեղծել ենք նոր մարդկային գնահատումներ՝ հաճելիությունն ու զրույցի ընթացքը չափելու համար։ Այս դեմ առ դեմ համեմատություններում GPT‑Live‑1‑ը և GPT‑Live‑1 mini-ն հստակ նախընտրելի են ընդլայնված ձայնային ռեժիմից՝ համապատասխանեցված 5–10 րոպեանոց զրույցներում, որոնք չափում են ընդհանուր նախընտրությունը, խոսափուլերի հերթափոխը, ընդհատումները, զրույցի ընթացքը և յուրաքանչյուր փոխազդեցության բնականությունը։

  • GPQA. GPT‑Live‑1‑ը զգալիորեն գերազանցում է ընդլայնված ձայնային ռեժիմին GPQA-ում, որը ստուգում է փորձագիտական մակարդակի գիտական հիմնավորումը կենսաբանության, քիմիայի և ֆիզիկայի ոլորտներում։
  • BrowseComp. GPT‑Live‑1‑ը BrowseComp-ում մեծ առաջընթաց է ցույց տալիս ընդլայնված ձայնային ռեժիմի համեմատ. այս թեստը ստուգում է ագենտային վեբ որոնումը և դժվար գտնելի տեղեկատվություն գտնելու կարողությունը։
  • τ³-Voice Telecom (ներքին տարբերակ)**․ GPT‑Live‑1‑ը գերազանցում է ընդլայնված ձայնային ռեժիմին τ³-Voice Telecom-ում, որը ձայնային ագենտներին ստուգում է իրատեսական, բազմահերթ հեռահաղորդակցության աջակցության առաջադրանքներում։

* GPT‑Live‑1‑ը (ակնթարթային) և GPT‑Live‑1 mini-ն հետին պլանում օգտագործում են GPT‑5.5 Instant մոդելը, իսկ GPT‑Live‑1 Medium-ը և GPT‑Live‑1 High-ը՝ GPT‑5.5 Thinking մոդելը՝ միջին և բարձր հիմնավորման ջանքով։

** Այս գնահատման համար մենք օգտագործել ենք օգտատիրոջ հարմարեցված մոդել, որը հիմնված է մեր ամենավերջին հիմնավորման մոդելների վրա։

ChatGPT Voice-ի նոր փորձառություն

Ամեն շաբաթ ավելի քան 150 միլիոն մարդ խոսում է ChatGPT‑ի հետ՝ օգտագործելով Voice-ի և Dictation-ի նման գործառույթներ։ Նրանք օգտվում են դրանից՝ առօրյա օգնություն ստանալու առանց ձեռքերն օգտագործելու, լեզուներ վարժելու, քնից առաջ հեքիաթներ պատմելու կամ պարզապես ճանապարհին զրուցելու համար։

Այսօրվանից, երբ սեղմեք Voice կոճակը՝ ChatGPT‑ի հետ խոսելու համար, կստանաք GPT‑Live‑ով աշխատող բարելավված փորձառություն՝ ավելի բնական զրույցներով, ավելի խելացի պատասխաններով, ավելի լավ լսելով և տեսողական պատասխաններով։

Ավելի բնական զրույցներ

ChatGPT‑ի հետ խոսելը հիմա պետք է շատ ավելի նման լինի իրական զրույցի։ Կարող եք ընդհատել հարցով, դադար առնել մտքերը հավաքելու համար կամ խնդրել ChatGPT‑ին ավելի դանդաղ խոսել։ Այն բնականորեն արձագանքում է ձեր ասածին՝ «մհմ» կամ «հասկացա» արտահայտություններով, որպեսզի իմանաք, որ հետևում է խոսքին։ Մենք նաև վերամշակել ենք ChatGPT‑ի ինը տարբերակվող ձայները GPT‑Live‑ի համար։

Ավելի խելացի պատասխաններ

ChatGPT Voice-ն այժմ կարող է օգտվել մեր ամենավերջին առաջադեմ մոդելներից՝ անհրաժեշտ պահին տալով ավելի խելացի պատասխաններ։ Կարող եք նաև ընտրել ձեր կարիքներին համապատասխան դատողության մակարդակը՝ Instant՝ արագ պատասխանների համար, կամ Medium և High, երբ ուզում եք, որ ChatGPT‑ն ավելի երկար մտածի։

Ավելի լավ լսում

Եթե մի պահ մտածելու համար դադար առնեք, ChatGPT Voice-ն այժմ սպասում է՝ փոխանակ խոսքը կտրելու և ընդհատելու։ Եթե խնդրեք, որ լռի և լսի, այդպես էլ կանի։ Իսկ երբ ֆոնային աղմուկ կա, օրինակ՝ անցնող մեքենաներ կամ մոտակայքում խոսակցություններ, ChatGPT‑ն ավելի լավ է կենտրոնանում ձեր ձայնի վրա՝ շեղվելու փոխարեն։

Տեսողական պատասխաններ՝ մի հայացքով

Որոշ պատասխաններ ավելի օգտակար են, երբ կարող եք դրանք տեսնել։ Մինչ դուք խոսում եք, ChatGPT‑ն այժմ կարող է ցուցադրել հարուստ տեսողական քարտեր այնպիսի թեմաների համար, ինչպիսիք են եղանակը, բաժնետոմսերը, սպորտը և այլն։ Voice-ը նաև շարունակում է աջակցել որոնմանը, հիշողությանը, պատկերներին և ֆայլերի վերբեռնումներին։

Արդյունքում ChatGPT Voice-ի փորձառությունը առօրյայում ավելի բնական, ավելի կարողունակ և ավելի օգտակար է թվում։

Անվտանգություն՝ ստեղծված ձայնի համար

GPT‑Live‑ը նախագծվել է այնպես, որ լռելյայն անվտանգ լինի։ Այն հիմնվում է մեր վերջին մոդելների անվտանգության առաջընթացի վրա՝ միաժամանակ ավելացնելով հատուկ անվտանգության ուսուցում հիմնական ռիսկային ոլորտներում և նոր պաշտպանական մեխանիզմներ՝ ստեղծված հենց ձայնի համար։

Անվտանգության ընդլայնված փորձարկում

Որպեսզի ավելի լավ արտացոլենք, թե ինչպես են մարդիկ ձայնն օգտագործում իրական պայմաններում, մենք սկսեցինք ընդլայնել մեր անվտանգության փորձարկումները՝ ներառելով նոր, աուդիոյին բնորոշ գնահատումներ։ Մենք նաև ստեղծել ենք սինթետիկ գնահատումներ, որոնք օգտագործում են գեներացված աուդիո՝ անվտանգության հիմնական ոլորտների վրա ավելի խորությամբ կենտրոնանալու համար՝ հիմնվելով ընդլայնված ձայնային ռեժիմից ստացած մեր փորձի վրա։ Այդ ոլորտներն են ինքնավնասումը, փսիխոզն ու մանիան, հուզական կախվածությունը AI-ից, բռնությունը և սեռական բովանդակությունը։ Ներքին փորձագետները նաև ռեդ-թիմինգի են ենթարկել մոդելը՝ ձայնին հատուկ ռիսկերի համար։

Մեր փորձարկումներում GPT‑Live‑ը գրեթե բոլոր գնահատված ոլորտներում ցուցաբերեց ընդլայնված ձայնային ռեժիմին համադրելի կամ դրանից ավելի լավ արդյունք։ Մեր փորձարկումների և պաշտպանական մեխանիզմների մասին ավելին կարող եք կարդալ GPT‑Live‑ի համակարգի քարտում(բացվում է նոր պատուհանում)։

Ներկառուցված պաշտպանական մեխանիզմներ

Քանի որ ձայնային զրույցներն ընթանում են իրական ժամանակում, մենք նաև ստեղծել ենք պաշտպանական մեխանիզմներ, որոնք կարող են գործել, մինչ մոդելը խոսում է։ Երբ համակարգը հայտնաբերում է պոտենցիալ վտանգավոր ելք, այն կարող է մոդելին ուղղորդել դեպի ավելի անվտանգ պատասխան, ցուցադրել լրացուցիչ անվտանգության հաղորդագրություններ կամ ռեսուրսներ, իսկ ավելի բարձր ռիսկի դեպքերում՝ ավարտել ձայնային զրույցը։ Ինքնավնասման հետ կապված զրույցների համար մենք ChatGPT‑ի աջակցության հոսքերը հարմարեցրել ենք ձայնին՝ ներառյալ փորձագետների կողմից ստուգված ճգնաժամային թեժ գծերի աջակցության առաջարկը։

Մենք նախագծել ենք լրացուցիչ պաշտպանություններ՝ դեռահաս օգտատերերին աջակցելու համար, և տարիքին համապատասխան վարքագիծը ուղղակիորեն ուսուցանել ենք մոդելին՝ ոչ պատշաճ պատասխանների ռիսկը նվազեցնելու համար։ Ծնողները ծնողական վերահսկողության միջոցով կարող են ընտրել՝ արդյոք իրենց դեռահասը կարող է օգտագործել ChatGPT Voice-ը, իսկ կապված ծնողները կարող են ծանուցվել ավելի բարձր ռիսկի իրավիճակներում, երբ նկատվում են հնարավոր ինքնավնասման կամ ինքնասպանության մտադրության նշաններ։

Սովորել իրական օգտագործումից

Մենք նաև գործարկում ենք երկարաժամկետ չափումներ և հետթողարկումային մոնիթորինգ՝ կենտրոնացած հուզական կախվածության վրա, որպեսզի շարունակենք խորացնել մեր ըմբռնումը և կատարելագործել պաշտպանական մեխանիզմները։ Հիմնվելով աֆեկտիվ օգտագործման և հուզական բարեկեցության վերաբերյալ մեր նախորդ հետազոտության վրա՝ սա կօգնի մեզ բացահայտել ձևավորվող օրինաչափությունները և բարելավել, թե ինչպես է համակարգը արձագանքում հուզականորեն զգայուն փոխազդեցություններում։

Վերջապես, GPT‑Live‑ը ստեղծված է զրույցի, ոչ թե ձայնի նմանակման համար։ Այն օգտագործում է ChatGPT‑ում նախապես սահմանված ձայների հավաքածու՝ պաշտպանական մեխանիզմներով, որոնք թույլ չեն տալիս նմանակել իրական մարդու ձայնը։

Մենք հանձնառու ենք աջակցելու անվտանգությանը և բարեկեցությանը և կշարունակենք ամրապնդել այս պաշտպանությունները՝ իրական օգտագործումից սովորելուն զուգահեռ։

Հասանելիություն և սահմանափակումներ

GPT‑Live‑ն այժմ հասանելի է դառնում ChatGPT‑ի օգտատերերին ամբողջ աշխարհում՝ iOS-ում, Android-ում և ChatGPT.com(բացվում է նոր պատուհանում)-ում։ GPT‑Live‑1‑ը կդառնա ChatGPT Voice-ը սնուցող լռելյայն մոդելը Go, Plus և Pro օգտատերերի համար, իսկ GPT‑Live‑1 mini-ն՝ Free օգտատերերի համար։ Հասանելիության մասին ավելի մանրամասն տեղեկություններ կարող եք գտնել մեր Օգնության կենտրոնում(բացվում է նոր պատուհանում)։

Մենք GPT‑Live‑ը օպտիմալացրել ենք ChatGPT‑ում ամենատարածված լեզուներից մի քանիսի համար։ Որոշ լեզուների դեպքում մոդելը կարող է ունենալ ոչ մայրենի արտասանություն կամ սահունության բացեր։ Մենք ակտիվորեն աշխատում ենք լեզուների միջև փորձառությունը բարելավելու ուղղությամբ։

Թողարկման պահին GPT‑Live‑ը ChatGPT‑ում չի աջակցի ձայնը տեսանյութի կամ էկրանի համօգտագործման հետ, բայց մենք աշխատում ենք շուտով ներկայացնել այս հնարավորությունները։ Դուք դեռ կարող եք օգտվել ChatGPT Voice-ի հին տարբերակներից, այդ թվում՝ Standard-ից և ընդլայնված ձայնային ռեժիմից, որտեղ այս գործառույթները հասանելի են։

Հեղինակ

OpenAI