We’re launching GPT‑Live, a new generation of voice models that make talking with AI feel much more like having a real conversation.
GPT‑Live is built on a full-duplex architecture, meaning it can listen and speak at the same time. During conversations, GPT‑Live can show it’s paying attention with phrases like “mhmm” or “yeah”, engage in quick back-and-forth, or just stay quiet when you need a moment to think. The result is a voice experience that is refreshingly easy to talk to.
GPT‑Live is also our smartest voice model yet. For questions that require web search, deeper reasoning, or more complex work, it delegates to our latest frontier model behind the scenes and brings the result back into the conversation when it’s ready. While it works, GPT‑Live can keep talking with you and maintain the flow of conversation. At launch, GPT‑Live will use GPT‑5.5 in the background. As we release new frontier models, we’ll continuously update the model used by GPT‑Live.
These advances power a new ChatGPT Voice experience that is more intelligent and natural to use. Over time, we believe this research will also unlock the ability to use voice for increasingly complex, longer-running, and more agentic work.
We’re beginning to roll out two versions of GPT‑Live – GPT‑Live‑1 and GPT‑Live‑1 mini – to ChatGPT users globally today. We also plan to bring them to the API soon, and developers and enterprises can sign up to be notified using this form.
Entering a new era of human-AI interaction
Our vision is to enable truly natural human–AI interaction: a world where collaborating with AI feels as fluid and responsive as working with another person, while reasoning and complex task execution happen seamlessly in the background.
Previous approaches
Older generations of voice AI systems brought us closer to that vision, but with important tradeoffs.
Cascaded voice systems
Cascaded voice systems rely on a series of models acting one after another to process each turn. The original ChatGPT Voice chained three models together: a speech-to-text model to transcribe your speech, a large language model to produce a response, and a text-to-speech model to convert it back into speech. This approach enabled us to talk to frontier AI models for the first time, but the complexity came at a cost: information could be lost across models, and responses were slow and stilted.
Córas gutha a fhorleathadh
Freagraí malla agus mínádúrtha, sosanna fada
Turn-based voice models
Turn-based voice models like ChatGPT Advanced Voice Mode processed and generated audio within a single model, reducing latency and making conversations smoother — but they still operated through discrete turns. The model had to wait for the user to stop speaking before responding, resulting in rigid back-and-forth. In addition, because turn detection is based on silence, even a brief pause or background noise could be mistaken for the end of turn — causing the model to interrupt at unnatural times.
Samhail ghutha bunaithe ar shealanna
Freagraí beagán níos tapúla agus níos réidhe, ach mothaíonn an t-idirphlé leis an tsamhail fós docht
Our new approach
GPT‑Live addresses these limitations through two architectural changes.
Continuous interaction
First, we built GPT‑Live for continuous interaction using a full-duplex architecture. Instead of processing a sequence of separate messages, GPT‑Live continuously processes input while generating output. The model can therefore make interaction decisions many times per second: whether to speak, continue listening, pause, interrupt, or invoke a tool.
This allows the model to engage in more natural back-and-forth, maintain a better sense of time, and even perform live translation.
Idirghníomhú leanúnach
Freagraí tapa, nádúrtha, léiritheacha agus éisteacht níos gníomhaí
Delegation for deeper work
Second, we decoupled GPT‑Live — which handles continuous interaction — from deeper work. When a question requires search, reasoning, or more agentic capabilities, GPT‑Live can delegate the task to another model like GPT‑5.5. This allows it to keep the conversation going, even as it handles multiple tasks in the background.
This architectural change also allows GPT‑Live to continuously use the latest models and agents, combining frontier intelligence with natural interaction.
Tarmligean le haghaidh oibre níos doimhne
Soláthraíonn GPT-Live freagraí tapa nádúrtha, agus láimhseálann GPT-5.5 an cuardach sa chúlra
Evaluations
We built new human evaluations to measure pleasantness and the flow of conversation. In these head-to-head comparisons, GPT‑Live‑1 and GPT‑Live‑1 mini are strongly preferred over Advanced Voice Mode in matched 5–10 minute conversations that measure overall preference, turn-taking, interruptions, conversational flow, and how natural each interaction felt.
- GPQA: GPT‑Live‑1 substantially outperforms Advanced Voice Mode on GPQA, which tests expert-level scientific reasoning across biology, chemistry, and physics.
- BrowseComp: GPT‑Live‑1 shows strong gains over Advanced Voice Mode on BrowseComp, which tests agentic web search and the ability to find difficult-to-locate information.
- τ³-Voice Telecom (internal variant)**: GPT‑Live‑1 outperforms Advanced Voice Mode on τ³-Voice Telecom, which tests voice agents on realistic, multi-turn telecom support tasks.
* GPT‑Live‑1 (instant) and GPT‑Live‑1 mini use the GPT‑5.5 Instant model in the background, while GPT‑Live‑1 Medium and GPT‑Live‑1 High use the GPT‑5.5 Thinking model with medium and high reasoning effort.
** We used a customized user model, powered by our latest reasoning models, for this eval.
Eispéireas nua ChatGPT Voice
Gach seachtain, labhraíonn breis agus 150 milliún duine le ChatGPT trí ghnéithe amhail Voice agus Dictation. Úsáideann siad é chun cabhair laethúil gan lámha a fháil, teangacha a chleachtadh, scéalta am luí a insint, nó comhrá a dhéanamh ar an mbealach chun na hoibre.
Ón lá inniu ar aghaidh, nuair a chliceálfaidh tú an cnaipe Voice chun labhairt le ChatGPT, gheobhaidh tú eispéireas feabhsaithe faoi thiomáint GPT‑Live — comhráite níos nádúrtha, freagraí níos cliste, éisteacht níos fearr agus freagraí amhairc.
Comhráite níos nádúrtha
Ba chóir go mbraithfeadh labhairt le ChatGPT i bhfad níos cosúla anois le fíorchomhrá. Is féidir leat cur isteach le ceist, sos a ghlacadh chun smaoineamh, nó iarraidh ar ChatGPT labhairt níos moille. Admhaíonn sé go nádúrtha an méid atá á rá agat le frásaí amhail “mm-hmm” nó “tuigim”, ionas go mbeidh a fhios agat go bhfuil sé leat. Rinneamar na naoi nguth ar leith in ChatGPT a athmháistriú do GPT‑Live freisin.
Freagraí níos cliste
Is féidir le ChatGPT Voice leas a bhaint anois as na samhlacha ceannródaíocha is déanaí atá againn, chun freagraí níos cliste a thabhairt duit nuair is gá. Is féidir leat leibhéal na réasúnaíochta a oireann do do riachtanais a roghnú freisin: Instant le haghaidh freagraí tapa, nó Medium agus High nuair is mian leat go gcaithfidh ChatGPT níos mó ama ag smaoineamh.
Éisteacht níos fearr
Má ghlacann tú nóiméad le smaoineamh, fanann ChatGPT Voice anois in áit léim isteach agus cur isteach ort. Má iarrann tú air fanacht ciúin agus éisteacht, déanfaidh sé sin. Agus nuair a bhíonn torann cúlra ann, amhail trácht ag dul thar bráid nó comhráite in aice láimhe, is fearr a dhíríonn ChatGPT ar do ghuth gan a aird a bheith á tarraingt.
Freagraí amhairc sracfhéachana
Bíonn freagraí áirithe níos úsáideach nuair is féidir iad a fheiceáil. Agus tú ag caint, is féidir le ChatGPT cártaí amhairc shaibhre a thaispeáint anois ar ábhair amhail an aimsir, stoic, spórt agus eile. Leanann Voice de thacaíocht a thabhairt do chuardach, cuimhne, íomhánna agus uaslódálacha comhad freisin.



Is é an toradh ná eispéireas ChatGPT Voice a bhraitheann níos nádúrtha, níos cumasaí agus níos úsáidí sa saol laethúil.
Sábháilteacht deartha don ghuth
Dearadh GPT‑Live le bheith sábháilte mar réamhshocrú. Tógann sé ar na dul chun cinn sábháilteachta sna samhlacha is déanaí atá againn, agus cuireann sé oiliúint shábháilteachta thiomnaithe leis i bpríomhréimsí riosca agus cosaintí nua atá deartha go sonrach don ghuth.
Tástáil sábháilteachta leathnaithe
Chun léiriú níos fearr a thabhairt ar an gcaoi a n-úsáideann daoine guth i suíomhanna fíorshaoil, thosaíomar trí ár dtástáil sábháilteachta a leathnú chun meastóireachtaí nua dúchasacha don fhuaim a áireamh. Chruthaíomar meastóireachtaí sintéiseacha freisin a úsáideann fuaim ghinte chun díriú níos déine ar phríomhréimsí sábháilteachta, bunaithe ar a d’fhoghlaimíomar ó mód gutha shofaisticiúil. Áirítear ar na réimsí sin féindíobháil, síocóis agus mania, spleáchas mothúchánach ar IS, foréigean agus ábhar gnéasach. Rinne saineolaithe inmheánacha tástáil ionsaitheach ar an tsamhail freisin maidir le rioscaí atá uathúil don ghuth.
Inár dtástáil, d’fheidhmigh GPT‑Live ar chomhchéim le mód gutha shofaisticiúil, nó níos fearr ná é, i mbeagnach gach réimse a ndearnamar meastóireacht air. Is féidir leat tuilleadh a léamh faoinár dtástáil agus ár gcosaintí i gcárta córais(osclaíonn i bhfuinneog nua) GPT‑Live.
Cosaintí ionsuite
Ós rud é go dtarlaíonn comhráite gutha i bhfíor-am, thógamar cosaintí freisin ar féidir leo gníomhú agus an tsamhail ag labhairt. Nuair a bhraitheann an córas aschur a d’fhéadfadh a bheith neamhshábháilte, is féidir leis an tsamhail a threorú i dtreo freagra níos sábháilte, teachtaireachtaí nó acmhainní sábháilteachta breise a thaispeáint, nó deireadh a chur leis an gcomhrá gutha i gcásanna riosca níos airde. I gcás comhráite a bhaineann le féindíobháil, chuireamar sreafaí tacaíochta ChatGPT in oiriúint don ghuth, lena n-áirítear tacaíocht línte cabhrach géarchéime atá faofa ag saineolaithe a thairiscint.
Dhearamar cosaintí breise chun tacú le húsáideoirí sna déaga, agus chuireamar iompar a oireann dá n-aois isteach san oiliúint don tsamhail chun riosca freagraí míchuí a laghdú. Is féidir le tuismitheoirí roghnú an féidir lena ndéagóir ChatGPT Voice a úsáid trí rialuithe tuismitheoirí, agus féadfar fógra a thabhairt do thuismitheoirí nasctha i gcásanna riosca níos airde a bhaineann le comharthaí féindíobhála féideartha nó intinne féinmharaithe.
Ag foghlaim ó úsáid sa bhfíorshaol
Táimid ag cur tomhais níos fadtéarmaí agus monatóireachta iar-sheolta i bhfeidhm freisin, dírithe ar spleáchas mothúchánach, chun ár dtuiscint a fheabhsú agus cosaintí a bheachtú. Ag tógáil ar ár dtaighde roimhe seo ar úsáid mhothúchánach agus folláine mhothúchánach, cabhróidh sé seo linn patrúin atá ag teacht chun cinn a aithint agus feabhas a chur ar an gcaoi a bhfreagraíonn an córas in idirghníomhaíochtaí atá íogair ó thaobh mothúchán de.
Ar deireadh, tá GPT‑Live deartha don chomhrá, ní chun aithris ghutha a dhéanamh. Úsáideann sé tacar guthanna réamhshainithe in ChatGPT, le cosaintí chun é a chosc ó aithris a dhéanamh ar ghuth duine dáiríre.
Táimid tiomanta do shábháilteacht agus folláine a thacú, agus leanfaidh muid orainn ag neartú na gcosaintí seo de réir mar a fhoghlaimímid ó úsáid sa bhfíorshaol.
Infhaighteacht & teorainneacha
Tá GPT‑Live á rolladh amach anois d’úsáideoirí ChatGPT ar fud an domhain ar iOS, Android agus ChatGPT.com(osclaíonn i bhfuinneog nua). Beidh GPT‑Live‑1 ina shamhail réamhshocraithe a chumhachtaíonn ChatGPT Voice d’úsáideoirí Go, Plus agus Pro, agus beidh GPT‑Live‑1 mini mar réamhshocrú d’úsáideoirí Free. Tá tuilleadh sonraí infhaighteachta ar fáil inár Lárionad Cabhrach(osclaíonn i bhfuinneog nua).
Tá GPT‑Live optamaithe againn do chuid de na teangacha is mó éilimh in ChatGPT. I gcás teangacha áirithe, d’fhéadfadh blas neamh-dhúchais nó bearnaí i líofacht a bheith ag an tsamhail. Táimid ag obair go gníomhach chun an t-eispéireas a fheabhsú trasna teangacha.
Ag an seoladh, ní thacóidh GPT‑Live le guth le físeán ná le comhroinnt scáileáin in ChatGPT, ach táimid ag obair chun na cumais seo a thabhairt isteach go luath. Is féidir leat rochtain a fháil fós ar leaganacha oidhreachta de ChatGPT Voice, lena n-áirítear Standard agus mód gutha shofaisticiúil, áit a bhfuil na gnéithe seo ar fáil.


