ਮੁੱਖ ਸਮੱਗਰੀ 'ਤੇ ਜਾਓ
OpenAI

10 ਸਤੰਬਰ 2026

ਉਤਪਾਦਰਿਲੀਜ਼

API ਵਿੱਚ GPT‑Live‑1 ਨਾਲ ਹੋਰ ਵੀ ਜ਼ਿਆਦਾ ਕੁਦਰਤੀ ਵੌਇਸ ਅਨੁਭਵ ਬਣਾਓ

GPT‑Live‑1 API ਵਿੱਚ ChatGPT ਦੀਆਂ ਕੁਦਰਤੀ, ਫੁੱਲ-ਡੁਪਲੈਕਸ ਗੱਲਬਾਤਾਂ ਲਿਆਉਂਦਾ ਹੈ, ਜਿਸ ਵਿੱਚ ਇਸ ਗੱਲ 'ਤੇ ਵਧੇਰੇ ਨਿਯੰਤਰਣ ਹੁੰਦਾ ਹੈ ਕਿ ਵੌਇਸ ਏਜੰਟ ਕਿਵੇਂ ਬੋਲਦੇ ਹਨ ਅਤੇ ਕਾਰਵਾਈ ਕਰਦੇ ਹਨ।

ਲੋਡ ਹੋ ਰਿਹਾ ਹੈ…

ਅਸੀਂ API ਵਿੱਚ GPT‑Live‑1 ਲਾਂਚ ਕਰ ਰਹੇ ਹਾਂ, ਜੋ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਵੌਇਸ-ਸਮਰਥਿਤ ਐਪਸ ਅਤੇ ਵਪਾਰਕ ਵਰਕਫਲੋ ਬਣਾਉਣ ਲਈ ਇੱਕ ਸ਼ਕਤੀਸ਼ਾਲੀ, ਕੁਦਰਤੀ ਵੌਇਸ ਮਾਡਲ ਪ੍ਰਦਾਨ ਕਰ ਰਿਹਾ ਹੈ। ਸਭ ਤੋਂ ਪਹਿਲਾਂ ChatGPT ਵਿੱਚ ਪੇਸ਼ ਕੀਤਾ ਗਿਆ, GPT‑Live‑1 ਇੱਕੋ ਸਮੇਂ ਸੁਣਨ ਅਤੇ ਬੋਲਣ ਦੇ ਸਮਰੱਥ ਹੈ ਅਤੇ, ਜਿਵੇਂ ਕਿ Codex ਅਤੇ ChatGPT ਵਰਕ ਵਿੱਚ ਦੇਖਿਆ ਗਿਆ ਹੈ⁠(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ), ਇਹ ਇਸ ਨਾਲ ਜੁੜੇ ਮਾਡਲਾਂ ਅਤੇ ਟੂਲਾਂ ਨੂੰ ਡੂੰਘੀ ਰੀਜ਼ਨਿੰਗ ਅਤੇ ਕਾਰਵਾਈਆਂ ਸੌਂਪ ਸਕਦਾ ਹੈ।

GPT‑Live‑1 ਦੀ API ਰਿਲੀਜ਼ ਲਈ, ਅਸੀਂ ਨਵੀਆਂ ਸਮਰੱਥਾਵਾਂ 'ਤੇ ਧਿਆਨ ਕੇਂਦਰਿਤ ਕੀਤਾ ਹੈ ਜੋ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਆਪਣੇ ਵਰਤੋਂਕਾਰਾਂ, ਵਰਕਫਲੋ, ਅਤੇ ਟੀਚਿਆਂ ਦੇ ਅਨੁਸਾਰ ਵੌਇਸ ਅਨੁਭਵਾਂ ਨੂੰ ਨਿਰਦੇਸ਼ਿਤ ਅਤੇ ਕਸਟਮਾਈਜ਼ ਕਰਨ ਦਿੰਦੀਆਂ ਹਨ। GPT‑Live‑1 ਦੀ ਇੱਕ ਮੁੱਖ ਤਾਕਤ, ਭਾਵ ਗੱਲ ਵਿੱਚ ਆਉਣ ਵਾਲੀ ਰੁਕਾਵਟ ਨੂੰ ਸੁਚਾਰੂ ਢੰਗ ਨਾਲ ਸੰਭਾਲਣਾ, ਪਹਿਲਾਂ ਹੀ ਵਪਾਰਕ ਪ੍ਰਭਾਵ ਦਿਖਾ ਰਿਹਾ ਹੈ: ਸ਼ੁਰੂਆਤੀ ਮੁਲਾਂਕਣਾਂ ਵਿੱਚ, Speak ਨੇ ਪਾਇਆ ਕਿ ਭਾਸ਼ਾ ਸਿਖਾਉਣ ਵਾਲੇ ਟਿਊਟਰ ਦੇ ਜਵਾਬ ਦੇਣ ਤੋਂ ਪਹਿਲਾਂ GPT‑Live‑1 ਨੇ ਸਿੱਖਣ ਵਾਲਿਆਂ ਨੂੰ ਸੋਚਣ ਲਈ ਵਧੇਰੇ ਸਮਾਂ ਦਿੱਤਾ, ਜਿਸ ਨਾਲ ਪਿਛਲੇ ਵਾਰੀ-ਅਧਾਰਿਤ ਸਿਸਟਮਾਂ ਦੇ ਮੁਕਾਬਲੇ ਰੁਕਾਵਟਾਂ ਵਿੱਚ ਲਗਭਗ 80% ਦੀ ਕਮੀ ਆਈ।

API ਵਿੱਚ GPT‑Live‑1 ਦੀਆਂ ਮੁੱਖ ਵਿਸ਼ੇਸ਼ਤਾਵਾਂ:

  • ਰੁਕਾਵਟ ਨੂੰ ਸੰਭਾਲਣਾ: ਇਹ ਇੱਕ ਸਿੰਗਲ ਮਾਡਲ ਰਾਹੀਂ ਰੁਕਾਵਟ ਪ੍ਰਬੰਧਨ ਵਿੱਚ ਸੁਧਾਰ ਕਰਦਾ ਹੈ ਜੋ ਆਉਣ ਵਾਲੀ ਅਤੇ ਜਾਣ ਵਾਲੀ ਆਡੀਓ ਦੋਵਾਂ 'ਤੇ ਇੱਕੋ ਸਮੇਂ ਰੀਜ਼ਨਿੰਗ ਲਾਗੂ ਕਰਦਾ ਹੈ, ਜਿਸ ਨਾਲ ਚੇਨਡ STT–LLM–TTS ਆਰਕੀਟੈਕਚਰਜ਼ ਵਿੱਚ ਆਉਣ ਵਾਲੀ ਦੇਰੀ ਅਤੇ ਕਮਜ਼ੋਰ ਹੈਂਡਆਫਸ ਤੋਂ ਬਚਿਆ ਜਾ ਸਕਦਾ ਹੈ।

  • ਰੀਜ਼ਨਿੰਗ ਅਤੇ ਟੂਲ ਕਾਲਿੰਗ ਡੈਲੀਗੇਸ਼ਨ: GPT‑Live‑1 ਰੀਜ਼ਨਿੰਗ ਅਤੇ ਟੂਲ ਕਾਲਾਂ ਨੂੰ GPT‑6 Astra ਜਾਂ ਕਿਸੇ ਥਰਡ-ਪਾਰਟੀ ਮਾਡਲ ਵਰਗੇ ਬੈਕਐਂਡ ਟੈਕਸਟ ਮਾਡਲ ਨੂੰ ਸੌਂਪ ਸਕਦਾ ਹੈ।

  • ਲਹਿਜ਼ਾ, ਰਫ਼ਤਾਰ ਅਤੇ ਸ਼ੈਲੀ: ਇਹ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਸਿਸਟਮ ਪ੍ਰੌੰਪਟ ਰਾਹੀਂ ਕਿਸੇ ਏਜੰਟ ਦੇ ਲਹਿਜੇ, ਰਫ਼ਤਾਰ ਅਤੇ ਗੱਲਬਾਤ ਕਰਨ ਦੇ ਅੰਦਾਜ਼ ਨੂੰ ਢਾਲਣ ਦਿੰਦਾ ਹੈ।

  • ਗੁਪਤ ਸੰਦਰਭ ਪ੍ਰਬੰਧਨ ਅਤੇ ਪਿਛੋਕੜ ਦਾ ਸ਼ੋਰ: ਗੱਲਬਾਤ ਵਿੱਚ ਵਿਘਨ ਪਾਏ ਬਿਨਾਂ ਜਾਂ ਹਰ ਪੜਾਅ ਨੂੰ ਉੱਚੀ ਆਵਾਜ਼ ਵਿੱਚ ਬਿਆਨ ਕੀਤੇ ਬਿਨਾਂ ਪਿਛੋਕੜ ਦੇ ਸ਼ੋਰ ਅਤੇ ਚੁੱਪ ਨੂੰ ਬਿਹਤਰ ਢੰਗ ਨਾਲ ਸੰਭਾਲਦਾ ਹੈ।

  • ਲੰਬੇ ਸੈਸ਼ਨਾਂ ਵਿੱਚ ਭਰੋਸੇਯੋਗਤਾ: ਲੰਬੀਆਂ ਗੱਲਬਾਤਾਂ ਦੌਰਾਨ ਸੰਦਰਭ ਯਾਦ ਰੱਖਣ ਅਤੇ ਗੱਲਬਾਤ ਦੀ ਗੁਣਵੱਤਾ ਨੂੰ ਬਿਹਤਰ ਬਣਾਉਂਦਾ ਹੈ।

  • ਟੈਲੀਫ਼ੋਨੀ ਸਮਰਥਨ: ਰੈਸਟੋਰੈਂਟ ਰਿਜ਼ਰਵੇਸ਼ਨਾਂ ਤੋਂ ਲੈ ਕੇ ਗਾਹਕ ਸਹਾਇਤਾ ਤੱਕ, ਫ਼ੋਨ ਕਾਲਾਂ ਲਈ ਫੁੱਲ-ਡੁਪਲੈਕਸ ਵੌਇਸ ਏਜੰਟ ਤੈਨਾਤ ਕਰਨ ਦੀ ਸਹੂਲਤ ਦਿੰਦਾ ਹੈ।

Try GPT-Live-1

Start a session and speak naturally. Interrupt, laugh, change your mind - try it at home or in a loud space like a coffee shop or city street.
See what it can do
  • Talk over it—naturally. Ask for help, then interrupt mid-response to change the question or add detail.
  • Take it with you. Try a conversation while walking outside or with everyday background noise, and see how it stays with you.
  • Make it playful. Laugh, hesitate, use short acknowledgments, or briefly talk to someone nearby—then continue the conversation.

ਇਹ ਡੈਮੋ ਸਮਾਂ-ਸੀਮਤ ਹੈ। ਇਸਦੀ ਵਰਤੋਂ ਕਰਕੇ, ਤੁਸੀਂ OpenAI ਦੀਆਂ ਸ਼ਰਤਾਂ ਨਾਲ ਸਹਿਮਤ ਹੁੰਦੇ ਹੋ ਅਤੇ ਸਾਡੀ ਪ੍ਰਾਈਵੇਸੀ ਪਾਲਿਸੀ ਨੂੰ ਸਵੀਕਾਰ ਕਰਦੇ ਹੋ।

ਆਪਣੇ ਵੌਇਸ-ਏਜੰਟ ਆਰਕੀਟੈਕਚਰ ਨੂੰ ਸਰਲ ਬਣਾਓ ਅਤੇ ਵੌਇਸ ਲੇਟੈਂਸੀ ਨੂੰ ਘਟਾਓ

ਰਵਾਇਤੀ ਵੌਇਸ ਏਜੰਟ ਆਵਾਜ਼-ਤੋਂ-ਲਿਖਤ, ਇੱਕ ਰੀਜ਼ਨਿੰਗ ਮਾਡਲ ਅਤੇ ਲਿਖਤ-ਤੋਂ-ਆਵਾਜ਼ ਨੂੰ ਆਪਸ ਵਿੱਚ ਜੋੜ ਕੇ ਕੰਮ ਕਰਦੇ ਹਨ। ਹਰ ਇੱਕ ਤਬਦੀਲੀ ਦੇਰੀ ਨੂੰ ਵਧਾਉਂਦੀ ਹੈ ਅਤੇ ਸਮੇਂ ਦੇ ਤਾਲਮੇਲ, ਪ੍ਰਸੰਗ ਜਾਂ ਗੱਲਬਾਤ ਦੀ ਕੁਦਰਤੀ ਲੈਅ ਨੂੰ ਗੁਆਉਣ ਦੇ ਜੋਖਮ ਨੂੰ ਪੈਦਾ ਕਰਦੀ ਹੈ। ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਅਕਸਰ ਹੀ ਇਨ੍ਹਾਂ ਸਾਰੇ ਪੜਾਵਾਂ ਦਾ ਤਾਲਮੇਲ ਬਿਠਾਉਣਾ ਪੈਂਦਾ ਹੈ, ਜਿਸ ਵਿੱਚ ਇਹ ਸੰਭਾਲਣਾ ਵੀ ਸ਼ਾਮਲ ਹੈ ਕਿ ਜਦੋਂ ਕੋਈ ਵਿਅਕਤੀ ਵਿਚਕਾਰ ਟੋਕਦਾ ਹੈ, ਰੁਕਦਾ ਹੈ, ਜਾਂ ਗੱਲ ਦਾ ਰੁਖ਼ ਬਦਲਦਾ ਹੈ, ਤਾਂ ਉਦੋਂ ਕੀ ਵਾਪਰਦਾ ਹੈ।

GPT‑Live‑1 ਇੱਕੋ ਮਾਡਲ ਵਿੱਚ ਸੁਣਨ ਅਤੇ ਬੋਲਣ ਨੂੰ ਸੰਭਾਲਦਾ ਹੈ, ਜਿਸ ਨਾਲ ਵੌਇਸ ਲੇਅਰ ਸਰਲ ਹੋ ਜਾਂਦੀ ਹੈ। ਇਹ ਗੱਲਬਾਤ ਵਿੱਚ ਆਉਣ ਵਾਲੀਆਂ ਰੁਕਾਵਟਾਂ ਅਤੇ ਹੁੰਗਾਰਿਆਂ ਦਾ ਉਸੇ ਵੇਲੇ ਜਵਾਬ ਦੇ ਸਕਦਾ ਹੈ, ਜਦੋਂ ਡੂੰਘੀ ਰੀਜ਼ਨਿੰਗ ਨੂੰ ਬੈਕਐਂਡ ਵੱਲ ਸੌਂਪ ਦਿੰਦਾ ਹੈ। ਇਸ ਨਾਲ ਪਿਛੋਕੜ ਵਿੱਚ ਕੰਮ ਜਾਰੀ ਰਹਿਣ ਦੇ ਬਾਵਜੂਦ ਗੱਲਬਾਤ ਲਗਾਤਾਰ ਜਾਰੀ ਰਹਿੰਦੀ ਹੈ।

“ਸਾਡੇ ਕੈਸਕੇਡਿਡ ਬਿਲਡ ਦੇ ਮੁਕਾਬਲੇ GPT‑Live‑1 ਨੇ ਸਾਡੇ ਕੋਡ ਬੇਸ ਨੂੰ 80% ਸਰਲ ਬਣਾ ਦਿੱਤਾ ਹੈ ਅਤੇ ਕੋਡ ਦੀਆਂ 23K ਲਾਈਨਾਂ ਨੂੰ ਹਟਾ ਦਿੱਤਾ ਹੈ। ਇਸ ਨਾਲ ਮਰੀਜ਼ਾਂ ਨਾਲ ਕੁਦਰਤੀ, ਰੀਅਲ-ਟਾਈਮ ਗੱਲਬਾਤ ਸੰਭਵ ਹੋਈ ਅਤੇ ਸਾਡੀ ਟੀਮ ਨੂੰ ਮੁਲਾਕਾਤ ਬੁੱਕ ਕਰਨ ਤੋਂ ਲੈ ਕੇ ਦੇਖਭਾਲ ਪ੍ਰਾਪਤ ਕਰਨ ਤੱਕ ਦੇ ਅਨੁਭਵ ਨੂੰ ਬਿਹਤਰ ਬਣਾਉਣ ਲਈ ਸਮਾਂ ਮਿਲਿਆ।”
—ਟੋਨੀ ਸਟੋਯਾਨੋਵ, ਸਹਿ-ਸੰਸਥਾਪਕ ਅਤੇ CTO

ਡਿਵੈਲਪਰ ਗੱਲਬਾਤ ਦੇ ਪਿੱਛੇ ਕੰਮ ਕਰਨ ਵਾਲੇ ਮਾਡਲ, ਟੂਲ ਅਤੇ ਏਜੰਟ ਜਾਂਚ-ਢਾਂਚੇ ਚੁਣਦੇ ਹਨ। ਉਦਾਹਰਨ ਵਜੋਂ, ਉਹ ਸਮਾਂ-ਸਾਰਣੀ ਬਣਾਉਣ ਜਾਂ ਆਰਡਰ ਅੱਪਡੇਟ ਵਰਗੇ ਹਾਈ-ਮਾਤਰਾ ਵਾਲੇ ਕੰਮਾਂ ਲਈ GPT‑Live‑1 ਨੂੰ Luna ਵਰਗੇ ਮਾਡਲ ਨਾਲ ਜੋੜ ਸਕਦੇ ਹਨ ਅਤੇ ਰੀਜ਼ਨਿੰਗ ਦੀ ਲੋੜ ਵਾਲੇ ਗੁੰਝਲਦਾਰ ਗਾਹਕ ਮਸਲਿਆਂ ਲਈ Astra ਵਰਗਾ ਮਾਡਲ ਵਰਤ ਸਕਦੇ ਹਨ। ਇਹ ਲਚਕਤਾ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਹਰ ਕੰਮ ਮੁਤਾਬਕ ਰੀਜ਼ਨਿੰਗ ਦੀ ਡੂੰਘਾਈ, ਰਫ਼ਤਾਰ ਅਤੇ ਲਾਗਤ ਵਿੱਚ ਸੰਤੁਲਨ ਬਣਾਉਣ ਦੀ ਇਜਾਜ਼ਤ ਦਿੰਦੀ ਹੈ।

GPT‑Live‑1 ਮੂਲ ਰੂਪ ਵਿੱਚ ASR ਲਿਖਤੀ ਰੂਪ ਅਤੇ ਜਵਾਬੀ ਲਿਖਤ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਇਹ ਅੱਖਰਾਂ ਅਤੇ ਅੰਕਾਂ ਦੇ ਸੁਮੇਲ ਨੂੰ ਚੰਗੀ ਤਰ੍ਹਾਂ ਸਮਝਦਾ ਹੈ ਅਤੇ ਮੁੱਖ ਸ਼ਬਦਾਂ ਨੂੰ ਤਰਜੀਹ ਦੇਣ ਦਾ ਸਮਰਥਨ ਵੀ ਕਰਦਾ ਹੈ। ਭਾਵੇਂ GPT‑Live ਵਾਰੀ-ਅਧਾਰਿਤ ਮਾਡਲ ਨਹੀਂ ਹੈ, ਪਰ ਇਹ ਮੂਲ ਰੂਪ ਵਿੱਚ ਵਾਰੀ ਪਛਾਣਨ ਦਾ ਸਮਰਥਨ ਕਰਦਾ ਹੈ, ਜਿਸ ਨਾਲ ਡਿਵੈਲਪਰ ਸਪੱਸ਼ਟ ਵਾਰੀ ਦੀਆਂ ਸੀਮਾਵਾਂ ਦੇ ਆਧਾਰ 'ਤੇ ਆਪਣਾ ਕੰਮ ਜਾਰੀ ਰੱਖ ਸਕਦੇ ਹਨ।

ਫੁੱਲ-ਡੁਪਲੈਕਸ ਦੇ ਲਾਭ ਦਾ ਮਾਪ

ਸਾਡੇ ਮੁਲਾਂਕਣਾਂ ਵਿੱਚ, GPT‑Live‑1, GPT‑Realtime‑2.1 ਦੇ ਮੁਕਾਬਲੇ ਫੁੱਲ ਡੁਪਲੈਕਸ ਬੈਂਚ ਦੀ ਕਾਰਗੁਜ਼ਾਰੀ ਵਿੱਚ 30 ਪ੍ਰਤੀਸ਼ਤ ਅੰਕਾਂ ਦਾ ਸੁਧਾਰ ਕਰਦਾ ਹੈ, ਜਿਸ ਵਿੱਚ ਗੱਲਬਾਤ ਦੇ ਤਾਲਮੇਲ ਵਿੱਚ ਦੇਰੀ ਅਤੇ ਇੰਟਰਐਕਟਿਵ ਵਿਵਹਾਰ ਵਿੱਚ ਵੱਡੇ ਪੱਧਰ 'ਤੇ ਲਾਭ ਮਿਲਦਾ ਹੈ। ਮੀਡੀਅਮ ਰੀਜ਼ਨਿੰਗ ਉਪਰਾਲੇ ਦੇ ਨਾਲ GPT‑6 Astra ਨਾਲ ਜੋੜੇ ਜਾਣ 'ਤੇ, ਇਹ Tau3 'ਤੇ ਵੀ #1 ਰੈਂਕ ਪ੍ਰਾਪਤ ਕਰਦਾ ਹੈ, ਜੋ ਐਂਡ-ਟੂ-ਐਂਡ ਕੰਮਾਂ 'ਤੇ ਅਤਿ-ਆਧੁਨਿਕ ਵੌਇਸ-ਏਜੰਟ ਇੰਟੈਲੀਜੈਂਸ ਨੂੰ ਮਾਪਦਾ ਹੈ।

ਏਅਰਲਾਈਨ, ਰਿਟੇਲ, ਅਤੇ ਟੈਲੀਕਾਮ ਖੇਤਰਾਂ ਵਿੱਚ ਬੋਲ ਕੇ ਕੀਤੇ ਗਏ ਗਾਹਕ-ਸੇਵਾ ਕੰਮਾਂ ਦਾ ਮੁਲਾਂਕਣ ਕਰਦਾ ਹੈ। Pass@1 ਕੰਮ ਦੀ ਸਫਲਤਾ ਨੂੰ ਮਾਪਦਾ ਹੈ; ਹੈੱਡਲਾਈਨ ਹਰੇਕ ਖੇਤਰ ਨੂੰ ਬਰਾਬਰ ਮਹੱਤਵ ਦਿੰਦੀ ਹੈ।


* GPT Live ਬੈਕਐਂਡ: Astra (ਮੀਡੀਅਮ)।

ਗਿਆਨ ਪ੍ਰਾਪਤੀ ਅਤੇ ਖਾਤਾ ਟੂਲਾਂ ਨਾਲ ਬੋਲੀ ਜਾਣ ਵਾਲੀ ਬੈਂਕਿੰਗ ਸਹਾਇਤਾ ਦਾ ਮੁਲਾਂਕਣ ਕਰਦਾ ਹੈ। Pass@1, 97 banking_knowledge ਕਾਰਜਾਂ ਵਿੱਚੋਂ ਸਫਲਤਾਪੂਰਵਕ ਪੂਰੇ ਕੀਤੇ ਗਏ ਕਾਰਜਾਂ ਦਾ ਹਿੱਸਾ ਹੈ।


* GPT Live ਬੈਕਐਂਡ: Astra (ਮੀਡੀਅਮ)।

ਰੁਕਣ ਦੇ ਪ੍ਰਬੰਧਨ, ਗੱਲਬਾਤ ਦੇ ਤਾਲਮੇਲ, ਰੁਕਾਵਟਾਂ ਅਤੇ ਬੈਕਚੈਨਲਸ ਦਾ ਮੁਲਾਂਕਣ ਕਰਦਾ ਹੈ।

ਬੈਕਗ੍ਰਾਊਂਡ ਸਪੀਚ, ਕਿਸੇ ਹੋਰ ਵਿਅਕਤੀ ਨਾਲ ਗੱਲਬਾਤ, ਸੁਣਨ ਵਾਲੇ ਦੇ ਬੈਕਚੈਨਲ ਸੰਕੇਤਾਂ ਅਤੇ ਰੁਕਾਵਟਾਂ ਪ੍ਰਤੀ ਪ੍ਰਤੀਕਿਰਿਆਵਾਂ ਦੀ ਜਾਂਚ ਕਰਦਾ ਹੈ।

ਇਹ ਮਾਪਦਾ ਹੈ ਕਿ ਵਰਤੋਂਕਾਰ ਦੁਆਰਾ ਆਪਣੀ ਗੱਲ ਪੂਰੀ ਕਰਨ ਤੋਂ ਬਾਅਦ ਏਜੰਟ ਕਿੰਨੀ ਜਲਦੀ ਆਪਣਾ ਜਵਾਬ ਸ਼ੁਰੂ ਕਰਦਾ ਹੈ।

ਬੋਲ ਕੇ ਕੀਤੀਆਂ ਗਈਆਂ ਬੇਨਤੀਆਂ ਤੋਂ ਟੂਲ ਦੀ ਵਰਤੋਂ ਦੀ ਜਾਂਚ ਕਰਦਾ ਹੈ, ਜਿਨ੍ਹਾਂ ਵਿੱਚ ਕੁਦਰਤੀ ਠਹਿਰਾਅ (pauses), ਝਿਜਕ, ਅਤੇ ਸਵੈ-ਸੁਧਾਰ ਸ਼ਾਮਲ ਹੁੰਦੇ ਹਨ। Pass@1 ਟੂਲ-ਕਾਲ ਸੀਕੁਐਂਸ ਦਾ ਸਕੋਰ ਦਿੰਦਾ ਹੈ।


* GPT Live ਬੈਕਐਂਡ: Terra (ਘੱਟ)।

ਠਹਿਰਾਅ, ਝਿਜਕ ਅਤੇ ਸਵੈ-ਸੁਧਾਰਾਂ ਵਾਲੀਆਂ ਟੂਲ-ਵਰਤਣ ਵਾਲੀਆਂ ਬੇਨਤੀਆਂ ਦੇ ਬੋਲੇ ਗਏ ਜਵਾਬ ਦਾ ਮੁਲਾਂਕਣ ਕਰਦਾ ਹੈ। ਇਹ ਗੱਲ ਦਾ ਸਕੋਰ ਦਿੰਦਾ ਹੈ ਕਿ ਜਵਾਬ ਸੰਦਰਭ ਦੇ ਇਰਾਦੇ ਨਾਲ ਕਿੰਨੀ ਚੰਗੀ ਤਰ੍ਹਾਂ ਮੇਲ ਖਾਂਦਾ ਹੈ।


* GPT Live ਬੈਕਐਂਡ: Terra (ਘੱਟ)।

ਗਾਹਕ ਕੀ ਕਹਿ ਰਹੇ ਹਨ

4 ਵਿੱਚੋਂ 1
“Yelp Host ਅਤੇ Hatch ਵਿੱਚ GPT‑Live‑1 ਨੂੰ ਸ਼ਾਮਲ ਕਰਨ ਨਾਲ ਸਾਡੇ ਰਵਾਇਤੀ ਵੌਇਸ ਢਾਂਚੇ ਦੇ ਮੁਕਾਬਲੇ ਗੱਲ ਕਰਨ ਦੀ ਵਾਰੀ ਅਤੇ ਸਟੀਕਤਾ ਵਿੱਚ ਸੁਧਾਰ ਹੋਇਆ ਹੈ। ਜਦੋਂ Yelp Host ਰਿਜ਼ਰਵੇਸ਼ਨ ਅਤੇ ਖਾਣੇ ਦੇ ਆਰਡਰ ਵਰਗੀਆਂ ਕਾਲਾਂ ਦਾ ਜਵਾਬ ਦੇਣ ਲਈ GPT‑Live ਵਰਤਦਾ ਹੈ, ਤਾਂ ਕਾਲ ਸੰਭਾਲਣ ਦੀ ਦਰ ਵਿੱਚ ਮਹੱਤਵਪੂਰਨ ਸੁਧਾਰ ਦਿਖਾਈ ਦਿੰਦਾ ਹੈ। ਕਾਲ ਕਰਨ ਵਾਲੇ ਹੁਣ ਵਧੇਰੇ ਪੂਰੇ ਅਤੇ ਕੁਦਰਤੀ ਵਾਕ ਵੀ ਬੋਲਦੇ ਹਨ, ਜਿਸ ਤੋਂ ਪਤਾ ਲੱਗਦਾ ਹੈ ਕਿ ਫ਼ੋਨ ਦੇ ਦੂਜੇ ਪਾਸੇ ਦਾ ਅਨੁਭਵ ਸੱਚਮੁੱਚ ਵੱਖਰਾ ਮਹਿਸੂਸ ਹੁੰਦਾ ਹੈ।”
—ਐਲੈਕਸ ਲੇਵੀ, ਮੁੱਖ ਤਕਨਾਲੋਜੀ ਅਧਿਕਾਰੀ

ਨਵੇਂ ਵੌਇਸ ਵਿਕਲਪ

ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਅਜਿਹੀਆਂ ਆਵਾਜ਼ਾਂ ਚਾਹੀਦੀਆਂ ਹਨ ਜੋ ਉਨ੍ਹਾਂ ਦੇ ਉਤਪਾਦ ਦੇ ਅਨੁਕੂਲ ਹੋਣ ਅਤੇ ਵਰਤੋਂਕਾਰਾਂ ਨੂੰ ਪੂਰੀ ਤਰ੍ਹਾਂ ਕੁਦਰਤੀ ਲੱਗਣ। GPT‑Live‑1 ਨਾਲ ਅਸੀਂ ਰੀਅਲ-ਟਾਈਮ ਆਵਾਜ਼ਾਂ ਦੇ ਛੋਟੇ ਜਿਹੇ ਸਮੂਹ ਤੋਂ ਅੱਗੇ ਵਧ ਕੇ ਵੱਖ-ਵੱਖ ਲਹਿਜ਼ਿਆਂ, ਬੋਲੀਆਂ ਅਤੇ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਵਿਆਪਕ ਚੋਣ ਪੇਸ਼ ਕਰ ਰਹੇ ਹਾਂ, ਜਿਸ ਨਾਲ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਆਪਣੇ ਸਹਾਇਕਾਂ ਦੀ ਆਵਾਜ਼ ਚੁਣਨ ਵਿੱਚ ਹੋਰ ਜ਼ਿਆਦਾ ਵਿਕਲਪ ਮਿਲਦੇ ਹਨ।

ਨਵੀਆਂ ਆਵਾਜ਼ਾਂ ਸੁਣੋ

ਅਸੀਂ ਆਉਣ ਵਾਲੇ ਮਹੀਨਿਆਂ ਵਿੱਚ ਵੌਇਸ ਵਿਕਲਪਾਂ ਅਤੇ ਭਾਸ਼ਾ ਦੀ ਉਪਲਬਧਤਾ ਦਾ ਵਿਸਤਾਰ ਕਰਨਾ ਜਾਰੀ ਰੱਖਾਂਗੇ।

ਕੀਮਤ ਅਤੇ ਉਪਲਬਧਤਾ

GPT‑Live‑1 ਅੱਜ API ਵਿੱਚ⁠(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ) ਫਰੰਟ-ਐਂਡ ਵੌਇਸ ਲੇਅਰ ਲਈ $0.05 ਪ੍ਰਤੀ ਮਿੰਟ ਦੀ ਦਰ ਨਾਲ ਉਪਲਬਧ ਹੈ. ਇਸਨੂੰ ਆਪਣੇ ਉਤਪਾਦ ਦੇ ਅਨੁਕੂਲ ਬੈਕਐਂਡ ਮਾਡਲ ਅਤੇ ਏਜੰਟ ਹਾਰਨੈੱਸ ਨਾਲ ਜੋੜੋ, ਫਿਰ ਇੱਕ ਅਜਿਹਾ ਵੌਇਸ ਅਨੁਭਵ ਤਿਆਰ ਕਰੋ ਜੋ ਇਸਦੇ ਕੰਮ ਕਰਨ ਦੀਆਂ ਜ਼ਰੂਰਤਾਂ ਦੇ ਹਿਸਾਬ ਨਾਲ ਸਕੇਲ ਕਰ ਸਕੇ।

GPT-Live-1 ਨਾਲ Codex ਜੋੜਨਾ

1
import { Codex } from "@openai/codex-sdk";
2

3
const thread = new Codex().startThread({
4
workingDirectory: "./repo",
5
sandboxMode: "read-only",
6
approvalPolicy: "never",
7
});
8

9
async function answer(live, delegationId, context) {
10
const { finalResponse } = await thread.run(
11
`Answer the latest question using this repo.
12
Reply in two short spoken sentences.\n${context}`
13
);
14

15
live.send({
16
type: "session.commentary.append",
17
delegation_id: delegationId,
18
content: finalResponse,
19
});
20
}

GPT-Live-1 ਨੂੰ Codex ਨਾਲ ਕਨੈਕਟ ਕਰਨਾ। ਇਹ ਅੰਸ਼ ਦਿਖਾਉਂਦਾ ਹੈ ਕਿ ਕੋਈ ਐਪਲੀਕੇਸ਼ਨ ਗੱਲਬਾਤ ਦਾ ਸੰਦਰਭ Codex ਨੂੰ ਕਿਵੇਂ ਭੇਜਦੀ ਹੈ ਅਤੇ ਉਸਦਾ ਜਵਾਬ GPT-Live-1 ਨੂੰ ਵਾਪਸ ਕਰਦੀ ਹੈ। ਕਨੈਕਸ਼ਨ ਸੈੱਟਅੱਪ ਅਤੇ ਡੈਲੀਗੇਸ਼ਨ ਹੈਂਡਲਿੰਗ ਨੂੰ ਛੱਡ ਦਿੱਤਾ ਗਿਆ ਹੈ.

ਕਸਟਮ ਆਵਾਜ਼ ਦੀ ਪਹੁੰਚ ਲਈ, ਯੋਗਤਾ ਅਤੇ ਬੇਨਤੀ ਦੀ ਪ੍ਰਕਿਰਿਆ ਬਾਰੇ ਹੋਰ ਜਾਣਨ ਵਾਸਤੇ ਵਿਕਰੀ ਟੀਮ ਨਾਲ ਸੰਪਰਕ ਕਰੋ।

GPT‑Live‑1 ਦੀ ਮਦਦ ਨਾਲ ਵੌਇਸ ਵਰਕਫਲੋ ਬਣਾਉਣ ਦਾ ਇੱਕ ਹੋਰ ਤਰੀਕਾ OpenAI Presence ਹੈ, ਜੋ ਰੀਅਲ-ਟਾਈਮ ਵੌਇਸ ਕੰਵਰਸੇਸ਼ਨਜ਼ ਨੂੰ ਸ਼ਕਤੀ ਪ੍ਰਦਾਨ ਕਰਨ ਲਈ ਮਾਡਲ ਦੀ ਵਰਤੋਂ ਕਰਦਾ ਹੈ। Presence ਉੱਦਮਾਂ ਨੂੰ ਅਜਿਹੇ ਭਰੋਸੇਮੰਦ AI ਏਜੰਟ ਤੈਨਾਤ ਕਰਨ ਵਿੱਚ ਮਦਦ ਕਰਦਾ ਹੈ ਜੋ ਸਵਾਲਾਂ ਦੇ ਜਵਾਬ ਦੇ ਸਕਦੇ ਹਨ, ਸਮੱਸਿਆਵਾਂ ਨੂੰ ਹੱਲ ਕਰ ਸਕਦੇ ਹਨ, ਕੰਪਨੀ ਦੇ ਸਿਸਟਮਾਂ ਦੀ ਵਰਤੋਂ ਕਰ ਸਕਦੇ ਹਨ, ਮਨਜ਼ੂਰਸ਼ੁਦਾ ਕਾਰਵਾਈਆਂ ਕਰ ਸਕਦੇ ਹਨ, ਅਤੇ ਲੋੜ ਪੈਣ 'ਤੇ ਮਨੁੱਖਾਂ ਤੱਕ ਗੱਲ ਪਹੁੰਚਾ ਸਕਦੇ ਹਨ। ਹੋਰ ਜਾਣਨ ਲਈ ਆਪਣੇ OpenAI ਅਕਾਊਂਟ ਡਾਇਰੈਕਟਰ ਨਾਲ ਸੰਪਰਕ ਕਰੋ।