ਮੁੱਖ ਸਮੱਗਰੀ 'ਤੇ ਜਾਓ
OpenAI

GPT‑6 Sol ਅਤੇ Luna ਪੇਸ਼ ਹਨ

ਤੁਹਾਡੇ ਰੋਜ਼ਾਨਾ ਦੇ ਕੰਮ ਵਿੱਚ ਅਤਿ-ਆਧੁਨਿਕ ਇੰਟੈਲੀਜੈਂਸ ਲਿਆਉਣ ਦੇ ਹੋਰ ਵੀ ਕਈ ਤਰੀਕੇ।

ਲੋਡ ਹੋ ਰਿਹਾ ਹੈ…

ਇਸ ਮਹੀਨੇ ਦੇ ਸ਼ੁਰੂ ਵਿੱਚ, ਅਸੀਂ ਦੁਨੀਆ ਦਾ ਸਭ ਤੋਂ ਇੰਟੈਲੀਜੈਂਟ ਅਤੇ ਅਨੁਕੂਲਿਤ ਮਾਡਲ, GPT‑6 Astra, ਪੇਸ਼ ਕੀਤਾ ਸੀ। ਸਭ ਤੋਂ ਮੰਗ ਵਾਲੇ ਅਤੇ ਮਹੱਤਵਪੂਰਨ ਪ੍ਰੋਜੈਕਟਾਂ ਲਈ ਅਜੇ ਵੀ Astra ਦੀ ਪੂਰੀ ਸਮਰੱਥਾ ਦੀ ਲੋੜ ਪੈਂਦੀ ਹੈ, ਪਰ ਕੰਮ ਵੱਖ-ਵੱਖ ਪੈਮਾਨਿਆਂ, ਰਫ਼ਤਾਰਾਂ ਅਤੇ ਬਜਟਾਂ 'ਤੇ ਹੁੰਦਾ ਹੈ।

ਇਸੇ ਲਈ ਅਸੀਂ GPT‑6 Sol ਅਤੇ GPT‑6 Luna ਨਾਲ GPT‑6 ਪਰਿਵਾਰ ਦਾ ਵਿਸਤਾਰ ਕਰ ਰਹੇ ਹਾਂ। ਜਿੱਥੇ GPT‑6 Astra ਨੇ ਇੰਟੈਲੀਜੈਂਸ ਦੀ ਨਵੀਂ ਪੀੜ੍ਹੀ ਪੇਸ਼ ਕੀਤੀ ਸੀ—ਉੱਥੇ ਹੀ ਇਹ ਮਾਡਲ ਲਾਗਤ ਕੁਸ਼ਲਤਾ ਨੂੰ ਅਤਿ-ਆਧੁਨਿਕ ਪੱਧਰ ਤੱਕ ਲਿਜਾ ਕੇ ਉਸ ਇੰਟੈਲੀਜੈਂਸ ਦੇ ਲਾਭ ਹੋਰ ਲੋਕਾਂ ਤੱਕ ਪਹੁੰਚਾਉਣ ਵਿੱਚ ਮਦਦ ਕਰਦੇ ਹਨ। ਅਸੀਂ GPT‑6 Sol ਅਤੇ Luna ਨੂੰ GPT‑6 Astra ਵਰਗੇ ਤਰੀਕਿਆਂ ਨਾਲ ਸਿਖਲਾਈ ਦਿੱਤੀ ਹੈ, ਜਿਸ ਨਾਲ ਪੇਸ਼ੇਵਰ ਕੰਮ, ਤੱਥਾਂ ਦੀ ਸਚਾਈ, ਕੋਡਿੰਗ, ਕੰਪਿਊਟਰ ਦੀ ਵਰਤੋਂ ਅਤੇ ਅਨੁਕੂਲਤਾ ਵਿੱਚ Astra ਦੀ ਅਤਿ-ਆਧੁਨਿਕ ਕਾਰਗੁਜ਼ਾਰੀ ਨੂੰ ਤੇਜ਼ ਅਤੇ ਵਧੇਰੇ ਕਿਫ਼ਾਇਤੀ ਮਾਡਲਾਂ ਤੱਕ ਪਹੁੰਚਾਇਆ ਗਿਆ ਹੈ।

GPT‑6 ਮਾਡਲ ਲਾਗਤ–ਇੰਟੈਲੀਜੈਂਸ ਦੇ ਸੰਤੁਲਨ ਵਿੱਚ ਮੋਹਰੀ ਹਨ, ਅਤੇ ਹਰ ਪੱਧਰ 'ਤੇ ਸ਼ਾਨਦਾਰ ਸਮਰੱਥਾਵਾਂ ਨੂੰ ਅਜਿਹੇ ਬੁਨਿਆਦੀ ਢਾਂਚੇ ਨਾਲ ਜੋੜਦੇ ਹਨ ਜੋ ਵੱਡੇ ਪੈਮਾਨੇ 'ਤੇ ਇਨ੍ਹਾਂ ਨੂੰ ਕੁਸ਼ਲਤਾ ਨਾਲ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਕੈਸ਼ਿੰਗ ਅਤੇ ਇਨਫਰੈਂਸ ਵਿੱਚ ਸੁਧਾਰਾਂ ਨਾਲ ਅਸੀਂ ਇਨ੍ਹਾਂ ਮਾਡਲਾਂ ਨੂੰ ਘੱਟ ਲਾਗਤ 'ਤੇ ਮੁਹੱਈਆ ਕਰਵਾ ਸਕਦੇ ਹਾਂ, ਅਤੇ GPT‑5.6 ਦੀ ਪ੍ਰਚਾਰਕ ਕੀਮਤ ਦੇ ਮੁਕਾਬਲੇ Sol ਅਤੇ Luna ਦੀਆਂ API ਕੀਮਤਾਂ 50% ਘਟਾ ਕੇ ਅਸੀਂ ਇਹ ਬਚਤ ਸਿੱਧੇ ਵਰਤੋਂਕਾਰਾਂ ਅਤੇ ਗਾਹਕਾਂ ਤੱਕ ਪਹੁੰਚਾ ਰਹੇ ਹਾਂ। ਇਹ ਸਾਰੇ ਸੁਧਾਰ ਮਿਲ ਕੇ ਉੱਨਤ AI ਨੂੰ ਰੋਜ਼ਾਨਾ ਦੇ ਹੋਰ ਕੰਮਾਂ ਅਤੇ ਵੱਡੇ ਪੈਮਾਨੇ ਦੀਆਂ ਐਪਲੀਕੇਸ਼ਨਾਂ ਲਈ ਵਿਹਾਰਕ ਬਣਾਉਂਦੇ ਹਨ।

GPT‑6 API ਦੀਆਂ ਕੀਮਤਾਂ

ਮਾਡਲ

ਇਨਪੁੱਟ

ਆਉਟਪੁੱਟ

ਕੀਮਤ ਵਿੱਚ ਕਟੌਤੀ

GPT‑6 Sol
ਬਨਾਮ GPT‑5.6 Sol

$4 → $2

$20 → $10

50% ਸਸਤਾ

GPT‑6 Luna
ਬਨਾਮ GPT‑5.6 Luna

$0.20 → $0.10

$1.20 → $0.50

50% ਸਸਤਾ

ਕੀਮਤਾਂ ਪ੍ਰਤੀ 10 ਲੱਖ ਟੋਕਨ ਹਨ।

GPT‑6 Astra ਹਰ ਪੱਖੋਂ ਸਾਡਾ ਸਭ ਤੋਂ ਵਧੀਆ ਮਾਡਲ ਬਣਿਆ ਹੋਇਆ ਹੈ। ਜਦੋਂ ਤੁਹਾਨੂੰ ਸਭ ਤੋਂ ਵਧੀਆ ਨਤੀਜੇ ਅਤੇ ਬਿਨਾਂ ਕਿਸੇ ਸਮਝੌਤੇ ਵਾਲਾ ਅਨੁਭਵ ਚਾਹੀਦਾ ਹੋਵੇ ਤਾਂ ਇਸਨੂੰ ਚੁਣੋ।

ਮਾਡਲ ਪਰਿਵਾਰ ਵਿੱਚ ਇੱਕ ਕਦਮ ਅੱਗੇ

GPT‑6 Sol ਅਤੇ Luna ਉਨ੍ਹਾਂ ਮਾਡਲਾਂ ਵਿੱਚ ਇੰਟੈਲੀਜੈਂਸ ਦੇ ਸੁਧਾਰ ਅਤੇ ਲਾਗਤ-ਕੁਸ਼ਲਤਾ ਲਿਆਉਂਦੇ ਹਨ ਜਿਨ੍ਹਾਂ ਨੂੰ ਤੁਸੀਂ ਪਹਿਲਾਂ ਹੀ ਜਾਣਦੇ ਹੋ ਅਤੇ ਗੁੰਝਲਦਾਰ ਕੰਮਾਂ ਨੂੰ ਪੂਰਾ ਕਰਨ ਲਈ ਸਭ ਤੋਂ ਵੱਧ ਉਪਯੋਗੀ ਸਮਰੱਥਾਵਾਂ ਵਿੱਚ ਵਰਤਦੇ ਹੋ।

ਪੇਸ਼ੇਵਰ ਕੰਮ

GPT‑6 Sol ਔਖੇ ਕੰਮਾਂ ਨੂੰ ਸੰਭਾਲ ਸਕਦਾ ਹੈ ਜਦੋਂ ਕਿ ਇਹ ਤੁਹਾਨੂੰ ਹਾਈ ਵਰਤੋਂ ਸੀਮਾ ਅਤੇ ਘੱਟ ਲਾਗਤ ਨਾਲ ਵਾਰ-ਵਾਰ ਸੁਧਾਰ ਕਰਨ ਲਈ ਵਧੇਰੇ ਖੁੱਲ੍ਹ ਦਿੰਦਾ ਹੈ, ਅਤੇ ਸਮਾਨ ਕੀਮਤ ਵਾਲੇ ਮੁਕਾਬਲੇਬਾਜ਼ ਮਾਡਲਾਂ ਦੇ ਮੁਕਾਬਲੇ ਵਧੇਰੇ ਇੰਟੈਲੀਜੈਂਸ ਤੇ ਬਿਹਤਰ ਨਤੀਜੇ ਪੇਸ਼ ਕਰਦਾ ਹੈ।

ਐਪਾਂ ਵਿੱਚ ਕਾਰੋਬਾਰੀ ਕਾਰਜ-ਪ੍ਰਵਾਹਾਂ ਦੀ ਜਾਂਚ ਕਰਨ ਵਾਲੇ AutomationBench 'ਤੇ, xhigh ਕੋਸ਼ਿਸ਼ ਵਾਲਾ GPT‑6 Sol ਵੱਧ ਤੋਂ ਵੱਧ ਕੋਸ਼ਿਸ਼ ਵਾਲੇ Claude Opus 5 ਨਾਲੋਂ ਬਿਹਤਰ ਪ੍ਰਦਰਸ਼ਨ ਕਰਦਾ ਹੈ, ਅਤੇ ਇਹ Opus 5 ਦੀ ਪ੍ਰਤੀ ਟਾਸਕ ਲਾਗਤ ਦੇ ਸਿਰਫ਼ 9% ਖਰਚੇ 'ਤੇ ਹੁੰਦਾ ਹੈ। ਹਾਈ ਕੋਸ਼ਿਸ਼ 'ਤੇ, GPT‑6 Luna ਆਪਣੇ ਪਿਛਲੇ ਮਾਡਲ ਨਾਲੋਂ 5.4 ਪ੍ਰਤੀਸ਼ਤ ਅੰਕਾਂ ਦਾ ਬਿਹਤਰ ਪ੍ਰਦਰਸ਼ਨ ਦਿੰਦਾ ਹੈ, ਜਦਕਿ ਪ੍ਰਤੀ ਟਾਸਕ ਲਾਗਤ 58% ਘੱਟ ਹੈ।

AutomationBench 1.0.6⁠(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ)ਵਿੱਚ, AI ਏਜੰਟਾਂ ਨੂੰ ਵਿਕਰੀ, ਮਾਰਕੀਟਿੰਗ, ਸੰਚਾਲਨ, ਸਹਾਇਤਾ, ਵਿੱਤ ਅਤੇ ਮਨੁੱਖੀ ਸਰੋਤਾਂ (HR) ਦੇ 47 ਟੂਲਸ ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਸ਼ੁਰੂ ਤੋਂ ਅੰਤ ਤੱਕ ਦੇ ਕਾਰਜ-ਪ੍ਰਵਾਹਾਂ 'ਤੇ ਪਰਖਿਆ ਜਾਂਦਾ ਹੈ। Claude Fable 5.1 ਲਈ ਡਾਟਾ ਪੁਆਇੰਟ ਇਸਦੀ ਅਸਲ ਲਾਗਤ ਨੂੰ ਘੱਟ ਦਰਸਾਉਂਦਾ ਹੈ ਕਿਉਂਕਿ ਇਸ ਵਿੱਚ ਲਗਭਗ 40% ਕੰਮਾਂ ਦੌਰਾਨ ਵਰਤੇ ਗਏ Opus 5 ਵਿਕਲਪਾਂ ਦੀ ਲਾਗਤ ਸ਼ਾਮਲ ਨਹੀਂ ਹੈ।

GPT‑6 Sol, Claude Fable 5.1 ਨੂੰ ਵੀ ਕਿਤੇ ਘੱਟ ਲਾਗਤ 'ਤੇ ਪਿੱਛੇ ਛੱਡ ਦਿੰਦਾ ਹੈ, ਅਤੇ ਇੱਥੋਂ ਤੱਕ ਕਿ ਘੱਟ-ਕੋਸ਼ਿਸ਼ ਵਾਲੇ GPT‑6 Astra ਨਾਲੋਂ ਵੀ ਬਿਹਤਰ ਪ੍ਰਦਰਸ਼ਨ ਕਰਦਾ ਹੈ।

ਮਾਡਲ (ਅਤੇ ਕੋਸ਼ਿਸ਼)

ਸਕੋਰ

ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ

GPT‑6 Sol (xhigh)

33.2%

$0.27

GPT‑6 Astra (ਘੱਟ)

30.3%

GPT‑6 Sol ਦਾ 3.9 ਗੁਣਾ

Claude Opus 5 (Max)

26.9%

GPT‑6 Sol ਦਾ 11.1 ਗੁਣਾ

Opus 5 ਫਾਲਬੈਕ ਸਮੇਤ Claude Fable 5.1 (Max)

31.4%

GPT‑6 Sol ਦਾ >8.9 ਗੁਣਾ

(ਵਿਕਲਪ ਦੀ ਲਾਗਤ ਨਹੀਂ ਦੱਸੀ ਗਈ)

ਜਟਿਲ ਪੇਸ਼ੇਵਰ ਕਾਰਜ-ਪ੍ਰਵਾਹਾਂ ਵਿੱਚ ਏਜੰਟਾਂ ਦਾ ਮੁਲਾਂਕਣ ਕਰਨ ਵਾਲੇ Agents’ Last Exam 'ਤੇ ਵੱਧ ਤੋਂ ਵੱਧ ਕੋਸ਼ਿਸ਼ ਵਾਲੇ GPT‑6 Sol ਦਾ ਸਕੋਰ 56.4% ਹੈ, ਜੋ ਕਿ ਇਸ ਮੁਲਾਂਕਣ ਵਿੱਚ Claude Opus 5 ਦੇ ਸਭ ਤੋਂ ਹਾਈ ਸਕੋਰ ਤੋਂ ਵੱਧ ਹੈ, ਜਦਕਿ ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ 60% ਘੱਟ ਹੈ।

Agents’ Last Exam V1⁠(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ)ਵਿੱਚ, AI ਏਜੰਟਾਂ ਦਾ ਮੁਲਾਂਕਣ ਲੰਬੇ ਸਮੇਂ ਵਾਲੇ ਅਤੇ ਆਰਥਿਕ ਤੌਰ 'ਤੇ ਕੀਮਤੀ ਕਾਰਜਾਂ 'ਤੇ ਕੀਤਾ ਜਾਂਦਾ ਹੈ ਜੋ 55 ਉਪ-ਉਦਯੋਗਾਂ ਵਿੱਚ ਫੈਲੇ ਹੋਏ ਹਨ, ਅਤੇ ਕੰਪਿਊਟਰ 'ਤੇ ਕੀਤੇ ਜਾਣ ਵਾਲੇ ਪੇਸ਼ੇਵਰ ਕੰਮਾਂ ਦੇ ਜ਼ਿਆਦਾਤਰ ਪ੍ਰਮੁੱਖ ਖੇਤਰਾਂ ਨੂੰ ਕਵਰ ਕਰਦੇ ਹਨ।

ਤੱਥ-ਪਰਕਤਾ

ਕਿਸੇ ਜਵਾਬ ਦੀ ਉਪਯੋਗਤਾ ਤੱਥਾਂ ਨੂੰ ਸਹੀ ਰੱਖਣ 'ਤੇ ਨਿਰਭਰ ਕਰਦੀ ਹੈ, ਅਤੇ ਅਸੀਂ ਤੱਥਾਂ ਦੀ ਭਰੋਸੇਯੋਗਤਾ ਦੇ ਮਾਮਲੇ ਵਿੱਚ ਲਗਾਤਾਰ ਤਰੱਕੀ ਕਰ ਰਹੇ ਹਾਂ। ਸਾਡੇ ਅੰਦਰੂਨੀ ਤੱਥ-ਪਰਕਤਾ ਮੁਲਾਂਕਣ 'ਤੇ, ਜੋ ਕਿ ਅਗਿਆਤ ਅਸਲ-ਸੰਸਾਰ ਦੀਆਂ ਗੱਲਾਂ-ਬਾਤਾਂ 'ਤੇ ਆਧਾਰਿਤ ਹੈ ਜਿੱਥੇ ਵਰਤੋਂਕਾਰਾਂ ਨੇ ਸਾਡੇ ਮਾਡਲਾਂ ਦੀਆਂ ਗਲਤੀਆਂ ਨੂੰ ਨਿਸ਼ਾਨਬੱਧ ਕੀਤਾ ਸੀ, GPT‑6 Sol ਆਪਣੇ ਪਿਛਲੇ ਮਾਡਲ ਨਾਲੋਂ ਲਗਭਗ ਅੱਧੀਆਂ ਗਲਤੀਆਂ ਕਰਦਾ ਹੈ, ਜੋ ਕਿ ਬਹੁਤ ਘੱਟ ਲਾਗਤ 'ਤੇ Astra-ਪੱਧਰ ਦੀ ਭਰੋਸੇਯੋਗਤਾ ਦੇ ਨੇੜੇ ਪਹੁੰਚ ਰਿਹਾ ਹੈ। GPT‑6 Luna ਵਿੱਚ ਵੀ ਕਾਫ਼ੀ ਸੁਧਾਰ ਹੋਇਆ ਹੈ; ਹਾਈ ਕੋਸ਼ਿਸ਼ ਦੇ ਪੱਧਰਾਂ 'ਤੇ, ਇਹ GPT‑5.6 Sol ਦੇ ਮੁਕਾਬਲੇ ਇਸਦੀ ਲਾਗਤ ਦੇ ਲਗਭਗ ਸੌਵੇਂ ਹਿੱਸੇ 'ਤੇ ਹੀ ਉਸ ਨਾਲ ਮੇਲ ਖਾਂਦਾ ਹੈ।

ਇੱਥੇ ਅਸੀਂ ਪਛਾਣ-ਰਹਿਤ ChatGPT ਗੱਲਬਾਤਾਂ ਵਿੱਚ ਤੱਥਕਤਾ ਦਾ ਮੁਲਾਂਕਣ ਕਰਦੇ ਹਾਂ, ਜਿੱਥੇ ਵਰਤੋਂਕਾਰਾਂ ਨੇ ਕਿਸੇ ਪਿਛਲੇ ਮਾਡਲ ਦੀ ਤੱਥ ਸੰਬੰਧੀ ਗਲਤੀ ਦਰਸਾਈ ਸੀ। ਇਹ ਗਲਤੀਆਂ ਪੈਦਾ ਕਰਨ ਵਾਲੀਆਂ ਗੱਲਬਾਤਾਂ ਆਮ ਵਰਤੋਂ ਨੂੰ ਨਹੀਂ ਦਰਸਾਉਂਦੀਆਂ, ਜਿੱਥੇ ਤੱਥ ਸੰਬੰਧੀ ਗਲਤੀਆਂ ਘੱਟ ਹੁੰਦੀਆਂ ਹਨ। ਸਕੋਰਾਂ ਵਿੱਚ ਲੰਬਾਈ ਨੂੰ ਨਿਯੰਤਰਿਤ ਨਹੀਂ ਕੀਤਾ ਗਿਆ ਹੈ; ਹਾਲਾਂਕਿ, ਵੱਖ-ਵੱਖ ਵਿਸਤਾਰ ਪੱਧਰਾਂ ਵਾਲੇ ਸਾਡੇ ਟੈਸਟਾਂ ਵਿੱਚ ਜਵਾਬ ਦੀ ਲੰਬਾਈ ਦਾ ਲਗਭਗ ਕੋਈ ਅਸਰ ਨਹੀਂ ਮਿਲਿਆ।

ਕੋਡਿੰਗ

ਇਸ ਸਾਲ ਕੋਡਿੰਗ ਏਜੰਟਾਂ ਨੇ ਪਹਿਲਾਂ ਨਾਲੋਂ ਕਿਤੇ ਵੱਧ ਗੁੰਝਲਦਾਰੀ, ਦਾਇਰੇ ਅਤੇ ਮਿਆਦ ਵਾਲੇ ਕਾਰਜਾਂ ਨਾਲ ਨਜਿੱਠਣਾ ਸ਼ੁਰੂ ਕਰ ਦਿੱਤਾ ਹੈ। OpenAI ਵਿਖੇ, ਸਾਡਾ ਅੰਦਰੂਨੀ ਇਸਤੇਮਾਲ ਤੇਜ਼ੀ ਨਾਲ ਵਧਿਆ ਹੈ। API ਕੀਮਤਾਂ ਦੇ ਹਿਸਾਬ ਨਾਲ, ਰੋਜ਼ਾਨਾ ਟੋਕਨ ਦੀ ਵਰਤੋਂ ਔਸਤ ਖੋਜਕਾਰ ਲਈ $600 ਤੋਂ ਵੱਧ ਅਤੇ 90ਵੇਂ ਪ੍ਰਤੀਸ਼ਤਕ 'ਤੇ ਮੌਜੂਦ ਖੋਜਕਾਰਾਂ ਲਈ $7,000 ਤੋਂ ਵੱਧ ਹੋ ਗਈ ਹੈ (ਖੋਜ ਵਿੱਚ ਤੇਜ਼ੀ: OpenAI ਦੇ ਅੰਦਰ ਦੀ ਝਲਕ⁠)। ਜਿਵੇਂ-ਜਿਵੇਂ ਕੋਡਿੰਗ ਏਜੰਟ ਲੰਬੇ ਅਤੇ ਵਧੇਰੇ ਮੰਗ ਵਾਲੇ ਕਾਰਜਾਂ ਨੂੰ ਆਪਣੇ ਹੱਥੀਂ ਲੈਂਦੇ ਹਨ, ਲਗਾਤਾਰ ਵਰਤੋਂ ਦੀ ਲਾਗਤ ਹੋਰ ਵੀ ਮਹੱਤਵਪੂਰਨ ਹੋ ਜਾਂਦੀ ਹੈ। GPT‑6 Sol ਅਤੇ Luna ਮਜ਼ਬੂਤ ਕੋਡਿੰਗ ਪ੍ਰਦਰਸ਼ਨ ਨੂੰ ਘੱਟ API ਕੀਮਤਾਂ ਨਾਲ ਜੋੜਦੇ ਹਨ, ਜਿਸ ਨਾਲ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਦੁਹਰਾਈ ਕਰਨ ਲਈ ਵਧੇਰੇ ਗੁੰਜਾਇਸ਼ ਮਿਲਦੀ ਹੈ ਅਤੇ ਟੀਮਾਂ ਨੂੰ ਇਸ ਬਾਰੇ ਵਧੇਰੇ ਉਤਸ਼ਾਹੀ ਹੋਣ ਦਾ ਭਰੋਸਾ ਮਿਲਦਾ ਹੈ ਕਿ ਉਹ Codex ਨੂੰ ਕੀ ਕਰਨ ਲਈ ਕਹਿ ਸਕਦੀਆਂ ਹਨ।

ਕੋਡਿੰਗ ਏਜੰਟਾਂ ਵੱਲੋਂ ਅਸਲ ਕੋਡਬੇਸਾਂ ਵਿੱਚ ਮਰਜ ਕਰਨ ਲਈ ਤਿਆਰ ਤਬਦੀਲੀਆਂ ਤਿਆਰ ਕਰਨ ਦਾ ਮੁਲਾਂਕਣ ਕਰਨ ਵਾਲੇ FrontierCode 'ਤੇ, GPT‑6 Sol ਨੇ GPT‑5.6 Sol ਨਾਲੋਂ ਕਾਫ਼ੀ ਸੁਧਾਰ ਕੀਤਾ ਹੈ ਅਤੇ ਬਹੁਤ ਘੱਟ ਲਾਗਤ 'ਤੇ Claude Fable 5.1 xhigh ਦੇ ਬਰਾਬਰ ਪ੍ਰਦਰਸ਼ਨ ਕਰਨ ਦੇ ਸਮਰੱਥ ਹੈ।

FrontierCode 1.1 Main⁠(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ) ਵਿੱਚ AI ਏਜੰਟ ਅਜਿਹਾ ਕੋਡ ਲਿਖਦੇ ਹਨ ਜਿਸਦਾ ਮੁਲਾਂਕਣ ਸਿਰਫ਼ ਸ਼ੁੱਧਤਾ ਦੇ ਆਧਾਰ 'ਤੇ ਹੀ ਨਹੀਂ, ਸਗੋਂ “ਮਰਜ ਹੋਣ ਯੋਗਤਾ” 'ਤੇ ਵੀ ਕੀਤਾ ਜਾਂਦਾ ਹੈ; ਜਿਵੇਂ ਕਿ ਟੈਸਟ ਦੀ ਗੁਣਵੱਤਾ, ਦਾਇਰੇ ਦੀ ਅਨੁਸ਼ਾਸਨਬੱਧਤਾ, ਕੋਡ ਸਟਾਈਲ, ਅਤੇ ਕੋਡਬੇਸ ਦੇ ਮਿਆਰਾਂ ਦੀ ਪਾਲਣਾ।

ਅਸਲ ਕੋਡਬੇਸਾਂ ਵਿੱਚ ਗੁੰਝਲਦਾਰ ਸੌਫਟਵੇਅਰ-ਇੰਜੀਨੀਅਰਿੰਗ ਕਾਰਜਾਂ 'ਤੇ ਪ੍ਰਦਰਸ਼ਨ ਦਾ ਮੁਲਾਂਕਣ ਕਰਨ ਵਾਲੇ DeepSWE v1.1 'ਤੇ, ਵੱਧ ਤੋਂ ਵੱਧ ਕੋਸ਼ਿਸ਼ ਵਾਲਾ GPT‑6 Sol 68.8% ਸਕੋਰ ਪ੍ਰਾਪਤ ਕਰਦਾ ਹੈ, ਜੋ ਕਿ ਇਸ ਮੁਲਾਂਕਣ ਵਿੱਚ Claude Fable 5 ਦੇ ਸਭ ਤੋਂ ਉੱਚੇ ਸਕੋਰ—xhigh ਕੋਸ਼ਿਸ਼ 'ਤੇ 69.9%—ਤੋਂ ਸਿਰਫ਼ 1.1 ਪ੍ਰਤੀਸ਼ਤ ਅੰਕਾਂ ਦੇ ਫ਼ਰਕ ਨਾਲ ਪਿੱਛੇ ਹੈ, ਜਦਕਿ ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ ਲਗਭਗ 80% ਘੱਟ ਹੈ।

ਵੱਧ ਤੋਂ ਵੱਧ ਕੋਸ਼ਿਸ਼ 'ਤੇ GPT‑6 Luna ਦਾ ਸਕੋਰ 66.6% ਹੈ, ਜੋ ਕਿ ਮੱਧਮ ਕੋਸ਼ਿਸ਼ ਵਾਲੇ Claude Opus 5 ਅਤੇ Fable 5 ਦੇ ਬਰਾਬਰ ਹੈ। ਇਨ੍ਹਾਂ ਤੁਲਨਾਵਾਂ ਵਿੱਚ Luna ਦੀ ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ Opus 5 ਨਾਲੋਂ 93% ਅਤੇ Fable 5 ਨਾਲੋਂ 96% ਘੱਟ ਹੈ।

DeepSWE 1.1⁠(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ)ਵਿੱਚ AI ਏਜੰਟ ਮੌਜੂਦਾ ਅਤੇ ਲੰਬੇ ਸਮੇਂ ਤੱਕ ਫੈਲੇ ਸਾਫਟਵੇਅਰ ਇੰਜੀਨੀਅਰਿੰਗ ਕਾਰਜਾਂ ਨੂੰ ਹੱਲ ਕਰਦੇ ਹਨ।

ਕੰਪਿਊਟਰ ਦੀ ਵਰਤੋਂ

ਜਿੱਥੇ GPT‑6 Astra ਕੰਪਿਊਟਰ ਦੀ ਵਰਤੋਂ ਲਈ ਦੁਨੀਆ ਦਾ ਸਭ ਤੋਂ ਵਧੀਆ ਮਾਡਲ ਬਣਿਆ ਹੋਇਆ ਹੈ, ਉੱਥੇ ਹੀ GPT‑6 Sol ਅਤੇ Luna ਆਪਣੇ ਪੁਰਾਣੇ ਮਾਡਲਾਂ ਨਾਲੋਂ ਵੱਧ ਲਾਗਤ-ਕੁਸ਼ਲ ਕਾਰਗੁਜ਼ਾਰੀ ਪੇਸ਼ ਕਰਦੇ ਹਨ। OSWorld 2.0 ਆਫ਼ਲਾਈਨ ਵਿੱਚ, xhigh ਕੋਸ਼ਿਸ਼ ਵਾਲਾ GPT‑6Sol, ਮੱਧਮ ਕੋਸ਼ਿਸ਼ ਵਾਲੇ Claude Opus 5 ਦੇ ਲਗਭਗ ਬਰਾਬਰ ਸਕੋਰ ਪ੍ਰਾਪਤ ਕਰਦਾ ਹੈ—60.5% ਬਨਾਮ 60.3%—ਜਦਕਿ ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ ਲਗਭਗ 80% ਘੱਟ ਹੈ। GPT‑6 Luna (max) ਆਪਣੇ ਖਰਚੇ ਦੇ ਦੱਸਵੇਂ ਹਿੱਸੇ 'ਤੇ GPT‑5.6 Sol (ਮੀਡੀਅਮ) ਨੂੰ ਪਛਾੜਨ ਦੇ ਸਮਰੱਥ ਹੈ।

OSWorld 2.0⁠(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ)ਵਿੱਚ, AI ਏਜੰਟ ਰੋਜ਼ਾਨਾ ਅਤੇ ਪੇਸ਼ੇਵਰ ਕਾਰਜਾਂ ਨਾਲ ਸੰਬੰਧਿਤ ਲੰਮੀ ਮਿਆਦ ਵਾਲੇ ਕੰਪਿਊਟਰ-ਵਰਤੋਂ ਕਾਰਜ-ਪ੍ਰਵਾਹ ਪੂਰੇ ਕਰਨ ਦੀ ਕੋਸ਼ਿਸ਼ ਕਰਦੇ ਹਨ। ਅਸੀਂ v2026.08.08 ਰਿਲੀਜ਼ ਦੇ ਆਫ਼ਲਾਈਨ ਸੈੱਟ ਲਈ ਅੰਸ਼ਕ ਇਨਾਮ ਦੀ ਰਿਪੋਰਟ ਕਰਦੇ ਹਾਂ।

ਸਹਿਯੋਗ ਦੀ ਸ਼ੈਲੀ

ਅਸੀਂ GPT‑6 Astra ਦੀ ਬਿਹਤਰ ਸੰਚਾਰ ਸ਼ੈਲੀ ਨੂੰ Sol ਅਤੇ Luna ਵਿੱਚ ਵੀ ਲਿਆਂਦਾ ਹੈ, ਜਿਸ ਬਾਰੇ ਸਾਡਾ ਮੰਨਣਾ ਹੈ ਕਿ ਇਹ ਵਿਸ਼ੇਸ਼ ਤੌਰ 'ਤੇ ਤਕਨੀਕੀ ਅਤੇ ਕੋਡਿੰਗ ਸੰਬੰਧੀ ਗੱਲਬਾਤ ਵਿੱਚ ਸਪੱਸ਼ਟ ਰੂਪ ਵਿੱਚ ਨਜ਼ਰ ਆਵੇਗਾ। ਸਮੱਗਰੀ ਨੂੰ ਗੁਆਏ ਬਿਨਾਂ ਵਧੇਰੇ ਸਪੱਸ਼ਟਤਾ, ਘੱਟ ਅਣਚਾਹੀ ਤਕਨੀਕੀ ਸ਼ਬਦਾਵਲੀ, ਘੱਟ ਅਜੀਬ ਵਾਕਾਂਸ਼, ਘੱਟ ਬੇਲੋੜੇ ਵੇਰਵੇ ਅਤੇ ਕੁੱਲ ਮਿਲਾ ਕੇ ਥੋੜ੍ਹੇ ਛੋਟੇ ਜਵਾਬਾਂ ਦੀ ਉਮੀਦ ਕਰੋ।

Prompt
Website’s looking clean! Could we use a Bento Box design style and add a slider between the pages in the top right? You may need to dive into the React..
GPT-5.6 Sol

Absolutely. I can get the bento feel and the top-right sliding page switcher without pulling in React—the interaction is small enough to stay fast and smooth in the current site. I’m reshaping all four pages around that system now.


Done — open the live site.

It now has a colorful bento-box layout across all four pages and an animated top-right Home / Play / Place / Taste slider. React wasn’t necessary; native page transitions keep it lightweight and smooth.

The built-in image tool created the food artwork. Prompt: “An energetic gouache-and-ink editorial illustration celebrating dumplings and spicy noodles, with bright colors, steam, spice, and no text or logos.”

GPT-6 Sol

I’ll reshape the pages into a bento grid and turn the top-right links into a sliding page switcher. I’ll keep the existing site and check whether that interaction needs React before changing its setup.


The updated site is live. Every page now has a playful bento layout, and the top-right page switcher slides between sections. I checked it on desktop and narrow mobile screens, including browser back navigation. The existing site didn’t need React for this.

ਭਾਵੇਂ ਸ਼ੈਲੀ ਵਿਅਕਤੀਗਤ ਹੁੰਦੀ ਹੈ, ਪਰ ਅਸੀਂ ਇੱਥੇ GPT‑6 Sol ਦੇ ਜਵਾਬ ਨੂੰ ਤਰਜੀਹ ਦਿੰਦੇ ਹਾਂ। ਇਹ ਜਲਦਬਾਜ਼ੀ ਵਿੱਚ ਸਿੱਟੇ 'ਤੇ ਨਹੀਂ ਪਹੁੰਚਦਾ, ਉਨ੍ਹਾਂ ਵੇਰਵਿਆਂ ਨੂੰ ਦੁਹਰਾਉਣ ਵਿੱਚ ਘੱਟ ਸਮਾਂ ਲਾਉਂਦਾ ਹੈ ਜੋ ਪੁੱਛਣ ਵਾਲੇ ਲਈ ਪਹਿਲਾਂ ਹੀ ਸਪੱਸ਼ਟ ਹੋ ਸਕਦੇ ਹਨ (ਉਦਾਹਰਣ ਵਜੋਂ, ਕਿ ਵੈੱਬਸਾਈਟ ਦੇ ਚਾਰ ਪੰਨੇ ਹਨ), ਘੱਟ ਅਸਪਸ਼ਟ ਭਾਸ਼ਾ ਦੀ ਵਰਤੋਂ ਕਰਦਾ ਹੈ (ਜਿਵੇਂ ਕਿ “ਬੈਂਟੋ ਵਰਗਾ ਅਹਿਸਾਸ” ਅਤੇ “ਉਸ ਪ੍ਰਣਾਲੀ ਦੇ ਆਲੇ-ਦੁਆਲੇ ਮੁੜ ਆਕਾਰ ਦੇਣਾ”), ਇਸ ਗੱਲ ਬਾਰੇ ਵਧੇਰੇ ਸਪੱਸ਼ਟ ਹੁੰਦਾ ਹੈ ਕਿ ਇਸ ਨੇ ਕੀ ਜਾਂਚ ਕੀਤੀ ਅਤੇ ਕੀ ਨਹੀਂ, ਅਤੇ ਆਪਣੇ ਚਿੱਤਰ ਟੂਲ ਦੇ ਪ੍ਰੌੰਪਟ ਵਰਗੇ ਲਾਗੂਕਰਨ ਵੇਰਵੇ ਬੇਲੋੜੇ ਤੌਰ 'ਤੇ ਸਾਂਝੇ ਨਹੀਂ ਕਰਦਾ।

ਏਜੰਟਾਂ ਅਤੇ ਲੰਬੀਆਂ ਗੱਲਬਾਤਾਂ ਲਈ ਕੈਸ਼ਿੰਗ ਨੂੰ ਬਿਹਤਰ ਬਣਾਉਣਾ

ਟੋਕਨ ਦੀਆਂ ਘੱਟ ਕੀਮਤਾਂ ਦੇ ਨਾਲ-ਨਾਲ, ਅਸੀਂ GPT‑6 'ਤੇ ਐਪਲੀਕੇਸ਼ਨਾਂ ਤਿਆਰ ਕਰਨ ਵਾਲੇ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਉਨ੍ਹਾਂ ਦੀਆਂ ਐਪਲੀਕੇਸ਼ਨਾਂ ਦੁਆਰਾ ਮੁੜ ਵਰਤੇ ਜਾਣ ਵਾਲੇ ਸੰਦਰਭ 'ਤੇ ਹੋਰ ਜ਼ਿਆਦਾ ਬਚਤ ਕਰਨ ਵਿੱਚ ਮਦਦ ਕਰ ਰਹੇ ਹਾਂ। ਅਸੀਂ ਉੱਚ ਕੈਸ਼ ਹਿੱਟ ਰੇਟ ਨੂੰ ਆਪਣੇ ਆਪ ਯਕੀਨੀ ਬਣਾਉਣ ਲਈ GPT‑6 ਲਈ ਪ੍ਰੋਂਪਟ ਕੈਸ਼ਿੰਗ ਵਿੱਚ ਸੁਧਾਰ ਕੀਤਾ ਹੈ, ਜਿਸ ਨਾਲ ਏਜੰਟਾਂ ਨੂੰ ਵਧੇਰੇ ਸੰਦਰਭ ਦੀ ਮੁੜ ਵਰਤੋਂ ਕਰਨ, ਤੇਜ਼ੀ ਨਾਲ ਜਵਾਬ ਦੇਣ ਅਤੇ ਕੈਸ਼ ਕੀਤੇ ਇਨਪੁਟ-ਟੋਕਨ ਰੀਡਸ 'ਤੇ 90% ਦੀ ਛੋਟ ਦਾ ਲਾਭ ਲੈਣ ਵਿੱਚ ਮਦਦ ਮਿਲਦੀ ਹੈ।

ਡਿਵੈਲਪਰਾਂ ਕੋਲ ਆਪਣੀ ਕੈਸ਼ਿੰਗ ਕਾਰਗੁਜ਼ਾਰੀ ਨੂੰ ਮਾਪਣ ਅਤੇ ਅਨੁਕੂਲ ਬਣਾਉਣ ਲਈ ਹੋਰ ਵੀ ਤਰੀਕੇ ਹਨ:

GitHub ਮੁਤਾਬਕ, ਪਿਛਲੇ ਕਈ ਮਹੀਨਿਆਂ ਦੌਰਾਨ ਇਨ੍ਹਾਂ ਸੁਧਾਰਾਂ ਨੇ OpenAI ਮਾਡਲਾਂ ਨੂੰ ਕੀਤੀਆਂ ਅਰਬਾਂ ਬੇਨਤੀਆਂ ਵਿੱਚ ਨਵੀਂ ਪ੍ਰਕਿਰਿਆ ਦੀ ਲੋੜ ਵਾਲੇ ਪ੍ਰੌਂਪਟ ਟੋਕਨਾਂ ਦਾ ਹਿੱਸਾ 50% ਤੋਂ ਵੱਧ ਘਟਾਇਆ ਹੈ, ਜਿਸ ਨਾਲ ਕੋਪਾਇਲਟ ਨੂੰ ਤੇਜ਼ੀ ਨਾਲ ਜਵਾਬ ਦੇਣ ਵਿੱਚ ਮਦਦ ਮਿਲੀ ਹੈ।

ਅਨੁਕੂਲਤਾ ਨੂੰ ਲਗਾਤਾਰ ਬਿਹਤਰ ਬਣਾਉਣਾ

GPT‑6 Sol ਅਤੇ Luna, ਸਾਡੇ ਹੁਣ ਤੱਕ ਦੇ ਸਭ ਤੋਂ ਵੱਧ ਅਨੁਕੂਲਿਤ ਮਾਡਲ Astra ਨਾਲ ਸ਼ੁਰੂ ਕੀਤੇ ਗਏ ਅਨੁਕੂਲਤਾ ਦੇ ਕੰਮ ਨੂੰ ਅੱਗੇ ਵਧਾਉਂਦੇ ਹਨ। ਸਾਡੇ ਅਨੁਕੂਲਤਾ ਮੁਲਾਂਕਣਾਂ ਵਿੱਚ Sol ਅਤੇ Luna ਦੋਵੇਂ ਆਪਣੇ GPT‑5.6 ਮਾਡਲਾਂ ਨਾਲੋਂ ਬਿਹਤਰ ਪ੍ਰਦਰਸ਼ਨ ਦਿਖਾਉਂਦੇ ਹਨ, ਜਿਸ ਵਿੱਚ ਉਨ੍ਹਾਂ ਦੇ ਕੋਡਿੰਗ ਕੰਮ ਬਾਰੇ ਗੁੰਮਰਾਹਕੁੰਨ ਦਾਅਵਿਆਂ ਦੀ ਘੱਟ ਦਰ ਵੀ ਸ਼ਾਮਲ ਹੈ।

ਹੇਠਾਂ ਦਿੱਤੇ ਮੁਲਾਂਕਣ ਸੋਚ-ਸਮਝ ਕੇ ਚੁਣੌਤੀਪੂਰਨ ਸਥਿਤੀਆਂ ਦੀ ਜਾਂਚ ਕਰਦੇ ਹਨ ਅਤੇ ਆਮ ਵਰਤੋਂ ਵਿੱਚ ਅਸਫਲਤਾ ਦੀਆਂ ਦਰਾਂ ਨੂੰ ਨਹੀਂ ਮਾਪਦੇ। ਪੂਰੇ ਨਤੀਜਿਆਂ ਲਈ ਸਿਸਟਮ ਕਾਰਡ⁠(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ) ਦੇਖੋ।

ਉਪਲਬਧਤਾ

GPT‑6 Sol ਅਤੇ GPT‑6 Luna ਅੱਜ ਤੋਂ ਸਾਰੇ Plus, Pro, Business, Enterprise ਅਤੇ Edu ਵਰਤੋਂਕਾਰਾਂ ਲਈ ChatGPT ਵਰਕ ਅਤੇ Codex ਵਿੱਚ ਉਪਲਬਧ ਹਨ। Free ਅਤੇ Go ਵਰਤੋਂਕਾਰ ਡੈਸਕਟਾਪ ਐਪ ਵਿੱਚ GPT‑6 Luna ਵਰਤ ਸਕਦੇ ਹਨ। ਇਹ ਮਾਡਲ ਹਾਲੇ ਚੈਟ ਵਿੱਚ ਉਪਲਬਧ ਨਹੀਂ ਹਨ। OpenAI API ਵਿੱਚ ਇਹ gpt-6-sol ਅਤੇ gpt-6-luna ਵਜੋਂ ਉਪਲਬਧ ਹਨ।

ਹਰ ਕਿਸੇ ਲਈ ਸੇਵਾ ਨੂੰ ਸਥਿਰ ਰੱਖਣ ਵਾਸਤੇ, ਅਸੀਂ ਦਿਨ ਭਰ ChatGPT ਵਿੱਚ ਇਹਨਾਂ ਮਾਡਲਾਂ ਨੂੰ ਹੌਲੀ-ਹੌਲੀ ਜਾਰੀ ਕਰਨ ਦੀ ਯੋਜਨਾ ਬਣਾਈ ਹੈ। ਜੇਕਰ ਤੁਹਾਨੂੰ ChatGPT ਵਰਕ ਜਾਂ Codex ਵਿੱਚ ਨਵੇਂ ਮਾਡਲ ਨਜ਼ਰ ਨਾ ਆਉਣ, ਤਾਂ ਕਿਰਪਾ ਕਰਕੇ ਬਾਅਦ ਵਿੱਚ ਦੁਬਾਰਾ ਕੋਸ਼ਿਸ਼ ਕਰੋ।


GPT ਦੇ ਮੁਲਾਂਕਣ ਸਾਡੇ ਖੋਜ ਇਨਵਾਇਰਨਮੈਂਟ ਵਿੱਚ ਜਾਂ ਸਾਡੇ API ਰਾਹੀਂ ਕੀਤੇ ਗਏ ਸਨ, ਜੋ ਸਿਸਟਮ ਪ੍ਰੋਂਪਟਾਂ, ਉਪਲਬਧ ਟੂਲਸ ਆਦਿ ਵਿੱਚ ਅੰਤਰ ਦੇ ਕਾਰਨ ਪ੍ਰੋਡਕਸ਼ਨ ChatGPT ਨਾਲੋਂ ਥੋੜ੍ਹਾ ਵੱਖਰਾ ਆਉਟਪੁੱਟ ਪ੍ਰਦਾਨ ਕਰ ਸਕਦੇ ਹਨ। ਪ੍ਰਤੀਯੋਗੀ ਮਾਡਲਾਂ ਦੇ ਮੁਲਾਂਕਣ ਜਨਤਕ ਤੌਰ 'ਤੇ ਉਪਲਬਧ ਰਿਪੋਰਟਾਂ ਵਿੱਚੋਂ ਲਏ ਗਏ ਸਨ। ਜਦੋਂ Claude Fable 5.1 ਦੇ ਸਕੋਰ ਉਪਲਬਧ ਨਹੀਂ ਸਨ, ਤਾਂ Claude Fable 5 ਦੇ ਸਕੋਰ ਦਰਜ ਕੀਤੇ ਗਏ ਸਨ।

ਲੇਖਕ

OpenAI