GPT‑6 Sol ਅਤੇ Luna ਪੇਸ਼ ਹਨ
ਤੁਹਾਡੇ ਰੋਜ਼ਾਨਾ ਦੇ ਕੰਮ ਵਿੱਚ ਅਤਿ-ਆਧੁਨਿਕ ਇੰਟੈਲੀਜੈਂਸ ਲਿਆਉਣ ਦੇ ਹੋਰ ਵੀ ਕਈ ਤਰੀਕੇ।
ਇਸ ਮਹੀਨੇ ਦੇ ਸ਼ੁਰੂ ਵਿੱਚ, ਅਸੀਂ ਦੁਨੀਆ ਦਾ ਸਭ ਤੋਂ ਇੰਟੈਲੀਜੈਂਟ ਅਤੇ ਅਨੁਕੂਲਿਤ ਮਾਡਲ, GPT‑6 Astra, ਪੇਸ਼ ਕੀਤਾ ਸੀ। ਸਭ ਤੋਂ ਮੰਗ ਵਾਲੇ ਅਤੇ ਮਹੱਤਵਪੂਰਨ ਪ੍ਰੋਜੈਕਟਾਂ ਲਈ ਅਜੇ ਵੀ Astra ਦੀ ਪੂਰੀ ਸਮਰੱਥਾ ਦੀ ਲੋੜ ਪੈਂਦੀ ਹੈ, ਪਰ ਕੰਮ ਵੱਖ-ਵੱਖ ਪੈਮਾਨਿਆਂ, ਰਫ਼ਤਾਰਾਂ ਅਤੇ ਬਜਟਾਂ 'ਤੇ ਹੁੰਦਾ ਹੈ।
ਇਸੇ ਲਈ ਅਸੀਂ GPT‑6 Sol ਅਤੇ GPT‑6 Luna ਨਾਲ GPT‑6 ਪਰਿਵਾਰ ਦਾ ਵਿਸਤਾਰ ਕਰ ਰਹੇ ਹਾਂ। ਜਿੱਥੇ GPT‑6 Astra ਨੇ ਇੰਟੈਲੀਜੈਂਸ ਦੀ ਨਵੀਂ ਪੀੜ੍ਹੀ ਪੇਸ਼ ਕੀਤੀ ਸੀ—ਉੱਥੇ ਹੀ ਇਹ ਮਾਡਲ ਲਾਗਤ ਕੁਸ਼ਲਤਾ ਨੂੰ ਅਤਿ-ਆਧੁਨਿਕ ਪੱਧਰ ਤੱਕ ਲਿਜਾ ਕੇ ਉਸ ਇੰਟੈਲੀਜੈਂਸ ਦੇ ਲਾਭ ਹੋਰ ਲੋਕਾਂ ਤੱਕ ਪਹੁੰਚਾਉਣ ਵਿੱਚ ਮਦਦ ਕਰਦੇ ਹਨ। ਅਸੀਂ GPT‑6 Sol ਅਤੇ Luna ਨੂੰ GPT‑6 Astra ਵਰਗੇ ਤਰੀਕਿਆਂ ਨਾਲ ਸਿਖਲਾਈ ਦਿੱਤੀ ਹੈ, ਜਿਸ ਨਾਲ ਪੇਸ਼ੇਵਰ ਕੰਮ, ਤੱਥਾਂ ਦੀ ਸਚਾਈ, ਕੋਡਿੰਗ, ਕੰਪਿਊਟਰ ਦੀ ਵਰਤੋਂ ਅਤੇ ਅਨੁਕੂਲਤਾ ਵਿੱਚ Astra ਦੀ ਅਤਿ-ਆਧੁਨਿਕ ਕਾਰਗੁਜ਼ਾਰੀ ਨੂੰ ਤੇਜ਼ ਅਤੇ ਵਧੇਰੇ ਕਿਫ਼ਾਇਤੀ ਮਾਡਲਾਂ ਤੱਕ ਪਹੁੰਚਾਇਆ ਗਿਆ ਹੈ।
GPT‑6 ਮਾਡਲ ਲਾਗਤ–ਇੰਟੈਲੀਜੈਂਸ ਦੇ ਸੰਤੁਲਨ ਵਿੱਚ ਮੋਹਰੀ ਹਨ, ਅਤੇ ਹਰ ਪੱਧਰ 'ਤੇ ਸ਼ਾਨਦਾਰ ਸਮਰੱਥਾਵਾਂ ਨੂੰ ਅਜਿਹੇ ਬੁਨਿਆਦੀ ਢਾਂਚੇ ਨਾਲ ਜੋੜਦੇ ਹਨ ਜੋ ਵੱਡੇ ਪੈਮਾਨੇ 'ਤੇ ਇਨ੍ਹਾਂ ਨੂੰ ਕੁਸ਼ਲਤਾ ਨਾਲ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਕੈਸ਼ਿੰਗ ਅਤੇ ਇਨਫਰੈਂਸ ਵਿੱਚ ਸੁਧਾਰਾਂ ਨਾਲ ਅਸੀਂ ਇਨ੍ਹਾਂ ਮਾਡਲਾਂ ਨੂੰ ਘੱਟ ਲਾਗਤ 'ਤੇ ਮੁਹੱਈਆ ਕਰਵਾ ਸਕਦੇ ਹਾਂ, ਅਤੇ GPT‑5.6 ਦੀ ਪ੍ਰਚਾਰਕ ਕੀਮਤ ਦੇ ਮੁਕਾਬਲੇ Sol ਅਤੇ Luna ਦੀਆਂ API ਕੀਮਤਾਂ 50% ਘਟਾ ਕੇ ਅਸੀਂ ਇਹ ਬਚਤ ਸਿੱਧੇ ਵਰਤੋਂਕਾਰਾਂ ਅਤੇ ਗਾਹਕਾਂ ਤੱਕ ਪਹੁੰਚਾ ਰਹੇ ਹਾਂ। ਇਹ ਸਾਰੇ ਸੁਧਾਰ ਮਿਲ ਕੇ ਉੱਨਤ AI ਨੂੰ ਰੋਜ਼ਾਨਾ ਦੇ ਹੋਰ ਕੰਮਾਂ ਅਤੇ ਵੱਡੇ ਪੈਮਾਨੇ ਦੀਆਂ ਐਪਲੀਕੇਸ਼ਨਾਂ ਲਈ ਵਿਹਾਰਕ ਬਣਾਉਂਦੇ ਹਨ।
ਮਾਡਲ | ਇਨਪੁੱਟ | ਆਉਟਪੁੱਟ | ਕੀਮਤ ਵਿੱਚ ਕਟੌਤੀ |
GPT‑6 Sol | $4 → $2 | $20 → $10 | 50% ਸਸਤਾ |
GPT‑6 Luna | $0.20 → $0.10 | $1.20 → $0.50 | 50% ਸਸਤਾ |
ਕੀਮਤਾਂ ਪ੍ਰਤੀ 10 ਲੱਖ ਟੋਕਨ ਹਨ।
GPT‑6 Astra ਹਰ ਪੱਖੋਂ ਸਾਡਾ ਸਭ ਤੋਂ ਵਧੀਆ ਮਾਡਲ ਬਣਿਆ ਹੋਇਆ ਹੈ। ਜਦੋਂ ਤੁਹਾਨੂੰ ਸਭ ਤੋਂ ਵਧੀਆ ਨਤੀਜੇ ਅਤੇ ਬਿਨਾਂ ਕਿਸੇ ਸਮਝੌਤੇ ਵਾਲਾ ਅਨੁਭਵ ਚਾਹੀਦਾ ਹੋਵੇ ਤਾਂ ਇਸਨੂੰ ਚੁਣੋ।
GPT‑6 Sol ਅਤੇ Luna ਉਨ੍ਹਾਂ ਮਾਡਲਾਂ ਵਿੱਚ ਇੰਟੈਲੀਜੈਂਸ ਦੇ ਸੁਧਾਰ ਅਤੇ ਲਾਗਤ-ਕੁਸ਼ਲਤਾ ਲਿਆਉਂਦੇ ਹਨ ਜਿਨ੍ਹਾਂ ਨੂੰ ਤੁਸੀਂ ਪਹਿਲਾਂ ਹੀ ਜਾਣਦੇ ਹੋ ਅਤੇ ਗੁੰਝਲਦਾਰ ਕੰਮਾਂ ਨੂੰ ਪੂਰਾ ਕਰਨ ਲਈ ਸਭ ਤੋਂ ਵੱਧ ਉਪਯੋਗੀ ਸਮਰੱਥਾਵਾਂ ਵਿੱਚ ਵਰਤਦੇ ਹੋ।
GPT‑6 Sol ਔਖੇ ਕੰਮਾਂ ਨੂੰ ਸੰਭਾਲ ਸਕਦਾ ਹੈ ਜਦੋਂ ਕਿ ਇਹ ਤੁਹਾਨੂੰ ਹਾਈ ਵਰਤੋਂ ਸੀਮਾ ਅਤੇ ਘੱਟ ਲਾਗਤ ਨਾਲ ਵਾਰ-ਵਾਰ ਸੁਧਾਰ ਕਰਨ ਲਈ ਵਧੇਰੇ ਖੁੱਲ੍ਹ ਦਿੰਦਾ ਹੈ, ਅਤੇ ਸਮਾਨ ਕੀਮਤ ਵਾਲੇ ਮੁਕਾਬਲੇਬਾਜ਼ ਮਾਡਲਾਂ ਦੇ ਮੁਕਾਬਲੇ ਵਧੇਰੇ ਇੰਟੈਲੀਜੈਂਸ ਤੇ ਬਿਹਤਰ ਨਤੀਜੇ ਪੇਸ਼ ਕਰਦਾ ਹੈ।
ਐਪਾਂ ਵਿੱਚ ਕਾਰੋਬਾਰੀ ਕਾਰਜ-ਪ੍ਰਵਾਹਾਂ ਦੀ ਜਾਂਚ ਕਰਨ ਵਾਲੇ AutomationBench 'ਤੇ, xhigh ਕੋਸ਼ਿਸ਼ ਵਾਲਾ GPT‑6 Sol ਵੱਧ ਤੋਂ ਵੱਧ ਕੋਸ਼ਿਸ਼ ਵਾਲੇ Claude Opus 5 ਨਾਲੋਂ ਬਿਹਤਰ ਪ੍ਰਦਰਸ਼ਨ ਕਰਦਾ ਹੈ, ਅਤੇ ਇਹ Opus 5 ਦੀ ਪ੍ਰਤੀ ਟਾਸਕ ਲਾਗਤ ਦੇ ਸਿਰਫ਼ 9% ਖਰਚੇ 'ਤੇ ਹੁੰਦਾ ਹੈ। ਹਾਈ ਕੋਸ਼ਿਸ਼ 'ਤੇ, GPT‑6 Luna ਆਪਣੇ ਪਿਛਲੇ ਮਾਡਲ ਨਾਲੋਂ 5.4 ਪ੍ਰਤੀਸ਼ਤ ਅੰਕਾਂ ਦਾ ਬਿਹਤਰ ਪ੍ਰਦਰਸ਼ਨ ਦਿੰਦਾ ਹੈ, ਜਦਕਿ ਪ੍ਰਤੀ ਟਾਸਕ ਲਾਗਤ 58% ਘੱਟ ਹੈ।
AutomationBench 1.0.6(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ)ਵਿੱਚ, AI ਏਜੰਟਾਂ ਨੂੰ ਵਿਕਰੀ, ਮਾਰਕੀਟਿੰਗ, ਸੰਚਾਲਨ, ਸਹਾਇਤਾ, ਵਿੱਤ ਅਤੇ ਮਨੁੱਖੀ ਸਰੋਤਾਂ (HR) ਦੇ 47 ਟੂਲਸ ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਸ਼ੁਰੂ ਤੋਂ ਅੰਤ ਤੱਕ ਦੇ ਕਾਰਜ-ਪ੍ਰਵਾਹਾਂ 'ਤੇ ਪਰਖਿਆ ਜਾਂਦਾ ਹੈ। Claude Fable 5.1 ਲਈ ਡਾਟਾ ਪੁਆਇੰਟ ਇਸਦੀ ਅਸਲ ਲਾਗਤ ਨੂੰ ਘੱਟ ਦਰਸਾਉਂਦਾ ਹੈ ਕਿਉਂਕਿ ਇਸ ਵਿੱਚ ਲਗਭਗ 40% ਕੰਮਾਂ ਦੌਰਾਨ ਵਰਤੇ ਗਏ Opus 5 ਵਿਕਲਪਾਂ ਦੀ ਲਾਗਤ ਸ਼ਾਮਲ ਨਹੀਂ ਹੈ।
GPT‑6 Sol, Claude Fable 5.1 ਨੂੰ ਵੀ ਕਿਤੇ ਘੱਟ ਲਾਗਤ 'ਤੇ ਪਿੱਛੇ ਛੱਡ ਦਿੰਦਾ ਹੈ, ਅਤੇ ਇੱਥੋਂ ਤੱਕ ਕਿ ਘੱਟ-ਕੋਸ਼ਿਸ਼ ਵਾਲੇ GPT‑6 Astra ਨਾਲੋਂ ਵੀ ਬਿਹਤਰ ਪ੍ਰਦਰਸ਼ਨ ਕਰਦਾ ਹੈ।
ਮਾਡਲ (ਅਤੇ ਕੋਸ਼ਿਸ਼) | ਸਕੋਰ | ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ |
|---|---|---|
GPT‑6 Sol (xhigh) | 33.2% | $0.27 |
GPT‑6 Astra (ਘੱਟ) | 30.3% | GPT‑6 Sol ਦਾ 3.9 ਗੁਣਾ |
Claude Opus 5 (Max) | 26.9% | GPT‑6 Sol ਦਾ 11.1 ਗੁਣਾ |
Opus 5 ਫਾਲਬੈਕ ਸਮੇਤ Claude Fable 5.1 (Max) | 31.4% | GPT‑6 Sol ਦਾ >8.9 ਗੁਣਾ (ਵਿਕਲਪ ਦੀ ਲਾਗਤ ਨਹੀਂ ਦੱਸੀ ਗਈ) |
ਜਟਿਲ ਪੇਸ਼ੇਵਰ ਕਾਰਜ-ਪ੍ਰਵਾਹਾਂ ਵਿੱਚ ਏਜੰਟਾਂ ਦਾ ਮੁਲਾਂਕਣ ਕਰਨ ਵਾਲੇ Agents’ Last Exam 'ਤੇ ਵੱਧ ਤੋਂ ਵੱਧ ਕੋਸ਼ਿਸ਼ ਵਾਲੇ GPT‑6 Sol ਦਾ ਸਕੋਰ 56.4% ਹੈ, ਜੋ ਕਿ ਇਸ ਮੁਲਾਂਕਣ ਵਿੱਚ Claude Opus 5 ਦੇ ਸਭ ਤੋਂ ਹਾਈ ਸਕੋਰ ਤੋਂ ਵੱਧ ਹੈ, ਜਦਕਿ ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ 60% ਘੱਟ ਹੈ।
Agents’ Last Exam V1(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ)ਵਿੱਚ, AI ਏਜੰਟਾਂ ਦਾ ਮੁਲਾਂਕਣ ਲੰਬੇ ਸਮੇਂ ਵਾਲੇ ਅਤੇ ਆਰਥਿਕ ਤੌਰ 'ਤੇ ਕੀਮਤੀ ਕਾਰਜਾਂ 'ਤੇ ਕੀਤਾ ਜਾਂਦਾ ਹੈ ਜੋ 55 ਉਪ-ਉਦਯੋਗਾਂ ਵਿੱਚ ਫੈਲੇ ਹੋਏ ਹਨ, ਅਤੇ ਕੰਪਿਊਟਰ 'ਤੇ ਕੀਤੇ ਜਾਣ ਵਾਲੇ ਪੇਸ਼ੇਵਰ ਕੰਮਾਂ ਦੇ ਜ਼ਿਆਦਾਤਰ ਪ੍ਰਮੁੱਖ ਖੇਤਰਾਂ ਨੂੰ ਕਵਰ ਕਰਦੇ ਹਨ।
ਕਿਸੇ ਜਵਾਬ ਦੀ ਉਪਯੋਗਤਾ ਤੱਥਾਂ ਨੂੰ ਸਹੀ ਰੱਖਣ 'ਤੇ ਨਿਰਭਰ ਕਰਦੀ ਹੈ, ਅਤੇ ਅਸੀਂ ਤੱਥਾਂ ਦੀ ਭਰੋਸੇਯੋਗਤਾ ਦੇ ਮਾਮਲੇ ਵਿੱਚ ਲਗਾਤਾਰ ਤਰੱਕੀ ਕਰ ਰਹੇ ਹਾਂ। ਸਾਡੇ ਅੰਦਰੂਨੀ ਤੱਥ-ਪਰਕਤਾ ਮੁਲਾਂਕਣ 'ਤੇ, ਜੋ ਕਿ ਅਗਿਆਤ ਅਸਲ-ਸੰਸਾਰ ਦੀਆਂ ਗੱਲਾਂ-ਬਾਤਾਂ 'ਤੇ ਆਧਾਰਿਤ ਹੈ ਜਿੱਥੇ ਵਰਤੋਂਕਾਰਾਂ ਨੇ ਸਾਡੇ ਮਾਡਲਾਂ ਦੀਆਂ ਗਲਤੀਆਂ ਨੂੰ ਨਿਸ਼ਾਨਬੱਧ ਕੀਤਾ ਸੀ, GPT‑6 Sol ਆਪਣੇ ਪਿਛਲੇ ਮਾਡਲ ਨਾਲੋਂ ਲਗਭਗ ਅੱਧੀਆਂ ਗਲਤੀਆਂ ਕਰਦਾ ਹੈ, ਜੋ ਕਿ ਬਹੁਤ ਘੱਟ ਲਾਗਤ 'ਤੇ Astra-ਪੱਧਰ ਦੀ ਭਰੋਸੇਯੋਗਤਾ ਦੇ ਨੇੜੇ ਪਹੁੰਚ ਰਿਹਾ ਹੈ। GPT‑6 Luna ਵਿੱਚ ਵੀ ਕਾਫ਼ੀ ਸੁਧਾਰ ਹੋਇਆ ਹੈ; ਹਾਈ ਕੋਸ਼ਿਸ਼ ਦੇ ਪੱਧਰਾਂ 'ਤੇ, ਇਹ GPT‑5.6 Sol ਦੇ ਮੁਕਾਬਲੇ ਇਸਦੀ ਲਾਗਤ ਦੇ ਲਗਭਗ ਸੌਵੇਂ ਹਿੱਸੇ 'ਤੇ ਹੀ ਉਸ ਨਾਲ ਮੇਲ ਖਾਂਦਾ ਹੈ।
ਇੱਥੇ ਅਸੀਂ ਪਛਾਣ-ਰਹਿਤ ChatGPT ਗੱਲਬਾਤਾਂ ਵਿੱਚ ਤੱਥਕਤਾ ਦਾ ਮੁਲਾਂਕਣ ਕਰਦੇ ਹਾਂ, ਜਿੱਥੇ ਵਰਤੋਂਕਾਰਾਂ ਨੇ ਕਿਸੇ ਪਿਛਲੇ ਮਾਡਲ ਦੀ ਤੱਥ ਸੰਬੰਧੀ ਗਲਤੀ ਦਰਸਾਈ ਸੀ। ਇਹ ਗਲਤੀਆਂ ਪੈਦਾ ਕਰਨ ਵਾਲੀਆਂ ਗੱਲਬਾਤਾਂ ਆਮ ਵਰਤੋਂ ਨੂੰ ਨਹੀਂ ਦਰਸਾਉਂਦੀਆਂ, ਜਿੱਥੇ ਤੱਥ ਸੰਬੰਧੀ ਗਲਤੀਆਂ ਘੱਟ ਹੁੰਦੀਆਂ ਹਨ। ਸਕੋਰਾਂ ਵਿੱਚ ਲੰਬਾਈ ਨੂੰ ਨਿਯੰਤਰਿਤ ਨਹੀਂ ਕੀਤਾ ਗਿਆ ਹੈ; ਹਾਲਾਂਕਿ, ਵੱਖ-ਵੱਖ ਵਿਸਤਾਰ ਪੱਧਰਾਂ ਵਾਲੇ ਸਾਡੇ ਟੈਸਟਾਂ ਵਿੱਚ ਜਵਾਬ ਦੀ ਲੰਬਾਈ ਦਾ ਲਗਭਗ ਕੋਈ ਅਸਰ ਨਹੀਂ ਮਿਲਿਆ।
ਇਸ ਸਾਲ ਕੋਡਿੰਗ ਏਜੰਟਾਂ ਨੇ ਪਹਿਲਾਂ ਨਾਲੋਂ ਕਿਤੇ ਵੱਧ ਗੁੰਝਲਦਾਰੀ, ਦਾਇਰੇ ਅਤੇ ਮਿਆਦ ਵਾਲੇ ਕਾਰਜਾਂ ਨਾਲ ਨਜਿੱਠਣਾ ਸ਼ੁਰੂ ਕਰ ਦਿੱਤਾ ਹੈ। OpenAI ਵਿਖੇ, ਸਾਡਾ ਅੰਦਰੂਨੀ ਇਸਤੇਮਾਲ ਤੇਜ਼ੀ ਨਾਲ ਵਧਿਆ ਹੈ। API ਕੀਮਤਾਂ ਦੇ ਹਿਸਾਬ ਨਾਲ, ਰੋਜ਼ਾਨਾ ਟੋਕਨ ਦੀ ਵਰਤੋਂ ਔਸਤ ਖੋਜਕਾਰ ਲਈ $600 ਤੋਂ ਵੱਧ ਅਤੇ 90ਵੇਂ ਪ੍ਰਤੀਸ਼ਤਕ 'ਤੇ ਮੌਜੂਦ ਖੋਜਕਾਰਾਂ ਲਈ $7,000 ਤੋਂ ਵੱਧ ਹੋ ਗਈ ਹੈ (ਖੋਜ ਵਿੱਚ ਤੇਜ਼ੀ: OpenAI ਦੇ ਅੰਦਰ ਦੀ ਝਲਕ)। ਜਿਵੇਂ-ਜਿਵੇਂ ਕੋਡਿੰਗ ਏਜੰਟ ਲੰਬੇ ਅਤੇ ਵਧੇਰੇ ਮੰਗ ਵਾਲੇ ਕਾਰਜਾਂ ਨੂੰ ਆਪਣੇ ਹੱਥੀਂ ਲੈਂਦੇ ਹਨ, ਲਗਾਤਾਰ ਵਰਤੋਂ ਦੀ ਲਾਗਤ ਹੋਰ ਵੀ ਮਹੱਤਵਪੂਰਨ ਹੋ ਜਾਂਦੀ ਹੈ। GPT‑6 Sol ਅਤੇ Luna ਮਜ਼ਬੂਤ ਕੋਡਿੰਗ ਪ੍ਰਦਰਸ਼ਨ ਨੂੰ ਘੱਟ API ਕੀਮਤਾਂ ਨਾਲ ਜੋੜਦੇ ਹਨ, ਜਿਸ ਨਾਲ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਦੁਹਰਾਈ ਕਰਨ ਲਈ ਵਧੇਰੇ ਗੁੰਜਾਇਸ਼ ਮਿਲਦੀ ਹੈ ਅਤੇ ਟੀਮਾਂ ਨੂੰ ਇਸ ਬਾਰੇ ਵਧੇਰੇ ਉਤਸ਼ਾਹੀ ਹੋਣ ਦਾ ਭਰੋਸਾ ਮਿਲਦਾ ਹੈ ਕਿ ਉਹ Codex ਨੂੰ ਕੀ ਕਰਨ ਲਈ ਕਹਿ ਸਕਦੀਆਂ ਹਨ।
ਕੋਡਿੰਗ ਏਜੰਟਾਂ ਵੱਲੋਂ ਅਸਲ ਕੋਡਬੇਸਾਂ ਵਿੱਚ ਮਰਜ ਕਰਨ ਲਈ ਤਿਆਰ ਤਬਦੀਲੀਆਂ ਤਿਆਰ ਕਰਨ ਦਾ ਮੁਲਾਂਕਣ ਕਰਨ ਵਾਲੇ FrontierCode 'ਤੇ, GPT‑6 Sol ਨੇ GPT‑5.6 Sol ਨਾਲੋਂ ਕਾਫ਼ੀ ਸੁਧਾਰ ਕੀਤਾ ਹੈ ਅਤੇ ਬਹੁਤ ਘੱਟ ਲਾਗਤ 'ਤੇ Claude Fable 5.1 xhigh ਦੇ ਬਰਾਬਰ ਪ੍ਰਦਰਸ਼ਨ ਕਰਨ ਦੇ ਸਮਰੱਥ ਹੈ।
FrontierCode 1.1 Main(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ) ਵਿੱਚ AI ਏਜੰਟ ਅਜਿਹਾ ਕੋਡ ਲਿਖਦੇ ਹਨ ਜਿਸਦਾ ਮੁਲਾਂਕਣ ਸਿਰਫ਼ ਸ਼ੁੱਧਤਾ ਦੇ ਆਧਾਰ 'ਤੇ ਹੀ ਨਹੀਂ, ਸਗੋਂ “ਮਰਜ ਹੋਣ ਯੋਗਤਾ” 'ਤੇ ਵੀ ਕੀਤਾ ਜਾਂਦਾ ਹੈ; ਜਿਵੇਂ ਕਿ ਟੈਸਟ ਦੀ ਗੁਣਵੱਤਾ, ਦਾਇਰੇ ਦੀ ਅਨੁਸ਼ਾਸਨਬੱਧਤਾ, ਕੋਡ ਸਟਾਈਲ, ਅਤੇ ਕੋਡਬੇਸ ਦੇ ਮਿਆਰਾਂ ਦੀ ਪਾਲਣਾ।
ਅਸਲ ਕੋਡਬੇਸਾਂ ਵਿੱਚ ਗੁੰਝਲਦਾਰ ਸੌਫਟਵੇਅਰ-ਇੰਜੀਨੀਅਰਿੰਗ ਕਾਰਜਾਂ 'ਤੇ ਪ੍ਰਦਰਸ਼ਨ ਦਾ ਮੁਲਾਂਕਣ ਕਰਨ ਵਾਲੇ DeepSWE v1.1 'ਤੇ, ਵੱਧ ਤੋਂ ਵੱਧ ਕੋਸ਼ਿਸ਼ ਵਾਲਾ GPT‑6 Sol 68.8% ਸਕੋਰ ਪ੍ਰਾਪਤ ਕਰਦਾ ਹੈ, ਜੋ ਕਿ ਇਸ ਮੁਲਾਂਕਣ ਵਿੱਚ Claude Fable 5 ਦੇ ਸਭ ਤੋਂ ਉੱਚੇ ਸਕੋਰ—xhigh ਕੋਸ਼ਿਸ਼ 'ਤੇ 69.9%—ਤੋਂ ਸਿਰਫ਼ 1.1 ਪ੍ਰਤੀਸ਼ਤ ਅੰਕਾਂ ਦੇ ਫ਼ਰਕ ਨਾਲ ਪਿੱਛੇ ਹੈ, ਜਦਕਿ ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ ਲਗਭਗ 80% ਘੱਟ ਹੈ।
ਵੱਧ ਤੋਂ ਵੱਧ ਕੋਸ਼ਿਸ਼ 'ਤੇ GPT‑6 Luna ਦਾ ਸਕੋਰ 66.6% ਹੈ, ਜੋ ਕਿ ਮੱਧਮ ਕੋਸ਼ਿਸ਼ ਵਾਲੇ Claude Opus 5 ਅਤੇ Fable 5 ਦੇ ਬਰਾਬਰ ਹੈ। ਇਨ੍ਹਾਂ ਤੁਲਨਾਵਾਂ ਵਿੱਚ Luna ਦੀ ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ Opus 5 ਨਾਲੋਂ 93% ਅਤੇ Fable 5 ਨਾਲੋਂ 96% ਘੱਟ ਹੈ।
DeepSWE 1.1(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ)ਵਿੱਚ AI ਏਜੰਟ ਮੌਜੂਦਾ ਅਤੇ ਲੰਬੇ ਸਮੇਂ ਤੱਕ ਫੈਲੇ ਸਾਫਟਵੇਅਰ ਇੰਜੀਨੀਅਰਿੰਗ ਕਾਰਜਾਂ ਨੂੰ ਹੱਲ ਕਰਦੇ ਹਨ।
ਜਿੱਥੇ GPT‑6 Astra ਕੰਪਿਊਟਰ ਦੀ ਵਰਤੋਂ ਲਈ ਦੁਨੀਆ ਦਾ ਸਭ ਤੋਂ ਵਧੀਆ ਮਾਡਲ ਬਣਿਆ ਹੋਇਆ ਹੈ, ਉੱਥੇ ਹੀ GPT‑6 Sol ਅਤੇ Luna ਆਪਣੇ ਪੁਰਾਣੇ ਮਾਡਲਾਂ ਨਾਲੋਂ ਵੱਧ ਲਾਗਤ-ਕੁਸ਼ਲ ਕਾਰਗੁਜ਼ਾਰੀ ਪੇਸ਼ ਕਰਦੇ ਹਨ। OSWorld 2.0 ਆਫ਼ਲਾਈਨ ਵਿੱਚ, xhigh ਕੋਸ਼ਿਸ਼ ਵਾਲਾ GPT‑6Sol, ਮੱਧਮ ਕੋਸ਼ਿਸ਼ ਵਾਲੇ Claude Opus 5 ਦੇ ਲਗਭਗ ਬਰਾਬਰ ਸਕੋਰ ਪ੍ਰਾਪਤ ਕਰਦਾ ਹੈ—60.5% ਬਨਾਮ 60.3%—ਜਦਕਿ ਪ੍ਰਤੀ ਕੰਮ ਲਾਗਤ ਲਗਭਗ 80% ਘੱਟ ਹੈ। GPT‑6 Luna (max) ਆਪਣੇ ਖਰਚੇ ਦੇ ਦੱਸਵੇਂ ਹਿੱਸੇ 'ਤੇ GPT‑5.6 Sol (ਮੀਡੀਅਮ) ਨੂੰ ਪਛਾੜਨ ਦੇ ਸਮਰੱਥ ਹੈ।
OSWorld 2.0(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ)ਵਿੱਚ, AI ਏਜੰਟ ਰੋਜ਼ਾਨਾ ਅਤੇ ਪੇਸ਼ੇਵਰ ਕਾਰਜਾਂ ਨਾਲ ਸੰਬੰਧਿਤ ਲੰਮੀ ਮਿਆਦ ਵਾਲੇ ਕੰਪਿਊਟਰ-ਵਰਤੋਂ ਕਾਰਜ-ਪ੍ਰਵਾਹ ਪੂਰੇ ਕਰਨ ਦੀ ਕੋਸ਼ਿਸ਼ ਕਰਦੇ ਹਨ। ਅਸੀਂ v2026.08.08 ਰਿਲੀਜ਼ ਦੇ ਆਫ਼ਲਾਈਨ ਸੈੱਟ ਲਈ ਅੰਸ਼ਕ ਇਨਾਮ ਦੀ ਰਿਪੋਰਟ ਕਰਦੇ ਹਾਂ।
ਅਸੀਂ GPT‑6 Astra ਦੀ ਬਿਹਤਰ ਸੰਚਾਰ ਸ਼ੈਲੀ ਨੂੰ Sol ਅਤੇ Luna ਵਿੱਚ ਵੀ ਲਿਆਂਦਾ ਹੈ, ਜਿਸ ਬਾਰੇ ਸਾਡਾ ਮੰਨਣਾ ਹੈ ਕਿ ਇਹ ਵਿਸ਼ੇਸ਼ ਤੌਰ 'ਤੇ ਤਕਨੀਕੀ ਅਤੇ ਕੋਡਿੰਗ ਸੰਬੰਧੀ ਗੱਲਬਾਤ ਵਿੱਚ ਸਪੱਸ਼ਟ ਰੂਪ ਵਿੱਚ ਨਜ਼ਰ ਆਵੇਗਾ। ਸਮੱਗਰੀ ਨੂੰ ਗੁਆਏ ਬਿਨਾਂ ਵਧੇਰੇ ਸਪੱਸ਼ਟਤਾ, ਘੱਟ ਅਣਚਾਹੀ ਤਕਨੀਕੀ ਸ਼ਬਦਾਵਲੀ, ਘੱਟ ਅਜੀਬ ਵਾਕਾਂਸ਼, ਘੱਟ ਬੇਲੋੜੇ ਵੇਰਵੇ ਅਤੇ ਕੁੱਲ ਮਿਲਾ ਕੇ ਥੋੜ੍ਹੇ ਛੋਟੇ ਜਵਾਬਾਂ ਦੀ ਉਮੀਦ ਕਰੋ।
ਭਾਵੇਂ ਸ਼ੈਲੀ ਵਿਅਕਤੀਗਤ ਹੁੰਦੀ ਹੈ, ਪਰ ਅਸੀਂ ਇੱਥੇ GPT‑6 Sol ਦੇ ਜਵਾਬ ਨੂੰ ਤਰਜੀਹ ਦਿੰਦੇ ਹਾਂ। ਇਹ ਜਲਦਬਾਜ਼ੀ ਵਿੱਚ ਸਿੱਟੇ 'ਤੇ ਨਹੀਂ ਪਹੁੰਚਦਾ, ਉਨ੍ਹਾਂ ਵੇਰਵਿਆਂ ਨੂੰ ਦੁਹਰਾਉਣ ਵਿੱਚ ਘੱਟ ਸਮਾਂ ਲਾਉਂਦਾ ਹੈ ਜੋ ਪੁੱਛਣ ਵਾਲੇ ਲਈ ਪਹਿਲਾਂ ਹੀ ਸਪੱਸ਼ਟ ਹੋ ਸਕਦੇ ਹਨ (ਉਦਾਹਰਣ ਵਜੋਂ, ਕਿ ਵੈੱਬਸਾਈਟ ਦੇ ਚਾਰ ਪੰਨੇ ਹਨ), ਘੱਟ ਅਸਪਸ਼ਟ ਭਾਸ਼ਾ ਦੀ ਵਰਤੋਂ ਕਰਦਾ ਹੈ (ਜਿਵੇਂ ਕਿ “ਬੈਂਟੋ ਵਰਗਾ ਅਹਿਸਾਸ” ਅਤੇ “ਉਸ ਪ੍ਰਣਾਲੀ ਦੇ ਆਲੇ-ਦੁਆਲੇ ਮੁੜ ਆਕਾਰ ਦੇਣਾ”), ਇਸ ਗੱਲ ਬਾਰੇ ਵਧੇਰੇ ਸਪੱਸ਼ਟ ਹੁੰਦਾ ਹੈ ਕਿ ਇਸ ਨੇ ਕੀ ਜਾਂਚ ਕੀਤੀ ਅਤੇ ਕੀ ਨਹੀਂ, ਅਤੇ ਆਪਣੇ ਚਿੱਤਰ ਟੂਲ ਦੇ ਪ੍ਰੌੰਪਟ ਵਰਗੇ ਲਾਗੂਕਰਨ ਵੇਰਵੇ ਬੇਲੋੜੇ ਤੌਰ 'ਤੇ ਸਾਂਝੇ ਨਹੀਂ ਕਰਦਾ।
ਟੋਕਨ ਦੀਆਂ ਘੱਟ ਕੀਮਤਾਂ ਦੇ ਨਾਲ-ਨਾਲ, ਅਸੀਂ GPT‑6 'ਤੇ ਐਪਲੀਕੇਸ਼ਨਾਂ ਤਿਆਰ ਕਰਨ ਵਾਲੇ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਉਨ੍ਹਾਂ ਦੀਆਂ ਐਪਲੀਕੇਸ਼ਨਾਂ ਦੁਆਰਾ ਮੁੜ ਵਰਤੇ ਜਾਣ ਵਾਲੇ ਸੰਦਰਭ 'ਤੇ ਹੋਰ ਜ਼ਿਆਦਾ ਬਚਤ ਕਰਨ ਵਿੱਚ ਮਦਦ ਕਰ ਰਹੇ ਹਾਂ। ਅਸੀਂ ਉੱਚ ਕੈਸ਼ ਹਿੱਟ ਰੇਟ ਨੂੰ ਆਪਣੇ ਆਪ ਯਕੀਨੀ ਬਣਾਉਣ ਲਈ GPT‑6 ਲਈ ਪ੍ਰੋਂਪਟ ਕੈਸ਼ਿੰਗ ਵਿੱਚ ਸੁਧਾਰ ਕੀਤਾ ਹੈ, ਜਿਸ ਨਾਲ ਏਜੰਟਾਂ ਨੂੰ ਵਧੇਰੇ ਸੰਦਰਭ ਦੀ ਮੁੜ ਵਰਤੋਂ ਕਰਨ, ਤੇਜ਼ੀ ਨਾਲ ਜਵਾਬ ਦੇਣ ਅਤੇ ਕੈਸ਼ ਕੀਤੇ ਇਨਪੁਟ-ਟੋਕਨ ਰੀਡਸ 'ਤੇ 90% ਦੀ ਛੋਟ ਦਾ ਲਾਭ ਲੈਣ ਵਿੱਚ ਮਦਦ ਮਿਲਦੀ ਹੈ।
ਡਿਵੈਲਪਰਾਂ ਕੋਲ ਆਪਣੀ ਕੈਸ਼ਿੰਗ ਕਾਰਗੁਜ਼ਾਰੀ ਨੂੰ ਮਾਪਣ ਅਤੇ ਅਨੁਕੂਲ ਬਣਾਉਣ ਲਈ ਹੋਰ ਵੀ ਤਰੀਕੇ ਹਨ:
ਨਿਗਰਾਨੀ ਅਤੇ ਸਮੱਸਿਆ ਦੀ ਪਛਾਣ। ਪ੍ਰੌਂਪਟ ਕੈਸ਼ਿੰਗ ਡੈਸ਼ਬੋਰਡ(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ) ਦਿਖਾਉਂਦਾ ਹੈ ਕਿ ਕਿੰਨਾ ਇਨਪੁੱਟ ਕੈਸ਼ ਹੋਇਆ ਹੈ ਅਤੇ ਸਮੇਂ ਦੇ ਨਾਲ ਇਹ ਕਿਵੇਂ ਬਦਲਦਾ ਹੈ। ਸਮੱਸਿਆ-ਪਛਾਣ ਟੂਲ(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ) ਕੈਸ਼ਿੰਗ ਲਈ ਖੁੰਝੇ ਗਏ ਮੌਕਿਆਂ ਅਤੇ ਲੋੜੀਂਦੇ ਸੁਧਾਰਾਂ ਨੂੰ ਸਮਝਣ ਵਿੱਚ ਮਦਦ ਕਰਦਾ ਹੈ।
ਕੈਸ਼ ਨੂੰ ਪ੍ਰਭਾਵਿਤ ਕੀਤੇ ਬਿਨਾਂ ਰੀਜ਼ਨਿੰਗ ਕੋਸ਼ਿਸ਼ ਅਤੇ ਟੂਲਸ ਦੀ ਉਪਲਬਧਤਾ ਨੂੰ ਵਿਵਸਥਿਤ ਕਰੋ। ਔਖੇ ਕੰਮਾਂ ਲਈ ਰੀਜ਼ਨਿੰਗ ਕੋਸ਼ਿਸ਼(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ) ਨੂੰ ਵਧਾਓ ਜਾਂ ਸੌਖੇ ਫਾਲੋ-ਅੱਪਸ ਲਈ ਇਸਨੂੰ ਘਟਾਓ, ਅਤੇ ਆਪਣੇ ਏਜੰਟ ਦੀਆਂ ਲੋੜਾਂ ਬਦਲਣ 'ਤੇ ਟੂਲਸ ਨੂੰ ਸਮਰੱਥ ਜਾਂ ਅਸਮਰੱਥ ਕਰੋ(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ)। ਹੁਣ ਦੋਵੇਂ ਕੰਟਰੋਲ ਕੈਸ਼ ਦੀ ਮੁੜ ਵਰਤੋਂ ਲਈ ਪਿਛਲੇ ਸੰਦਰਭ ਨੂੰ ਸੁਰੱਖਿਅਤ ਰੱਖਦੇ ਹਨ।
ਅਨੁਕੂਲ ਬਣਾਓ ਕਿ ਕਿਹੜੇ ਪ੍ਰੀਫਿਕਸ ਕੈਸ਼ ਹੁੰਦੇ ਹਨ। ਸਪੱਸ਼ਟ ਬ੍ਰੇਕਪੁਆਇੰਟ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਇਹ ਚੁਣਨ ਦਿੰਦੇ ਹਨ ਕਿ ਕੈਸ਼ ਕੀਤੇ ਗਏ ਪ੍ਰੋਂਪਟ ਪ੍ਰੀਫਿਕਸ ਕਿੱਥੇ ਖਤਮ ਹੁੰਦੇ ਹਨ। ਇਹ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਕੈਸ਼ ਦੀ ਮੁੜ ਵਰਤੋਂ 'ਤੇ ਵਧੇਰੇ ਕੰਟਰੋਲ ਦਿੰਦਾ ਹੈ ਅਤੇ ਕਾਰਗੁਜ਼ਾਰੀ ਵਿੱਚ ਸੁਧਾਰ ਕਰ ਸਕਦਾ ਹੈ।
GitHub ਮੁਤਾਬਕ, ਪਿਛਲੇ ਕਈ ਮਹੀਨਿਆਂ ਦੌਰਾਨ ਇਨ੍ਹਾਂ ਸੁਧਾਰਾਂ ਨੇ OpenAI ਮਾਡਲਾਂ ਨੂੰ ਕੀਤੀਆਂ ਅਰਬਾਂ ਬੇਨਤੀਆਂ ਵਿੱਚ ਨਵੀਂ ਪ੍ਰਕਿਰਿਆ ਦੀ ਲੋੜ ਵਾਲੇ ਪ੍ਰੌਂਪਟ ਟੋਕਨਾਂ ਦਾ ਹਿੱਸਾ 50% ਤੋਂ ਵੱਧ ਘਟਾਇਆ ਹੈ, ਜਿਸ ਨਾਲ ਕੋਪਾਇਲਟ ਨੂੰ ਤੇਜ਼ੀ ਨਾਲ ਜਵਾਬ ਦੇਣ ਵਿੱਚ ਮਦਦ ਮਿਲੀ ਹੈ।
GPT‑6 Sol ਅਤੇ Luna, ਸਾਡੇ ਹੁਣ ਤੱਕ ਦੇ ਸਭ ਤੋਂ ਵੱਧ ਅਨੁਕੂਲਿਤ ਮਾਡਲ Astra ਨਾਲ ਸ਼ੁਰੂ ਕੀਤੇ ਗਏ ਅਨੁਕੂਲਤਾ ਦੇ ਕੰਮ ਨੂੰ ਅੱਗੇ ਵਧਾਉਂਦੇ ਹਨ। ਸਾਡੇ ਅਨੁਕੂਲਤਾ ਮੁਲਾਂਕਣਾਂ ਵਿੱਚ Sol ਅਤੇ Luna ਦੋਵੇਂ ਆਪਣੇ GPT‑5.6 ਮਾਡਲਾਂ ਨਾਲੋਂ ਬਿਹਤਰ ਪ੍ਰਦਰਸ਼ਨ ਦਿਖਾਉਂਦੇ ਹਨ, ਜਿਸ ਵਿੱਚ ਉਨ੍ਹਾਂ ਦੇ ਕੋਡਿੰਗ ਕੰਮ ਬਾਰੇ ਗੁੰਮਰਾਹਕੁੰਨ ਦਾਅਵਿਆਂ ਦੀ ਘੱਟ ਦਰ ਵੀ ਸ਼ਾਮਲ ਹੈ।
ਹੇਠਾਂ ਦਿੱਤੇ ਮੁਲਾਂਕਣ ਸੋਚ-ਸਮਝ ਕੇ ਚੁਣੌਤੀਪੂਰਨ ਸਥਿਤੀਆਂ ਦੀ ਜਾਂਚ ਕਰਦੇ ਹਨ ਅਤੇ ਆਮ ਵਰਤੋਂ ਵਿੱਚ ਅਸਫਲਤਾ ਦੀਆਂ ਦਰਾਂ ਨੂੰ ਨਹੀਂ ਮਾਪਦੇ। ਪੂਰੇ ਨਤੀਜਿਆਂ ਲਈ ਸਿਸਟਮ ਕਾਰਡ(ਨਵੀਂ ਵਿੰਡੋ ਵਿੱਚ ਖੁੱਲ੍ਹਦਾ ਹੈ) ਦੇਖੋ।
GPT‑6 Sol ਅਤੇ GPT‑6 Luna ਅੱਜ ਤੋਂ ਸਾਰੇ Plus, Pro, Business, Enterprise ਅਤੇ Edu ਵਰਤੋਂਕਾਰਾਂ ਲਈ ChatGPT ਵਰਕ ਅਤੇ Codex ਵਿੱਚ ਉਪਲਬਧ ਹਨ। Free ਅਤੇ Go ਵਰਤੋਂਕਾਰ ਡੈਸਕਟਾਪ ਐਪ ਵਿੱਚ GPT‑6 Luna ਵਰਤ ਸਕਦੇ ਹਨ। ਇਹ ਮਾਡਲ ਹਾਲੇ ਚੈਟ ਵਿੱਚ ਉਪਲਬਧ ਨਹੀਂ ਹਨ। OpenAI API ਵਿੱਚ ਇਹ gpt-6-sol ਅਤੇ gpt-6-luna ਵਜੋਂ ਉਪਲਬਧ ਹਨ।
ਹਰ ਕਿਸੇ ਲਈ ਸੇਵਾ ਨੂੰ ਸਥਿਰ ਰੱਖਣ ਵਾਸਤੇ, ਅਸੀਂ ਦਿਨ ਭਰ ChatGPT ਵਿੱਚ ਇਹਨਾਂ ਮਾਡਲਾਂ ਨੂੰ ਹੌਲੀ-ਹੌਲੀ ਜਾਰੀ ਕਰਨ ਦੀ ਯੋਜਨਾ ਬਣਾਈ ਹੈ। ਜੇਕਰ ਤੁਹਾਨੂੰ ChatGPT ਵਰਕ ਜਾਂ Codex ਵਿੱਚ ਨਵੇਂ ਮਾਡਲ ਨਜ਼ਰ ਨਾ ਆਉਣ, ਤਾਂ ਕਿਰਪਾ ਕਰਕੇ ਬਾਅਦ ਵਿੱਚ ਦੁਬਾਰਾ ਕੋਸ਼ਿਸ਼ ਕਰੋ।
GPT ਦੇ ਮੁਲਾਂਕਣ ਸਾਡੇ ਖੋਜ ਇਨਵਾਇਰਨਮੈਂਟ ਵਿੱਚ ਜਾਂ ਸਾਡੇ API ਰਾਹੀਂ ਕੀਤੇ ਗਏ ਸਨ, ਜੋ ਸਿਸਟਮ ਪ੍ਰੋਂਪਟਾਂ, ਉਪਲਬਧ ਟੂਲਸ ਆਦਿ ਵਿੱਚ ਅੰਤਰ ਦੇ ਕਾਰਨ ਪ੍ਰੋਡਕਸ਼ਨ ChatGPT ਨਾਲੋਂ ਥੋੜ੍ਹਾ ਵੱਖਰਾ ਆਉਟਪੁੱਟ ਪ੍ਰਦਾਨ ਕਰ ਸਕਦੇ ਹਨ। ਪ੍ਰਤੀਯੋਗੀ ਮਾਡਲਾਂ ਦੇ ਮੁਲਾਂਕਣ ਜਨਤਕ ਤੌਰ 'ਤੇ ਉਪਲਬਧ ਰਿਪੋਰਟਾਂ ਵਿੱਚੋਂ ਲਏ ਗਏ ਸਨ। ਜਦੋਂ Claude Fable 5.1 ਦੇ ਸਕੋਰ ਉਪਲਬਧ ਨਹੀਂ ਸਨ, ਤਾਂ Claude Fable 5 ਦੇ ਸਕੋਰ ਦਰਜ ਕੀਤੇ ਗਏ ਸਨ।


