പ്രധാന ഉള്ളടക്കത്തിലേക്ക് നീങ്ങുക
OpenAI

GPT-6.1Sol

Near-Astra intelligence for a fifth of the price

ഏജന്റിക് കോഡിംഗ്, കമ്പ്യൂട്ടർ ഉപയോഗം, പ്രൊഫഷണൽ ജോലികൾ എന്നിവയിൽ അസാധാരണ മികവുള്ള GPT‑6.1 Sol അവതരിപ്പിക്കുന്നു. ഇത് GPT‑6 Sol-ന്റെ മെച്ചപ്പെടുത്തിയ പതിപ്പാണ്. സങ്കീർണ്ണമായ ജോലികളിൽ ഇത് Sol-നെ GPT‑6 Astra-യുടെ പ്രകടനത്തോട് അടുപ്പിക്കുന്നു. Astra-യുടെ സാധാരണ ഇൻപുട്ട്, ഔട്ട്പുട്ട് ടോക്കൺ വിലയുടെ അഞ്ചിലൊന്ന് മാത്രമാണ് ചെലവ്. ഇതുവഴി ഒരേ ബജറ്റിൽ കൂടുതൽ കഴിവുള്ള ഏജന്റുകളെ നിർമിക്കാനും പ്രവർത്തിപ്പിക്കാനും ഡെവലപ്പർമാർക്ക് കഴിയും.

Sol-ന്റെ വിലയിൽ Astra-യോട് അടുത്ത പ്രകടനം നൽകുന്ന GPT‑6.1 Sol, ഇന്ന് ലഭ്യമായതിൽ അതിന്റെ പ്രകടനത്തിന് ഏറ്റവും ചെലവുകുറഞ്ഞ മോഡലാണ്. കാഷ് ചെയ്ത ഇൻപുട്ടിന് പത്ത് ലക്ഷം ടോക്കണുകൾക്ക് വെറും $0.10 ആണ് ചെലവ്—സാധാരണ ഇൻപുട്ട് വിലയിൽ 95% ഇളവ്. ആവർത്തിച്ചുള്ള അഭ്യർഥനകളിൽ സന്ദർഭം വീണ്ടും ഉപയോഗിക്കേണ്ട ഏജന്റിക് ജോലികൾ ഇതുവഴി കൂടുതൽ ചെലവ് കുറച്ച് ചെയ്യാം.

മൊത്തത്തിലുള്ള കഴിവിൽ GPT‑6 Astra തന്നെയാണ് ഞങ്ങളുടെ ഏറ്റവും മികച്ച അത്യാധുനിക മോഡൽ. പ്രധാന ജോലികൾ കൂടുതൽ തവണ ചെയ്യാൻ ആഗ്രഹിക്കുന്ന ഉപയോക്താക്കൾക്കും വലിയ തോതിൽ ആപ്ലിക്കേഷനുകൾ നിർമിച്ച് പ്രവർത്തിപ്പിക്കുന്ന എപിഐ ഉപഭോക്താക്കൾക്കും GPT‑6.1 Sol കഴിവും ചെലവും തമ്മിൽ പുതിയൊരു സന്തുലനം നൽകുന്നു.

മൂന്ന് മോഡൽ കാർഡുകൾ: GPT-6 Astra, മികച്ച ഫലങ്ങൾക്കായുള്ള ഞങ്ങളുടെ ഏറ്റവും ബുദ്ധിശേഷിയുള്ള മോഡൽ, ഇൻപുട്ട് $10, ഔട്ട്പുട്ട് $50, കാഷ് ചെയ്ത ഇൻപുട്ട് $1; GPT-6.1 Sol, അഞ്ചിലൊന്ന് വിലയിൽ Astra-യോട് അടുത്ത ബുദ്ധിശേഷി, ഇൻപുട്ട് $2, ഔട്ട്പുട്ട് $10, കാഷ് ചെയ്ത ഇൻപുട്ട് $0.10; GPT-6 Luna, ദൈനംദിന ജോലികൾ വലിയ തോതിൽ വേഗത്തിലും കാര്യക്ഷമമായും ചെയ്യാൻ, ഇൻപുട്ട് $0.10, ഔട്ട്പുട്ട് $0.50, കാഷ് ചെയ്ത ഇൻപുട്ട് $0.01.

വിവിധ ജോലികളിൽ കൂടുതൽ കഴിവുള്ള Sol

കോഡ് എഴുതലും പിശക് തിരുത്തലും മുതൽ രേഖകൾ മനസ്സിലാക്കലും പല ഘട്ടങ്ങളുള്ള ബിസിനസ് പ്രവാഹങ്ങൾ നടപ്പാക്കലും വരെ, സങ്കീർണമായ പ്രൊഫഷണൽ ജോലികളിൽ GPT‑6 Sol-നെക്കാൾ ഗണ്യമായ മെച്ചം GPT‑6.1 Sol നൽകുന്നു. ഈ മൂല്യനിർണയങ്ങളിൽ പലതിലും ഗണ്യമായി കുറഞ്ഞ ചെലവിൽ ഇത് GPT‑6 Astra-യുടെ പ്രകടനത്തോട് അടുക്കുന്നു.

കോഡിംഗ്

യഥാർഥ കോഡ് ശേഖരങ്ങളിലെ സങ്കീർണ സോഫ്റ്റ്‌വെയർ എൻജിനീയറിംഗ് ജോലികൾ വിലയിരുത്തുന്ന DeepSWE v1.1-ൽ, ഏകദേശം അഞ്ചിലൊന്ന് ചെലവിൽ GPT‑6.1 Sol, GPT‑6 Astra-യ്ക്കൊപ്പമെത്തുന്നു. കുറഞ്ഞ റീസണിംഗ് ശ്രമനിലയിലും ചെലവിലും GPT‑6 Sol-ന്റെ മികച്ച സ്കോറിനെ 6.4 ശതമാന പോയിന്റിന് മറികടക്കുകയും ചെയ്യുന്നു.

DeepSWE 1.1⁠⁠(പുതിയ വിൻഡോയിൽ തുറക്കുന്നു) എന്ന പരീക്ഷണത്തിൽ, നിർമിതബുദ്ധി ഏജന്റുകൾ പുതുതായി തയ്യാറാക്കിയതും ദീർഘമായ പ്രവർത്തനക്രമങ്ങൾ ആവശ്യപ്പെടുന്നതുമായ സോഫ്റ്റ്‌വെയർ എൻജിനീയറിങ് ജോലികൾ നിർവഹിക്കുന്നു.

പ്രൊഫഷണൽ ജോലികൾ

പട്ടികകൾ, ചാർട്ടുകൾ, രേഖാചിത്രങ്ങൾ, സൂക്ഷ്മവിവരങ്ങൾ എന്നിവയുള്ള സങ്കീർണ പിഡിഎഫ് രേഖകൾ ഉപയോഗിച്ച് മോഡലുകൾ പ്രൊഫഷണൽ ചോദ്യങ്ങൾക്ക് എത്ര കൃത്യമായി ഉത്തരം നൽകുന്നുവെന്ന് GDP.pdf അളക്കുന്നു. പരീക്ഷിച്ച റീസണിംഗ് ക്രമീകരണങ്ങളിലെല്ലാം, പകരം സംവിധാനങ്ങളോടെയുള്ള Opus 5.5-നെക്കാൾ ഉയർന്ന സ്കോർ, ഓരോ ജോലിക്കും പകുതിയിൽ താഴെ ചെലവിൽ GPT‑6.1 Sol നേടുന്നു. ഓരോ ജോലിക്കും ഏകദേശം അഞ്ചിലൊന്ന് ചെലവിൽ GPT‑6 Astra-യുടെ മുൻനിര പ്രകടനത്തോടും ഇത് അടുക്കുന്നു.

GDP.pdf⁠(പുതിയ വിൻഡോയിൽ തുറക്കുന്നു) എന്ന പരീക്ഷണത്തിൽ, ധനകാര്യം, ആരോഗ്യപരിചരണം, നിയമം എന്നിവയിലെയും മറ്റ് ഏഴ് തൊഴിൽമേഖലകളിലെയും പ്രവർത്തനക്രമങ്ങളിൽ നിന്നെടുത്ത സങ്കീർണമായ പിഡിഎഫ് രേഖകളെക്കുറിച്ചുള്ള യഥാർഥ സാഹചര്യങ്ങളിലെ ചോദ്യങ്ങൾക്ക് മാതൃകകൾ ഉത്തരം നൽകണം.

പല ഘട്ടങ്ങളുള്ള ബിസിനസ് പ്രവാഹങ്ങൾ ഏജന്റുകൾ കൃത്യമായി പൂർത്തിയാക്കുന്നുണ്ടോ എന്ന് അളക്കുന്ന AutomationBench-ൽ, മാധ്യമം റീസണിംഗ് ശ്രമനിലയിൽ GPT‑6.1 Sol, Opus 5.5-നെക്കാൾ 2.2 ശതമാന പോയിന്റ് ഉയർന്ന സ്കോർ നേടുന്നു. ചെലവ് ഏകദേശം മൂന്നിലൊന്നാണ്. അതേ ക്രമീകരണത്തിൽ GPT‑6 Sol-നെക്കാൾ 4.8 ശതമാന പോയിന്റ് ഉയർന്നതാണ് ഈ സ്കോർ.

In AutomationBench 1.0.6⁠⁠(പുതിയ വിൻഡോയിൽ തുറക്കുന്നു), AI agents are tested on end-to-end workflows using 47 tools across sales, marketing, operations, support, finance, and HR. The datapoint for Claude Fable 5.1 understates its actual cost, as it omits the cost of fallbacks, which occurred on ~40% of tasks.

കമ്പ്യൂട്ടർ ഉപയോഗം

കമ്പ്യൂട്ടർ ആപ്ലിക്കേഷനുകളുമായി ഇടപെടേണ്ട ജോലികളിലും GPT‑6.1 Sol ഗണ്യമായ പുരോഗതി കൈവരിക്കുന്നു. സങ്കീർണ്ണമായ കമ്പ്യൂട്ടർ ഉപയോഗ പ്രവാഹങ്ങളിൽ ഏജന്റുകളെ വിലയിരുത്തുന്ന OSWorld 2.0-ന്റെ ഓഫ്‌ലൈൻ സമുച്ചയത്തിൽ, പരമാവധി റീസണിംഗ് ശ്രമനിലയിൽ GPT‑6.1 Sol, GPT‑6 Sol-നെ ഏഴ് ശതമാന പോയിന്റിന് മറികടക്കുന്നു. ചെലവ് പകുതിയിൽ താഴെയാണ്. പരമാവധി റീസണിംഗ് ശ്രമനിലയിൽ Astra-യുടെ സ്കോറിനേക്കാൾ 2.1 ശതമാന പോയിന്റ് മാത്രം പിന്നിലാണ് ഇത്. ഓരോ ജോലിക്കുമുള്ള ചെലവ് ഏകദേശം ഏഴിലൊന്നാണ്.

In OSWorld 2.0⁠⁠(പുതിയ വിൻഡോയിൽ തുറക്കുന്നു), AI agents attempt long-horizon computer-use workflows spanning everyday and professional tasks. We report the partial reward on the offline set from the v2026.08.08 release.

ശാസ്ത്ര ഗവേഷണം

ഡാറ്റ വിശകലനം, സിമുലേഷൻ, സിദ്ധാന്തങ്ങൾ തെളിയിക്കൽ തുടങ്ങിയ ശാസ്ത്രീയ പ്രവർത്തനക്രമങ്ങൾ വിലയിരുത്തുന്ന Terminal-Bench Science 0.1-ൽ, പരമാവധി റീസണിംഗ് ശ്രമനിലയിൽ GPT‑6.1 Sol, GPT‑6 Sol-ന്റെ ഇരട്ടിയിലേറെ സ്കോർ നേടുന്നു. ഓരോ ജോലിക്കുമുള്ള ചെലവ് പകുതിയിൽ താഴെയാണ്. പരമാവധി ശ്രമനിലയിൽ GPT‑6.1 Sol-ന് ഓരോ ജോലിക്കും ശരാശരി $5.47 ചെലവാകുന്നു. Opus 5.5-ന് $23.21, Astra-യ്ക്ക് $23.80 എന്നിങ്ങനെയാണ് ചെലവ്. ഈ രണ്ട് മോഡലുകളേക്കാളും 75%-ലേറെ കുറഞ്ഞ ചെലവിൽ മികച്ച ശാസ്ത്രീയ ശേഷി ഇത് നൽകുന്നു.

പരീക്ഷിച്ച മോഡലുകളിൽ 68.1% എന്ന ഏറ്റവും ഉയർന്ന സ്കോർ ഇപ്പോഴും GPT‑6 Astra-യ്ക്കാണ്. ഏറ്റവും സങ്കീർണ്ണമായ ശാസ്ത്ര ഗവേഷണ ജോലികൾക്ക് അതാണ് ഉപയോഗിക്കേണ്ടത്.

Terminal-Bench Science 0.1⁠(പുതിയ വിൻഡോയിൽ തുറക്കുന്നു) എന്ന പരീക്ഷണത്തിൽ, ഏജന്റുകൾ കോഡും ടെർമിനൽ ഉപകരണങ്ങളും ഉപയോഗിച്ച് ശാസ്ത്ര ഗവേഷണ പ്രവർത്തനക്രമങ്ങൾ പൂർത്തിയാക്കുന്നു. ഡാറ്റ വിശകലനം ചെയ്യുക, സിമുലേഷനുകൾ നടത്തുക, ഡാറ്റയ്ക്ക് യോജിക്കുന്നവിധം മാതൃകകൾ ക്രമീകരിക്കുക എന്നിവ ഇതിൽ ഉൾപ്പെടുന്നു.

വസ്തുതാകൃത്യത

സങ്കീർണ്ണമായ നിർദേശങ്ങളിൽ വസ്തുതാകൃത്യതയും GPT‑6.1 Sol മെച്ചപ്പെടുത്തുന്നു. അതി ഉയർന്ന റീസണിംഗ് ശ്രമനിലയിൽ ഇതിന്റെ വസ്തുതാപിശക് നിരക്ക് 4.1% ആണ്. GPT‑6 Sol-ന്റെ 4.5%-നെക്കാൾ കുറവും അതേ ക്രമീകരണത്തിലെ Astra-യുടെ 4.0%-നോട് അടുത്തതുമാണിത്. ഓരോ ജോലിക്കും Astra-യെക്കാൾ ഏകദേശം 83% ചെലവ് കുറവാണ്.

മുൻ മോഡലിന്റെ പിശക് ഉപയോക്താക്കൾ ചൂണ്ടിക്കാണിച്ചതും, തിരിച്ചറിയൽ വിവരങ്ങൾ നീക്കം ചെയ്തതുമായ സംഭാഷണങ്ങളിൽ, ഒരു വസ്തുതാപരമായ പിശകെങ്കിലും അടങ്ങിയ ഉത്തരങ്ങളുടെ അനുപാതമാണ് ഈ മൂല്യനിർണ്ണയം അളക്കുന്നത്. ബോധപൂർവ്വം തയ്യാറാക്കിയ ഇത്തരം സങ്കീർണ്ണമായ പ്രോംപ്റ്റുകൾ സാധാരണ ഉപയോഗത്തെ പ്രതിഫലിപ്പിക്കുന്നവയല്ല.

മുൻ മോഡലിന്റെ വസ്തുതാപരമായ പിശക് ഉപയോക്താക്കൾ ചൂണ്ടിക്കാട്ടിയ ChatGPT സംഭാഷണങ്ങളിൽ, തിരിച്ചറിയൽ വിവരങ്ങൾ നീക്കിയ ശേഷമാണ് ഞങ്ങൾ വസ്തുതാകൃത്യത വിലയിരുത്തുന്നത്. പിശകുകളിലേക്ക് നയിക്കുന്ന ഈ സംഭാഷണങ്ങൾ സാധാരണ ഉപയോഗത്തെ പ്രതിനിധീകരിക്കുന്നില്ല. സാധാരണ ഉപയോഗത്തിൽ വസ്തുതാപരമായ പിശകുകൾ കൂടുതൽ അപൂർവമാണ്.

GPT‑6.1 Sol സുരക്ഷിതമായി വിന്യസിക്കൽ

ഉദ്ദേശ്യങ്ങളുമായുള്ള പൊരുത്തം വിലയിരുത്തുന്ന ഞങ്ങളുടെ പരിശോധനകളിൽ GPT‑6 Sol-നെക്കാൾ ഗണ്യമായ മെച്ചം GPT‑6.1 Sol കാണിക്കുന്നു. ഇത് അതിനെ GPT‑6 Astra-യോട് കൂടുതൽ അടുപ്പിക്കുന്നു.

GPT‑6.1 Sol അതിന്റെ പരിമിതികൾ കൂടുതൽ തുറന്നുപറയുന്നു. ഉപയോക്താവിന്റെ ഉദ്ദേശ്യവും സുരക്ഷാ നിയന്ത്രണങ്ങളും പാലിക്കുന്നതിൽ കൂടുതൽ വിശ്വസനീയവുമാണ്. തകരാറിലായ തിരയൽ ഉപകരണങ്ങളെക്കുറിച്ച് തുറന്നുപറയൽ, വ്യക്തമായ നിയന്ത്രണങ്ങൾ പാലിക്കൽ, ഏജന്റിക് ജോലികളിൽ അനധികൃത ഫലങ്ങൾ ഒഴിവാക്കൽ എന്നിവയിലെ സങ്കീർണ്ണമായ മൂല്യനിർണയങ്ങളിൽ GPT‑6 Sol-നെക്കാൾ കുറഞ്ഞ പരാജയനിരക്കാണ് ഇത് കാണിക്കുന്നത്. GPT‑6 Astra, GPT‑6 Sol എന്നിവയിലെപ്പോലെ സ്വയമേവ പ്രവർത്തിക്കുന്ന സുരക്ഷാ പരിശോധകനെ മറികടക്കാനുള്ള ശ്രമങ്ങളൊന്നും ഞങ്ങൾ കണ്ടില്ല.

താഴെയുള്ള മൂല്യനിർണയങ്ങൾ ബോധപൂർവം സങ്കീർണ്ണമായ സാഹചര്യങ്ങളാണ് പരീക്ഷിക്കുന്നത്. സാധാരണ ഉപയോഗത്തിലെ പരാജയ നിരക്കല്ല ഇവ അളക്കുന്നത്.

വിലയും ലഭ്യതയും

ഇന്ന് മുതൽ എല്ലാ Plus, Pro, Business, Enterprise, Edu ഉപയോക്താക്കൾക്കും ChatGPT ജോലി, Codex എന്നിവയിൽ GPT‑6.1 Sol ലഭ്യമാണ്. ഈ മോഡലുകൾ ചാറ്റിൽ ഇതുവരെ ലഭ്യമല്ല. ഡെവലപ്പർമാർക്ക് OpenAI എപിഐ വഴി gpt-6.1-sol എന്ന പേരിലും ഇത് ഉപയോഗിക്കാം. ഇതിന്റെ സാധാരണ എപിഐ നിരക്കുകൾ: പത്ത് ലക്ഷം ഇൻപുട്ട് ടോക്കണുകൾക്ക് $2, പത്ത് ലക്ഷം കാഷ് ചെയ്ത ഇൻപുട്ട് ടോക്കണുകൾക്ക് $0.10, പത്ത് ലക്ഷം ഔട്ട്പുട്ട് ടോക്കണുകൾക്ക് $10.

ഇതിനൊപ്പം, GPT‑6 Astra-യെക്കാൾ 8 മടങ്ങ് വരെ വേഗമുള്ള, ലോകത്തിലെ ഏറ്റവും വേഗതയേറിയ അത്യാധുനിക മോഡലായ GPT‑6 Astra Ultrafast, കൂടാതെ GPT‑6.1 Sol Ultrafast എന്നിവയും അവതരിപ്പിക്കുന്നു. ഇവ എപിഐയിൽ ലഭ്യമാണ്. ഏറ്റവും കൂടുതൽ ഉപയോഗം അനുവദിക്കുന്ന, പ്രതിമാസം $500 നിരക്കുള്ള ഞങ്ങളുടെ പുതിയ Pro തലത്തിലെ ഉപയോക്താക്കൾക്ക് ChatGPT ജോലി, Codex എന്നിവയിലും ഇവ ലഭ്യമാണ്. GPT‑6.1 Sol Ultrafast ഉപയോഗിച്ച്, മുമ്പ് GPT‑6 Astra-യ്ക്കുണ്ടായിരുന്ന ഏകദേശം അതേ എപിഐ ചെലവിൽ, 8 മടങ്ങ് വരെ വേഗത്തിൽ Astra-യോട് അടുത്ത ബുദ്ധിശേഷി ഡെവലപ്പർമാർക്ക് ലഭിക്കും.

രചയിതാവ്

OpenAI

ഞങ്ങളുടെ ഗവേഷണ പരിതസ്ഥിതിയിലോ എപിഐ വഴിയോ ആണ് GPT-യുടെ മൂല്യനിർണയം നടത്തിയത്. സിസ്റ്റം നിർദേശങ്ങൾ, ലഭ്യമായ ഉപകരണങ്ങൾ, ശ്രമനിലകൾ തുടങ്ങിയവയിലെ വ്യത്യാസങ്ങൾ മൂലം ഇവയിൽ നിന്നുള്ള ഫലങ്ങൾ പൊതുവിൽ ലഭ്യമായ ChatGPT-യുടേതിൽ നിന്ന് അല്പം വ്യത്യാസപ്പെട്ടേക്കാം. മത്സരിക്കുന്ന മോഡലുകളുടെ മൂല്യനിർണയങ്ങൾ പൊതുവിൽ ലഭ്യമായ റിപ്പോർട്ടുകളിൽ നിന്നെടുത്തതാണ്.